OpenAI presentó GPT-6.1 Sol como una actualización de GPT-6 Sol enfocada en programación con agentes, trabajo profesional, uso del computador e investigación científica. La compañía sitúa su rendimiento más cerca de GPT-6 Astra en distintas evaluaciones, mientras mantiene los precios de Sol y un costo por tokens de entrada y salida equivalente a una quinta parte de las tarifas estándar de Astra.
Características generales de GPT-6.1 Sol
GPT-6.1 Sol mejora los resultados de GPT-6 Sol en tareas que:
- Requieren escribir y depurar código
- Interpretar documentos complejos
- Cpmpletar procesos de varios pasos mediante herramientas.
No obstante, GPT-6 Astra continúa siendo el modelo de mayor capacidad general de OpenAI, por lo que GPT-6.1 Sol queda ubicado como una alternativa de menor costo para cargas de trabajo en las que no se requiere alcanzar el máximo rendimiento de Astra.
La diferencia también aparece en precisión factual, donde GPT-6.1 Sol registró una tasa de respuestas con al menos un error factual del 4,1 % utilizando razonamiento muy alto, frente al 4,5 % de GPT-6 Sol y el 4,0 % de GPT-6 Astra. OpenAI advierte que esta evaluación utiliza conversaciones seleccionadas por haber provocado errores previamente y que sus resultados no representan el uso habitual.

DeepSWE v1.1 mide ingeniería de software sobre bases de código reales
DeepSWE v1.1 evalúa agentes de IA mediante problemas originales de ingeniería de software que requieren trabajar durante periodos prolongados sobre bases de código reales. El gráfico compara la puntuación conseguida con el costo por tarea para distintas configuraciones de razonamiento de GPT-6.1 Sol, GPT-6 Sol y GPT-6 Astra.
- GPT-6.1 Sol iguala el resultado de GPT-6 Astra con un costo aproximado equivalente a una quinta parte por tarea.
- Frente al mejor resultado de GPT-6 Sol, GPT-6.1 Sol obtiene 6,4 puntos porcentuales adicionales utilizando menos esfuerzo de razonamiento y con menor costo.
- La evaluación busca comprobar la capacidad de los agentes para mantener un trabajo de programación prolongado y resolver cambios concretos dentro de código existente.
En DeepSWE cuanto más arriba está un punto, mejor es el resultado; cuanto más a la derecha, mayor es el costo por tarea. GPT-6.1 Sol obtiene puntuaciones cercanas a las de Astra con un gasto mucho menor.

GDP.pdf mide la capacidad de trabajar con documentos PDF complejos
GDP.pdf utiliza solicitudes procedentes de flujos profesionales y exige que los modelos encuentren y relacionen información dentro de archivos PDF que incluyen texto, tablas, gráficos, diagramas y detalles en letra pequeña. La evaluación incluye documentos de finanzas, salud y derecho, además de otros siete ámbitos profesionales, y relaciona la puntuación obtenida con el costo necesario para completar cada tarea.
- GPT-6.1 Sol supera la puntuación de Opus 5.5 con modelos de respaldo en las configuraciones de razonamiento evaluadas.
- El costo por tarea de GPT-6.1 Sol en esa comparación es inferior a la mitad del registrado para Opus 5.5 con modelos de respaldo.
- Frente a GPT-6 Astra, GPT-6.1 Sol se aproxima a su resultado con un costo por tarea cercano a una quinta parte.

AutomationBench 1.0.6 evalúa flujos empresariales completos mediante herramientas
AutomationBench 1.0.6 mide si un agente puede completar correctamente procesos de varios pasos utilizando 47 herramientas correspondientes a ventas, marketing, operaciones, soporte, finanzas y recursos humanos. La prueba no se limita a responder una pregunta, sino que exige ejecutar un flujo de trabajo completo y mide su resultado frente al costo por tarea.
- Con razonamiento medio, GPT-6.1 Sol supera a Opus 5.5 con modelos de respaldo por 2,2 puntos porcentuales.
- En esa configuración, OpenAI sitúa el costo de GPT-6.1 Sol en aproximadamente un tercio del correspondiente a Opus 5.5.
- Frente a GPT-6 Sol utilizando la misma configuración, GPT-6.1 Sol obtiene 4,8 puntos porcentuales adicionales.
- OpenAI advierte que el punto mostrado para Fable 5.1 con Opus 5 como respaldo subestima su costo real, debido a que el gráfico no incorpora el costo de los modelos de respaldo utilizados en cerca del 40 % de las tareas.
Los agentes de IA deben completar procesos que encadenan varias acciones y herramientas. GPT-6.1 Sol alcanza resultados similares a los de algunas configuraciones más costosas de Opus 5.5 y Astra.*

OSWorld 2.0 mide agentes que operan aplicaciones en un computador
OSWorld 2.0 somete a los agentes a flujos de trabajo prolongados que requieren utilizar aplicaciones informáticas para completar tareas cotidianas y profesionales. OpenAI informa en este caso la recompensa parcial obtenida sobre el conjunto sin conexión correspondiente a la versión publicada el 8 de agosto de 2026.
- Con el máximo esfuerzo de razonamiento, GPT-6.1 Sol supera a GPT-6 Sol por siete puntos porcentuales.
- Esa mejora se obtiene con un costo por tarea inferior a la mitad del registrado para GPT-6 Sol en la comparación presentada.
- Frente a GPT-6 Astra con razonamiento máximo, GPT-6.1 Sol queda 2,1 puntos porcentuales por debajo.
- El costo por tarea de GPT-6.1 Sol en esa comparación corresponde aproximadamente a una séptima parte del costo de Astra.
En esta prueba, la IA realiza acciones dentro de aplicaciones del computador. GPT-6.1 Sol se acerca al mejor resultado de Astra, mientras el costo por tarea es considerablemente menor.

Terminal-Bench Science 0.1 evalúa investigación científica mediante código y terminal
Terminal-Bench Science 0.1 prueba agentes en flujos de investigación científica que requieren trabajar con código y herramientas de terminal, incluidas tareas de análisis de datos, simulación, ajuste de modelos y demostración de teoremas. La evaluación permite comparar tanto la capacidad obtenida como el costo necesario para completar cada tarea.
- Con el máximo esfuerzo de razonamiento, GPT-6.1 Sol obtiene más del doble de la puntuación de GPT-6 Sol.
- GPT-6.1 Sol registra un costo promedio de US$5,47 por tarea con el esfuerzo configurado al máximo.
- Opus 5.5 con modelos de respaldo alcanza un costo promedio de US$23,21 por tarea, mientras GPT-6 Astra llega a US$23,80.
- GPT-6 Astra obtiene la mayor puntuación de los modelos comparados con un 68,1 %, por lo que OpenAI lo mantiene como su opción para las tareas de investigación científica de mayor dificultad.

Precio y disponibilidad de ChatGPT-6.1 Sol
El modelo está disponible en ChatGPT Work y Codex para usuarios Plus, Pro, Business, Enterprise y Edu, además de la API mediante el identificador gpt-6.1-sol, pero todavía no se encuentra disponible en Chat. Su precio estándar en la API es de US$2 por millón de tokens de entrada, US$0,10 por millón de tokens de entrada almacenados en caché y US$10 por millón de tokens de salida.

