OpenAI presentó GPT-6.1 Sol, una nueva versión de su modelo orientada especialmente a tareas de programación con agentes, uso del ordenador y trabajo profesional. La compañía asegura que el modelo ofrece un rendimiento cercano al de GPT-6 Astra, pero con tarifas considerablemente más bajas para quienes necesitan ejecutar cargas de trabajo a escala.

De acuerdo con la información proporcionada por OpenAI, GPT-6.1 Sol mantiene el enfoque de Sol en eficiencia, pero incorpora mejoras importantes para resolver tareas complejas. Su propuesta busca ofrecer a desarrolladores y empresas más capacidad para crear y ejecutar agentes de inteligencia artificial sin aumentar de forma considerable el presupuesto.
Actualmente, GPT-6 Astra continúa como el modelo de mayor capacidad general, mientras que GPT-6.1 Sol plantea un equilibrio diferente entre rendimiento y costo.
GPT-6.1 Sol mejora en programación
Uno de los principales avances aparece en tareas de ingeniería de software. En DeepSWE v1.1, una evaluación que mide la capacidad de los agentes para resolver problemas complejos en bases de código reales, GPT-6.1 Sol alcanza un rendimiento similar al de GPT-6 Astra, según las pruebas compartidas por OpenAI.
Además, el nuevo modelo supera en 6,4 puntos porcentuales la puntuación obtenida por GPT-6 Sol en esta evaluación, utilizando menos esfuerzo de razonamiento y con un costo menor por tarea.
Este tipo de rendimiento resulta especialmente relevante para aplicaciones que necesitan agentes capaces de analizar código, modificar proyectos y completar tareas de desarrollo durante periodos prolongados.
También mejora para el trabajo profesional
GPT-6.1 Sol también está pensado para tareas que requieren analizar información compleja. En GDP.pdf, una evaluación basada en documentos profesionales que incluyen tablas, gráficos, diagramas y texto pequeño, el modelo se acerca al rendimiento de GPT-6 Astra con un costo considerablemente menor por tarea.
En AutomationBench, que mide la capacidad de los agentes para completar flujos de trabajo empresariales utilizando múltiples herramientas, GPT-6.1 Sol supera a Opus 5.5 en las configuraciones de razonamiento señaladas por OpenAI y mejora en 4,8 puntos porcentuales respecto a GPT-6 Sol con la misma configuración.
Esto coloca al modelo como una alternativa orientada a automatizar procesos de varios pasos en áreas como operaciones, soporte, finanzas, marketing y recursos humanos.
GPT-6.1 Sol también avanza en uso del ordenador
El modelo incorpora mejoras en tareas que requieren interactuar directamente con aplicaciones informáticas. En el conjunto offline de OSWorld 2.0, GPT-6.1 Sol supera a GPT-6 Sol por 7 puntos porcentuales con el máximo esfuerzo de razonamiento.
Además, queda a 2,1 puntos porcentuales de GPT-6 Astra en esa configuración, mientras que el costo por tarea resulta considerablemente menor.
Este tipo de capacidad es importante para los agentes que necesitan navegar interfaces, utilizar aplicaciones y completar flujos de trabajo que normalmente requerirían interacción humana.
Más capacidad para investigación científica
GPT-6.1 Sol también muestra avances en tareas científicas. En Terminal-Bench Science 0.1, evaluación que incluye análisis de datos, simulaciones y demostraciones de teoremas, el modelo obtiene más del doble de la puntuación de GPT-6 Sol con el máximo esfuerzo de razonamiento.
OpenAI señala que GPT-6.1 Sol tiene un costo promedio de 5,47 dólares por tarea, frente a 23,21 dólares de Opus 5.5 y 23,80 dólares de GPT-6 Astra en la configuración analizada.
Sin embargo, GPT-6 Astra continúa encabezando esta evaluación con una puntuación del 68,1 %, por lo que OpenAI mantiene su modelo insignia para las tareas de investigación científica más exigentes.
Te recomendamos: Kate Bishop Avengers Doomsday: el regreso que podría cambiar el futuro de los Vengadores jóvenes
También busca reducir los errores factuales
GPT-6.1 Sol incorpora mejoras en precisión factual cuando se enfrenta a prompts diseñados específicamente para provocar errores. Con un esfuerzo de razonamiento muy alto, registra una tasa de errores del 4,1 %, frente al 4,5 % de GPT-6 Sol y el 4,0 % de GPT-6 Astra en la misma configuración.
OpenAI aclara que esta prueba utiliza conversaciones desidentificadas en las que previamente se había señalado un error factual y que, por sus características, no representa necesariamente el uso cotidiano de los modelos.
GPT-6.1 Sol apuesta por una IA más segura
La compañía también señala mejoras en las evaluaciones de alineación. Según OpenAI, GPT-6.1 Sol es más transparente respecto a sus limitaciones y muestra una mayor capacidad para respetar la intención del usuario y las restricciones de seguridad.
Entre las pruebas se encuentran situaciones relacionadas con herramientas de búsqueda que presentan fallos, restricciones explícitas y tareas de uso del ordenador. En estas evaluaciones, el modelo presenta tasas de fallo inferiores a GPT-6 Sol en varios escenarios analizados.
Precio y disponibilidad de GPT-6.1 Sol
Uno de los principales atractivos es su estructura de precios en la API. El modelo tiene un costo estándar de 2 dólares por millón de tokens de entrada, 0,10 dólares por millón de tokens de entrada en caché y 10 dólares por millón de tokens de salida.
En comparación, las tarifas indicadas para GPT-6 Astra son de 10 dólares por millón de tokens de entrada, 1 dólar por millón de tokens de entrada en caché y 50 dólares por millón de tokens de salida.
GPT-6.1 Sol también está llegando a ChatGPT Work y Codex para usuarios de planes elegibles, aunque su disponibilidad depende del plan y del despliegue correspondiente. OpenAI confirma actualmente que el modelo se está implementando en Work y Codex.
Un nuevo equilibrio entre capacidad y costo
Con GPT-6.1 Sol, OpenAI busca ampliar el acceso a capacidades avanzadas para programación, automatización, uso del ordenador y trabajo profesional sin recurrir necesariamente al modelo de mayor costo.
La propuesta deja a Astra como la opción de mayor capacidad general, mientras que Sol apunta a quienes necesitan ejecutar agentes y flujos de trabajo complejos con mayor frecuencia y con un presupuesto más ajustado.
Para más contenidos como este no olvides seguirnos en nuestras redes sociales: Tiktok, Instagram y Facebook.

