GPT-6.1 Sol iguala a GPT-6 Astra a una quinta parte del precio
GPT 6.1 Sol
OpenAI lanza GPT-6.1 Sol, una mejora de GPT-6 Sol que casi alcanza la inteligencia de GPT-6 Astra en codificación agéntica, uso de computadoras y trabajo profesional, pero a una quinta parte del precio. En DeepSWE v1.1 iguala a Astra con un costo cinco veces menor; en Terminal-Bench Science 0.1 duplica la puntuación de Sol y cuesta $5.47 por tarea frente a $23.80 de Astra. Ya está disponible en ChatGPT Work, Codex y la API.
En Terminal-Bench Science 0.1, GPT-6.1 Sol más que duplica la puntuación de GPT-6 Sol con el máximo esfuerzo de razonamiento a menos de la mitad del costo por tarea.
- proxysna
Todavía tengo que gastarme 200 $ en deepseek este año. No sé qué tipo de uso puede justificar 200 $/mes de openai o anthropic, y ni siquiera hablo de 500 $. Deepseek es más rápido, en mi opinión la diferencia de inteligencia es insignificante y es tan barato que ya no me importa cuánto lo uso. Nunca he alcanzado ninguna cuota diaria/semanal ni nada por el estilo mientras trabajo o trasteo. A estas alturas me da igual estar 6 meses por detrás de la "frontera", puramente por relación calidad-precio, y que le den a qué gobierno en la sombra se queda con mis datos.
- revolvingthrow
Había un modelo llamado Astra-Minor, encontrado en los archivos hace unos días. Asumo que Sol 6.1 es este, como un cambio de nombre de pánico de última hora debido a que Sol 6 fue decepcionante mientras que Opus 5.5 resultó ser realmente fuerte. No puedo explicar de otra manera el lanzamiento de Sol 6, especialmente hace apenas unos días.
- the_duke
El lanzamiento de GPT 6 fue... no muy bueno.
Sol 6 era tan malo que me pasé a Opus 5.5 en exclusiva.
Una regresión enorme comparado con Sol 5.6, a menudo haciendo cosas realmente estúpidas. Lo mismo con Luna.
Incluso Astra es muy poco fiable para programar. Brillante para visión, a veces simplemente genial, pero también hace cosas muy estúpidas a menudo.
Estoy un poco resentido con OpenAI ahora mismo y escéptico de que 6.1 vaya a ser muy diferente.
(Nota: esto es después de haber preferido y promocionado los modelos Codex/OpenAI durante el último medio año)
- minimaxir
> La entrada en caché cuesta solo 0,10 $ por millón de tokens—un 95% menos que el precio de entrada estándar y un 50% menos que el precio de entrada en caché de GPT‑6 Sol
Este es el verdadero gran anuncio. Una caché un 50% más barata que GPT-6 Sol te dará muchísimo más rendimiento en Codex.
- gradus_ad
Es ominoso para la industria y los inversores que el precio de los tokens se esté convirtiendo en el principal campo de batalla. Podría ser la razón de Anthropic para salir a bolsa este año.
- whatifitoldyou
Debo decir que esto de la IA está yendo más o menos como sentía que iría hace aproximadamente un año. Creo que no hay un foso real en los modelos de IA. Es una commodity y los grandes laboratorios previsiblemente han quedado atrapados en una carrera hacia el fondo. No estoy seguro de si esto va a ir mejor o peor para todos nosotros, la gente común. Debo decir que estoy un poco contento, sin embargo, en el sentido de que la "inteligencia" no va a ser controlada y alquilada por una pequeña minoría.
- simonw
Llego un poco tarde con los pelícanos porque estaba haciendo live-blogging de la keynote: https://simonwillison.net/2026/Sep/29/openai-devday-2026-liv...
Aquí están los de GPT-6.1-Sol: https://tools.simonwillison.net/markdown-svg-renderer?url=ht...
No son notablemente diferentes de los pelícanos de la familia GPT-6: https://static.simonwillison.net/static/2026/gpt-pelicans-gr...
- Nevin1901
Me encanta la competencia del libre mercado. Estamos teniendo avances increíbles cada día. Recuerdo cuando los llms costaban un ojo de la cara para una inteligencia decente
- pazimzadeh
¿Alguien me puede explicar por qué en benchmarks como estos un nivel de esfuerzo más alto a menudo tiene una puntuación más baja?
Por ejemplo, GPT-6.1 Sol High obtiene 75,2% en DeepSWE y XHigh obtiene 71,9% y es más caro
https://openai.com/index/introducing-gpt-6-1-sol/#deepswe
Además, ¿cuántas veces probaron cada condición - solo una vez o unas pocas? ¿Están mostrando un promedio de múltiples intentos, etc..?
- phpnode
¿Qué está impulsando el aumento en la cadencia de lanzamientos aquí? Parece que tenemos nuevos modelos cada semana más o menos ahora, ¿es esto RSI?