GPT-6.1 Sol iguala a GPT-6 Astra a una quinta parte del precio

GPT 6.1 Sol

OpenAI lanza GPT-6.1 Sol, una mejora de GPT-6 Sol que casi alcanza la inteligencia de GPT-6 Astra en codificación agéntica, uso de computadoras y trabajo profesional, pero a una quinta parte del precio. En DeepSWE v1.1 iguala a Astra con un costo cinco veces menor; en Terminal-Bench Science 0.1 duplica la puntuación de Sol y cuesta $5.47 por tarea frente a $23.80 de Astra. Ya está disponible en ChatGPT Work, Codex y la API.

En Terminal-Bench Science 0.1, GPT-6.1 Sol más que duplica la puntuación de GPT-6 Sol con el máximo esfuerzo de razonamiento a menos de la mitad del costo por tarea.
  1. proxysna

    Todavía tengo que gastarme 200 $ en deepseek este año. No sé qué tipo de uso puede justificar 200 $/mes de openai o anthropic, y ni siquiera hablo de 500 $. Deepseek es más rápido, en mi opinión la diferencia de inteligencia es insignificante y es tan barato que ya no me importa cuánto lo uso. Nunca he alcanzado ninguna cuota diaria/semanal ni nada por el estilo mientras trabajo o trasteo. A estas alturas me da igual estar 6 meses por detrás de la "frontera", puramente por relación calidad-precio, y que le den a qué gobierno en la sombra se queda con mis datos.

  2. revolvingthrow

    Había un modelo llamado Astra-Minor, encontrado en los archivos hace unos días. Asumo que Sol 6.1 es este, como un cambio de nombre de pánico de última hora debido a que Sol 6 fue decepcionante mientras que Opus 5.5 resultó ser realmente fuerte. No puedo explicar de otra manera el lanzamiento de Sol 6, especialmente hace apenas unos días.

  3. the_duke

    El lanzamiento de GPT 6 fue... no muy bueno.

    Sol 6 era tan malo que me pasé a Opus 5.5 en exclusiva.

    Una regresión enorme comparado con Sol 5.6, a menudo haciendo cosas realmente estúpidas. Lo mismo con Luna.

    Incluso Astra es muy poco fiable para programar. Brillante para visión, a veces simplemente genial, pero también hace cosas muy estúpidas a menudo.

    Estoy un poco resentido con OpenAI ahora mismo y escéptico de que 6.1 vaya a ser muy diferente.

    (Nota: esto es después de haber preferido y promocionado los modelos Codex/OpenAI durante el último medio año)

  4. minimaxir

    > La entrada en caché cuesta solo 0,10 $ por millón de tokens—un 95% menos que el precio de entrada estándar y un 50% menos que el precio de entrada en caché de GPT‑6 Sol

    Este es el verdadero gran anuncio. Una caché un 50% más barata que GPT-6 Sol te dará muchísimo más rendimiento en Codex.

  5. gradus_ad

    Es ominoso para la industria y los inversores que el precio de los tokens se esté convirtiendo en el principal campo de batalla. Podría ser la razón de Anthropic para salir a bolsa este año.

  6. whatifitoldyou

    Debo decir que esto de la IA está yendo más o menos como sentía que iría hace aproximadamente un año. Creo que no hay un foso real en los modelos de IA. Es una commodity y los grandes laboratorios previsiblemente han quedado atrapados en una carrera hacia el fondo. No estoy seguro de si esto va a ir mejor o peor para todos nosotros, la gente común. Debo decir que estoy un poco contento, sin embargo, en el sentido de que la "inteligencia" no va a ser controlada y alquilada por una pequeña minoría.

  7. simonw

    Llego un poco tarde con los pelícanos porque estaba haciendo live-blogging de la keynote: https://simonwillison.net/2026/Sep/29/openai-devday-2026-liv...

    Aquí están los de GPT-6.1-Sol: https://tools.simonwillison.net/markdown-svg-renderer?url=ht...

    No son notablemente diferentes de los pelícanos de la familia GPT-6: https://static.simonwillison.net/static/2026/gpt-pelicans-gr...

  8. Nevin1901

    Me encanta la competencia del libre mercado. Estamos teniendo avances increíbles cada día. Recuerdo cuando los llms costaban un ojo de la cara para una inteligencia decente

  9. pazimzadeh

    ¿Alguien me puede explicar por qué en benchmarks como estos un nivel de esfuerzo más alto a menudo tiene una puntuación más baja?

    Por ejemplo, GPT-6.1 Sol High obtiene 75,2% en DeepSWE y XHigh obtiene 71,9% y es más caro

    https://openai.com/index/introducing-gpt-6-1-sol/#deepswe

    Además, ¿cuántas veces probaron cada condición - solo una vez o unas pocas? ¿Están mostrando un promedio de múltiples intentos, etc..?

  10. phpnode

    ¿Qué está impulsando el aumento en la cadencia de lanzamientos aquí? Parece que tenemos nuevos modelos cada semana más o menos ahora, ¿es esto RSI?

Más de este día

2026-09-29