OpenAI выпустила GPT-6.1 Sol: почти как Astra, но в пять раз дешевле

GPT 6.1 Sol

GPT-6.1 Sol — обновление GPT-6 Sol, которое приближается к интеллекту GPT-6 Astra в агентном кодинге, работе с компьютером и профессиональных задачах при цене в пять раз ниже. Кэшированный ввод стоит $0.10 за миллион токенов — на 95% дешевле стандартного ввода. Модель уже доступна пользователям Plus, Pro, Business, Enterprise и Edu в ChatGPT Work и Codex, а разработчикам — через API как gpt-6.1-sol. В ближайшие дни обещают режим Ultrafast с генерацией до 8 раз быстрее.

На Terminal-Bench Science 0.1 при максимальном усилии GPT-6.1 Sol стоит в среднем $5.47 за задачу против $23.21 у Opus 5.5 и $23.80 у Astra, обеспечивая серьёзные научные возможности более чем на 75% дешевле любой из этих моделей.
  1. proxysna

    Я до сих пор не потратил 200 долларов на deepseek за этот год. Не уверен, какое использование может оправдать 200 долларов в месяц ни для openai, ни для anthropic, я уже молчу про 500. Deepseek быстрее, разница в интеллекте, на мой взгляд, незначительна, и он настолько дешевле, что мне уже плевать, сколько я его использую. Я ни разу не упирался ни в какие дневные/недельные лимиты, пока работал или что-то мастерил. На данный момент меня устраивает отставание на 6 месяцев от «переднего края», чисто по соотношению цена-качество, и плевать, какое теневое правительство получит мои данные.

  2. revolvingthrow

    Несколько дней назад в файлах нашли модель под названием Astra-Minor. Полагаю, Sol 6.1 — это она, в последнюю минуту панически переименованная из-за того, что Sol 6 вышел слабым, а Opus 5.5 оказался действительно сильным. Я не могу объяснить выпуск Sol 6 как-то иначе, особенно всего несколько дней назад.

  3. the_duke

    Релиз GPT 6 был... не очень.

    Sol 6 оказался настолько плох, что я полностью перешёл на Opus 5.5.

    Огромный регресс по сравнению с Sol 5.6, часто делает реально тупые вещи. То же самое с Luna.

    Даже Astra очень ненадёжна для программирования. Блестяща для зрения, иногда просто великолепна, но тоже часто делает очень глупые вещи.

    Я сейчас немного разочарован в OpenAI и скептически настроен, что 6.1 будет сильно отличаться.

    (Примечание: это после того, как последние полгода я предпочитал и нахваливал модели Codex/OpenAI)

  4. minimaxir

    > Кэшированный ввод стоит всего $0.10 за миллион токенов — на 95% меньше стандартной цены ввода и на 50% меньше цены кэшированного ввода GPT‑6 Sol

    Это и есть настоящее большое объявление. Кэш на 50% дешевле, чем у GPT-6 Sol, даст вам гораздо больше отдачи на Codex.

  5. gradus_ad

    Зловещий знак для индустрии и инвесторов, что цена за токен становится главным полем битвы. Возможно, это причина, по которой Anthropic выходит на IPO в этом году.

  6. whatifitoldyou

    Должен сказать, что эта история с ИИ идёт более или менее так, как я и предполагал примерно год назад. Думаю, в моделях ИИ нет настоящего рва. Это товар, и крупные лаборатории предсказуемо оказались в гонке ко дну. Не уверен, обернётся ли это лучше или хуже для всех нас, простых людей. Должен сказать, я всё же немного рад, что «интеллект» не будет контролироваться и сдаваться в аренду небольшим меньшинством.

  7. simonw

    Я немного опоздал с пеликанами, потому что вёл прямую трансляцию с презентации: https://simonwillison.net/2026/Sep/29/openai-devday-2026-liv...

    Вот они для GPT-6.1-Sol: https://tools.simonwillison.net/markdown-svg-renderer?url=ht...

    Они заметно не отличаются от пеликанов семейства GPT-6: https://static.simonwillison.net/static/2026/gpt-pelicans-gr...

  8. Nevin1901

    Обожаю конкуренцию на свободном рынке. Мы получаем безумные достижения каждый день. Помню времена, когда LLM стоили целое состояние за приличный интеллект

  9. pazimzadeh

    Может кто-нибудь объяснить, почему на таких бенчмарках более высокий уровень усилий часто даёт более низкий результат?

    Например, GPT-6.1 Sol High получает 75.2% на DeepSWE, а XHigh — 71.9% и стоит дороже

    https://openai.com/index/introducing-gpt-6-1-sol/#deepswe

    И ещё, сколько раз они тестировали каждое условие — один раз или несколько? Они показывают среднее по нескольким попыткам и т.д.?

  10. phpnode

    Что движет ростом частоты релизов? Кажется, теперь новые модели выходят чуть ли не каждую неделю — это RSI?

Ещё за этот день

2026-09-29