OpenAI выпустила GPT-6.1 Sol: почти как Astra, но в пять раз дешевле
GPT 6.1 Sol
GPT-6.1 Sol — обновление GPT-6 Sol, которое приближается к интеллекту GPT-6 Astra в агентном кодинге, работе с компьютером и профессиональных задачах при цене в пять раз ниже. Кэшированный ввод стоит $0.10 за миллион токенов — на 95% дешевле стандартного ввода. Модель уже доступна пользователям Plus, Pro, Business, Enterprise и Edu в ChatGPT Work и Codex, а разработчикам — через API как gpt-6.1-sol. В ближайшие дни обещают режим Ultrafast с генерацией до 8 раз быстрее.
На Terminal-Bench Science 0.1 при максимальном усилии GPT-6.1 Sol стоит в среднем $5.47 за задачу против $23.21 у Opus 5.5 и $23.80 у Astra, обеспечивая серьёзные научные возможности более чем на 75% дешевле любой из этих моделей.
- proxysna
Я до сих пор не потратил 200 долларов на deepseek за этот год. Не уверен, какое использование может оправдать 200 долларов в месяц ни для openai, ни для anthropic, я уже молчу про 500. Deepseek быстрее, разница в интеллекте, на мой взгляд, незначительна, и он настолько дешевле, что мне уже плевать, сколько я его использую. Я ни разу не упирался ни в какие дневные/недельные лимиты, пока работал или что-то мастерил. На данный момент меня устраивает отставание на 6 месяцев от «переднего края», чисто по соотношению цена-качество, и плевать, какое теневое правительство получит мои данные.
- revolvingthrow
Несколько дней назад в файлах нашли модель под названием Astra-Minor. Полагаю, Sol 6.1 — это она, в последнюю минуту панически переименованная из-за того, что Sol 6 вышел слабым, а Opus 5.5 оказался действительно сильным. Я не могу объяснить выпуск Sol 6 как-то иначе, особенно всего несколько дней назад.
- the_duke
Релиз GPT 6 был... не очень.
Sol 6 оказался настолько плох, что я полностью перешёл на Opus 5.5.
Огромный регресс по сравнению с Sol 5.6, часто делает реально тупые вещи. То же самое с Luna.
Даже Astra очень ненадёжна для программирования. Блестяща для зрения, иногда просто великолепна, но тоже часто делает очень глупые вещи.
Я сейчас немного разочарован в OpenAI и скептически настроен, что 6.1 будет сильно отличаться.
(Примечание: это после того, как последние полгода я предпочитал и нахваливал модели Codex/OpenAI)
- minimaxir
> Кэшированный ввод стоит всего $0.10 за миллион токенов — на 95% меньше стандартной цены ввода и на 50% меньше цены кэшированного ввода GPT‑6 Sol
Это и есть настоящее большое объявление. Кэш на 50% дешевле, чем у GPT-6 Sol, даст вам гораздо больше отдачи на Codex.
- gradus_ad
Зловещий знак для индустрии и инвесторов, что цена за токен становится главным полем битвы. Возможно, это причина, по которой Anthropic выходит на IPO в этом году.
- whatifitoldyou
Должен сказать, что эта история с ИИ идёт более или менее так, как я и предполагал примерно год назад. Думаю, в моделях ИИ нет настоящего рва. Это товар, и крупные лаборатории предсказуемо оказались в гонке ко дну. Не уверен, обернётся ли это лучше или хуже для всех нас, простых людей. Должен сказать, я всё же немного рад, что «интеллект» не будет контролироваться и сдаваться в аренду небольшим меньшинством.
- simonw
Я немного опоздал с пеликанами, потому что вёл прямую трансляцию с презентации: https://simonwillison.net/2026/Sep/29/openai-devday-2026-liv...
Вот они для GPT-6.1-Sol: https://tools.simonwillison.net/markdown-svg-renderer?url=ht...
Они заметно не отличаются от пеликанов семейства GPT-6: https://static.simonwillison.net/static/2026/gpt-pelicans-gr...
- Nevin1901
Обожаю конкуренцию на свободном рынке. Мы получаем безумные достижения каждый день. Помню времена, когда LLM стоили целое состояние за приличный интеллект
- pazimzadeh
Может кто-нибудь объяснить, почему на таких бенчмарках более высокий уровень усилий часто даёт более низкий результат?
Например, GPT-6.1 Sol High получает 75.2% на DeepSWE, а XHigh — 71.9% и стоит дороже
https://openai.com/index/introducing-gpt-6-1-sol/#deepswe
И ещё, сколько раз они тестировали каждое условие — один раз или несколько? Они показывают среднее по нескольким попыткам и т.д.?
- phpnode
Что движет ростом частоты релизов? Кажется, теперь новые модели выходят чуть ли не каждую неделю — это RSI?