GPT-6.1 Sol、Astra級の知能を5分の1の価格で提供

GPT 6.1 Sol

OpenAIがGPT-6 Solのアップグレード版「GPT-6.1 Sol」を発表。エージェント型コーディングやコンピュータ操作、専門業務においてGPT-6 Astraに迫る性能を、Astraの標準入出力トークン価格の5分の1で実現する。キャッシュ入力は100万トークンあたり0.10ドルと、標準入力比で95%安い。ChatGPT WorkとCodexでPlus、Pro、Business、Enterprise、Eduユーザー向けに提供開始。APIではgpt-6.1-solとして利用可能で、入力100万トークンあたり2ドル、出力10ドル。

GPT-6.1 Solは、複雑なソフトウェアエンジニアリングタスクを評価するDeepSWE v1.1において、約5分の1のコストでGPT-6 Astraに匹敵し、より低い推論努力とコストでGPT-6 Solの最高スコアを6.4ポイント上回った。
  1. proxysna

    今年はまだdeepseekに$200も使っていない。openaiやanthropicに月$200、ましてや$500を使う価値があるような使い方なんて想像もつかない。deepseekは速いし、知能の差は些細だと思うし、とにかく安いからもう使用量を気にしていない。仕事でも遊びでも、日次や週次のクォータに引っかかったことは一度もない。今のところ、コスパだけを基準に「フロンティア」から6ヶ月遅れていても構わないし、どの怪しい政府にデータを取られようがどうでもいい。

  2. revolvingthrow

    数日前にファイルの中からAstra-Minorというモデルが見つかった。Sol 6.1はこれのことだと思う。Sol 6が期待外れだった一方でOpus 5.5が非常に強力だったため、土壇場で慌てて名前を変えたんだろう。Sol 6を数日前にリリースした理由は、他に説明のしようがない。

  3. the_duke

    GPT 6のリリースは…ひどかった。Sol 6はあまりに酷くて、完全にOpus 5.5に乗り換えた。Sol 5.6と比べて大きな後退で、しばしば本当に馬鹿げたことをする。Lunaも同じだ。Astraでさえコーディングには非常に信頼できない。ビジョンには素晴らしく、時には本当に凄いが、しばしば非常に愚かなこともする。今はOpenAIに少し不満があるし、6.1が大きく変わるとは懐疑的だ。(注:これはここ半年間Codex/OpenAIモデルを好んで推していた後の話だ)

  4. minimaxir

    > キャッシュされた入力は100万トークンあたりわずか$0.10——標準入力価格より95%安く、GPT‑6 Solのキャッシュ入力価格より50%安い

    これが本当の大発表だ。GPT-6 Solより50%安いキャッシュは、Codexで遥かに多くの距離を稼げる。

  5. gradus_ad

    トークン価格が主戦場になりつつあるのは、業界と投資家にとって不吉な兆候だ。Anthropicが今年IPOする根拠かもしれない。

  6. whatifitoldyou

    このAIの流れは、約1年前に自分が感じていた通り、ほぼそのまま進んでいる。AIモデルに本当の堀はないと思う。コモディティであり、大手ラボは予想通り底辺への競争に巻き込まれている。これが我々一般庶民にとって良くなるのか悪くなるのかは分からない。ただ、「知能」が少数派に管理され貸し出されるものにはならないという点では、少し嬉しい。

  7. simonw

    pelicansの件は遅れてしまった。基調講演をライブブログしていたからね:https://simonwillison.net/2026/Sep/29/openai-devday-2026-liv...

    GPT-6.1-Sol用はこちら:https://tools.simonwillison.net/markdown-svg-renderer?url=ht...

    GPT-6ファミリーのpelicansと特に違いはない:https://static.simonwillison.net/static/2026/gpt-pelicans-gr...

  8. Nevin1901

    自由市場の競争が大好きだ。毎日とんでもない進歩が起きている。まともな知能を得るのにLLMが腕と脚ほどのコストがかかっていた時代を覚えているよ。

  9. pazimzadeh

    これらのベンチマークで、なぜ努力レベルが高い方がスコアが低いことがよくあるのか説明してくれる人はいないだろうか?

    例えば、GPT-6.1 Sol HighはDeepSWEで75.2%、XHighは71.9%でしかもより高価だ。

    https://openai.com/index/introducing-gpt-6-1-sol/#deepswe

    あと、各条件を何回テストしたのか——1回だけか数回か?複数回試行の平均を表示しているのか、など。

  10. phpnode

    ここでのリリース頻度の増加は何が原因なんだ?今やほぼ毎週新しいモデルが出ているようだが、これはRSIなのか?

この日のほかの記事

2026-09-29