Anthropicの最高性能AIモデル、安価な競合に押されユーザー獲得に苦戦
Anthropic's best AI model struggles to attract users as cheaper tools thrive
Anthropicの最高性能AIモデルが、より安価な競合ツールの台頭によりユーザー獲得に苦戦している。FTの報道によると、高性能モデルは技術的に優れているものの、コストパフォーマンスを重視するユーザーが低価格の代替品へ流れている。この傾向はAI業界の価格競争の激化を示しており、Anthropicの市場戦略に影響を与える可能性がある。
Anthropicの最高性能AIモデルは、より安価なツールが台頭する中でユーザーを惹きつけるのに苦戦している。
HNでの議論
698- pmontra
- a1371
Anthropicが失敗したのは、収益化をモデルトレーニングと同じように扱ったことだ。実験での成功は転用できないことが判明した。
彼らは市場がSOTAモデルに支払う最高額を見つけようとしてきた。しかし、消費者側から見ると、これはあまりに混乱を招き、不安を煽るものだ。
「Fableはプランの一部として1週間だけ使えます」
「準備を!トークンごとの支払いが始まります!」
「やっぱり、あと数週間延長しました!」
「待って、今度は使用量の半分までです」
「OK、今度は…」
ほとんどの人は気にしたくない。私たちはAIを電気のように欲しい——供給がどれだけ簡単か難しいかに関係なく、ただそこにあるもの。電気会社がいつでも供給を止める寸前でいてほしくない。
それがAnthropicだ。彼らがプレミアムな価格で、信頼できるサービスを提供したいとは感じられない。絶え間ない駆け引きゲームだ。それによって人々は壁に囲まれた庭の外を見るようになる。そこには、まあまあのモデルがあり、しかもそんなごまかしもない。
- foxylad
LLMを使っていない者です。なぜかって?環境問題はさておき、自分の組織の最高機密を{ランダムなインターネット企業}に渡すのは非常に不安です。彼らがトレーニングデータのためにやることを見てください——Spiritの通話記録に1000万ドル?何百万もの入手困難な本をスキャンするために破棄?彼らはメス中毒者よりも無節操に見えます。
あなたのプロンプトは、特にコードベース全体を含む場合、航空会社の電話や1920年代の小説よりもはるかにデータリッチです。だから、どれだけチェックボックスをオンにして止めようとしても、彼らはそれでトレーニングするでしょう。これは商業リスクであり、巨大な新たな攻撃面でもあります。
ソフトウェア開発者だけの問題ではありません。法律事務所が公開LLMのプロンプトを非常に注意深く管理していなければ、クライアントの秘密保持違反で訴えられる可能性があります。実際、競争環境にあるどの組織も心配すべきです:Acme Bolts:「Zoom Construction向けのプレゼンを作って」Beta Bolts:「Acme BoltsがZoom Constructionに提案している?」
これが、OpenAIとAnthropicが需要が思ったより弱いと感じている理由の一部かもしれません。そして、組織が専用ハードウェアで実行できるオープンウェイトモデルが繁栄している理由でもあります。
- bentt
彼らは自分たちを窮地に追い込んだ。Fableはあまりに優れていて、$20プランで無料で提供してしまった。進歩を示すにはOpus 4.8からの大きな飛躍が必要で、Opus 4.8は多くの異なる分野でのコーディングに非常に優れている。
しかし、トークンコストでやられている。人々にもっとトークンにお金を払わせる必要がある。そこで、Fableを$200プランに入れ、Opus 5をリリースした。Opus 5には疑念がある。ほとんど4.8より劣っている。Fableとの差を広げるために意図的に性能を落としたように見える。
それで、私たちのほとんどは何をしたか?Opus 4.8に留まった。統計がそれを裏付けている。4.8がまだ支配的だ。
今、彼らは行き詰まっている。4.8を取り上げたら、みんな怒るだろう。Opus 5.xを4.8より良くしたら、誰もFableに移行する気がなくなり、最も重要なこととして、より多く支払う意欲がなくなる。
本当に、彼らが今できるのは、損失を受け入れて、当面の間4.8を$20プロプランの頂点に据え、その間にFableを本当に$200から無限大の価値に見合うように必死に改善することだけだ。
- motbus3
Fableに対する私の最初の反応は、「これは費用対効果が良い」だった。
しかし、時間が経つにつれて、厳密なガイダンスなしでは、貧弱で脆いソフトウェアを構築することに気づいた。
仕様をすべて書かないといけないなら、コードを書くか、もっと安いモデルを使うかもしれない。
Opus 5とFable 5はかなり期待外れだった。
Sol、Terra、Lunaを使ってみたが、最初の2つは最初のコードレビューに良いと思う。LunaはDeepSeek V4 Flashよりそれほど優れていない。
- matheusmoreira
Mythos?それは超特別な企業専用で、あなたは対象外。Fable?セキュリティのロックアウトに引っかからずに見ることすらできない。たとえそれを乗り越えても、使用量の50%未満に制限されている。Fableのレビューをプロジェクトで完了するのに1ヶ月かかった。
本当にけちだ。OpenAIの最近の使用量問題があっても、Anthropicよりはるかにマシで、笑ってしまうほどだ。Solでコードレビューを再実行してみたところ、SolのパフォーマンスはFableの70%から90%の範囲だった。Anthropicはまだ最高のモデルを持っているが、ほとんど使えないなら何の意味がある?
- nl
うわー、ここでの感情はとてもネガティブだね。
私は$200プラン(仕事で支払い)と$20のOpenAIプラン(自分で支払い)を持っていて、OpenRouterにも残高を維持している。
Fableに匹敵するものは何もない。全然近づくものもない。
最近、プロジェクトの自律的なリビルドを18時間実行させた(パフォーマンス/データサイズのトレードオフの問題でSparkからPandasに移行)。
Opusサブエージェントを18時間完璧にオーケストレーションした。エージェントの数を5時間の予算内に収める管理も見事にやった(2回再起動する必要があったと思う)。
18時間後、/simplify、/code-review、/simplifyのサイクルを実行し、さらに6時間続いた。
20億トークン(OpusとFableの混合)、24時間の継続的なコーディング、そしてバグのない結果。API価格で$2000かかっただろうが、それだけの価値は十分にある。
Fableが他のモデルを軌道に乗せ続ける能力は、これらの長期的な目標に取り組む際、他の何よりもはるかに優れている。
去勢されたどころか、サイバー拒否を受けたことは一度もないし、Fableの英語は実際に読める(Opus 5とは違って)。
余談:Opus 5の英語を読むのは嫌いだが、それでも私の経験ではSolよりも明らかに優れたモデルだ。
しかし、Solが手に入るならOpus 5を失っても構わない。しかし、Fableに近いものは何もない。
- cromka
月額100ドル払って、仕事で必要なときに「Claudeは現在容量がいっぱいです」と言われるのは助からない。
開発者がそれに依存できないなら、不可欠な開発ツールにはできない。彼らは絶対に、より信頼できるサービスに乗り換えるだろう。私にとってそれはCodexだった。
追伸:Claudeは今まさに私にとってダウンしている。
- Zigurd
私を含む多くのコーダーにとって、LLMベースのコーディングエージェントは十分に機能し、役に立ち、場合によっては支払う価値がある。
私が見えないのは、広大な産業分野がLLMに数百億ドルの価値を見出していることだ。契約書が正しく作成されているかチェックできるlintやコンパイラはない。だから、法律事務所に役立つはずのLLMは、コーディングエージェントよりも手作業でのチェックがはるかに多い。
他の業界での形式的でない文書作成は、構造が少ない可能性が高い。それが問題にならない設定もあるかもしれないが、すぐに例を思い浮かべるのは難しい。
- semiquaver
私の会社はまだFableへの広範なアクセスを展開できていない。なぜなら、ZDRベースで利用できないからだ。記事には言及されていなかったが、この要因は無関係ではないと思う。