Anthropics bestes KI-Modell kämpft um Nutzer, während günstigere Tools boomen
Anthropic's best AI model struggles to attract users as cheaper tools thrive
Anthropics fortschrittlichstes KI-Modell hat Schwierigkeiten, Nutzer anzuziehen, während günstigere Alternativen auf dem Markt boomen. Der Financial Times zufolge verliert das Unternehmen trotz technischer Überlegenheit Marktanteile an preiswertere Konkurrenz. Der Artikel analysiert die Gründe für diese Entwicklung und die strategischen Herausforderungen für Anthropic im Wettbewerb um KI-Anwender.
Anthropics bestes KI-Modell hat Schwierigkeiten, Nutzer anzuziehen, während günstigere Tools boomen.
- pmontra
- a1371
Wo Anthropic es vermasselt hat, war, ihre Monetarisierung so zu behandeln wie ihr Modelltraining. Es stellt sich heraus, dass Erfolg im Experimentieren nicht übertragbar ist.
Sie haben versucht, den höchsten Preis zu finden, den der Markt für SOTA-Modelle zahlt; auf der Verbraucherseite ist das jedoch einfach zu verwirrend und beunruhigend:
"Sie können Fable nur eine Woche lang im Rahmen Ihres Plans nutzen"
"Seien Sie bereit! Sie müssen pro Token bezahlen!"
"Vergessen Sie es! Wir haben es um ein paar Wochen verlängert"
"Moment, jetzt sind es bis zu der Hälfte Ihrer Nutzung"
"Okay, jetzt ist es..."
Die meisten Menschen wollen sich nicht darum kümmern müssen. Wir wollen unsere KI wie Strom – einfach da, egal wie einfach oder schwer es für den Anbieter ist. Sie wollen nicht, dass Ihr Stromversorger kurz davor ist, Ihnen jeden Moment den Strom abzustellen.
Das ist Anthropic. Man hat nicht das Gefühl, dass sie Ihnen einen zuverlässigen Dienst zu einem, wenn auch Premium-, Preis bieten wollen. Es ist ein ständiges Verhandlungsspiel. Das zwingt die Leute dazu, über den Tellerrand des geschlossenen Gartens hinauszuschauen. Dort finden sie Modelle, die in Ordnung sind ... und ohne die Spielchen.
- foxylad
Nicht-LLM-Nutzer hier. Warum? Abgesehen von den ökologischen Problemen bin ich sehr unwohl dabei, meiner Organisation ihre Kronjuwelen an {random_internet__corp} zu geben. Schauen Sie sich an, welche Mühen sie für Trainingsdaten auf sich nehmen – 10 Millionen für Spirit's Anrufprotokolle? Millionen obskurer Bücher zerstören, um sie zu scannen? Sie lassen Methabhängige wie gewissenhaft aussehen.
Ihre Prompts, besonders wenn sie Ihre gesamte Codebasis enthalten, sind _viel_ datenreicher als ein Telefonanruf einer Fluggesellschaft oder ein Roman aus den 1920er Jahren. Also werden sie definitiv darauf trainieren, egal wie viele Kontrollkästchen Sie anklicken, um das zu verhindern. Das ist sowohl ein kommerzielles Risiko als auch eine massive neue Angriffsfläche.
Es sind nicht nur Softwareentwickler; wenn Anwaltskanzleien keine öffentlichen LLM-Prompts _sehr_ sorgfältig kontrollieren, können sie mit einigen saftigen Klagen wegen Vertraulichkeit von Mandanten rechnen. Tatsächlich sollte jede Organisation in einem wettbewerbsintensiven Umfeld besorgt sein: Acme Bolts: "Schreiben Sie mir eine Präsentation für Zoom Construction". Beta Bolts: "Pitcht Acme Bolts bei Zoom Construction?"
Vielleicht ist das ein Grund, warum OpenAI und Anthropic feststellen, dass die Nachfrage schwächer ist, als sie sich wünschen. Und warum Open-Weight-Modelle, die Organisationen auf exklusiver Hardware ausführen können, florieren.
- bentt
Sie haben sich in eine Ecke manövriert. Fable war zu gut und sie haben es mit dem 20-Dollar-Plan verschenkt. Es musste ein großer Schritt von Opus 4.8 sein, um Fortschritt zu zeigen, und Opus 4.8 ist GROSSARTIG beim Programmieren in vielen verschiedenen Bereichen.
Aber sie werden durch die Token-Kosten ruiniert. Sie müssen die Leute dazu bringen, mehr für Token zu zahlen. Also haben sie Fable in den 200-Dollar-Plan verschoben und Opus 5 veröffentlicht. Ich bin misstrauisch gegenüber Opus 5. Es ist größtenteils schlechter als 4.8. Es _scheint_, als hätten sie es beschnitten, um mehr Abstand zwischen ihm und Fable zu schaffen.
Was haben die meisten von uns also getan? Bei Opus 4.8 geblieben. Die Statistiken belegen das. 4.8 dominiert immer noch.
Jetzt stecken sie fest. Wenn sie 4.8 entfernen, werden alle rebellieren. Wenn sie Opus 5.x besser als 4.8 machen, nehmen sie allen den Anreiz, zu Fable zu wechseln und, was am wichtigsten ist, mehr zu zahlen.
Wirklich, alles, was sie tun können, ist, vorerst den Verlust einzustecken und 4.8 für die absehbare Zukunft den Höhepunkt des 20-Dollar-Pro-Plans sein zu lassen, während sie wie verrückt daran arbeiten, Fable SO VIEL besser zu machen, dass es die 200 bis unendlich Dollar verdient, die sie wirklich wollen, dass alle zahlen.
- nl
Wow, die Stimmung hier ist so negativ.
Ich bin im 200-Dollar-Plan (Arbeit zahlt) und habe auch den 20-Dollar-OpenAI-Plan (ich zahle) und halte ein Guthaben auf OpenRouter.
Es gibt nichts so Gutes wie Fable, nicht einmal annähernd.
Ich habe es kürzlich einen 18-stündigen autonomen Umbau eines Projekts durchführen lassen (Umstellung von Spark auf Pandas aufgrund von Leistungs-/Datengrößen-Abwägungen).
Es orchestrierte Opus-Subagenten 18 Stunden lang fehlerfrei. Es hat sogar großartige Arbeit geleistet, die Anzahl der Agenten zu verwalten, um sie innerhalb der 5-Stunden-Budgets zu halten (ich glaube, ich musste es zweimal neu starten).
Nach 18 Stunden habe ich einen /simplify, /code-review, /simplify-Zyklus durchgeführt, der weitere 6 Stunden dauerte.
2 Milliarden Tokens (Mischung aus Opus und Fable), 24 Stunden ununterbrochenes Programmieren und ein fehlerfreies Ergebnis. Das hätte zu API-Preisen 2000 Dollar gekostet und ist jeden Cent wert.
Fables Fähigkeit, andere Modelle bei diesen langfristigen Zielen auf Kurs zu halten, ist so viel besser als alles andere.
Weit davon entfernt, kastriert zu sein, hatte ich noch nie eine Cyber-Verweigerung, und Fables Englisch ist tatsächlich lesbar (anders als Opus 5).
Nebenbei: Obwohl ich es hasse, Opus-5-Englisch zu lesen, ist es meiner Erfahrung nach immer noch ein deutlich besseres Modell als Sol.
Aber ich könnte den Verlust von Opus 5 verkraften, wenn ich stattdessen Sol bekäme. Aber es gibt nichts, was auch nur annähernd an Fable herankommt.
- matheusmoreira
Mythos? Das ist nur für super spezielle Konzerne, du brauchst dich nicht zu bewerben. Fable? Du kannst es nicht einmal falsch ansehen, ohne auf Cybersicherheits-Sperren zu stoßen. Und selbst wenn du daran vorbeikommst, ist es auf <50% Nutzung begrenzt. Ich habe einen Monat gebraucht, um eine Fable-Überprüfung meines Projekts abzuschließen.
So knauserig. Selbst mit OpenAIs jüngsten Nutzungsproblemen sind sie immer noch so viel besser als Anthropic, dass es nicht einmal lustig ist. Habe die Code-Überprüfung mit Sol als Benchmark erneut durchgeführt, und es stellt sich heraus, dass Sols Leistung innerhalb von 70%-90% von Fables liegt. Anthropic hat immer noch das beste Modell, aber was nützt das, wenn ich es kaum nutzen kann?
- madrox
Anthropic hat bei mir jeglichen Goodwill verloren. Alles, von ihren Richtlinien bis zu ihrer Rhetorik, hat eine Atmosphäre von "wir vertrauen dir nicht". Die Art, wie sie mit Nutzern umgingen, die sie für OpenClaw nutzen wollten, hat mir nicht gefallen, und dann war der Fable-Unsinn der letzte Tropfen.
Und sie sind irgendwie schockiert, dass Nutzer dem gegenüber nicht loyal sind. Es geht nicht um Kosten.
- Zigurd
Für viele Programmierer, mich eingeschlossen, funktionieren LLM-basierte Programmieragenten gut genug, um nützlich zu sein, und in einigen Fällen ist es wert, dafür zu zahlen.
Was ich nicht sehe, sind riesige Bereiche der Industrie, die Werte in Höhe von zig bis hundert Milliarden Dollar in LLMs finden. Es gibt keinen Lint oder Compiler, der korrekt erstellte Verträge überprüfen kann. LLMs, die für Anwaltskanzleien nützlich sein sollten, erfordern also viel mehr manuelle Überprüfung ihrer Arbeit als Programmieragenten.
Weniger formale Dokumentenproduktion in anderen Branchen hat wahrscheinlich weniger Struktur. Das könnte in einigen Umgebungen keine Rolle spielen, aber mir fällt spontan kein Beispiel ein.
- dlcarrier
Transformer-Modelle werden schnell zu einem Massenprodukt, und ich vermute, mit der Zeit werden wir sie alle lokal ausführen. Selbst jetzt kann man etwas ziemlich Nützliches auf einer 16-GB-Grafikkarte ausführen, und ich vermute, dass in zehn Jahren Einstiegshardware bessere Modelle ausführen wird, als High-End-Grafikkarten es heute können, da Einstiegshardware besser wird und Modelle effizienter werden.
Das bedeutet nicht, dass gehostete Frontier-Modelle nicht existieren werden, sie werden nur selten sein. Es ist nicht anders als bei jedem anderen Massenmarkt, zum Beispiel sind die meisten Autos billige Massenmodelle, mit seltenen Individuen, die teure Luxusautos kaufen, und Unternehmen, die teure Lastwagen und Spezialausrüstung kaufen.
- semiquaver
Mein Unternehmen konnte Fable immer noch nicht breit zugänglich machen, weil es nicht auf ZDR-Basis verfügbar ist. Das wurde im Artikel nicht erwähnt, aber ich stelle mir vor, dass dieser Faktor nicht irrelevant ist.