Mercury 2.5: Das größte je trainierte Diffusions-Sprachmodell

Mercury 2.5: Das größte je trainierte Diffusions-Sprachmodell

Inception Labs veröffentlicht Mercury 2.5, das nach eigenen Angaben größte je trainierte Diffusions-Sprachmodell. Es bietet eine um 40 % höhere Intelligenz als Mercury 2, erreicht 1.107 Token pro Sekunde auf NVIDIA-GPUs und verarbeitet Kontexte bis 260.000 Token. Der Preis liegt bei 0,20 $ pro Million Input-Tokens und 0,75 $ pro Million Output-Tokens, zum Start mit 80 % Rabatt. Mercury 2.5 wird in Produktion für Such-, Sprach- und Codierungsanwendungen eingesetzt und zeigt deutliche Latenz- und Kostenverbesserungen, etwa bei OpenCall und Augment Code. Zusätzlich werden Vorschauen von Mercury Voice und Mercury Router angekündigt.

In der Sprachverarbeitung ist Latenz kein Infrastrukturdetail – sie ist die Pause, die ein Anrufer hört.

Mehr von diesem Tag

2026-09-08