Canto von Wispr Flow: Das genaueste Spracherkennungsmodell für echte Diktate

Canto: A speech model built for the real world

Canto von Wispr Flow: Das genaueste Spracherkennungsmodell für echte Diktate

Wispr Flow stellt Canto vor, ein Echtzeit-Sprachmodell, das auf echten Diktaten trainiert wurde. In einem 10-Stunden-Test mit über 2.300 Sprechern erzielte Canto die niedrigste Wortfehlerrate und übertraf Google, OpenAI, AssemblyAI und Deepgram. Auch bei schwierigen Bedingungen wie Hintergrundgeräuschen, Flüstern oder kurzen Äußerungen gehört es zur Spitze. Ermöglicht wurde dies durch Supervised Fine-Tuning und Reinforcement Learning mit GRPO, das aus Nutzerkorrekturen lernt und Kontext selektiv nutzt.

Wir haben eine Infrastruktur entwickelt, die Sprach-Rollouts in großem Maßstab generieren und bewerten kann, sodass wir Trainingsumgebungen für spezifische Verhaltensweisen und Fehlermodi erstellen können.

Mehr von diesem Tag

2026-09-17