Wispr Flow представила Canto — самую точную модель распознавания речи для реальных условий
Canto: A speech model built for the real world

Wispr Advanced Interfaces Lab выпустила Canto — модель для диктовки в реальном времени. На 10 часах живых диктовок от 2300 пользователей Canto показала минимальный WER среди моделей Google, OpenAI, AssemblyAI и Deepgram. В сложных условиях — шум, шёпот, короткие фразы — модель уступила только Gemini 3.1 Pro, но стала лучшей среди real-time решений. Обучение включало supervised fine-tuning и reinforcement learning с GRPO, а также механизм извлечения ошибок из пользовательских правок.
Мы построили инфраструктуру, которая позволяет генерировать и оценивать речевые роллауты в масштабе, что даёт возможность создавать обучающие среды вокруг конкретных поведений и режимов отказа.