Wispr Flow представила Canto — самую точную модель распознавания речи для реальных условий

Canto: A speech model built for the real world

Wispr Flow представила Canto — самую точную модель распознавания речи для реальных условий

Wispr Advanced Interfaces Lab выпустила Canto — модель для диктовки в реальном времени. На 10 часах живых диктовок от 2300 пользователей Canto показала минимальный WER среди моделей Google, OpenAI, AssemblyAI и Deepgram. В сложных условиях — шум, шёпот, короткие фразы — модель уступила только Gemini 3.1 Pro, но стала лучшей среди real-time решений. Обучение включало supervised fine-tuning и reinforcement learning с GRPO, а также механизм извлечения ошибок из пользовательских правок.

Мы построили инфраструктуру, которая позволяет генерировать и оценивать речевые роллауты в масштабе, что даёт возможность создавать обучающие среды вокруг конкретных поведений и режимов отказа.

Ещё за этот день

2026-09-17