Grok Voice Transcribe 2.0:准确率翻倍,价格不变

Grok Voice Transcribe 2.0:准确率翻倍,价格不变

我们发布了 Grok Voice Transcribe 2.0,这是目前最精准的语音转文本模型之一。相比前代,它在保持相同价格的前提下,准确率提升了一倍。该模型基于 Grok Voice 的音频基础模型构建,已在数十万通客户支持电话、数百万小时视频旁白以及 Tesla 车辆的 Grok 助手等真实场景中验证。它专为处理嘈杂环境、多方口音及复杂语音指令而训练,在 Artificial Analysis 榜单的流式模型中排名第一。无论是短指令的多语言识别,还是对数字、邮箱等关键信息的精准转录,Grok Voice Transcribe 2.0 都表现卓越。Atlassian Loom 已采用该模型优化工作流,实现了从录音到代码生成的闭环。

我们一直相信,推动工作前进的最佳方式是只记录一次上下文,然后让它流向各处。

同日更多故事

2026-09-18