Grok Voice Transcribe 2.0、同じ価格で精度が2倍に

xAIが音声認識モデルGrok Voice Transcribe 2.0を発表した。実環境の評価で精度が1.0の2倍になり、価格は据え置き。公開リーダーボードでは32のストリーミングモデル中1位に立つ。多言語の短いフレーズでは単語誤り率が20.6%から6.8%へ低下し、話者分離や単語タイムスタンプも追加料金なしで使える。
「コンテキストを一度捉えれば、それがどこにでも流れていく。GrokがLoomの音声認識を支え、Cursorがそれをコードに変えることで、コンテキストからコードへのループを閉じている」