Mercury 2.5、最強の拡散LLMとして登場:品質40%向上、速度1,107トークン/秒

Mercury 2.5、最強の拡散LLMとして登場:品質40%向上、速度1,107トークン/秒

Inception Labsが、拡散型LLMとして最大級のモデル「Mercury 2.5」をリリース。Mercury 2から品質が40%向上し、GPT-5.6 Luna (Low)やGemini 3.5 Flash-Liteといったコスト最適化フロンティアモデルに匹敵。速度は1,107トークン/秒、コンテキスト長は260Kトークン、価格は入力100万トークンあたり$0.20(ローンチ時80%オフ)。検索エージェント、音声エージェント、コーディングエージェントでの実運用事例も紹介。OpenCallでは応答レイテンシが中央値で170ミリ秒に短縮、Augment Codeではコンテキスト圧縮のレイテンシが82%削減された。

音声において、レイテンシはインフラの詳細ではない。それは、発信者が聞く間(ま)なのだ。

この日のほかの記事

2026-09-08