Ramp、モデルルーターでAI推論コストを平均40%削減
Ramp Launches a Model Router

Rampが、AIモデルへのリクエストを最適なモデルに自動ルーティングする「Router」を発表。単一のAPIエンドポイントで全モデルにアクセスでき、性能を維持しながら推論コストを平均40%削減する。Ramp社内ではAIコストを30%削減し、月間2.75兆トークンを処理。2026年まで無料で、26ドルのクレジット付き。OpenAIやAnthropicのモデルに対応し、BYOKも可能。
Rampでは、RouterによりLLMコスト全体を30%削減し、機能をよりスマートかつ高速にすることができました。