SpotifyのPortalでClaude Codeのトークン使用量が90%削減
Portal by Spotify cut my Claude Code token usage by 90%

AIコーディングエージェントのコストは、シートライセンスではなくトークンによって膨らむ。Spotifyのエンジニアが、Claude Codeの大量のファイル読み込みや定型コード生成といった「考える必要のないI/O作業」を、安価なGemini 2.5 Flashを搭載したAiKAモードに委譲するプラグイン「shunt」を開発。フックで大容量ファイルの読み込みをブロックし、スキルとスクリプトでルーティングを強制することで、平均90%のトークン削減を達成した。
AIコーディングエージェントが私のために行う作業のほとんどは、考えることではなくI/Oです。
HNでの議論
39- solenoid0937
つまり、これは特定の作業をより賢くないモデルに委任しているだけということ?確かに、提案されているようにコード作成にGemini 2.5 Flashを使うことは絶対にないですね。
CodexやClaudeが巨大なファイルを読むのに問題を感じたことは一度もありません。彼らは正確なgrepが本当に得意です。
- jnwatson
トークン使用量が減るのは、リーダー/コードライターのタスクに、異なるトークン予算を持つ別のサービスを使っているからです。
Claude Codeでも、サブエージェントにこれを委任できます(ただし、OpenRouter経由で安いモデルに切り替えない限り、選択できるモデルは限られます)。
賢くないモデルをスマートなgrepとして使うのは構いませんが、フロンティアモデルを使う意味は、コーディングのような難しい作業にその知性を使うことです。
- faangguyindia
実際にはうまく機能しません。
自分で試してみてください。OpusやSolのような大きなモデルに、プランモードを使って計画を立てさせ、すべてを実装させます。
次に、Luna MaxやGemini Flash 3.8のような安いモデルにタスクを分散してみてください。
計画中に、大きなモデルは関連ファイルをすでにコンテキストで読んでいます。一方、小さなモデルに作業の一部を与えるには、大きなモデルがタスクの分散、レビューなどを推論する必要があります。
それで本当にトークンを節約できるのでしょうか?
- shikck200
余談ですが、スクロールを乗っ取るのはやめてください。本当に悪い行いです。やめてください。
- Banditoz
あらまあ、なぜこのウェブサイトはスクロール動作を上書きするのでしょうか?