「Bullet」がコーディングエージェントを高速化、待ち時間を排除

Launch HN: Bullet (YC S26) – A Faster Coding Agent

「Bullet」がコーディングエージェントを高速化、待ち時間を排除

Y Combinator支援の新プロジェクト「Bullet」は、コーディングエージェントの実行を高速化するツール。単純なタスクは高速なモデルにルーティングし、複雑なタスクのみ深い推論にエスカレーション。リポジトリ全体を埋め込まずに必要なコードだけを検索・読み取り、独立したツール呼び出しは並列実行。重複呼び出しやループを防止し、待ち時間を削減する。現在macOS向けにプライベートベータを無料公開中。

コードに人質に取られるな。
  1. seizethecheese

    これは有望な方向性ですね!ただ、残念ながら、ここでのベンチマーク結果は本質的に意味がないと思います。

    私は最近、同じ教訓を痛い目に遭って学びました。構築していたマルチエージェントシステムでGPQA Diamondのスコアを改善しようとしていたのです(システムはこちら:http://pellmell.ai)。どんなに頑張っても、改善できませんでした。Fable 5がリリースされたときも、Opusより改善されず、自分の間違いに気づきました。ベンチマークは飽和していたのです!

    今回の結果を見ると、同じパターンが見えます。FableはOpusより優れておらず、スコアは約95%です。特に、この投稿はどのサブエージェントを使っているかを省略しています。なぜでしょうか?このツールが本当に機能するかどうかを知的に正直に判断する方法は、そのエージェントを実行して、そのスコアとコストも報告することでしょう。

    GPQA Diamondの教訓に戻ると、飽和したリーダーボードがどのように振る舞うかはこちらで確認できます:https://artificialanalysis.ai/evaluations/gpqa-diamond。Fableはタスクあたり$0.22で92.6%を獲得していますが、いくつかのモデルは$0.01でより高いスコアを出しています。私は、モデルをランダムに選ぶルーターを実装するだけで、「GPQA DiamondでFableを強化」し、低コストでスコアが向上したと示すルーターを簡単に公開できます!

  2. lrvick

    ダウンロードを押したら、.debファイルが来ました。

    .debをインストールするにはroot権限が必要です。つまり、root権限を欲しがるコーディングエージェントです。サプライチェーンセキュリティに真剣に取り組んでいる人はほとんどいないことは分かっています。今週だけで2500社がLiteLLMを使ってハッキングされました。それで、ソースコードのリンクを探しましたが、見つかりません。

    つまり、私は、NPM依存関係によってはマルウェアかもしれないウェブサイト上のランダムなバイナリにroot権限を与え、それをビルドする未知のCI/CDシステムが私のシステム上でroot権限で任意のコマンドを実行できることを信頼し、しかもコードをレビューすることすら許されない、ということですか?

    それは家族にさえ与えないレベルの信頼であり、それをすべてのユーザーに求めているのです。

    そこで、ローカルのLLMに逆コンパイルさせてみました。198の依存関係とライセンス準拠を調べるために。

    ここから、包括的なテストスイートを書かせ、コードを削除し、LLMにすべてのテストに合格するコードを書き直させ、その結果を自分でオープンソースにすることもできました。

    実際にやるつもりはありませんが、誰にでもできます。プロプライエタリソフトウェアはもはや堀ではなく、このようなものではソフトウェアを非常に信頼しにくくするだけです。クリーンルームでのコードの洗浄は今や簡単すぎるので、自分でオープンソースにしたほうがいいでしょう。

  3. esafak

    これは価値が追加されていないと思います。私はOpenCodeを使い続けます。

    私が価値を感じるもの:忠実度の高い可視化(Figmaのようなビジュアル編集はボーナス)、優れたツール使用(モデルに指示を強制しない)、トークン効率、リソース効率。問題ではないもの:

    * ルーティング:OpenCodeはサブエージェントを事前定義しており、適切なモデルに設定できます。

    * 検索:ASTベースや埋め込みベースの検索MCPがあります。私はhttps://github.com/DeusData/codebase-memory-mcpを使っています。

  4. andai

    swe-mini-agentより35%高速、素晴らしい。これは並列化によるものだとおっしゃっていますね?

    私はswe-mini-agent(実際にはその弟分、チュートリアル[0])に基づくカスタムハーネスを使っていますが、コードックス(小さなタスクの場合)よりはるかに高速だと感じています。「ただのbash」をwhileループで回しているだけなのに。

    主な違いは、私があなたの言うこととは逆のことをしていることです。つまり、コンテキストをプロンプトにダンプしているのです。目の前にあるものをgrepする必要はありません:)

    しかし、私のリポジトリは小さいです(しばしばClaudeのシステムプロンプトより小さい!)、そして「アウトライン」(関数ヘッダーやトップレベルの変数など)をダンプするスクリプトがあります。

    外科的編集のためのさらに小さなハーネスもありましたが、少し扱いにくく、完全なエージェント的な「あちこち探検させて理解させる」モードが恋しくなりました。

    しかし、その古いものから恋しいのは、1回のLLM呼び出しで複数のファイルを同時に編集できたことです。いつかそれを復活させるかもしれません:)

    とはいえ、数ヶ月以内に速度を重視する人は全員Cerebrasなどに移行するでしょう。それにより、遅いハーネスでさえ私やあなたのものよりはるかに速くなります!(すでにテストしましたが、その速さは異常です...)

    [0] https://minimal-agent.com/

  5. etchalon

    このツールがコミットに自分自身を著者として注釈するのを止められないので、使えません。

    それはオプションであるべきで、強制されるべきではありません。

この日のほかの記事

2026-08-13