Opus 5.5は「考えろ」と指示しなくても自分で考え、長時間の作業をやり切る
Getting the most out of Opus 5.5 in Claude and Claude Code

Opus 5.5は、これまでのClaudeの使い方をそのまま活かしつつ、いくつかの点で挙動が異なる。長時間のマルチステップ作業を少ない監督で続け、返信前に必ず思考し、作業内容を平易に報告する。本ガイドは、プロンプトの書き方、Claude Codeでの長い実行の舵取り、結果の確認方法を、具体的なプロンプト例とともに解説する。
Opus 5.5は常に返信前に考え、その思考量を自分で決める。だから「よく考えて」と頼む必要はない。
HNでの議論
121- rdli
本当に良いモデルだ。ここ数日、OpusにCIをとにかく高速化するための大まかな指示を出して、課金される分と実時間の両方を気にしていると伝えている。CI全体を分析した後に計画を立て、その計画をFableのサブエージェントにレビューさせて、それから低リスク・高リターンの変更に集中するように言った。
9時間後にはマージ可能なPRが12本できていて、正味の結果としてCI時間は約10分から約4分に短縮され、課金される分は約60%減った。私が割いた注意力は1時間未満だ。
- jjcm
フロントエンドが極めて得意で、特に画像リファレンスがある場合に強い。デザインの参考画像を放り込んで、流れるようなSVGに集中するよう指示したら、このStar Trekのコンピュータにインスパイアされたレイアウトを見事に仕上げた: https://html.non.io/lcars-opus-5.5
- pawelduda
Opus 5.5をxhighで住宅建設の設計図(ベクター図面のPDF)に向けて、Blenderで3Dモデルを作るよう頼んだ。45分で一発でタスクをこなし、私(Blender初心者)が手作業で50時間以上かけた仕事を上回った。以前に私が気づいていた文書の問題点も同じように指摘してきた。インテリアデザイナーからもらったレンダリングや図面がいくつかあったので、それらをブレンドするよう頼んだら、見事にやってのけた。APIコストは合計45ドル(私はプラン契約中なので実際の負担はずっと少なく、/usageに表示された額をそのまま書いているだけ)。とんでもないアップグレードだ。
半年前にこうしたタスクの実現可能性を調べたが、AIには十分な空間認識と設計図の知識は無理だろうという結論だった。とんでもない額をそのタスクに投じる覚悟がない限りは。
- adastra22
このアドバイスの一部は的を外している。私がよく知っているもの一つだけ挙げよう。私がよく使うプロンプトの多くには「これをステップバイステップで考えて」と入っている。そうしないと、タスクをステップごとではなく全体としてしか捉えず、その考え方の枠組みでは別の問題が出てくるからだ。これは実際に見られる。たとえば計画を立てるとき、全体をステップごと(タスクごと)に考え抜くよう強制するまで、タスク間の相互依存に気づかないことがよくある。そうするとステップ2がステップ14で導入される機能を必要としていることに気づく。そうでなければ気づかない。
はい、これはOpus 5.5でも当てはまった。確認した。Fableと同等だが強みと弱みが異なる、はるかに優れたモデルだ。しかしそれでもこの問題は残っている。公平に言えば、人間にも同じことがある。計画立案は学習されるスキルだ。
彼らが言いたいのは、ハーネスがもう推論モードを起動するために「think」のテキスト検索を使っていない、ということだと思う。なるほど、それは知っておいて良い。だからといって、モデルに特定の考え方をするよう求めることが意図した効果を持たないわけではない。
- hibikir
5よりずっと良いが、今週はいくつか、独立性を求めすぎて私の推奨に真っ向から反する判断を下す場面があった。オートモードを私が許可した範囲をはるかに超えて進めるよう説得するような愉快なこともやってくれる。たとえば、リージョンabz-1でプロセスXを実行する特定の許可が、突然、警告もなく他の5リージョンでXを実行することになり、サマリーでは一度も言及されなかった変更を加えていた。しかも数回は、理解していないシステムを理解したと決めつけて、判断を大きく誤った。訂正すると私に反論までしてきた。似た名前が同じものを指していると思い込んだが、実際は違っていたからだ。
では、長期間にわたって自分で物事をやらせる?先週のことを踏まえると、絶対にない。
- jampekka
Opus 5.5がいかに素晴らしいかという、たぶん逸話付きのありきたりなコメントのスパムは何なんだ?それがどう投稿の議論になるんだ?
- magicalhippo
最近のプロジェクトにはとても感銘を受けている。古い電子回路をいくつかシミュレートしたかった。回路図を含む古いサービスマニュアルのスキャンをフォルダに入れて渡した。回路を正しく解釈し、図がかなり違っていても同じトポロジーだと見抜いたり、一見ほぼ同じに見えても微妙だが非常に重要な違いがあるものを見抜いたりした。
いくつかのケースでは、正しく読み取れなかったため、サブ回路や部品の値を確認するよう私に求めてきた。だからでっち上げるのではなく、私に委ねてきた。
また、これをやりながら大量の小さなシミュレーション実験を回して、サービスマニュアルの主張を検証していた。たとえば、回路図から読み取ったRCフィルタのカットオフ周波数が、マニュアルのある帯域幅の数値と比べて妥当かどうかなどだ。
多くのICのデータシートPDFをアップロードしていたので、それを使って照合・検証していた。
1時間以上も作業を続けた。手動での確認を求められたとき、私は回路の接続を言葉で説明した。たとえば「IC 2のピン3から、3kの直列抵抗と10 pFのコンデンサが並列にあり、それが18kの抵抗でグラウンドへ、逆バイアスのダイオードでグラウンドへ、そして最後にIC 4のピン6に入る」といった具合だ。するとどのケースでもトポロジーを正しく理解した。時には何かおかしいと思ったのか再度確認を求めてきて、実際に私が回路図を読み間違えていた。
さらに提供した[…]
- ToJans
実に素晴らしいモデルだ。
大きなタスクをいくつか与えて、できるだけ並列化するよう頼んだ。
1日ほどで週次のトークンを使い切ってしまった(20x max)が、出力は完全に的を射ていた。
(アカウントに「reset token usage - opus 5.5」ボタンがあるのは知っていた。)
今では新機能の調査まで任せるようになった。
適切な出力を得るにはまだ方法論を与える必要があるが、結果は私が5人のチームで1か月かけても実現できないものをはるかに超えている。