Claude Opus 5.5でプログラミング開発|任せ方と検証の型

2026年9月22日、AnthropicがClaude Opus 5.5を公開しました。Opus 5より速く、安く、長い作業を最後までやり切る方向に強化されたモデルです。Claude Codeで開発している人にとっては「どこまで任せてよいのか」「設定は何を変えればいいのか」が気になるところだと思います。
この記事では、Claude Opus 5.5をプログラミング開発に使うときの設定、指示の出し方、AIが書いたコードの検証手順を、個人開発者や小規模チームの目線で整理します。自作ツールにAPIで組み込んでいる人向けに、Opus 5からの移行で引っかかる変更点もまとめました。
※料金・仕様は2026年9月24日時点の公式情報にもとづきます。
結論:Opus 5.5は「最後まで任せる」前提で使うモデル
先に要点を3つ挙げます。
- 速く、安くなった:出力速度はOpus 5比で約30%向上。API料金は入力$4/出力$20(100万トークンあたり)で、Opus 5から入出力とも2割下がりました
- 長い作業を完走しやすい:Anthropicは、テスターが68万行のコード移行を1日かからずに終えた例を紹介しています
- 使い方の前提が変わった:思考(thinking)は常にオン。Claude CodeでのeffortのデフォルトはOpus 5の
highからmediumに下がっています
つまり、細かく指示を刻んで1ステップずつ見守るより、「完了の条件」をはっきり渡してまとめて任せ、終わったあとに検証する使い方が合っています。その分、検証の手順を自分で持っているかどうかで成果物の質が大きく変わります。この記事の中心はそこです。
Claude Opus 5.5の開発性能|Opus 5との違いと料金
公式ベンチマーク(Anthropic自己申告)
以下はAnthropicが公表した数値で、第三者による検証前の自己申告です。
| ベンチマーク | Opus 5.5 | Fable 5.1 | Opus 5 |
|---|---|---|---|
| Terminal-Bench 4.0 | 66.4% | 55.8% | 52.3% |
| CursorBench 4.0 | 57.8% | 51.8% | 46.6% |
| FrontierCode v1.1 | 54.4% | 50.3% | 48.0% |
ターミナル操作を伴う開発タスクで、上位モデルのFable 5.1を上回る数値が出ています。GitHubのCPOは「VS Code上で、Opus 5より多くのターミナルタスクを半分以下のステップで解いた」とコメントしています。
第三者評価(Artificial Analysis)
独立評価機関のArtificial Analysisでは、Opus 5.5(max effort)が総合指標のIntelligence Indexで58を記録し、同機関の計測で首位になりました。同機関によるTerminal-Bench 4.0の計測値は59.6%で、Opus 5から11ポイント上がっています。公式値(66.4%)とは測定条件が違うため、数字が一致しない点に注意してください。
トークン消費と料金の関係
見落としやすいのがトークン消費です。Artificial Analysisの計測では、1タスクあたりの出力トークンがOpus 5の約7.3万に対して、Opus 5.5は約11.9万。約1.6倍に増えています。
単価は2割下がっても、使う量が増えれば請求額は思ったほど下がりません。Anthropicは「典型的な利用で約40%安い」としていますが、これはキャッシュ読み込みの値下げ(60%減)なども含めた数字です。
| 項目 | Opus 5.5(100万トークンあたり) |
|---|---|
| 入力 | $4 |
| 出力 | $20 |
| キャッシュ読み込み | $0.20 |
| バッチ処理 | 入出力とも50%割引 |
| fast mode | 入力$8/出力$40 |
Claude Codeでの始め方とeffortの使い分け
Opus 5.5に切り替える
Claude CodeでOpus 5.5を使うには、v2.1.280以降が必要です。古い場合はclaude updateで更新します。
claude update
claude --model opus
セッション中なら/model opusで切り替えられます。Anthropic APIではopusエイリアスがOpus 5.5を指し、100万トークンのコンテキストが追加料金なしで使えます。
effortは自分で決める
effortは「どれだけ考えてから答えるか」の設定で、low・medium・high・xhigh・maxの5段階です。Opus 5.5のデフォルトはmediumです。
| effort | 向いている作業 |
|---|---|
| low | 定型的な修正、命名変更、簡単な質問 |
| medium | 日常的な機能追加やバグ修正(デフォルト) |
| high | 複数ファイルにまたがる改修、原因が見えにくいバグ |
| xhigh / max | 大規模な移行、設計からやり直す作業 |
セッション中は/effort highのように変更できます。常に同じ設定にしたい場合は、settings.jsonにモデル別で書きます。
{
"modelSettings": {
"claude-opus-5-5": {
"effort": "high"
}
}
}
注意点として、settings.jsonのトップレベルに書いたeffortLevelはOpus 5.5には効きません。Opus 5時代の設定をそのまま使っていると、気づかないうちにmediumで動いていることがあります。
細かい挙動の変化
- 思考はオフにできません。考えている内容は
Ctrl+Oで表示を切り替えられます - 「よく考えて」「ステップごとに考えて」といった指示は不要になりました。Anthropicは、プロンプトや保存済みの指示からこうした文言を削るよう勧めています
- 実行中にメッセージを追加で送れば、止めずに方針を修正できます。1回の実行が長くなったぶん、やり直しのコストが上がっているためです
/fastで応答を速くできます(研究プレビュー、トークン単価は高め)
「完了」と「正しい」は別物|Opus 5.5に任せるときの指示と検証の型
Opus 5.5は、途中で止まらずに作業を終わらせる力が上がっています。ただ、The New Stackの記事で独立系アーキテクトが指摘しているように、「完了した」ことと「正しく動く」ことは同じではありません。長く自走するほど、検証のしかたが結果を左右します。
1. 完了条件を具体的に書く
「APIクライアントを新しくして」ではなく、終わりの状態を書きます。Anthropicの公式ブログの例は次のとおりです。
> 完了の定義:すべてのエンドポイントが新しいクライアントを使い、古いクライアントが削除され、テストスイートが通ること。
完了条件があると、Opus 5.5は自分でテストを回して確認しながら進めます。
2. CLAUDE.mdに停止条件を書く
任せる範囲を広げるほど、「ここでは止まって聞いてほしい」を先に決めておく必要があります。プロジェクトのCLAUDE.mdに、たとえば次のように書きます。
## 停止条件
- 自分なしでは先に進めないときだけ止まって質問する
- データ削除、force push、このリポジトリ外の変更の前には必ず確認する
3. 進捗をファイルに残させる
長い作業ではコンテキストが埋まっていくため、チェックリストのファイルを作らせて、進むたびに更新してもらいます。途中で自分が様子を見るときにも、どこまで進んだかがすぐ分かります。大規模な監査や移行では、サービスごとにサブエージェントへ振り分けさせ、その結果を本体に確認させる方法もあります。
4. 終わったら差分をレビューさせてから自分で見る
作業が終わったら、まず「自分(人間)の返事待ちになっている箇所」がないかを確認します。次に、Opus 5.5自身に差分をレビューさせます。そのうえで人間が確認すると、見る量が減ります。
5. 確認できなかったことを明示させる
指示の最後に「確認できなかった点には印を付け、どこを調べたかを書いて」と加えておきます。これで「動くはず」と「動くことを確かめた」を区別できます。
長時間の自律実行を回す環境づくり
Anthropicは、18時間以上人手を介さずに進んだタスクの事例も紹介しています。こうした長い作業を手元のノートPCで回すと、スリープや持ち出しで止まってしまいます。選択肢は主に3つです。
| 方法 | 特徴 | 注意点 |
|---|---|---|
| Claude Code on the web | ブラウザからクラウド上でClaude Codeを実行。環境構築が少ない | GitHubリポジトリ前提の作業に向く |
| VPS(Linux) | 自由度が高く、常時稼働させやすい | サーバー管理の知識が必要 |
| クラウドPC | デスクトップ環境ごとクラウドに置ける | 月額費用がかかる |
Linuxサーバーの扱いに慣れていない人や、Windowsの開発環境をそのまま使い続けたい人には、クラウドPCが扱いやすい選択肢です。XServer クラウドPCは専用のPCをクラウド上に作れる仮想デスクトップサービスで、24時間稼働させても電気代がかからず、手元のPCが壊れたりなくしたりしてもデータはサービス上に残ります。お試しプラン(メモリ2GB)から始めて、あとから上位プランへ変更することもできます。プラン内容と料金は公式サイトで確認してください。
APIで自作ツールに組み込む人向け|Opus 5から移行でハマる4つの変更
モデルIDをclaude-opus-5-5に書き換えるだけでは動かないケースがあります。公式の移行ガイドから、影響の大きい変更を4つ挙げます。
1. 思考の無効化・手動指定がエラーになる
thinking: {"type": "disabled"}や{"type": "enabled", "budget_tokens": N}は400エラーになります。thinkingを省略するか、{"type": "adaptive"}にして、深さはoutput_config.effortで調整します。
2. 特定ツールの強制呼び出しができない
tool_choiceのanyとtool(ツール名の指定)は使えなくなりました。autoのままで、確実に構造化データを受け取りたい場合はstrict tool useやstructured outputsを使います。
3. ツール呼び出しの合間のテキストが消えて見える
これまでtextブロックで返っていた「次に○○します」といった途中の文章が、thinkingブロックで返るようになりました。デフォルトの表示設定(display: "omitted")では中身が空になるため、進捗をストリーミング表示しているアプリは、ツール実行の間に何も出なくなります。thinking.displayを"auto"などに設定すると表示されます。
4. computer useのツール定義が変わった(Claude API・Google Cloud)
computer_20251124は使えなくなり、computer_toolset_20260801への移行が必要です。Amazon Bedrockでは従来の定義のまま動きます。
このほか、思考に使うトークンが増えるためmax_tokensの見直しと、effortの再調整(Opus 5の設定を流用しない)が推奨されています。安全上の理由で回答が拒否された場合は、HTTP 200のままstop_reason: "refusal"が返るので、その分岐も用意しておきます。
Claude Opus 5.5が向いている人・向いていない人
向いている人
- 複数ファイルにまたがる改修や、ライブラリの移行をまとめて任せたい人
- Opus 5を使っていて、速度と料金に不満があった人
- テストがある程度そろったリポジトリで開発している人(完了条件を渡しやすいため)
向いていない人・注意が必要な人
- 1行の修正や質問が中心の人。毎回たくさん考える分、軽い作業ならSonnet 5のほうが待ち時間も費用も抑えられます
- 出てきたコードを確認する時間や手段がない人。長く任せるほど、確認していない変更が積み重なります
- セキュリティ診断など、サイバーセキュリティ関連の作業が中心の人。Opus 5.5では該当する依頼の多くが自動的にOpus 4.8へ切り替わります。Claude Codeで別モデルに切り替わったときは、
/modelでOpus 5.5に戻せます
Fable 5.1との比較では、Anthropicは「大半の作業で同等の性能」としています。コスト面ではOpus 5.5のほうが扱いやすく、まずはOpus 5.5を日常の標準にして、足りない場面だけ上位モデルを試す使い分けが現実的です。
よくある質問
Q. Claude Opus 5.5は無料プランでも使えますか?
A. 提供先として案内されているのは有料プラン(Pro・Max・Team・Enterprise)とAPIです。最新の対象プランは公式サイトで確認してください。
Q. Claude Code以外の開発ツールでも使えますか?
A. GitHub Copilotで提供が始まっています。APIはAnthropicのほか、Amazon Bedrock、Google Cloud Vertex AI、Microsoft Foundryから利用できます。
Q. Claude CodeでOpus 5.5が選択肢に出てきません。
A. Claude Codeのバージョンがv2.1.280より古い可能性があります。claude updateで更新してから/model opusを試してください。
Q. effortは常にmaxにしておけばいいですか?
A. 性能は上がりやすい一方、トークン消費と待ち時間が増えます。普段はmedium〜highにして、大きな改修のときだけ上げるほうが費用を抑えられます。
Q. 「よく考えて」と指示したほうが精度は上がりますか?
A. Opus 5.5は常に考えてから答え、考える量も自分で決めます。Anthropicはこの種の指示を削るよう勧めており、深さを変えたいときはeffortで調整します。
まとめ
Claude Opus 5.5は、Opus 5より速く安くなり、長い開発作業を最後までやり切る力が上がったモデルです。一方で、effortのデフォルト変更やAPIの仕様変更など、前のモデルの感覚のまま使うと引っかかる点もあります。
- Claude Codeはv2.1.280以降に更新し、effortをモデル別に設定する
- 完了条件と停止条件を先に渡し、まとめて任せる
- 終わったら差分レビュー、未確認箇所の明示、自分の目での確認まで行う
- APIで使う場合は、思考設定・tool_choice・途中テキストの表示を見直す
任せる範囲が広がるほど、成果物の質は検証の手順で決まります。まずは小さめのタスクで完了条件の書き方を試し、自分のプロジェクトに合うCLAUDE.mdを育てていくところから始めてみてください。
参考
- Introducing Claude Opus 5.5(Anthropic)
- What’s new in Claude Opus 5.5(Claude Platform Docs)
- Model configuration(Claude Code Docs)
- Getting the most out of Opus 5.5 in Claude and Claude Code(claude.dev)
- Claude Opus 5.5 takes the top spot on the Artificial Analysis Intelligence Index(Artificial Analysis)
- Claude Opus 5.5 wants to finish your coding tasks, not just start them(The New Stack)
- Claude Opus 5.5 is now available in GitHub Copilot(GitHub Changelog)






