Claude Opus 5.5移行ガイド:Agentワークフローを壊しうる5つの変更

移行の中心はthinking、tool use、computer use、会話履歴の互換性です。

Buda Team
← ブログに戻る
Claude Opus 5.5移行ガイド:Agentワークフローを壊しうる5つの変更

Anthropicは2026年9月22日、Claude Opus 5.5を発表しました。見出しだけなら「より高性能で、速く、安い」アップデートです。しかしAgentワークフローにとって重要なのは、thinking、ツール呼び出し、computer use、会話履歴の扱いが変わったことです。

ベンチマークだけを見ると移行コストを見落とします。token単価だけを見ると、再試行、壊れたツールループ、人によるレビューのコストを見落とします。

まず結論

AnthropicはOpus 5.5を、長時間のagentic codingとknowledge work向けモデルと位置づけています。API model IDはclaude-opus-5-5。context windowは100万token、最大出力は12.8万tokenで、adaptive thinkingは常時有効です。

変更Claude Opus 5.5Claude Opus 5チームが確認すべきこと
標準入力価格100万tokenあたり4ドル5ドルファイル・ツール・再試行を含む総入力
標準出力価格100万tokenあたり20ドル25ドルthinkingも出力予算を消費する
Cache read100万tokenあたり0.20ドル0.50ドル長いセッションでの実際のhit率
デフォルトeffortmediumhighデフォルトで品質基準を満たすか
Thinking常時有効一部effortで無効化可能既存のrequest/response処理
Context100万token100万tokenツール結果とthinking保持後の実効容量

Anthropicは、デフォルト設定の典型的なワークロードでOpus 5より40%低コスト、出力は30%以上高速だと説明しています。これはベンダーのテストに基づく推定であり、すべてのワークロードに保証された割引ではありません。Prompt、effort、cache、tool call、retry rateで結果は変わります。

Claude Opus 5.5がAgentワークフローを変える5つの場所

最大の変更はbenchmarkではない

Agentワークフローはモデルだけで動きません。Harnessがcontext、利用可能なtools、permissions、tool resultの戻し方、完了と判断するためのevidenceを決めます。

Opus 5.5はこの接続面のいくつかを変えます。

Thinkingは無効化できない

Adaptive thinkingは常時有効です。effortで深さを調整できますが、thinking: {"type":"disabled"}は拒否されます。

thinking-offを前提にコストやparserを調整していたintegrationは再検証が必要です。Thinking tokenは表示されなくてもoutput tokenとして課金され、max_tokensにも含まれます。移行時は料金だけでなく、出力が途中で切れないかも確認します。

Opus 5.5のデフォルトeffortはmediumです。発表資料の最高スコアを得るために、すべてを最初からmaxにする必要はありません。まずデフォルトで試し、acceptance testを満たさない仕事だけeffortを上げます。

強制tool useは既存ループを壊す可能性がある

Opus 5.5はtool_choiceのanyや特定toolの強制指定を受け付けません。Anthropicはautoとstrict tool definitionまたはstructured outputの組み合わせを推奨しています。

「毎ターン必ずこのtoolを呼ぶ」と仮定するworkflowは、明示的なmigration testが必要です。scheduled agentが本番で400を返してから気づくのでは遅すぎます。

Computer useは新しいtoolsetが必要

Claude APIとGoogle Cloudでは、従来のcomputer_20251124はOpus 5.5で使えません。computer_toolset_20260801へ移行する必要があります。

これはPrompt品質ではなくrequest contractの互換性です。benchmarkは、現在のbrowser/computer harnessが正しいversionかを確認してくれません。

Thinking blockは会話のintegrityに関わる

Opus 5.5はpreserved thinkingを使います。署名されたthinking blockより前のsystem instructions、tools、messagesは変更できません。会話履歴を作り直したり編集したりすると、blockが無効になることがあります。

長時間動くAgentは履歴をappend-onlyとして扱うか、Anthropicが提供するcontext managementを使うべきです。状態は明確になりますが、token節約のために過去メッセージを手作業で書き換える方法は危険になります。

進捗表示が消えることがある

デフォルトのdisplay: "omitted"では、tool call間のprogress updateが空のthinking blockとして返る場合があります。途中の文章をそのまま進捗UIにしていた製品は、処理中でも無反応に見えることがあります。

Anthropicは、reasoning summaryを見せず、ユーザー向けprogressだけ返すbetaのupdates modeを用意しています。これはモデルスコアではなく製品統合の問題です。

発表が証明すること、証明しないこと

Anthropicはagentic coding、computer use、knowledge work、business workflowでの改善を報告しています。自動behavioral auditではOpus 5より良い結果を示し、containment boundaryを越えようとする試行も専用評価で減ったと説明しています。

これらは重要な一次情報ですが、すべてのworkflowが安全・正確になる保証ではありません。Anthropic自身も、前線モデル間のbenchmark差は実運用の差を説明しにくくなっていると述べています。発表スコアの多くはhighまたはmax effortで、safeguard fallbackの影響を受ける経路もあります。

問うべきなのは「何個のchartで勝ったか」ではなく、「自分たちのtools、permissions、data、review standardでaccepted workが増えるか」です。

公平なmigration test

既にOpus 5で安定したbaselineがあるworkflowを一つ選びます。repository change、出典付きresearch report、spreadsheetからpresentationへの引き渡しなどが適しています。入力ファイル、tools、time limit、permission policy、acceptance checklistを固定します。

最初はOpus 5.5のデフォルトmedium effortで実行します。総input/output token、cache read、tool call、retry、wall-clock time、reviewer correctionsを記録し、基準を満たさない場合だけeffortを上げます。

reviewerはモデルの「完了しました」ではなくartifactを確認します。codeならdiff、tests、logs。researchなら重要な数値と引用。business documentなら構造、事実、templateへの適合を確認します。

有効な結論は「新モデルの方が賢く感じる」ではありません。accepted-task rate、review minutes、accepted artifactあたりの総コストのいずれかが改善し、重大な失敗が増えていないことです。

Claude Opus 5.5の確認済み移行情報

ワークフロー層が重要な理由

Budaはfile、browser、terminal、tool call、最終artifactを一つの確認可能なworkspaceに保ちます。leaderboardではなく、acceptされた結果、失敗loop、review負担を比較できます。

FAQ

Opus 5.5はOpus 5より安いですか?

Anthropicの標準API価格は、Opus 5の入力100万tokenあたり5ドル・出力25ドルから、Opus 5.5の4ドル・20ドルに下がりました。単価は20%減ですが、実際のタスク費用にはキャッシュ、thinking、再試行、ツールループも含めて判断します。

Context windowは大きくなりましたか?

いいえ。Anthropicの現行ドキュメントでは両方とも100万tokenです。5.5の中心はcontextの数字ではなく、効率とintegration behaviorです。

すべてのOpus 5 workflowをすぐ移行すべきですか?

いいえ。request shape、tool loop、computer-use version、history handling、cost、accepted outputを代表taskで検証してから判断してください。

Buda で Opus 5.5 を使う

Buda では Agent のモデル選択から Claude Opus 5.5 を選べます。正式なモデル ID は claude-opus-5-5 です。保存済みの旧 Opus 5 の選択は Opus 5.5 に更新され、Agent の再作成やファイルの削除は必要ありません。上記の API 移行ルールは Anthropic に直接接続する開発者向けであり、すべての Buda ユーザーに必要な追加設定ではありません。

Buda の提供開始のお知らせを読む · Buda Credits

参照元