減速を唱えた10日後、Anthropicが出したのは「Opus 5より40%安い」新モデルでした。同じ日にOpenAIも価格を半分にしています。ところが独立計測では、最も深く考えさせる設定にすると、1タスクの費用は前世代と同水準でした。その40%は、どの設定で成り立つ数字なのでしょうか。
Anthropicは2026年9月22日、Claude 5.5ファミリーの第1弾となるClaude Opus 5.5を公開した。同社によれば、ほとんどの仕事でClaude Fable 5.1と同水準の性能を示し、既定設定の典型的な作業ではOpus 5より運用コストが40%低い。API価格は100万トークンあたり入力4ドル、出力20ドルで、Opus 5から20%下がった。キャッシュ読み込みは60%下がり、出力速度は30%以上速い。
フロンティアのペーシングを同社が提唱してから初のリリースで、METRなどが事前評価を行った。サイバーセキュリティや生物学に対し、Fable 5.1と同等のセーフガードを備える。
From:
Introducing Claude Opus 5.5
【編集部解説】
ペーシング宣言から10日後の新モデル
9月12日、ダリオ・アモデイ氏はエッセイ「We Must Pace the Frontier」で、AIの能力向上の速度を落とすべきだと訴えました。その10日後に出てきたのが、Claude Opus 5.5です。
Anthropic自身、Opus 5.5を「ペーシングを提唱してから最初のリリース」と位置づけています。では、減速を唱えた会社は何を出したのか。
Opus 5.5は性能の水準も引き上げ、Anthropicは新たな先頭モデルと位置づけています。そのうえで私が注目するのは、最上位に近い性能帯の仕事を、Opus 5より低い費用で回せるようになった点です。同社が掲げた看板も「ほとんどの仕事でFable 5.1並み」と「Opus 5より40%安い」の2つでした。この「40%」がどの設定と作業で成り立つのかを、以下で確かめます。
ベンチマーク表では、Opus 5.5が比較したすべての項目でFable 5.1を上回っています。ただ、Anthropicはこの水準になるとスコアの差は実力差の目安として当てにならなくなってきたと書き、社内で使った実感ではFable 5.1との差は表ほど大きくないとも述べています。自社の数字を割り引いて読むよう、発表者自身が促しているわけです。
「40%安い」の内訳
40%という数字は、単価の値下げだけで出てくるものではありません。
入力と出力のトークン単価は、それぞれ100万トークンあたり4ドルと20ドルで、Opus 5から20%下がりました。エージェントやコーディングの費用の大半を占めるとされるキャッシュ読み込みは0.20ドルで、下げ幅は60%です。これに、1つの仕事を終えるまでに使うトークンの数が減った効果を重ねて、既定設定の典型的な作業で40%という計算になります。
ここで効いてくるのが、既定のeffort(思考の深さの設定)です。Opus 5.5では、effortを指定しないとmediumで動きます。Opus 5ではhighでした。40%という数字も、このmediumを前提にしたAnthropic自身のテスト結果です。
Anthropicはあわせて、1タスクの費用を解説する記事を公開しています。Opus 5.5では出力トークンの単価がキャッシュ読み込みの100倍にあたり、画面に出ない思考の部分も出力として課金されます。思考に使うトークンも請求に載る以上、effortは請求額を動かす重要な設定です。実際の費用は、ターン数やキャッシュの効き具合、入出力の量にも左右されます。
独立計測が映した、effortごとの顔
発表と同じ日に、第三者による計測も出ています。
評価機関のArtificial Analysisでは、Opus 5.5(max設定)が同社の総合指数で58点を記録し、首位に立ちました。総合指数50点以上のモデルと比べると、5段階のeffortのうち4段階(max、xhigh、high、medium)が、性能と1タスクあたりの費用で最も効率のよい領域に入っています。
一方、max設定では1タスクあたり約11万9000の出力トークンを使い、Opus 5の約7万3000を大きく上回りました。単価が下がったぶんと相殺され、1タスクあたりの費用はOpus 5と同じ水準にとどまっています。Terminal-Bench 4.0では、Anthropicが自社の評価構成で66.4%と発表したのに対し、Artificial Analysisは独自の構成で59.6%を測定し、GPT-6 Astra(xhigh)と同水準としています。評価の構成が異なるため、2つの数字は直接比べられません。
コードレビューサービスのCodeRabbitも、自社の仕組みで試した結果を公表しています。思考の設定を低めに組み合わせた「Standard」構成は、既知の80パターンのバグのうち51件を見つけ、本番で使っている構成の49件を上回りました。一方で、トークンは約50%多く使い、本番構成が見つけた9件を見逃しています。難しい13件を集めた別の試験では、設定を高めにした「Max」構成が通常のレビューコメントで10件を見つけ、本番構成の5件を上回りました。
2つの独立計測が示しているのは、費用を設定や仕事の中身から切り離しては語れないということです。Artificial Analysisではmediumも効率のよい領域に入り、maxでは出力トークンが増えてOpus 5並みの費用になりました。CodeRabbitは発見数を伸ばしつつトークンも増えており、実運用で安くなるかは確定していないと同社自身が書いています。
同じ日、OpenAIも「安さ」を出した
同じ日、OpenAIもGPT-6 SolとGPT-6 Lunaを公開しました。Solの価格は100万トークンあたり入力2ドル、出力10ドルです。OpenAIが比較の基準としたGPT-5.6 Solのプロモーション価格は入力4ドル・出力20ドルで、Opus 5.5と同じ水準でした。
両社の発表資料には、互いの新モデルを同じ表で比べた結果はありません。一方、Artificial Analysisは両モデルを自社の共通の評価体系で測定しています。見えてくるのは、フロンティア級の競争の軸が、トークン単価から「完了した1タスクあたりの費用」へ移りつつあるということです。両社がそろって、トークン数やステップ数の削減を前面に出しています。
移行は文字列の書き換えでは済まない
既存のシステムをOpus 5から移す場合、モデル名を書き換えるだけでは済みません。
Opus 5.5では思考を無効化できず、無効にする指定を送るとエラーが返ります。特定のツールを必ず呼ばせる指定(tool_choice)も使えなくなりました。さらに、ツール呼び出しの合間にモデルが書く短い経過メモは、思考ブロックの中に移り、既定の表示設定では空になります。これはエラーにならないため、進捗を画面に流しているアプリは、何も知らせずに黙り込むことになります。
セーフガードの経路も変わります。Opus 5.5はFable 5.1と同じ水準のサイバーと生物学の安全装置を備え、サイバーセキュリティの作業の多くは、Opus 4.8へ振り分けられます。防御側の実務者向けには、今後数週間でCyber Verification Programを拡大し、Opus 5.5を使えるようにする方針です。
日本の現場にとっての意味
Opus 5.5は、Claude API、AWS、Google Cloud、MicrosoftのFoundryで同時に使えるようになりました。社内規程でクラウド経由の利用に限っている日本企業でも、初日から検証に取りかかれます。
そのうえで、見直す価値がある点は2つです。1つは、effortを「品質の設定」ではなく「予算の設定」として扱うことです。既定がmediumに下がった以上、Opus 5時代の設定をそのまま引き継ぐと、品質も費用も想定からずれます。もう1つは、見積もりの単位です。100万トークンあたりの単価ではなく、1件の仕事を終えるのにいくらかかったかで比べる。2社が同じ日にそろって示した方向は、そこにあります。
これから開くもの
Anthropicは、Opus 5.5が評価中だと察する傾向をしばしば見せることを、自ら書いています。評価の数字と実運用での振る舞いをどう結びつけるかは、同社が引き続き抱える宿題です。
それでも、能力を伸ばしながら、1件の仕事にかかる費用も下げたことの意味は小さくありません。Opus 5.5は、ペーシングを提唱した後のAnthropicが、進歩と普及をどう両立させようとしているかを示す最初の事例です。
【関連記事】
【解説】Anthropicが単独で始めたのは減速ではない
9月12日のエッセイ「We Must Pace the Frontier」を読み解いた記事。ペーシングが訓練の停止ではない点を整理している。
Anthropicが評価者に机を用意する|減速を検証可能にする設計
第三者の評価者に社員並みのアクセスを与える構想を扱った記事。ペーシングを外から検証できるようにする仕組みの設計を読み解く。
Claude Fable 5.1|Anthropicが答えた3つの宿題
本記事の比較基準であるFable 5.1の発表を扱った記事。同じ基盤で安全装置が異なるMythos 5.1との関係も解説する。
Claude Opus 5、脆弱性は「見つける」が「悪用」の手前で止まる─Anthropicが引いた線
前世代Opus 5の発表時の記事。サイバーセキュリティのセーフガードをめぐる線引きの経緯を、今回の変更と読み比べられる。
【解説】GPT-6 Astra|見出しの数字より17個の注釈を読む
GPT-6 Astraの発表を注釈から読んだ記事。ベンチマークの条件を確かめる読み方は、本記事の独立計測の話とつながる。
【編集部後記】
CodeRabbitの検証には、スコアの表に現れない数字がもう1組あります。Standard構成だけが見つけたバグが11件、本番構成だけが見つけたバグが9件です。
総数で2件上回っていても、見つけたものの中身は入れ替わっています。レビュー役のモデルを乗り換えることは、見逃すバグの種類を取り替えることでもあるわけです。
いま頼っているレビューは、どんな種類のバグを取りこぼしているのか。乗り換えの前に、そこを一度洗い出しておく価値があります。
【用語解説】
トークン
AIモデルが文章を処理する単位。API料金は入力と出力のトークン数で決まり、思考に使った分も出力として数えられる。
effort
Claudeがどれだけ深く考えるかを決める設定である。low、medium、high、xhigh、maxの5段階があり、Opus 5.5の既定はmediumである。
キャッシュ読み込み
一度処理した入力を保存し、次のリクエストで再利用する仕組み。通常の入力より大幅に安く、Opus 5.5では100万トークンあたり0.20ドルである。
フロンティアのペーシング
最先端AIの能力向上の速度を調整し、安全対策や検証が追いつく時間を確保しようとする考え方。Anthropicが9月に提唱した。
Terminal-Bench 4.0
コマンドライン上で複数の手順からなる実務的な作業をAIに完了させ、その成功率を測るベンチマーク。
思考ブロック
Claudeが回答の前に行う推論を収めた応答の一部。Opus 5.5では常に有効で、無効にする指定はエラーになる。
tool_choice
AIに特定のツールを必ず呼び出させるAPIの指定。Opus 5.5ではツールを強制する指定が使えなくなった。
セーフガード
AIが悪用されるのを防ぐ安全装置。Opus 5.5ではサイバーセキュリティや生物学の危険な依頼を検知し、別のモデルへ振り分けるなどする。
【参考リンク】
Claude Opus(Anthropic公式)(外部)
AnthropicのOpusシリーズの製品ページ。Opus 5.5の位置づけ、提供プラン、主な用途と料金の概要を確認できる。
What’s new in Claude Opus 5.5(Claude Platform Docs)(外部)
Opus 5.5の破壊的変更、既定effort、料金、提供先を開発者向けにまとめた公式ドキュメント。移行の前に目を通しておきたい。
What a task costs on Opus 5.5(Claude公式ブログ)(外部)
1タスクの費用がターン数、キャッシュ、出力量でどう決まるかを、Opus 5.5の料金で試算しながら学べる公式の解説記事。
Claude Opus 5.5(Artificial Analysis)(外部)
独立系の評価機関によるOpus 5.5の評価ページ。総合指数と、effort別の1タスクの費用や速度を他モデルと比較できる。
Claude Opus 5.5 for code review(CodeRabbit)(外部)
CodeRabbitがレビュー基盤でOpus 5.5を検証した記事。発見数と見逃し、トークンの増加を構成別に示し、費用も考察する。
Introducing GPT-6 Sol and Luna(OpenAI)(外部)
OpenAIによるGPT-6 SolとLunaの発表。API価格の半減と、Claude各モデルとの比較結果を掲載している。
We Must Pace the Frontier(ダリオ・アモデイ)(外部)
AnthropicのCEOが9月12日に公開したエッセイ。AIの能力向上の速度を調整すべきだとし、第三者検証の構想も述べる。
METR(外部評価機関)(外部)
AIモデルの危険な能力や自律性を評価する米国の非営利研究組織。Opus 5.5の公開前の評価に、外部評価者として参加した。
【参考記事】
Claude Opus 5.5 matches Fable 5.1 performance at lower cost and promises less “Claudish” writing(外部)
Artificial Analysisの計測結果を詳報。総合指数58点、max設定の出力約11.9万トークンなどの数値を整理している。
OpenAI launches GPT-6 Sol and Luna, boasting lower cost and fewer mistakes(外部)
GPT-6 SolとLunaの公開を報じる記事。API価格の半減に加え、Opus 5.5の公開と同じ日の発表となった競争の構図を伝える。
OpenAI releases GPT-6 Sol and Luna models, slashing API costs 50% or more(外部)
GPT-6 Solの入力2ドル・出力10ドルという価格を、Opus 5.5やFable 5.1のトークン単価と並べて位置づけを整理した記事。


















