TIP
← 記事

AI

Anthropic、Claude Opus 5.5を発表——Fable 5.1レベルの性能をOpus 5比40%安く提供

2026/09/23

Anthropic、Claude Opus 5.5を正式リリース

Anthropicは2026年9月22日、新しいモデルファミリー「Claude 5.5」の第一弾となる Claude Opus 5.5 を正式にリリースした。同社によれば、ほとんどの作業でClaude Fable 5.1と同等のパフォーマンスを発揮しながら、標準設定の典型的なワークロードではOpus 5と比べて 約40%のコスト削減 を実現しているという。

モデルの提供形態はマネージドAPIのみで、ウェイト(モデルの重み)は公開されておらず、セルフホスティングは不可とされている。開発者はClaudeプラットフォームのほか、Amazon Web Services、Google Cloud、Microsoft Azureを通じて claude-opus-5-5 を呼び出せる。従来のOpusモデルと同様、ゼロデータ保持オプションも利用可能だ。

ベンチマーク結果——全体的に優勢も全勝ではない

Anthropicが公開したベンチマーク結果は、Opus 5.5が多くの指標でOpus 5やFable 5.1を上回ることを示している(Opus 5.5のスコアは適応的思考・最大エフォートかつプロダクション向け安全策を有効にした条件で計測)。

ベンチマークOpus 5.5Fable 5.1Opus 5GPT-6 Astra
Terminal-Bench 4.066.4%55.8%52.3%57.9%
FrontierCode v1.154.4%50.3%48.0%53.3%
CursorBench 4.057.8%51.8%46.6%未報告
GDPval-AA v2.1(Elo)1846173517081542
OSWorld 2.081.8%80.7%74.0%未報告
Terminal-Bench-Science 0.158.7%52.6%29.0%64.6%
AutomationBench40.0%31.4%26.9%41.4%

Terminal-Bench-ScienceとAutomationBenchではGPT-6 Astraが依然リードしているとされており、Anthropic自身も「ベンチマークのマージンは信頼できる指標としての役割が低下しつつある」と注意を促している。

コスト調整後の比較では、標準(中程度)エフォート時にOpus 5.5はFrontierCodeで54.6%を記録。これはGPT-6 Astraのトップスコア53.3%を上回りながら、タスクあたりのコストが約5分の1程度とされている。CursorBenchでも中程度エフォートで52.5%を記録し、GPT-5.6 Solのベストスコアを約11ポイント上回ったと報告されている。

価格と速度

Opus 5.5はOpus 5よりも少ない計算リソースで提供できるとされており、価格にもそれが反映されている。

項目(100万トークンあたり)Opus 5.5Opus 5
入力$4$5
出力$20$25
キャッシュ読み込み$0.20$0.50
キャッシュ書き込み$5$6.25

エージェント型・コーディング用途ではキャッシュ読み込みがコストの大部分を占めるが、その単価は 60%削減 されている。さらにOpus 5.5はタスクあたりの使用トークン数も少なく、これらを合わせた結果として40%のコスト削減が実現されるとAnthropicは説明している。出力生成速度もOpus 5比で30%以上高速化されたという。

また、Claude CodeとClaudeプラットフォームに「ファストモード」が用意されており、入力$8・出力$40(100万トークンあたり)で最大2.5倍の速度で利用できるとされている。Pro、Max、Team、エンタープライズ(シートベース)の各プランでは5時間の使用上限も引き上げられる。

実際の活用事例

Anthropicが紹介した早期テスターからの報告は次の通り。

  • 68万行のコードマイグレーションを1日以内に完了したとするテスターがいたと報告されている
  • 20万行のコードベースの監査と修正を3時間未満で実施。Opus 5では20時間以上かかり、トークン消費量も2.5倍だったという
  • CからRustへのHAProxy移植では、Opus 5.5が9.5時間で完了。Fable 5.1は12時間を要し、コストはOpus 5.5が51%安かったとされる
  • Deloitteによるテストでは、最低エフォートのOpus 5.5が既知のレビューバグの72%を検出。高エフォートのOpus 5は56%だったという
  • 入手困難な決算レポートを作成するテストでは、18件中16件がAnthropicの品質基準をクリア。Fable 5.1やOpus 5では基準を満たしたことがなかったと報告されている

文章のスタイル面でも変化があり、Opus 5.5は重要な情報を冒頭に置き、専門用語を減らし、与えられた文体ルールをより忠実に守る傾向があるとされている。

安全性と新たな制約

Opus 5.5は、CEOのDario Amodei氏がフロンティア開発のペーシング(調整)を求めた後の最初のリリースとなる。METRやFrontier Designなど外部評価機関によるテストを経てリリースされており、Anthropicの自動化された行動監査(約2,000シナリオをカバー)では過去最高スコアを記録したという。また、新しい封じ込めテストでは、境界を回避しようとする試みがOpus 5比で約85%減少したとされている。

生物学・サイバーセキュリティ領域の能力はClaude Mythos 5.1と同等とされており、Fable 5.1に類似した安全策が適用される:

  • サイバーセキュリティ: 通常のバグ発見・修正は利用可能。多くのサイバーセキュリティタスクはOpus 4.8に振り向けられる。Cyber Verification ProgramがOpus 5.5に拡張される予定
  • 生物学: 認定組織はLife Sciences Verification Programへの申請が可能
  • 蒸留防止: Preserved thinking機能により、APIユーザーが過去のコンテキストを編集して推論を抽出することを防ぐ(2026年8月31日以降に作成されたAPIアカウントに適用)

さらに重要な変更点として、思考プロセスの無効化が不可 になった。また、EU AI法への対応としてテキスト出力に 透かし(ウォーターマーク) が付与される。詳細はOpus 5.5 System Cardで確認できるとされている。


出典: Anthropic Releases Claude Opus 5.5: Fable 5.1-Level Performance at 40% Lower Running Cost Than Opus 5