Anthropicプロプライエタリ

Claude Opus 5.5

このモデルを比較

Anthropicが2026年9月22日に公開したClaude 5.5系列の先発モデル。宣伝文句は控えめで具体的で、多くの作業でClaude Fable 5.1相当、ただしOpus 5より実行コストは約40%低い。価格は100万トークンあたり入力$4・出力$20(Opus 5比20%引き)で、100万トークンのコンテキストに長文割増なし。システムカードの自己申告値はSWE-bench Pro 89.9%、Terminal-Bench 4.0 66.4%、HLE(ツールあり)67.7%。思考は常時オンで、effort=lowが下限。

シェア:XはてブLINE

パラメータ

非公開

コンテキスト長

1M

ライセンス

プロプライエタリ

リリース日

2026-09-22

ベンチマーク性能

AA インテリジェンス指数

57.6

LMArena Elo

Human-Like Evaluation

67.7

ARC-AGI-2

SWE-bench Verified

GPQA Diamond

MMLU-Pro

LiveCodeBench

AIME 2025

MATH-500

API料金

入力料金(1Mトークンあたり)

$4

出力料金(1Mトークンあたり)

$20

課金モード: standard

強み

  • 価格はOpus 5比20%引きの$4/$20で、実行コストは約40%低い
  • 100万トークンのコンテキストに長文割増なし、キャッシュ読み取りは60%引き
  • 発表前にMETRとFrontier Designの外部評価を実施、サンドボックス脱出試行は約85%減

弱み

  • ベンチマークはほぼ全て自己申告で、xhigh/maxなどAPIデフォルトより高いeffortの値
  • CodeRabbitの実測では同一入力で出力トークンが約50%増え、20%の値下げでも請求額は増え得る
  • 思考は常時オンで無効化できず、旧プロンプト資産には破壊的変更

活用例

  • 数十万行規模のコードベース監査・移行といった長時間のエンジニアリング作業
  • 誤クリックのコストが高いコンピュータ操作・デスクトップ自動化
  • 第三者の安全評価記録が調達要件になる規制産業

深度分析

Artificial Analysis Intelligence Index

51.2(中)/ 57.6(最大)

AA Index v4.3.2。GPT-6 Solの最大は47.5

実測コスト(1タスク)

$1.34(中)/ $5.98(最大)

同じ測定系。キャッシュ読み書き込みの定価ベース

Input / Output 価格

100万トークンあたり $4 / $20

Opus 5の$5/$25から20%削減。キャッシュ読み$0.20

Context Window

100万トークン

最大出力128K、Batchで300K。長文割増なし

封じ込め境界の突破試行

Opus 5 / Mythos 5.1比で約85%減

Anthropicの申告。METRとFrontier Designの外部評価済み

Release

2026年9月22日

Claude 5.5系の第1弾。Sonnet 5.5とHaiku 5.5も予告

強み

  • Fable 5.1相当の出力をOpus 5比40%低い実行コストで実現し、定価も20%下げた
  • 推論強度をlowからmaxまで1つのエンドポイントで調整でき、安い処理と深い処理を同じモデルで回せる
  • 100万トークン全域で長文割増がなく、272Kで入力単価が倍になるGPT-6 Solと条件が異なる
  • Bedrock、Google Cloud、Microsoft Foundryに同時投入され、しかも公開前に外部評価を受けている

弱み

  • 同じトークン量ならGPT-6 Solの2倍の単価。49タスクの経路検証ではタスクあたりコストが約3.4倍だった
  • 推論を切れず、同一入力でも出力トークンが約50%増えたというCodeRabbitの計測がある。20%の値下げが請求額を押し上げ得る
  • ローンチ時点でシステムカードが公開されていない
  • Opus 5.5自身のSWE-bench VerifiedやGPQA Diamondは未公表で、第三者によるコーディング指標はこれから

競合比較

ModelArenaSWEGPQAPrice
GPT-6 SolAA 47.5(最大)N/AN/A$2/$10
Claude Fable 5.1AA 60N/AN/A$10/$50
Claude Opus 5AA 6396.0%N/A$5/$25

Claude Opus 5.5は2026年9月22日に発表されたClaude 5.5系の第1弾で、能力の跳躍というよりコストの一手である。Anthropicは「多くの作業でClaude Fable 5.1相当」とし、Opus 5と比べて実行コスト40%減、出力速度30%以上向上を主張する。定価は20%下がり、入力100万トークン$4/出力$20となった。Artificial AnalysisのIntelligence Index v4.3.2では既定の中程度設定で51.2、最大設定で57.6。同日発表のGPT-6 Solの最大47.5を上回る。100万トークンの文脈に長文割増はないが、推論は切れない。CEOの減速論表明後に投入された最初のモデルであり、METRとFrontier Designの外部評価を経ている点も特徴である。

分析生成日: 2026-09-23