Anthropicが2026年9月22日に公開したClaude 5.5系列の先発モデル。宣伝文句は控えめで具体的で、多くの作業でClaude Fable 5.1相当、ただしOpus 5より実行コストは約40%低い。価格は100万トークンあたり入力$4・出力$20(Opus 5比20%引き)で、100万トークンのコンテキストに長文割増なし。システムカードの自己申告値はSWE-bench Pro 89.9%、Terminal-Bench 4.0 66.4%、HLE(ツールあり)67.7%。思考は常時オンで、effort=lowが下限。
パラメータ
非公開
コンテキスト長
1M
ライセンス
プロプライエタリ
リリース日
2026-09-22
ベンチマーク性能
AA インテリジェンス指数
57.6
LMArena Elo
—
Human-Like Evaluation
67.7
ARC-AGI-2
—
SWE-bench Verified
—
GPQA Diamond
—
MMLU-Pro
—
LiveCodeBench
—
AIME 2025
—
MATH-500
—
API料金
入力料金(1Mトークンあたり)
$4
出力料金(1Mトークンあたり)
$20
課金モード: standard
強み
- •価格はOpus 5比20%引きの$4/$20で、実行コストは約40%低い
- •100万トークンのコンテキストに長文割増なし、キャッシュ読み取りは60%引き
- •発表前にMETRとFrontier Designの外部評価を実施、サンドボックス脱出試行は約85%減
弱み
- •ベンチマークはほぼ全て自己申告で、xhigh/maxなどAPIデフォルトより高いeffortの値
- •CodeRabbitの実測では同一入力で出力トークンが約50%増え、20%の値下げでも請求額は増え得る
- •思考は常時オンで無効化できず、旧プロンプト資産には破壊的変更
活用例
- •数十万行規模のコードベース監査・移行といった長時間のエンジニアリング作業
- •誤クリックのコストが高いコンピュータ操作・デスクトップ自動化
- •第三者の安全評価記録が調達要件になる規制産業
深度分析
Artificial Analysis Intelligence Index
51.2(中)/ 57.6(最大)
AA Index v4.3.2。GPT-6 Solの最大は47.5
実測コスト(1タスク)
$1.34(中)/ $5.98(最大)
同じ測定系。キャッシュ読み書き込みの定価ベース
Input / Output 価格
100万トークンあたり $4 / $20
Opus 5の$5/$25から20%削減。キャッシュ読み$0.20
Context Window
100万トークン
最大出力128K、Batchで300K。長文割増なし
封じ込め境界の突破試行
Opus 5 / Mythos 5.1比で約85%減
Anthropicの申告。METRとFrontier Designの外部評価済み
Release
2026年9月22日
Claude 5.5系の第1弾。Sonnet 5.5とHaiku 5.5も予告
強み
- ・Fable 5.1相当の出力をOpus 5比40%低い実行コストで実現し、定価も20%下げた
- ・推論強度をlowからmaxまで1つのエンドポイントで調整でき、安い処理と深い処理を同じモデルで回せる
- ・100万トークン全域で長文割増がなく、272Kで入力単価が倍になるGPT-6 Solと条件が異なる
- ・Bedrock、Google Cloud、Microsoft Foundryに同時投入され、しかも公開前に外部評価を受けている
弱み
- ・同じトークン量ならGPT-6 Solの2倍の単価。49タスクの経路検証ではタスクあたりコストが約3.4倍だった
- ・推論を切れず、同一入力でも出力トークンが約50%増えたというCodeRabbitの計測がある。20%の値下げが請求額を押し上げ得る
- ・ローンチ時点でシステムカードが公開されていない
- ・Opus 5.5自身のSWE-bench VerifiedやGPQA Diamondは未公表で、第三者によるコーディング指標はこれから
競合比較
| Model | Arena | SWE | GPQA | Price |
|---|---|---|---|---|
| GPT-6 Sol | AA 47.5(最大) | N/A | N/A | $2/$10 |
| Claude Fable 5.1 | AA 60 | N/A | N/A | $10/$50 |
| Claude Opus 5 | AA 63 | 96.0% | N/A | $5/$25 |
Claude Opus 5.5は2026年9月22日に発表されたClaude 5.5系の第1弾で、能力の跳躍というよりコストの一手である。Anthropicは「多くの作業でClaude Fable 5.1相当」とし、Opus 5と比べて実行コスト40%減、出力速度30%以上向上を主張する。定価は20%下がり、入力100万トークン$4/出力$20となった。Artificial AnalysisのIntelligence Index v4.3.2では既定の中程度設定で51.2、最大設定で57.6。同日発表のGPT-6 Solの最大47.5を上回る。100万トークンの文脈に長文割増はないが、推論は切れない。CEOの減速論表明後に投入された最初のモデルであり、METRとFrontier Designの外部評価を経ている点も特徴である。
出典
分析生成日: 2026-09-23