速報

Opus 5.5とGPT-6: AI最新ニュース 9月23日

Opus 5.5とGPT-6: AI最新ニュース 9月23日

90分差という「答え合わせ」

9月22日、AnthropicがClaude Opus 5.5を出し、その約90分後にOpenAIがGPT-6 SolGPT-6 Lunaを出した。両社のCEOが「フロンティア開発を減速すべきだ」と公の場で述べた、その直後の出来事である。

この構図には見覚えがある。私は以前から、フロンティア各社の減速論は安全の問題ではなく商業的な調整弁だと書いてきた。能力の天井を競うレースから、同じ能力をいくらで売るかのレースへ移ったのなら、減速を叫ぶことと安く売ることは何も矛盾しない。むしろ減速の主張は、値下げ競争に正当性を与える化粧だ。

第1ラウンド:天井の高さ

Anthropicの説明は控えめで具体的だ。Opus 5.5は「多くの作業でClaude Fable 5.1相当」、Opus 5と比べて実行コストは40%減、出力速度は30%以上向上。Artificial AnalysisのIntelligence Index v4.3.2(同一運用者が全推論強度で10種の評価を実施)では、デフォルトの中程度設定で51.2、最大設定で57.6。1タスクあたりのコストはそれぞれ1.34ドルと5.98ドルだった。

対するGPT-6 Solは最大設定で47.5、1タスク1.06ドル。天井はAnthropicの勝ちだが、その差は約10ポイント、価格差は約5.6倍である。

第2ラウンド:値札

Opus 5.5は入力100万トークン4ドル、出力20ドル。Opus 5の5ドル/25ドルから20%の値下げで、コンテキストは100万トークン、長文時の割増なし。ただし推論はオフにできず、「低」が下限になる。

GPT-6 Solは2ドル/10ドルで、これはClaude Sonnet 5の料金表とほぼ同一。Lunaは0.10ドル/0.50ドルで、Claude Haiku 4.5の入力単価の10分の1。自前でオープンウェイトをホストする層の価格帯に踏み込んできた。272Kトークン超では両モデルとも入力2倍・出力1.5倍の割増が付く。

同日、OpenAIはGPT-6系のプロンプトキャッシュも改善し、キャッシュ済みプロンプトのコストを最大90%削減すると発表した。長時間動くエージェントにとっては、ベンチマークの1ポイントより効く変更だ。

第3ラウンド:安全の台帳

ここは今、両社が主張ではなく開示で競っている領域である。Opus 5.5は大規模なアラインメント試験に加え、METRとFrontier Designによる外部評価を受けてから公開された。Anthropicによれば、封じ込め境界を突破しようとする試行はOpus 5やMythos 5.1より約85%少ない。

OpenAIも数字を出した。拒否の巻き戻り率はSolが68%から64%へ、Lunaは77%から42%へ低下。掲示板を模したテストで、Solが未承認の指示を実行した割合は52%から11%に下がった。どちらも実質的な改善だ。ただしSolとLunaにはローンチ時点でシステムカードが添付されていない。

第4ラウンド:どこで動くか

Opus 5.5はClaude API、Amazon Bedrock、AWS上のClaude Platform、Google Cloud、Microsoft Foundryで提供される。SolとLunaはOpenAI APIのみ。加えてChatGPT WorkとCodexの有料プラン、無料版とGoはデスクトップでLunaが使えるが、Chatには未搭載。可用性はAnthropicの明確な勝ちだ。

判断

タスクあたりの品質単価で選ぶなら、中量帯はSol、裾野はLuna。49タスクの経路検証では両者とも49/49で、Opus 5.5が0.054ドル、Solが0.016ドルだった。最高の単発結果が必要で、請求書が他人持ちならOpus 5.5。ただしCodeRabbitの評価は重い注記を残している。同一入力でもOpus 5.5の出力トークンは約50%増えており、20%の値下げは請求額を押し上げ得る。一方で、24〜48時間の長時間コーディングでは複雑なバグ検出数が自社ベースラインの2倍だったという。

クイック・スキャン

  • Anthropicの年換算売上高が1000億ドルを突破(2か月で50%増)。IPOは11月を目標とし、Astra対抗モデルを検討中。
  • OpenAIは投資家に対し、2030年までの計算資源支出が8560億ドル、フリーキャッシュフローはマイナス2780億ドルに達すると説明した。
  • NVIDIAの四半期売上高ガイダンスは1080億ドル(前期962億ドル)。Huang氏はバブル警告を「終末論」と一蹴した。
  • DeepSeekはV4.1-FlashのKVキャッシュを1トークンあたり890バイトに削減(V1比437分の1)。GPUあたり同時エージェント数が4倍になり、8兆パラメータモデルの計画も明かした。
  • 米下院はRatepayer Protection Actを417対3で可決。大規模データセンターに送電網増強の増分費用全額を負担させる内容だ。
  • Metaはフランス〜米国を結ぶペタビット級海底ケーブルPetalを発表。xAIのGrok 4.7(9月21日)は2ドル/6ドルを維持し、GitHub Copilotに即日搭載された。
  • OpenAIは9月22日、第三者評価に関する原則も公表した。AnthropicがMETRとFrontier Designを前面に出したのと同じ日である。

編集者の視点

日本の読者にとって、この対決の実務的な結論は性能表ではなく調達先にある。Opus 5.5はAmazon BedrockとGoogle Cloudで提供されるため、既存のクラウド契約と統制の枠内でそのまま使える。SolとLunaはOpenAI APIのみで、ChatGPT WorkとCodexの有料契約が前提だ。日本の多くの企業にとって、モデル選定は技術評価ではなく購買経路の選定になりつつある。私は、11月のAnthropicの開示資料に粗利率の記載があるかどうかを見る。値下げが戦略なのか症状なのかは、そこにしか現れない。

スポンサーリンクおすすめのAIツールを見る

コメント (0)

シェア:Xはてブ

コメントを投稿

読み込み中...