GPT-5.6値下げ: AI最新ニュース 8月24日

GPT-5.6値下げ: AI最新ニュース 8月24日
一、今日のヘッドライン
米国企業が値下げ競争を開始。 OpenAIは8月21日、開発者向けGPT-5.6 Solの基準価格を2割以上引き下げ(3カ月限定)と発表。7月下旬にも中堅モデルを2割、低コストモデルを8割値下げしていた。GoogleはGemini 3.7 Flashを発表し、価格を前世代の約半額に。米メディアは中国のオープンソース・低価格戦略による圧力と報じた。(出典:CCTV News、Phoenix News、8月23日 — ベンダー公式を優先)
DeepSeek V4 ProがAPIでGAに。 正式版(0813)は同一モデル名で提供され、エージェント能力が大幅強化。Terminal-Bench 2.1で87.9(AnthropicのFable 5は88.0、0.1差)、CyberGym(83.3)とAutomationBenchではFable 5を逆転。OpenAI Responses APIとCodex連携を標準搭載。8月23日から週末は全時間帯を閑散帯価格に統一。(出典:Star Market Daily/DeepSeek公式、8月22–23日 — ベンダー公式を優先)
Anthropicが4つのClaudeエージェントAPIをGA化。 8月20日、Computer Use、新しいBrowser Use、Skills API、Files APIをClaude Platformで一般提供。強化されたComputer Useは複数アクション実行とHIPAA準拠に対応、Files APIは組織ストレージを1TB・レート制限5倍に引き上げ。(出典:Anthropic公式ブログ、8月20日 — ベンダー公式を優先)
二、モデルリリース動向
- OpenAIがCodex Harnessをオープンソース化。 コーディングエージェントの実行フレームワークを公開。
- Black Forest LabsがFLUX-3をリリース。 動画・音声・ロボット動作予測を統合し、最大20秒のネイティブ音声付き動画を生成。
- 小紅書(Xiaohongshu)がdots3-noteを公開。 280Bパラメータ(活性16B)でファーウェイAscendに即日対応。
- HuggingFace/周辺: NVIDIAが蒸留用550B教師モデルを公開、HuggingFaceがテキスト→動作モデルPRISM-1.4Bを発表、Moonshot AIがkvcache-aiと共同でFirecracker基盤のエージェント学習環境AgentENVをオープンソース化。
三、産業と資本
- NVIDIA AIサーバーが値上がり。 主要顧客にラック規模システムが15%超値上がりすると通知(GB200 NVL72は既に280–340万ドル)。メモリ費用が要因。NVIDIAは電力確保のためデータセンター開発のCloverleaf Infrastructureに数億ドルを出資し minority stake を取得。(出典:Cailian Press/TechCrunch、8月23日 — ベンダー公式を優先)
- Goldman Sachs:「実行の時代」へ。 競争の焦点がモデルからワークフロー・エージェント編成へ移ると分析。
- Pinecone NexusがGAし企業ベンチマーク首位。 Nexusを知識層に使ったエージェントがτ-KnowledgeでOpenAI・Anthropic・Googleの最前線モデルを上回った。
- RampがRouterを発表。 OpenAI・Anthropic・DeepSeek・Moonshot・Minimax・NVIDIA・xAI・Z.aiを横断する統合ルーターを2026年末まで無料提供。
- 米軍のAI信頼危機。 国防総省はAnthropicとの2億ドル契約をモデル制限維持を理由に打ち切り、空軍は武器システムからのAnthropic製品除去を一時指示。(出典:China News Service、8月23日 — ベンダー公式を優先)
四、中国の力
- DeepSeek V4 Pro(ヘッドライン参照)は圧倒的な低コスト(入力約3元/百万トークン、出力6元)で国内エージェント基準を塗り替えた。
- 小紅書 dots3-note がファーウェイAscend即日対応でオープンウェイトの波に加わる。
- 人手・AI顧客対応協調の初の国家基準 が9月1日施行。複雑な苦情は明確な有人対応への引き継ぎを義務付ける。(出典:China National Radio、8月23日 — ベンダー公式を優先)
- 第2回世界人型ロボット競技大会 は種目を26から51に拡大。
五、今日の視点
今週の本質は個別モデルではなく、レバレッジの所在だ。PineconeのNexusが企業知識ベンチマークで最前線モデルのエージェントを上回り、NVIDIA自身の研究も「エージェントharnessはベースモデルを上回る」と示す。エージェント用途では検索・編成層がモデル単体の能力を上回って結果を決める。これは予算の限られた開発者にとって好材料であり、巨大モデル単体でパイプラインの欠陥を直せると信じる人への警鐘でもある。
編集者の視点
今日の値下げが目を引くが、私が静かな本命とするのはAnthropicの4 API昇格だ。Computer Use・Browser Use・Skills API・Files APIが揃い、Claudeは「答えるモデル」から「ファイルを納品するプラットフォーム」になる。企業が2年待っていたまさにこれだ。32分→13分の数字は魅力的だが、computer-useが撮るスクリーンショット1枚ごとがトークンを焼く以上、コスト試算は実案件の請求を見てから信じたい。
読み込み中...