DeepSeek V4.1 Flashは、2026年9月10日に公開されたDeepSeekのマルチモーダル旗艦リフレッシュ。100万トークン文脈とネイティブな画像・音声入力を持つ新アーキテクチャで、333–400+ tok/sでデコードする。キャッシュ入力価格を約60%引き(閑散時は100万トークンあたり約0.02元=約0.028ドル)とし、V4 ProのトラフィックをV4.1 Flashへ自動迂回する。オープンウェイト公開で、DeepSeekのSTAR Market上場準備の柱となる。
パラメータ
TBA (new architecture, native multimodal)
コンテキスト長
1M
ライセンス
MIT License
リリース日
2026-09-10
API料金
入力料金(1Mトークンあたり)
$0.38
出力料金(1Mトークンあたり)
$
課金モード: standard
強み
- •1M-token context with native multimodal (image/audio) input
- •Decode 333–400+ tok/s, among the fastest open-weight flagships
- •Cached-input price cut ~60%, off-peak as low as ~$0.028/1M tokens
- •Open-weight license; V4 Pro traffic auto-routed to it
弱み
- •Independent benchmark numbers not published at launch
- •Multimodal quality vs top closed models unproven
- •Throughput claims are vendor figures, not third-party runs
活用例
- •高頻度エージェント・コーディングの低コスト長文脈層
- •低価格マルチモーダルチャット・文書理解
- •データをオンプレミスに置く自己ホスト展開
深度分析
リリース
2026年9月10日
DeepSeek V4.1 Flash;ネイティブマルチモーダル版
コンテキストウィンドウ
100万トークン
画像+音声のネイティブ入力
デコード速度
333–400+ tok/s
ベンダー数値;オープン重み旗艦で最速級
キャッシュ入力価格
約0.028ドル/100万(閑散時)
V4 Pro比60%減;約0.02元/100万
ライセンス
オープンウェイト(MIT)
V4 Proトラフィックが自動迂回
Intelligence Index
TBA
ローンチ時独立ベンチ未公開
強み
- ・100万トークン文脈に画像・音声のネイティブ入力を新アーキテクチャで維持
- ・333–400+ tok/sでデコード——オープン重み旗艦で最速級、高頻度エージェントに向く
- ・キャッシュ入力を約60%引き(閑散時約0.028ドル/100万);V4 Proトラフィックが自動迂回
- ・オープンウェイトで自己ホスト・大規模安価運用が可能
弱み
- ・ローンチ時独立ベンチは未公開——自タスクで検証を
- ・最上位クローズドモデル(GPT-6 Astra、Gemini)比のマルチモーダル品質は未証明
- ・スループットはベンダー数値で、第三者計測ではない
競合比較
| Model | Arena | SWE | GPQA | Price |
|---|---|---|---|---|
| DeepSeek V4 Flash | - | SWE-bench Verified ~79% | GPQA ~91% | 約0.094ドル平均 |
| GPT-5.6 Luna | - | - | 91.6% | 0.450ドル平均 |
| Qwen3.7 Plus | - | - | 約88–90% | $0.40/$1.16 |
DeepSeek V4.1 Flashは2026年9月10日に公開されたDeepSeekのマルチモーダル旗艦リフレッシュ。100万トークン文脈と画像・音声をネイティブに扱う新アーキテクチャで、333–400+ tok/sでデコードする。キャッシュ入力を約60%引き(閑散時約0.028ドル/100万)にし、V4 ProトラフィックをV4.1 Flashへ自動迂回する。オープンウェイトで公開され、DeepSeekのSTAR Market上場準備の柱となる。ローンチ時独立ベンチは未公開のため、ベンダー主張は暫定と見なすべき。
分析生成日: 2026-09-11