Mistral AI開発の高性能モデル。効率性と性能のバランスに優れる。
パラメータ
非公開
コンテキスト長
ライセンス
プロプライエタリ
リリース日
2026-05-01
日本語性能
多言語対応モデルのうち、日本語処理に優れた性能を持つモデル。
API料金
このモデルのAPI料金情報は現在未公開です
強み
弱み
活用例
深度分析
SWE-Bench Verified
77.6%
オープンウェイトモデルとしては最高。Claude Sonnet 4.6(79.6%)にはわずかに及ばない
τ³-Telecom
91.4%
エージェント型ツール利用においてクラス最高のスコア
パラメータ数
128B(dense)
各トークンに対して全パラメータが活性化
コンテキストウィンドウ
256Kトークン
Claude Sonnet 4.6(200K)よりも大容量
入力価格
$1.50/1M
GPT-4o($2.50)より安価
オープンウェイト
Yes(Modified MIT)
商用利用時の売上上限:月額$20M
強み
- ・単一の統合モデルで3つの専門モデル(指示追随、推論、コーディング)を置き換え可能。
- ・オープンウェイトモデルとして最先端のコーディングエージェント性能(SWE-Bench 77.6%)。
- ・リクエストごとに推論の深さを調整可能(高速応答 vs. 深い思考)。
弱み
- ・一部のオープンウェイト競合と比較してAPI出力価格が高い($7.50/1M)。
- ・セルフホスティングには大規模なハードウェアが必要(最低4基のH100 80GB GPU)。
- ・公式ベンチマークの報告が不完全(MMLU、GPQAなどが未掲載)。
競合比較
| Model | Arena | SWE | GPQA | Price |
|---|---|---|---|---|
| Claude Sonnet 4.6 | N/A | 79.6% | N/A | $3.00/$15.00 |
| DeepSeek V4 Pro | N/A | 80.6% | N/A | $1.74/$3.48 |
| Qwen 3.6 27B | N/A | 72.4% | N/A | $0.20/$0.60 |
Mistral Medium 3.5は、Mistral AIの2026年4月のフラッグシップモデルであり、これまでの専門モデル(推論用Magistral、コーディング用Devstral 2、指示追随用Medium 3.1)を単一のdense 128Bパラメータアーキテクチャに統合する戦略的転換を表しています。この「統合モデル」アプローチにより、デプロイメントの簡素化と、複雑なエージェントワークフローにおけるモデルルーティングの不要化を目指しています。256Kトークンという大容量コンテキストウィンドウ、リクエストごとの推論量調整機能、可変画像サイズに対応するカスタム訓練のビジョンエンコーダーを備えています。
プレミアムなオープンウェイトコーディングエージェントモデルとして位置づけられ、SWE-Bench Verifiedで77.6%を達成し、Claude Sonnet 4.6などのクローズドソースリーダーに迫るエリートクラスに位置しています。τ³-Telecomベンチマークでの91.4%というスコアが、突出したエージェント能力を示しています。本リリースはMistralのプロダクトエコシステムと密接に統合されており、Vibeの非同期クラウドコーディングエージェントやLe ChatのWork Modeを支えています。API価格は性能ティアに対して競争力がありますが、Modified MITライセンスとセルフホスティングに必要な大規模インフラにより、データ主権や大量のエージェントワークロードが必要なチーム向けの特定の価値提案となっています。
出典
分析生成日: 2026-07-17