Alibaba通義のQwen3-VLシリーズの8Bビジョン言語モデル。テキスト・画像・動画を入力として処理し、256Kコンテキスト(1Mまで拡張可能)をサポート。32言語のOCR、GUIエージェント機能、空間認識能力を搭載。Apache 2.0ライセンス。2025年10月15日リリース。
パラメータ
8B
コンテキスト長
256K
ライセンス
Apache 2.0
リリース日
2025-10-15
API料金
入力料金(1Mトークンあたり)
$0.18
出力料金(1Mトークンあたり)
$0.7
課金モード: per-token
強み
弱み
活用例
深度分析
パラメータ
8B
コンテキスト窓
256K tokens
ライセンス
Apache 2.0 (open)
価格 (入/出 100万トークン)
$0.18 / $0.7
DashScope基準
LiveCodeBench
33.2
Leaderboard値
リリース
2025-10-15
強み
- ・Apache 2.0で自己ホスト・商用利用とも自由。8Bなら単一GPUで動き、データ主権を取りやすい
- ・256Kコンテキストとvision対応で、文書画像・スクリーンショット理解を安価に処理できる
- ・入力$0.18/100万トークンは、画像を含む大量RAGの本番コストを極小化する
弱み
- ・LiveCodeBench 33.2と、コード系は軽量なりの上限がある。高精度エンジニアリングには不向き
- ・フラグシップQwen(3.5/3.6系)と比べると総合知能で劣り、複雑な推論は上位に譲る
- ・マルチモーダル品質はベンダー公称値多く、独立したvisionベンチの公開が薄い
競合比較
| Model | Price |
|---|---|
| Qwen3-VL (大規模系) | 上位ティア |
| Gemini 3.5 Flash-Lite | $0.3/$2.5 |
| GPT-4o-mini相当 | OpenAI基準 |
Qwen3-VL-8B-InstructはAlibabaのQwenが出す8Bのオープンビジョン言語モデル。2025年10月15日公開、Apache 2.0、256Kコンテキスト、入力$0.18/出力$0.7(100万トークン)。私の評価では、オープン权重で自分のGPUに載るvisionモデルを探している層にとって、これは現実的な一択に近い。8Bなら消費者向けGPUでも動き、文書画像・スクリーンショット・簡易GUI理解を安価に回せる。弱点はコード系(LiveCodeBench 33.2)で、高精度エンジニアリングには及ばないこと。
分析生成日: 2026-09-16