用途別おすすめモデル

あなたの使いたい目的に最適なAIモデルを提案します。コード生成、文章作成、データ分析など、8つのシナリオから選びましょう。

用途を選択

プログラミング・コード生成に最適なモデル

Anthropic

スコア:58
主要ベンチマーク:SWE-bench Verified 95
詳細を見る

Anthropic

スコア:58
主要ベンチマーク:SWE-bench Pro 81.2
該当する活用例:複数ファイルにまたがるコードリファクタリングとソフトウェア工学
詳細を見る

Anthropic

スコア:55
主要ベンチマーク:SWE-bench Verified 93.9
詳細を見る

DeepSeek

スコア:52
主要ベンチマーク:LiveCodeBench 91.6
詳細を見る

DeepSeek

スコア:50
主要ベンチマーク:SWE-bench Verified 80.6
詳細を見る

Thinking Machines Lab

スコア:49
主要ベンチマーク:SWE-bench Verified 77.6
詳細を見る

Alibaba (Qwen)

スコア:46
主要ベンチマーク:LiveCodeBench 80.7
詳細を見る

MiniMaxAI

スコア:45
主要ベンチマーク:SWE-bench Pro 56.2
詳細を見る

ByteDance Seed

スコア:44
主要ベンチマーク:SWE-bench Pro 57.5
詳細を見る

Anthropic

スコア:36
主要ベンチマーク:SWE-bench Pro 89.9
詳細を見る

Anthropic

スコア:35
主要ベンチマーク:SWE-bench Verified 88.6
詳細を見る

アリババ

スコア:34
主要ベンチマーク:LiveCodeBench 87.1
詳細を見る

Moonshot AI

スコア:33
主要ベンチマーク:LiveCodeBench 89.6
詳細を見る

Google Deep Mind

スコア:33
主要ベンチマーク:LiveCodeBench 91.7
詳細を見る

アリババ

スコア:33
主要ベンチマーク:LiveCodeBench 91.6
詳細を見る

Anthropic

スコア:33
主要ベンチマーク:SWE-bench Pro 81.3
詳細を見る

DeepMind

スコア:32
主要ベンチマーク:LiveCodeBench 80
詳細を見る

Meta AI

スコア:32
該当する活用例:大規模リポジトリを対象とした自律コーディングエージェントマルチファイル改修とリファクタリングの自動化
詳細を見る

Alibaba Cloud (Qwen Team)

スコア:32
該当する活用例:フロントエンド / リポジトリ単位のコーディング(Code Arena WebDev 首位)コードレビュー / リファクタリングの低コスト層($6 / 出力トークン)
詳細を見る

xAI

スコア:32
該当する活用例:Terminal-Bench向上の長時間自律コーディングCursorBench級のコードレビューとデバッグの量産
詳細を見る