AI Models Navi
리더보드
모델
비교
가격
블로그
도구
더보기
한국어
KO
리더보드로 돌아가기
종합 랭킹
코딩 능력
수학 능력
AI 에이전트 능력
추론 능력
범용 성능
OpenClaw 랭킹
추론 능력
HLE, ARC-AGI-2, GPQA Diamond 기반 추론·사고 능력 평가.
…
벤치마크 소개
HLE
総合知能テスト — 人間レベルの推論能力を測定
ARC-AGI-2
抽象的推論ベンチマーク — 新規パターンの汎化能力を測定
GPQA Diamond
Graduate-Level Google-Proof Q&A — 大学院レベルの科学的推論能力を測定