Google Deep Mind독점

Gemini 3.1 Pro Preview

이 모델 비교

Google DeepMind가 개발한 고성능 멀티모달 모델. 텍스트, 이미지, 영상을 통합 처리합니다.

파라미터

Undisclosed

컨텍스트

1M

라이선스

Proprietary

출시일

2026-02-20

일본어 처리 능력

High-Quality JP

Multilingual model with strong Japanese language processing capabilities.

API 가격

입력 가격 (1M 토큰당)

$2

출력 가격 (1M 토큰당)

$

과금 모드: standard

강점

    약점

      활용 사례

        심층 분석

        GPQA Diamond

        94.3%

        #1 독점 모델 (도구 없음)

        ARC-AGI-2

        77.1%

        ARC Prize 검증, Gemini 3 Pro 대비 2.5배 도약

        SWE-Bench Verified

        80.6%

        단일 시도, Claude Opus 4.6과 약 0.2pp 차

        LMArena Elo

        1481~1501

        다수 트래커 기준 종합 3위 내

        컨텍스트 윈도우

        100만 토큰 (Vertex에서 200만)

        시장 최대 프로덕션 컨텍스트

        입력/출력 가격

        $2.00 / $12.00 per 1M

        표준 계층(입력 200K 이하), Opus 출력 대비 약 40% 저렴

        강점

        • 최고 수준 독점 GPQA Diamond 점수(94.3%)로 급별 과학·다단계 추론
        • 진짜 100만 토큰 컨텍스트에 강한 장문 검색(MRCR v2 128K: 84.9%)으로 복잡한 RAG 파이프라인 불필요
        • 텍스트·이미지·오디오·최대 3시간 비디오를 포괄하는 최고 수준 멀티모달 이해

        약점

        • 여전히 프리뷰 상태로 프로덕션 SLA 없음, API 변경 가능성, 확정 GA 일자 없음
        • 장문 컨텍스트 가격은 입력 200K 토큰 초과 시 2배($4/$18)로 비싸져 전체 윈도우 사용이 고비용
        • 사고 단계 때문인 높은 첫 토큰 시간(~28~30초)으로 경쾌한 대화형 사용 사례에 제약

        경쟁사 비교

        ModelArenaSWEGPQAPrice
        Claude Opus 4.5146276.3%89.1%$15/$75
        GPT-5.2~145280.0%92.4%$10/$30
        Gemini 3 Pro147076.2%91.9%$2/$12

        Gemini 3.1 Pro Preview는 2026년 2월 19일 Google DeepMind가 출시한 모델로, Gemini 제품군 역사상 단일 버전 추론 도약이 가장 큽니다. 암기 저항 설계 벤치마크인 ARC-AGI-2에서 모델은 31.1%(Gemini 3 Pro)에서 검증된 77.1%로, 약 3개월 만에 성능을 2배 이상 끌어올렸습니다. 여기에 기록적인 GPQA Diamond 94.3%(대학원 수준 과학 추론)와 프론티어급 SWE-Bench Verified 80.6%가 더해져, Google은 추론·코딩·멀티모달 전 영역에서 확실한 최상위 경쟁자로 자리잡습니다.

        모델의 정의적 능력은 날 숫자 너머로 확장됩니다. 네이티브 100만 토큰 컨텍스트(Vertex AI에서 200만까지 확장)는 2026년 중반 기준 프로덕션 최대 규모이며, 128K 토큰에서 검증된 장문 검색 정확도 84.9%를 자랑합니다. 비디오 이해는 VideoMME에서 87.2%(Claude Opus 4.5 대비 8점 차)로 비디오 중심 워크플로에 가장 강력한 선택입니다. 또한 Google 생태계와 깊이 통합됩니다. 실시간 데이터용 Search grounding, Workspace·BigQuery 커넥터, Vertex AI의 기업급 거버넌스.

        주된 주의점은 프리뷰 라벨(프로덕션 SLA 미보장, GA 전 API 표면 변경 가능)과 200K 입력 초과 시 비용이 2배가 되는 계층형 가격입니다. Google Cloud 위에 있거나 프론티어 추론에 멀티모달·장문 컨텍스트 지원이 필요한 팀에는 Gemini 3.1 Pro Preview가 해당 계층에서 가장 강한 가격 대비 능력 비율을 제공합니다. 다만 순수 코딩 자율성은 Claude Opus가, 순수 수학 추론은 DeepSeek R2가 앞서므로, 마이그레이션 전 워크로드별 벤치마크가 필수입니다.

        분석 생성일: 2026-08-07