テンセントAI研究所오픈소스

Tencent Hy3

이 모델 비교

Tencent가 개발한 고성능 기반 모델. 다양한 작업에 대응하는 범용 능력을 갖추고 있습니다.

파라미터

Undisclosed

컨텍스트

라이선스

Apache 2.0

출시일

2026-07-06

일본어 처리 능력

🌐Multilingual

General multilingual model. Basic Japanese processing is possible, but inferior to specialized models.

API 가격

입력 가격 (1M 토큰당)

$1.2

출력 가격 (1M 토큰당)

$

과금 모드: standard

강점

    약점

      활용 사례

        심층 분석

        SWE-Bench Verified

        78.0%

        GLM-5.2 대비 84.2%

        GPQA Diamond

        90.4%

        STEM 추론 벤치마크

        입력 가격

        100만 토큰당 $0.14

        Tencent Cloud 가격

        환각률

        5.4%

        프리뷰 12.5%에서 하락

        컨텍스트 윈도우

        256K

        토큰

        활성 파라미터

        21B

        전체 295B 중

        강점

        • 뛰어난 에이전트 능력(BrowseComp 84.2, MCP-Atlas 79.1)으로 오픈웨이트 모델 중 선두
        • 크게 낮아진 환각률(5.4%)과 상식 오류(12.7%)로 프로덕션 안정성 확보
        • 매우 비용 효율적(100만 토큰당 $0.14/$0.56)하며 허용적 Apache 2.0 라이선스 채택

        약점

        • 모든 코딩 벤치마크에서 GLM-5.2에 크게 뒤처짐(SWE-Bench 78% 대 84.2%, DeepSWE 28% 대 46.2%)
        • 풀정밀도 서빙에 8개 GPU와 큰 메모리 필요(H20-3e 또는 동급 권장)
        • 벤치마크 신뢰성에 대한 커뮤니티 의구심 및 일부 KV 캐시 관리 미흡 보고

        경쟁사 비교

        ModelArenaSWEGPQAPrice
        GLM-5.2N/A84.2%88.0%$1.40/$4.40
        DeepSeek V4 FlashN/A76.0%85.0%$0.14/$0.28
        GPT-5.5N/AN/AN/A$5.00/$30.00

        Tencent Hy3는 295B 파라미터 MoE(혼합 전문가) 모델로, 토큰당 활성 파라미터는 21B에 불과하며 2026년 7월 6일 상업적으로 허용적인 Apache 2.0 라이선스로 출시되었다. 비용 효율적이고 프로덕션 준비가 된 대형 프런티어 모델 대안으로 positioned, Hy3는 에이전트 작업, 도구 오케스트레이션, 장문 추론에서 탁월하며 환각률을 5.4%로 크게 낮춰 신뢰성을 높였다. 이 모델은 4월 프리뷰 대비 크게 개선되었으며 Tencent 내부 제품팀 50개 이상의 피드백을 반영해 추론, 에이전트 능력, 실제 배포 안정성이 크게 향상되었다.

        Hy3의 전략적 포지셔닝은 GLM-5.2(744B 파라미터) 같은 더 큰 모델의 일부 비용으로 프런티어에 근접한 성능을 제공하는 데 초점을 맞춘다. 코드 작업의 절대적 최고 성능보다 비용 효율성, 라이선스 유연성, 프로덕션 신뢰성을 중시하는 조직에 매력적이다. 이 모델은 수출 규정을 준수하는 하드웨어(H20-3e 등)와 표준 서양 데이터센터 GPU에서 효율적으로 구동되며, 256K 컨텍스트 윈도우는 현대 에이전트 애플리케이션에 필수적인 복잡하고 다단계 워크플로를 지원한다.

        분석 생성일: 2026-08-13