Thinking Machines Lab오픈소스

Inkling

이 모델 비교

Thinking Machines Lab의 추론 모델입니다.

파라미터

Undisclosed

컨텍스트

1M

라이선스

Apache 2.0

출시일

2026-07-15

일본어 처리 능력

🌐Multilingual

General multilingual model. Basic Japanese processing is possible, but inferior to specialized models.

API 가격

입력 가격 (1M 토큰당)

$3.74

출력 가격 (1M 토큰당)

$9.36

과금 모드: standard

강점

    약점

      활용 사례

        심층 분석

        Total/Active Parameters

        975B/41B

        전문가 혼합(Mixture-of-Experts) 구조

        Context Window

        1M tokens

        오픈웨이트로 제공

        SWE-Bench Verified

        77.6%

        Nemotron 3 Ultra 대비: 70.7%

        GPQA Diamond

        87.2%

        강력한 과학 추론

        VoiceBench

        91.4%

        오픈웨이트 중 최상위 오디오 성능

        Input Price (64K ctx)

        $1.87/1M

        Tinker API 기준

        FORTRESS Adversarial

        78.0%

        오픈웨이트 중 최고 안전성

        강점

        • 통합 아키텍처로 텍스트·이미지·오디오를 아우르는 네이티브 멀티모달 추론
        • 정밀한 비용-성능 최적화를 위한 제어 가능한 사고 노력(0.2~0.99)
        • 우수한 토큰 효율성과 함께 강력한 에이전트 및 코딩 역량
        • 무제한 기업 커스터마이즈와 배포를 가능케 하는 Apache 2.0 라이선스
        • 오픈 모델 중 유해 질의 거부율이 최고 수준인 탄탄한 안전 프로필

        약점

        • 사실성 점수(SimpleQA 43.9%)가 GPT-5.6 Sol(71.6%) 같은 주요 폐쇄형 모델에 크게 뒤처짐
        • 방대한 하드웨어 요구사항(BF16 기준 2TB VRAM)이 접근 가능한 로컬 배포를 제한
        • 최고 수준 추론(HLE 텍스트 전용 29.7%)이 GLM 5.2(40.1%) 같은 특화 모델에 밀림
        • 창의적 글쓰기와 정교한 지시 따르기는 프런티어 폐쇄형 모델에 뒤처짐

        경쟁사 비교

        ModelArenaSWEGPQAPrice
        GLM 5.2N/A80.0%89.5%Open Weights
        DeepSeek V4 ProN/A80.6%88.8%Open Weights
        Claude Fable 5 (max)N/A95.0%92.6%Closed Weights
        GPT-5.6 Sol (xhigh)N/A82.2%94.1%Closed Weights

        Inkling은 Thinking Machines Lab의 첫 오픈웨이트 파운데이션 모델로, 벤치마크 압도보다는 커스터마이즈에 최적화된 폭넓고 균형 잡힌 범용 모델입니다. 희소 MoE(전문가 혼합) 구조로 전체 파라미터 975B(활성 41B)를 가지며, 인코더 없는 통합 설계로 텍스트·이미지·오디오를 네이티브하게 처리합니다. 이 모델의 핵심 혁신은 제어 가능한 사고 노력으로, 개발자가 추론 예산을 0.2에서 0.99까지 조절해 성능과 토큰 비용·지연 시간을 정밀하게 균형 맞출 수 있습니다.

        기업 파인튜닝을 위한 실용적 멀티모달 파운데이션으로 포지셔닝된 Inkling은 추론·코딩·안전 벤치마크에서 경쟁력 있는 성능을 보이되 최첨단은 아니며, 네이티브 멀티모달·토큰 효율성·진정한 오픈소스 라이선스(Apache 2.0)라는 고유한 장점을 제공합니다. 에이전트 워크플로에서 탁월하며 미국 연구소가 낸 선도적 오픈웨이트 모델이지만, 순수 추론에서는 중국 특화 오픈 모델에, 최고 성능에서는 상위 폐쇄형 모델에 뒤처집니다.

        이 릴리스는 프런티어 규모만 좇는 것이 아니라 커스터마이즈 가능하고 효율적이며 신뢰할 수 있는 AI 시스템 구축에 집중하는 Thinking Machines의 방향을 보여줍니다. 모델은 자사 Tinker 플랫폼을 통한 즉시 파인튜닝이 가능하며, HuggingFace에 전체 가중치가 있고 주요 추론 제공업체와 배포 파트너십이 맺어져 있습니다.

        분석 생성일: 2026-08-09