Gemini 3.7 Flash 공개: AI 뉴스 8월 14일

Google은 주력 모델은 내놓지 않은 채 반복 속도를 높였고, 중국 진영의 오픈 웨이트 물결이 다시 거세졌으며, NVIDIA는 GPU를 월가의 자산군으로 바꿔 놓았다. 지난 24시간의 AI 동향을 다섯 개 섹션으로 정리한다. 일차 출처가 아닌 매체·애그리게이터 기반 내용은 벤더 공식 확인 필요.
1. 오늘의 톱
Google, Gemini 3.7 Flash 공개 — 3.6 Flash 이후 단 3주 만. 8월 13일 Google은 Gemini 3.7 Flash를 발표하며 "코딩과 에이전트를 위한 가장 똑똑한 워크호스 모델"이라고 규정했다. 주목할 점은 개별 벤치마크보다 투입 속도다. 직전 Flash에서 겨우 3주 만에 다음 반복이 나온 반면, 오랫동안 미뤄진 주력 Gemini 3.5 Pro는 여전히 모습을 보이지 않았다.
성능 향상은 실재하지만 점진적이다. 코딩에서 DeepSWE v1.1이 49.0%에서 65.3%로, FrontierCode 1.1 Main이 34.4%에서 43.6%로 올랐다. WebDev Arena의 Elo는 1538에서 1588이 되었고, 문서 처리 계열에서는 GDP.pdf 벤치마크가 22.0%에서 34.0%, AutomationBench가 17.0%에서 30.4%로 개선되었다. Google은 다단계 계획과 도구 호출에서 "더 세심하게 사고한다"고 설명했고, CBRN 및 사이버 공격 영역의 안전장치도 갱신했다고 밝혔다.
더 뚜렷한 신호는 가격이다. 2026년 말까지 도입 가격은 입력 100만 토큰당 0.75달러, 출력 100만 토큰당 3.75달러 — 3.6 Flash 출시 당시의 절반이다(Google). Gemini API, AI Studio, Android Studio, Google Antigravity, Gemini Enterprise에서 이미 사용 가능하며, AI Pro/Ultra 구독자에게는 에이전트 Gemini Spark를 구동한다. 다만 일반 챗봇은 당분간 3.6 Flash로 유지된다. 한편 주력 3.5 Pro는 지연이 이어진다. Google은 Gemini 4를 학습 중이라고 밝혔으며, 공동 창업자 Sergey Brin이 핵심 AI 인력에게 OpenAI·Anthropic과의 코딩 격차를 좁히라고 직접 압박했다는 보도도 있다(Reuters, 벤더 공식 확인 필요). 또한 Sundar Pichai CEO는 Gemini 앱의 월간 사용자가 10억 명을 넘었다고 말했다.
2. 모델 소식
- DeepSeek V4 Pro 정식판 출시(V4-Pro-0813). DeepSeek이 API 문서를 갱신해 기존 V4 Flash와 함께 안정판 Pro를 호출할 수 있게 되었다. 100만 토큰 컨텍스트와 384K 최대 출력을 유지하며, 가격은 입력 100만 토큰당 3위안, 출력 6위안, 캐시 적중 입력 0.025위안이다(DeepSeek 공식 문서 / Lanjing News, 벤더 공식 확인 필요). 에이전트형 코딩 벤치마크 DeepSWE에서 프리뷰 12.8에서 62.7로 올랐다고 보도되었으며, Artificial Analysis의 Intelligence Index v4.1.1에서 V4 Pro는 53으로 GPT-5.6 Solo(61)와 Claude Opus 5(63)에 뒤지지만 작업당 약 0.06달러(Opus 5는 2.34달러) 수준이다.
- Alibaba, Qwen3.8-Max 가중치 공개(2.4T-A95B). 8월 13일, Alibaba가 Max급 주력 모델의 가중치를 개방한 것은 처음이다(Alibaba / 각종 보도, 벤더 공식 확인 필요). 팀은 약 16일간의 자율 코딩과 연구 논문 독립 재현 같은 극한 데모를 공개했다.
- NVIDIA, Nemotron 3.5 Lightning과 NeMo Switchyard 투입. 장시간 구동되는 에이전트의 실행 계층을 겨냥한, 더 작고 빠른 오픈 Nemotron 모델(노트북의 단일 GPU에서 구동)과 Rust로 작성된 오픈소스 라우팅 라이브러리 NeMo Switchyard를 공개했다. 후자는 Kong, OpenRouter, LiteLLM이 이미 채택을 진행 중이다. 사내 테스트에서 오픈 모델군과 Opus 4.8을 라우팅으로 결합해 프런티어급 정확도를 유지하면서 Opus 단독의 약 3분의 1 비용을 달성했다고 한다. Hugging Face, ModelScope, OpenRouter, build.nvidia.com에서 제공.
- Meta, Muse Glimmer 공개. 로컬 에이전트 워크플로(계획, 도구 호출, 자기 점검, 장애 복구)에 최적화한 약 300억 파라미터 오픈 모델. 주력 Muse Spark 1.2 가중치도 곧 공개할 예정이라고 밝혔다(각종 보도, 벤더 공식 확인 필요).
- Google DeepMind, 수어 AI를 소비자용으로. 대규모 다국어 수어-텍스트 변환(SL2T) 모델이 Pixel 11의 Gboard와 Live Transcribe에서 미국 수어 입력을 지원한다. 수어 AI가 소비자 제품에 탑재된 첫 사례다(IT Home, 벤더 공식 확인 필요).
3. 산업과 자본
- NVIDIA와 월가 6개사, 5000억 달러 GPU 금융 플랫폼 구축. NVIDIA는 Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs, KKR와 MOU를 체결해 5000억 달러 이상의 제3자 자본 동원을 목표로 한다. Jensen Huang CEO는 이를 "기술 칩이 투자 가능한 자산군이 된 첫 사례"라고 표현했다. 보도에 따르면 오하이오주의 10GW 규모 OpenAI 데이터센터에 최대 2500억 달러의 스탠바이 금융, 여기에 약 3500억 달러의 칩 조달 패키지도 협의 중이다. 발표 당일 NVIDIA 주가는 2.86% 하락해 217.55달러로 마감했고, Michael Burry와 Jim Chanos 같은 공매도 세력이 "순환 금융" 우려를 제기했다(insideAI.news / Cailian Press, 벤더 공식 확인 필요).
- Anthropic, IPO 전 초기 투자자 회동. Krishna Rao CFO가 주도하는 고위급 협의 단계로, 일부 투자자는 약 2조 달러의 밸류에이션을 언급하지만 이는 회사의 공식 목표가 아니다. Anthropic은 5월 말 9650억 달러 밸류에이션으로 자금을 조달했고(OpenAI의 8520억 달러 상회), 연환산 매출 실행률은 470억 달러를 넘는다고 공개했다(금융계, 벤더 공식 확인 필요).
- Intel, 200억 달러 규모 주식 발행으로 AI 투자를 가속. 2026년 미국 기업의 증자 규모는 약 1050억 달러에 달하며 이 중 약 40%가 AI 관련으로 추정된다(Goldman Sachs 데이터).
- Synopsys, 세계 최초 HBM4 IP 테스트칩 검증 성공. 9.2Gbps에서의 안정 동작을 확인했으며, 차세대 AI 가속기의 메모리 대역폭에서 이정표가 된다.
4. 중국의 힘
- 중국산 모델의 주간 토큰 호출량, 15주 연속 세계 1위. 지난주 국내 모델의 호출량은 34.25조 토큰(전주 대비 +21.76%)으로, 전 세계 약 69조 토큰 중 미국을 앞섰다(National Business Daily / 21st Century Business Herald, 벤더 공식 확인 필요).
- 오픈 웨이트가 클로즈드 모델을 "포위". Hugging Face의 2026년 봄 보고서에 따르면 중국산 오픈 모델의 다운로드 비중은 41%에 달해 처음으로 미국을 넘어섰고, 누적 다운로드는 100억 회를 돌파했다.
- 규모보다 효율. DeepSeek V4는 추론을 Huawei의 950PR 칩에서 구동하도록 최적화되었고(학습에는 NVIDIA 제품 사용), Kimi K3(2.8조 파라미터, 896개 전문가 중 16개만 활성)와 Tencent Hy3(총 2950억, 실효 210억) 같은 MoE 설계가 미국의 칩 수출 규제 아래 연산 비용을 낮추고 있다.
- 중국, AI 글로벌 거버넌스 추진. 국영 매체에 따르면 세계인공지능협력기구는 38개 창설 회원국을 두고 있으며, 향후 5년간 개발도상국을 대상으로 5000명의 AI 연수 정원을 제공할 예정이다.
5. 오늘의 관찰
- Anthropic, Claude 출력에 비가시 워터마크 삽입. 8월 2일 이후 출시된 모든 모델에 대해 Anthropic은 사람은 인지할 수 없고 기계만 판별할 수 있는 워터마크를 텍스트에 부여하고, 다른 매체에는 C2PA 출처 메타데이터를 부여한다. EU AI법(2026년 12월까지 유예 기간) 준수가 목적이다. 방식은 공격적이다. 모델 계층에서 적용되기 때문에 경미한 편집만 거친 텍스트에도 표시가 붙을 수 있다. 비판적 시각에서는 악의적 행위자는 쉽게 제거할 수 있는 반면 일반 사용자가 부당하게 표시될 수 있다는 점이 문제로 지적된다(각종 보도, 벤더 공식 확인 필요).
- 투입 속도 자체가 전략인가. 3.5 Pro가 늦어지는 가운데 Flash 계열을 잘게 계속 내놓고 동시에 인재 유출도 보도되는 상황에 대해, 애널리스트들 사이에서는 Google이 모멘텀의 "겉보기"를 관리하는 것인지, 아니면 3.5 Pro를 출시하지 않고 Gemini 4 Pro를 다음 주력으로 삼는 방향으로 조용히 전환하는 것인지에 대한 물음이 제기된다.
WebSearch와 일차 출처(Google Blog, DeepSeek 공식 문서)를 Reuters, Bloomberg, Ars Technica, Axios, 9to5Google, insideAI.news와 상호 검증해 작성. 이번 회차에는 Grok을 사용할 수 없었다. 매체·애그리게이터 기반 항목은 벤더 공식 확인 필요.
로딩 중...