DeepSeek V4.1 Flash는 2026년 9월 10일 공개된 DeepSeek의 멀티모달 플래그십 리프레시다. 100만 토큰 문맥과 네이티브 이미지·오디오 입력을 갖춘 새 아키텍처로, 초당 333–400+ 토큰으로 디코딩한다. 캐시 입력 가격을 약 60% 인하(한산 시간 100만 토큰당 약 0.028달러)했고, V4 Pro 트래픽을 V4.1 Flash로 자동 우회시킨다. 오픈 가중치로 공개되며 DeepSeek의 STAR Market(과창판) 상장 준비의 축이다.
파라미터
TBA (new architecture, native multimodal)
컨텍스트
1M
라이선스
MIT License
출시일
2026-09-10
API 가격
입력 가격 (1M 토큰당)
$0.38
출력 가격 (1M 토큰당)
$
과금 모드: standard
강점
- •100만 토큰 문맥에 이미지·오디오 네이티브 입력
- •333–400+ tok/s 디코딩, 오픈 가중치 플래그십 중 최속급
- •캐시 입력 약 60% 인하(한산 시 약 $0.028/100만)
- •오픈 가중치; V4 Pro 트래픽 자동 우회
약점
- •출시 시 독립 벤치 미공개
- •최상위 클로즈드 모델 대비 멀티모달 품질 미증명
- •처리량은 벤더 수치이며 제3자 계측 아님
활용 사례
- •저비용 장문 문맥이 필요한 고빈도 에이전트·코딩
- •저가 멀티모달 채팅·문서 이해
- •온프레미스 데이터 자체 호스팅 배포
심층 분석
출시
2026년 9월 10일
DeepSeek V4.1 Flash; 네이티브 멀티모달
컨텍스트 창
100만 토큰
이미지+오디오 네이티브 입력
디코딩 속도
333–400+ tok/s
벤더 수치; 오픈 가중치 플래그십 중 최속급
캐시 입력 가격
약 $0.028/100만 (한산)
V4 Pro 대비 60% 인하; 약 0.02위안/100만
라이선스
오픈 가중치 (MIT)
V4 Pro 트래픽 자동 우회
Intelligence Index
TBA
출시 시 독립 벤치 미공개
강점
- ・100만 토큰 문맥에 이미지·오디오 네이티브 입력을 새 아키텍처로 유지
- ・333–400+ tok/s 디코딩——오픈 가중치 플래그십 중 최속급, 고빈도 에이전트에 적합
- ・캐시 입력 약 60% 인하(한산 시 약 $0.028/100만); V4 Pro 트래픽 자동 우회
- ・오픈 가중치로 자체 호스팅·대규모 저비용 운용 가능
약점
- ・출시 시 독립 벤치 미공개——자체 작업으로 검증 필요
- ・최상위 클로즈드 모델(GPT-6 Astra, Gemini) 대비 멀티모달 품질 미증명
- ・처리량은 벤더 수치이며 제3자 계측 아님
경쟁사 비교
| Model | Arena | SWE | GPQA | Price |
|---|---|---|---|---|
| DeepSeek V4 Flash | - | SWE-bench Verified ~79% | GPQA ~91% | ~$0.094 평균 |
| GPT-5.6 Luna | - | - | 91.6% | $0.450 평균 |
| Qwen3.7 Plus | - | - | ~88–90% | $0.40/$1.16 |
DeepSeek V4.1 Flash는 2026년 9월 10일 공개된 DeepSeek의 멀티모달 플래그십 리프레시다. 100만 토큰 문맥과 이미지·오디오를 네이티브 처리하는 새 아키텍처로, 초당 333–400+ 토큰을 디코딩한다. 캐시 입력을 약 60% 인하(한산 시 약 $0.028/100만)했고 V4 Pro 트래픽을 V4.1 Flash로 자동 우회시킨다. 오픈 가중치로 공개되며 DeepSeek의 STAR Market(과창판) 상장 준비의 축이다. 출시 시 독립 벤치는 미공개라 벤더 주장은 잠정적이다.
분석 생성일: 2026-09-11