DeepSeek오픈소스

DeepSeek V4.1 Flash

이 모델 비교

DeepSeek V4.1 Flash는 2026년 9월 10일 공개된 DeepSeek의 멀티모달 플래그십 리프레시다. 100만 토큰 문맥과 네이티브 이미지·오디오 입력을 갖춘 새 아키텍처로, 초당 333–400+ 토큰으로 디코딩한다. 캐시 입력 가격을 약 60% 인하(한산 시간 100만 토큰당 약 0.028달러)했고, V4 Pro 트래픽을 V4.1 Flash로 자동 우회시킨다. 오픈 가중치로 공개되며 DeepSeek의 STAR Market(과창판) 상장 준비의 축이다.

파라미터

TBA (new architecture, native multimodal)

컨텍스트

1M

라이선스

MIT License

출시일

2026-09-10

API 가격

입력 가격 (1M 토큰당)

$0.38

출력 가격 (1M 토큰당)

$

과금 모드: standard

강점

  • 100만 토큰 문맥에 이미지·오디오 네이티브 입력
  • 333–400+ tok/s 디코딩, 오픈 가중치 플래그십 중 최속급
  • 캐시 입력 약 60% 인하(한산 시 약 $0.028/100만)
  • 오픈 가중치; V4 Pro 트래픽 자동 우회

약점

  • 출시 시 독립 벤치 미공개
  • 최상위 클로즈드 모델 대비 멀티모달 품질 미증명
  • 처리량은 벤더 수치이며 제3자 계측 아님

활용 사례

  • 저비용 장문 문맥이 필요한 고빈도 에이전트·코딩
  • 저가 멀티모달 채팅·문서 이해
  • 온프레미스 데이터 자체 호스팅 배포

심층 분석

출시

2026년 9월 10일

DeepSeek V4.1 Flash; 네이티브 멀티모달

컨텍스트 창

100만 토큰

이미지+오디오 네이티브 입력

디코딩 속도

333–400+ tok/s

벤더 수치; 오픈 가중치 플래그십 중 최속급

캐시 입력 가격

약 $0.028/100만 (한산)

V4 Pro 대비 60% 인하; 약 0.02위안/100만

라이선스

오픈 가중치 (MIT)

V4 Pro 트래픽 자동 우회

Intelligence Index

TBA

출시 시 독립 벤치 미공개

강점

  • 100만 토큰 문맥에 이미지·오디오 네이티브 입력을 새 아키텍처로 유지
  • 333–400+ tok/s 디코딩——오픈 가중치 플래그십 중 최속급, 고빈도 에이전트에 적합
  • 캐시 입력 약 60% 인하(한산 시 약 $0.028/100만); V4 Pro 트래픽 자동 우회
  • 오픈 가중치로 자체 호스팅·대규모 저비용 운용 가능

약점

  • 출시 시 독립 벤치 미공개——자체 작업으로 검증 필요
  • 최상위 클로즈드 모델(GPT-6 Astra, Gemini) 대비 멀티모달 품질 미증명
  • 처리량은 벤더 수치이며 제3자 계측 아님

경쟁사 비교

ModelArenaSWEGPQAPrice
DeepSeek V4 Flash-SWE-bench Verified ~79%GPQA ~91%~$0.094 평균
GPT-5.6 Luna--91.6%$0.450 평균
Qwen3.7 Plus--~88–90%$0.40/$1.16

DeepSeek V4.1 Flash는 2026년 9월 10일 공개된 DeepSeek의 멀티모달 플래그십 리프레시다. 100만 토큰 문맥과 이미지·오디오를 네이티브 처리하는 새 아키텍처로, 초당 333–400+ 토큰을 디코딩한다. 캐시 입력을 약 60% 인하(한산 시 약 $0.028/100만)했고 V4 Pro 트래픽을 V4.1 Flash로 자동 우회시킨다. 오픈 가중치로 공개되며 DeepSeek의 STAR Market(과창판) 상장 준비의 축이다. 출시 시 독립 벤치는 미공개라 벤더 주장은 잠정적이다.

분석 생성일: 2026-09-11