DeepSeek-V4-Flash 정식 공개 베타 출시

원제: DeepSeek-V4-Flash Update

왜 중요한가

에이전트 AI 분야에서 복수의 공개 벤치마크 최고 수준 성능을 주장하며, 코드 에이전트 시장 경쟁 구도에 직접적인 영향을 미칠 수 있다.

DeepSeek는 2026년 7월 31일, AI 에이전트 특화 모델 DeepSeek-V4-Flash API의 정식 공개 베타를 출시했다. 모델명을 deepseek-v4-flash로 설정하는 것만으로 이용 가능하며, 에이전트 벤치마크 성능은 V4-Pro-Preview를 크게 상회한다고 밝혔다.

DeepSeek는 2026년 7월 31일, DeepSeek-V4-Flash API의 공개 베타 출시를 공식 발표했다. API 호출 방식은 기존과 동일하며, 모델명을 deepseek-v4-flash로 지정하면 최신 버전을 사용할 수 있다.

에이전트 성능 면에서 V4-Pro-Preview를 크게 초과하는 벤치마크 결과가 공개됐다. 주요 수치는 Terminal Bench 2.1에서 82.7점, NL2Repo 54.2점, Cybergym 76.7점, DeepSWE 54.4점, Toolathlon verified 70.3점, Agent Last Exam 25.2점, Automation Bench(공개) 25.1점, DSBench-FullStack 68.7점, DSBench-Hard 59.6점이다. 공개 벤치마크의 Code Agent 태스크는 DeepSeek Harness 최소 모드(향후 공개 예정)를 프레임워크로 사용해 최대 노력 레벨, top_p=0.95, temperature=1.0 조건에서 테스트됐다.

DeepSeek-V4-Flash는 Responses API 형식을 네이티브로 지원하며, Codex에 특화된 적응도 이루어졌다. 모델 아키텍처 및 규모는 V4-Flash-Preview와 동일하게 유지되며, 재사후훈련(re-post-training)만 진행됐다고 DeepSeek 측은 밝혔다.

이번 업데이트는 DeepSeek-V4-Flash API에만 적용되며, DeepSeek-V4-Pro API 및 앱·웹 모델은 변경되지 않는다. V4-Pro 정식 출시는 추후 예정이라고 안내했다.

출처

api-docs.deepseek.com — 원문 읽기 →