AI는 이제 "누가 더 잘하나"가 아니라 "누가 더 빨리 공짜에 가깝게 주나"로 싸운다. 2026년 7월 31일, 딥시크(DeepSeek)가 V4 플래시(V4-Flash) 정식 버전을 MIT 오픈소스 라이선스로 공개했다. 프리뷰 대비 에이전트 성능은 대폭 뛰었고, 가격은 이미 업계 최저 수준이다.
해외 개발자 커뮤니티 Hacker News에서 700포인트가 넘는 반응이 나왔지만, 국내에서는 아직 조용하다. "모르면 손해"인 타이밍이다.
▲ deepseek.com 공식 사이트 — 상단 배너에 V4-Flash 정식판 API 공개 안내 (2026.07.31)
에이전트 점수
에이전트 점수 상승
출력 대비 저렴
DeepSeek V4 Flash가 뭔가
딥시크 V4 플래시는 V4 시리즈의 '빠르고 저렴한' 버전이다. 구조는 MoE(Mixture-of-Experts) 아키텍처로, 총 2,840억 개의 파라미터를 갖고 있지만 토큰당 실제로 활성화되는 건 130억 개뿐이다. 덕분에 추론 속도는 빠르고, 비용은 낮다.
이번 정식 버전의 핵심은 단순한 아키텍처 업그레이드가 아니라 포스트 트레이닝(post-training)을 다시 했다는 점이다. 구조는 그대로지만 학습을 새로 돌린 덕분에 에이전트 성능이 크게 뛰었다.
이런 소식, 남들보다 먼저 받으실 분?
직접 돌려보고 되는 것만 골라 매주 보내드립니다. 광고성 하이프는 거릅니다.
에이전트 성능이 얼마나 뛰었나
Terminal-Bench는 AI가 실제로 "일을 시키면 얼마나 잘 하는지"를 측정하는 에이전트 벤치마크다. 단순한 대화 능력이 아니라, 여러 단계의 작업을 연속으로 수행하는 능력을 본다.
프리뷰 대비 25.8포인트 상승이다. 더 주목할 부분은 V4-Flash 정식 버전이 V4-Pro 프리뷰 수준을 넘어섰다는 점이다. 플래시(저가) 버전이 프로(고가) 프리뷰보다 잘한다는 뜻이다.
V4 Flash는 Artificial Analysis Intelligence Index에서 50점을 기록했다. Gemini 3.6 Flash와 동급, 프리뷰 대비 10점 상승이다.
가격 비교 — 얼마나 싸나
성능도 중요하지만 이번 릴리즈에서 더 파급력 있는 부분은 가격이다.
| 모델 | 입력 (/1M 토큰) | 출력 (/1M 토큰) | 캐시 히트 |
|---|---|---|---|
| DeepSeek V4 Flash | $0.14 | $0.28 | $0.0028 |
| Claude Opus 4.7 | $4.80 | $24.00 | $2.40 |
| GPT-5.5 | $2.50 | $10.00 | — |
| Gemini 3.6 Flash | $0.35 | $1.05 | — |
▲ api-docs.deepseek.com 공식 가격표 — V4-Flash 출력 $0.28/1M, 캐시 히트 $0.0028 (2026.08 기준)
Claude Opus 4.7 대비 입력 34배, 출력 86배 저렴하다. 에이전트 작업처럼 출력이 많아지는 워크로드에서는 이 차이가 비용을 그대로 1/86로 줄인다. 그리고 캐시 히트 시 입력 비용은 $0.0028 — 사실상 공짜에 가깝다.
MIT 오픈소스의 진짜 의미
단순히 "무료"가 아니다. MIT 라이선스로 공개된다는 건 세 가지를 의미한다.
- 상업적 사용 제한 없음 — 제품에 그대로 넣어도 된다
- 모델이 사라지지 않는다 — API 서비스가 종료되어도 가중치는 남는다. 지금 능력은 영원히 사용 가능하다
- 자체 호스팅 가능 — AMD MI300X GPU 하나로 돌릴 수 있다. 클라우드 의존도 제로
개발자 실용 정보 — 기존 코드 그대로 쓴다
V4 Flash API는 OpenAI ChatCompletions 형식과 Anthropic 메시지 형식을 모두 지원한다. 기존에 GPT-4o나 Claude를 쓰던 코드라면 엔드포인트 URL과 모델명만 바꾸면 된다. Claude Code, OpenCode 같은 AI 코딩 도구의 백엔드도 교체할 수 있다.
V4-Pro는 아직 — 더 강한 게 온다
이번에 정식 공개된 건 V4 Flash뿐이다. 더 강력한 V4-Pro는 "곧 출시"라고만 했다. V4-Pro까지 나오면 비용 대비 성능 경쟁은 한 단계 더 올라간다.
총 1.6조 파라미터, 490억 활성/토큰. V4 Flash와 같은 1M 컨텍스트. 에이전트 점수는 Flash보다 높다. 가격 미확정, 빠른 시일 내 출시 예정.
정리 — 지금 알아야 하는 이유
딥시크 V4 Flash 정식 출시가 중요한 이유는 세 가지다.
- 가격 전쟁이 임계점을 넘었다 — Claude 대비 86배 싸다는 건 시장 압력이 된다. 경쟁사들도 반응할 수밖에 없다
- 오픈소스라서 영구적이다 — API가 사라져도 모델은 남는다. 지금의 성능을 영원히 쓸 수 있다
- 에이전트 실전 성능이 뛰었다 — 벤치마크 숫자가 아니라 실제로 "일 시키면 더 잘한다"는 게 확인됐다
해외 개발자들은 이미 알고 쓰기 시작했다. 한국에서 아직 모르는 사람들이 많다는 건, 지금 알면 먼저 쓸 수 있다는 뜻이다.
카드뉴스로 보기
실측 위주 AI 뉴스레터 — 직접 돌려보고 되는 것만 골라 매주 보내드립니다.