JARVIS STUDIO ← 블로그
AI 트렌드 2026년 8월 9일

딥시크가 또 해냈다
V4 플래시, Claude보다 출력 86배 싸고 에이전트 점수는 수직 상승

2026년 7월 31일, 딥시크가 V4 플래시를 MIT 오픈소스로 정식 공개했다. 해외 개발자들은 Hacker News에서 700+ 포인트를 터트렸고, 한국은 아직 조용하다. AI 가격 전쟁의 새 국면을 지금 정리한다.

AI는 이제 "누가 더 잘하나"가 아니라 "누가 더 빨리 공짜에 가깝게 주나"로 싸운다. 2026년 7월 31일, 딥시크(DeepSeek)가 V4 플래시(V4-Flash) 정식 버전을 MIT 오픈소스 라이선스로 공개했다. 프리뷰 대비 에이전트 성능은 대폭 뛰었고, 가격은 이미 업계 최저 수준이다.

해외 개발자 커뮤니티 Hacker News에서 700포인트가 넘는 반응이 나왔지만, 국내에서는 아직 조용하다. "모르면 손해"인 타이밍이다.

DeepSeek 공식 사이트 — V4-Flash 정식판 API 공개 배너

▲ deepseek.com 공식 사이트 — 상단 배너에 V4-Flash 정식판 API 공개 안내 (2026.07.31)

82.7
Terminal-Bench
에이전트 점수
+25.8
프리뷰 대비
에이전트 점수 상승
86×
Claude Opus 4.7
출력 대비 저렴

DeepSeek V4 Flash가 뭔가

딥시크 V4 플래시는 V4 시리즈의 '빠르고 저렴한' 버전이다. 구조는 MoE(Mixture-of-Experts) 아키텍처로, 총 2,840억 개의 파라미터를 갖고 있지만 토큰당 실제로 활성화되는 건 130억 개뿐이다. 덕분에 추론 속도는 빠르고, 비용은 낮다.

🧠
284B MoE 아키텍처
총 2,840억 파라미터 · 활성 130억/토큰 · 빠른 추론 속도
📄
100만 토큰 컨텍스트
긴 문서 전체를 한 번에 분석 가능
🔓
MIT 오픈소스
상업적 사용 포함 무제한 · 모델 가중치 공개
🔌
OpenAI/Anthropic 호환
기존 코드 수정 없이 엔드포인트 교체만으로 전환

이번 정식 버전의 핵심은 단순한 아키텍처 업그레이드가 아니라 포스트 트레이닝(post-training)을 다시 했다는 점이다. 구조는 그대로지만 학습을 새로 돌린 덕분에 에이전트 성능이 크게 뛰었다.

이런 소식, 남들보다 먼저 받으실 분?
직접 돌려보고 되는 것만 골라 매주 보내드립니다. 광고성 하이프는 거릅니다.

📮 뉴스레터 신청

에이전트 성능이 얼마나 뛰었나

Terminal-Bench는 AI가 실제로 "일을 시키면 얼마나 잘 하는지"를 측정하는 에이전트 벤치마크다. 단순한 대화 능력이 아니라, 여러 단계의 작업을 연속으로 수행하는 능력을 본다.

V4 Flash (정식, 0731)
82.7
V4 Flash (프리뷰)
56.9
V4-Pro (프리뷰)
~74
Gemini 3.6 Flash
50

프리뷰 대비 25.8포인트 상승이다. 더 주목할 부분은 V4-Flash 정식 버전이 V4-Pro 프리뷰 수준을 넘어섰다는 점이다. 플래시(저가) 버전이 프로(고가) 프리뷰보다 잘한다는 뜻이다.

Artificial Analysis 지능 지수

V4 Flash는 Artificial Analysis Intelligence Index에서 50점을 기록했다. Gemini 3.6 Flash와 동급, 프리뷰 대비 10점 상승이다.

가격 비교 — 얼마나 싸나

성능도 중요하지만 이번 릴리즈에서 더 파급력 있는 부분은 가격이다.

모델 입력 (/1M 토큰) 출력 (/1M 토큰) 캐시 히트
DeepSeek V4 Flash $0.14 $0.28 $0.0028
Claude Opus 4.7 $4.80 $24.00 $2.40
GPT-5.5 $2.50 $10.00
Gemini 3.6 Flash $0.35 $1.05
DeepSeek API 공식 가격표 — V4-Flash 출력 $0.28/1M

▲ api-docs.deepseek.com 공식 가격표 — V4-Flash 출력 $0.28/1M, 캐시 히트 $0.0028 (2026.08 기준)

Claude Opus 4.7 대비 입력 34배, 출력 86배 저렴하다. 에이전트 작업처럼 출력이 많아지는 워크로드에서는 이 차이가 비용을 그대로 1/86로 줄인다. 그리고 캐시 히트 시 입력 비용은 $0.0028 — 사실상 공짜에 가깝다.

MIT 오픈소스의 진짜 의미

단순히 "무료"가 아니다. MIT 라이선스로 공개된다는 건 세 가지를 의미한다.

💡 AMD MI300X 단일 GPU에서 V4 Flash를 로컬 실행한 결과가 HN에서 화제가 됐다. 기업이 온프레미스로 돌릴 수 있다는 뜻이다. 엔비디아 의존성도 줄어든다.

개발자 실용 정보 — 기존 코드 그대로 쓴다

V4 Flash API는 OpenAI ChatCompletions 형식과 Anthropic 메시지 형식을 모두 지원한다. 기존에 GPT-4o나 Claude를 쓰던 코드라면 엔드포인트 URL과 모델명만 바꾸면 된다. Claude Code, OpenCode 같은 AI 코딩 도구의 백엔드도 교체할 수 있다.

Responses API 지원
OpenAI Responses API 기반 에이전트 및 멀티스텝 워크플로우 구축 가능
🤖
에이전트 프레임워크 호환
LangChain, LlamaIndex, AutoGen 등 기존 프레임워크 교체 없이 적용

V4-Pro는 아직 — 더 강한 게 온다

이번에 정식 공개된 건 V4 Flash뿐이다. 더 강력한 V4-Pro는 "곧 출시"라고만 했다. V4-Pro까지 나오면 비용 대비 성능 경쟁은 한 단계 더 올라간다.

V4-Pro 스펙 (정식 출시 전)

총 1.6조 파라미터, 490억 활성/토큰. V4 Flash와 같은 1M 컨텍스트. 에이전트 점수는 Flash보다 높다. 가격 미확정, 빠른 시일 내 출시 예정.

정리 — 지금 알아야 하는 이유

딥시크 V4 Flash 정식 출시가 중요한 이유는 세 가지다.

해외 개발자들은 이미 알고 쓰기 시작했다. 한국에서 아직 모르는 사람들이 많다는 건, 지금 알면 먼저 쓸 수 있다는 뜻이다.

카드뉴스로 보기

DeepSeek V4 Flash 카드뉴스 1/6 DeepSeek V4 Flash 카드뉴스 2/6 DeepSeek V4 Flash 카드뉴스 3/6 DeepSeek V4 Flash 카드뉴스 4/6 DeepSeek V4 Flash 카드뉴스 5/6 DeepSeek V4 Flash 카드뉴스 6/6

실측 위주 AI 뉴스레터 — 직접 돌려보고 되는 것만 골라 매주 보내드립니다.