1. DeepSeek V4: 1.6조 MoE, MIT 라이선스로 완전 공개
2026년 7월 20일, DeepSeek가 V4 GA를 출시했다. 회사 역사상 가장 강력한 모델 세대로, V4-Pro와 V4-Flash 두 가지 변형을 MIT 오픈소스 라이선스로 공개했다.
| 지표 | DeepSeek V4-Pro | DeepSeek V4-Flash |
|---|---|---|
| 아키텍처 | MoE, 1.6T 총 파라미터 / 49B 활성 | 284B 총 파라미터 / 13B 활성 |
| 컨텍스트 윈도우 | 100만 토큰 | 100만 토큰 |
| 라이선스 | MIT | MIT |
| 출력 가격 | 커스텀 | 0.28달러 / 100만 토큰 |
| Codeforces Rating | 3,206 | — |
V4는 DeepSeek 최초의 시간대별 요금 체계를 도입했다. 피크밸리 종량제로, 지정된 평일 피크 시간대에는 가격이 2배가 된다. 기존 엔드포인트 deepseek-chat 및 deepseek-reasoner는 7월 24일 폐지된다.
이번 출시로 7일이라는 놀라운 기간 동안 세 개의 중국발 프론티어 오픈소스 모델이 등장했다: Kimi K3(2.8T, Frontend Code Arena #1, 7월 16일), Qwen3.8(2.4T, 출시 확정, 7월 19일), 그리고 이번 DeepSeek V4(1.6T, Codeforces 오픈 모델 중 #1, 7월 20일). 모두 독자 개발되어 세계 최고 수준의 성능을 달성했으며, 같은 주에 공개되었다.
2. Codeforces Rating 3,206: 코딩 능력으로 GPT-5.4 추월
DeepSeek V4-Pro의 가장 큰 하이라이트는 Codeforces 경쟁 프로그래밍 레이팅 3,206이라는 점수다. GPT-5.4를 능가하며, 알고리즘 추론 벤치마크에서 가장 강력한 오픈소스 모델이 되었다.
| 벤치마크 | DeepSeek V4-Pro |
|---|---|
| Codeforces Rating | 3,206 (GPT-5.4 능가) |
| V4-Flash vs V3.2 | Flash가 이전 플래그십을 대부분 벤치마크에서 능가 |
| 경쟁 프로그래밍 | 가장 강력한 오픈소스 모델 |
Codeforces는 실세계 코딩에 특히 의미 있는 벤치마크다. 시간 제약 하에서의 알고리즘 문제 해결 능력을 측정하며, 소프트웨어 엔지니어링, 데이터 분석, 자동화 워크플로 구축에 직접 적용 가능한 추론력을 나타낸다. AI 기반 마케팅 도구를 구축하는 브랜드에게 이 능력은 템플릿 패턴 매칭이 아닌 복잡한 자동화 파이프라인을 진정으로 추론할 수 있는 모델을 의미한다.
V4-Flash는 284B 파라미터(13B 활성)의 소형 변형임에도 불구하고, 이전 플래그십 V3.2를 대부분의 평가 작업에서 능가한다. 이는 DeepSeek의 훈련 방법론 개선이 원시 파라미터 스케일링보다 더 중요함을 보여준다.
3. 0.28달러/100만 토큰 + 피크밸리 요금제: 새로운 가격 패러다임
DeepSeek V4는 AI 모델 API로는 업계 최초로 피크밸리 종량제를 도입했다:
| 메커니즘 | 상세 |
|---|---|
| 기준 가격 (Flash, 출력) | 0.28달러 / 100만 토큰 |
| 피크 시간대 배율 | 지정된 평일 윈도우에서 2배 |
| 오프피크 할인 | 야간・주말은 기준 요율 적용 |
이 가격 모델은 브랜드 마케팅 운영에 중요한 의미를 갖는다:
1. 배치 콘텐츠 생성은 오프피크 시간대로 이전. 대량 카피 생성, 상품 설명 업데이트, 다국어 번역 파이프라인을 0.28달러 기준 요율이 적용되는 오프피크 윈도우에 스케줄링함으로써 피크 시간대 대비 50% 직접 비용 절감 가능.
2. 실시간 인터랙티브 애플리케이션은 프리미엄을 지불. 영업 시간 중 응답해야 하는 고객 대응 챗봇과 라이브 마케팅 도구는 2배 배율에 직면한다. 0.56달러의 피크 요율은 여전히 경쟁력 있지만(GPT-5.6 Sol보다 약 90% 저렴), 가격 신호는 배치와 실시간 워크로드를 명시적으로 구분한다.
3. MIT 라이선스가 벤더 종속을 제거. Kimi K3의 오픈웨이트(7월 27일까지)나 Qwen3.8의 계획된 출시와 달리, DeepSeek V4는 완전한 MIT 라이선스 웨이트와 코드를 즉시 이용 가능. 브랜드는 라이선스 비용 제로, API 의존 제로, 완전한 데이터 주권으로 V4를 자체 호스팅할 수 있다 — 규제 대상 업계에 가장 강력한 컴플라이언스 태세.
4. 듀얼 모델 전략: Pro는 추론용, Flash는 스케일용
DeepSeek의 V4 라인업은 의도적인 듀얼 모델 전략을 반영한다:
| 사용 사례 | 모델 | 이유 |
|---|---|---|
| 복잡한 추론, 경쟁 코딩, 연구 | V4-Pro (49B 활성) | 추론당 최대 지능 |
| 대량 생산, 콘텐츠 생성, 에이전트 파이프라인 | V4-Flash (13B 활성) | 5배 낮은 비용으로 프론티어에 가까운 품질 |
| 야간 배치 작업, 스케줄 워크플로 | V4-Flash (오프피크) | 0.28달러 기준 요율, 피크 대비 50% 할인 |
이는 DeepSeek가 V3로 개척한 아키텍처 전략의 진화형이다. 동일한 훈련 기반을 공유하면서 다른 배포 프로필에 최적화된 추론용과 고처리량용 변형을 분리한다. V4의 중요한 차이점은 두 변형이 거의 동일한 품질 엔벨로프에 수렴한다는 점이다. Flash는 '덤' 버전이 아니라 '패스트' 버전이다.
브랜드 마케터에게 실용적 워크플로는 명확하다: 전략에는 V4-Pro(캠페인 설계, 경쟁 분석, 크리에이티브 브리프 생성), 실행에는 V4-Flash(카피 변형, A/B 테스트 생성, 다국어 번역, 랜딩 페이지 코드).
5. 중국 오픈소스 모델 위크: Kimi K3 → Qwen3.8 → DeepSeek V4
2026년 7월 14일~20일은 AI 역사상 분수령으로 기억될 것이다. 세 개의 독자 개발된 중국발 프론티어 모델이 모두 세계 최고 수준의 성능을 달성하고 같은 주에 출시되었다:
| 날짜 | 모델 | 특징 | 개방성 |
|---|---|---|---|
| 7월 16일 | Kimi K3 (2.8T) | Frontend Code Arena #1, 세계 최대 오픈소스 | 오픈웨이트 7월 27일 |
| 7월 19일 | Qwen3.8 (2.4T) | Fable 5 다음 성능, 알리바바 클라우드 생태계 | 오픈소스 확정 |
| 7월 20일 | DeepSeek V4 (1.6T) | Codeforces 3206 > GPT-5.4, 피크밸리 요금제 | MIT, 즉시 이용 가능 |
이는 타이밍의 우연이 아니다. 세 기업이 독립적으로 모델 품질의 프론티어에 도달했으며, 모두 공개를 선택했음을 반영한다. 구조적 함의는 명확하다: AI 능력이 오픈소스 자체 호스팅 모델로 배포 가능하다면, 해당 능력의 상용 API 시장은 즉각적인 가격 압축에 직면한다.
6. 브랜드에 대한 의미
TMG의 크로스보더 브랜드 마케터에게 DeepSeek V4 출시는 세 가지 전략적 함의를 명확히 한다:
1. AI 기반 마케팅의 비용 하한이 붕괴되었다. DeepSeek V4-Flash의 0.28달러/100만 토큰(MIT)과 Kimi K3의 15달러/100만 토큰(오픈웨이트) 사이에서, 브랜드는 50배 가격대에 걸친 선택지를 갖는다 — 모두 프론티어 또는 그에 가까운 품질로. "대규모 AI 도입이 불가능하다"는 경제적 논리는 더 이상 성립하지 않는다.
2. 자체 호스팅 배포가 컴플라이언스 기본값이 되었으며, 더 이상 '열망의 목표'가 아니다. MIT 라이선스 + 13B 활성 파라미터(Flash)로, 브랜드는 단일 온프레미스 서버에서 프로덕션 등급 AI 마케팅 엔진을 배포할 수 있으며, 기업 경계 밖으로 데이터가 전혀 유출되지 않는다. 이는 7월 15일 AI 의인화 금지령의 데이터 주권 요구사항에 직접 대응한다.
3. 피크밸리 요금제가 AI 마케팅에 운영 규율을 도입한다. 배치 콘텐츠 파이프라인(야간 다국어 블로그 번역, 주간 상품 설명 생성, 스케줄된 A/B 테스트 변형 작성)을 구축하는 브랜드는 단순한 스케줄링만으로 추론 비용을 50% 절감할 수 있다. AI 비용 관리는 더 이상 조달 결정이 아니라 운영 스킬이다.
핵심 요점
- DeepSeek V4, 7월 20일 출시 — Pro(1.6T MoE, 49B 활성)와 Flash(284B, 13B 활성), 둘 다 MIT 오픈소스
- V4-Pro Codeforces Rating 3,206 — GPT-5.4 능가, 알고리즘 추론에서 가장 강력한 오픈소스 모델
- V4-Flash 0.28달러/100만 출력 토큰 — 이용 가능한 가장 저렴한 프론티어급 모델 중 하나
- 업계 최초 피크밸리 요금제 — 평일 피크 시간대 2배, 야간・주말 기준 요율
- 기존 엔드포인트 7월 24일 폐지 — 완전 이전 마감일
- 중국 오픈소스 모델 위크 — Kimi K3(7/16), Qwen3.8(7/19), DeepSeek V4(7/20) — 세 개의 프론티어 모델, 7일, 모두 오픈