AI Briefing

DeepSeek, V4-Pro 가격 75% 인하

·2026.04.28 09:00

핵심 내용

DeepSeek가 V4-Pro 가격을 75% 인하하고 API cache-hit 비용도 10분의 1로 낮췄다.

자세히 보기

DeepSeek가 새 V4-Pro 입력 토큰 가격에 75% 할인 프로모션을 붙여 2026년 5월 5일까지 제공하고, API 전반의 cache-hit 비용도 즉시 기존의 10분의 1로 낮췄다.

할인 전에도 V4-Pro는 입력 $0.145/백만 토큰, 출력 $3.48/백만 토큰으로 GPT-5.5, Gemini 3.1 Pro, Claude Opus 4.7보다 저렴하다. 프로모션이 적용되면 입력가는 약 $0.036/백만 토큰까지 떨어진다.

  • 더 작은 Flash variant는 입력 $0.14, 출력 $0.28/백만 토큰으로 GPT-5.4 Nano, Gemini 3.1 Flash, GPT-5.4 Mini, Claude Haiku 4.5를 밑돈다.
  • V4-Pro는 총 1.6조 파라미터와 활성 490억 파라미터를 가진 Mixture-of-Experts 모델이며, 현재 공개된 open-weight 모델 중 최대 규모다.
  • 100만 토큰 컨텍스트와 Hybrid Attention Architecture를 앞세워 긴 문서와 대형 코드베이스 처리를 겨냥하고, Huawei Ascend 950와 Cambricon 하드웨어에 맞춰 학습·최적화돼 Nvidia 의존도를 줄였다.
  • Claude Code, OpenClaw, OpenCode와도 네이티브로 연동돼 기존 에이전트 코딩 생태계에서의 전환 비용을 낮춘다.

DeepSeek가 2025년 1월 R1으로 촉발한 가격 경쟁은 이번 V4-Pro 인하로 다시 압박 수위를 높이고 있다. 미 백악관 과학기술정책국장 Michael Kratsios가 중국계 기업의 대규모 모델 증류를 비판한 직후 나온 이번 조치는, DeepSeek가 직접 반박 대신 가격 경쟁으로 응수했다는 뜻이다. 오픈소스 공개로 모델 접근 장벽을 없애고, 저렴한 API 가격과 100만 토큰 컨텍스트로 배포 비용을 낮추면서 OpenAI, Anthropic, Google API에서의 전환 유인을 키우고 있다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.