딥시크(DeepSeek)가 7월 중순에 최신 프런티어 모델 V4를 공식 출시한다. 모든 모델 변형에 100만 토큰 컨텍스트 윈도우를 기본 탑재했으며, 업계 최초로 피크/오프피크 API 요금제를 도입해 개발자들의 AI 추론 비용 관리 방식을 바꿀 전망이다.
딥시크 V4가 제공하는 것
딥시크 팀은 월요일 V4가 현재 프리뷰 릴리스의 후속작으로 출시된다고 발표하며, 다양한 기능 개선과 성능 업그레이드를 예고했다. 가장 주목할 점은 전체 모델 라인업이 100만 토큰 컨텍스트 윈도우를 지원한다는 것이다. 이는 세 권 분량의 장편 소설을 한 번에 처리할 수 있는 수준이다.
컨텍스트 확장 외에도 V4는 에이전트 기반 작업 수행, 수학적 추론, 코드 생성에서 더 강력한 성능을 보여준다. TechNode에 따르면, 이 모델은 프리뷰 버전보다 "에이전트 기반 작업 수행, 수학적 추론, 코드 생성 분야에서 더 뛰어난 성능"을 발휘한다.
이러한 개선으로 V4는 OpenAI의 GPT-4o, Anthropic의 Claude 3.5, Google의 Gemini 1.5 Pro 등 장문 이해와 복잡한 추론 작업에서 경쟁하는 모델들과 직접 경쟁하게 됐다.

새로운 API 요금 모델
딥시크가 V4와 함께 도입하는 가장 전략적인 변화는 새로운 API 요금 구조다. 업계 최초로 시간대별 동적 가격 책정을 도입하는데, 이는 클라우드 컴퓨팅에서는 흔하지만 AI API 시장에서는 드문 방식이다.
피크 시간대는 오전 9시~12시, 오후 2시~6시로, 이 시간대 API 사용량은 오프피크 요금의 두 배로 청구된다. 나머지 시간은 오프피크 시간대로, 개발자들이 대규모 작업을 비피크 시간대로 배치하도록 유도할 것으로 보인다.
이러한 움직임은 AWS나 Azure 등 클라우드 제공업체가 수요를 분산하기 위해 사용하는 전략을 반영한 것이지만, AI 모델 API로는 이례적이다. 대부분의 제공업체(OpenAI, Anthropic 포함)는 볼륨 할인 가능성이 있는 균일 토큰당 가격을 사용한다. AI 추론 비용이 여전히 스타트업과 기업의 주요 관심사인 상황에서 딥시크의 접근 방식은 다른 업체들도 이 모델을 따르도록 압박할 수 있다.
AI 산업에 미치는 영향
딥시크 V4의 출시는 여러 측면에서 중요하다. 첫째, 100만 토큰 컨텍스트 윈도우는 최고 수준의 서양 모델들과 맞먹거나 능가한다. Gemini 1.5 Pro도 100만 토큰을 제공하지만, GPT-4o는 최대 128K, Claude 3.5는 200K에 그친다. 이제 딥시크는 개발자와 기업에게 법률 계약서, 코드베이스, 연구 논문 등 극도로 긴 문서를 분할 없이 처리할 수 있는 대안을 제공한다.
둘째, 피크/오프피크 요금제는 중국 AI 연구소가 상업적으로 더 정교해지고 있음을 보여준다. 헤지펀드 High-Flyer의 지원을 받는 딥시크는 이미 미국 경쟁사 대비 훨씬 적은 비용으로 경쟁력 있는 모델을 훈련시킬 수 있음을 입증했다. V4를 통해 이제 비즈니스 모델 측면에서도 혁신을 이끌고 있는 것이다.
TechNode에 따르면, 요금 변경은 7월 중순 공식 출시와 함께 시행된다. 오프피크 요금이 상당히 저렴할 것으로 예상되지만, 정확한 금액은 아직 공개되지 않았다.

경쟁 구도
딥시크 V4는 여러 프런티어 모델이 개발자의 관심을 놓고 경쟁하는 시장에 진입한다. OpenAI는 최근 GPT-4o를 시각 능력 개선으로 업데이트했고, Anthropic은 200K 컨텍스트의 Claude 3.5를 출시했으며, Google은 자체 100만 컨텍스트의 Gemini 1.5 Pro를 계속 밀고 있다.
딥시크의 차별점은 가격과 개방형 연구 기여다. 이 회사는 Mixture-of-Experts 아키텍처와 훈련 방법에 대한 상세한 기술 보고서를 발표하며 AI 연구 커뮤니티에서 신뢰를 얻었다. V4의 개선된 에이전트 기반 실행은 단순 채팅 완료를 넘어 자율 워크플로를 구축하는 개발자들에게도 매력적일 수 있다.
피크/오프피크 요금제는 딥시크에 또 다른 이점을 제공한다. 유연한 일정을 가진 개발자는 비용을 대폭 줄일 수 있어 서양 경쟁사보다 더 저렴하게 이용할 수 있다. 야간이나 주말에 대량의 텍스트를 처리하는 기업에게 V4는 가장 비용 효율적인 옵션이 될 수 있다.
업계에 주는 시사점
개발자와 스타트업: 100만 토큰 컨텍스트 윈도우는 전체 코드 저장소 분석, 장문 법률 문서 처리, 여러 시간 분량의 회의록 요약 등 새로운 사용 사례를 열어준다. 요금 모델을 통해 스타트업은 긴급하지 않은 작업을 오프피크 시간대로 이동시켜 비용을 더 예측 가능하게 관리할 수 있다.
기업: 딥시크 V4는 장문 컨텍스트 AI가 필요하지만 벤더 종속이 우려되는 조직에 매력적인 대안을 제공한다. 이 중국 연구소는 Apache 2.0 같은 허용적 라이선스로 모델을 공개해온 이력이 있어, 자체 호스팅이나 미세 조정을 원하는 기업에 어필할 수 있다.
경쟁사: OpenAI와 Anthropic은 동적 가격 책정을 도입하거나 컨텍스트 윈도우를 더 확장해야 하는 압박을 받을 수 있다. 현재의 균일 요금 API 모델은 딥시크의 오프피크 요금이 훨씬 저렴할 경우 경쟁력에 타격을 입을 수 있다. 서양 연구소들은 고부가가치 사용 사례를 빼앗기지 않기 위해 자체 컨텍스트 윈도우 확장을 가속화할 수도 있다.
투자자: 딥시크 V4 출시는 중국 AI 연구소가 단순히 따라잡는 데 그치지 않고 비즈니스 모델에서도 혁신하고 있다는 내러티브를 강화한다. 이는 투자 역학에 영향을 미쳐, 미국 VC들은 포트폴리오 기업에 유사한 가격 전략을 채택하도록 압박하고, 클라우드 제공업체는 AI 추론과 컴퓨팅 시간을 더 적극적으로 번들링할 수 있다.
자주 묻는 질문
딥시크 V4란? 딥시크 V4는 비용 효율적인 훈련 방법으로 알려진 중국 AI 연구소 딥시크의 차세대 프런티어 언어 모델이다. 공식 출시는 7월 중순 예정이다.
딥시크 V4의 컨텍스트 윈도우는 얼마인가? V4 라인업의 모든 모델 변형은 기본 100만 토큰 컨텍스트 윈도우를 탑재하며, 이는 상용 API에서 가장 큰 수준 중 하나다.
새로운 API 요금은 어떻게 작동하나? 딥시크는 피크 및 오프피크 요금을 도입한다. 피크 시간대는 매일 오전 9시~12시, 오후 2시~6시이며, 오프피크 요금의 두 배가 부과된다. 정확한 가격은 아직 공개되지 않았다.
새 요금은 언제부터 적용되나? 요금 구조는 V4 공식 출시와 함께 7월 중순부터 시행된다.
딥시크 V4와 OpenAI의 GPT-4o를 비교하면? V4는 더 큰 컨텍스트 윈도우(100만 대 128K 토큰)와 에이전트 기반 작업, 수학, 코딩에서 개선된 성능을 제공한다. 직접적인 벤치마크 비교는 아직 제공되지 않았지만, 딥시크의 이전 모델들은 리더보드에서 경쟁력을 보여줬다.
V4 출시 후 딥시크는 V3를 계속 지원하나? 회사는 폐지 계획을 발표하지 않았다. V3는 당분간 계속 사용할 수 있지만, 새로운 기능과 최적화는 V4에 집중될 것으로 보인다.
결론
딥시크 V4는 중국 AI 연구소의 주목할 만한 진전을 의미하며, 거대한 컨텍스트 윈도우와 업계 전반에 영향을 미칠 수 있는 혁신적인 요금 모델을 제시한다. 기술적 개선과 스마트한 가격 전략의 결합을 통해 딥시크는 글로벌 프런티어 모델 경쟁에서 진지한 도전자로 자리매김하고 있으며, 경쟁사들에게도 비용과 접근성에 대한 기존 방식을 재고하도록 압박하고 있다.
