DeepSeek 将于 7 月中旬正式发布其最新前沿模型 V4,全系列标配 100 万 Token 上下文窗口。此次更新还引入了业界首创的峰谷 API 定价机制,可能重塑开发者对 AI 推理成本的预算方式。
DeepSeek V4 带来了什么
DeepSeek 团队周一宣布,V4 将作为当前预览版的继任者推出,带来大量功能增强和性能升级。最引人注目的是,整个模型系列现在支持 100 万 Token 上下文窗口——这意味着它单次可以处理大约三本完整小说。
除了上下文扩展外,DeepSeek V4 在基于代理的任务执行、数学推理和代码生成方面表现更强。据 TechNode 报道,该模型在“基于代理的任务执行、数学推理和代码生成”方面相比预览版有更出色表现。
这些改进使 V4 成为 OpenAI 的 GPT-4o、Anthropic 的 Claude 3.5 和 Google 的 Gemini 1.5 Pro 等模型的直接竞争对手——这些模型一直在长上下文理解和复杂推理任务上争夺主导地位。

全新的 API 访问定价模式
DeepSeek 在 V4 上最具战略意义的转变或许是新的 API 定价结构。该公司将首次根据时段引入动态定价——这种模式在云计算中很常见,但在 AI API 市场中却很少见。
高峰时段定义为每天 上午 9:00 至中午 12:00 和 下午 2:00 至下午 6:00,在此期间 API 使用费用为 非高峰时段的两倍。非高峰时段包括所有其他时间,这很可能激励开发者在非高峰窗口批量处理繁重的工作负载。
这一举措模仿了 AWS 和 Azure 等云提供商平滑需求的策略,但对于 AI 模型 API 来说并不常见。大多数提供商(包括 OpenAI 和 Anthropic)使用固定每 Token 定价,可能附带批量折扣。DeepSeek 的做法可能促使其他公司效仿,因为 AI 推理成本仍然是初创企业和企业的主要担忧。
这对 AI 行业意味着什么
DeepSeek V4 的发布在多个方面具有重大意义。首先,100 万 Token 上下文窗口 与顶级西方模型的能力相当或超越。Gemini 1.5 Pro 也提供 100 万 Token,而 GPT-4o 最高为 128K,Claude 3.5 为 200K。DeepSeek 现在为开发者和企业提供了一个可以处理超长文档——法律合同、代码库、研究论文——而无需分块的替代方案。
其次,峰谷定价表明中国 AI 实验室在商业上变得更加成熟。由对冲基金 High-Flyer 支持的 DeepSeek 已经证明,它能够以远低于美国对手的成本训练出具有竞争力的模型。随着 V4 的推出,它现在也在商业模式方面进行创新。
据 TechNode 报道,定价变化将于 7 月中旬与正式发布同步生效。开发者应预期非高峰期的费率会便宜得多,尽管具体金额尚未公布。

竞争格局
DeepSeek V4 进入的市场中,多款前沿模型正在争夺开发者的关注。OpenAI 最近更新了 GPT-4o,增强了视觉能力;Anthropic 推出了 Claude 3.5,支持 200K 上下文窗口;Google 继续推动 Gemini 1.5 Pro,拥有自己的 100 万上下文。
DeepSeek 的差异化优势在于价格和开放研究贡献。该公司已发布其混合专家架构和训练方法的详细技术报告,在 AI 研究界赢得了信誉。V4 改进的基于代理的执行可能也吸引那些构建自主工作流的开发者——随着行业超越简单的聊天完成,这是一个热门领域。
峰谷定价为 DeepSeek 提供了另一个杠杆:日程灵活的开发者可以大幅降低成本,可能进一步削弱西方竞争对手。对于在夜间或周末处理大量文本的公司来说,V4 可能成为最具成本效益的选择。
这对行业的影响
对于开发者和初创企业: 100 万 Token 上下文窗口解锁了新的用例——分析整个代码库、处理长法律文件或总结多小时的会议记录。定价模式还允许初创企业通过将非紧急工作负载转移到非高峰时段来更可预测地管理成本。
对于企业: DeepSeek V4 为需要长上下文 AI 但担心供应商锁定的组织提供了一个有吸引力的替代方案。该中国实验室在宽松许可证(如 Apache 2.0)下发布模型的记录可能吸引那些希望自托管或微调的公司。
对于竞争对手: OpenAI 和 Anthropic 可能面临引入动态定价或进一步扩展上下文窗口的压力。如果 DeepSeek 的非高峰费率被证明显著更便宜,当前的固定费率 API 定价模式可能成为竞争劣势。西方实验室也可能加速自己的上下文窗口扩展,以避免失去高价值用例。
对于投资者: DeepSeek V4 的发布强化了这样一种说法:中国 AI 实验室不仅在追赶,而且在商业模式上进行创新。这可能影响融资动态——美国风投可能推动其投资组合公司采用类似的定价策略,而云提供商可能将 AI 推理与计算时间更积极地捆绑。
常见问题解答
什么是 DeepSeek V4? DeepSeek V4 是 DeepSeek(一家以高效训练方法闻名的中国 AI 实验室)的下一代前沿语言模型。正式发布定于 7 月中旬。
DeepSeek V4 的上下文窗口是多少? V4 系列中的所有模型变体标配 100 万 Token 上下文窗口,这是商业 API 中可用的最大窗口之一。
新的 API 定价如何运作? DeepSeek 将引入峰谷定价。高峰时段为每天上午 9:00–中午 12:00 和下午 2:00–下午 6:00,收费为 非高峰费率的两倍。确切价格尚未公布。
新定价何时生效? 定价结构将于 7 月中旬与 V4 正式发布同步生效。
DeepSeek V4 与 OpenAI 的 GPT-4o 相比如何? V4 具有更大的上下文窗口(100 万 Token vs. 128K Token),并在基于代理的任务、数学和编码方面性能有所提升。直接的基准比较尚未公布,但 DeepSeek 之前的模型在排行榜上一直具有竞争力。
V4 发布后,DeepSeek 会继续支持 V3 吗? 该公司尚未宣布任何弃用计划。V3 很可能在一段时间内仍然可用,但新功能和优化将集中在 V4 上。
总结
DeepSeek V4 标志着这家中国 AI 实验室向前迈出了显著的一步,提供了巨大的上下文窗口和一种可能影响整个 API 行业的新颖定价模式。通过将技术改进与更明智的定价策略相结合,DeepSeek 正将自己定位为全球前沿模型竞赛中的严肃竞争者——并迫使竞争对手重新思考自己的成本和访问方法。
