DeepSeek 将于 7 月中旬发布 V4,支持 100 万 Token 上下文窗口及峰谷 API 定价

DeepSeek 将于 7 月中旬发布 V4,支持 100 万 Token 上下文窗口及峰谷 API 定价

2 分钟阅读•2026年7月7日•
Priya Nair
Priya Nair

DeepSeek 将于 7 月中旬正式发布其最新前沿模型 V4,全系列标配 100 万 Token 上下文窗口。此次更新还引入了业界首创的峰谷 API 定价机制,可能重塑开发者对 AI 推理成本的预算方式。

DeepSeek V4 带来了什么

DeepSeek 团队周一宣布,V4 将作为当前预览版的继任者推出,带来大量功能增强和性能升级。最引人注目的是,整个模型系列现在支持 100 万 Token 上下文窗口——这意味着它单次可以处理大约三本完整小说。

除了上下文扩展外,DeepSeek V4 在基于代理的任务执行、数学推理和代码生成方面表现更强。据 TechNode 报道,该模型在“基于代理的任务执行、数学推理和代码生成”方面相比预览版有更出色表现。

这些改进使 V4 成为 OpenAI 的 GPT-4o、Anthropic 的 Claude 3.5 和 Google 的 Gemini 1.5 Pro 等模型的直接竞争对手——这些模型一直在长上下文理解和复杂推理任务上争夺主导地位。

DeepSeek logo

全新的 API 访问定价模式

DeepSeek 在 V4 上最具战略意义的转变或许是新的 API 定价结构。该公司将首次根据时段引入动态定价——这种模式在云计算中很常见,但在 AI API 市场中却很少见。

高峰时段定义为每天 上午 9:00 至中午 12:00 和 下午 2:00 至下午 6:00,在此期间 API 使用费用为 非高峰时段的两倍。非高峰时段包括所有其他时间,这很可能激励开发者在非高峰窗口批量处理繁重的工作负载。

这一举措模仿了 AWS 和 Azure 等云提供商平滑需求的策略,但对于 AI 模型 API 来说并不常见。大多数提供商(包括 OpenAI 和 Anthropic)使用固定每 Token 定价,可能附带批量折扣。DeepSeek 的做法可能促使其他公司效仿,因为 AI 推理成本仍然是初创企业和企业的主要担忧。

这对 AI 行业意味着什么

DeepSeek V4 的发布在多个方面具有重大意义。首先,100 万 Token 上下文窗口 与顶级西方模型的能力相当或超越。Gemini 1.5 Pro 也提供 100 万 Token,而 GPT-4o 最高为 128K,Claude 3.5 为 200K。DeepSeek 现在为开发者和企业提供了一个可以处理超长文档——法律合同、代码库、研究论文——而无需分块的替代方案。

其次,峰谷定价表明中国 AI 实验室在商业上变得更加成熟。由对冲基金 High-Flyer 支持的 DeepSeek 已经证明,它能够以远低于美国对手的成本训练出具有竞争力的模型。随着 V4 的推出,它现在也在商业模式方面进行创新。

据 TechNode 报道,定价变化将于 7 月中旬与正式发布同步生效。开发者应预期非高峰期的费率会便宜得多,尽管具体金额尚未公布。

Comparison chart placeholder

竞争格局

DeepSeek V4 进入的市场中,多款前沿模型正在争夺开发者的关注。OpenAI 最近更新了 GPT-4o,增强了视觉能力;Anthropic 推出了 Claude 3.5,支持 200K 上下文窗口;Google 继续推动 Gemini 1.5 Pro,拥有自己的 100 万上下文。

DeepSeek 的差异化优势在于价格和开放研究贡献。该公司已发布其混合专家架构和训练方法的详细技术报告,在 AI 研究界赢得了信誉。V4 改进的基于代理的执行可能也吸引那些构建自主工作流的开发者——随着行业超越简单的聊天完成,这是一个热门领域。

峰谷定价为 DeepSeek 提供了另一个杠杆:日程灵活的开发者可以大幅降低成本,可能进一步削弱西方竞争对手。对于在夜间或周末处理大量文本的公司来说,V4 可能成为最具成本效益的选择。

这对行业的影响

对于开发者和初创企业: 100 万 Token 上下文窗口解锁了新的用例——分析整个代码库、处理长法律文件或总结多小时的会议记录。定价模式还允许初创企业通过将非紧急工作负载转移到非高峰时段来更可预测地管理成本。

对于企业: DeepSeek V4 为需要长上下文 AI 但担心供应商锁定的组织提供了一个有吸引力的替代方案。该中国实验室在宽松许可证(如 Apache 2.0)下发布模型的记录可能吸引那些希望自托管或微调的公司。

对于竞争对手: OpenAI 和 Anthropic 可能面临引入动态定价或进一步扩展上下文窗口的压力。如果 DeepSeek 的非高峰费率被证明显著更便宜,当前的固定费率 API 定价模式可能成为竞争劣势。西方实验室也可能加速自己的上下文窗口扩展,以避免失去高价值用例。

对于投资者: DeepSeek V4 的发布强化了这样一种说法:中国 AI 实验室不仅在追赶,而且在商业模式上进行创新。这可能影响融资动态——美国风投可能推动其投资组合公司采用类似的定价策略,而云提供商可能将 AI 推理与计算时间更积极地捆绑。

常见问题解答

什么是 DeepSeek V4? DeepSeek V4 是 DeepSeek(一家以高效训练方法闻名的中国 AI 实验室)的下一代前沿语言模型。正式发布定于 7 月中旬。

DeepSeek V4 的上下文窗口是多少? V4 系列中的所有模型变体标配 100 万 Token 上下文窗口,这是商业 API 中可用的最大窗口之一。

新的 API 定价如何运作? DeepSeek 将引入峰谷定价。高峰时段为每天上午 9:00–中午 12:00 和下午 2:00–下午 6:00,收费为 非高峰费率的两倍。确切价格尚未公布。

新定价何时生效? 定价结构将于 7 月中旬与 V4 正式发布同步生效。

DeepSeek V4 与 OpenAI 的 GPT-4o 相比如何? V4 具有更大的上下文窗口(100 万 Token vs. 128K Token),并在基于代理的任务、数学和编码方面性能有所提升。直接的基准比较尚未公布,但 DeepSeek 之前的模型在排行榜上一直具有竞争力。

V4 发布后,DeepSeek 会继续支持 V3 吗? 该公司尚未宣布任何弃用计划。V3 很可能在一段时间内仍然可用,但新功能和优化将集中在 V4 上。

总结

DeepSeek V4 标志着这家中国 AI 实验室向前迈出了显著的一步,提供了巨大的上下文窗口和一种可能影响整个 API 行业的新颖定价模式。通过将技术改进与更明智的定价策略相结合,DeepSeek 正将自己定位为全球前沿模型竞赛中的严肃竞争者——并迫使竞争对手重新思考自己的成本和访问方法。

AI视频引发亚利桑那州上诉法院撤销过失杀人刑期

亚利桑那州一家上诉法院撤销了加布里埃尔·霍卡西塔斯的10.5年刑期,同时维持其过失杀人罪定罪。这一消息最早由《纽约时报》报道。案件将发回马里科帕县高等法院重新量刑,届时不得使用该视频。法官认为,视频把事先撰写的陈述呈现得仿佛受害者本人正在法庭上发言。

由三名法官组成的合议庭表示,视频生成了克里斯托弗·佩尔基的声音和外貌,但并未反映真实发生过的事件。合议庭认定,允许使用并依赖该视频,使量刑程序从根本上失去了公正性;同时指出,亚利桑那州此前没有案件涉及量刑时此类影像是否可采。

法官表示,受害者的发言权不能凌驾于被告基于准确、可靠信息接受量刑的权利之上。他们指出,该视频混淆了两个不同的概念:家人认为佩尔基会说什么,以及佩尔基本人的声音和观点。

裁决区分了家人讲述佩尔基的情况与生成的影像替他发声这两种做法。

佩尔基的姐姐斯泰西·威尔斯在霍卡西塔斯接受量刑时播放了这段视频,同时还宣读了家人和朋友撰写的受害者影响陈述。威尔斯写下了视频脚本,并表示她的丈夫和夫妻俩多年的生意伙伴参与了视频制作;他们从一段YouTube视频中提取佩尔基的声音,并根据一张殡仪服务海报还原他的面部和躯干。

托德·F·朗法官称赞这段视频真挚动人,随后判处最高刑期10.5年,超过检方要求的9年。

威尔斯表示,没有人想让法庭相信佩尔基还活着,也没有人想让法庭以为他在去世前录制了这段视频。她说自己不同意这项裁决,并指出,家人会用幻灯片、拼贴画、假想对话和诗歌来表达悲痛。

威尔斯将这段AI视频比作摄影,并表示,摄影术在法院中得到广泛认可之前,经历了约1860年代开始的15年间一系列具有里程碑意义的案件。

案件将发回马里科帕县高等法院举行新的量刑听证会,届时不得使用这段AI生成视频。