DeepSeek 的 V4-Pro 模型已进入实用的 API 规划领域。 该公司当前的 API 定价文档列出了 DeepSeek-V4-Pro 和 DeepSeek-V4-Flash,通过 OpenAI 格式的基本 URL 和单独的 Anthropic 格式的基本 URL 公开。 社区帖子引用 DeepSeek 的变更日志称,V4-Pro 0813 版本已于 8 月 13 日向应用程序、网络和 API 用户推出。
该型号列表值得注意的不仅仅是可用性。 DeepSeek-V4-Pro 宣传的上下文长度为 1M 令牌,最大输出 384K 令牌,另外还提供 JSON 输出、工具调用、聊天前缀补全 beta 和非思考模式下的 FIM 补全 beta。 对于构建代理、代码工具、长文档工作流程或检索繁重的系统的开发人员来说,这些限制将 V4-Pro 归入可以重塑提示架构的模型类别,而不仅仅是取代较小的聊天模型。
然而,定价才是真正的操作故事。 DeepSeek 的页面列出了 V4-Pro 的价格为每 1M 缓存命中输入令牌 0.003625 美元,每 1M 缓存未命中输入令牌 0.435 美元,每 1M 输出令牌 0.87 美元。 这种传播意味着请求的成本在很大程度上取决于重复的上下文是否真正命中了提供者的缓存。 如果提示高度可变、分段不良或通过阻止缓存重用的工具进行路由,那么在乐观缓存假设下看起来便宜的工作负载可能会变得更加昂贵。
API 用户的变化
DeepSeek 的文档现在将 V4-Pro 呈现为具有两个兼容性表面的一流 API 模型:主 DeepSeek API 基本 URL 上的 OpenAI 样式端点和单独路径下的 Anthropic 样式端点。 这很重要,因为它降低了已经使用 OpenAI 兼容客户端的团队的集成障碍,同时还为 Claude 风格的客户端提供了更直接的格式选项。
对于 AI API 网关,当前的工作很平凡但很重要:刷新模型目录、更新上下文窗口和最大输出元数据、标记支持的功能以及决定如何表示两种 API 格式。 将 OpenAI 格式和 Anthropic 格式表面视为同一事物可能对营销页面来说很方便,但可能会在 SDK、日志和策略控制中造成混乱。 开发人员需要知道适用哪种请求模式、工具调用行为和流假设。
广告中的巨大输出限制也值得关注。 384K 令牌的最大输出不仅仅是表中的一个更大的数字。 它改变了故障模式。 团队可能需要更严格的响应限制、计费警报和应用程序级护栏,以防止生成失控或意外的长格式转储将单个代理步骤变成材料成本事件。
为什么缓存命中定价现在变得更加重要
许多开发人员长期以来一直将 DeepSeek 与激进的 API 定价联系在一起。 V4-Pro 使这种看法变得复杂。 与缓存未命中输入价格相比,列出的缓存命中输入价格非常低,但只有在工作负载设计用于缓存重用时,这种差异才有帮助。
实际上,缓存效率取决于即时稳定性。 长系统提示、策略块、文档包和存储库上下文在一致重用时会受益。 但代理系统通常会在每一步改变提示:添加日志、工具输出、时间戳、中间计划和用户特定的状态。 如果这些更改改变了缓存边界或导致大型前缀丢失,则有效成本可能会更接近缓存丢失率。
这就是为什么路由策略不应通过单个混合输入价格对 V4-Pro 进行排名。 成本模拟应将缓存命中输入、缓存未命中输入和输出令牌分开,然后测试代表性工作负载。 重用大型存储库摘要的编码代理的行为可能与将新帐户状态注入每个请求的客户支持助理的行为非常不同。
这也是模型门和类似的多模型路由层发挥实际作用的地方。 按模型、团队和 API 密钥跟踪令牌使用情况的网关可以帮助运营商了解看似便宜的路线在生产中是否实际上很便宜。 相关指标不再仅仅是每个请求的令牌;它是缓存命中输入、未缓存输入和实际流量中生成的输出的组合。
谁受到影响
直接使用 DeepSeek 的开发人员应在切换生产流量之前验证模型标识符、端点格式和功能标志。 列出了 JSON 输出和工具调用,但应用程序行为仍然需要测试,特别是如果现有代码依赖于其他提供商的边缘情况处理。
网关运营商和平台团队有更广泛的清单。他们需要更新的价格表、上下文限制、最大输出限制、每个模型的功能元数据、预算控制以及 OpenAI 兼容和 Anthropic 兼容访问的文档。 如果他们将 V4-Pro 作为嵌入式模型公开,他们仍应警告客户,等效的请求语法不能保证等效的行为或成本。
运行大容量自动化的企业应重新审视默认模型假设。 具有 1M 代币上下文窗口的模型对于法律审查、研究综合、代码库分析和长期运行的代理来说可能很有吸引力。 但长上下文模型往往会鼓励更大的提示,而更大的提示会放大缓存设计和输出控制中的每一个错误。
仍然不确定的内容
定价页面提供了当前列出的费率和功能,但报告的未来定价变化仍然存在不确定性。 社区帖子称,DeepSeek 已警告 API 价格大幅上涨,新的高峰和非高峰价格可能会在 8 月 16 日生效。 这些说法与预算规划相关,但未来的关税表并未在研究过程中从可直接获取的官方通知中得到验证。
这种不确定性应该让团队保持谨慎而不是冻结。 明智的应对措施是将 V4-Pro 添加到评估池中,测试实际工作负载,测量缓存行为,并避免将其硬编码为永久最低成本默认值,直到定价得到确认。 对于某些工作负载,V4-Pro 可能是一个出色的长上下文选项。 对于其他人来说,尤其是输出密集型代理或缓存重用较差的提示,其经济效益可能不如标题缓存命中率所暗示的有利。
更广泛的教训是,模型可用性现在只是第一个路由问题。 更难的问题是关于格式兼容性、功能可靠性、缓存机制、输出上限和成本可观察性。 DeepSeek V4-Pro 为开发人员提供了另一个强大的 API 选项,但它也明确表明“便宜”已成为特定于工作负载的结论,而不是提供商的标签。