应用与产品

DeepSeek 正式发布 V4-Pro:从预览版走向 Agent 工作流,API 将实行峰谷定价

DeepSeek 于 8 月 13 日将 V4-Pro 从预览升级为正式版,覆盖网页、移动应用与 API,重点增强 Agent 执行、编程任务和工具调用能力,同时支持原生 Responses API 与 Codex 适配。公司还宣布自 2026-08-16 起对 V4 系列实行峰谷定价,非峰时价格为峰时的一半,可能影响批处理与实时应用的成本考量。

DeepSeek 正式发布 V4-Pro:从预览版走向 Agent 工作流,API 将实行峰谷定价

DeepSeek 于 8 月 13 日将 V4-Pro 从预览升级为正式版,覆盖网页、移动应用与 API,重点增强 Agent 执行、编程任务和工具调用能力,同时支持原生 Responses API 与 Codex 适配。公司还宣布自 2026-08-16 起对 V4 系列实行峰谷定价,非峰时价格为峰时的一半,可能影响批处理与实时应用的成本考量。

DeepSeek 于 8 月 13 日正式发布 DeepSeek-V4-Pro,结束此前的预览阶段。新版本同步登陆网页端、移动应用和 API,重点放在 Agent 执行能力、编程任务以及更灵活的推理强度控制上;同时,DeepSeek 也宣布 API 将引入峰时与非峰时定价。

根据 DeepSeek 官方发布说明,V4-Pro 正式版已经可以在网页端和应用的“Expert Mode”中使用。API 调用方式保持不变,开发者仍使用 deepseek-v4-pro 这一模型名称接入最新版本。DeepSeek 官网也确认,V4-Pro 已在网页、移动应用和 API 全面提供。

这次发布的重点不是重新定义一个模型名称,而是将此前的 V4-Pro 预览版本推进到正式可用阶段。DeepSeek 在 API 更新日志 中称,正式版“显著增强”了 Agent 能力,并特别强调了生产环境中的表现提升。不过,这些能力描述和页面列出的评测数字属于厂商公开说明,尚不足以单独推导出经过独立复测的行业排名结论。

V4-Pro 把重点放在 Agent、编程和工具调用

V4-Pro 正式版支持原生 OpenAI Responses API,并针对 Codex 接入进行了适配。DeepSeek 表示,开发者可以按照官方文档完成配置,并使用一键脚本接入 Codex。对已经围绕 OpenAI 接口构建工具调用、代码执行或多轮任务流程的团队来说,这意味着迁移时不必重新设计一套完全不同的调用抽象。

DeepSeek 的模型与定价页面 显示,V4-Pro 的当前版本标识为 DeepSeek-V4-Pro-0813,支持 1M 上下文长度、最高 384K 输出、工具调用、Responses API,以及 OpenAI 格式和 Anthropic 格式的接口。页面还列出,V4-Pro 支持思考模式,并与 V4-Flash 一样提供不同的推理强度选项。

新的推理强度分为 lowhighmax 三档。官方给出的使用逻辑是:简单任务使用低强度,日常 Agent 工作流使用高强度,复杂任务则使用最高强度。它反映出模型服务商正在把“推理多少”从模型内部行为转化为开发者可以调度的资源参数。对于长时间运行、需要多次工具调用的任务而言,速度、成本和完成质量之间的取舍,可能比单一的模型排行榜分数更直接影响实际部署。

这一路线也延续了 DeepSeek 在 V4-Flash-0731 的前一轮更新 中体现出的方向:模型升级的中心从单纯回答问题,转向代码、工具调用和持续执行任务。不过,V4-Pro 与 V4-Flash 的定位并不相同,前者是更高阶的正式版本,后者则主要承担更低成本和更高吞吐的应用场景。

API 价格将从统一价格转向峰谷定价

V4-Pro 正式发布的同时,DeepSeek 宣布调整 V4 系列 API 价格。新安排将于 2026 年 8 月 16 日 16:00 UTC 生效,即北京时间 8 月 17 日凌晨,非峰时价格为峰时价格的一半。根据官方价格页面显示的时段说明,峰时为 UTC 时间 01:00 至 04:00 和 06:00 至 10:00,其余时间为非峰时。

这意味着开发者在安排批处理、代码分析、数据整理或其他可以延迟执行的任务时,可以通过错开高峰时段来降低费用。但对需要实时响应的应用来说,峰时价格将成为新的成本基准。路透社在 相关报道 中称,V4-Pro 和 V4-Flash 的新价格按模型、输入类型和使用时段计算,较现有价格的涨幅最高达到数倍;具体价格仍应以 DeepSeek 官方价格页在生效后的最终表格为准。

以正式版上线前的现行价格作为参照,官方页面列出的 V4-Pro 每百万 token 缓存命中输入价格为 0.003625 美元,缓存未命中输入为 0.435 美元,输出为 0.87 美元。中国媒体转述的调价方案显示,V4-Pro 峰时每百万 token 输出价格将达到 27 元,非峰时为 13.5 元;V4-Flash 也将同步调整。由于价格安排在 8 月 16 日 UTC 时间才生效,开发者在比较新旧成本时需要区分当前价格、峰时价格和非峰时价格,不能把其中一种价格直接视为全天统一费率。

正式发布也回应了 DeepSeek 面临的竞争压力

DeepSeek 在 2025 年初凭借 R1 模型获得全球关注,外界开始重新讨论高性能模型的训练成本和商业模式。但在此后的几个月里,中国市场陆续出现 Moonshot AI、智谱、MiniMax、阿里巴巴和字节跳动等公司的新模型,模型能力的更新速度明显加快。

路透社在相关报道中还提到,DeepSeek 正在扩大招聘、计算资源和融资安排,并推进芯片设计人才的招聘。更大的背景是,Agent 产品要在真实环境中持续执行任务,除了模型本身,还需要更稳定的算力、工具接口、权限管理和错误恢复机制。模型正式发布,只是把这些问题推到了更接近生产环境的位置。

此前关于 V4-Flash 的公开资料已经显示,DeepSeek 试图同时覆盖云端 API 与更开放的部署路径;而 V4-Pro 此次加入 Responses API 和 Codex 适配,则更明确地把竞争焦点放在开发者工作流入口上。正如 AIFluxNews 此前在关于 Agent 科学计算的报道中所指出的,模型“会做事”之后,验证、审查和责任边界会成为新的瓶颈。对 V4-Pro 的实际评价,最终也不只取决于官方评测表,而要看它能否在真实代码库、复杂工具链和长期任务中稳定完成工作。

目前可以确认的是,DeepSeek-V4-Pro 已经完成从预览到正式发布的转换,并覆盖网页、应用和 API 三个渠道;原生 Responses API、Codex 优化和三档推理强度,构成了这次更新最清晰的产品变化。至于 Agent 能力提升能否在不同用户环境中稳定复现,以及峰谷定价会否改变开发者对 V4-Pro 和 V4-Flash 的选型,仍需要正式版本运行数据和价格生效后的实际使用情况来回答。

来源:DeepSeek V4-Pro 官方发布说明DeepSeek API 更新日志DeepSeek 模型与定价DeepSeek 官网ReutersThe Hindu 对 Reuters 报道的转载

不错过任何一条 AI 大事

订阅 AIFlux 早报,每天 3 分钟看懂产业动态。

相关阅读