Deepseek 发布改进版 V4 Pro,开源代理软件并提高 API 价格
Deepseek 将其旗舰模型 V4-Pro 移出测试阶段,并开源了其代理软件 Harness v0.1(采用 MIT 许可证)。同时,API 价格上调,缓存命中成本增至当前六倍,对代理工作流影响显著。
Deepseek 将其旗舰模型 V4-Pro 移出测试阶段,并开源了其代理软件 Harness v0.1(采用 MIT 许可证)。同时,API 价格上调,缓存命中成本增至当前六倍,对代理工作流影响显著。
SynthePulse Insight · AI 深度解读
版本 1 · 1 个来源
DeepSeek 将旗舰模型 V4-Pro 移出测试阶段,发布开源 Agent 软件 Harness v0.1,并同步调整 API 定价。性能提升显著,但整体排名仍落后于 Claude Opus 5。
DeepSeek 于 2026 年 8 月 13 日宣布,其旗舰模型 V4-Pro 已从测试阶段转为正式版,端点 deepseek-v4-pro 现在提供 build V4-Pro-0813。模型名称、参数规模和 100 万 token 上下文窗口均未改变,DeepSeek 表示现有集成无需任何调整即可继续运行。在应用和网页端,该模型以“Expert Mode”提供,并新增了对 OpenAI Responses API 的原生支持,集成 Codex。推理努力程度可设置为“低”“高”“最大”三档,DeepSeek 推荐日常 Agent 使用中间档。
根据 DeepSeek 自己的对比表,V4-Pro 在 Terminal Bench 2.1 上的得分从 72.1 跃升至 87.9,DeepSWE 得分从 12.8 升至 62.7。在多个 Agent 基准测试中,该模型超过了 Claude Opus 4.8。然而,Artificial Analysis 的数据显示,V4-Pro 的 Intelligence Index 从 45 升至 53,与 GLM-5.2 持平,但仍落后于 Muse Spark(57)、Qwen 3.8 Max(58)、Kimi K3(60)和 Claude Opus 5(63)。DeepSeek 尚未发布新构建的权重,Hugging Face 上仍是 4 月的预览版。
与模型更新同步,DeepSeek 发布了 Harness v0.1,作为开发者预览版,采用 MIT 许可证。该开源 Agent 软件被定位为 OpenAI Codex 和 Claude 的替代品,基于新发布的 Cordis 插件系统构建,所有功能(从工具、沙箱到会话和 UI)都是可替换的插件。它提供连续会话日志,记录每次提示、工具调用和结果,支持恢复、分支和重放。
Harness 的极简模式仅保留 shell 和文件编辑器,DeepSeek 使用此设置进行自己的基准测试。软件通过 npx 启动,提供本地 Web 界面,但 DeepSeek 警告存在兼容性问题。项目由崔天毅领导,他于 2026 年 3 月从量化交易公司 Jane Street 加入 DeepSeek。8 月初团队征集测试者时,三天内就有 712 个项目报名。
新 API 定价于 8 月 16 日 UTC 16:00 生效。DeepSeek 在 6 月底宣布转向峰谷定价,但当时未公布具体数字和日期。非高峰时段使用费用减半。高峰时段为 UTC 1:00-4:00 和 6:00-10:00,与中国工作日对应。对于欧洲用户,几乎整个下午都处于较低费率。
非高峰时段,V4-Pro 输入价格从 $0.435 涨至 $0.66 每百万 token,输出从 $0.87 涨至 $1.98。高峰时段,这些费率翻倍至 $1.32 和 $3.96。缓存命中的涨幅最大,从 $0.003625 涨至非高峰 $0.022 和高峰 $0.044,缓存折扣从约 1/120 缩小至 1/30。对于反复读取相同文件的 Agent 来说,这是最昂贵的部分。新定价部分抵消了 5 月的降价,缓存命中成本甚至高于降价前。此次涨价发生在公司筹集新资本并准备 IPO 之际。
本文信息主要来自 THE DECODER 的报道,其中引用了 DeepSeek 官方数据(如基准分数、定价)和 Artificial Analysis 的第三方数据。DeepSeek 官方数据属于来源声明,Artificial Analysis 数据属于第三方验证,但未提供原始报告链接。所有数字和结论均基于报道,未独立核实。
DeepSeek V4-Pro 正式版在 Agent 基准上大幅提升,但整体智能水平仍落后于顶级模型;开源 Harness 和涨价显示其商业化与生态布局并行。
主报道
主报道来源