模型发布

DeepSeek V4 Pro API切至0813,变更日志缺席

版本映射与价格已可见,能力变化仍缺官方日志和独立复测。

2026年8月13日 · 周四深度报告中置信重要度 3/5

本文要点

  • 官方稳定调用名deepseek-v4-pro的后端版本从未标日期变为明确标注0813。
  • OpenRouter新增可显式选择的deepseek/deepseek-v4-pro-0813模型ID。
  • 可用性证据已进入生产API层,能力证据仍停留在旧模型卡与第三方初测。

阅读辅助

先看数字、证据和来源,再读正文。

1M token官方上下文长度
384K token官方最大输出
5 条 Claim Audit

DeepSeek官方API别名deepseek-v4-pro当前已指向DeepSeek-V4-Pro-0813。

5 个时间点

2026-04-24 · DeepSeek开放V4 Pro与V4 Flash API;模型名为deepseek-v4-pro和deepseek-v4-flash。

11 个来源8 个非 X 来源

DeepSeek V4 Pro 的这次变化已经足以影响生产调用,却还不足以支撑“能力大幅跃升”的结论。官方快速入门页明确写出:稳定模型名 deepseek-v4-pro 当前映射到 DeepSeek-V4-Pro-0813,调用方式保持不变。对已有用户而言,这是一种后端版本切换,而不是需要迁移到新路径的全新API首发。

规格与价格也能从官方页面直接核实:上下文长度为 1M token,最大输出为 384K token;每百万输入token在缓存命中、缓存未命中时分别为 $0.003625$0.435,每百万输出token为 $0.87,并发上限列为 500。官方还标记JSON输出、工具调用、Responses API和Anthropic格式均可用。

信息缺口同样清楚。DeepSeek更新日志的最新条目仍是 2026年7月31日 的V4 Flash更新,没有0813专属说明;官方Hugging Face模型卡仍把V4系列描述为4月发布的Preview版本。眼下无法从官方材料判断0813改了训练数据、后训练、推理强度、工具调用可靠性,还是主要调整了服务端部署。

最需要行动的是已有API调用方:稳定别名没有变化意味着接入成本很低,也意味着版本漂移可能在不改代码的情况下进入线上。回归测试、输出留档、结构化响应校验和合规基线,应该先于任何社区排行榜带来的乐观判断。

三个名字,三种版本语义

这次最容易写错的是把产品别名、具体构建和集成方路由混成一个“官方模型ID”。它们都能发起请求,但锁定能力不同。

层级可确认的ID或版本谁定义版本含义当前边界
DeepSeek官方APIdeepseek-v4-proDeepSeek稳定别名,当前后端映射到0813官方未给出独立0813快照ID
DeepSeek后端版本DeepSeek-V4-Pro-0813DeepSeek文档价格页与快速入门页展示的当前构建不是文档示例中的请求参数
OpenRouterdeepseek/deepseek-v4-pro-0813OpenRouter集成方可显式选择的0813路由“GA release”是OpenRouter措辞
OpenCode Godeepseek-v4-proOpenCodeOpenCode端点的稳定模型ID文档没有显式写出其后端构建号
Hugging Facedeepseek-ai/DeepSeek-V4-ProDeepSeek官方仓库4月Preview权重与模型卡页面未把权重标记为0813

因此,“DeepSeek官方发布了名为 deepseek-v4-pro-0813 的新调用参数”是不准确的。官方调用参数仍是 deepseek-v4-pro;显式带0813的请求ID来自OpenRouter。类似地,OpenRouter称它是GA版本,可以说明集成方如何定位该页面,却不能代替DeepSeek尚未出现的GA公告或变更日志。

官方集成文档还补充了可用性边界。DeepSeek原生支持OpenAI兼容接口与Anthropic兼容接口;Codex集成指南则明确使用Responses API,并在模型目录中把上下文窗口写为 1,048,576 token。这证明0813所在的Pro服务可以进入主流编码Agent链路,但不证明所有第三方客户端都能把 1M 窗口完整利用。客户端自动压缩阈值、工具消息膨胀、服务端限额和最大输出都会先吃掉上下文预算。

价格低,但“便宜多少”要先统一口径

官方现价可以原样写,社区算出的倍数则必须降级。按单纯输出标价比较,X用户@hosseeb把DeepSeek的 $0.87/百万token 与另一高端模型的 $25/百万token 并列,得到“接近 30倍”的差距。算术没有问题,问题在于它只比较输出单价,没有控制完成同一任务所需的输入、推理与输出token,也没有控制缓存命中率、失败重试和平台折扣。

计费项DeepSeek官方V4 Pro现价OpenRouter页面可以得出的结论
缓存命中输入$0.003625/百万token$0.003625/百万token两处相互印证当前标价
缓存未命中输入$0.435/百万token$0.435/百万token适合估算新上下文写入成本
输出$0.87/百万token$0.87/百万token只能比较token单价,不能替代每任务总成本
上下文1M token1M token说明模型上限,不承诺每次请求都能占满
最大输出384K token页面主卡未单列需以DeepSeek官方规格为准

另一个容易忽略的变量是缓存。OpenRouter页面在早期流量上展示约 93.1% 的缓存命中率和显著低于标价的加权平均输入成本,这能解释部分用户为何感到极便宜,却不能外推到新项目。重复前缀很高的编码Agent可能命中大量缓存,频繁切换仓库、动态检索或每轮重写系统上下文的任务则未必如此。

DeepSeek还在价格页预告,近期计划对API服务整体价格作“显著”上调,具体方案另行通知。因此,当前单价适合做短期预算,不宜直接写进长期采购合同。更稳妥的成本评估是保存真实请求的缓存命中、输入、思考、输出和重试数据,再按当前价与一个涨价情景分别建模。

benchmark变了什么:目前没有同口径答案

4月Preview模型卡给出过完整的DeepSeek自报成绩,例如Pro Max在Terminal Bench 2.0为 67.9,SWE-bench Verified为 80.6,GPQA Diamond为 90.1,HLE为 37.7。这些数字描述的是4月模型卡中的评测对象、推理模式与官方harness,不是0813的新成绩。

OpenRouter的0813页面已经显示一组来自Artificial Analysis的早期指标:综合智能指数 45.3、编码指数 59.4、Agentic指数 37.8;细项包括GPQA Diamond 88.8%、HLE 37.5%、Terminal-Bench Hard 46.2%。它们是有价值的第三方观测,但评测名称、版本、推理预算与4月表格并不完全一致,不能把 46.267.9 直接相减后声称退步,也不能把其他图表中的相对增幅写成官方提升。

证据对象与口径数字示例能否证明0813相对Preview变化
4月官方模型卡Preview、DeepSeek自报、指定harnessTerminal Bench 2.0 67.9只能提供旧基线
OpenRouter 0813页Artificial Analysis第三方指标Terminal-Bench Hard 46.2%不能直接比较,版本与协议不同
Cline社区转帖平台营销性转述“提升 15.8%不能;未给出可核验同口径证据链
CommandCode公开仓库单提示、单次生成、人工与脚本混合检查0813样例成本约 $0.00055只能说明该样例,不代表通用编码能力

CommandCode的公开仓库比只发截图更有价值,因为能检查生成文件、提示和作者列出的限制;但作者也明确写了每个模型 n=1、没有重跑和方差估计,部分检查由Node虚拟机烟测代替真实浏览器。其X帖给0813打 8/10,并与Kimi、GLM比较单次成本,这适合作为“值得复测”的线索,不适合作为模型质量排序。

发现阶段出现的微信公众号文章同样没有进入核心证据链。它可以帮助发现话题,但不能被写成DeepSeek官方发布,更不能替代价格页、快速入门页或正式模型卡。当前最可靠的编辑结论不是“0813全面超过某闭源模型”,而是“生产API版本已经变化,官方能力解释暂时落后于部署”。

安全信号:8/9不是一份安全报告

X用户@SingulCore称,其自动越狱系统在 9类请求中突破了 8类,若干网络与犯罪相关类别给出高服从分,化学与生物生产类在 5次重试中为 0/5。这组数字必须保留归因:它来自红队工具作者的单方帖子,采集材料没有完整提示集、系统提示、采样参数、裁判模型、成功判据、重复实验和误报分析。

缺少这些信息时,8/9既不能证明模型“整体失守”,0/5也不能证明化学生物防护稳健。自动裁判可能把防御性解释误判为服从,也可能漏掉隐晦的有害内容;不同API入口、推理强度和系统提示还会改变结果。它的合理用途是触发复现:由独立团队公开测试集,区分直接回答、部分泄露、拒答绕过与真正可操作输出,并与4月Preview和V4 Flash采用相同协议对照。

早报观点

0813首先暴露了“稳定别名、滚动后端”带来的治理问题。对个人开发者,这种设计让升级几乎零摩擦;对企业,它意味着模型行为可能在不改请求参数的情况下发生变化。便宜的token降低了试错成本,却没有降低版本留痕、回归评测和安全复核的必要性。

DeepSeek眼下把产品交付速度放在了说明材料之前。官方文档足以确认服务可用,也足以确认价格和容量,却没有回答0813为什么比4月Preview更适合生产。这种证据落差会把解释权暂时交给OpenRouter、平台营销和社交媒体测试者,随后产生“GA”“近30倍”“提升15.8%”“8/9失守”等彼此不可比的强叙事。

早报判断是:0813应当按“已上线、待解释、需回归”处理。开发者可以立即试用,采购可以测算当前成本,安全团队也应开始红队;但任何能力跃升、价格碾压或安全崩溃的结论,都要等同口径复现。若DeepSeek随后补发变更日志、可固定的快照ID和安全报告,这次静默切换才算完成了从可调用到可治理的最后一步。

给API用户的回归清单

现有调用方可以先记录响应中的可观测版本信息,并保存 2026年8月13日 前后的同一组测试请求。重点不是跑一个总分,而是覆盖结构化JSON、工具参数、长对话状态、拒答边界、中文写作和真实仓库修改。若业务依赖Responses API或Anthropic兼容层,两条入口都要分别验证。

  • 固定提示、温度、推理强度和工具schema,比较切换前后的成功率与token消耗。
  • 单独测 256K512K 与接近 1M 的长上下文,记录召回、首token延迟和中途截断。
  • 384K 最大输出不要做常态预算;超长输出会迅速放大费用、延迟与校验失败风险。
  • 将缓存命中率与每任务总成本一起看,避免用 $0.003625 的理想输入价估算全部流量。
  • 对社区红队案例做可重复复现,并把失败拒答与真实危害完成度分开统计。

接下来最关键的外部信号有三类:DeepSeek是否补上0813专属说明与安全材料;官方或独立机构是否发布同一协议下的Preview对照;价格预告何时落地。三者分别决定这次更新能否被解释、能否被比较、能否被长期采购。