8 月 13 日凌晨,DeepSeek-V4-Pro 正式版悄悄换上了 0813 的版本号。没有发布会倒计时,没有创始人上台挥手,甚至官方更新日志截至发稿时还停在 7 月 31 日的 V4 Flash;真正先说话的是 API 定价页:模型版本已经变成 DeepSeek-V4-Pro-0813,1M 上下文、最高 384K 输出、默认开启思考模式,支持工具调用、Responses API 与 Anthropic API。

然后,页面脚下注释又补了一刀:DeepSeek 计划近期整体上调 API 服务定价,预计涨幅较大,具体方案以正式通知为准。

这很 DeepSeek。一只手把正式版模型塞进开发者控制台,另一只手把涨价预告压在账单下面。网友本来正忙着把梁文锋从“小梁”“梁白开”重新请回“梁圣”的神位,看到这行字,又迅速发明了新的职级晋升路线:梁圣、梁子,再涨狠一点,会不会就成了“牢梁”?

笑话很轻,问题却很重。V4 Pro 的意义并不只是又多了一个排行榜选手。DeepSeek 过去几个月真正建立起来的,是行业的“斩杀线”:不要求每项第一,却用一个极低的价格告诉所有模型厂商,低于这条能力线、又高于这条价格线的产品,为什么还值得存在?现在,画线的人准备抬价,这条线会跟着上移,还是反过来变成一把回旋镖?

网友以梁文锋和“闭源模型”为主题制作的调侃图

图 1:网络梗图,不是 DeepSeek 官方物料。它恰好浓缩了社区对“低价、开源与闭源旗舰”的戏剧化想象。

正式版到底正式在哪里

先把情绪放下,看产品。

官方定价页确认,V4 Pro 0813 沿用 deepseek-v4-pro 这个 API 名称,开发者不需要改调用方式。当前每百万 Token 价格为:缓存命中输入 0.003625 美元、缓存未命中输入 0.435 美元、输出 0.87 美元;并发上限为 500。作为对照,同页 V4 Flash 的三个价格分别是 0.0028、0.14 和 0.28 美元,并发上限为 2500。换句话说,Pro 仍然大约是 Flash 的三倍价,同时给了更强能力与更低并发配额。

规格本身也透露了产品方向。1M 上下文和最高 384K 输出,不只是为了把一部长篇小说吞进去再吐出来,而是为了长时间运行的 Agent:读取大仓库、连续调用工具、跨文件修改、保留执行轨迹,最后提交一份相当长的结果。DeepSeek 这次不再只卖“问答模型”,它卖的是一个能够在终端、代码库和工具链里待更久的执行引擎。

用户提供的对比表显示,0813 相比 Pro Preview 的提升集中在 Agent 相关任务:Terminal Bench 2.1 从 72.1 到 87.9,DeepSWE 从 12.8 到 62.7,AutomationBench 从 12.8 到 31.8,DSBench-Hard 从 31.1 到 67.2。这里最值得注意的不是某一项超过谁,而是正式版与预览版之间的跃迁幅度。

DeepSeek V4 Pro 0813 与多个前沿模型的 Agent 评测对比

图 2:用户提供的流传版评测表。部分项目是厂商内部测试集,且不同模型的工具框架、推理预算与回退机制未必一致,适合观察方向,不宜当成无条件的总排名。

跑分表也给了我们一盆必要的冷水。V4 Pro 0813 并非“全面第一”:HLE、NL2Repo、Toolathlon、DSBench-FullStack 等项目上,表中的 Fable 5、Opus 4.8 或 Kimi-K3 各有领先;在 Terminal Bench 2.1 上它达到 87.9,接近表中最高的 88.3 和 88.0;Cybergym 83.3、AutomationBench 31.8 则进入第一梯队。

这更像一台完成度很高的全能工作机,而不是十项全能全部夺冠的神像。正式版最有价值的地方,是把此前“能力很强但经常卡在最后一公里”的预览版,推进到更像生产工具的位置。国内媒体当天的实测也大体围绕这一点:前端页面、小游戏、终端任务和长程编码的完成度明显提高,但真实可用性仍会受提示词、Harness、工具权限和任务长度影响。

因此,看这张表应有三个括号:这是厂商选择的测试集合;分数依赖测试框架与推理预算;实际工程成本还包含延迟、失败重试、上下文膨胀和人工验收。排行榜告诉我们模型可能抵达哪里,账单和故障日志才告诉我们它能否在那里稳定上班。

“斩杀线”斩的不是最强模型,而是中间商

“斩杀线”这个词听起来像游戏直播间的高伤害技能,实际更接近一条价格—性能前沿。

假设横轴是完成一个任务的综合成本,纵轴是成功率。一个模型如果比 DeepSeek 更贵、成功率还更低,它处在被支配区域;一个模型如果更强但贵得多,它仍然有高价值任务的生存空间;一个模型更弱但极便宜,也可以靠批量分类、摘要和简单生成活下去。真正危险的是中间地带:能力没有形成差异,价格也没有形成优势,品牌之外没有第二个购买理由。

AI 模型斩杀线的价格与性能示意

图 3:斩杀线是动态的价格—性能边界,不是某个固定跑分。点位为公开报道口径下的示意位置。

DeepSeek V4 Flash 先把这条边界压得很低,V4 Pro 0813 则把能力上沿向前推。于是竞争对手遭遇的并非简单降价,而是产品分层被挤压:轻量模型要回答为什么不比 Flash 更便宜,旗舰模型要回答为什么贵十倍甚至几十倍仍然值得,腰部模型最难受,因为它既卖不起“绝对最强”,也卖不了“近乎免费”。

海外社区对“kill line”的讨论和中文互联网有一点有趣差异。中文讨论更人格化:梁文锋今天是梁圣,明天是梁子,发布节奏和价格都能直接改变尊号。Reddit、Hacker News 的讨论则更快落到账本:当前 0.435/0.87 美元的 Pro 价格能维持多久;第三方路由商是否提供同一版本;缓存命中率会怎样改变有效成本;0813 权重是否同步公开;官方 Harness 对成绩贡献多大。

两种讨论其实在说同一件事:大家已经不满足于看模型“会不会”,而是在计算它是否值得成为基础设施。神坛上的模型只需要令人惊叹,生产中的模型要同时接受采购、法务、延迟、数据边界与退出成本的审判。

更严格地说,企业真正关心的不是 Token 单价,而是“每个成功任务的成本”:

成功任务成本 = 单次调用费用 × 平均尝试次数
             + 工具与沙箱费用
             + 人工复核费用
             + 失败造成的返工与风险成本

如果 V4 Pro 比便宜模型少重试两次,0.87 美元的输出价可能反而更省;如果它在长任务后半程频繁偏航,再低的 Token 单价也只是便宜地制造返工。所谓斩杀线,不应只画在 API 价目表上,而应画在完整任务的单位经济性上。

涨价不是背叛,含糊的涨价才是风险

截至 8 月 13 日,正式版尚未涨价。官方只确认“近期”“整体上调”“预计涨幅较大”,没有公布新价格、生效日和是否区分模型。任何“确定涨三倍”“月底执行”的说法,目前都比官方公告跑得更快。

为什么要提前预告?最直接的解释是,价格正在从获客工具回到商业变量。

低价发布有三种价值。第一,迅速换取真实调用量,让模型在海量任务上暴露问题;第二,推动开发者把接口写进产品,形成生态位置;第三,迫使竞争对手按 DeepSeek 的成本口径回答问题。但低价也有代价:推理资源会被迅速吃满,长上下文与高推理强度进一步放大成本,并发配额已经显示 Pro 比 Flash 更稀缺。一个能够长时间操作工具的 Agent,消耗的不是一次回答,而是一串持续占用计算资源的决策。

所以,涨价本身并不等于“屠龙者变恶龙”。一家模型公司若永远只能靠补贴维持斩杀线,那条线首先斩到的是自己的现金流。真正需要观察的是涨价之后,用户获得了什么:更稳定的吞吐、更少的排队、更清晰的版本生命周期、更可靠的 SLA,还是只把社区热度兑换成毛利。

可以用当前价格做三个情景推演,但它们只是分析,不是预测:

情景 Pro 输出价 对“斩杀线”的影响
温和上调 50% 1.305 美元/M Token 性价比优势大概率仍在,主要修复供需失衡
上调 3 倍 2.61 美元/M Token 仍可能显著低于海外旗舰,但与国产模型、路由平台的比较会重做
上调 10 倍 8.70 美元/M Token 价格从武器变成普通变量,斩杀线叙事明显削弱

这张表解释了为什么“牢梁”这个梗要等新价落地才判刑。如果涨两三倍,V4 Pro 仍可能处于极强的性价比区间,梁圣顶多从“赛博菩萨”转岗为“正常做生意的梁总”;如果涨到与海外旗舰同一数量级,却没有相应的稳定性、服务和生态承诺,那么网友不是把梁圣叫成梁子,而是会发现原来的斩杀线其实是一张限时优惠券。

还有一个容易被忽略的变量:缓存。官方价里,Pro 缓存命中输入只要 0.003625 美元,而未命中是 0.435 美元,相差 120 倍。对代码 Agent 来说,仓库上下文、系统提示和工具说明能否复用,会极大改变真实账单。未来涨价若主要抬高未命中或输出价格,擅长上下文缓存的平台仍能守住成本;如果缓存价格与规则一起变化,整个 Agent 工程的上下文策略都要重算。

大公司的反应,先发生在采购表和接入层

今天还没有看到 OpenAI、Anthropic、Google 等海外头部公司专门针对 0813 发布正式回应。把沉默解释成“连夜开会”很有短视频气质,却没有证据。更可靠的观察方式,是看它改变了哪些已有决策。

国内云厂商此前已快速接入 V4 Pro 与 Flash,阿里云、腾讯云一类平台的价值,是把模型调用、企业账户、数据治理和算力交付包在一起。0813 版本继续增强 Agent 能力,会让云平台面对两个相反压力:一边要尽快上线,避免开发者流向 DeepSeek 直连或第三方路由;另一边要经营自己的模型,不能把所有高价值调用都变成转售业务。

模型厂商的应对也不会只有降价。智谱、月之暗面、阿里、字节等玩家可以在本地部署、中文场景、长上下文、工具生态、企业合规或多模态上做差异。斩杀线最厉害的地方,是逼大家停止用“参数更多、榜单更高”作为统一答案,回到具体任务:谁能把代码合进去,谁能在企业数据边界内运行,谁能稳定处理一万个并发工作流。

算力端则更复杂。DeepSeek V4 此前与国产算力适配的叙事,已经让华为昇腾和中国 AI 基础设施链条受到关注。但 0813 当天公开信息不足以证明又出现了新增采购潮,更不能把数月前的订单都算到这次正式版头上。可以确认的长期变化是:当一个高调用量模型把价格压低,行业不一定减少算力需求,反而可能因为单位成本下降而产生更多调用,这就是杰文斯悖论在 AI 时代的版本。单次推理更便宜,Agent 却会运行更久、调用更多工具、生成更多 Token。

对海外旗舰厂商来说,DeepSeek 的威胁也不是“明天所有用户迁移”。高端客户购买的不只是推理能力,还包括数据处理协议、审计、全球可用区、赔偿条款、团队协作产品与品牌风险。DeepSeek 压低的是能力本身的价格,迫使对手证明剩余溢价来自服务,而不是来自模型神秘感。

海外在算账,国内在封圣,资本市场在等第二张牌

Hacker News 和 Reddit 在 0813 上线后很快出现讨论,注意力主要集中在三件事:成绩是否能在独立 Harness 中复现、当前价格是否只是涨价前窗口、正式权重与 API 版本的关系。有人兴奋于 0.435/0.87 美元的价位,也有人提醒不要把 OpenRouter 排名、厂商自测和“开源”三个概念混在一起。这种谨慎是必要的:API 上线、开放权重、开放训练代码,是三件不同的事。

中文社区则贡献了最有效率的舆情温度计。V4 跳票时,梁文锋从“梁圣”降为“小梁”“梁白开”;Flash 性价比超预期,他又被火速复位;涨价预告出现后,“梁子”重回评论区。现在大家等的不是模型输出,而是价目表输出。若涨幅失控,“牢梁”大概会成为年度最快完成从技术名词到社会学称谓的产品指标。

但别小看这些梗。它们反映的是用户和 DeepSeek 之间一种少见的心理契约:大家并非只期待它做出强模型,还期待它代表一种“把昂贵智能打下来”的立场。普通厂商涨价,用户抱怨成本;DeepSeek 涨价,用户会追问你是否背离了斩杀线。价格已经成为品牌人格的一部分,这既是资产,也是枷锁。

资本市场今天的反应则明显克制。2025 年 R1 出圈时,市场第一次意识到高性能模型未必需要按原有资本开支叙事定价,英伟达曾出现历史级单日市值波动。V4 Pro 0813 没有重演这一幕。原因不难理解:V4 大版本已在 4 月出现,Flash 正式版也在 7 月底上线,0813 更像产品兑现而非世界观突袭;同时,DeepSeek 尚未公布最终涨价方案,投资者还无法判断这究竟意味着利润改善、需求过热,还是低价策略接近边界。

因此,今天没有一条可信的股价波动可以单独归因于 0813。媒体报道热、社区讨论快,不等于资本市场已经投票。真正值得资本关注的第二张牌,是新价格与调用量能否同时成立:价格提高后需求若仍强,说明 DeepSeek 获得了定价权;涨价后调用迅速迁移,则说明用户忠于便宜智能,而不是忠于 DeepSeek。

V4 Pro 的真正考题在发布之后

0813 的成绩足够让 DeepSeek 继续坐在牌桌中心,但还不能宣布牌局结束。

第一道考题是独立复现。厂商跑分可以说明方向,不能替代真实仓库、长任务与多轮工具调用。尤其是 DeepSWE 这类大幅跃迁项目,社区需要知道提升来自模型本身、推理预算、上下文长度,还是专门 Harness。一个能力只有在别人的工具链里仍然成立,才会从发布成绩变成产业能力。

第二道考题是版本承诺。Agent 被嵌入生产流程后,模型更新不再像聊天产品换皮肤。输出行为改变会影响审批、测试和风险控制。DeepSeek 需要给企业更清晰的旧版本保留期、迁移窗口、回归基线与故障沟通,而不只是凌晨替换一个版本号。

第三道考题才是价格。斩杀线不是“不许涨价”,而是涨价后仍要让竞争对手难以回答。只要 V4 Pro 在完整任务成本上保持明显优势,梁圣可以收钱;如果涨价换来了稳定性与服务,甚至应该收钱。商业可持续不是理想主义的敌人,而是理想主义不在下一轮账单日前断电的条件。

网友把创始人的称号一天改三次,看似没正形,其实比很多宏大叙事更诚实:能力好就夸,跳票就骂,便宜就封圣,涨价先看幅度。技术崇拜被一张实时更新的价格表拴住,至少比只看发布会灯光健康。

所以,今天对 DeepSeek V4 Pro 最准确的评价也许是:模型转正了,商业模式还在答辩。0813 把 Agent 能力推过了一条重要门槛,涨价预告则提醒所有人,廉价智能从来不是自然资源,它需要算力、工程和现金流共同供养。

至于梁圣会不会变牢梁,不妨等正式价目表宣判。毕竟在大模型行业,真正有法律效力的从来不是网友尊号,而是每百万 Token 后面的那个数字。

这篇讨论的是 Pro 转正后的商业答辩;关于 Flash 如何把斩杀线第一次画出来,以及为什么模型过了斩杀线仍不等于工程过了验收线,可以接着读过了斩杀线,还没过验收线

资料说明

本文事实截至 2026 年 8 月 13 日晚,优先采用 DeepSeek 官方模型与定价页官方更新日志。当日实测与报道参考了爱范儿、钛媒体、IT之家、华尔街见闻、东方财富等公开页面;海外讨论参考 Hacker News、Reddit 搜索可见讨论。社区发言、媒体实测与厂商跑分均不等同于官方承诺,最终价格以 DeepSeek 后续通知为准。