DeepSeek V4 Flash低价斩杀线背后:当梁文锋也卷不动算力账单(含实测)

DeepSeek V4 Flash低价斩杀线背后:当梁文锋也卷不动算力账单(含实测)

低价”往往是击穿同行防御最锋利的武器,但它也是最先伤到自己的一把双刃剑。

8月6日,DeepSeek在用户后台突然发布调价预告,宣布计划在近期对全部API接口服务进行整体提价,且预计涨幅较大。官方在公告中明确建议企业与个人开发者合理规划调用量、控制充值金额,具体调价细则与生效时间以后续正式公告为准。

DeepSeek V4 Flash低价斩杀线背后:当梁文锋也卷不动算力账单(含实测)

这距离梁文峰上一次给行业带来“价格震荡”,仅仅过去了七天。

7月31日,DeepSeek在API文档里更新了一条日志,宣布DeepSeek-V4-Flash正式版上线公测。模型的架构与参数规模和4月24日开源的预览版完全一致,2840亿总参数、130亿激活参数的MoE架构,唯一重做的东西是后训练。

然而,正是这唯一的改动,让整个行业惊掉了下巴。在官方公布的9项Agent基准测试中,正式版全面越过自家旗舰V4-Pro预览版,指令遵循能力呈现出跨代际的提升。与此同时,DeepSeek首次原生支持Responses API格式,并直接向OpenAI的Codex亮剑。开发者可以直接在ChatGPT桌面端或是VS Code插件里,将底层引擎无缝切换为DeepSeek。

随后几天,各大榜单和开发者的时间线都被这个模型“血洗”了一遍。大模型之家也在第一时间对DeepSeek V4 Flash正式版进行了实测,进步确实不小,但它真正的杀伤力不在只跑分上。

实测:修复生产bug,仅需8毛8

DeepSeek V4 Flash低价斩杀线背后:当梁文锋也卷不动算力账单(含实测)

实测的机会来得有些偶然。笔者自己搭建的舆情管理系统正好出了bug:信源匹配数量断崖式下跌,前一天还能匹配出10000多条数据,当天只剩不到2000条。

DeepSeek V4 Flash低价斩杀线背后:当梁文锋也卷不动算力账单(含实测)

DeepSeek V4 Flash正式版在遍历遍历“屎山代码”之后,很快定位到匹配历史骤减的根源:每次遍历信源之后的归档写出环节存在错误,导致此后更新的历史库条目大幅下降。

DeepSeek V4 Flash低价斩杀线背后:当梁文锋也卷不动算力账单(含实测)

从开始定位bug到给出解决方案,全程不到3分钟,并且一次修复成功匹配数量从1966条恢复到了11020条。

DeepSeek V4 Flash低价斩杀线背后:当梁文锋也卷不动算力账单(含实测)

在这个过程中还有一个计划外的收获。DeepSeek V4 Flash正式版甚至在检查代码时顺手揪出了信息条目重复的暗病,并附赠了去重方案。

DeepSeek V4 Flash低价斩杀线背后:当梁文锋也卷不动算力账单(含实测)

而在一次修正的成果背后,DeepSeek V4 Flash正式版的消耗也是可圈可点:整个项目消耗了不到21.7Token,缓存命中率高达99.8%。按照正式版的定价(输入1元/百万Token、缓存命中0.02元/百万Token、输出2元/百万Token)估算,这次在生产环境中debug的总成本,仅需要0.88元人民币(约0.13美元)。如果抛开后续的去重和项目归档,仅算最初的Bug定位与修复,成本仅为0.27元(约0.04美元),若通过第三方平台的Token Plan调用,价格还能再压一压。

DeepSeek V4 Flash低价斩杀线背后:当梁文锋也卷不动算力账单(含实测)

在Agent时代全面到来之前,几毛钱修好一个生产环境的Bug,恐怕是难以想象的。

DeepSeek V4 Flash低价斩杀线背后:当梁文锋也卷不动算力账单(含实测)

不过,DeepSeek V4 Flash正式版也并非没有短板。其API目前仍不支持多模态图像输入,这使得它在处理前端任务中会表现出“审美”不足,且284B总参数量、13B激活的体量,决定了它在复杂、长流程的任务规划中依然会感到吃力。单点定位、单次修复是它的绝对主场,可一旦拉长到多步骤、多分支的完整工程,其表现就会不可避免地下滑。

Agent时代难逃“真香定律”

凭借着不错的能力与极为出色的性价比,DeepSeek V4 Flash正式版发布后,“斩杀线”一说在AI圈里不胫而走,“干翻Claude”的说法铺天盖地。

DeepSeek V4 Flash低价斩杀线背后:当梁文锋也卷不动算力账单(含实测)

根据第三方评测机构Artificial Analysis的综合智能指数显示,DeepSeek V4 Flash正式版得分50,在国内落后于Kimi K3的57分和智谱GLM-5.2的51分,排在第三。

值得注意的是,DeepSeek V4 Flash正式版的输出价格是每百万token 0.28美元(2元人民币),而GLM-5.2的输出定价是4.29美元,是它的15倍;Anthropic旗舰Claude Fable 5的输出定价更是高达50美元,是它的178倍。

Artificial Analysis按综合评测任务口径估算,DeepSeek V4 Flash正式版完成一项任务的平均成本约0.03美元,Kimi K3约0.86美元,Fable 5约3.15美元,最贵与最便宜之间差了105倍。

也许在单轮闲聊中,几毛与几分的差价毫无体感,但Agent场景会将其指数级放大。一个真实的软件工程任务,模型需要读仓库、改代码、调终端、查输出、发现错误再重来,动辄触发百次以上的调用。一次0.03美元和一次3.15美元,跑50次,就是一杯咖啡和一台咖啡机的区别。这不是倍数差,而是量级碾压。

这也是为什么,各大厂商立刻闻风而动。DeepSeek V4 Flash正式版上线前一天,OpenAI宣布GPT-5.6系列调价,入门款Luna降价80%;8月1日,智谱重新开放了一度需要抢购的GLM Coding Plan订阅。

虽然在瞬息万变的模型市场,我们很难把所有同行的降价都归因于DeepSeek,但在如此密集的动作背后,整个行业的价格锚点正在被重塑。这也恰恰是“斩杀线”的真正含义:性能比它强的,价格贵出一两个数量级;价格向它看齐的,性能又存在代差。

正因为DeepSeek V4 Flash正式版的出色表现,也让尚未露面的DeepSeek V4 Pro正式版备受行业期待。如果Flash的定义是“够用”,那么瞄准GPT-5.6 Sol一档的Pro,才会是DeepSeek真正意义上的正面进攻。届时,“国模一哥”的地位,也许会再次发生洗牌。

重启500亿募资,梁文峰的秣马厉兵

与DeepSeek产品侧的“抠门”形成对照的,是梁文峰在资本侧的胃口。

据报道,DeepSeek已重启第二轮融资,计划募资500亿元,投前估值约5000亿元。而就在两个月前,他们刚刚完成了中国大模型史上规模最大的首轮融资——拿走了包括国家人工智能产业投资基金、腾讯、宁德时代等在内的510亿元,是中国AI大模型史上规模最大的首轮融资。

大模型之家了解到,两轮合计超千亿的募资,将有超过六成资金用于自建智算中心与国产芯片适配,另有一条一年前已秘密启动的自研推理芯片产线,以及核心人才团队的稳定与扩充。这家曾经以“轻资产、重算法”著称的公司,正在被残酷的算力需求逼着变“重”。

DeepSeek V4 Flash低价斩杀线背后:当梁文锋也卷不动算力账单(含实测)

梁文锋曾表示:采购一批服务器,大约10个月通过API收入收回设备成本,在DeepSeek内部,这已经算“合理利润”。也就是说,此前的低价不是靠补贴烧出来的战术,而是算法优化带来的成本结构性优势。

同一赛道的另一面是月之暗面。7月16日发布2.8万亿参数的Kimi K3之后,这家公司先以约315亿美元(折合人民币约2100亿元)的估值完成F轮融资,随即以500亿美元估值开启Pre-IPO轮,预计年内递表上市。K3的API定价比上一代K2.6涨了三到四倍,输出达到100元/百万token。一个涨价押注“更聪明”,一个降价押注“够用就好”。两条路线都拿到了巨额资本背书,市场还没有投出最终答案。

然而,8月6日后台那一纸突如其来的调价预告,无情地戳破了DeepSeek带来的这场低价狂欢的滤镜。它透露出大模型商业化进程中,触碰到了最冰冷的物理现实:算法的精妙固然可以压缩单位Token的算力成本,但算力集群的硬件天花板与现金流压力,无法被无限平抑。

DeepSeek V4 Flash正式版上线后,在OpenRouter榜单上创下了单周7.1万亿Token的恐怖消耗量。极低的价格引发了全网开发者的“报复性”调用,高峰期的并发请求直接让服务器集群不堪重负。在自建智算中心尚未完全交付的当下,通过价格杠杆筛选高价值客户、抑制低效高频消耗,成了防止服务器被彻底挤爆的唯一自救手段。

另一方面,则是重资产基础设施的现实账单。自建超大规模智算中心、深度适配国产芯片乃至自研推理芯片的产线建设,无一不是动辄百亿级的现金流黑洞。即便是手握千亿融资金额,面对硬件周期与供应链成本,DeepSeek也必须重新算账:如果长期维持临界状态的低毛利,硬件扩张与研发投入的血条终究难以为继。

写在最后

“8毛8修Bug”的故事固然动听,但8月6日的提价信号终归证明了一件事:即便是技术与成本控制极具天赋的梁文锋,也无法凭一己之力脱离算力硬件的客观物理规律。当强如DeepSeek都不得不踩下刹车、调头提价时,这场靠“价格战”互相放血的时代,或许真的要画上句号了。

而在另一边,阿里“千问办公”、腾讯WorkBuddy与字节豆包,正为了C端办公场景打得刺刀见红。对比之下,DeepSeek那个功能依然“简陋”的官网,克制得仿佛不属于这个时代。

克制的产品形态,极致的API定价,与千亿级别的重资产基建,构成了DeepSeek最真实的商业底色。DeepSeek踩下的这一脚刹车,与其说是向商业现实低头,不如说是整个行业在一场狂热的价格战后,对客观商业规律的第一次真正敬畏。

原创文章,作者:志斌,如若转载,请注明出处:http://damoai.com.cn/archives/17911

(0)
上一篇 8小时前
下一篇 2025年5月20日 下午3:50

相关推荐

发表回复

登录后才能评论