DeepSeek 发布 V4.1 Flash 模型:更小成本带来更强智能,同步开源并下调价格

大模型之家讯 9月10日,DeepSeek 正式推出全新模型系列中的最小尺寸模型 DeepSeek V4.1 Flash,该模型具备原生多模态视觉理解能力。官方表示,新模型结构在设计上追求能力上限更高、推理速度更快、吞吐更大,并可扩展至更大参数的模型。

作为 552B 参数的 MoE 模型,V4.1 Flash 采用全新的 Causal-Encoder-Decoder 非对称结构,输入与输出不对称,其中输入激活仅为 8B、输出激活为 16B,成本显著低于已知的同尺寸模型。同时,新模型采用新的预训练方式并经过更大规模强化学习后训练,在基准测试中成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型。

DeepSeek 发布 V4.1 Flash 模型:更小成本带来更强智能,同步开源并下调价格

在成本优化方面,新一代模型大幅缩减了 KV Cache 缓存占用,相比上一代,对 HBM 的需求减少至 1/4,对 SSD 的需求减少至 1/8,进一步降低了 Agent 类任务的使用成本。官方数据显示,相对于初代模型,KV Cache 已缩小 437 倍。

DeepSeek 发布 V4.1 Flash 模型:更小成本带来更强智能,同步开源并下调价格
DeepSeek 发布 V4.1 Flash 模型:更小成本带来更强智能,同步开源并下调价格

API 支持方面,DeepSeek V4.1 Flash 已同步上线官方 API,命名为 deepseek-flash,旧版本模型 deepseek-v4-flash、deepseek-v4-flash-vision-exp 将被暂时路由至新模型。同时,由于 V4.1 Flash 在性能、费用、速度、总用时等各项指标上全面超越 V4 Pro,官方计划有序下线 V4 Pro:北京时间 2026 年 9 月 14 日 12 时之后,访问 deepseek-v4-pro 的请求将全部路由至 V4.1 Flash,并按新模型单价计费。腾讯(WorkBuddy、CodeBuddy)和 OpenCode 已作为官方合作伙伴全量接入该模型。

得益于架构创新,DeepSeek 同步下调了 V4.1 Flash 定价,并保留峰谷定价机制,闲时价格为高峰时段价格的一半,新价格自 2026 年 9 月 10 日 12 时起生效。

DeepSeek 发布 V4.1 Flash 模型:更小成本带来更强智能,同步开源并下调价格

模型现已开源,官方提供 Hugging Face 模型与论文链接,并面向具备大规模部署条件的用户开放合作。

DeepSeek 发布 V4.1 Flash 模型:更小成本带来更强智能,同步开源并下调价格

原创文章,作者:志斌,如若转载,请注明出处:http://damoai.com.cn/archives/18693

(0)
上一篇 48分钟前
下一篇 2024年12月2日 下午8:34

相关推荐

发表回复

登录后才能评论