大模型之家讯 9月10日,深度求索正式发布DeepSeek V4.1 Flash模型。该模型为552B参数的MoE模型,采用全新Causal-Encoder-Decoder架构,输入激活仅8B、输出激活16B,具备原生多模态视觉理解能力,在基准测试中超越包括V4 Pro在内的一众旗舰模型。新一代模型大幅压缩KV Cache,对HBM需求减少到1/4,对SSD需求减少到1/8,初代模型的KV Cache是其437倍。官方同步下调定价,新价格于9月10日12:00生效,腾讯(WorkBuddy、CodeBuddy)和OpenCode已全量接入,官方计划于9月14日12:00起有序下线V4 Pro。