大模型之家2026年8月热力榜:涨价与降本齐飞,开源共普惠一色

大模型之家2026年8月热力榜:涨价与降本齐飞,开源共普惠一色

2026年8月,如果说7月是用WAIC和2.8万亿参数证明中国大模型能做大,那么8月就是用两份价目表证明它能做便宜、能交付。喧嚣散场,战场回到模型本身:智谱GLM-5.3与GLM-5.3-Flash连发,阿里Qwen3.8-Max刷新开源旗舰纪录后,转身掏出每token仅激活6B的Qwen3.8-Flash,腾讯混元Hy4以770B参数、100万上下文入场,同一件事:把推理成本压下来。

而在市场上,一边是DeepSeek V4 Pro正式版结束预览、开启峰谷定价,输出最高27元/百万tokens、部分价格涨幅最高约12倍,第一次把“模型也能涨价”的商业底气摆上台面;另一边是智谱、阿里、蚂蚁的Flash矩阵集体反向操作,主打低成本规模化落地,曾以“Ox Alpha”匿名走红的GLM-5.3-Flash直接开源。一涨一降,完成了中国大模型商业化的AB面:涨价验证真实需求,降本才能换来真正普惠。

当开源成为默认选项、Flash成为标配、多模态与Agent成为必考题,全新的AI发展规律规律已然切换赛道:大模型的竞争,正从谁的参数更大转向谁的单位算力更聪明、谁的闭环更能交付7月让中国模型登顶Hugging Face,8月则让它走进每一次调用——参数崇拜退场,效率与成本登场,这才是从“做大”到“做成生意”的关键一跃。

大模型之家2026年8月热力榜:涨价与降本齐飞,开源共普惠一色

智谱:GLM-5.3GLM-5.3-Flash连发并开源

8月14日,智谱发布新一代开源旗舰基座模型GLM-5.3(总参约740B、激活40B的MoE架构),与GLM-5.2共用同一基座,能力增益全部来自后训练规模化,官方称编程内部基准提升约50%,并补齐全栈网络安全能力,在CyberGym开源评测中位列第一;权重于8月28日在Hugging Face与魔搭ModelScope开放,采用允许商用、超大规模部署受限的自定义License。8月26日再上线并开源GLM-5.3-Flash(总参320B、激活18B),即此前以匿名身份“Ox Alpha(牛来)”走红开发者社区的模型,采用线性注意力与稀疏注意力混合架构,主打低成本原生多模态,实现视觉、代码、浏览器与图形界面的协同闭环。

DeepSeek:模型大幅涨价、首个视觉模型开源

8月13日,DeepSeek无预告上线V4-Pro正式版(DeepSeek-V4-Pro-0813),由4月预览版升级为GA版本,Agent与编程能力显著跃升,并同步发布配套模型运行系统DeepSeek Harness;同时宣布API调价,8月17日0时起采用峰谷定价,高峰时段V4 Pro输出价格最高达27元/百万tokens,部分输入价格涨幅最高约12倍,标志V4-Pro结束预览转为正式商用。8月21日再发布V4系列首款原生视觉模型DeepSeek-V4-Flash-Vision-Exp(实验版),支持图片描述、截图文字识别与图表分析,Terminal Bench 2.1得分83.9,并于8月底开源,补齐多模态能力。

阿里巴巴:Qwen3.8-MaxQwen3.8-Flash开源

8月3日,阿里巴巴正式发布新一代基座大模型Qwen3.8-Max,总参数2.4万亿、采用稀疏混合专家架构,这是千问系列首次开源Max级旗舰模型权重,编程与专业办公能力大幅提升,官方称推理成本降至行业约1/8;随后又推出面向笔记本等端侧场景的Qwen3.8-27B等轻量开源版本。8月26日,通义团队再发布多模态MoE模型Qwen3.8-Flash(总参125B、每token仅激活6B),并同步开源被视为新一代Qwen4雏形的Qwen3.8-Flash-Next权重。8月28日消息显示,阿里云收入增速创22个季度新高,AI商业化加速。

腾讯:混元Hy4 preview开源,上下文破百万

8月28日,腾讯混元发布并开源新一代大语言模型混元Hy4 preview:总参数770B、激活参数49B,上下文长度突破100万token,采用Apache 2.0协议全量开放。该模型重点面向Agent、编程及软件工程、办公、游戏开发、科研等真实生产力场景优化,强化复杂任务的理解、规划、工具调用与持续执行能力;腾讯披露在内部163名专家、203个工程任务的盲测中表现突出,称已跻身开源大模型第一梯队,被业内视为补齐腾讯“模型+场景+工程”差异化竞争壁垒的关键动作。此外,8月4日腾讯还宣布混元Hy3在WorkBuddy与CodeBuddy中的免费调用期限顺延至8月31日。

百度:文心任务引擎2.0与搜索“整页可交互“

8月18日,百度发布2026年二季度财报,创始人李彦宏明确提出要让文心大模型重新回到基础大模型第一梯队。8月20日百度AI Day开放日上,文心助手升级推出“任务引擎2.0”,覆盖专业分析报告、办公PPT、量化交易终端、定时任务等高频场景并完全免费,推动AI从“帮你找到”走向“帮你做到”,覆盖约4亿金融、教育、办公用户群,官方称日活用户同比增长83%;同日百度搜索推出全球首创“整页可交互”搜索结果形态,不再只有图文,而是生成可互动的知识卡片、步骤图解、可交互动画等组件。

商汤科技:U1.5-Lite开源与多模态智能体齐发

8月3日,商汤面向全球开源轻量级原生统一多模态模型SenseNova U1.5-Lite预览版(约8B参数),在同一架构中贯通视觉理解、推理、生成与编辑,原生支持4K生成与编辑;8月21日发布该模型正式版并开源,进一步强化复杂指令遵循、视觉质量、文字与布局、原生4K生成、图像编辑与精细视觉控制等能力,面向真实视觉创作与交付场景提升稳定性与可控性。8月11日,“日日新”上线多模态智能体模型SenseNova 6.8 Flash Lite Preview,具备自主规划、持续执行、多Agent协作与动态纠偏能力。8月底,商汤携日日新、小浣熊、Seko等产品亮相深圳国际通用人工智能大会,提出“2026是Agent之年”。

360集团:半年报扭亏为盈,“All in Agent”提速

8月19日晚间,三六零披露2026年半年报:上半年营收41.72亿元、同比增长9.01%,归母净利润2.16亿元,同比扭亏为盈,扣非净利润1.53亿元同样转正,毛利率升至69.66%。公司延续“AI+安全”双主线推进“All in Agent”布局,以自研360智脑大模型为核心,持续迭代纳米AI、360AI办公、纳米大片流水线、360文库等产品矩阵,会员订阅收入驱动特征明显;企业智能体工作平台“纳米Work”自7月底发布后加速落地,推动AI进入企业真实业务流程。安全侧,360安全大模型已在政务、金融、能源、制造、交通等行业落地,漏洞挖掘智能体“图龙锋”累计发现漏洞近7000个,8月17日创始人周鸿祎还发内部信要求高管学习AI。

字节跳动:SeedRealtime与“豆包工作上线

8月5日,字节跳动正式推出原生音视频全双工大模型SeedRealtime,以统一架构原生融合音频、视频与文本,支持在连续多模态信息流上实时交互,实现“边看边听边说”,并已全量上线豆包App。8月25日,字节发布面向生产力场景的AI办公智能体品牌“豆包工作”,深度打通飞书生态,用户输入目标后自动完成拆解、工具调用、信息搜集与多步骤执行,推动豆包从问答式助手向数字办公助手跨越。此外,Seedance 2.5视频生成模型8月起陆续上线豆包、即梦、扣子等产品并向企业开放;8月30日消息称,原计划8月推出的豆包大模型2.2延期发布,以便更充分预训练,强化编程、工具调用与Agent能力。

蚂蚁百灵:Ling-3.0系列开源与金融增强模型

8月上旬,蚂蚁集团旗下百灵大模型正式开源新一代原生混合推理模型Ling-3.0-flash(总参124B、激活5.1B),提供FP8、FP4、INT4等多版本,定位极致智能密度、全链路Agent闭环与低成本规模化落地,开源当日即获昇腾0 Day适配并开放一体化部署方案;随后又开源面向本地部署与Agent场景的轻量模型Ling-3.0-tiny(总参7.9B、激活1.3B),支持思考与快速回答双模式并可调用工具,已在DGX Spark、MacBook、Mac mini等设备完成验证;8月28日,蚂蚁联合中金公司及行业专家推出百灵首个金融增强模型Ling-3.0-flash-Fin,通过金融语料持续预训练与领域后训练打造。

MiniMax:全模态视频模型H3开源

8月3日,MiniMax(稀宇科技)正式开源通用全模态视频生成模型MiniMax H3,这是海螺系列首次开源视频模型权重,该模型可统一理解文本、图像、视频与音频构成的多模态上下文,生成最高2K分辨率、最长15秒、带原生立体声音频的视频,官方模型卡标注24FPS与32kHz立体声;开放权重已上架Hugging Face与魔搭ModelScope,供全球开发者免费下载、部署与二次开发。此举被业内视为开源视频生成领域的重要突破,也被认为将对闭源视频模型形成直接冲击。

原创文章,作者:志斌,如若转载,请注明出处:http://damoai.com.cn/archives/18383

(0)
上一篇 14小时前
下一篇 7小时前

相关推荐

发表回复

登录后才能评论