大模型之家2026年7月热力榜:WAIC 2026的7月,中国大模型把主场搬到了世界舞台

大模型之家2026年7月热力榜:WAIC 2026的7月,中国大模型把主场搬到了世界舞台

2026年7月,中国AI产业迎来了真正意义上的”世界时刻”。7月17日,WAIC 2026在上海开幕,主题”智能伙伴,共创未来”——这届大会不再比拼谁的演示更惊艳,而是把”智能体能不能交付”摆上台面:阿里发布Agent Native Cloud,腾讯一口气开源三款具身智能基座模型,百度搭子与阶跃STEPX Neo双双入选”镇馆之宝”。而大会开幕前夜,月之暗面投下了7月最重的一枚棋子:Kimi K3发布,2.8万亿参数刷新全球开源模型规模纪录。

2026年最硬核的商业验证不是缺需求,而是缺算力。资本随即用真金白银投票:F轮超35亿美元、投后估值350亿美元,G轮(Pre-IPO轮)提前开启、投前估值升至500亿美元,股份制改造同日落地,赴港上市进入倒计时。资本市场对AI的定价权,正式从”故事”移交给了”参数、开源与收入”。

7月,模型侧的关键词是”开源登顶”与”Agent反超”。中国开源模型第一次在世界舞台上扬眉吐气:7月27日,Kimi K3全量开源,2.8万亿参数的MIT权重登顶HuggingFace热度榜;月末,DeepSeek V4-Flash正式版压轴登场,2840亿参数、Agent与代码能力九项基准全面反超自家1.6万亿参数的V4-Pro预览版,MIT协议权重两天下载量超23.6万。

应用层面,7月是”智能体经济”的正式起跑:商汤大装置日均Token服务量突破2.4万亿,360把10万个智能体塞进自家630个岗位试错150天后推出纳米Work,阶跃星辰把大模型装进手机,面壁智能把1.5B参数的VLA模型装进机器人。

在大模型之家《2026年6月大模型热力榜》中,我们共收录了600余个大模型及其所属企业。当中国模型开始在HuggingFace登顶、在Copilot上岗、在国家超算互联网上按API计费,”谁能把大模型做成生意”的上半场已见分晓——下半场的考题,变成了”谁能把中国开源做成全球基础设施”。7月只是决战的开端。

大模型之家2026年7月热力榜:WAIC 2026的7月,中国大模型把主场搬到了世界舞台

月之暗面:开源全球最大参数模型Kimi K3

7月16日,月之暗面发布新一代旗舰大模型Kimi K3,7月27日正式全面开源,同步放出完整模型权重、技术报告及三项核心训练基础设施技术(MoonEP、FlashKDA、AgentEnv)。Kimi K3总参数量达2.8万亿,是全球首个开源的近3万亿参数MoE模型,原生支持视觉理解,具备100万token上下文窗口,面向软件工程、知识工作、深度研究与多模态理解等复杂长程任务。模型上线不到一天即登顶Arena.ai前端代码竞技场,在品牌营销、参考设计、数据分析、消费产品、模拟、内容创作、游戏七个细分方向中拿下六个第一。整体扩展效率较K2提升约2.5倍,综合智能水平接近全球前沿闭源模型。资本层面,7月29日月之暗面完成工商变更登记,正式变更为股份制公司,F轮融资超35亿美元,实际募资规模超出原定目标3倍以上,G轮(Pre-IPO轮)已提前开启,投前估值升至500亿美元,资本化进程显著提速。

DeepSeekV4-Flash正式版发布,Agent能力反超Pro

7月31日,DeepSeekAPI文档更新日志中低调宣布V4-Flash正式版(版本号V4-Flash-0731)开启公测。该模型总参数2840亿、激活参数130亿,定位高效低成本推理场景。与常规认知中“Pro强、Flash弱”的分层逻辑不同,此次升级最引人关注的是,V4-Flash正式版在智能体(Agent)能力上实现了对自家V4-Pro预览版的全面反超。据官方公布的9项基准测试成绩,V4-Flash正式版在Terminal Bench 2.1上拿到82.7分,NL2Repo 54.2分,Cybergym 76.7分,Toolathlon verified 70.3分,九项智能体与代码基准得分全部超过自家1.6万亿总参数、490亿激活参数的V4-Pro预览版。工程适配上,正式版原生支持Responses API格式,并针对性适配Codex,降低开发者迁移成本。发布后仅约5小时,Unsloth即推出本地运行版本,使这款前沿级代码模型可在普通桌面电脑上运行。DeepSeek同时官宣V4-Pro旗舰模型将于8月初正式发布。

腾讯:混元Hy3正式版发布,组织架构再整合

7月6日,腾讯混元正式发布第三代大语言模型Hy3。该模型采用MoE架构,总参数295B、激活参数21B,最大支持256K上下文长度,提供no_think、think_low与think_high多档思考模式。相比4月底的preview版本,Hy3在后训练质量和规模上进一步提升,在推理、Agent、长上下文等任务上显著进步,效果比肩国内外参数规模达其2—5倍的旗舰模型,幻觉率降至5.4%,定价进一步降低。Hy3已在WorkBuddyCodeBuddy等腾讯内部产品中落地。7月23日,腾讯宣布将混元多模态模型部门与大语言模型部门合并成立“基础模型部”,由首席AI科学家姚顺雨统一掌舵,目标直指全模态大一统,这是腾讯AI体系自2025年12月大调整后的又一次组织升级。WAIC期间,腾讯Robotics X实验室联合混元发布具身智能系列新模型,首次系统性打通“感知—身体—行动”闭环。此外,混元研究智能体Hyra借助Hy3模型,构造出整数集使和集与差集的指数比精确达到2,解决了自1969年以来悬而未决的极值数学难题。

阿里巴巴:Qwen3.8预览版上线,多模态全面突破

7月19日,阿里通义千问正式放出新一代旗舰基座Qwen3.8-Max-Preview预览版,总参数量拉升至2.4万亿,支持视觉理解,上下文长度达1M Tokens,在编程(Coding)和专业办公(Cowork)方面能力大幅提升,全栈代码与长程Agent能力大幅升级。官方称其综合能力仅次于Fable 5,位列全球第二。7月15日,通义实验室悄然发布Qwen-Audio-3.0-Realtime语音模型,在语音推理榜单登顶全球第一,超越OpenAI旗舰模型。7月22日,通义团队发布第三代图像生成大模型千问文生图3.0(Qwen-Image-3.0),指令长度上限跃升至4.5k token,可仅凭三千多字长指令一次性生成涵盖医学图解、代码界面、复杂公式的精细图像,细节刻画能力大幅提升。7月31日,通义千问推出具备长音频上下文记忆的语音识别模型,支持会议连续转写,内置医疗、IT等行业词典,专业术语召回率分别达95.36%和91.87%。此外,通义千问确认已与Apple Intelligence集成,将在中国区iPhone、iPad、Mac及Vision Pro上全面部署。

百度:DuMate智能体升级,昆仑芯M100亮相WAIC

7月10日,百度在成都举办“AI Day·百度搭子专场”,宣布通用智能体百度搭子(DuMate)重磅升级,并正式发布DuMate企业版。个人版新增智能路由(自动选择云端沙箱、本地沙箱或Chat模式,任务耗时显著降低)、共享记忆、浏览器控制、演示文稿生成等能力,日均提问次数较此前暴增20倍。企业版则叠加统一身份接入、成员与资源管理、安全审计等组织管控能力,支持企业将专属技能、数字员工和企业级记忆沉淀为可复用资产。7月17日至20日WAIC期间,百度旗下昆仑芯科技首次公开第四代AI芯片昆仑芯M100实物,该芯片依托自研XPU架构优化大模型算力部署,面向大规模AI推理场景。C端方面,7月1日文心一言App新增“深度阅读”与“图表生成”两大能力,用户上传百页以上行业报告或PDF,AI可在数秒内提取核心论点并生成结构化图表。7月26日,百度文心相关网站完成合并升级,统一整合为全新的百度文心网站,打造一站式AI服务超级入口,在文心5.1加持下实现体验全面升级。此外,文心快码于7月中旬同步支持Kimi K3模型。

360集团:发布纳米Work企业智能体平台

7月28日,360集团创始人周鸿祎在北京国家会议中心正式发布新一代企业智能体工作平台纳米Work”,标志着360正式杀入企业级智能体赛道。纳米Work定位为企业AI化的生产力引擎,面向企业老板、创业者、一人公司(OPC)及企业员工,打造“超级组织”。平台内置多智能体引擎,用户只需给出明确目标,AI专家团即可直接交付工作成果——老板可用于经营分析,创业者可做产品验证、内容生产、营销获客,普通员工可做研究、写方案。周鸿祎提出“企业搞AI,老板要先用”的观点,并宣布为首批用户每人提供1亿Token试用额度。该平台脱胎于360自身实践:360先拿自己开刀,将10万多个智能体投入真实业务,150天覆盖630个岗位,消耗350万亿词元,收集5.6万条反馈,暴露出智能体在企业场景下成本、稳定、安全、可控四类问题,据此总结出智能体上岗须过的六道关口。纳米Work的发布,标志着360AI战略从模型层转向应用层,重点押注企业智能体赛道。

商汤科技:SenseNova U1 Pro发布,迈向系统级交付

7月18日,WAIC 2026上,商汤科技正式发布大模型家族旗舰新品——日日新SenseNova U1 Pro作为“日日新SenseNova U”系列的旗舰版本,U1 Pro定位为业界首个以“理解·生成·行动”原生统一为内核的面向长程任务的交付级原生多模态智能体基座,对标全球顶尖模型GPT-Image 2,并率先支持原生8K。商汤方面表示,U1 Pro的问世标志着全球多模态产业正式跳出单点内容生成局限,从“内容生成”迈向“系统级交付”。该模型打通了AI理解、生成、行动全链路统一能力,在原生统一架构基础上,通过在视觉创作领域的深度优化,实现长程复杂任务的端到端交付。商汤科技董事长兼CEO徐立表示,好的AI产品既扩展人的能力,更促进成长。此次发布是商汤在多模态AI领域的重要里程碑,体现了其从计算机视觉起家向通用大模型与智能体基座全面延伸的战略路径,也反映出行业共识——AI正在经历从生成一段内容、一次回答,走向完成一个长程任务、实现系统级交付的重要转变。

MiniMaxH3多模态生成模型发布,视频能力登顶

7月31日,MiniMax正式发布新一代多模态生成模型MiniMax H3,并宣布近期开放模型权重。H3是一款通用全模态生成模型,支持对文本、图像、视频、声音组成的多模态上下文进行统一理解,能够输出具备原生双声道的音视频内容,最高可支持15秒2K分辨率直出。H3不再以图片、视频、声音的生成、编辑和参考等单一任务为边界,而是在多模态上下文中统一理解创作意图,完成更加自然、连贯的生成与表达,画面连贯性大幅升级,人物动作更自然。在Artificial Analysis视频编辑能力榜单上,H3登顶全球第一。定价方面,H3生成成本仅为业内同类旗舰模型的三分之一,被市场称为“价格核弹”。作为MiniMax从“特化任务模型”迈向“通用多模态智能”的重要探索,H3的发布向Sora等全球竞品发起正面挑战。受此消息影响,MiniMax港股(00100.HK)当日股价大涨超10%,市值显著攀升。开源计划则进一步强化了其生态吸引力,开发者可本地部署自由修改。

阶跃星辰:发布STEPX AI终端品牌与智能体操作系统

7月13日,阶跃星辰正式发布全球首个大模型原生AI终端品牌STEPX,并同步推出全球首个智能体原生操作系统Step AOS(Step Agentic-native OS)和阶跃新一代个人智能体阶跃Amoo,全球首款大模型原生智能体手机STEPX Neo同步亮相。Step AOS的设计原点是为智能体自主执行而设计,而非传统的人点击、机器响应模式,被认为是最彻底的“重构派”路线——不从现有系统外挂智能体,而是从底层重构。阶跃Amoo作为个人智能体,可通过自然语音与用户交互,自主规划并持续执行任务。7月17日,STEPX Neo在WAIC上正式对外展出,董事长印奇亲自演示智能体交互,STEPX已与携程、支付宝、滴滴、美团等首批生态伙伴达成AI深度合作。7月20日,阶跃星辰与上海期智研究院在WAIC期间宣布共同设立智能体前沿研究院,由姚期智院士与印奇共同出席揭牌仪式,将围绕智能体网络及经济原理、AI Safety等方向开展联合研究,探索Agent时代的基础理论与产业范式。

面壁智能:端侧模型与具身智能双线突破

7月19日,在WAIC 2026,面壁智能联合OpenBMB集中发布多项端侧AI与具身智能新成果。端侧文本大模型方面,MiniCPM5-2B正式发布,仅20亿参数,却在综合知识、数学推理、代码、指令遵循和智能体能力上均做到同尺寸全球领先,在Artificial Analysis(AA)榜单中以17分占据榜首,取得全球4B以下模型的最高得分。模型原生支持混合思考模式,可在快速响应与深度推理之间切换,并自带工具调用能力。具身智能方面,面壁智能发布其首个具身智能技术成果MiniCPM-Robot系列模型,包括基于MiniCPM-V 4.6训练的通用VLA模型MiniCPM-RobotManip(参数仅1.5B,性能比肩3-4B模型,流式推理成本减半,支持1分钟具身原生记忆)和支持本地部署的跟踪模型MiniCPM-RobotTrack(5+Hz响应率,无需联网)。两款模型均已开源。落地层面,面壁智能已完成五款主流座舱芯片的量产级适配,沉淀68个可量产车机场景,并发布AI原生开发板松果派,降低端侧AI开发门槛。

原创文章,作者:志斌,如若转载,请注明出处:http://damoai.com.cn/archives/17822

(0)
上一篇 2天前
下一篇 1天前

相关推荐

发表回复

登录后才能评论