美团LongCat核心成员顾奇被曝将离职创业 瞄准多模态模型赛道
大模型之家讯 近日,有消息称美团LongCat Team主任研究员、通用Agent团队负责人顾奇即将离职,将在多模态模型领域创业,目前正与VC接触。公开资料显示,顾奇为LongCat系列模型核心贡献者,担任LongCat-Flash-Thinking-2601模型负责人。他毕业于清华大学数学科学系,加入美团前曾先后在字节跳动Seed-LLM-Code团队及蚂蚁集团担任研究员,相关进展仍有待进一步披露。
英伟达拟129亿美元收购Hugging Face 全球最大AI开源平台或易主
大模型之家讯 8月28日,据The Information报道,英伟达已同意以129亿美元收购全球最大AI开源平台Hugging Face,目前尚未签署正式协议。该平台被誉为“AI界的GitHub”,托管超300万个开源模型与100万个数据集。2023年英伟达曾参与其2.35亿美元D轮融资,当时估值45亿美元;去年底Hugging Face还曾拒绝英伟达一笔对应70亿美元估值的5亿美元投资。收购意在守住“卖铲人”生态位,通过繁荣开源生态将算力需求留在英伟达硬件上,同时可将承担的数百亿美元云合同闲置算力转售给平台客户。英伟达Q2营收962.21亿美元同比增106%、净利润596.88亿美元同比增126%,单日市值大增约4420亿美元至5.49万亿美元。微软此前亦曾洽谈收购未果。
谷歌发布Gemini Omni 1.1 Flash视频生成模型 最高支持4K分辨率
大模型之家讯 8月27日,谷歌宣布推出Gemini Omni 1.1 Flash视频生成模型,最高可直接输出4K高细节成片,同时支持1080p与720p。新模型支持场景扩展、首尾帧指定与视频参考:可基于已有视频从结尾无缝续生成,按每次10秒步长扩展、单条累计最长40秒;指定起始帧与结束帧即可实现平滑转场与运镜;可引入最长3秒参考视频以维持背景与角色一致性。为提升迭代效率,模型提供360p预览模式,较720p生成速度最高提升60%、成本仅三分之一。定价为360p每秒0.03美元(约0.2元)、720p每秒0.1美元(约0.67元)、1080p每秒0.15美元(约1元)、4K每秒0.3美元(约2元)。
成立仅4个月,北京AI Infra创企博伦智汇获千万级天使轮融资
大模型之家讯 8月27日,北京AI基础设施创企博伦智汇宣布完成千万级天使轮融资,由专注AI及AI Infra赛道的一线产业基金投资,资金将用于核心技术迭代、产品打磨及团队扩充。公司成立于2026年4月,聚焦大规模异构算力调度,业务覆盖企业私有化算力部署与自营Token工厂,CEO刘进治曾任职英特尔、摩托罗拉并推动WANdisco中国落地,CTO杨光曾任职西门子、IBM、Oracle及矩量无限。核心团队来自天数智芯、华为、趋动科技等,曾操盘国内首批英伟达SuperPOD训练集群并早期进入国产GPU生态。其自研Token导向的大规模分布式架构TOLD已在英伟达与国产GPU组成的万卡级异构集群中完成验证,可对不同地区、不同架构算力统一调度,实现多GPU协同、一键适配及B2B2C多租户服务,旨在降低国产GPU接入成本、提升集群利用率与Token产出效率。
MiniMax上半年收入1.17亿美元同比增283%,8月ARR突破8亿美元
大模型之家讯 8月27日,MiniMax披露2026年上半年财报,收入1.17亿美元、同比增长283.1%,已超2025年全年,毛利2081万美元、同比增464.8%,毛利率17.9%、提升5.8个百分点。收入结构发生切换:开放平台及其他AI企业服务收入7393万美元、同比暴涨703.1%,占比从30.3%升至63.4%;AI原生产品海螺AI收入4264万美元、同比增100.9%,占比从69.7%降至36.6%。财报期后增速进一步加速,7月Token消耗量达1月的20倍,8月ARR超8亿美元,企业客户及开发者突破200万、为去年底10倍,海外收入7083万美元、占比60.8%,覆盖超230个国家和地区。公司称M3较M2价格不变下智能水平提升是核心驱动,截至8月26日市值报1058亿港元,正从C端产品向B端能力底座切换。
智谱发布GLM-5.3-Flash“牛来”,首个原生多模态模型价格仅为Opus 4.8的1/40
大模型之家讯 8月27日,智谱正式发布并开源此前以Ox-Alpha“牛来”匿名测试的GLM-5.3-Flash,总参数320B、激活18B,为GLM-5系列首个原生多模态模型。该模型在Artificial Analysis Intelligence Index获57分,与Claude Opus 4.8持平,超越GLM-5.2及DeepSeek V4 Pro的53分,首日即登顶OpenRouter榜首并刷新单日Tokens用量纪录,较此前峰值提升4倍。定价方面,输入0.8元/百万Tokens、输出2.8元、缓存命中0.23元,约为GLM-5.3的1/10、限时折扣价1/20,较Opus 4.8约35元/175元仅为1/40,也低于DeepSeek V4 Flash的1.5元/4.5元。更关键的是测试期间全部流量由超10万张国产芯片集群承载,基于SGLang专用推理引擎及EPD分离架构等优化,端到端性能较基线提升3倍,单Token成本已与主流英伟达GPU相当,验证了国产卡承载前沿大模型的可行性。据知情人士透露,训练或由海光DCU等国产芯片支持。
小鹏第三颗图灵AI芯片点亮,超级智能体上车
大模型之家讯 8月27日,小鹏汽车宣布自研图灵AI芯片第三颗正式点亮,并于当日15:00举行物理AI分享暨第二代VLA新版本体验日。新一代VLA+VLM实现跨域融合,具备跨域总调度、原生多模态和端侧大模型能力,座舱语音架构重构后支持语音靠边停车、就近泊入、模糊导航及复杂行程规划,实现“一个大脑管理全车,一句话控车”。图灵芯片于2024年8月流片成功,40核心可运行30B参数大模型,经深度定制可实现算力100%利用,单车规划搭载不少于3颗。自2025年三季度量产上车以来累计出货已超20万片,今年二季度起全系Max版本切换至自研芯片,全年出货目标接近100万片,标志着小鹏端侧AI算力自主化进入规模化落地阶段。
斯坦福研究:22至25岁职场新人受AI冲击最显著 高等教育可有效缓冲
大模型之家讯 8月26日,斯坦福数字经济实验室依托薪资服务商ADP覆盖数百万美国劳动者的高频数据更新论文《Canaries in the Coal Mine?》显示,生成式AI尚未造成全美大规模岗位替代,但冲击高度集中于“第一梯级”入门岗:在软件开发、客服等高AI暴露职业中,22至25岁年轻人就业率较受影响较小的领域落后约19%,较2025年的13%进一步扩大,而资深从业者就业保持平稳甚至上升。研究认为,入门岗依赖可通过教材与流程文档传授的“编码化知识”,更易被AI替代,而依赖实践与导师指导的“默会知识”则使AI更多辅助资深员工;同时高等教育可显著缓冲AI对入门就业的负面冲击。
Stability AI完成7600万美元B轮融资 EA与三大音乐巨头及AMD风投联合入局
大模型之家讯 8月26日,Stability AI宣布完成7600万美元(约合5.12亿元人民币)B轮融资,由EA、索尼音乐、环球音乐、华纳音乐及AMD风投联合投资,资金用于创意产品开发、应用研究深化及专业服务扩展。CEO Prem Akkaraju称,投资者不仅提供资金,更带来专业知识、信誉及与艺术家直连的渠道,印证“以生成式AI赋能每位制片人、音乐家和故事讲述者”的愿景。作为Stable Diffusion研发方,Stability AI曾面临商业化压力,此次获内容巨头集体背书,标志版权方从对抗转向合作,将为其合规数据与商业化落地提供支撑,也预示AIGC进入产业资本与模型厂商深度绑定阶段。
英伟达发布Jetson Orin Nano 2 算力翻倍或节能四成
大模型之家讯 8月25日,英伟达正式发布面向入门级边缘AI的Jetson Orin Nano 2机器人计算机,预计2027年上半年以模组及开发套件形态上市。新品沿用Jetson Orin Nano Super同尺寸形态,标准模式下AI算力达78 TOPS,集成8核Arm CPU与8GB内存,视频处理能力显著提升,可实现前代2倍AI推理算力,或在同等性能下功耗仅15W、为前代60%,节能四成。英伟达机器人与边缘AI副总裁Deepu Talla表示,中小型前沿模型精度已追平去年最大前沿模型,该产品将把实时智能的性能与能效带给数百万开发者,利好低成本机器人、智能视觉与边缘Agent场景的规模化落地。