昨天 • 2026年7月24日 • 周五
16:25

腾讯合并混元两大模型部门,成立基础模型部

大模型之家讯 7月23日,腾讯宣布混元多模态模型部门与大语言模型部门正式合并,组建成立基础模型部,统一由腾讯首席AI科学家姚顺雨管理。此举旨在打通不同技术方向的研发链路,提升模型研发效率,集中资源探索全模态模型智能上限。腾讯混元以大语言模型为底座,已构建覆盖图像、视频、语音及3D生成的完整模型矩阵。合并后,团队将加速推进通用人工智能底层能力建设。

10:39

AMD公布AI/HPC路线图:CPU两年一代、GPU一年一代,2030年AI加速器市场将达1.4万亿美元

大模型之家讯 7月24日,AMD在Advancing AI 2026大会上公布AI/HPC芯片路线图:CPU遵循两年一代、GPU一年一代的节奏,2028年推出基于Zen 7的EPYC CPU,2030年推出Zen 8版Ravenna;GPU方面Instinct MI500系列明年问世,MI600系列2028年推出。苏姿丰预计到2030年数据中心AI加速器市场将达1.4万亿美元,年复合增长率45%。AMD同时宣布与Cerebras Systems合作推出结合Helios GPU机架与晶圆级芯片的AI推理方案,产品今年晚些时候上市,消息推动Cerebras股价盘中上涨11%。

10:33

微软发布MAI-Image-2.5-Pro和MAI-Voice-2-Flash两款自研AI模型

大模型之家讯 7月24日,微软推出两款自研AI模型——MAI-Image-2.5-Pro专注高精度图像生成与文字渲染,MAI-Voice-2-Flash针对高并发语音场景优化。两款模型均为自研产品而非蒸馏第三方,已进入公开预览并集成至Bing、PowerPoint、Dynamics 365等核心产品,在提升性能的同时大幅降低GPU成本。

10:30

OpenAI上线ChatGPT Health:接入苹果Health等数据,每周超3亿人询问健康问题

大模型之家讯 7月24日,OpenAI升级ChatGPT Health健康功能,支持接入苹果健康(Apple Health)及多家美国医院系统医疗记录,让ChatGPT分析用户健康状况。该功能面向美国18岁以上Free、Go、Plus和Pro计划用户,可总结自上次就诊以来的健康变化,识别睡眠、运动等日常数据,帮助用户理解医学术语并准备咨询医生的问题。OpenAI透露每周已有超过3亿人向ChatGPT咨询健康相关问题,并承诺已连接的数据不会用于训练基础模型或投放定向广告。

2026年7月23日 • 周四
11:48

阿里平头哥开源 AI 软件栈 SAIL,芯片累计出货 56 万片

大模型之家讯 7月23日,阿里平头哥在 WAIC 2026 上宣布开源自研 AI 软件栈 T-Head SAIL,覆盖驱动层、编程语言层、编译器层、高性能库及开发工具五层完整技术栈,全面兼容 PyTorch、TensorFlow、vLLM 等 260 余个主流框架即开即用,主流 AI 推理框架平均适配时间小于 7 天。截至今年 4 月,真武 AI 芯片累计出货 56 万片,服务 20 多个行业 400 余家客户。

11:46

科大讯飞发布星火 Token Factory,打造企业级 AI 模型智能路由与治理新底座

大模型之家讯 7月19日,科大讯飞正式推出星火 Token Factory,定位为企业级 AI 模型智能路由与治理平台。该平台基于 Prompt 长短、规则预置等多维度特征对任务进行智能分级,综合考虑质量、成本、延迟、可用性、安全五个因子匹配最优模型资源,决策延迟可控制在 100 毫秒以内。平台还提供推理引擎优化,相较开源框架推理效率提升约 5 倍,并内置三权分立安全体系与全链路审计日志。

11:44

OpenAI 推出企业软件 OpenAI Presence,布局企业赛道

大模型之家讯 7月22日,OpenAI 推出企业 AI 智能体管理平台 OpenAI Presence,旨在将 AI 与企业内部数据、业务流程无缝连接,自动化客户支持、销售等环节。该平台提供模拟测试、安全防护和效果评估工具。Presence 目前已用于 OpenAI 自身英语电话客服系统。此举标志着 OpenAI 从模型提供商向企业软件服务商的战略转型。与此同时,旗下智能体产品 Codex 和 ChatGPT Work 用户总数已破千万,较本月初几乎翻倍。

11:42

谷歌 Gemini 4 即将推出:公司史上最大规模模型训练启动

大模型之家讯 7月22日,谷歌 DeepMind 在发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型的同时,宣布已启动公司史上最大规模的预训练任务,目标直指下一代旗舰模型 Gemini 4。三款新模型均围绕 Agent 工作流优化:3.6 Flash 主打降低 Token 消耗,在 DeepSWE 测试中输出 Token 减少约 65%;3.5 Flash-Lite 每秒输出 350 Token,速度位列行业前茅。谷歌还计划于 2028 年部署 Frozen v2 芯片,将 Gemini 部分架构固化以提升推理能效 6 至 10 倍。

11:39

英伟达加速 AI 算力供应:Grace 芯片累计交付超 250 万颗

大模型之家讯 7月22日,英伟达宣布其首款数据中心自主架构 CPU Grace 芯片累计发货已超过 250 万颗。为应对 Agentic AI 带来的需求增长,英伟达正协同超过 300 家全球合作伙伴推进新一代 Vera CPU 的供应。硬件工程高级副总裁 Andrew Bell 表示,公司拥有约 12 家制造合作伙伴,有能力实现每日生产 1000 个 Vera 机架的产能目标,基于该产能估算,单季度收入潜力至少可达 6300 亿美元。Vera Rubin 机架作为”AI 工厂”的基础构建单元,专为大规模智能体 AI 负载设计。

2026年7月22日 • 周三
17:43

中国银联与15家商业银行推智能体银行卡,一键智能支付

大模型之家讯 7月20日,中国银联宣布推出智能体银行卡解决方案,携手平安、浦发、交通等15家商业银行推出AI智能体银行卡产品。该系列将大模型算力、智能体会员、AI办公工具纳入银行卡权益体系,持卡人可通过消费积累Token兑换算力与会员服务,航旅纵横、滴滴等为首批试点商户。银联同步推进支付能力向车载、AR/MR眼镜等泛终端延伸,标志着银行卡从支付工具向AI能力分发载体演进。

点击加载更多