昨天 • 2026年7月23日 • 周四
11:48

阿里平头哥开源 AI 软件栈 SAIL,芯片累计出货 56 万片

大模型之家讯 7月23日,阿里平头哥在 WAIC 2026 上宣布开源自研 AI 软件栈 T-Head SAIL,覆盖驱动层、编程语言层、编译器层、高性能库及开发工具五层完整技术栈,全面兼容 PyTorch、TensorFlow、vLLM 等 260 余个主流框架即开即用,主流 AI 推理框架平均适配时间小于 7 天。截至今年 4 月,真武 AI 芯片累计出货 56 万片,服务 20 多个行业 400 余家客户。

11:46

科大讯飞发布星火 Token Factory,打造企业级 AI 模型智能路由与治理新底座

大模型之家讯 7月19日,科大讯飞正式推出星火 Token Factory,定位为企业级 AI 模型智能路由与治理平台。该平台基于 Prompt 长短、规则预置等多维度特征对任务进行智能分级,综合考虑质量、成本、延迟、可用性、安全五个因子匹配最优模型资源,决策延迟可控制在 100 毫秒以内。平台还提供推理引擎优化,相较开源框架推理效率提升约 5 倍,并内置三权分立安全体系与全链路审计日志。

11:44

OpenAI 推出企业软件 OpenAI Presence,布局企业赛道

大模型之家讯 7月22日,OpenAI 推出企业 AI 智能体管理平台 OpenAI Presence,旨在将 AI 与企业内部数据、业务流程无缝连接,自动化客户支持、销售等环节。该平台提供模拟测试、安全防护和效果评估工具。Presence 目前已用于 OpenAI 自身英语电话客服系统。此举标志着 OpenAI 从模型提供商向企业软件服务商的战略转型。与此同时,旗下智能体产品 Codex 和 ChatGPT Work 用户总数已破千万,较本月初几乎翻倍。

11:42

谷歌 Gemini 4 即将推出:公司史上最大规模模型训练启动

大模型之家讯 7月22日,谷歌 DeepMind 在发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型的同时,宣布已启动公司史上最大规模的预训练任务,目标直指下一代旗舰模型 Gemini 4。三款新模型均围绕 Agent 工作流优化:3.6 Flash 主打降低 Token 消耗,在 DeepSWE 测试中输出 Token 减少约 65%;3.5 Flash-Lite 每秒输出 350 Token,速度位列行业前茅。谷歌还计划于 2028 年部署 Frozen v2 芯片,将 Gemini 部分架构固化以提升推理能效 6 至 10 倍。

11:39

英伟达加速 AI 算力供应:Grace 芯片累计交付超 250 万颗

大模型之家讯 7月22日,英伟达宣布其首款数据中心自主架构 CPU Grace 芯片累计发货已超过 250 万颗。为应对 Agentic AI 带来的需求增长,英伟达正协同超过 300 家全球合作伙伴推进新一代 Vera CPU 的供应。硬件工程高级副总裁 Andrew Bell 表示,公司拥有约 12 家制造合作伙伴,有能力实现每日生产 1000 个 Vera 机架的产能目标,基于该产能估算,单季度收入潜力至少可达 6300 亿美元。Vera Rubin 机架作为”AI 工厂”的基础构建单元,专为大规模智能体 AI 负载设计。

2026年7月22日 • 周三
17:43

中国银联与15家商业银行推智能体银行卡,一键智能支付

大模型之家讯 7月20日,中国银联宣布推出智能体银行卡解决方案,携手平安、浦发、交通等15家商业银行推出AI智能体银行卡产品。该系列将大模型算力、智能体会员、AI办公工具纳入银行卡权益体系,持卡人可通过消费积累Token兑换算力与会员服务,航旅纵横、滴滴等为首批试点商户。银联同步推进支付能力向车载、AR/MR眼镜等泛终端延伸,标志着银行卡从支付工具向AI能力分发载体演进。

11:02

清程极智发布Token”前店后厂”架构,跑DeepSeek成本暴降75%

大模型之家讯 7月22日,WAIC 2026期间,清程极智发布Token”前店后厂”三层全链路架构,通过自研赤兔推理引擎从零为国产显卡深度定制优化。在生产层支持FP4格式后,使用DeepSeek等模型时原本需4台机器的显存现仅需1台即可,成本暴降75%。该架构还包括AI Ping服务平台和Agent Store终端,打通了Token从生产、流通到消费的全链路闭环。清程极智孵化自清华大学计算机系高性能所。

11:00

AI智能体互联国标试点在京启动,18家单位首批签约

大模型之家讯 7月21日,《人工智能 智能体互联》系列标准应用推进专题会议在北京召开,国内首个覆盖智能体全生命周期的互联标准体系正式进入试点应用阶段。该标准覆盖身份码、智能体发现、交互及工具调用等核心环节。会议同步发布AIP互联协议V2.1开源代码。美团、智谱华章、滴滴、联想、用友等18家单位首批签约。

10:58

小红书大模型dots-note-3.0 IMO满分夺金,中国大模型首次

大模型之家讯 7月22日,IMO 2026成绩出炉,小红书大模型dots-note-3.0六道题全部答对,以满分42分斩获金牌,成为中国首个获得IMO官方金牌水平认证的大模型,也是继谷歌Gemini之后全球第二个达此成绩的模型。模型仅用自然语言完成从读题到证明的全过程,在第三题独创归纳解法,被双CMO金牌得主评价为漂亮且优雅。小红书宣布该模型即将开源。

10:57

谷歌连发三款 Gemini 新模型:3.6 Flash、3.5 Flash Cyber

大模型之家讯 7月21日,谷歌发布三款新AI模型,包括性能更强的Gemini 3.6 Flash、专攻网络安全的3.5 Flash Cyber,以及面向智能体场景的3.5 Flash-Lite。新模型完成相同任务所需Token减少17%,使用成本更低。其中3.5 Flash Cyber在测试中对V8引擎发现55个问题,含10个此前其他AI模型未曾发现的漏洞,将仅向政府及可信合作伙伴开放。但旗舰级Gemini 3.5 Pro第三次延期,仍未公布发布时间。谷歌透露已开始对Gemini 4进行预训练。

点击加载更多