平头哥公布CPU规划,将推倚天720、倚天730和倚天750三代芯片
大模型之家讯 9月22日,在2026杭州云栖大会上,平头哥公布倚天服务器CPU的规划,2027年将推出倚天720和倚天730两代服务器CPU,单核新能持续提升。未来,平头哥还将继续推出基于第二代自研核的倚天750,该芯片支持平头哥自研ICN片间互联总线协议,可与真武AI芯片通过ICN总线直接互联,进一步提升CPU与AI芯片的协同效率,满足Agentic时代的算力需求。
宇树科技发布 Dex5-S 灵巧手,22 自由度、39900 元起
大模型之家讯 9月22日,宇树科技发布全新 Dex5-S 灵巧手。每只手拥有 22 个自由度,按人手 1:1 尺寸设计,起步价 39900 元,Dex5-S Pro 版本同步推出。产品尺寸 102×187×26mm,重 620g,采用铝合金外壳;拇指与小指各 5 个自由度,食指、中指、无名指各 4 个,小指新增 Roll 自由度。Dex5-S 配备 22 个电机,全部支持直驱与反驱,采用双编码器控制,单手握力 1kg、最大负载 2kg,峰值功率 200W。该产品支持 15V 至 65V 宽压供电,配备千兆以太网、USB 与高速 485 三种通信接口。
上海 AI Lab 联合上海交大提出 NCP 预训练新范式,8.9B 隐空间模型半量 Token 追平同类
大模型之家讯 9月22日,上海人工智能实验室与上海交通大学人工智能学院 LUMIA 实验室团队提出新的预训练任务\u201c下一概念预测\u201d(NCP),并发布全球首个 8.9B 规模离散隐空间基座模型 NCP-ArchPreview。该模型在 5.73T Dolma-3 数据上预训练,仅使用 51.3% 的 Token 预算即追平 OLMo-3-7B 的最终预训练 Loss,收敛速度提升 1.95 倍、计算帕累托效率提升 1.74 倍;下游任务平均超出 2.45 分,GSM8K 数学推理提升近 6 分。团队还发现,仅微调 17M 隐空间参数即可超越 LoRA,且无灾难性遗忘,训练吞吐提升同时显存占用下降。
马斯克 SpaceXAI 发布最强编码与知识处理模型 Grok 4.7,百万词元输入 2 美元起
大模型之家讯 9月22日,SpaceXAI 宣布推出新一代 Grok 4.7,主打编程和知识工作场景。官方称其采用全新更大规模基础模型,并通过更长时间强化学习提升复杂任务处理能力,速度是同类模型的两倍、价格只有一半,且能在困难任务上持续更久、强化自我检查。价格方面,每百万词元输入起价 2 美元(约合人民币 13.4 元),输出起价 6 美元(约合人民币 40.2 元),另提供速度与价格均翻倍的高速版本。安全层面,该模型在 HackerBench v0.3 测试中仅放行 3.3% 的高风险双重用途提示,LatchBio 生物安全基准取得 62.4%。目前 Grok 4.7 已通过 Cursor、Grok Build 提供,并开放 Grok API。
德州仪器发布全栈嵌入式边缘 AI 方案,TinyEngine NPU 使推理延迟降低 90 倍
大模型之家讯 9月22日,德州仪器(TI)发布面向边缘 AI 的全栈嵌入式方案。TI MSP 微控制器业务总经理 Vinay Agarwal 指出,边缘 AI 落地面临两大挑战:网络安全与数据隐私(防范逆向工程、模型盗取、恶意代码注入),以及跨节点可扩展性(不同边缘节点对算力、能效、成本要求天差地别)。核心创新 TinyEngine NPU 为独家专有独立解耦 NPU 加速器,计算单元与 CPU 内核分离,执行推理时无需唤醒主 CPU,相比未配加速器的 MCU 将推理延迟降低最高 90 倍、能耗降低超 120 倍;模型直接装载于加速器,形成硬件隔离屏障。硬件覆盖 MSPM0G5187、AM13E23019(BOM 成本最高降 30%)与 AM62A/AM67A/AM68A/AM69A 系列。落地:穿戴医疗心电图延迟降低 10 倍;智能楼宇基于单个 PIR 传感器结合 MCU 端边缘 AI,多运动源识别准确率超 98%。
浪潮元脑 SD200 Ultra 超节点发布:单机承载 2.8 万亿参数 Kimi K3
大模型之家讯 9月21日,浪潮信息在 2026 人工智能计算大会(AICC2026)推出元脑 SD200 Ultra 超节点与 HC2000 多元算力机组。SD200 Ultra 基于国产 AI 芯片,单机可承载 2.8 万亿参数 Kimi K3,Token 时延降至 5.85 毫秒以内,相当于单用户 170 Tokens/s,达业界平均 5 倍,支持 10 万亿参数模型单机运行。采用 3D Hyper Mesh 架构,紧耦合 128 芯本土 AI 芯片,提供 8TB 统一编址显存与 64TB 内存,通信时延 0.69 微秒;首次实现本土 AI 芯片 GPU 显存直连,AllReduce 通信时间降低 3.5 倍;融合 KDA、Gated MLA、MoE 算子后算子数量降低 10 倍,推理性能提升 3 倍以上。HC2000 机组采用 DirectCom 2.0 架构与高密液冷整机柜,搭配 MCIS 软件栈,同等投资下 Token 产能提升 10 倍。浪潮称前沿模型参数已从 DeepSeek R1 的 6710 亿增至 Kimi K3 的 2.8 万亿。
小米 MiMo-V2.6 开源:Pro 版 AA 指数登顶开源榜首,价格仅海外 1/20
大模型之家讯 9月22日,小米发布并开源 MiMo-V2.6 系列,含 Pro 与 Flash 两个原生全模态模型,是探索 RSI 关键一步。得益于 RL 算力扩展,Pro 版在 AA 综合智能指数 v4.3.2 取得 46 分,超越 Kimi K3 与 GLM-5.3,成为 AA 指数排名最高的开源权重模型,较前代高出 20 分;仍低于 Claude Fable 5.1、GPT-6 Astra 等闭源模型(均 53 分)。Pro 与 Flash 训练各 30 步、不到 6 天,成本约 262 万美元(约人民币 1880 万元)与 85 万美元(约人民币 600 万元),支持 100 万上下文;DeepSWE v1.1 基准分别提升约 17 分与 14 分。模型融合 3D 空间推理、多模态感知与计算机操作,可视觉闭环控制机械臂完成抓取;科研端在 Lean 4 完成《周期三蕴含混沌》主定理形式化,6000 余行源码通过核验。API 定价:Flash 输入 1 元/输出 2 元、Pro 输入 3 元/输出 6 元,仅为海外模型 1/20 至 1/60。
Anthropic据悉考虑在IPO前发布新AI模型
大模型之家讯 9月20日,据报道Anthropic正考虑推出新AI模型,以应对OpenAI GPT-6 Astra的势头。此举发生在公司筹备IPO期间,原计划10月中旬启动路演,现可能推迟至11月中期选举结束后。公司正评估新模型安全性并据此研议是否推出产品。公司内部也在讨论如何在投入新模型的同时强化获利能力。Ramp数据显示,GPT-6 Astra占企业AI支出13%,Claude Fable约占8%。部分投资者正重新评估Anthropic作为企业级AI工具领先提供商的地位。
OpenAI预计到2030年累计”烧钱”近2800亿美元
大模型之家讯 9月20日,OpenAI内部演示文件显示,公司预计到2030年底累计产生2780亿美元负自由现金流。尽管年收入预计从2026年的360亿美元飙升至2030年的3500亿美元,五年累计营收8400亿美元,仍无法覆盖开支。算力和基础设施累计支出将达8560亿美元,为最大单项支出。今年3月完成的1220亿美元融资按当前消耗节奏预计2028年耗尽。GPT-6 Astra等企业级AI产品快速扩张是主因,该模型占Ramp追踪的企业AI支出13%。
阿里达摩院开源全球首个专家级通用医疗影像 AI 模型 DAMO RADAR
大模型之家讯 9月18日,阿里达摩院与浙江大学医学院附属第一医院等机构研发的通用医疗影像 AI 模型 DAMO RADAR 登上国际顶刊《科学》(Science),并同步开源模型、代码与框架。该模型面向腹部增强 CT 诊断,可一次性识别超 146 种病症、覆盖 18 个器官,在近 4 万次真实世界检查中 AUC 达 0.913,成为首个达到专家水平的通用医学影像 AI 模型。技术上首次采用”器官级细粒度对齐”策略,将 CT 分解为解剖单元,在器官层面实现图像与报告文本精确对齐,无需额外人工标注。与 26 名来自多家医院的影像科医生对比,DAMO RADAR 平均准确率超过其中 23 名医生;AI 提示下医生识别疾病的敏感性提升 10%、用时减少 30% 以上。