Meta将把AI代理Muse接入AI眼镜
大模型之家讯 10月1日,Meta表示,未来几个月将把个人AI代理Muse接入AI眼镜。用户可通过语音直接唤醒Muse,并让其根据自己正在查看的内容执行任务。Meta称,Muse能够理解用户当前关注的商品、传单或物品清单等内容,并据此代为采取相应操作。Meta此前于9月推出Muse,并计划进一步将其扩展至AI眼镜等设备,此举显示Meta正加快推动AI代理从手机等平台向可穿戴硬件的融合。
Kimi K3 自己写“超级算子”,推理提速3倍以上
大模型之家讯 近日,vLLM原班人马创办的Inferact开源一套TPU巨型算子(Megakernels),将Kimi K3的92个MoE层写进同一程序,在16颗谷歌TPU v7上运行:开启投机解码时单用户输出速度达709 tokens/s,同样16块英伟达GB200用vLLM为452 tokens/s;关闭投机解码后在1至8并发下均为GB200的1.4至2倍。TPU v7纸面显存带宽(7380GB/s)低于GB200(8000GB/s),提速来自算子融合而非硬件。同一周,浪潮信息在AICC 2026发布元脑SD200 Ultra超节点AI服务器,用128颗本土AI芯片单机运行Kimi K3,Token生成时延压到5.85毫秒,单用户吞吐突破170 tokens/s。其“超级算子”有相当一部分由K3自己编写,在“生成—验证—测量—迭代”闭环中迭代,最终综合推理效能提升3倍以上。
曝腾讯租用甲骨文东南亚数据中心,涉及约10万块AI芯片
大模型之家讯 10月1日,据《金融时报》报道,腾讯已与甲骨文签署其最大海外租赁协议,在东南亚多个甲骨文数据中心获取约10万块先进AI芯片,双方均未回应置评请求。知情人士称,这份五年期租赁交易估值约70亿美元(约合人民币470.18亿元),首付约30%,腾讯计划将算力用于推进AI模型和智能体工具开发。报道称,字节跳动和阿里巴巴仍是东南亚数据中心最大客户。此类租赁在美国规则下被允许,也可能提供英伟达在中国无法获取的先进芯片。数据显示,腾讯第二季度资本支出同比增176%至530亿元人民币,主要用于AI基础设施和算力资源预付款。
谷歌发布Gemini 4 Argon:登顶多榜单,单题成本最低1.99美元
大模型之家讯 10月1日,谷歌发布新一代旗舰模型 Gemini 4 Argon。其在长期软件工程评测 DeepSWE v1.1 上取得 77.9%,高于 Claude Opus 5.5 的 74.2% 与 GPT-6 Astra 的 74.1%;漏洞修复 CWE-bench v1 拿到 68%、与 Astra 并列第一,并以 68.90% 登顶 Vals Index。价格上,每百万输入 token 2 美元(人民币约 13.4 元)、输出 10 美元(人民币约 67.2 元),单项任务成本最低 1.99 美元(人民币约 13.4 元),约为 Astra 的一半。Argon 仅通过 Fairwind 计划向经审核的网络安全防御方开放;皮查伊与哈萨比斯公开站台,但彭博社援引谷歌员工称其实际编程表现不及跑分、存在刷榜嫌疑,谷歌回应称相关说法不准确。
GPT-6.1 Sol发布:性能逼近GPT-6 Astra,价格仅五分之一
大模型之家讯 10月1日,OpenAI 在 DevDay 发布下一代旗舰模型 GPT-6.1 Sol,官方称“以五分之一的价格获得接近 Astra 的智能水平”。其 API 定价为输入每百万 token 2 美元(人民币约 13.4 元)、输出 10 美元(人民币约 67.2 元),仅为 GPT-6 Astra 的 20%,缓存读取价 0.10 美元、便宜 95%;即日起可在 ChatGPT 工作区与 Codex 使用。性能上,它在软件工程评测 DeepSWE v1.1 上以五分之一成本打平 Astra,专业办公 AutomationBench 比 Claude Opus 5.5 高 2.2 分而成本仅三分之一。45 页系统卡显示,其思维链指令遵循成功率达 44.8%,上一代仅 16.1%;AA Intelligence Index 得 52 分,距 Astra 的 53 分仅差 1 分。
OpenAI DevDay 20项发布:常驻智能体dots正式上岗,新增500美元Pro 500套餐
大模型之家讯 10月1日,OpenAI 在 DevDay 2026 开发者大会抛出 20 项发布,核心是首个 7×24 小时常驻智能体 dots:由 GPT-6 Astra 驱动,自带云端电脑与浏览器,打通 4000 余款工具,关屏后仍在后台执行任务,Pro 及以上用户即日起可创建。奥特曼称:“你不是在用一个工具,你是在建立一个团队。”大会重启 200 美元(人民币约 1343 元)的 Pro 订阅,新增 500 美元(人民币约 3358 元)的 Pro 500 套餐,用量为 ChatGPT Plus 的 25 倍且无 5 小时限制;另发布协作空间 ChatGPT Space,Codex 上云。OpenAI 称 Responses API 流量同比增 100 倍,要把 ChatGPT 从“问答入口”变成“干活入口”,加码个人智能体入口竞争。
Amazon Bedrock AgentCore在亚马逊云科技中国区域正式可用
大模型之家讯 9月29日,亚马逊云科技宣布Amazon Bedrock AgentCore现已在由光环新网运营的中国(北京)区域和由西云数据运营的中国(宁夏)区域正式可用,助力企业加速AI Agent规模化部署。
作为全托管的AI Agent部署与运维平台,AgentCore以Serverless架构贯穿构建、部署到运维全流程,兼容任意大模型与框架,可按业务流量实现从零到数十万并发会话的弹性扩缩容,并通过硬件级虚拟化隔离提供全方位安全防护。其核心能力涵盖Runtime、Gateway、Identity等,可赋能数字员工、内容生产、智能客服、智能家居、汽车等行业场景,助客户就近构建Agent、降低延迟。
360图龙锋再曝Codex 0day:启动同步链路绕过审批闸门,全球2500万用户受影响
大模型之家讯 9月29日,中国AI安全攻防系统360图龙锋披露,OpenAI Codex再曝全新0day漏洞,与curated Git插件同步机制有关,是继8月6个高价值漏洞后的全新攻击路径。该漏洞可绕过Codex安全闸门,让危险操作在用户点击”是否允许执行”前就已发生,启动同步也不在沙箱内。攻击推演显示,开发者用Codex打开恶意开源组件的瞬间,攻击命令即静默执行,窃取GitHub Token、CI/CD密钥等,进而把带毒代码混入正式版本,经官方更新通道感染终端用户。Codex安全防线半年内被层层拆穿:5月Pwn2Own Berlin赛事三天产生47个零日漏洞,9月又曝出四大AI编程工具共享的Plugin4Shell零点击缺陷。
豆包将推个人助理产品:4月已内测,曾用代号”Spell”
大模型之家讯 9月29日,新浪科技获悉,豆包正在个人助理方向推进产品规划:今年4月内部已开始内测探索产品,代号”Spell”,由豆包手机助手团队主导,因豆包手机发布等原因一直未正式对外。在Meta Muse、Instinct等海外个人助理产品获得关注后,豆包正加速personal agent能力的对外发布,计划将Spell与豆包产品更深度结合,新产品由Spell项目与豆包对话团队共同负责,预期较快推出。Spell可视为豆包手机助手积累的personal agent能力向独立应用形态的延伸,这是字节跳动对海外个人Agent热潮的直接回应,国内个人Agent市场即将迎来大厂正规军入场。
Manus 2.0突然发布:自研Cascade框架省32%成本,还推出Agent群聊应用Cue
大模型之家讯 9月28日,明星Agent公司蝴蝶效应推出Manus 2.0及多Agent群聊应用Cue,为Manus恢复独立运营以来首次大版本更新,且为海外版。Manus 2.0采用自研Cascade框架,官方测试显示Token消耗减少23.2%、任务完成时间缩短28.2%、运行成本降低32%,新增云电脑、自动化触发和一句话远程操控电脑,并推出视频编辑器与游戏开发环境。Cue中每个Agent拥有专属邮箱、电话、钱包与独立电脑环境,可互相通信、在预算内支付、代接来电,用户可组建Agent团队分工协作。面对国内大厂与Meta Muse的夹击,Manus 2.0选择向重执行方向突围。