百度文心助手霸榜:SuperCLUE XClaw测评97.62分登顶国产第一,且完全免费
大模型之家讯 8月6日,SuperCLUE最新一期XClaw”龙虾”测评结果出炉。在十大国产”龙虾”产品的同台比拼中,百度文心助手以97.62分登顶国产第一:其中”记忆”一项斩获满分100分,数据处理98.86分、内容创作99.44分、研究分析96.44分,均位列榜首。而就在7月20日,文心助手已凭借94.6%的成绩问鼎权威PinchBench v2榜单世界第一。不到二十天,文心助手接连拿下国内外两大”硬核第一”。更值得注意的是,这款顶尖产品至今完全免费、不限量。SuperCLUE的XClaw基准围绕数据处理、内容创作、记忆、代码、研究分析五大维度评测,被视为中文大模型能力的”晴雨表”。文心助手”免费称王”的打法,正对国内AI助手市场形成明显的降维冲击。
Meta推出首款编程AI智能体Muse Code,正面挑战Codex与Claude
大模型之家讯 8月6日,Meta正式发布首款AI编程智能体工具Muse Code,基于最新AI模型Muse Spark 1.2构建,定位为竞品低价替代方案。该工具与Anthropic的Claude和OpenAI的Codex类似,开发者可在单一界面构建应用,并管理大量支撑软件开发流程的AI智能体。Meta人工智能负责人Alexandr Wang称,用户”通过一条命令即可安装”,可用于规划变更、编写代码、验证结果等完整软件工程任务。Muse Code目前以测试版形式提供,采用按需付费模式,API定价每百万输入tokens 1.25美元、每百万输出tokens 4.25美元,明显低于Claude与Codex,被视为直接瞄准编程助手市场的价格战,有望进一步拉低开发者使用AI编程工具的门槛。
腾讯混元发布Hy ASR 3.0 preview,元宝首发上线
大模型之家讯 近日,腾讯混元发布语音识别模型Hy ASR 3.0 preview,已在元宝App首发上线。该模型主打让语音识别理解上下文,通过上下文感知能力提升复杂场景下的识别准确率,作为腾讯混元大模型家族的最新成员,聚焦语音交互场景,有望优化元宝App的语音输入与交互体验。同时,腾讯宣布Hy3模型限时免费活动再次延长至8月31日,WorkBuddy、CodeBuddy等产品持续以免费策略争夺开发者市场。
Liquid AI发布LFM2.5-2.6B端侧小模型,智能手机可本地运行
大模型之家讯 8月4日,人工智能初创企业Liquid AI发布LFM2.5-2.6B开源智能体模型。该模型仅26亿参数,适合智能手机等设备端本地部署,同时足以支持规划、调用、多步骤处理等智能体工作流。模型基于34T Token数据集预训练,并通过扩展现有分词器增强了对非拉丁字母语言的支持,已在Hugging Face平台提供基础与后训练两个版本。在与gemma-4-E2B-it、gemma-4-E4B-it、Qwen3.5-4B、Qwen3.5-9B等更大尺寸模型的基准测试中,LFM2.5-2.6B在所有指令执行项目及几乎所有工具使用项目中均领先,仅在BFCLv4测试中落后于Qwen3.5-9B;STEM领域于AA Omniscience测试中领先,编程是唯一更大模型仍保持优势的领域。
字节跳动发布原生音视频全双工大模型SeedRealtime,已上线豆包App
大模型之家讯 8月5日,字节跳动Seed团队正式发布原生音视频全双工大模型SeedRealtime,采用统一架构原生融合音频、视频与文本,实现边看、边听、边说的实时交互体验。该模型具备三大核心能力:音视频联合理解(结合场景消解同音词歧义、理解视觉时序指代)、主动交互(察觉画面变化时主动提醒并调用工具)、流畅交互节奏(实时感知对话状态,抗干扰防误触发)。端到端人工评测显示,相比级联模型,SeedRealtime的音视频对话节奏问题减少一半,单次对话完整顺畅交流的概率明显提升。目前该模型已在豆包App全量上线,系业界率先实现音视频全双工技术规模化落地。
面壁智能联合 OpenBMB 开源 ForgeStencil,一周自动优化 100+ 工业软件
大模型之家讯 8月4日,面壁智能联合 OpenBMB 开源全球首个 Stencil 模板计算优化”自动研究+自动部署”大闭环 AI 系统 ForgeStencil。该系统 1 周自动完成 100+ 真实工业和科学计算软件重构优化,全程无人类专家介入,覆盖油气勘探、计算流体力学、电磁仿真等 8 大工业领域及 5 大科学领域,端到端加速中位数达 1.41 倍。通用 CAE 求解器 hypre 加速 3.86 倍,电磁仿真 FDTD 加速 2.47 倍。过去 HPC 专家每人每年精调软件不超 20 个,ForgeStencil 相当于每年替代 4-8 名工程师、等效研发投入 300 万~1000 万元。
英伟达开源 Alpamayo 2 Super 并开放商用,助推自动驾驶多任务推理
大模型之家讯 8月4日,英伟达面向自动驾驶领域推出开源模型 Alpamayo 2 Super,现已开放商业使用。该模型采用 OpenMDW-1.1 宽松许可,覆盖微调、衍生模型与商业再分发,车企和供应商可基于自身数据改造部署。性能上,其在 LingoQA 自动驾驶推理基准排名第一,Lingo-Judge 测试中领先 Qwen2.5-VL 72B 达 17.0 分、领先 Gemini 2.5 Pro 15.1 分。模型基于 Cosmos 3 Super Reasoner 构建并经强化学习后训练,可处理复杂路况的场景理解、因果推理与安全路径决策。Alpamayo 1.5 与 1 则提供更低成本选项。
京东开源自研实时流式视频编辑模型 JoyAI-Video-Edit,支持”边播边改”
大模型之家讯 8月5日,京东开源自研实时流式视频编辑模型 JoyAI-Video-Edit,用户可一边观看视频一边修改人物与场景,让视频创作从”先有素材再修改”变为实时互动编辑。该模型基于全自研 JoyAI-Video 底座,720P 下每秒 30 帧推理,支持任意时长稳定流式编辑,可实时修改场景、替换物体、调整人物形象或改变风格。对比 SANA Streaming、LiveEdit 等国际代表模型,其在 OpenVE-Bench 通用评测中全面领先。该模型还可将人手操作视频转化为机械臂操作素材,为具身智能数据合成提供新路径。开源代码已发布至 Hugging Face 与 GitHub。
SpaceX 携手英伟达打造 Starmind AI1 算力卫星,目标布局百万颗太空算力网络
大模型之家讯 8月5日,SpaceX在2026年第二季度财报电话会议上宣布,携手英伟达共同开发名为Starmind AI1的算力卫星,探索将AI算力部署至地球之外。SpaceX设想构建一个最终规模可达100万颗卫星的轨道网络,在太空打造分布式人工智能超级计算机,并依靠激光链路实现卫星间高速数据传输。英伟达同步确认合作,称”AI基础设施的下一个篇章,正迈向AI计算从未涉足的疆域”。马斯克表示,该计划将在地面和太空部署英伟达Vera Rubin NVL72机架式系统,并称”Vera Rubin架构是目前最好的AI计算机,只与英伟达合作”。每颗卫星搭载Rubin GPU与Vera CPU,具备数据中心级太空计算能力。财报显示,SpaceX本季度营收78亿美元,同比增长92%,净亏损收窄至5.41亿美元。
智元机器人回应首席科学家「离职」传闻:暂未离职,内部岗位调整
大模型之家讯 8月3日,市场传闻智元机器人首席科学家罗剑岚已于近期离职,且其名字从公司官网名单消失。对此,智元官方回应称:「暂未离职,内部岗位调整。」同日,智元官网同步公开合伙人团队完整名单,团队由多位来自华为、谷歌、腾讯、大疆、寒武纪等科技企业人士组成,背景横跨AI技术研发、产品工程、全球商业化及政企关系等领域。此前罗剑岚于2025年4月加盟智元,曾牵头组建智元具身智能研究中心,主导开源AgiBot World真机数据集、τ0-WM世界模型等核心成果。当前正值智元赴港IPO的关键窗口期,首席科学家的岗位变动引发市场关注。业内人士分析,智元在冲刺上市前调整核心岗位,既可能是上市合规需要,也可能反映公司战略重心从技术研发向商业化交付倾斜,后续需观察其技术叙事是否随之调整。