蚂蚁百灵开源 Ling-3.0 tiny / flash Base 模型,同步开放 6 个训练关键节点
大模型之家讯 8月21日,蚂蚁百灵宣布将 Ling-3.0-tiny-base 与 Ling-3.0-flash-base 正式开源,除最终 Base checkpoint 外,还将同步开放预训练和中期训练的权重 checkpoint,共计 6 个 checkpoints。官方表示,这些 checkpoints 适合用于持续预训练、领域监督微调、偏好优化、强化学习后训练、蒸馏,以及长上下文和 MoE 系统研究。在训练方法上,蚂蚁百灵在中期训练结束后将传统学习率衰减改写为 checkpoints 加权合并,即 WSM(Warmup-Stable and Merge)。其中,Ling-3.0-tiny-base 总参数 7.9B、激活参数 1.3B,以相比前代约 50% 的总参数量,在大多数评测中取得更高结果。
谷歌开源模型家族 Gemma 下载量破 10 亿次,”Gemmaverse”生态成型
大模型之家讯 8月20日,谷歌宣布其开源端侧模型家族 Gemma 的总下载量已突破 10 亿次;过去两年间,开发者基于 Gemma 发布了超过 10 万个模型变体,构成了一个被谷歌称为”Gemmaverse”的创新生态系统。谷歌列举了多个 Gemma 家族的实际应用场景:从太空本地图像分析、医疗报告标准数字化、癌症创新治疗方案,到动物语言识别,Gemma 家族模型正在多个领域切实提升人类发展质量。为支持这一生态,谷歌还将在 GitHub 上推出 Awesome Gemma 官方精选代码库,收录最佳社区项目、微调方案、教程和开发者工具。
Waymo 首曝 Robotaxi 计算系统,自研 5nm ASIC 算力超 1000 TOPS
大模型之家讯 8月20日,Alphabet 旗下自动驾驶出租车企业 Waymo 首次揭开了驱动其 Robotaxi 计算系统的技术细节。该计算系统拥有数据中心级别的性能,能应对车载运行环境的复杂性与实时性要求,其原始计算性能在 8 年间提升了 20 倍。系统由异构 CPU、GPU、加速器与先进机器学习技术有机结合而成,并结合超低延迟软件栈,最大程度缩短从首个像素到实际操作的端到端延迟。Waymo 同时公布了其自研的 5nm ASIC 芯片,该芯片专为实时处理、传感器数据融合和高级神经网络设计,可从激光雷达、摄像头等传感器产生的原始数据流中即时提取关键信息,并提供超过 1000 TOPS 的机器学习算力。
阿里云千问 AI 平台接入 GLM-5.3、DeepSeek-V4-Pro,MaaS 矩阵再扩容
大模型之家讯 8月21日,阿里云 MaaS 再次扩充模型服务矩阵,智谱最新旗舰模型 GLM-5.3 和 DeepSeek-V4-Pro 正式版已正式接入千问 AI 平台,相关 API 服务同步开放。其中,GLM-5.3 进一步强化了编程、长程任务处理和网络安全能力;DeepSeek-V4-Pro 则重点增强智能体能力,可覆盖代码开发、复杂任务处理等场景。至此,千问 AI 平台已陆续接入 Qwen3.8-Max、Qwen3.8 开源模型、Qwen Audio 3.0、Wan3.0、Kimi K3 等国内主流模型,全面覆盖文本、代码、语音、图像及视频生成。DeepSeek-V4-Pro、Qwen3.8-Max 等已开放 Token Plan 订阅。
商汤开源 8B 多模态大模型 SenseNova U1.5 Lite,原生支持 4K 高分辨率输出
大模型之家讯 8月21日,商汤科技宣布开源轻量级、原生统一多模态大模型 SenseNova U1.5 Lite。该模型原生支持3-4k上下文长度,可同时处理主体、数量、空间关系、文字、布局、风格等多重约束,显著提升复杂视觉任务的执行稳定性。在视觉生成方面,模型改善了整体构图、色彩、材质、光影和真实感,减少”局部正确但整体完成度不足”的问题;图像编辑方面,增强了主体身份、空间结构、版式关系及非编辑区域的保持能力;文字与复杂布局处理方面,加强了中英文文字、海报、信息图、品牌视觉及多文本排版能力。此外,模型还支持 Bounding Box、Visual Marker 及单图、多图参考等多种精细视觉控制方式,并具备原生 4K 高分辨率输出能力。
豆包工作任务模式上线”技能·连接器·工作伙伴”,协同 Agent 重塑复杂办公流程
大模型之家讯 8月21日,豆包官方宣布工作任务模式继续上新,”技能·连接器·工作伙伴/小队”现已正式上线。目前豆包内已上架超200个技能和连接器,并支持用户自定义新建技能,将常用工作步骤、交付标准和参考模板整理为可反复使用的标准化流程。接入连接器后,豆包可直接在常用工具中查找信息、处理任务;通过工作伙伴功能,用户可选择不同专业方向的 Agent,协同分析问题、拆解步骤并完成交付。技能、连接器和工作伙伴既可独立使用,也能灵活搭配,实现”技能记住工作方法、连接器快速获取信息、Agent 协同推进任务”的办公闭环。
Fable 5.1开启灰度测试,部分Claude用户已免费体验
大模型之家讯 8月20日,Anthropic旗下模型Fable 5.1被曝已进入小范围灰度测试,部分Claude用户已免费使用上该版本。据可靠消息,Fable 5.1延续每百万输入token 10美元、输出50美元的定价,大概率不会涨价,预计8月底前全量推送。此前Anthropic上周末发布报告称,内部已开发出比Mythos更强的Model 2,但不会对外发布。
极佳视界发布双足人形机器人Maker L01,最高速度4m/s
大模型之家讯 8月20日,极佳视界发布通用双足人形机器人Maker L01,全身搭载31个关节电机,支持奔跑、跳跃、空翻等动作,最高移动速度达4m/s。该机器人重42kg,配备518Wh热插拔电池,全栈开放,从科研到赛事开发均可开箱即用。极佳视界成立于2023年,曾获华为哈勃投资,专注世界模型驱动的物理世界通用智能。
北京人形机器人创新中心发布天工Omni,开放底座降低开发门槛
大模型之家讯 8月20日,2026世界机器人大会期间,北京人形机器人创新中心发布轻量化人形机器人天工Omni。该机器人身高1.35米、整机仅39公斤,是全球首个兼具感知移动与全身通用控制的Humanoid Native开放底座,面向狭窄空间、应急救援及家庭服务等场景。天工Omni开放关节、传感器、系统、运控API等全套二次开发体系,大幅降低开发者底层研发门槛,加速应用创新迭代。
MiniMax Design发布,H3多模态视频模型进入商业生产
大模型之家讯 8月20日,MiniMax推出多模态创作平台MiniMax Design,基于原生多模态视频模型H3,实现从需求理解、任务拆解到素材处理与交付的全流程自动化。该平台标志着AI视频生成技术正加速从实验阶段进入商业内容生产环节,大幅降低视频创作门槛。