摩尔线程交出上市后首份半年报:营收 17.36 亿元同比增 147%
大模型之家讯 近日,国产 GPU 第一股摩尔线程发布上市后首份半年报:2026 年上半年营业收入 17.36 亿元,同比增长 147.42%,仅用半年就超过 2025 年全年 15.06 亿元的营收规模。毛利总额 9.89 亿元,同比增长 103.78%,整体毛利率达 56.95%;归母净利润亏损 1156.31 万元,同比大幅收窄 2.59 亿元,收窄比例达 95.73%。
摩尔线程是国内唯一实现全功能 GPU 量产量销的企业。国产 GPU 发展经历了”能用”(2014-2022)、”好用”(2023-2025)到规模化商用的演进,华为昇腾 910、摩尔线程 MTT S5000、沐曦”曦云 C500″均为关键产品。财务数据背后,国产 GPU 正加速从技术突围走向生态构建与商业闭环。
Mistral AI 自家平台开放第三方模型接入:首个为智谱 GLM-5.2
大模型之家讯 8月11日,Mistral AI 宣布,作为其欧洲主权人工智能新举措的一部分,其平台将支持第三方开放模型,首款模型为智谱 GLM-5.2。第三方开放模型将与第一方模型运行在相同的基础设施、区域控制和服务承诺下,客户可在不分散 AI 运行位置的情况下扩展模型选择范围。
Mistral 同时宣布,用户现可选择在美国或欧洲区域执行 AI 推理负载,以满足数据跨境合规监管要求,并启动 Mistral 优先层级公开预览,为关键任务工作负载提供承诺的服务级别。此外,Mistral 还启动欧洲计算单元联盟计划,通过汇集多客户长期 AI 负载容量承诺,支持更大规模的欧洲算力基础设施建设。
腾讯微信公布 WeLM 模型:80B 版已上线小微,617B 版开发中
大模型之家讯 8月13日,腾讯微信团队在 X 平台公布自研大语言模型 WeLM,该模型以资源利用效率为核心。目前已明确两个规格:WeLM-80B(800 亿总参数、30 亿激活参数)和 WeLM-617B(6170 亿总参数、230 亿激活参数)。其中 WeLM-80B 已部署于微信原生 AI 助手小微,支持聊天与搜索、使用微信原生功能及调用小程序服务。
WeLM-617B 为混合专家模型(MoE),正在开发中,将在保持适度激活参数的前提下显著提升通用理解与逻辑推理能力,面向智能小程序开发、小微工具生成等微信生态内的复杂任务。腾讯总裁刘炽平此前表示,微信将成为以 AI 为先的生态系统。
阿里开放 Qwen3.8-2.4T-A95B 模型权重
大模型之家讯 8月12日深夜,阿里云魔搭 ModelScope 社区宣布,阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重,这是 Qwen-Max 级别模型首次开源权重。该模型总参数 2.4T,每个 Token 激活 95B 参数,原生支持 262,144 Token 上下文,可扩展至 1,010,000 Token;每个 MoE 层含 512 个专家,每 Token 选择 10 个路由专家并激活 1 个共享专家,并采用多步 MTP 训练支持多 Token 预测。
Qwen3.8 延续 Qwen3.5 混合架构,重点提升编程、办公、科研和长周期 Agent 任务的端到端完成能力。官方云端版 Qwen3.8-Max 基于该权重并加入更多生产环境能力,在编程 Agent、通用 Agent、专业工作与长上下文等评测中与 Opus 4.8、Fable 5、GPT 5.6 Sol 互有高低,并于 PaperBench、IFBench 等 Benchmark 中取得较高成绩。
深夜放大招!DeepSeek V4 Pro 正式版 API 更新上线
大模型之家讯 8月13日,DeepSeek V4 Pro 正式版发布并更新至 API,调用模型名不变(DeepSeek-V4-Pro-0813)。该模型总参数达 1.6 万亿,为混合专家(MoE)架构,每个 Token 仅激活 490 亿参数,拥有 100 万 Token 上下文窗口,支持最大 38.4 万 Token 输出。新版本重点增强 Agent 能力,全面支持 JSON 结构化输出、Tool Calls、Responses API 和 Anthropic API,可无缝接入 Codex。
在 DeepSeek 官方测评中,V4 Pro 多项测试成绩接近甚至超越 Claude Fable 5,与 Opus 4.8 相比不逊色,其中 Terminal Bench 2.1 得分 87.9,远超预览版的 72.1。定价为百万 tokens 输入(缓存命中)0.025 元、输入 3 元、输出 6 元。同一天,阿里 Qwen3.8-Max 正式开源、SpaceXAI 推出 Grok 4.6,模型之争转向性能、成本与生态的综合较量。
Manus宣布脱离Meta恢复独立运营,部分用户数据将被删除
大模型之家讯 8月11日,AI智能体公司Manus发布《致Manus用户的一封信》,宣布即将恢复以独立公司的形式运营,继续为全球数百万用户提供服务。Manus表示,此次调整是为遵守特定司法辖区的监管要求,并非因数据泄露或其他安全事件。部分用户在2025年12月29日(Meta完成对Manus收购当日)及之后产生的数据,将于2026年8月23日08:00起至8月24日期间被删除,受影响用户需在8月23日07:59前自行备份。恢复独立运营后,用户数据将存储于美国和新加坡。Manus透露,目前已在筹备一系列新功能,未来将继续开发通用AI智能体产品。
商汤日日新 SenseNova 6.8 Flash Lite 预览版上线:剑指”委派智能”
大模型之家讯 8月11日,商汤科技日日新 SenseNova 6.8 Flash Lite 预览版正式上线,主打轻量敏捷,定位”委派智能”场景。该版本在保持基础能力的同时强化了智能体任务执行效率,面向高频、低延迟的任务委派与自动化场景,为企业级 Agent 应用提供更轻量的模型底座。商汤表示,随着智能体从”聊天问答”走向”任务委派”,模型在意图理解、工具调用与结果校验上的能力权重显著提升。
蚂蚁百灵开源 Ling-3.0-tiny:支持英伟达 DGX Spark 与 Mac mini 部署
大模型之家讯 8月11日,蚂蚁百灵大模型开源一款轻量级混合推理 MoE 模型 Ling-3.0-tiny,支持英伟达 DGX Spark、MacBook、Mac mini 等设备本地部署。该模型在保持混合推理能力的同时大幅压缩参数规模,面向端侧与边缘场景,开发者可在消费级硬件上直接运行和微调。开源社区评价,Ling-3.0-tiny 为端侧 AI 应用提供了新的轻量选择。蚂蚁此举延续了其”模型开源 + 场景落地”战略,让国内开源模型生态在”轻量化、端侧可部署”维度进一步丰富。
腾讯 WorkBuddy 上线”多端同步”:打通手机和电脑
大模型之家讯 8月11日,腾讯 WorkBuddy 宣布支持”多端同步”功能,实现 PC、App、小程序三端的任务、对话记录与产物实时同步,并支持用户在手机上远程对电脑端任务进行授权与停止。此外,多端同步还支持”锁屏远程”能力,用户可在手机锁屏状态下查看和操控电脑端任务进度。分析认为,这标志着国产 AI 助手正从”单端工具”走向”跨端任务中枢”,远程授权与锁屏操控等能力则为 AI 智能体在真实办公流程中的无人值守运行打下基础。
智谱 ZCode 全面升级:Goal、Subagents 等四大功能上线,GLM Coding Plan 全员额度回满
大模型之家讯 8月11日,智谱宣布 ZCode 迎来重大升级,Goal、Subagents、Remote Control 与闲时任务四大功能正式上线。此次升级最重要的变化是让 Agent 能够自主跑完复杂任务:只要设定一个明确、可验收的目标,ZCode 会自动拆解任务、修改代码、运行命令和执行测试,再根据结果判断目标是否完成,未达标则进入下一轮迭代,每轮进度均在 Goal 面板中一目了然。作为百万用户里程碑回馈,智谱宣布 GLM Coding Plan 全体用户额度于当日 13:00 统一重置,全员额度全部回满。业内认为,”目标驱动”模式代表 AI 编程工具向”AI 自主闭环”演进的重要一步。