Ilya 首个模型曝光:SSI 探索 TTT 小型推理引擎,最快本月露面
大模型之家讯 8月13日,据网友爆料,前 OpenAI 首席科学家 Ilya Sutskever 创办的 SSI 正在开发基于 TTT(测试时训练)的小型推理引擎,通过专门数据学习如何学习,并能在求解过程中动态更新权重,以较小规模挑战更大模型。爆料称,SSI 当前版本已准备就绪,下一代规模将扩大 10 倍,最快本月向少数用户开放。这是 Ilya 离职两年多来 SSI 首次曝光具体技术路线,被业内视为可能改变大模型竞争格局的信号。
DeepSeek Harness预览版上线:Agent能力全部做成插件
大模型之家讯 8月13日,DeepSeek宣布DeepSeek Harness开发者预览版(v0.1)正式面向全球开发者开放测试,并同步以MIT协议开源。该项目采用”一切皆插件”的插件式开放架构,模型、工具、技能、会话、沙箱、存储、调度及UI等Agent能力均可通过插件进行组合和替换,底层基于Cordis插件系统构建,开发者无需修改源码即可独立替换或扩展能力并在配置层组合。DeepSeek Harness目前提供标准、PTC、极简和创造四种运行模式,采用仅追加的会话日志设计,系统提示词、思维链、工具调用及结果、子Agent调度等运行信息均会写入日志,支持恢复、分叉、检索和回放。已安装Node.js开发工具链的用户可通过npx @deepseek-ai/dsh web启动Web UI。DeepSeek表示,v0.1仍属早期预览版本,核心插件与基础接口后续将继续迭代。
摩尔线程交出上市后首份半年报:营收 17.36 亿元同比增 147%
大模型之家讯 近日,国产 GPU 第一股摩尔线程发布上市后首份半年报:2026 年上半年营业收入 17.36 亿元,同比增长 147.42%,仅用半年就超过 2025 年全年 15.06 亿元的营收规模。毛利总额 9.89 亿元,同比增长 103.78%,整体毛利率达 56.95%;归母净利润亏损 1156.31 万元,同比大幅收窄 2.59 亿元,收窄比例达 95.73%。
摩尔线程是国内唯一实现全功能 GPU 量产量销的企业。国产 GPU 发展经历了”能用”(2014-2022)、”好用”(2023-2025)到规模化商用的演进,华为昇腾 910、摩尔线程 MTT S5000、沐曦”曦云 C500″均为关键产品。财务数据背后,国产 GPU 正加速从技术突围走向生态构建与商业闭环。
Mistral AI 自家平台开放第三方模型接入:首个为智谱 GLM-5.2
大模型之家讯 8月11日,Mistral AI 宣布,作为其欧洲主权人工智能新举措的一部分,其平台将支持第三方开放模型,首款模型为智谱 GLM-5.2。第三方开放模型将与第一方模型运行在相同的基础设施、区域控制和服务承诺下,客户可在不分散 AI 运行位置的情况下扩展模型选择范围。
Mistral 同时宣布,用户现可选择在美国或欧洲区域执行 AI 推理负载,以满足数据跨境合规监管要求,并启动 Mistral 优先层级公开预览,为关键任务工作负载提供承诺的服务级别。此外,Mistral 还启动欧洲计算单元联盟计划,通过汇集多客户长期 AI 负载容量承诺,支持更大规模的欧洲算力基础设施建设。
腾讯微信公布 WeLM 模型:80B 版已上线小微,617B 版开发中
大模型之家讯 8月13日,腾讯微信团队在 X 平台公布自研大语言模型 WeLM,该模型以资源利用效率为核心。目前已明确两个规格:WeLM-80B(800 亿总参数、30 亿激活参数)和 WeLM-617B(6170 亿总参数、230 亿激活参数)。其中 WeLM-80B 已部署于微信原生 AI 助手小微,支持聊天与搜索、使用微信原生功能及调用小程序服务。
WeLM-617B 为混合专家模型(MoE),正在开发中,将在保持适度激活参数的前提下显著提升通用理解与逻辑推理能力,面向智能小程序开发、小微工具生成等微信生态内的复杂任务。腾讯总裁刘炽平此前表示,微信将成为以 AI 为先的生态系统。
阿里开放 Qwen3.8-2.4T-A95B 模型权重
大模型之家讯 8月12日深夜,阿里云魔搭 ModelScope 社区宣布,阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重,这是 Qwen-Max 级别模型首次开源权重。该模型总参数 2.4T,每个 Token 激活 95B 参数,原生支持 262,144 Token 上下文,可扩展至 1,010,000 Token;每个 MoE 层含 512 个专家,每 Token 选择 10 个路由专家并激活 1 个共享专家,并采用多步 MTP 训练支持多 Token 预测。
Qwen3.8 延续 Qwen3.5 混合架构,重点提升编程、办公、科研和长周期 Agent 任务的端到端完成能力。官方云端版 Qwen3.8-Max 基于该权重并加入更多生产环境能力,在编程 Agent、通用 Agent、专业工作与长上下文等评测中与 Opus 4.8、Fable 5、GPT 5.6 Sol 互有高低,并于 PaperBench、IFBench 等 Benchmark 中取得较高成绩。
深夜放大招!DeepSeek V4 Pro 正式版 API 更新上线
大模型之家讯 8月13日,DeepSeek V4 Pro 正式版发布并更新至 API,调用模型名不变(DeepSeek-V4-Pro-0813)。该模型总参数达 1.6 万亿,为混合专家(MoE)架构,每个 Token 仅激活 490 亿参数,拥有 100 万 Token 上下文窗口,支持最大 38.4 万 Token 输出。新版本重点增强 Agent 能力,全面支持 JSON 结构化输出、Tool Calls、Responses API 和 Anthropic API,可无缝接入 Codex。
在 DeepSeek 官方测评中,V4 Pro 多项测试成绩接近甚至超越 Claude Fable 5,与 Opus 4.8 相比不逊色,其中 Terminal Bench 2.1 得分 87.9,远超预览版的 72.1。定价为百万 tokens 输入(缓存命中)0.025 元、输入 3 元、输出 6 元。同一天,阿里 Qwen3.8-Max 正式开源、SpaceXAI 推出 Grok 4.6,模型之争转向性能、成本与生态的综合较量。
Manus宣布脱离Meta恢复独立运营,部分用户数据将被删除
大模型之家讯 8月11日,AI智能体公司Manus发布《致Manus用户的一封信》,宣布即将恢复以独立公司的形式运营,继续为全球数百万用户提供服务。Manus表示,此次调整是为遵守特定司法辖区的监管要求,并非因数据泄露或其他安全事件。部分用户在2025年12月29日(Meta完成对Manus收购当日)及之后产生的数据,将于2026年8月23日08:00起至8月24日期间被删除,受影响用户需在8月23日07:59前自行备份。恢复独立运营后,用户数据将存储于美国和新加坡。Manus透露,目前已在筹备一系列新功能,未来将继续开发通用AI智能体产品。
商汤日日新 SenseNova 6.8 Flash Lite 预览版上线:剑指”委派智能”
大模型之家讯 8月11日,商汤科技日日新 SenseNova 6.8 Flash Lite 预览版正式上线,主打轻量敏捷,定位”委派智能”场景。该版本在保持基础能力的同时强化了智能体任务执行效率,面向高频、低延迟的任务委派与自动化场景,为企业级 Agent 应用提供更轻量的模型底座。商汤表示,随着智能体从”聊天问答”走向”任务委派”,模型在意图理解、工具调用与结果校验上的能力权重显著提升。
蚂蚁百灵开源 Ling-3.0-tiny:支持英伟达 DGX Spark 与 Mac mini 部署
大模型之家讯 8月11日,蚂蚁百灵大模型开源一款轻量级混合推理 MoE 模型 Ling-3.0-tiny,支持英伟达 DGX Spark、MacBook、Mac mini 等设备本地部署。该模型在保持混合推理能力的同时大幅压缩参数规模,面向端侧与边缘场景,开发者可在消费级硬件上直接运行和微调。开源社区评价,Ling-3.0-tiny 为端侧 AI 应用提供了新的轻量选择。蚂蚁此举延续了其”模型开源 + 场景落地”战略,让国内开源模型生态在”轻量化、端侧可部署”维度进一步丰富。