我国发布大豆垂直大模型“丰菽”2.0
大模型之家讯 8月17日,在第32届全国大豆科研生产研讨会上,安徽农大王晓波教授团队发布大豆垂直大模型“丰菽”2.0。模型由安徽农大联合中国农科院构建,整合种质、基因组、文献等数据,新增多模型协同分析机制,可对各模型回答做共识与证据综合分析。其集成六大功能模块,融合 8000 份基因组重测序、约 4 万份种质资源与 3000 份以上表型数据,可辅助病害诊断、育种亲本筛选等。
美团王莆中谈 AI 落地四重错配,曾“养虾”日耗千万
大模型之家讯 8月17日,美团核心本地商业 CEO 王莆中在演讲中分享内部 AI 变革,指出现阶段仅少数企业能统计到可测量的 AI 收益,根源在四重错配:认知夸大或轻视、大模型只触日常事务、AI 游走边缘、考核追求立竿见影。他自曝 2-3 月全员“养虾运动”曾致账单暴涨、日耗上千万元。美团全场景 Agent 平台 CatPaw 已于7月上线,覆盖 9 万员工、搭建 Agent 3 万个。
智象未来发布交互式世界模型 HiDream-O1-World
大模型之家讯 8月17日,智象未来(HiDream.ai)发布原生全模态交互式世界模型 HiDream-O1-World,具备漫游、编辑、交互三大功能,支持文本、图像等多模态输入,可一键生成时空一致、符合物理规律、可长时推演的完整世界。该模型搭载自研原生全模态(UiT)架构。在美团 LongCat 与复旦联合推出的 WBench 评测中,以平均分 80.9 登顶 Navi 分榜榜首,物理维度 73.3 分第一,一致性维度达 88.0 分。
OpenAI 多智能体 v2 上线,超长对话加载提速 16 倍
大模型之家讯 8月17日,OpenAI 工程师宣布 GPT-5.6 多智能体 v2 全面上线,主 Agent 可自动将子任务委派给不同模型(含 Luna),每个子 Agent 可单独设推理强度。同期 ChatGPT 前端大改:内部以 741 轮、231MB 的“怪物级”对话测试,打开时间从 27.62 秒降至 1.66 秒,内存增长减半,网络请求从 894 次砍至 16 次。OpenAI 称其正从聊天工具向全自动工作流平台进化。
Codex GPT-5.6 Sol 百万上下文开放 ChatGPT 账号
大模型之家讯 8月17日,OpenAI 工程师 Tibo 在 X 平台宣布,Codex 中 GPT-5.6 Sol 模型的 100 万 Token 上下文窗口已支持通过 ChatGPT 账号使用,此前仅限 API 密钥。该模型官方文档显示支持约 105 万 Token。ChatGPT Plus、Pro 等订阅用户在用 Codex 时可手动启用近百万上下文,更适合大型代码库重构与长时间会话。Tibo 提醒,启用后订阅额度消耗会显著加快,建议仅在确有必要时开启。
DeepSeek API 峰谷定价今日生效,高峰时段价格最高涨 1100%
大模型之家讯 8月17日,DeepSeek 峰谷定价方案于北京时间今日零时起正式生效,DeepSeek-V4-Flash 与 V4-Pro 两款主力模型首次采用峰谷定价,闲时价格为高峰时段的一半。高峰时段为每日 9:00-12:00、14:00-18:00 共7小时,其余17小时为闲时。V4-Pro 高峰时段百万 tokens 缓存命中输入、未命中输入、输出分别为 0.3元、9元、27元;V4-Flash 对应为 0.1元、3元、9元。相较调价前,V4-Pro 高峰时段三项分别上涨 1100%、200%、350%。代码生成、批量处理等对延迟不敏感的任务可错峰调用以显著降本。
Ilya 首个模型曝光:SSI 探索 TTT 小型推理引擎,最快本月露面
大模型之家讯 8月13日,据网友爆料,前 OpenAI 首席科学家 Ilya Sutskever 创办的 SSI 正在开发基于 TTT(测试时训练)的小型推理引擎,通过专门数据学习如何学习,并能在求解过程中动态更新权重,以较小规模挑战更大模型。爆料称,SSI 当前版本已准备就绪,下一代规模将扩大 10 倍,最快本月向少数用户开放。这是 Ilya 离职两年多来 SSI 首次曝光具体技术路线,被业内视为可能改变大模型竞争格局的信号。
DeepSeek Harness预览版上线:Agent能力全部做成插件
大模型之家讯 8月13日,DeepSeek宣布DeepSeek Harness开发者预览版(v0.1)正式面向全球开发者开放测试,并同步以MIT协议开源。该项目采用”一切皆插件”的插件式开放架构,模型、工具、技能、会话、沙箱、存储、调度及UI等Agent能力均可通过插件进行组合和替换,底层基于Cordis插件系统构建,开发者无需修改源码即可独立替换或扩展能力并在配置层组合。DeepSeek Harness目前提供标准、PTC、极简和创造四种运行模式,采用仅追加的会话日志设计,系统提示词、思维链、工具调用及结果、子Agent调度等运行信息均会写入日志,支持恢复、分叉、检索和回放。已安装Node.js开发工具链的用户可通过npx @deepseek-ai/dsh web启动Web UI。DeepSeek表示,v0.1仍属早期预览版本,核心插件与基础接口后续将继续迭代。
摩尔线程交出上市后首份半年报:营收 17.36 亿元同比增 147%
大模型之家讯 近日,国产 GPU 第一股摩尔线程发布上市后首份半年报:2026 年上半年营业收入 17.36 亿元,同比增长 147.42%,仅用半年就超过 2025 年全年 15.06 亿元的营收规模。毛利总额 9.89 亿元,同比增长 103.78%,整体毛利率达 56.95%;归母净利润亏损 1156.31 万元,同比大幅收窄 2.59 亿元,收窄比例达 95.73%。
摩尔线程是国内唯一实现全功能 GPU 量产量销的企业。国产 GPU 发展经历了”能用”(2014-2022)、”好用”(2023-2025)到规模化商用的演进,华为昇腾 910、摩尔线程 MTT S5000、沐曦”曦云 C500″均为关键产品。财务数据背后,国产 GPU 正加速从技术突围走向生态构建与商业闭环。
Mistral AI 自家平台开放第三方模型接入:首个为智谱 GLM-5.2
大模型之家讯 8月11日,Mistral AI 宣布,作为其欧洲主权人工智能新举措的一部分,其平台将支持第三方开放模型,首款模型为智谱 GLM-5.2。第三方开放模型将与第一方模型运行在相同的基础设施、区域控制和服务承诺下,客户可在不分散 AI 运行位置的情况下扩展模型选择范围。
Mistral 同时宣布,用户现可选择在美国或欧洲区域执行 AI 推理负载,以满足数据跨境合规监管要求,并启动 Mistral 优先层级公开预览,为关键任务工作负载提供承诺的服务级别。此外,Mistral 还启动欧洲计算单元联盟计划,通过汇集多客户长期 AI 负载容量承诺,支持更大规模的欧洲算力基础设施建设。