中国科学院发布知境社会心智大模型:给AI装上’情商’
大模型之家讯 7月24日,中科院计算技术研究所知境团队发布知境社会心智大模型技术体系,包含SoMBench评测基准、Zing训练系统和Actio部署架构。SoMBench将社会心智拆解为3大维度、17个二级维度、71项细粒度任务(3481道题),当前最强模型正确率仅72.08%。Zing-27B五项综合均值79.80超越GPT-5.5(78.44),是首个在HiToM高阶信念推理基准上超越GPT-5.5的百亿参数级公开模型;Zing-8B在HiToM上达78.08,超越参数量数十倍的更大模型,证明社会心智提升来自训练方法的结构化设计而非参数堆砌。
Claude Cowork爆安全漏洞:影响全球约50万macOS用户
大模型之家讯 7月27日,Anthropic的AI智能体工具Claude Cowork被曝存在安全漏洞(CVE-2026-46331),攻击者可利用该漏洞从Linux虚拟机沙箱逃逸,读写Mac任意位置文件,甚至获取在线服务登录凭据。研究人员利用VirtioFS挂载点与Linux内核漏洞,可同时突破Anthropic设置的两层限制。影响范围涉及约50万运行本地Cowork会话的macOS用户。Anthropic将报告标记为信息丰富但未直接修复,后续版本已默认在云端执行以绕过本地逃逸路径,但本地运行用户仍面临风险。
上海青浦与华为共建:长三角AI+联合创新中心正式启用
大模型之家讯 7月27日,长三角AI+联合创新中心在上海青浦正式启动运营。该中心由青浦区联合华为及生态伙伴共同打造,总建筑面积约5400平方米,核心具备开源鸿蒙应用创新中心、鲲鹏昇腾创新中心、AI应用创新中心、具身智能创新中心等6+1技术功能矩阵,并配备公共算力服务底座。中心与西岑华为练秋湖研发中心形成东西联动,覆盖从基础研发到应用创新的全链路闭环。
蚂蚁百灵发布新一代原生混合推理模型Ling-3.0-Flash
大模型之家讯 7月24日,蚂蚁百灵发布新一代原生混合推理模型Ling-3.0-Flash,总参数124B、单次计算仅激活5.1B。该模型从预训练阶段即采用混合注意力架构,以5:1比例交替堆叠KDA线性注意力层与MLA层,每个Token的专家激活比例压缩至1/64,在基础推理、指令遵循及长文本处理等指标上对标参数规模2至3倍的行业领先模型。针对Agent场景,模型扩展了超10000个真实交互训练环境,并通过集群级分级缓存将长输入首字响应延迟降低60%~80%以上。该模型已上线OpenRouter,限时免费一周后将正式开源。
中国白领’AI倦怠’:近三分之二怀念前AI时代工作方式
大模型之家讯 7月26日,咨询公司Adaptavist调查发现,约65%的白领经常怀念AI出现前的工作方式。约三分之一的受访者因会削弱创造力而愿意放弃生成式AI,亦有三分之一担忧AI遭滥用。近一半受访者表示为核实AI内容准确性被迫投入更多时间,与AI减少重复劳动的承诺背道而驰。宾夕法尼亚大学沃顿商学院研究显示,AI虽提高了创意质量,却削弱了创意多样性,有研究者警告:把ChatGPT当成唯一创意顾问,很快会发现自己的点子越来越少。
纳德拉警告:依赖单一AI满足所有需求的公司恐将无法生存
大模型之家讯 7月26日,微软CEO纳德拉在接受CNN采访时警告,企业若将AI能力完全外包给单一模型开发商,最终可能失去竞争力甚至无法生存。纳德拉表示,企业向AI模型提供商交出的每一项信息都可能成为未来风险,应建立机制确保调用AI模型时产生的元数据掌握在自己手中,以便未来训练自有模型或使用开源模型。他还建议企业将Harness与模型分离、上下文与模型分离,根据不同任务自由选择最适合的模型,避免被单一供应商锁定。
Kimi K3正式开源:全球首个3万亿参数级开源大模型落地
大模型之家讯 7月27日,月之暗面正式开源Kimi K3完整模型权重及技术报告,总参数达2.8万亿,成为全球首个达到该规模的开源大模型。K3基于KDA混合线性注意力机制构建,原生支持视觉理解,拥有100万token上下文窗口,在896个专家中高效激活16个。据Artificial Analysis数据,K3的BrowseComp单次任务成本仅为GPT-5.6 Sol的一半,较Claude Fable 5便宜近一个数量级。月之暗面还同步开源了MoonEP、FlashKDA和AgentEnv三项关键Infra技术。阿里云同日宣布真武M890超节点已Day0适配Kimi K3。
微软发布首个AI安全模型MAI-Cyber-1-Flash,跑分超Anthropic和OpenAI
大模型之家讯 7月28日,微软CEO纳德拉在X平台宣布推出首个网络安全专用AI模型MAI-Cyber-1-Flash,并将其接入多智能体安全系统MDASH。该模型在CyberGym基准测试中取得95.95%的成功率,大幅超过Claude Mythos 5(83.8%)和GPT-5.5 Cyber(85.6%)。微软表示,MAI-Cyber-1-Flash可高效处理约90%的网络安全任务,与GPT-5.4的组合成本比现有方案降低近50%。同日,微软还推出智能体安全系统Perception,用于持续监测威胁、修补漏洞和关闭新威胁入口。目前微软每天处理的安全信号超过100万亿条。
蚂蚁百灵发布Ling-3.0-Flash,124B参数激活仅5.1B
大模型之家讯 7月24日,蚂蚁百灵发布新一代原生混合推理模型Ling-3.0-Flash。该模型总参数量124B,单次计算仅激活5.1B,在推理、指令遵循及长文本处理上对标参数规模达2至3倍的行业领先模型。技术层面,Ling-3.0-Flash采用混合注意力架构,以5:1比例交替堆叠KDA线性注意力层与MLA层,专家激活比例压缩至1/64。模型已扩展超10000个真实交互训练环境,集群级分级缓存将首字延迟降低60%-80%。该模型已上线OpenRouter限时免费一周,后续将正式开源。
英伟达与Naver达成10亿美元协议,扩建韩国AI算力工厂
大模型之家讯 7月24日,英伟达宣布与韩国互联网巨头Naver达成10亿美元投资协议,计划将GAK世宗数据中心的NVIDIA DSX AI工厂从55兆瓦扩容至2028年的200兆瓦,并最终目标扩展至1吉瓦。Brookfield拟提供最高90亿美元资金支持。扩建后的工厂将采用Vera Rubin、Blackwell等英伟达最新平台,为韩美AI企业提供算力。Naver还计划下半年基于英伟达Agent Toolkit推出AI Agent平台。