成立仅4个月,北京AI Infra创企博伦智汇获千万级天使轮融资
大模型之家讯 8月27日,北京AI基础设施创企博伦智汇宣布完成千万级天使轮融资,由专注AI及AI Infra赛道的一线产业基金投资,资金将用于核心技术迭代、产品打磨及团队扩充。公司成立于2026年4月,聚焦大规模异构算力调度,业务覆盖企业私有化算力部署与自营Token工厂,CEO刘进治曾任职英特尔、摩托罗拉并推动WANdisco中国落地,CTO杨光曾任职西门子、IBM、Oracle及矩量无限。核心团队来自天数智芯、华为、趋动科技等,曾操盘国内首批英伟达SuperPOD训练集群并早期进入国产GPU生态。其自研Token导向的大规模分布式架构TOLD已在英伟达与国产GPU组成的万卡级异构集群中完成验证,可对不同地区、不同架构算力统一调度,实现多GPU协同、一键适配及B2B2C多租户服务,旨在降低国产GPU接入成本、提升集群利用率与Token产出效率。
MiniMax上半年收入1.17亿美元同比增283%,8月ARR突破8亿美元
大模型之家讯 8月27日,MiniMax披露2026年上半年财报,收入1.17亿美元、同比增长283.1%,已超2025年全年,毛利2081万美元、同比增464.8%,毛利率17.9%、提升5.8个百分点。收入结构发生切换:开放平台及其他AI企业服务收入7393万美元、同比暴涨703.1%,占比从30.3%升至63.4%;AI原生产品海螺AI收入4264万美元、同比增100.9%,占比从69.7%降至36.6%。财报期后增速进一步加速,7月Token消耗量达1月的20倍,8月ARR超8亿美元,企业客户及开发者突破200万、为去年底10倍,海外收入7083万美元、占比60.8%,覆盖超230个国家和地区。公司称M3较M2价格不变下智能水平提升是核心驱动,截至8月26日市值报1058亿港元,正从C端产品向B端能力底座切换。
智谱发布GLM-5.3-Flash“牛来”,首个原生多模态模型价格仅为Opus 4.8的1/40
大模型之家讯 8月27日,智谱正式发布并开源此前以Ox-Alpha“牛来”匿名测试的GLM-5.3-Flash,总参数320B、激活18B,为GLM-5系列首个原生多模态模型。该模型在Artificial Analysis Intelligence Index获57分,与Claude Opus 4.8持平,超越GLM-5.2及DeepSeek V4 Pro的53分,首日即登顶OpenRouter榜首并刷新单日Tokens用量纪录,较此前峰值提升4倍。定价方面,输入0.8元/百万Tokens、输出2.8元、缓存命中0.23元,约为GLM-5.3的1/10、限时折扣价1/20,较Opus 4.8约35元/175元仅为1/40,也低于DeepSeek V4 Flash的1.5元/4.5元。更关键的是测试期间全部流量由超10万张国产芯片集群承载,基于SGLang专用推理引擎及EPD分离架构等优化,端到端性能较基线提升3倍,单Token成本已与主流英伟达GPU相当,验证了国产卡承载前沿大模型的可行性。据知情人士透露,训练或由海光DCU等国产芯片支持。
小鹏第三颗图灵AI芯片点亮,超级智能体上车
大模型之家讯 8月27日,小鹏汽车宣布自研图灵AI芯片第三颗正式点亮,并于当日15:00举行物理AI分享暨第二代VLA新版本体验日。新一代VLA+VLM实现跨域融合,具备跨域总调度、原生多模态和端侧大模型能力,座舱语音架构重构后支持语音靠边停车、就近泊入、模糊导航及复杂行程规划,实现“一个大脑管理全车,一句话控车”。图灵芯片于2024年8月流片成功,40核心可运行30B参数大模型,经深度定制可实现算力100%利用,单车规划搭载不少于3颗。自2025年三季度量产上车以来累计出货已超20万片,今年二季度起全系Max版本切换至自研芯片,全年出货目标接近100万片,标志着小鹏端侧AI算力自主化进入规模化落地阶段。
斯坦福研究:22至25岁职场新人受AI冲击最显著 高等教育可有效缓冲
大模型之家讯 8月26日,斯坦福数字经济实验室依托薪资服务商ADP覆盖数百万美国劳动者的高频数据更新论文《Canaries in the Coal Mine?》显示,生成式AI尚未造成全美大规模岗位替代,但冲击高度集中于“第一梯级”入门岗:在软件开发、客服等高AI暴露职业中,22至25岁年轻人就业率较受影响较小的领域落后约19%,较2025年的13%进一步扩大,而资深从业者就业保持平稳甚至上升。研究认为,入门岗依赖可通过教材与流程文档传授的“编码化知识”,更易被AI替代,而依赖实践与导师指导的“默会知识”则使AI更多辅助资深员工;同时高等教育可显著缓冲AI对入门就业的负面冲击。
Stability AI完成7600万美元B轮融资 EA与三大音乐巨头及AMD风投联合入局
大模型之家讯 8月26日,Stability AI宣布完成7600万美元(约合5.12亿元人民币)B轮融资,由EA、索尼音乐、环球音乐、华纳音乐及AMD风投联合投资,资金用于创意产品开发、应用研究深化及专业服务扩展。CEO Prem Akkaraju称,投资者不仅提供资金,更带来专业知识、信誉及与艺术家直连的渠道,印证“以生成式AI赋能每位制片人、音乐家和故事讲述者”的愿景。作为Stable Diffusion研发方,Stability AI曾面临商业化压力,此次获内容巨头集体背书,标志版权方从对抗转向合作,将为其合规数据与商业化落地提供支撑,也预示AIGC进入产业资本与模型厂商深度绑定阶段。
英伟达发布Jetson Orin Nano 2 算力翻倍或节能四成
大模型之家讯 8月25日,英伟达正式发布面向入门级边缘AI的Jetson Orin Nano 2机器人计算机,预计2027年上半年以模组及开发套件形态上市。新品沿用Jetson Orin Nano Super同尺寸形态,标准模式下AI算力达78 TOPS,集成8核Arm CPU与8GB内存,视频处理能力显著提升,可实现前代2倍AI推理算力,或在同等性能下功耗仅15W、为前代60%,节能四成。英伟达机器人与边缘AI副总裁Deepu Talla表示,中小型前沿模型精度已追平去年最大前沿模型,该产品将把实时智能的性能与能效带给数百万开发者,利好低成本机器人、智能视觉与边缘Agent场景的规模化落地。
英伟达Vera Rubin NVL72实测曝光 每兆瓦吞吐量飙升30倍
大模型之家讯 8月26日,英伟达在Hot Chips 2026上首次公布下一代旗舰机柜Vera Rubin NVL72片上实测数据,基于1.6T参数开源模型DeepSeek-V4-Pro跑真实Agent编码工作流显示,其每兆瓦吞吐量较当前主力GB300 NVL72最高提升30倍,每百万Token成本最高降低35倍。此前GB300已较H200提升15倍,两代合计实现约900倍飞跃而整机价格仅约4倍。英伟达指出,单个Agent任务Token消耗达普通聊天的15倍,传统8K/1K固定序列基准已失效,新AgentX基准回放含上下文增长、工具调用与子智能体生成的完整编码会话。此次跃升源于分离式服务、分布式KV缓存、NVFP4 4位量化、第六代NVLink(带宽10倍、延迟低3倍)及MegaMoE等极致协同设计,配套Vera CPU搭载88个自研Olympus核心与1.2TB/s LPDDR5X带宽,已获SpaceXAI规模化部署,将用于吉瓦级算力工厂及2028年太空版Starmind卫星机架。
OpenAI自研推理芯片Jalapeño首秀 每瓦性能1.5至1.9倍于英伟达GB300
大模型之家讯 8月25日,OpenAI正式展示首款自研推理芯片Jalapeño,基于SemiAnalysis旗下InferenceX基准的实测数据显示,在GPT-OSS 120B、DeepSeek R1 670B和Kimi K2.5 1T三款模型上,其每瓦AI吞吐量达英伟达GB200/GB300系统的1.5至1.9倍,端到端延迟仅为对比系统的28%至59%,其中DeepSeek R1上高约1.7倍、Kimi K2.5上高约1.5倍。该芯片由OpenAI与博通联合开发、台积电3nm代工,额定功率700瓦、实测持续功耗控制在550瓦以内,采用脉动阵列架构并配备HBM高带宽内存,专为大模型推理设计,不用于训练,流片仅用约9个月。芯片及配套服务器仅供内部使用,计划2026年底前小规模部署、2027年放量,第二代已进入后期开发、第三代启动概念设计,OpenAI表示尚未与英伟达最新Vera Rubin对比,将维持多供应商策略。
字节整合TRAE与扣子至豆包 将推统一品牌豆包工作
大模型之家讯 8月25日,据钛媒体综合,字节跳动于8月24日完成办公AI产品团队整合,TRAE、扣子(Coze)团队整体并入豆包体系。其中TRAE Work与扣子将与豆包工作场景能力整合,TRAE IDE及CLI作为豆包品牌下编程产品线持续发展。整合后字节明确豆包为AI主干业务,并将于本周内推出面向AI办公的统一品牌“豆包工作”,现有用户权益不受影响。此次调整旨在协同产品与技术资源,从内容生成向完成工作闭环演进,提升AI办公体验。