智谱发布GLM-5.3-Flash“牛来”,首个原生多模态模型价格仅为Opus 4.8的1/40

大模型之家讯 8月27日,智谱正式发布并开源此前以Ox-Alpha“牛来”匿名测试的GLM-5.3-Flash,总参数320B、激活18B,为GLM-5系列首个原生多模态模型。该模型在Artificial Analysis Intelligence Index获57分,与Claude Opus 4.8持平,超越GLM-5.2及DeepSeek V4 Pro的53分,首日即登顶OpenRouter榜首并刷新单日Tokens用量纪录,较此前峰值提升4倍。定价方面,输入0.8元/百万Tokens、输出2.8元、缓存命中0.23元,约为GLM-5.3的1/10、限时折扣价1/20,较Opus 4.8约35元/175元仅为1/40,也低于DeepSeek V4 Flash的1.5元/4.5元。更关键的是测试期间全部流量由超10万张国产芯片集群承载,基于SGLang专用推理引擎及EPD分离架构等优化,端到端性能较基线提升3倍,单Token成本已与主流英伟达GPU相当,验证了国产卡承载前沿大模型的可行性。据知情人士透露,训练或由海光DCU等国产芯片支持。

上一篇:

下一篇:

发表回复

登录后才能评论