科大讯飞开源星火X2.5端侧模型:4B与1.7B原生支持100万Token上下文

大模型之家讯 9月1日,科大讯飞全资子公司词元星火正式开源星火X2.5-4B与星火X2.5-1.7B两款端侧通用大模型,采用混合注意力架构,宣称是端侧目前唯一原生支持100万Token长上下文的模型,围绕智能体、代码、数学与指令遵循等能力优化,综合表现领先同尺寸主流开源模型。

科大讯飞开源星火X2.5端侧模型:4B与1.7B原生支持100万Token上下文

该系列基于全国产算力平台完成全流程训练,预训练数据约20万亿Token,并以千亿Token级长文档高质量数据进行长上下文训练,经监督微调与强化学习持续优化,可在一次任务中接收更大规模信息,解决分段问答易遗漏的问题。以售后手册场景为例,模型可一次性梳理退换货、故障处理与例外条件等跨章节规则,并在追加偏远地区、数据清除等新条件时给出综合判断与后续建议。

在任务执行层面,模型覆盖办公、代码、智能硬件与机器人等场景。办公中可完成销售明细汇总与趋势分析,生成约3000字中英文部门业绩报告并校验排版;代码场景中,4B模型在算法实现与代码补全上可对标2至3倍参数的云端模型,支持通过DeepSeek Harness、OpenCode等接入本地开发,实现低延迟与代码资产本地化;智能家居测试集Domux上,1.7B模型端到端指令执行正确率90.3%,平均响应0.85秒。

两款模型适配英伟达、华为、海光及后摩等硬件,兼容vLLM、SGLang、llama.cpp等推理框架,可通过Ollama、LM Studio快速部署并支持LLaMA-Factory增量训练。权重、代码与部署文档已在Hugging Face、GitHub开放,API已上线讯飞星辰MaaS平台限时免费。科大讯飞预告将于9月7日发布星火X2.5-293B通用大模型。

原创文章,作者:志斌,如若转载,请注明出处:http://damoai.com.cn/archives/18374

(0)
上一篇 15小时前
下一篇 9小时前

相关推荐

发表回复

登录后才能评论