跳转到主要内容

讯飞星火X2.5双子星开源:百万级上下文首次落地端侧

9月1日,科大讯飞全资子公司“思远星火”正式发布并开源了两款端侧通用大模型——星火X2.5-4B和星火X2.5-1.7B。这两款产品是业界首批原生支持百万Token上下文长度的端侧模型,同时开放了模型权重、代码仓库和部署文档。

百万级上下文,小模型也能“读整本书”

这两款模型均采用混合注意力架构,针对智能体、代码、数学、指令跟随等核心能力进行了优化,综合性能在同类开源模型中处于领先水平。

在上下文能力上,星火X2.5-4B和1.7B基于数万亿Token的高质量数据训练,覆盖长文档、技术资料等场景,原生支持100万Token的上下文窗口,可以一次性接收和理解更大规模的信息。

Image

举个例子,在售后场景中,用户可以把完整的售后手册导入星火X2.5-4B。模型会先梳理不同场景下的售后规则,并标注对应章节。当用户问“购买10天内设备故障,且使用了第三方耗材,能否换新?”时,模型能跨章节关联退换货、故障处理、例外条款等规定,给出综合判断。即使后续再增加“偏远地区”或“家庭地图设备”等新条件,模型也能保持之前的上下文,结合物流、数据擦除、费用承担等规则继续提供建议。

长上下文解决了“信息能否看全”的问题,而智能体和工具调用能力则解决了“看完能否行动”的问题。星火X2.5端侧模型为个人办公、代码开发、智能硬件、机器人等场景提供了本地化智能能力。在代码开发场景中,星火X2.5-4B在算法实现、代码补全、生成等任务上,可以媲美参数规模大2到3倍的云端模型;在Domux智能家居测试集上,星火X2.5-1.7B对控制指令的端到端执行准确率达到90.3%,平均响应时间仅0.85秒;在机器人场景中,两款模型均可部署在机器人本体或边缘设备上,支持操作控制、目标跟踪、导航决策等任务,减少对云端连接和固定预设程序的依赖。

全栈国产算力训练,即下即用

星火X2.5-4B和1.7B完全基于国产计算平台训练,使用了约20万亿多样化的Token数据进行预训练,并通过高质量监督微调和强化学习持续提升性能。

部署方面,两款模型支持NVIDIA、华为、海光、沐曦等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架,可通过Ollama、LM Studio等工具快速部署,并支持使用LLaMA-Factory进行增量训练。即日起,模型权重已在Hugging Face、GitHub等平台开放,同时讯飞星火MaaS平台也上线了对应模型API,限时免费。9月7日,讯飞将正式发布下一代旗舰通用大模型星火X2.5,进一步升级代码、智能体等核心能力。

关键要点

  • 星火X2.5-4B和1.7B:两款端侧模型,原生支持百万Token上下文,全面开源。
  • 国产算力训练:完全基于国产计算平台,使用约20万亿Token数据。
  • 应用场景:覆盖售后、代码开发、智能家居、机器人等,性能领先。
  • 部署便捷:支持多种硬件和推理框架,即下即用。
  • 后续计划:9月7日发布旗舰版星火X2.5。