登录

端侧首个支持百万上下文的模型,宣布开源


速读:端侧首个支持百万上下文的模型,宣布开源。 9月7日,科大讯飞还将发布全新一代旗舰通用大模型星火X2.5。
作者:赵广立 来源:中国科学报 发布时间:2026/9/1 19:55:0

星火X2.5-4B&1.7B让小模型干大活

端侧首个支持百万上下文的模型,宣布开源

9月1日,科大讯飞全资子公司“词元星火”正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。据介绍, 9月7日,科大讯飞还将发布全新一代旗舰通用大模型星火X2.5,进一步升级代码和智能体等核心能力。

大模型正在加速进入手机、PC、汽车座舱、智能家居和机器人等终端设备。人们对端侧模型的期待,早已不是“断网能聊几句”,而是“一份几十页的产品手册能不能一次读完并提炼重点?”“一张表格、一项指令、一个多步骤任务,能不能直接完成?”对此,星火X2.5给出了答案。

作为端侧模型中首个原生支持最长100万Token上下文的模型,星火X2.5-4B和1.7B把百万级信息处理能力带到了端侧。据介绍,两款模型采用混合注意力架构,并围绕智能体、代码、数学和指令遵循等核心能力进行优化,使其不仅从“能够在设备上对话”,还能“在本地完成任务”。

过去,端侧模型处理长内容,常常要把文档切成几段分别问,容易忘记前情、遗漏信息、已读乱回。星火X2.5-4B和1.7B原生支持最长100万Token上下文窗口,使用覆盖长篇文档、技术资料等场景的千亿Token级高质量数据开展训练,可以在一次任务中接收和理解更大规模的信息。

“百万级上下文并非单纯为了‘塞下更多字’。它真正解决的是,让模型基于完整信息,在连续交互中持续理解和处理复杂问题。”词元星火相关技术负责人介绍说,长上下文解决的是“信息能不能看全”,智能体和工具调用能力解决的,则是“看完之后能不能动手”。

依托科大讯飞在AI技术研发、智能办公和智能硬件等领域的积累,星火X2.5端侧模型可面向个人办公、代码开发、智能硬件和机器人等场景,提供本地化智能能力。

机器人是端侧智能的重要落点。据介绍,星火X2.5-4B和1.7B适用于机器人等需要持续感知和连续执行的场景。模型可以部署在机器人本体或边缘设备中,支持操作控制、目标追踪、导航决策等任务,减少对云端连接和固定预设程序的依赖。

另据了解,星火X2.5-4B和1.7B基于全国产算力平台完成全流程训练,使用约20万亿Token多样化数据进行预训练,并通过高质量监督微调和强化学习训练,持续提升模型在推理、代码、智能体和指令遵循等任务中的表现。全国产算力训练,为端侧智能构建了自主、可持续演进的技术底座。

即日起,星火X2.5-4B和1.7B已在Hugging Face、GitHub等平台开放模型权重、代码仓库和部署文档,对应模型API也已上线到讯飞星辰 MaaS平台。

模型HuggingFace、 Github及MaaS平台 链接:

https://huggingface.co/collections/XHToken/spark-x25

https://github.com/XHToken/Spark-X2.5

https://maas.xfyun.cn/modelSquare

主题:模型|端侧|智能体|科大讯飞