星火X2.5-4B&1.7B开源:业界首个支持百万级上下文

博望财经博望财经2026-09-01 15:20 大公司
科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。

今天,科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。

大模型正在加速进入手机、PC、汽车座舱、智能家居和机器人等终端设备。大家对端侧模型的期待,早已不是“断网能聊几句”,而是:一份几十页的产品手册能不能一次读完并提炼重点?一张表格、一项指令、一个多步骤任务,能不能直接完成?

星火X2.5给出了答案:作为端侧模型中首个原生支持最长100万Token上下文的模型,星火X2.5-4B和1.7B把百万级信息处理能力带到本地设备。两款模型采用混合注意力架构,并围绕智能体、代码、数学和指令遵循等核心能力进行优化。综合实测,相关能力领先业界同尺寸一流开源模型。

从“能够在设备上对话”,到“能够在本地完成任务”,星火X2.5端侧模型正在拓展中小底座的能力和应用边界。

业界首个:支持百万级上下文,读懂完整信息

真实工作场景里,用户交给模型的往往不是一段提问,而可能是一份售后手册、一套会议材料、一批项目文档,甚至是完整代码仓库。

过去,端侧模型处理长内容,常常要把文档切成几段分别问,容易忘记前情、遗漏信息、已读乱回。星火X2.5-4B和1.7B原生支持最长100万Token上下文窗口,使用覆盖长篇文档、技术资料等场景的千亿Token级高质量数据开展训练,可以在一次任务中接收和理解更大规模的信息。

以产品售后为例,用户可将完整的产品售后手册导入星火X2.5-4B,先梳理不同场景下的售后规则并标注对应章节;当进一步询问“购买10天后设备故障,且使用过第三方耗材,是否符合换货要求”时,模型能够关联退换货、故障处理和例外条件等跨章节规定,给出综合判断。面对偏远地区、设备存有家庭地图等新增条件,模型还可保持前文情境,结合物流、数据清除、费用承担和处理时限等规则,提供后续建议。

百万级上下文并非单纯为了“塞下更多字”。它真正解决的是:让模型基于完整信息,在连续交互中持续理解和处理复杂问题。

真正“干活”:不止回答问题,还是工作/生活助手

长上下文解决的是“信息能不能看全”,智能体和工具调用能力解决的,则是“看完之后能不能动手”。

依托科大讯飞在AI技术研发、智能办公和智能硬件等领域的积累,星火X2.5端侧模型可面向个人办公、代码开发、智能硬件和机器人等场景,提供本地化智能能力。

在个人办公场景中,星火X2.5端侧模型可覆盖数据处理、文档生成和文档翻译等环节。以Loomy上的办公案例为例,用户上传销售明细表并提出销售分析和中英文部门业绩报告的交付需求后,星火X2.5-4B首先编写脚本完成数据汇总、关键指标提取和趋势分析,随后生成约3000字的中文部门业绩报告,并沿用原有结构和格式生成英文版报告,最后完成内容、结构和排版校验,实现从原始数据分析到双语报告交付的完整流程。

在代码开发场景中,星火X2.5-4B在算法实现、代码补全与生成等任务中,可对标参数规模大2至3倍的云端模型。代码编写、脚本生成和调试辅助工作,可以不出本地直接完成。依托端侧部署,模型还具备低延迟、离线使用和代码资产本地化管理等优势。开发者可通过DeepSeek Harness、OpenCode、Codex、Pi等开源Harness,将模型接入本地开发和自动化脚本流程。

在智能硬件场景中,端侧模型比拼的不只是“听没听懂”,更是“能不能又快又准地执行”。以智能家居为例,在Domux智能家居测试集上,星火X2.5-1.7B控制指令端到端执行正确率达到90.3%,平均响应时间仅为0.85秒,兼顾准确度与速度。

机器人同样是端侧智能的重要落点。星火X2.5-4B和1.7B同样适用于机器人等需要持续感知和连续执行的场景。模型可以部署在机器人本体或边缘设备中,支持操作控制、目标追踪、导航决策等任务,减少对云端连接和固定预设程序的依赖。

安全可控:扎根全国产算力,构建开放端侧生态

大模型进入更多行业和智能终端,既需要模型能力持续提升,也需要自主可控的算力支撑与灵活易用的部署条件。

星火X2.5-4B和1.7B基于全国产算力平台完成全流程训练,使用约20万亿Token多样化数据进行预训练,并通过高质量监督微调和强化学习训练,持续提升模型在推理、代码、智能体和指令遵循等任务中的表现。全国产算力训练,为端侧智能构建了自主、可持续演进的技术底座。

在部署层面,两款模型支持英伟达、华为、海光及后摩等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架,可通过Ollama、LM Studio等工具快速部署,并支持使用LLaMA-Factory开展增量训练。多硬件、多框架适配,进一步降低了开发者和行业伙伴在不同环境中部署、微调和应用端侧模型的门槛。

即日起,星火X2.5-4B和1.7B已在Hugging Face、GitHub等平台开放模型权重、代码仓库和部署文档,对应模型API也已上线到讯飞星辰 MaaS平台,限时免费,欢迎大家下载或接入使用。

当百万级上下文进入端侧,模型开始能够在更贴近用户的设备上,看得更全、记得更久、做得更多。

Hugging Face链接:

https://huggingface.co/collections/XHToken/spark-x25

Github链接:

https://github.com/XHToken/Spark-X2.5

讯飞星辰MaaS平台接入:

https://maas.xfyun.cn/modelSquare

9月7日,科大讯飞还将正式发布全新一代旗舰通用大模型星火X2.5,进一步升级代码和智能体等核心能力,敬请期待。

【本文为合作媒体授权博望财经转载,文章版权归原作者及原出处所有。文章系作者个人观点,不代表博望财经立场,转载请联系原作者及原出处获得授权。有任何疑问都请联系(联系(微信公众号ID:AppleiTree)。免责声明:本网站所有文章仅作为资讯传播使用,既不代表任何观点导向,也不构成任何投资建议。】

猜你喜欢