9 月 1 日,科大讯飞全资子公司词元星火正式推出并开源星火 X2.5-4B 和星火 X2.5-1.7B 两款端侧通用大模型。这两款产品也是端侧模型中首个原生支持最长 100 万 Token 上下文的模型,同时已全面开放模型权重、代码仓库和部署文档。
百万级上下文加持,小模型也能“读全书”
两款模型均采用混合注意力架构,围绕智能体、代码、数学和指令遵循等核心能力进行优化,综合实测能力领先业界同尺寸一流开源模型。
在上下文能力上,星火 X2.5-4B 和 1.7B 使用覆盖长篇文档、技术资料等场景的千亿 Token 级高质量数据训练,原生支持 100 万 Token 上下文窗口,可以一次接收和理解更大规模的信息。

以产品售后为例:用户可将完整售后手册导入星火 X2.5-4B,模型先梳理不同场景下的售后规则并标注对应章节,当被问及“购买 10 天后设备故障且使用过第三方耗材是否符合换货要求”时,能够关联退换货、故障处理和例外条件等跨章节规定给出综合判断。即使后续补充偏远地区、设备存有家庭地图等新条件,模型也能保持前文情境,结合物流、数据清除、费用承担等规则继续给出建议。
长上下文解决的是“信息能不能看全”,智能体和工具调用能力解决的则是“看完之后能不能动手”。星火 X2.5 端侧模型可面向个人办公、代码开发、智能硬件和机器人等场景提供本地化智能能力。在代码开发场景中,星火 X2.5-4B 在算法实现、代码补全与生成等任务上可对标参数规模大 2 至 3 倍的云端模型;在 Domux 智能家居测试集上,星火 X2.5-1.7B 的控制指令端到端执行正确率达到 90.3%,平均响应时间仅 0.85 秒;在机器人场景中,两款模型可部署在机器人本体或边缘设备,支持操作控制、目标追踪、导航决策等任务,减少对云端连接和固定预设程序的依赖。
全程国产算力训练,即刻可下载体验
星火 X2.5-4B 和 1.7B 均基于全国产算力平台完成全流程训练,使用约 20 万亿 Token 多样化数据进行预训练,并通过高质量监督微调和强化学习持续提升表现。
部署层面,两款模型支持 NVIDIA、华为、海光及后摩等硬件平台,兼容 vLLM、SGLang、llama.cpp 等主流推理框架,可通过 Ollama、LM Studio 等工具快速部署,并支持使用 LLaMA-Factory 开展增量训练。即日起,模型权重已在 Hugging Face、GitHub 等平台开放,对应模型 API 已上线讯飞星辰 MaaS 平台,限时免费。9 月 7 日,科大讯飞还将正式发布全新一代旗舰通用大模型星火 X2.5,进一步升级代码和智能体等核心能力。
.png)
发评论,每天都得现金奖励!超多礼品等你来拿
登录 在评论区留言并审核通过后,即可获得现金奖励,奖励规则可见: 查看奖励规则