首页 > 新闻 > 国内时政更多新闻

端侧首个支持百万上下文模型开源

2026-09-02 13:38 来源:经济日报新闻客户端
查看余下全文
首页 > 新闻 > 国内时政更多新闻

端侧首个支持百万上下文模型开源

2026年09月02日 13:38 来源:经济日报新闻客户端 吉亚矫
[字号 ]

近日,科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。

大模型正在加速进入手机、PC、汽车座舱、智能家居和机器人等终端设备。大家对端侧模型的期待,早已不是能聊几句,而是:一份几十页的产品手册能不能一次读完并提炼重点?一个多步骤任务,能不能直接完成?

作为端侧模型中首个原生支持最长100万Token上下文的模型,星火X2.5-4B和1.7B把百万级信息处理能力带到本地设备。两款模型采用混合注意力架构,并围绕智能体、代码、数学和指令遵循等核心能力进行优化。

以产品售后为例,用户可将完整的产品售后手册导入星火X2.5-4B,先梳理不同场景下的售后规则并标注对应章节;当进一步询问“购买10天后设备故障,且使用过第三方耗材,是否符合换货要求”时,模型能够关联退换货、故障处理和例外条件等跨章节规定,给出综合判断。

依托科大讯飞在AI技术研发、智能办公和智能硬件等领域的积累,星火X2.5端侧模型可面向个人办公、代码开发等场景,提供本地化智能能力。

在个人办公场景中,星火X2.5端侧模型可覆盖数据处理、文档生成和文档翻译等环节。在代码开发场景中,星火X2.5-4B在算法实现、代码补全与生成等任务中,可对标参数规模大2至3倍的云端模型。代码编写、脚本生成和调试辅助工作,可以不出本地直接完成。依托端侧部署,模型还具备低延迟、离线使用和代码资产本地化管理等优势。

机器人同样是端侧智能的重要落点。星火X2.5-4B和1.7B同样适用于机器人等需要持续感知和连续执行的场景。模型可以部署在机器人本体或边缘设备中,支持操作控制、目标追踪、导航决策等任务,减少对云端连接和固定预设程序的依赖。

大模型进入更多行业和智能终端,既需要模型能力持续提升,也需要自主可控的算力支撑与灵活易用的部署条件。星火X2.5-4B和1.7B基于全国产算力平台完成全流程训练,使用约20万亿Token多样化数据进行预训练,并通过高质量监督微调和强化学习训练,持续提升模型在推理、代码、智能体和指令遵循等任务中的表现。全国产算力训练,为端侧智能构建了自主、可持续演进的技术底座。

(责任编辑:杨淼)