驱动之家 09-01
端侧首个百万上下文!科大讯飞星火X2.5-4B、1.7B开源:全国产算力平台训练
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_font3.html

 

快科技 9 月 1 日消息,今日,科大讯飞全资子公司词元星火正式推出并开源星火 X2.5-4B 和星火 X2.5-1.7B 两款端侧通用大模型,这也是端侧模型中首个原生支持最长 100 万 Token 上下文的产品。

两款模型采用混合注意力架构,围绕智能体、代码、数学和指令遵循等核心能力进行优化,综合实测相关能力领先业界同尺寸一流开源模型。

上下文方面,星火 X2.5-4B 和 1.7B 使用覆盖长篇文档、技术资料等场景的千亿 Token 级高质量数据训练,原生支持 100 万 Token 上下文窗口,可以在一次任务中接收和理解更大规模的信息。

百万级上下文真正解决的问题是让模型基于完整信息,在连续交互中持续理解和处理复杂问题。

以产品售后为例,用户可将完整售后手册导入星火 X2.5-4B,模型先梳理不同场景下的售后规则并标注对应章节,当被问及 " 购买 10 天后设备故障且使用过第三方耗材是否符合换货要求 " 时,能够关联退换货、故障处理和例外条件等跨章节规定给出综合判断。

面对偏远地区、设备存有家庭地图等新增条件,模型还能保持前文情境,结合物流、数据清除、费用承担和处理时限等规则提供后续建议。

长上下文解决的是信息能不能看全,智能体和工具调用能力解决的则是看完之后能不能动手,星火 X2.5 端侧模型可面向个人办公、代码开发、智能硬件和机器人等场景,提供本地化智能能力。

比如在代码开发场景中,星火 X2.5-4B 在算法实现、代码补全与生成等任务中可对标参数规模大 2 至 3 倍的云端模型,代码编写、脚本生成和调试辅助工作可以不出本地直接完成。

智能硬件场景中,在 Domux 智能家居测试集上,星火 X2.5-1.7B 控制指令端到端执行正确率达到 90.3%,平均响应时间仅 0.85 秒。

机器人场景方面,两款模型可部署在机器人本体或边缘设备中,支持操作控制、目标追踪、导航决策等任务,减少对云端连接和固定预设程序的依赖。

星火 X2.5-4B 和 1.7B 均基于全国产算力平台完成全流程训练,使用约 20 万亿 Token 多样化数据进行预训练,并通过高质量监督微调和强化学习持续提升推理、代码、智能体和指令遵循等任务表现。

部署层面支持 NVIDIA、华为、海光及后摩等硬件平台,兼容 vLLM、SGLang、llama.cpp 等主流推理框架,可通过 Ollama、LM Studio 等工具快速部署,并支持使用 LLaMA-Factory 开展增量训练。

即日起,星火 X2.5-4B 和 1.7B 已在 Hugging Face、GitHub 等平台开放模型权重、代码仓库和部署文档,对应模型 API 已上线讯飞星辰 MaaS 平台,限时免费。

此外在 9 月 7 日,科大讯飞还将正式发布全新一代旗舰通用大模型星火 X2.5,进一步升级代码和智能体等核心能力。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

开源 机器人 科大讯飞 智能家居 华为
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论