三易生活 09-08
科大讯飞星火X2.5发布,基于全国产平台训练
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

近日,科大讯飞正式发布采用 MoE(混合专家)架构的星火 X2.5 多语言文本生成模型,其参数规模为 293B-A30B,并基于全国产平台完成训练,可支持 256K 上下文。

据悉,星火 X2.5 全面提升了代码生成和智能体能力,并支持 200 余种语言,在语言理解、答题、推理等通用任务上有着优异的表现。目前,星火 X2.5 已上线讯飞星辰 MaaS 平台,其输入价格为 1.6 元 / 百万 Token,输入缓存命中价格为 0.24 元 / 百万 Token,输出价格是 6 元 / 百万 Token。

早在 2023 年 5 月 6 日,科大讯飞就已发布讯飞星火认知大模型 V1.0,具备文本生成、语言理解、知识问答、逻辑推理、数学、代码和多模态七大核心能力。6 月 9 日,其发布星火认知大模型 V1.5,升级了开放式知识问答、多轮对话、逻辑推理和数学能力。8 月 15 日升级为 V2.0 版本,重点提升了代码和多模态能力,随后在 10 月 24 日发布七大核心能力进一步升级的 V3.0 版本。

2024 年 1 月 30 日,科大讯飞推出基于 " 飞星一号 " 训练的星火 V3.5,这也是首个基于全国产算力训练的全民开放大模型。6 月 27 日,升级为七大核心能力全面提升的 V4.0 版本,10 月 24 日发布星火 4.0 Turbo,并且官方称其中文能力对标 GPT ‑ 4 Turbo。

2025 年 1 月 15 日,科大讯飞推出星火深度推理模型 X1,同年 11 月 6 日推出采用 MoE 架构的星火 X1.5,官方称其推理效率相比星火 X1 提升 100%,并支持 130 余种语言。

今年 2 月,科大讯飞发布采用 MoE 稀疏架构的星火 X2,实现了国产大 EP 并行部署,并且推理性能较星火 X1.5 提升 50%。

【本文图片来自网络】

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

科大讯飞 数学 星火认知大模型 讯飞
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论