近日,科大讯飞正式发布采用 MoE(混合专家)架构的星火 X2.5 多语言文本生成模型,其参数规模为 293B-A30B,并基于全国产平台完成训练,可支持 256K 上下文。

据悉,星火 X2.5 全面提升了代码生成和智能体能力,并支持 200 余种语言,在语言理解、答题、推理等通用任务上有着优异的表现。目前,星火 X2.5 已上线讯飞星辰 MaaS 平台,其输入价格为 1.6 元 / 百万 Token,输入缓存命中价格为 0.24 元 / 百万 Token,输出价格是 6 元 / 百万 Token。

早在 2023 年 5 月 6 日,科大讯飞就已发布讯飞星火认知大模型 V1.0,具备文本生成、语言理解、知识问答、逻辑推理、数学、代码和多模态七大核心能力。6 月 9 日,其发布星火认知大模型 V1.5,升级了开放式知识问答、多轮对话、逻辑推理和数学能力。8 月 15 日升级为 V2.0 版本,重点提升了代码和多模态能力,随后在 10 月 24 日发布七大核心能力进一步升级的 V3.0 版本。
2024 年 1 月 30 日,科大讯飞推出基于 " 飞星一号 " 训练的星火 V3.5,这也是首个基于全国产算力训练的全民开放大模型。6 月 27 日,升级为七大核心能力全面提升的 V4.0 版本,10 月 24 日发布星火 4.0 Turbo,并且官方称其中文能力对标 GPT ‑ 4 Turbo。
2025 年 1 月 15 日,科大讯飞推出星火深度推理模型 X1,同年 11 月 6 日推出采用 MoE 架构的星火 X1.5,官方称其推理效率相比星火 X1 提升 100%,并支持 130 余种语言。
今年 2 月,科大讯飞发布采用 MoE 稀疏架构的星火 X2,实现了国产大 EP 并行部署,并且推理性能较星火 X1.5 提升 50%。
【本文图片来自网络】


登录后才可以发布评论哦
打开小程序可以发布评论哦