科大讯飞星火X2.5发布,基于全国产平台训练

近日,科大讯飞正式发布采用MoE(混合专家)架构的星火X2.5多语言文本生成模型,其参数规模为293B-A30B,并基于全国产平台完成训练,可支持256K上下文。

科大讯飞星火X2.5发布,全国产平台训练

据悉,星火X2.5全面提升了代码生成和智能体能力,并支持200余种语言,在语言理解、答题、推理等通用任务上有着优异的表现。目前,星火X2.5已上线讯飞星辰MaaS平台,其输入价格为1.6元/百万Token,输入缓存命中价格为0.24元/百万Token,输出价格是6元/百万Token。

科大讯飞星火X2.5发布,全国产平台训练

早在2023年5月6日,科大讯飞就已发布讯飞星火认知大模型V1.0,具备文本生成、语言理解、知识问答、逻辑推理、数学、代码和多模态七大核心能力。6月9日,其发布星火认知大模型V1.5,升级了开放式知识问答、多轮对话、逻辑推理和数学能力。8月15日升级为V2.0版本,重点提升了代码和多模态能力,随后在10月24日发布七大核心能力进一步升级的V3.0版本


2024年1月30日,科大讯飞推出基于“飞星一号”训练的星火V3.5,这也是首个基于全国产算力训练的全民开放大模型。6月27日,升级为七大核心能力全面提升的V4.0版本,10月24日发布星火4.0 Turbo,并且官方称其中文能力对标GPT‑4 Turbo。


2025年1月15日,科大讯飞推出星火深度推理模型X1,同年11月6日推出采用MoE架构的星火X1.5,官方称其推理效率相比星火X1提升100%,并支持130余种语言。


今年2月,科大讯飞发布采用MoE稀疏架构的星火X2,实现了国产大EP并行部署,并且推理性能较星火X1.5提升50%。


【本文图片来自网络】

踩(0)

最新文章

相关文章

大家都在看