9月8日消息,近日,科大讯飞正式发布了星火X2.5大模型。该模型采用了MoE架构,参数规模为293B-A30B,重点提升了以下几方面的能力:
代码能力
智能体能力
数学能力
理解能力
此外,该模型还持续增强了其他通用能力。
据了解,星火X2.5采用混合专家(MoE)架构,总参数量为2930亿,每次推理激活参数量为300亿。
该模型基于全国产算力完成全流程训练,支持256K上下文,并持续优化国产算力上的超长序列训练与推理。
价格方面,模型详情页显示,星火X2.5目前提供限时5折优惠,每百万Token的输入、缓存命中输入和输出价格分别为1.6元、0.24元和6元,原价分别为3.2元、0.48元和12元。
模型基于全国产算力完成全流程训练及推理,持续优化国产超长序列训推难题,目前已上线讯飞开放平台。
此前,星火X2.5-4B和1.7B两款端侧模型已开源,支持最长100万Token上下文,可本地部署于长文档处理、代码辅助、数据分析等场景。
