9月7日,科大讯飞正式发布星火X2.5大模型。该模型采用MoE(混合专家模型)架构,参数规模为293B-A30B,重点提升代码和智能体能力,并持续增强数学、理解等通用能力。模型基于全国产算力完成全流程训练及推理,持续优化国产超长序列训推难题,目前已上线讯飞开放平台。
此前,星火X2.5-4B和1.7B两款端侧模型已开源,支持最长100万词元上下文,可本地部署于长文档处理、代码辅助、数据分析等场景。(汪茜茜)
【纠错】 【责任编辑:周雨濛】
9月7日,科大讯飞正式发布星火X2.5大模型。该模型采用MoE(混合专家模型)架构,参数规模为293B-A30B,重点提升代码和智能体能力,并持续增强数学、理解等通用能力。模型基于全国产算力完成全流程训练及推理,持续优化国产超长序列训推难题,目前已上线讯飞开放平台。
此前,星火X2.5-4B和1.7B两款端侧模型已开源,支持最长100万词元上下文,可本地部署于长文档处理、代码辅助、数据分析等场景。(汪茜茜)