资讯
讯飞星火X2.5正式发布,重点提升代码与智能体能力
📋总体概括
科大讯飞发布星火X2.5大模型,采用MoE架构,参数规模293B-A30B,重点强化代码与智能体能力,并提升数学、理解等通用水平。该模型基于全国产算力完成全流程训练与推理,针对国产超长序列训推难题持续优化,已上线讯飞开放平台。此前两款端侧模型星火X2.5-4B和1.7B已开源,支持最长100万Token上下文,可本地部署于长文档、代码辅助、数据分析等场景。讯飞借此巩固其在国产算力体系下的大模型差异化定位。
⚡关键信息
- ▸星火X2.5正式发布,采用MoE架构,参数规模为293B-A30B
- ▸模型重点提升代码与智能体能力,并增强数学、理解等通用能力
- ▸基于全国产算力完成全流程训练及推理,优化国产超长序列训推难题
- ▸模型已上线讯飞开放平台,向开发者开放使用
- ▸端侧模型4B和1.7B此前已开源,支持最长100万Token上下文,可本地部署
🔥犀利点评
全国产算力全流程训练是讯飞反复强调的标签,技术上确实是绕不开的合规牌,但也是商业上最难打的牌——国产芯片训推效率注定与顶级英伟达方案有差距,代码和智能体这类能力恰恰最吃算力密度和迭代速度。293B-A30B的MoE配置中规中矩,真正的胜负手在于端侧开源能否撬动开发者生态,否则只是又一份国产自研的成绩单。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 36氪快讯 阅读全文 →