据量子位报道,讯飞星火X2.5大模型于9月9日上线讯飞开放平台。该模型采用MoE架构,参数规模为293B-A30B,覆盖200余种语言,重点提升代码与智能体能力。API原生支持Anthropic、Responses协议,可接入Claude Code、Codex等第三方Agent框架。
讯飞此前已开源4B和1.7B两款端侧模型,两者均可原生支持100万Token上下文。社区对这两款模型进行了量化、部署及工具调用测试,其中4B版本一度登上Hugging Face趋势榜第一。这次上线的293B版本是更大规模的正式产品,活动期内API可享五折。
量子位在评测中设置了三类任务。第一项是创意实现:要求模型以“中秋祈福”为主题生成一个带手势交互的3D粒子网页。该网页在待机时呈现散落的金色粒子,握拳时粒子聚拢成圆月,切换手势时拼出“中秋快乐”“阖家团圆”等祝福,松开后粒子散作星辰。评测人员还基于同一技术制作了名为《月宫快递》的多人小游戏。
第二项办公任务要求模型处理英伟达Q2财报。模型在阅读61页财报后,输出了9份图表和1份投研风险简报。评测人员抽查关键损益数据,发现其与报告一致,未来承诺事项的结构也清晰可读。在科研场景中,模型被要求依据两篇论文、一篇新闻报道和20份问卷数据,撰写“使用AI对科研人员工作效率影响”的实证初稿。模型不仅给出方向性结论,还自动绘制了对比图和相关系数表,并指出研究存在样本量小、缺少控制变量等问题。在电商数据筛查测试中,评测人员故意把一部分营收数值算错,并将数据截图放进Word文档。模型最终准确挑出了这些错误。
第三项任务是网站设计。模型根据原创游戏《堕神余烬》的世界观,生成了包含导航、首页海报、闯关地图和Boss介绍专题的完整官网,页面风格贴合哥特地下城设定,并配置了玩法说明和下载入口等基本组件。
星火大模型的更新日志显示,X1先攻深度推理,X2-Flash加强代码与智能体,X2-VL引入多模态能力,X2.5则把代码和智能体放在最前面。讯飞大模型的训练与推理均基于国产算力平台,从2023年“飞星一号”落地起已连续运行多代。据科大讯飞在2025年度业绩说明会上披露,其MoE模型在国产算力上的训练效率,已从最初相当于同规模A800集群开箱状态的30%提升至93%。
量子位的报道认为,星火X2.5同时呼应了Agent从聊天走向交付、国产算力从备选走向核心这两条行业主线。国家层面也对智能体应用普及提出目标,按照国务院2025年8月印发的《关于深入实施“人工智能+”行动的意见》,到2027年新一代智能终端、智能体等应用普及率将超过70%。