讯飞星火X2.5实测:从创意交互到复杂研报,国产算力闭环能力再升级

2026/09/09 18:02阅读量 3

讯飞发布参数293B的MoE大模型星火X2.5,重点强化代码生成与智能体(Agent)能力。实测显示,该模型在3D粒子交互网页开发、61页财报数据提取与分析、以及基于虚构数据的实证研究纠错等方面表现优异,具备从创意落地到复杂任务交付的能力。同时,该模型依托全国产算力平台完成全链路训练与推理,训练效率较同规模A800集群显著提升,标志着国产算力正从备用选项转向核心资源池。

事件概述

讯飞正式推出参数规模为293B-A30M的MoE大模型星火X2.5。该模型原生支持Anthropic Responses协议,可快速接入OpenClaw、Claude Code等第三方Harness框架。此次更新重点提升了代码编写与智能体(Agent)执行能力,覆盖200余种语言,旨在解决AI从“问答”向“实际交付”过渡的关键问题。

核心实测表现

通过三道关卡测试,验证了星火X2.5在创意实现、数据处理及逻辑校验方面的能力:

  • 创意与代码落地:模型成功生成包含手势交互功能的3D粒子网页。用户可通过握拳、比划数字等手势,控制粒子聚散形成圆月或文字祝福,并附带小游戏模块,展示了其在前端开发与创意可视化方面的执行力。
  • 复杂文档处理与分析:在处理英伟达Q2财报(61页)时,模型在半小时内自动提取关键数据,生成9份图表及1份投研风险简报,数值准确且结构清晰,显著降低了人工阅读成本。
  • 多模态数据校验与纠错
    • 实证研究辅助:在整合Nature/Science论文及模拟问卷数据时,模型不仅完成了实证初稿撰写,还主动识别出数据来源为模拟生成的潜在偏差,并指出样本量不足等方法论缺陷,体现了较强的逻辑批判性。
    • 异常数据检测:面对包含错误营收数值的非结构化截图数据,模型成功识别统计Bug,并将分析报告转化为可视化PDF,展现了对非标准输入的处理能力及准确性。

技术背景与行业意义

  • 全国产算力全链路支撑:星火X2.5依托讯飞“飞星一号”国产算力平台,实现了从训练、强化学习到推理部署的全链条自主可控。据科大讯飞披露,其MoE模型在国产算力上的训练效率已从开箱状态的30%提升至93%,接近同规模A800集群水平。
  • 训推闭环优势:不同于仅做推理适配的方案,星火X2.5打通了训推全链路,能够将在应用中出现的新需求反馈至训练端,形成持续迭代的闭环。这对于即将大规模普及的智能体(Agent)应用至关重要,确保了算力供应的稳定性和模型更新的及时性。
  • 市场趋势:随着国务院《关于深入实施「人工智能+」行动的意见》提出2027年智能终端普及率超70%的目标,国产算力正从备用选项转变为核心基础设施。讯飞凭借早期布局,已在国产算力适配上积累了大量经验,有助于降低真实应用场景中的部署门槛。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。