作者:一水 文婷
来源:量子位
讯飞星火 X2.5 大模型正式上线,参数规模达 293B(激活 30B)。此前该系列开源的 4B 与 1.7B 端侧模型因支持百万 Token 上下文且兼容多种硬件,已在社区引发热议并登顶 Hugging Face 趋势榜。
作为 MoE 架构大模型,星火 X2.5 重点强化了代码生成与智能体(Agent)能力,覆盖 200 余种语言。目前 API 服务已开启限时优惠,开发者可通过讯飞开放平台接入,并原生支持 Anthropic 及 Responses 协议,快速集成至 OpenClaw、Claude Code 等第三方框架。
为验证其实际落地能力,本次测试设置了三道关卡:从创意交互网页开发,到复杂财报与科研数据分析,再到完整游戏官网搭建。
实测一:创意落地,生成 3D 粒子交互网页
首项测试要求将“中秋祈福”创意转化为可交互的 3D 粒子网页。通过输入包含金桂、星辰、圆月等元素的 Prompt,模型成功生成了基于手势识别的交互页面。
实测效果显示,用户可通过握拳、比划数字等手势,控制屏幕粒子聚散成圆月或拼出“中秋快乐”、“阖家团圆”等 3D 文字,交互过程流畅自然。此外,模型还额外生成了《月宫快递》小游戏,进一步丰富了节日互动体验。
实测二:专业攻坚,财报拆解与科研实证
第二关聚焦真实办公场景,测试模型处理复杂数据的能力。
英伟达财报深度分析
面对长达 61 页的英伟达 Q2 财报,模型在半小时内完成了关键数据提取、图表制作及投研风险简报撰写。测试结果显示,其生成的营收利润图表数值准确,对未来承诺(Future commitments)的结构化梳理清晰,有效降低了人工阅读硬核财报的门槛。
科研论文实证与数据纠错
在科研辅助测试中,模型不仅整合了 Nature、Science 文献及模拟问卷数据,得出了"AI 提升科研效率”的结论并配以统计图表,更展现了敏锐的数据洞察力。它主动指出了输入数据中样本量少、未控制变量等缺陷,并在电商数据筛查环节,成功识别出人为植入 Word 文档截图中的计算错误,最终输出了高质量的可视化 PDF 报告。
实测三:整站交付,构建奇幻游戏官网
最后一关要求为原创游戏《堕神余烬》搭建官方网站。基于提供的哥特式世界观 Prompt,模型不仅生成了包含导航栏、首页海报的标准官网结构,还创造性地设计了闯关地图与 Boss 专题板块,将“神骸污染”等底层设定融入页面逻辑。这表明,缺乏前端团队的独立开发者亦可借助该模型快速实现高质量官网的上线部署。
△海报页面
国产算力模型迈入可交付时代
三次实测表明,星火 X2.5 已从单纯的对话问答进化为具备全流程交付能力的智能体。当前 AI 行业竞争焦点正从“聊天”转向“办事”,即 Agent 工程的落地能力。
星火大模型的迭代路径清晰反映了这一趋势:从 X1 的深度推理,到 X2 系列的代码与多模态增强,再到 X2.5 对智能体能力的全面强化,模型正逐步补齐“想、看、做、交付”的全链路能力。
值得注意的是,星火大模型坚持“全国产算力”标签。与仅在推理阶段适配国产芯片不同,讯飞实现了从训练、强化学习到推理部署的全链路自主可控。据披露,其 MoE 模型在国产算力上的训练效率已从初期的 30% 提升至 93%,达到了与国际主流集群相当的水平。
随着《关于深入实施「人工智能+」行动的意见》提出智能体普及率目标,构建可持续运转的“训推闭环”成为关键。讯飞凭借早期布局,已在国产算力平台上积累了成熟的迭代经验,使得星火 X2.5 不仅能跑通模型,更能托住真实的行业应用,标志着国产大模型正式进入规模化交付阶段。

