讯飞星火X2.5 293B上线 API五折 实测全场景交付实力

近期,参数规模达293B的MoE架构大模型星火X2.5正式对外发布,作为星火系列的最新迭代版本,它在代码能力与智能体应用上的升级,让不少开发者和从业者都充满期待。
在此之前,星火X2.5的两款端侧开源模型已经在社区引发了不小的热度:4B和1.7B参数的轻量化版本,无需依赖云端算力就能在本地运行百万Token级别的上下文。从模型量化适配到跨平台移植,从桌面端到浏览器环境,社区开发者们展开了丰富的实践,甚至有开发者将其接入智能体工作流,实现了连续工具调用。其中4B参数的开源模型更是登顶了Hugging Face的当前趋势榜单。
既然小模型已经展现出了不俗的实力,这款大参数的293B版本又能交出怎样的答卷?恰逢其时,该模型的API还推出了限时五折的优惠活动,我们便通过官方接口接入了相关框架,开启了一场全方位的测试。
我们设计了四道递进式的测试任务,从创意落地到复杂办公场景,再到专业研究与轻量化官网搭建,全面验证这款模型从创意到交付的全流程能力:
- 将创意转化为可交互的3D互动网页
- 拆解专业财报并完成行业分析
- 处理多源研究数据并完成专业校验
- 为原创游戏设计可上线的官方网站
第一关:将中秋祈福的创意转化为可交互的互动作品
恰逢中秋佳节,我们以“中秋祈福”为主题,将金桂、星辰、圆月、阖家团圆等元素写入提示词,让模型直接生成3D粒子手势交互网页。
最终生成的网页效果超出预期:待机状态下,细碎的粒子如同桂花般在夜空中缓缓飘散;握紧拳头时,粒子会向中心聚拢凝结成一轮圆月;比出“1”的手势,圆月会散开并重组为可旋转的立体文字“中秋快乐”;切换到“2”的手势,粒子又会丝滑地排列成“阖家团圆”的字样;松开手掌,所有祝福都会化作漫天星辰四散开来。
整个交互过程流畅自然,如同小时候玩的“报数抱团”游戏,只不过这次的参与者是一群亮晶晶的“赛博小精灵”。我们还基于这个思路制作了《月宫快递》小游戏,玩家操控太空小兔抢夺月饼,率先收集更多月饼的玩家就能登上月球,成为“广寒宫首席快递员”,不少朋友试玩后都直呼过瘾,中秋氛围直接拉满。
第二关:复杂办公场景的高效落地
英伟达Q2财报在周三凌晨四点发布,61页的硬核财报内容让不少上班族望而却步,我们便将这个任务交给了星火X2.5,要求其提炼关键数据并制作可视化图表,同时解读数字背后的行业机会与风险。
仅用了半小时早会的时间,模型就完成了9份专业图表与1份投研风险简报。以FY2027 Q1为例,营收、利润、净利润等核心数据都准确对应,未来承诺的结构也一目了然。原本需要耗费数小时啃读的财报,现在只需要通过模型生成的可视化内容就能快速掌握核心信息,大幅降低了信息获取的门槛。
第三关:专业研究与多源数据校验
我们将两篇来自顶级学术期刊的论文、一篇行业新闻报道以及20份模拟问卷数据全部交给模型,要求其围绕“经常使用AI的科研人员工作效率是否更高”这一问题完成实证研究,并生成带有可视化图表的初稿。
模型不仅快速完成了资料整合与交叉校验,还敏锐地发现了我们没有说明的细节:它主动提醒我们在给出研究结论时需要谨慎,因为我们提供的数据集存在样本量不足、未设置控制变量等问题。在忽略这个提醒继续推进后,模型最终得出了“经常使用AI的科研人员在产出数量与评价效率上更高”的方向性结论,并配套生成了“不同AI使用频率的科研人员产出数量对比图”“AI日均使用次数与工作效率的散点关系图”以及“问卷描述统计与相关系数表”等可视化内容。
为了进一步测试模型的数据校验能力,我们故意将薯片电商的营收数据算错,将数据截图嵌入Word文档中,不提供原始Excel表格。没想到模型不仅没有被难住,反而精准找出了数据集中的统计bug,随后还将分析报告转化为了格式规范的可视化PDF文档。
第四关:原创游戏官网的快速搭建
最后,我们尝试为原创奇幻动作游戏《堕神余烬》设计官方网站,提供的世界观背景包括诸神陨落后的破碎世界、玩家穿越危险区域揭开真相的剧情,以及网站需要传递黑暗宏大的氛围、适配游戏玩家与独立开发者两类用户的目标。
模型生成的官网不仅准确贴合了游戏的暗黑奇幻世界观,还包含了导航栏、首页海报等基础组件,更惊喜的是专门设计了闯关地图与Boss专题板块,将关卡设定与“失控神力·神骸污染”的底层世界观深度结合,而非简单罗列内容。同时,玩法介绍、跳转入口等上线必备的合规组件也一应俱全,对于没有专业设计与前端团队的独立游戏开发者来说,这种快速生成可上线官网的能力无疑极具价值。
四道测试通关,验证了从创意到交付的全流程能力
四道测试任务完成后不难发现,这款模型的核心能力已经从单纯的问答交互,升级到了从创意落地到完整交付的全流程支持。这并非偶然,而是行业发展的必然趋势:今年以来,从智能体工具的普及到Agent工程化的讨论,整个AI行业都在从“会聊天”转向“会干活”,能够承接完整任务并交付最终成果的模型,才是真正符合产业需求的产品。
回顾星火系列的迭代历程,也能看到这条清晰的升级路线:X1版本率先突破深度推理能力,X2-Flash加码代码与智能体功能,X2-VL补上多模态理解能力,到了X2.5版本,代码与智能体能力更是被放在了核心位置,从“会思考”到“会看、会动手、会交付”的能力拼图已经完整。
除此之外,星火系列还有一个鲜明的特色——全链路全国产算力支持。与仅将训练好的模型适配到国产芯片的做法不同,星火从模型训练、强化学习、持续迭代到推理部署,整个流程都基于国产算力平台完成。这种从底层原生构建的能力,在智能体规模化应用的当下显得尤为重要。
智能体并非一次性任务,而是需要持续更新迭代的服务,模型需要根据实际使用中的需求不断优化。仅做推理适配只能解决当下的问题,而打通训推全链路才能形成闭环:将实际应用中的新需求反馈到训练端,让升级后的能力快速回到应用场景中。根据2025年8月国务院印发的《关于深入实施「人工智能+」行动的意见》,到2027年新一代智能终端、智能体的应用普及率将超过70%,当智能体真正实现规模化落地,持续的算力需求就像水电一样不可或缺,全国产算力方案的价值也会愈发凸显。
近期有消息显示,国内头部开源模型企业计划部署至少16万颗国产AI芯片,虽然消息尚未完全证实,但已经能看出行业的转向趋势:国产算力正在从备用选项转变为核心资源池。而科大讯飞早在2023年就推出了“飞星一号”国产算力平台,并发布了全链条自主可控的星火大模型,如今已经在全国产算力上迭代了多个版本。根据科大讯飞2025年度业绩说明会披露的数据,其MoE模型在国产算力上的训练效率,从开箱状态下的30%提升到了93%,这背后离不开算子适配、集群通信、专家路由等底层技术的持续打磨。
当行业集体转向国产算力布局时,讯飞已经积累了多代模型的训推经验,能够将更多精力投入到模型的落地交付能力上,这正是提前布局带来的先发优势。
星火X2.5的发布,恰好将当前AI行业的两条核心主线拧合在了一起:智能体从尝鲜走向规模化交付,国产算力从适配模型走向支撑真实应用。模型上线只是第一步,能够稳定交付完整成果才是真正的实力体现,而星火X2.5已经交出了一份令人满意的答卷。
想要体验这款模型的开发者,可以通过官方渠道访问:https://maas.xfyun.cn/modelSquare

