阶跃星辰Step5 Preview:UI能力比肩第一梯队的国产AI

最近在测试多款新晋AI模型时,阶跃星辰推出的Step 5 Preview给了我不少惊喜。这款模型在UI设计领域的表现已经追平了行业第一梯队,甚至在部分场景中展现出了更具性价比的优势。
根据公开的测试数据,该模型在行业评测中直接攀升了13个名次,与国内头部模型和海外知名模型的表现持平,而其使用成本仅为同类产品的三分之一。特别是在前端UI开发场景中,这款模型用更低的成本实现了一流的效果。
先从最直观的页面复刻测试说起。我们仅用一句简单的提示词,就让模型生成与官方网站高度一致的页面。比如尝试复刻苹果官网首页,仅用四分半钟就完成了完整页面的生成,包含导航、产品展示、按钮交互等所有元素,生成的页面AI痕迹极轻,细节还原度拉满。
对比另一款主流模型的测试结果,Step 5 Preview在图片素材保留和页面细节上都表现更出色,最终生成的页面与官方网站几乎完全一致,从导航栏到产品卖点的排版都精准还原。
当结合专业设计技能包后,这款模型的表现进一步提升。我们将行业常见的落地页设计、信息架构等专业技能导入后,模型不仅能快速生成符合设计规范的页面,还能自动添加动态背景和特效,无需额外手动调整。
更换不同的设计任务后,模型依然能保持稳定的输出质量,整体风格统一,排版细节到位,没有出现字体不一致、间距错乱等常见问题。无论是波浪形的动态页面设计,还是其他风格的落地页复刻,模型都能一次完成高质量的输出。
除了静态页面设计,我们还测试了模型的游戏开发能力。让其生成一款横版动作闯关游戏,模型快速完成了包含角色移动、跳跃、攻击、敌人巡逻、金币收集等完整功能的游戏代码。
生成的游戏操作流畅,画面风格复古有趣,虽然细节上还有优化空间,但整体游玩体验已经相当不错。我们还尝试将经典贪吃蛇游戏改为3D多视角版本,模型同样快速完成了代码实现,视角转换流畅自然。
在日常办公场景中,Step 5 Preview同样表现出色。我们让其从72页的PDF文档中提取关键财务数据,模型逐页定位文档内容,准确识别出利润表和现金流量表中的数字,排除了同名干扰项,清晰整理出了财务数据的对应关系。
我们还将一个包含14张工作表、1800多条公式且存在循环引用的损坏Excel模型交给它修复,模型先梳理了工作表之间的关联逻辑,最终找出了五大类共22个单元格的错误,并且对不确定的问题进行了标注,提供了详细的修复建议,而非擅自修改。
创建一个名为 `apple` 的文件夹,并创建一个 HTML 文件,其内容与官方商店页面完全一致,使其与官网保持同步。
总的来说,这个新模型前端复刻效果不错,而且放到现有的Agent框架也不会出现水土不服的情况,理解技能包的能力很强,执行过程中对长上下文的理解,或者做一些应用操作,比如批量开关文件,浏览器操作,都是可以的。
作为一款兼具性能和成本优势的模型,Step 5 Preview在当前的AI模型市场中展现出了很强的竞争力。从前端设计到办公自动化,从游戏开发到内容创作,这款模型都能稳定输出高质量的结果,甚至在部分场景中超出预期。
更值得一提的是,国产AI模型正在从少数头部玩家转向百花齐放的局面,越来越多的优质模型开始崭露头角,为行业带来了更多选择。
请使用纯 HTML5 Canvas 和 JavaScript 编写一个自包含的单文件 2D 动作平台网页游戏。玩家支持左右移动、跳跃与近战攻击。设计一个包含多层跳台、深渊坑洞、可收集金币及通关终点的完整关卡,并加入至少两类具有巡逻逻辑且触碰造成伤害的敌人。实现重力物理、AABB 碰撞检测、平滑镜头跟随、生命值、计分板、受击击退与无敌帧反馈,以及死亡重开与胜利结算界面。整体要求无外部依赖,在浏览器本地打开即可流畅游玩。
测到这里,我想说个更大的感受。以前提到做前端、做游戏、跑Agent这些活,大家第一反应都是那几家模型。但这回测下来,阶跃星辰是真的有点超出我的预期。
至少在今天测的这些任务里,它不光能做,而且有些地方做得还真挺不错。放到现在这一批模型里,也是完全能打的。而且你能明显感觉到,现在能打的国产模型,正在从几家变成一批。
以前是我们追着别人的发布会看,现在自己家里,也有越来越多拿得出手的东西了。阶跃星辰加油,国产模型也加油。

