文章摘要
如今AI生成定制化3D交互场景门槛大降,此前小型团队数周才能完成的项目,现在十几美元就能一键实现。研究者用约10美元让Opus 5将文学文本转化为可交互三维场景,虽成品粗糙但完成度和趣味性值得关注。该测试引发跟进,未来大模型或按需生成临时虚拟世界,但目前大模型难自主检查成果。

曾经用来测试AI模型能力的鹈鹕骑自行车实验,已经不足以体现当前大模型的进展了。如今AI生成定制化3D交互场景的门槛已经低到令人惊讶的程度。曾经需要小型开发团队花费数周才能完成的个性化虚拟项目,如今仅需十几美元的成本就能一键实现。

有行业研究者开展了一项突破性的AI模型测试,他们将一段经典奇幻文学的开篇文本交给Opus 5,仅提出一个使用Three.js将这段文字转化为可观看、可交互的三维场景的要求,并提供了约百万Token的计算预算,总成本仅约10美元,甚至这笔预算还能买到打折的休闲游戏。

整个生成过程持续了近两个小时,最终AI产出了超过5500行代码。这套代码并非简单的网页框架,而是一套完整的3D场景搭建逻辑:模型首先需要精准理解原文描绘的环境与叙事情节,创建出角色、建筑、植被等多边形模型资产,再将这些元素按照故事的叙事逻辑放置到三维空间中,为每一个对象设置精准的x、y、z空间坐标。

除此之外,模型还要完成镜头视角规划、角色动作设计、动画脚本编写等工作,让整个场景能够按照原文的叙事顺序自然运转,形成一个可以互动的小型虚拟世界。

不过最终的成品效果并不算精致,整体带着明显的粗糙感,部分场景甚至带有一定的抽象视觉效果,但整体的完成度和趣味性依然值得关注。毕竟在几年前,这样一个基于小说文本的交互式3D场景,还需要一个小型开发团队花费数天甚至数周的时间才能完成。

这项测试公开后,引发了不少爱好者的跟进尝试:有人基于这套思路制作了增强版的场景,还有人将测试文本替换为其他经典IP的内容,比如热门的哈利波特系列的开篇,生成了对应的3D交互空间。

这项实验的有趣之处在于,在传统开发流程中,手写数千行高度定制化的代码,往往需要投入大量的时间和精力,投入与产出严重不成正比,很少有人会愿意为这样个性化的小项目花费数周时间。但大模型完全没有这样的顾虑,只要计算预算允许,它就可以反复创建模型、调整坐标、补充动画逻辑,不断检查程序运行状态并进行优化。

基于这样的技术进展,研究者进一步畅想,未来的大模型或许可以实现按需生成临时虚拟世界。用户只需要输入一个主题,比如一段小说、一部电影的剧情,甚至是自己脑海中的想象场景,就能在短时间内生成一个专属的、可探索可交互的游戏空间。

用户可以以旁观者、NPC甚至故事主角的身份进入这个世界,体验完全定制化的虚拟场景,就像加载一个专属的“临时GTA”一样,只属于你个人的虚拟世界会在等待片刻后自动生成。

不过这项实验也暴露了当前大模型的一个明显短板:虽然它们可以轻松生成游戏相关的代码,却很难自主检查最终的工作成果。目前的大模型还无法高效原生地感知视频内容,也很难真正参与并理解一段游戏的运行过程。

对于普通的代码调试,模型可以通过读取报错信息、分析日志文件,根据文字反馈进行修改,但在3D虚拟场景中,模型无法直观看到场景是否存在穿模问题、角色是否站在正确的位置、镜头是否被障碍物遮挡、动画效果是否自然流畅。

在本次测试中,大模型只能通过在不同阶段截取静态画面,再基于这些图片进行缓慢的调整,整个过程耗时且容易出现判断失误,最终生成的场景中依然存在不少错位、碰撞细节和粗糙的视觉效果。

但无论如何,这项实验依然证明了AI生成定制化虚拟内容的巨大潜力,曾经只有专业团队才能完成的高度定制化项目,如今已经变成了一项低成本的即时任务。对于等待大型游戏上线的玩家来说,甚至可以先体验一下基于经典IP生成的迷你虚拟场景,比如基于经典奇幻故事打造的霍比屯微型世界。

以上内容不代表本平台立场,仅供读者参考