GPT-6实测:多场景能力追平Claude了吗?

最近在体验新一代AI模型时,我先遇到了一个让人哭笑不得的界面设计问题。原本以为推理强度档位有六档,结果实际只有轻度、中、极高三个选项,滑动进度条的时候还会出现重复显示的情况,滑到最左边甚至直接降级到旧版本。切换英文界面确认后发现,这个设计确实存在逻辑问题,不知道是哪位设计师的创意。本来还以为能拿到好几天的重置额度,结果模型只推迟了一天就全量上线了,心情真是在开心和失落之间反复横跳。
这次重点想测试的是备受好评的电脑自动化功能,于是我拿出了两周前花77元买的外置键盘,上面带有三个自定义按键,常规设置是一键唤起对话工具、语音输入和发送消息。之前用旧版本配置时踩了不少坑,系统分不清全局唤起和应用内新建对话的区别,把应用内快捷键写到了全局映射里,导致不在对话界面时键盘完全没用,最后只能手动修改。但这次新版本只用了41秒就完成了全部配置,甚至不需要我手动调整快捷键,直接一次性搞定。
接着我又尝试用同款方式配置高端鼠标,选的是售价499元的MX Anywhere 3s,属于500元预算内的顶级外设。这次需要设置14个不同功能,属于相当复杂的软件界面操作,我让新版本帮忙完成配置,连配套的Logi Options软件也是它帮忙安装的,彻底体验了一把“懒人式操作”。最终除了在对话工具内做语音唤醒需要额外录入一组组合键外,整个配置过程毫无压力,它还自动为浏览器、办公软件和对话工具设置了不同的快捷键组合,比如按后退键可以截图粘贴到对话工具,前进键直接唤起语音输入,滚轮按键则可以快速唤起对话工具,甚至能在8个基础选项上拓展出4个AI应用的跳转菜单,整体体验比77元的键盘好太多。
接下来是经典的3D建模环节,最近看到不少让人惊讶的AI建模案例,于是我让新版本帮忙制作一个海盗船模型。令人惊讶的是,整个过程只用了不到10分钟。一开始我还怀疑它是不是偷偷联网下载了现成组件,结果反问它制作逻辑时,它明确表示没有使用现成船模,也没有用图片转3D技术,还详细说明了每个部件的生成方式:比如木板和绳索的生成逻辑、用圆柱和圆环组合搭建结构,甚至给炮管做出了空心的炮口细节,这个表现完全超出预期。
在3D建模之外,新版本的视频生成能力也有明显提升。之前用白模视频就能生成类似《秒速5厘米》的画面,通过简单的几何形状就能控制视频里的空间关系、镜头移动和物体交互。我让新版本制作一段15秒的3D物体上下楼梯的镜头,它给出的解决方案是先搭建布景,再设置动作关键帧,由建模软件自动计算每一帧的移动,完全不用像我之前那样手动调整镜头逐帧渲染,效率提升非常明显。它的3D游戏制作能力同样出色,只用一句话就能把马里奥的三个关卡整合为一个星球形状的3D游戏,我还测试了自制的难度关卡:需要躲避BOSS的火焰球,趁BOSS矮化时跳到头上,不能碰到BOSS身体,这个关卡至今都没人能通关。
之前我尝试过不少AI剪辑工具,比如Remotion、hyperframes和ChatCut,它们虽然能剪掉冗余片段和添加动画,但做出来的视频达不到发布标准。我需要的是能贴合个人剪辑习惯的工具,比如在前5秒就抛出核心观点,用动画辅助说明而不是重复字幕内容。这次让新版本剪辑视频时,一共修改了三次:第一版参考了其他剪辑风格,几乎没有辅助素材,全是动画效果反而分散注意力;第二版去掉了所有动画,只保留原始素材,用力过猛;第三版的效果让我比较满意,处理竖版视频里的横版素材时,用上下拖动配合说明文字,对于小尺寸对话框素材,采用双层显示的方式,下层正常播放素材,上层拉大文字从左到右滚动,既能看到全局画面又能看清文字提示,整体达到了合格标准,紧急情况下制作30秒视频完全可以用,我也整理了对应的剪辑提示语。
你是一名短视频剪辑师。请根据我提供的 A-roll(人物口播)、B-roll(录屏、图片、视频)和剪辑文档,直接制作一版 9:16、1080×1920 的竖版视频,交付可播放的成片。 这条视频要让观众理解:【填写一个核心观点】 素材与文档:【填写路径或链接】 请按以下要求完成: 先理解内容,再安排素材。 看完剪辑文档,检查所有素材,建立“口播—对应素材—视觉处理”的时间线。优先遵守文档里的素材对应关系,尤其是开头。素材按表达需要使用,不必全部塞进去。涉及人物观点或外部案例时,查证原始出处。 人物在下、素材在上作为默认排版,随内容调整。 展示操作和证据时用分屏;强调观点、情绪和结论时,可以切人物全屏。录屏要裁掉无关区域、放大关键操作,并给观众足够的阅读时间。需要比较时,先左右展示,再进入局部细节。 人物独占画面时,也要有剪辑设计。 根据语义和重音加入轻推近、拉远、景别切换或关键词动画。让数字分拍出现、流程逐步展开、想法被删除或积累。避免长时间原片直放,也避免每句话都加特效。镜头移动要照顾人物位置,不裁掉脸部和重要手势。 字幕负责说清口播,动画负责补充理解。 不要在字幕之外,再放一大段同义说明。额外文字优先用于标记阶段、指出差异、说明关系或标注来源。保持字体、边框风格一致,避开人脸、字幕和平台按钮区域。 保证素材真实、声音清楚。 使用最高质量原片,保留自然口播;剪掉重说、无效停顿和明显口误。不要把示意动画包装成真实操作,也不要把个人感受包装成实测结果。 先自查,再交付。 检查开头是否用了正确素材、录屏在手机尺寸下是否可读、人物段是否有节奏变化、说明文字是否重复字幕、动画是否遮挡、音画是否同步。导出后做完整解码检查,并抽查关键画面。交付成片、时间线和可继续修改的工程或脚本。 你可以使用适合的剪辑工具和 Skill。请实际执行所用工具的工作流,简要说明用了什么、完成了什么;存在素材缺失或无法完成的部分时,如实说明。
最后我尝试用新版本美化之前分享过的PPT,因为模板限制不能修改背景和字体,也不能直接用图片生成或转HTML格式。之前用旧版本做的PPT排版很糟糕,内容都缩在角落,没有铺满整个页面,完全没掌握人类做PPT的精髓,比如三列布局会歪歪扭扭堆在左上角。新版本第一次输出的效果更差,我明确要求调整排版不要堆在角落,不要让文字颜色和背景重叠,最终版本如果作为纯PPT文件,我能给到6到7分。它为了适配不同背景颜色,采用了黑色蒙版加白色文字的组合,虽然还是喜欢加很多多余的文字,但比起旧版本已经有了明显进步。
最后回到最开始的界面问题,很多人都会问这次新版本的UI有没有超过竞品。我的答案是暂时还没有,但已经进步了不少。在不使用任何额外工具的情况下,新版本的技能合集网页动效很丝滑,但封面图的搭配很奇怪,详情页也有不少冗余内容。而竞品的设计则更成熟,之前我们把热度最高的案例作为技能封面,会导致在案例库和技能库重复出现时让人困惑,竞品这次采用了三张图合并展示的方式,既保留了高热度案例作为代表作,又通过视觉语言体现出这是一个合集,整体设计语言和内容呈现都比新版本更出色。
写到这里我的对话工具额度已经用得差不多了,真的希望能多囤点重置额度,不用再看竞品的界面。

