OpenAI Codex 2000万用户,Ultra Fast重塑AI交互体验

在最新一期播客访谈中,OpenAI旗下Codex项目负责人Tibo分享了大量AI领域的核心干货,这位因经常亲自为开发者重置使用额度而被网友称为“赛博义父”的负责人,甚至专门制作了一个实体按钮,随时可以为受影响的用户调整额度,他也在访谈中自信表示“只要我想重置,随时都可以重置”。
Tibo全名Thibault Sottiaux,来自比利时,本科毕业于鲁汶天主教大学应用数学专业。2015年他加入大型科技公司,最初参与地图相关工作,之后进入DeepMind负责AI研究基础设施建设,参与支撑了包括AlphaGo在内的多个前沿AI项目。2024年他加入OpenAI接手Codex项目,随着AI编程浪潮兴起,Codex成为OpenAI增长最快的产品之一,Tibo也因此进入开发者视野。
这场访谈覆盖了OpenAI的产品文化、下一代智能体、Ultra Fast极速模式、未来人机交互、前沿模型训练暂停等多个核心议题,几乎涵盖了当前AI领域的热门方向。
访谈中Tibo首先回顾了自己在DeepMind的经历。早在ChatGPT面世的前一年,DeepMind团队就已经开发出了LM Chat这类内部语言模型对话工具,当时团队已经萌生了将其推向公众的想法,但母公司整体过于保守,阻止了这类可能冲击现有业务的产品落地。对比之下,OpenAI的文化更注重快速交付产品,研究与产品团队紧密协作,能够快速将想法落地并推向用户,这也是他选择加入OpenAI的重要原因。
他还提到,OpenAI的文化自下而上且充满赋能性,每个人都可以提出创意并快速推进,同时也注重保持产品的简洁性和高质量,比如ChatGPT的iOS应用就被他认为是市面上顶尖的产品之一。对于创业者,他建议要坚定信念,贴近用户快速迭代,同时敢于颠覆自身现有业务,拥抱未来的变化。
当被问及公司成熟后如何维持创新文化时,Tibo表示OpenAI始终面向未来布局,不会被短期的现金牛业务束缚。团队会通过实际试用模型来挖掘其真实能力,而非仅依赖基准测试,比如新推出的语音功能就彻底改变了团队的日常工作流,现在他经常通过语音向AI下达任务,高效完成多项工作。
关于下一代智能体,Tibo提出了核心观点:当前的智能体发展方向不该是堆砌更多技能、记忆或子智能体,而是让这些机制“消失”。用户真正需要的是一个能够持续理解自身目标、日常工作和团队上下文的伙伴,而非需要不断管理技能文件、记忆库和智能体网络的工具。他还指出,笔记本电脑将成为AI智能体的新瓶颈,下一代智能体必然会走向云端,依托更大规模的计算资源运行。
他进一步解释,目前很多开发者会同时运行10到15个智能体,本质是用并发来弥补模型响应速度不足的问题。而Ultra Fast模式将响应速度提升到接近人类思考的水平,届时开发者的工作流将回归实时交互和心流状态,无需频繁切换上下文。
关于Ultra Fast模式,Tibo介绍了其实际应用场景。在内部测试中,该模式已经在高风险场景中得到广泛应用,比如事故响应团队会优先使用该模式,因为每一秒都至关重要。还有团队在推进关键项目时也会申请使用,比如为DevDay准备新功能的团队。
他还提到,Ultra Fast在工具调用较少、需要生成大量上下文的场景中表现尤为突出,比如快速搭建网站或游戏原型时,速度可以提升10倍左右;但如果存在大量工具调用,受网络或执行轨迹的开销影响,加速效果会维持在3到4倍。他自己患有注意缺陷多动障碍,习惯在上下文切换和大量小决策中找到状态,但Ultra Fast模式也能帮助他在需要专注于单一任务时保持心流。而主持人也有类似的神经发育差异,两人对Ultra Fast的需求也各有侧重。
他还提到,未来Ultra Fast的普及度会越来越高,一两年内可能成为默认选项,但始终会存在更高配置的溢价档位,满足对性能有极致需求的用户。同时OpenAI员工不会无限制使用Ultra Fast容量,大部分资源会留给外部用户和客户。
访谈中还谈到了ChatGPT与Codex的合并计划。Tibo表示,合并是未来模型发展的必然要求,两者最终会融合为一个高度个性化的AGI产品,不再区分“编程智能体”和“聊天助手”。未来的界面会根据用户的任务、能力和习惯自动调整,无论用户是否具备编程背景,都能获得贴合自身需求的使用体验。用户无需主动选择界面类型,系统会根据每个人的具体情况自动适配,因为用户的技能和需求本就是一个连续的光谱,而非简单的分类。
对于未来的人机交互,Tibo认为会更加自然和环境化,不仅会支持语音交互,还会感知更多非语言的交流信号,比如手势、面部表情等。当前ChatGPT的语音功能已经快速普及,越来越多的用户选择通过语音与AI互动,因为这比打字更加自然高效。未来的AI还会能够理解用户所处的环境,比如在办公室白板上写下的想法,AI也能够感知并提供帮助。
对于行业内的竞争,Tibo表示自己并不太关注对手,OpenAI的差异化优势不在于单纯追求模型更强,而是致力于将最强的AI能力交到尽可能多的用户手中。通过合并Codex并接入ChatGPT的庞大用户群体,OpenAI能够快速将AI编程能力普及给更多人群,包括产品经理、设计师、销售人员等非技术岗位的用户,这也推动了Codex用户量快速突破2000万。
他还提到,OpenAI非常注重社区建设,保持产品的透明度,从社区汲取创意并快速反馈,这种方式不仅能让产品更贴合用户需求,也能为团队带来更多能量。
关于广受关注的Codex额度重置,Tibo解释说,这最初源于团队在产品迭代过程中出现的故障或体验问题,为了补偿用户而提供的额度调整,后来逐渐演变为一种常态化的用户关怀措施。他拥有直接重置额度的权限,无需经过多层审批,核心原则是当产品未能达到预期时,及时为用户提供补偿。除了补偿故障用户,重置额度也会用于推广新功能,比如在Ultra Fast上线时,为用户提供额外额度体验新功能。而那个实体按钮,正是为了方便他快速完成额度重置而制作的。
他还提到了团队维护的趣味功能Codex Pets,虽然这类功能不算核心业务,但团队也会用心维护,比如他自己的屏幕上就一直显示着自己的Pet,在视频会议时也会出现,给团队带来不少乐趣。
关于算力规划和效率提升,Tibo表示OpenAI早在两年前就开始了大规模的算力投入,尽管当时曾受到质疑,但现在看来这是极具前瞻性的押注。当前OpenAI不仅用算力支持研究,还利用最先进的模型来优化基础设施、CUDA内核和推理栈,形成了“更强模型→更高效率→更多算力→更强模型”的递归自我改进飞轮。
比如Sol模型优化了Luna的运行效率,让Luna的价格下调了80%,这种效率提升不仅来自算法改进,也来自对技术栈的全面重构。在算力分配上,OpenAI会从第一性原理出发,为研究和产品分配资源,而效率提升后,相同的算力可以支撑更高的吞吐量,无需在各领域之间进行艰难的取舍。
访谈中还提到了OpenAI暂停前沿强化学习训练的决定。Tibo表示,这一决定主要出于安全和对齐的考量,随着模型能力增强,对齐和安全的重要性也越来越高,团队需要投入大量资源来加固系统的每一个环节,确保在恢复训练时能够完全掌控。这一工作由安全团队主导,通过逐步明确的原则来判断恢复训练的时机。
对于对AI感到紧张的公众,Tibo建议不必过度担忧,AI技术会随着时间变得越来越高效,成本也会不断降低,能够为更多人提供帮助。比如ChatGPT可以辅助写作、提供个人建议,甚至帮助用户准备就医时的信息,这些实用价值已经触手可及。他建议犹豫的用户可以从观察身边人的使用体验开始,逐步了解AI能带来的价值。
访谈的最后,Tibo还透露了一个最新消息:OpenAI将于次日恢复ChatGPT Plus用户的5小时使用限制,不过Pro套餐的100美元和200美元档位在未来几个月内不会受到该限制的影响。

