文章摘要
近期使用AI编码工具问题频出,如Codex对话历史丢失、使用限制调整等,GPT-5.6Sol的xhigh档位表现下滑。44分钟的OpenAI访谈披露核心信息,包括下一代模型规划、Agent框架方向、额度重置原因等。ChatGPT和Codex将合并,下一代Agent目标明确。此外,模型速度提升,Tibo分享创业建议,最后有人考虑囤国产模型开发计划。

近期使用AI编码工具时遇到了不少麻烦:不仅Codex的对话历史频繁丢失,好几次十几轮的对话记录直接消失,还有官方调整了使用限制,Plus用户的5小时使用限制重新恢复,且没有提前缓冲时间,Pro用户则暂时没有时长上限,不少用户都需要熬夜刷取使用额度。

除此之外,GPT-5.6 Sol的xhigh档位近期表现下滑,执行任务时只会生成测试代码,连skill加载都会失败。为此调整了工作流,要么让fable5生成执行计划并启动子agent调用Codex完成任务,要么让5.6 sol high档位生成计划,交由5.6 sol medium档位执行,这套组合的运行速度和输出质量都没有受到明显影响。

官方相关的最新动态来自一则44分钟的访谈,披露了不少核心行业信息,包括下一代模型Astra(也可称为GPT6)规划、Agent框架发展方向以及用户额度重置的原因。

访谈中聊到了下一代Agent的形态:当前Codex用户已经习惯了复杂的操作设置,维护skill时可能丢失长期记忆,使用多Agent工作流还要单独规划子agent的运行逻辑,不少开发者都吐槽这套流程过于繁琐。而OpenAI的下一代Agent目标非常明确,会深度理解用户的目标并主动行动,不需要用户再去管理底层的运行结构。

访谈还拆分了两个Agent的发展方向:一类是personal AGI,会深度熟悉用户的使用习惯,和用户协同完成各类日常任务;另一类是full automation全自动化模式,可以主动从生产日志中发现并优化性能问题,将风险暴露的时间压缩到接近零。

另外,ChatGPT和Codex将会合并为同一个personal AGI应用,所有用户使用的底层架构都是统一的,只是根据不同的工具调用和任务类型做差异化适配。

访谈中也聊到了Tibo频繁重置用户额度的原因:最初是因为模型迭代速度太快导致功能出现故障,通过重置来补救,后来慢慢演变成了社区里的常规操作。有趣的是,这个决策并没有复杂的审批流程,不需要向上级申请,只要觉得需要重置就可以直接操作,甚至还专门设置了实体的重置按钮。

除了额度调整,模型的运行速度也在持续提升:13号刚推出了基于Cerebras硬件加速的GPT 5.6 Sol版本,Ultra Fast模式下的处理速度可以达到标准模式的14倍,每秒能生成750个token。Tibo预计,1到2年内这种速度将会成为模型的默认运行标准。

访谈中Tibo还分享了给创业公司的建议,核心非常简单:尽早获取真实的用户反馈,并根据反馈快速迭代产品。OpenAI本身也是如此,在训练出新模型后,内部会进行大量的实际使用测试,在使用过程中发现新的使用场景,从而调整产品的发展方向。

感慨之下似乎又能理解OpenAI的一些操作了,但转念又想到月底Claude Code的50%周增量额度就要过期,于是打算多囤一些国产模型的coding开发计划,甚至还调侃不如组队去偷按Tibo的重置按钮,目前进度是1/1000。

以上内容不代表本平台立场,仅供读者参考