OpenAI 已经宣布了未来的安排, 在接下来的二十八天的时间里, 每天都会向使用 Codex 服务的用户和使用 Work 服务的用户推送一项内容明确具体的改进措施, 如果在某一天确实没有推出新的更新内容, 那么当天的用量额度就会直接被清理重置到零, 在第一天开展工作的过程中, Tibo 一个人就一次性交付了四项更新内容, 这全部的四项更新都是专门对准那些环节设计的, 目的是为了处理当 Agent 进入日常工作状态以后最容易碰到障碍从而卡住不能继续运行的地方。

01.GPT-6 默认速度提升约五成

第一天更新的情况里, 有一条内容是特别直观的。这条内容讲的是 GPT-6 Astra 和 GPT-6.1 Sol 这两款模型的变化。它们是在订阅体系之下进行更新的。

它们的默认推理速度提升了大概百分之五十。这个效果是不需要用户额外付费的。只要是所有订阅用户, 都会自动获得这个好处。得到的实际体验是等待时间变短了。

对于那种需要非常频繁进行调用的业务场景来说, 速度的变快, 是直接在减少用户在感觉上的等待时间。虽然 OpenAI 这个公司没有去公布具体的每秒处理请求数量的数据, 但是它选择把速度提升这一点放在第一天更新内容的最显眼的地方来告诉大家, 这样做, 实际上就是在向外界透露它内部关于重要程度的排序方式。

02.Auto-review 向所有用户免费开放

OpenAI把那个叫做Auto-review的功能免费开放给了所有登录了GPT的用户, 而且不再扣减大家使用的套餐额度了, 这个机制引入了第二层的Agent来进行自动审查, 这样做的目的是在触发那些高风险的操作之前, 就把相关的风险拦截并且确认好了。

当 Agent 连续进行数十分钟的运转时刻, 如果反复地手动去点击“批准”这个操作, 那么整个工作的节奏就会被严重地拖累。

而 Auto-review 这一功能是在用户和底层执行环节之间增加了一道自动进行的检查机制, 这样一来, 那些比较长的任务流程就能够顺畅地向前推进, 并且同时还保留了对关键行为的有效把控能力。

03.API 用量等级压缩为三层

OpenAI 把原本的五层的 API 用量等级, 压缩为三个等级, 并且降低了最高等级的进入门槛。只要达到规定的标准, 相关的组织就会被自动升级。这种变化意味着, 大家就不再需要去提交任何手动申请了。

对于正把应用从测试推向生产的开发者来说, RPM 与 TPM 扩容规则曾是实际瓶颈。层级减少意味着扩展路径缩短,开发者不必逐层排队审批。

04.Meetings 插件接入 GPT Space

Meetings 插件可在会议过程中记录内容,生成个性化总结与待办事项,直接存入 GPT Space。用户可设为私有或分享给团队,后续让 GPT 基于记录更新项目计划。

当前只有很少数的Enterprise客户参加了Alpha测试。这个功能让工作发生的时刻和AI获取上下文信息的时刻之间的距离变得更短了。这样一来, 会议的产出内容就会被自动地直接用作下一轮任务的输入材料。

05.Decisions API 进入公测

Decisions API 这个东西, 是靠着 GPT-6 Luna 来提供动力的。它接受文本和图片这些输入内容。它可以支持好几种功能, 比如请求路径的选择、工具的使用选择, 还有对内容的分类。

另外, 它还能对 Agent 这个动作的风险进行判断和评估。这些都属于三种不同的输出类型。现在的情况是, 这个服务已经对外开放了公有 beta 测试阶段。

OpenAI 演示数据所显示出来的情况是, 决策过程的延迟时间大概在 150 毫秒左右, 这一点跟使用 Responses API 去调用同一个模型所需消耗的 1.6 秒的时间相比起来, 速度要快大概 10 倍之多。

所以那些需要大量使用“判断下一步应该做些什么”的功能的调用操作, 可以分流到这类具有更低延迟特性的接口那里去进行操作。

06.不追参数规模 转向工作流细节

这四项更新有一个共同点, 那就是并没有去追逐那些单纯的模型能力指标。Agent 目前已经具备了写代码的能力, 也学会了怎么调用工具, 还能直接操作电脑。一旦真正地进入了高频的工作环境之中, 瓶颈就变成了权限审批的问题、API 扩容的问题, 也就是上下文搬运的问题, 还有简单判断的问题。

OpenAI 决定把这些卡点一个一个地解决掉, 而不是继续去堆叠参数。如果这个 28 天计划能够持续地兑现出来, 那么 Agent 产品的工作流程的成熟度, 就会成为下一阶段竞争的焦点所在。

你猜28天连更里头最管用的绝活是哪样好戏? 评论区里敞开聊, 若觉着中用就给个赞, 顺手转给做Agent开发的伙伴瞧瞧。