
OpenAI已经为所有ChatGPT Work和Codex用户重置使用限制,并针对GPT-5.6 Sol“额度消耗快于预期”的反馈公布首轮优化结果。OpenAI Codex负责人Tibo Sottiaux于2026年7月28日太平洋时间晚间在X表示,公司没有下调任何订阅套餐的使用额度;完成多项改进后,典型Sol用量预计可比优化前多维持约18%,部分用户从当天起会看到更明显的改善。
这条消息真正值得关注的,不是用户临时多获得了一轮额度,而是OpenAI首次较完整解释了高能力Agent模型为何会出现“同样一条任务,限额掉得更快”的体验:Sol更愿意延长任务、追加工具调用、协调子Agent;相同推理等级下,它也可能比GPT-5.5消耗更多Token。code mode带来的并行工具调用和等待期间继续工作,又放大了响应次数与缓存输入Token。
因此,18%不是套餐永久提额,也不是每名用户都会固定多出18%的消息数。它是OpenAI对“典型使用”的预期效率改善,实际结果仍取决于上下文、推理强度、工具数量、网页搜索、缓存输入和任务长度。对TOPSTIP读者最有用的结论是:Agent能力越强,消息数越不能代表真实成本;模型是否会主动扩展工作范围,已经成为用量管理的一部分。
这次究竟重置了什么,又没有改变什么?
Sottiaux的原帖明确写道,他已经为“所有ChatGPT Work和Codex用户”重置使用限制。这意味着适用用户当前的用量窗口获得刷新,但原帖没有宣布新的套餐价格、永久增加基础限额,也没有说每名用户都得到一张可保存到未来兑换的banked reset。
这一区别很重要。即时重置会改变当前窗口剩余额度,用户继续使用后,余额仍会再次下降;banked reset则通常是一份可在以后主动使用的恢复机会。此次公开表述只支持前者,不能把它写成“OpenAI永久涨额度”或“所有账户获赠额外长期配额”。
OpenAI当前Codex定价文档也确认,ChatGPT Work与Codex共享同一套价格、Credits和用量限制。因此,在ChatGPT Work中运行长任务,会影响同一账户继续使用Codex的空间,反之亦然。这次统一重置同时覆盖两个产品入口,正是因为它们并不是两份互不相干的额度池。
18%改善不是提额,而是同一额度完成更多工作
OpenAI给出的口径是,完成若干改进后,用户在“典型Sol使用”中的额度预计可多维持约18%。这更接近单位任务Token成本下降,而不是订阅账户的名义上限上调。假设一个用户此前在相同工作方式下很快耗尽五小时窗口,优化后可能完成更多任务;但后台限额规则本身并未因此被宣布扩大18%。
官方没有公开18%的样本规模、测试区间、任务分布或计算公式,也没有说明它是按Token、Credits、消息数还是完成任务数加权得出。因此,这个数字应被写成OpenAI的预期,不是独立基准测试,更不能保证每名用户都获得完全一致的提升。
Sottiaux还特别表示,部分用户可能看到“显著更大”的改善。原因在于问题分布并不平均:中位数用户使用Sol时其实相当节省Token,真正异常的是处理高难任务的长尾用户。OpenAI承认,团队在发布前更关注平均值和中位数,遗漏了少数复杂工作流可能消耗远高于预期的情况。
Sol为什么会比GPT-5.5更快消耗Codex限额?
第一层原因是任务行为。按照Sottiaux的解释,GPT-5.6 Sol更愿意工作更长时间、追加工具调用,并跨工具与子Agent协调复杂流程。这些行为提升了模型完成困难任务的机会,却也意味着一次用户消息背后可能发生更多模型响应、工具往返和上下文累积。
第二层原因是推理等级不能跨模型直接等价。OpenAI指出,Sol在同一推理强度下比上一代模型“工作得更努力”;Sol的High可能比GPT-5.5的High使用更多Token。用户虽然选择了同名档位,实际获得的推理深度和成本并不一定相同。把推理等级当成固定Token预算,会低估代际差异。
第三层原因来自code mode,也就是程序化工具调用。它让Sol可以并行运行多个工具,或者在等待某项调用完成时继续推进其他工作。这种执行方式减少了Agent空等的时间,却会产生更多中间响应和缓存输入Token。尤其在大量网页搜索或等待慢工具时,一次任务可能扩展成比用户界面上看到的对话轮次复杂得多的执行树。
五小时限制恢复,当前公开套餐能用多少?
Sottiaux表示,OpenAI曾在调查期间临时暂停五小时限制,并将在次日恢复。当前Codex官方定价文档已经重新列出共享的五小时窗口,同时提示还可能存在额外周限制。这说明五小时窗口是正常套餐规则的一部分,临时暂停不应被理解为永久取消。
按当前官方文档口径,GPT-5.6 Sol在Plus和Business套餐中,平均可支持约15至90条本地消息/五小时;Pro 5x约为75至450条,Pro 20x约为300至1800条。Enterprise和Edu如果使用灵活计费,消耗随Credits扩展;没有灵活计费的席位,多数功能采用与Plus相近的单席限额。
这些区间不是承诺的固定消息数。OpenAI明确说明,消息消耗取决于模型、任务规模与复杂度,以及本地或云端运行方式。小型脚本可能只使用额度的一小部分,大型代码库、长时间任务和持续扩张的上下文则会让每条消息消耗显著增加。额外的周限制也意味着,即使五小时窗口恢复,用户仍可能先触及另一层上限。
“消息条数”为什么越来越难预测Agent成本?
传统聊天产品容易让用户形成“一问一答算一次”的直觉,但Codex与ChatGPT Work执行的是多步骤任务。一条提示可能触发仓库检索、文件读取、命令运行、多个网页搜索、子Agent并行调查、代码修改、测试和失败重试。界面只显示一轮用户请求,后台却可能包含大量输入、缓存输入和输出Token。
OpenAI的Credits文档把GPT-5.6 Sol列为每100万输入Token消耗125 Credits、每100万缓存输入Token12.5 Credits、每100万输出Token750 Credits。官方同时给出GPT-5.6每条消息平均约5至40 Credits的宽区间。这个跨度本身说明,同样是“一条消息”,实际成本可以相差数倍。
输出Token价格权重高于输入,而Agent长时间规划、解释和生成代码会增加输出;大量工具结果反复进入上下文,又会增加缓存输入。code mode如果让多个工具分支继续推进,效率提升与Token增长可能同时发生。对用户来说,判断模型“划不划算”不能只看任务是否完成,还要看完成相同结果需要消耗多少共享用量。
哪些用户最可能感受到这次优化?
最可能明显受益的是Sol的高强度用户:让Agent跨多个代码库或数据源调查、启用多个子Agent、进行大量网页搜索、等待慢工具,或者在High推理档位运行长任务的开发者。这些正是OpenAI所说的长尾场景,也是发布前平均值最容易掩盖的部分。
只用Sol完成短代码修改、单文件分析或少量工具调用的中位数用户,原本可能就没有严重的异常耗额,因此提升未必达到“显著”程度。18%的典型改善也不应反推为每个简单任务都固定少用18% Token;调度、缓存与工具等待优化对不同任务结构的影响会不同。
团队用户还需要注意共享入口。ChatGPT Work与Codex使用同一用量体系后,研究、文档、数据分析和编码任务可能共同竞争一个席位的额度。企业在评估容量时,应把跨产品工作流放在一起测量,而不是分别观察两个界面的消息数。
OpenAI的解释为何比一次补偿更重要?
重置用量能立即缓解用户不满,但不能解释为什么问题发生。Sottiaux这次公开承认,能力与效率不会总是同步进步,部分问题只有在真实规模使用后才暴露;团队本应更早识别,并更透明地说明。这比笼统地说“正在优化”提供了更多可验证的产品信息。
它也暴露了Agent评测的盲点。发布前如果主要观察平均与中位用量,模型在最复杂10%甚至1%任务中的成本爆发可能被隐藏。然而,高强度长尾用户恰恰是最愿意为前沿编码Agent付费、也最可能把它接入生产流程的人群。只优化典型用例,会让旗舰能力在最重要的场景中遭遇容量瓶颈。
对OpenAI而言,下一步不仅要降低平均Token成本,还要控制任务扩展的尾部风险:模型何时停止追加搜索、何时不再生成新的子任务、等待工具时是否重复响应,以及并行分支如何共享上下文。否则,模型越主动,用户越难预测一次任务会消耗多少额度。
用户现在可以怎样让Sol额度更耐用?
最直接的做法是给复杂任务设定清晰的完成条件和范围。限制需要检查的目录、网页来源或日期区间,说明必须交付的结果与可选工作,能减少Agent自行扩展搜索空间。对不需要最高推理深度的日常任务,使用Terra或Luna也能换取更高的可用量。
工具上下文同样需要管理。每个启用的MCP服务器都可能向请求加入额外说明和工具描述;不需要时关闭相关服务器,可以减少固定输入。大型AGENTS.md应按目录分层,让具体任务只加载相关规则。长任务则适合拆成可验证阶段,避免失败后从头重复全部上下文和工具调用。
用户可以在Codex用量面板查看当前限制,在CLI会话中使用/status检查余量。需要强调的是,这些方法是在既有额度内降低消耗,不是绕过平台限制。对于必须持续运行的自动化任务,API Key按标准API价格计费可能比依赖订阅窗口更容易做成本预算,但它是另一种计费方式,不属于本次重置。
下一阶段竞争将从能力跑分转向“每份额度完成多少工作”
GPT-5.6 Sol代表的是更主动、更长时间、更擅长跨工具协调的编码Agent,但这次事件说明,能力提升如果伴随不可预测的用量增长,会直接削弱产品价值。用户购买的不是抽象Token,而是在一个周期内完成代码、研究或业务任务的能力。
OpenAI此次没有下调套餐上限,却通过执行优化让典型用量预计延长18%,说明效率已经成为模型发布后的持续产品工作。重置额度是一次补偿;恢复五小时窗口是回到正常规则;真正决定Sol长期竞争力的,是复杂任务尾部消耗能否继续下降,同时不牺牲主动工具调用和多Agent协作带来的能力。
对用户最稳妥的判断是:这不是永久提额新闻,而是OpenAI修正旗舰Agent成本失控的一次公开说明。Sol仍适合最需要质量与推理深度的任务,但日常工作不必全部交给最高档模型。下一阶段Codex、Claude及其他编码Agent的比较,也不能只看谁解题更多,还要看谁能在同一预算、同一时间窗口内稳定完成更多真实工作。
信息来源
- Tibo Sottiaux:ChatGPT Work与Codex用量重置、Sol效率问题及18%改善说明
- OpenAI Codex官方定价与用量限制文档
- OpenAI:ChatGPT Work产品说明

TopsTip