英伟达发布开源大模型Nemotron 3 Super

Codex 48 小时三连更:暂时取消 5 小时用量限制、Sol 变省、用户破 600 万

OpenAI · Codex · Codex 用量限制阅读时间: 5 分钟发表时间:2026.07.13
Codex 48 小时三连更:暂时取消 5 小时用量限制、Sol 变省、用户破 600 万

Codex 48 小时三连更:暂时取消 5 小时用量限制、Sol 变省、用户破 600 万

本站为独立第三方技术服务平台,提供多模型 API 聚合接入服务,与 Anthropic、OpenAI、Google 等模型提供商无任何关联、授权或合作关系。

OpenAI 产品与平台负责人 Thibault Sottiaux(Tibo)一早发了条动态,用他自己的话说,"过去 48 小时 Codex 和 ChatGPT Work 相当密集"。一口气三条更新,全是开发者关心的用量和成本话题。逐条拆一下。

核心要点

  • 临时取消 5 小时用量限制:面向所有 Plus、Business、Pro 计划用户,暂时性放开。
  • GPT-5.6 Sol 全面调优、更省用量:同样的额度能跑更多活儿,具体节省幅度官方称"待量化后公布"。
  • 活跃用户突破 600 万,随之而来的是一次即将生效的用量额度重置(发文时称约一小时内落地)。

详细解读

1. 5 小时用量限制"临时"取消

Codex / ChatGPT Work 之前有一个按时间窗口计的用量限制(5 小时一档)。这次针对 Plus、Business、Pro 三档订阅暂时移除了这个限制。

注意"临时"两个字——这更像是产能富余期的阶段性放开,而非永久政策。对重度用户是好消息:短时间内可以把手头攒着的重活集中跑完,不必再盯着时间窗口掐点。但别把它当成长期承诺来排产,官方随时可能恢复限制。

2. Sol 变"省":同样额度跑更远

第二条更新更有意思:OpenAI 在对 GPT-5.6 Sol 做全面效率优化,效果会体现在**"消耗更少用量、同样额度能走更远"**。换句话说,不是给你更多额度,而是让每一份额度更耐用。

对预算敏感的团队,这类"底层变省"的更新往往比涨额度更实在——它直接改善单位成本。不过官方明确说"具体影响待量化后再公布",所以现在别急着按某个节省比例去重排预算,等实测数据出来再调。

3. 600 万活跃用户,与一次额度重置

第三条是里程碑:活跃用户破 600 万。伴随增长的是一次即将落地的用量重置。增长这么快,重置和限制调整基本是同步发生的常态——供需一紧,政策就得跟着动。

这也解释了前两条为什么是"临时/待量化":平台在高速扩张期,用量策略是动态调的,今天放开的、明天可能收,反之亦然。

对开发者意味着什么

  • 订阅制的额度会波动。5 小时限制这次能临时取消,说明它也能随时回来。把关键生产链路押在"当前恰好放开"的额度上,风险不小。
  • "变省"是好事,但别提前 all in。等官方量化数据出来,再决定要不要把更多任务迁到 Sol,比现在拍脑袋靠谱。
  • 对冲额度波动,最稳的是留一条随时切换模型的通道。当某家模型限流、重置、或临时收紧时,能一行代码切到另一家继续跑,业务就不会被单一供应商的政策绑住。

在 Code0 上如何应对额度波动

Code0 是多模型聚合网关——一个 Key 接入 300+ 主流大模型,兼容 OpenAI SDK,按量即用、失败不计费。它不按"5 小时窗口"这类订阅额度计,而是按实际调用量走,天然不受某一家订阅政策临时变动的影响。

更实际的价值在"随时切换":同一段代码,只改 model 字段就能在 GPT、Claude、Gemini、DeepSeek 之间切换,某家临时限流时立刻换一家:

from openai import OpenAI

client = OpenAI(
    base_url="https://hk.code0.ai/v1",
    api_key="sk-你的Key",  # 在 console.code0.ai 获取
)

# 主用一个模型,遇到限流/额度问题就切备用
candidates = ["gpt-5.6", "claude-opus-4-8", "deepseek-v3"]

for model in candidates:
    try:
        resp = client.chat.completions.create(
            model=model,
            messages=[{"role": "user", "content": "你的任务 prompt"}],
        )
        print(model, "→", resp.choices[0].message.content)
        break  # 成功就停
    except Exception as e:
        print(f"{model} 暂时不可用,切下一个:{e}")

想切别的模型?改 candidates 列表即可,其他代码一行都不用动——这就是"一个 Key 通模"在额度波动期的价值。

具体可用的模型 ID、GPT-5.6 系列的上架情况与计费口径,均以 console.code0.ai 控制台的模型列表和文档为准。

总结

这波 Codex 更新传递的信号很清晰:在用户高速增长的阶段,订阅额度是动态调整的变量,不是常量。 临时放开的限制会回来,"变省"的幅度还没量化,重置说来就来。对开发者来说,与其押注某一家某一时刻的额度政策,不如把接入层做薄、留一条随时切换多模型的后路——让业务的连续性掌握在自己手里,而不是别人的用量看板上。