OpenAI深夜认怂!GPT-5.6 Sol遭实锤偷偷调参,上下文缩水与思考预算降级内幕曝光

不少重度开发者在周末使用 Codex 赶工时,纷纷察觉到了一件怪事:旗舰模型 GPT-5.6 Sol 的运行速度似乎变快了,但吐出的代码质量与推理深度却大打折扣。随后,多张对比截图在社交平台 X 上疯传,直指 OpenAI 偷偷调整了后台参数。

舆论发酵后,OpenAI 负责 Codex 与 ChatGPT 业务的员工 Tibo 连夜发帖回应,公开承认了进行过参数调整并宣布回退。这场“模型被削弱”的疑云,最终以官方罕见的公开认账告终。

🔍 网友晒图实锤:思考预算被悄悄“拧小”

事件的起因在于用户发现 Sol 模型的推理力度出现了明显下滑。几位核心开发者通过数据对比,揭开了后台模型调参的秘密:

  • 推理档位被整体下调:有网友指出,GPT-5.6 Sol 的 思考预算(juice values)相较于发布之初已被大幅调低。这导致原本开 Extra High 档位就能解决的难题,如今必须开到 Max 档位才能勉强达到相同的效果。 降级后的旗舰版 Sol,其思考预算甚至一度输给了未被调整的 Terra 和 Luna 档位。
  • 用速度掩盖质量流失:模型看似响应更快、表现更“高效”,本质上是因为精简了底层的思考步骤。这种“偷工减料”的做法瞬间引发了订阅了高价套餐用户的广泛不满。

📢 OpenAI 官方连夜回应:承认实验并回退参数

面对激烈的社区质疑,OpenAI 官方员工 Tibo 紧急发布了更新清单,正面回应了用户的猜测,并列出了以下调整:

1. 撤销思考预算(Juice Values)实验

官方承认为了排查额度异常扣除的原因,曾对底层的推理力度进行过调整实验,目前这些调整已全部撤回,模型推理能力正在恢复。

2. 上下文窗口紧急回退

Sol 的 上下文窗口 此前从 272k 提升到了 372k,但由于实际产生的额度消耗远超预期,官方已将其临时退回至 272k,并承诺在后续几天优化后重新开放。

3. 多智能体及自动审核Bug修复

在 High 和 XHigh 档位下,多智能体(Multi-Agent)的额度消耗存在异常。此外,Auto-Review(自动审核)机制也存在冗余开销,官方正在全力修复。同时,5小时的免费限额暂时继续不生效,并为所有 Sol 订阅用户提供约 10% 的可用额度回馈作为补偿。

🧮 额度蒸发背后:开发者的“账单分析”

除了模型降级,不少用户还遭遇了额度加速消耗的现象。开发者 Theo 对此进行了解密,指出额度异常消耗是由多重因素叠加导致的“套娃”现象:

{
  "billing_issues": {
    "reasoning_rate_multiplier": "2.0x",
    "multi_agent_nesting": "Ultra nesting sub-agents",
    "context_handling": "Copying long local context repeatedly",
    "fast_mode_multiplier": "2.5x"
  }
}
  1. 双倍计费与快速模式叠加:基础推理计费本身存在翻倍,而在开启快速模式(Fast Mode)时,计费会再乘以 2.5 倍。
  2. 子代理长上下文复制:在使用中,多智能体嵌套运行会在子代理之间反复复制超长的本地上下文,直接导致 Token 消耗呈指数级上升。

💡 用户应对与优化建议

针对当前的模型状态,建议开发者在日常调用时采取以下策略以节省成本并保证产出质量:

  • 合理评估推理档位:在官方彻底修复思考预算前,建议根据任务难度手动调节档位,避免盲目挂机高档位造成额度浪费。
  • 监控 Prompt 上下文长度:在编写长代码或分析大文档时,主动控制输入上下文,防止触发因窗口缩水导致的阶段性截断问题。
  • 暂缓重度多智能体并行任务:鉴于 multi-agent 仍存在计费偏高的Bug,可将复杂任务拆分为单次 Prompt 依次调用,直至官方补丁完全实装。

关联文章推荐

关联问答推荐

文章评论

登录后才能发布评论哦
立即登录/注册
还没有评论,快来抢沙发吧~
消息提醒
Hello, world! This is a toast message.