OpenAI深夜认怂!GPT-5.6 Sol遭实锤偷偷调参,上下文缩水与思考预算降级内幕曝光
不少重度开发者在周末使用 Codex 赶工时,纷纷察觉到了一件怪事:旗舰模型 GPT-5.6 Sol 的运行速度似乎变快了,但吐出的代码质量与推理深度却大打折扣。随后,多张对比截图在社交平台 X 上疯传,直指 OpenAI 偷偷调整了后台参数。
舆论发酵后,OpenAI 负责 Codex 与 ChatGPT 业务的员工 Tibo 连夜发帖回应,公开承认了进行过参数调整并宣布回退。这场“模型被削弱”的疑云,最终以官方罕见的公开认账告终。
🔍 网友晒图实锤:思考预算被悄悄“拧小”
事件的起因在于用户发现 Sol 模型的推理力度出现了明显下滑。几位核心开发者通过数据对比,揭开了后台模型调参的秘密:
- 推理档位被整体下调:有网友指出,GPT-5.6 Sol 的 思考预算(juice values)相较于发布之初已被大幅调低。这导致原本开 Extra High 档位就能解决的难题,如今必须开到 Max 档位才能勉强达到相同的效果。 降级后的旗舰版 Sol,其思考预算甚至一度输给了未被调整的 Terra 和 Luna 档位。
- 用速度掩盖质量流失:模型看似响应更快、表现更“高效”,本质上是因为精简了底层的思考步骤。这种“偷工减料”的做法瞬间引发了订阅了高价套餐用户的广泛不满。
📢 OpenAI 官方连夜回应:承认实验并回退参数
面对激烈的社区质疑,OpenAI 官方员工 Tibo 紧急发布了更新清单,正面回应了用户的猜测,并列出了以下调整:
1. 撤销思考预算(Juice Values)实验
官方承认为了排查额度异常扣除的原因,曾对底层的推理力度进行过调整实验,目前这些调整已全部撤回,模型推理能力正在恢复。
2. 上下文窗口紧急回退
Sol 的 上下文窗口 此前从 272k 提升到了 372k,但由于实际产生的额度消耗远超预期,官方已将其临时退回至 272k,并承诺在后续几天优化后重新开放。
3. 多智能体及自动审核Bug修复
在 High 和 XHigh 档位下,多智能体(Multi-Agent)的额度消耗存在异常。此外,Auto-Review(自动审核)机制也存在冗余开销,官方正在全力修复。同时,5小时的免费限额暂时继续不生效,并为所有 Sol 订阅用户提供约 10% 的可用额度回馈作为补偿。
🧮 额度蒸发背后:开发者的“账单分析”
除了模型降级,不少用户还遭遇了额度加速消耗的现象。开发者 Theo 对此进行了解密,指出额度异常消耗是由多重因素叠加导致的“套娃”现象:
{
"billing_issues": {
"reasoning_rate_multiplier": "2.0x",
"multi_agent_nesting": "Ultra nesting sub-agents",
"context_handling": "Copying long local context repeatedly",
"fast_mode_multiplier": "2.5x"
}
}
- 双倍计费与快速模式叠加:基础推理计费本身存在翻倍,而在开启快速模式(Fast Mode)时,计费会再乘以 2.5 倍。
- 子代理长上下文复制:在使用中,多智能体嵌套运行会在子代理之间反复复制超长的本地上下文,直接导致 Token 消耗呈指数级上升。
💡 用户应对与优化建议
针对当前的模型状态,建议开发者在日常调用时采取以下策略以节省成本并保证产出质量:
- 合理评估推理档位:在官方彻底修复思考预算前,建议根据任务难度手动调节档位,避免盲目挂机高档位造成额度浪费。
- 监控 Prompt 上下文长度:在编写长代码或分析大文档时,主动控制输入上下文,防止触发因窗口缩水导致的阶段性截断问题。
- 暂缓重度多智能体并行任务:鉴于 multi-agent 仍存在计费偏高的Bug,可将复杂任务拆分为单次 Prompt 依次调用,直至官方补丁完全实装。
创建: 2026-07-14
登录后才能发布评论哦
立即登录/注册