1. GPT-5.6 Sol 险胜,成功登顶 Arena 排行榜
长期在 LMSYS Chatbot Arena 榜单上霸榜第一的 Anthropic 旗舰模型 Claude Fable 5 终于遇到了对手。OpenAI 新发布的 GPT-5.6 Sol 势头极猛,在发布之初迅速冲上第二后,目前已经在最新的 Arena 代码生成榜上跑出了 1631 的高分,以仅仅 1 分 的微弱优势险胜 Claude Fable 5(1630 分),正式登顶。
不过在另一端,更考验长程规划和 Repository 级别硬核开发的 Agent 榜单 中,Claude Fable 5 依然稳居第一,GPT-5.6 Sol 暂时屈居第二。
2. 体验调整:Codex 取消 5 小时高频限制,聚焦底层 Token 降本
因为 GPT-5.6 Sol 具备多智能体拆解(Ultra 模式)和更长的多轮对话能力,上线后热度空前。但这也带来了巨大的“Token 烧伤”,由于其单次任务执行过深,很多开发者吐槽原有的 5 小时高频使用限制根本不够用,很容易在短时间内耗尽额度。
对此,OpenAI 产品负责人 Tibo 昨日在 X 平台上公开确认,过去 48 小时的密集调用超出了预期。官方目前已推出了针对性的优化措施:
- 取消 5 小时窗口限制: 暂时移除了 Plus、Pro 和 Business 用户在 Codex 和 ChatGPT Work 中的 5 小时滚动机制,目前仅保留周限额,并为所有人赠送了一次额度重置。
- 降低底层消耗: Tibo 表示,团队正在全力对 GPT-5.6 的底层效率进行优化,接下来会通过减少不必要的 Token 消耗来提高整体耐用度。

