从 GPT-5.5 切换到 GPT-5.6,我的生产力反而下降了

Vincent Schmalbach 2026-08-12T12:19:41.872051

2026年8月10日 · Vincent Schmalbach

我订阅了三个 Codex 账号,每个每月 200 美元,但过去一周,它们大多时候只让我干等。自从我从 GPT-5.5 切换到 GPT-5.6,我不是盯着任务转圈却始终不结束,就是三个账号的额度全部归零。用 GPT-5.5 时,我觉得自己生产力爆棚。新模型更聪明了,可我完成的事情反而更少了。

写这篇文章时,我正在开发 vroni.com——一个把任务变成 pull request 的 AI 编码工具。

Codex 是我主要的开发驱动,我的原则向来是:用最好的模型,并把推理强度开到最高。几周前,最佳配置还是 GPT-5.5 搭配 xhigh 推理档,那时我唯一的烦恼是付费的额度怎么都用不完。

在 GPT-5.5 上,我的夜间工作流程是这样的:交给它一个任务,讨论到计划清晰,然后让它独立干活,自己就去睡觉了。它通常工作一两个小时就会停下,第二天早上,完成任务已经在等我了。

GPT-5.6 发布后,我换到了它的顶级版本 GPT-5.6 Sol,推理档位仍然是 xhigh,结果这个流程彻底失效。同样的任务、同样的指令,第二天早上醒来时,它还在继续工作。它中途产出的内容并不差,但它永远不认为自己完成了。它总能找到更多需要验证的地方,以及一个又一个顺带启动的新任务。

GPT-5.6 就像有多动症(ADHD)。它会高度专注地连续思考几个小时,同时又不断横向扩散,衍生出越来越多的子任务,结果总是有更多工作在途,却永远没有一个终局。

现在我的 Codex 会话轻轻松松就能在 24 小时内烧掉一整份订阅配额。上周我的三个订阅全部用完了额度,Codex 里基本什么都干不了。真正写出来的代码,都是在 Claude Code 里配合 Fable 完成的——这可不是我每个月花 600 美元给 OpenAI 时所预想的结果。等到配额重置,我夜里交给 Sol 一个任务,这一个任务就把整份配额给耗光了。我只能切到第二个账号,又开了四个任务。写这篇文章的时候,它们都还在转圈,我也不知道到底会不会有跑完的那一天。

我也试过把推理强度从 xhigh 调到 high,结果没有任何实质变化。GPT-5.6 Terra 的问题则完全是另一种:它根本完不成我交代的任务。Terra 真的算不上一个有用的模型,碰难事它不够聪明,做大规模自动化又不够便宜。还有人建议:用 Sol 做规划,再用较小的 Luna 来实现。我非常反感这个建议。实现是整个流程里最重要的一步,把它交给一个更弱的模型,只是为了绕开强大模型停不下来的毛病——这比起我之前全程用 GPT-5.5 的工作流,是一种倒退。

所以,Sol 显然是我用过的智能程度最高的模型,比之前的任何模型都强,可实际上我却几乎用不了它。

Vroni

把任务交出去,拿回软件

把 GitHub issue、bug 报告、需求说明,或者一个粗略的想法丢给 Vroni。它会自己读仓库、规划改动、写代码、跑检查,然后一步步推进到一个可以审阅的 pull request。

查看原文