给Claude Code踩刹车

preslav.me 2026-08-04T17:37:02.802380

重度使用Claude Code几周后,作者发现它搭建原型很快,但也容易在无人干预时烧掉大量token。通过在流程中加入一个30秒的延迟钩子,他成功控制了token消耗,也重新拿回了对任务方向的主动权。

当“自动驾驶”变成“跑偏”

过去几周,我一直在重度使用Claude Code。这个工具的确能在短时间内从零搭出一个能跑的最小可用产品(MVP),但要把这些MVP打磨成能上线的生产级应用,多少还是要靠运气。

有好几次,我扔下一个任务让Claude自己跑,满心以为回来就能看到一套像样的方案。结果等我再去看,不仅结果不对,它还稀里糊涂地烧掉了一大批token。

好在我的Claude Code是固定月费订阅,额度给得还算大方。基本上可以连用一整天,只是Anthropic会在某些时段设配额上限,一旦触顶,就得等几个小时才能继续用。

写这篇文章的时候,只要你订阅了Claude Pro,就可以免费使用Claude Code。

但这种好事谁都清楚不会一直持续。这是个让你上瘾的诱饵。迟早有一天,Anthropic会把大家迁到按token计费的订阅模式——到那时候,你很可能每个月花掉几百甚至上千美元,却什么像样的成果都拿不出来。更别提token浪费背后的环境成本了,不过如今好像没几个人关心这个。

怎么管理token消耗,目前业界还处在摸索最佳实践的早期阶段。我只确定一件事:不想再看着token像大出血一样流走,自己却什么都没剩下。

给Agent加一道减速带

一个自然的解决办法,是在流程里人为加入一些“摩擦”。我依然希望Claude能独立处理大任务,但我也想随时知道它在做什么——关键是,在它烧掉几百万token、沿着错误方向一路狂奔之前,能有机会否决掉它那些跑偏的思路。

我找到的最简单的方案,是加一个特殊的钩子(hook),在每次重大变更前强制暂停一下:

这个配置的具体写法因IDE而异,不过在VS Code里,我是按项目把钩子写在 .claude/settings.local.json 文件中的。

别看只是加了30秒延迟,Claude Code的工作流确实顺了不少。这段停顿给了我一个有意识、有意义的缓冲时间:可以切换任务、折返回来,在它动手之前及时介入。同时,token消耗速度也自然降了下来。以前可能两个小时就把配额烧光了,现在同样的token能均匀地撑上一整天。

也许有人会说,反正我本来动作就慢,效果大概也差不多。这话有一定道理,但过程的“伤害性”确实小了很多,而且我也不介意慢一点。更重要的是,这让我能真正参与整个过程,而不是只在最后当个结果审核员。

Claude Code的hooks还能做很多事,我也刚起步。目前的思路是做一个能自我适应的方案,根据token用量渐进式地让Claude Code慢下来。等有结论了,我会在后续博客里继续分享。

关键要点

欢迎在评论区聊聊你的看法。

查看原文