给Claude Code踩刹车
重度使用Claude Code几周后,作者发现它搭建原型很快,但也容易在无人干预时烧掉大量token。通过在流程中加入一个30秒的延迟钩子,他成功控制了token消耗,也重新拿回了对任务方向的主动权。
当“自动驾驶”变成“跑偏”
过去几周,我一直在重度使用Claude Code。这个工具的确能在短时间内从零搭出一个能跑的最小可用产品(MVP),但要把这些MVP打磨成能上线的生产级应用,多少还是要靠运气。
有好几次,我扔下一个任务让Claude自己跑,满心以为回来就能看到一套像样的方案。结果等我再去看,不仅结果不对,它还稀里糊涂地烧掉了一大批token。
好在我的Claude Code是固定月费订阅,额度给得还算大方。基本上可以连用一整天,只是Anthropic会在某些时段设配额上限,一旦触顶,就得等几个小时才能继续用。

写这篇文章的时候,只要你订阅了Claude Pro,就可以免费使用Claude Code。
但这种好事谁都清楚不会一直持续。这是个让你上瘾的诱饵。迟早有一天,Anthropic会把大家迁到按token计费的订阅模式——到那时候,你很可能每个月花掉几百甚至上千美元,却什么像样的成果都拿不出来。更别提token浪费背后的环境成本了,不过如今好像没几个人关心这个。
怎么管理token消耗,目前业界还处在摸索最佳实践的早期阶段。我只确定一件事:不想再看着token像大出血一样流走,自己却什么都没剩下。
给Agent加一道减速带
一个自然的解决办法,是在流程里人为加入一些“摩擦”。我依然希望Claude能独立处理大任务,但我也想随时知道它在做什么——关键是,在它烧掉几百万token、沿着错误方向一路狂奔之前,能有机会否决掉它那些跑偏的思路。
我找到的最简单的方案,是加一个特殊的钩子(hook),在每次重大变更前强制暂停一下:
这个配置的具体写法因IDE而异,不过在VS Code里,我是按项目把钩子写在 .claude/settings.local.json 文件中的。
别看只是加了30秒延迟,Claude Code的工作流确实顺了不少。这段停顿给了我一个有意识、有意义的缓冲时间:可以切换任务、折返回来,在它动手之前及时介入。同时,token消耗速度也自然降了下来。以前可能两个小时就把配额烧光了,现在同样的token能均匀地撑上一整天。
也许有人会说,反正我本来动作就慢,效果大概也差不多。这话有一定道理,但过程的“伤害性”确实小了很多,而且我也不介意慢一点。更重要的是,这让我能真正参与整个过程,而不是只在最后当个结果审核员。
Claude Code的hooks还能做很多事,我也刚起步。目前的思路是做一个能自我适应的方案,根据token用量渐进式地让Claude Code慢下来。等有结论了,我会在后续博客里继续分享。
关键要点
- 加30秒延迟钩子,成本极低,却能有效降低token浪费,把“两小时烧完额度”变成“均摊到一整天”
- 阶段性介入比事后审核更有主动权:你可以在Claude跑偏之前纠正方向,而不是等结果出来才后悔
- 固定订阅模式不会一直持续,提前养成管理token用量的习惯,是在为按量付费的那一天做准备
欢迎在评论区聊聊你的看法。