太长不看版
- 大多数「Claude Code 太慢」其实是上下文膨胀。旋转状态行用秒数和 token 数标出每一轮的代价——换工具之前先读它。
- 减少加载:用 /init 生成 CLAUDE.md 并控制在 200 行以内,任务之间 /clear,需要延续的会话用带重点的 /compact。
- 把活派给对的引擎:例行小改动用 /model 换更快的默认模型,用 /context 看谁在吃窗口,每个项目少挂 MCP 服务器。
- 有些慢不怪你:先查 status.claude.com 是否有故障,再留意滚动的 5 小时限额——终端监控器能把重置倒计时和燃烧速率摆在眼前。
Wait.. Claude Code is MADE Slow on Purpose? Heres How to Fix It
频道:AI LABS10:35
Why Claude Code Gets Slow and Forgetful and 4 Habits That Fix It
频道:Prompt to Prod11:00
Manage costs & usage limits — official documentation
官方文档:code.claude.com/docs
本页的每条命令、限额和默认行为都已对照 code.claude.com/docs 与 anthropics/claude-code 更新日志核实;上方视频是画面与事实来源(包括状态行读数和五小时窗口监控)。视频与文档不一致处,以文档为准。
截图版权归原作者所有,并附深链直达对应时间戳。未使用任何人脸镜头。
一步步让 Claude Code 快回来
第 1 部分 — 看清时间花在哪
- 1
给全新会话发一条真实的提示词
在项目里启动 claude,输入一条真实请求。全新会话一开始只有欢迎框里的提示,Claude 必须先读你的文件才能回答——大多数「Claude Code 太慢」的报告都始于这次摸底。注意输入区的动词会随进度变化。

全新会话:欢迎框里的提示就是 Claude Code 起步时的全部上下文。在 0:08 观看 - 2
干活时读一读状态行
diff 下方会出现类似「Unravelling… (16s · 351 tokens · esc to interrupt)」的行。动词只是装饰,秒数和 token 数才是你的仪表盘:它告诉你 Claude 在思考、在等待,还是在啃文件。如果每轮都在第一次编辑前烧掉几百 token,那就是上下文在拖慢它。

状态行就是仪表盘:动词、秒数、token 数、esc to interrupt。在 1:08 观看 - 3
打开 diff,看一次小编辑拖进来多少东西
再小的功能也得先被找到。视频里加字数统计只改一个文件、新增九行,可这一轮在 spinner 落定前就花了 352 个 token。换成更大的仓库,摸底意味着列出目录、读一堆与请求无关的文件——视频称之为「淹没在无关信息里」。

只给一个文件加了九行——spinner 却一直在数 token。在 0:22 观看
第 2 部分 — 喂给它的上下文更少
- 4
运行 /init 生成 CLAUDE.md
输入 /init,选择「Initialize a new CLAUDE.md file with codebase documentation」。这是官方文档给的命令,为 Claude 准备一份关于仓库的持久简报,新会话不用每次编辑前重新摸底。对「它每次都先读一遍全库」的抱怨,这是最大的一剂解药。

/init 是官方生成 CLAUDE.md 的方式。在 3:38 观看 - 5
等这次一次性扫描跑完
Claude 会读 package.json、README、router 等文件,然后写出这份文件——视频里的运行在约 90 个 token 的工具调用后显示 Deciphering… spinner。这笔代价只付一次。从下一个会话起,Claude 需要的上下文已经在 CLAUDE.md 里,不用再从磁盘重读。

一次性扫描:读取、检索,然后落笔。在 2:22 观看 - 6
CLAUDE.md 保持精简——命令加架构
成品文件里是开发命令、数据库层和简短的架构摘要。保持这个粒度:官方文档说 CLAUDE.md 会在每次会话开始时载入上下文,建议不超过 200 行。臃肿的 CLAUDE.md 会把它解决的问题再造回来——专门的工作流移进按需加载的 skills。

命令和架构——这个文件每次会话都会载入,务必保持简短。在 3:50 观看 - 7
用语义搜索取文档,而不是塞满上下文
遇到库的问题,视频演示 Context7 MCP 调用 get-library-docs 并带上主题「best practices」,从微软 TypeScript 仓库取回的只有相关的一节。语义搜索只返回真正需要的片段,而不是把整本文档拉进上下文窗口。

get-library-docs 返回匹配的那一节,而不是整本手册。在 2:48 观看 - 8
用 /mcp 确认 MCP 服务器已连上
运行 /mcp,确认服务器显示「connected」——视频用 claude mcp add 添加了 Serena 语义代码服务器,并在这里检查。视频和文档给出两个提醒:MCP 服务器按项目生效,想在哪个仓库用就在哪装;启动时卡住的服务器会拖慢该项目的每个会话。

/mcp 是慢服务器藏身的地方:serena 显示绿色的 connected。在 5:31 观看
第 3 部分 — 模型、限额与监控
- 9
例行工作换更快的模型
打开 /model——或 IDE 里的选择器——让引擎匹配任务。官方文档建议 Sonnet 作为日常默认、Opus 留给复杂推理,简单的子代理任务可以用 Haiku。更快的模型治不了上下文拥堵,但对小修改来说,响应时间和每个 token 的成本一起省。

同一个提示词,不同的引擎:选择器在 /model 和 IDE 工具栏里。在 4:32 观看 - 10
弄清撞到限额会发生什么
Anthropic 的文档划得清楚:「You've hit your session limit」和周限额属于席位额度——换模型没用,消息里会给出重置时间。模型专属限额可以用 /model 绕开,从 v2.1.234 起还能用 /rate-limit-options 菜单在重置后自动继续任务。

「达到限额会发生什么」的官方答案。在 4:44 观看 - 11
用终端监控器盯着消耗
视频推荐开源的 Claude Code Usage Monitor(GitHub 上的 Maciek-roboblog,MIT 协议,用 uv 或 pip 安装),放在第二个终端标签页里。它读取 Claude Code 自己的会话日志,用量就显示在工作旁边——不用再开一个网页 UI。

视频推荐的监控器:Maciek-roboblog/Claude-Code-Usage-Monitor。在 6:22 观看 - 12
盯住重置倒计时和燃烧速率
TUI 里是费用、token 和消息三条进度条、Time to Reset 倒计时(视频里是 2 小时 52 分)、模型分布,以及实时的燃烧速率和「Tokens will run out: 3:00 PM」这类预测。5 小时窗口摆在眼前,突发的变慢就不再是谜——你能看到天花板正在逼近。

燃烧速率和重置倒计时,就在终端的一个标签页里。在 6:50 观看
Claude Code 对比 Cursor、Codex 和上个月的它
搜「claude code slower than cursor」「than codex」的人,多半在比较不同的配置而不是不同的引擎。真正的差异是:
- 1对比 Cursor——Cursor 有自己的上下文管线,视频拍摄时把模型窗口截到约 120k token,而 Claude Code 给 Claude 完整的 200k,却会把更多仓库内容塞进去。谁也不天然「更快」:窗口更干净的那个体感更快。
- 2对比 Codex CLI——物理规律相同。任何编码代理只要提示词拖着一整个仓库都会变慢;/clear、精简的上下文文件、带重点的 compact 可以一对一搬到 Codex。模型队列和限额按套餐不同,不按终端不同。
- 3对比上个月的 Claude Code(「比以前慢了」)——先怀疑自己的会话长度,而不是版本。长会话会越过自动压缩阈值,每次压缩本身就是一次大请求;/clear 加两行简报通常就能找回原来的爽快感。然后再查更新日志,跑 claude --safe-mode 排除自定义配置。
- 4对比 claude.ai 网页聊天——聊天显得快,因为它不读你的仓库。Claude Code 用这点启动重量换来了动手能力:完整上下文窗口、本地工具、直接改盘上的文件。按完成任务的时间评价它,而不是首字时间。
- 5诚实的结论——头部代理的模型原始延迟差不多。你感觉得到的差异来自上下文大小、MCP 启动和限额排队——三者都可测量,也都能在这一页里修。
如果你因为速度换了工具,把同一个任务跑两遍——每轮前先看一眼 /context——再比较 token 数。多数「这个工具更快」的故事,其实是「这个会话更小」。
还是慢?按清单排查
「慢」有几种截然不同的原因,每种都有信号。上面的步骤解释不了你的卡顿时,按这张清单往下走:
- 1今天哪都转圈 → 先看 status.claude.com。服务商故障的表现是所有仓库同时长等待加重试;本地无解,而且状态行里 token 数低得反常,秒数却一直涨。
- 2出现「Invalid API key · Please run /login」之类的报错 → 这是认证问题不是速度问题,但同样让会话停摆。运行 /login 重新认证;顽固情况按文档建议 /logout、关闭 Claude Code 再重来。顺手检查有没有游离的 ANTHROPIC_API_KEY——它会盖掉你的订阅登录。
- 3只在工作一小时后变慢 → 上下文窗口满了。自动压缩会在接近阈值时总结旧历史,而每次压缩本身就是一次大请求。用带重点的 /compact(比如:只保留计划和 diff),或者 /clear 后贴两行简报重新开场。
- 4卡在 connecting 或 MCP 启动 → 运行 /mcp 找出挂起的服务器,把它从该项目移除。启动最近修了不少:v2.1.292 会把连接慢的 stdio 服务器记住 7 天,headless 首轮也不再等 HTTP 服务器应答。
- 5停几分钟又自己恢复 → 你撞到用量限额了。会话限额的消息里写着重置时间;换模型救不了席位限额,但 /rate-limit-options(v2.1.234+)能在重置后自动继续任务,/model 只对模型专属限额有用。
- 6终端本身卡——滚动慢、残影、打字延迟 → 这是渲染问题不是推理问题。跑 claude --safe-mode 在一个会话里禁用钩子和状态栏脚本;如果卡顿消失,就精简你的 statusline 脚本或 hooks。再把同一会话放到 VS Code 面板和终端里各跑一次,进一步定位。
文档里还有一条:会话内存超过 2.5GB 就重启——claude --continue 会在新进程里恢复对话,通常比你离开的那个快。
