Claude Code тормозит? 12 исправлений для медленных ответов (2026)
Почему Claude Code такой медленный? Читайте строку состояния, облегчайте контекст компактной CLAUDE.md и /clear, переключайте модель через /model и следите за лимитом в 5 часов.
TL;DR
- Большинство «Claude Code тормозит» — это раздувшийся контекст. Спиннер-строка состояния показывает цену каждого хода в секундах и токенах — читайте ее, прежде чем искать другой инструмент.
- Грузите меньше: создайте CLAUDE.md через /init и держите ее под 200 строк, делайте /clear между задачами, а выживающей сессии — /compact с фокусом.
- Отправляйте работу нужному двигателю: /model для более быстрой модели на рутинных правках, /context чтобы увидеть, кто съедает окно, и меньше MCP-серверов на проект.
- Часть медлительности не ваша: проверьте status.claude.com и следите за скользящим лимитом в 5 часов — терминальный монитор показывает таймер сброса и burn rate вживую.
Wait.. Claude Code is MADE Slow on Purpose? Heres How to Fix It
Канал: AI LABS10:35
Why Claude Code Gets Slow and Forgetful and 4 Habits That Fix It
Канал: Prompt to Prod11:00
Manage costs & usage limits — official documentation
Официальная документация: code.claude.com/docs
Каждая команда, лимит и значение по умолчанию на этой странице сверены с code.claude.com/docs и changelog anthropics/claude-code; видео выше — визуальный и фактический источник, включая показания строки состояния и монитор пятичасового окна. Где видео и документация расходятся, гайд следует документации.
Скриншоты принадлежат своим авторам и снабжены глубокими ссылками на точный таймкод. Кадры с лицом не используются.
Вернуть Claude Code скорость, шаг за шагом
Часть 1 — Увидеть, куда уходит время
- 1
Отправить свежей сессии один реальный запрос
Запустите claude в проекте и введите настоящий запрос. Совсем новая сессия начинает лишь с приветственного блока, поэтому Claude сначала читает ваши файлы — именно с этого «разведывательного захода» начинается большинство жалоб «Claude Code тормозит». Следите, как в поле ввода меняются глаголы спиннера.

Свежая сессия: подсказки приветственного блока — весь контекст, с которым стартует Claude Code.Смотреть на 0:08 - 2
Читать строку состояния, пока он работает
Под диффом появится строка вроде «Unravelling… (16s · 351 tokens · esc to interrupt)». Глагол — украшение; секунды и счетчик токенов — ваш спидометр. Они говорят, думает ли Claude, ждет или копается в файлах. Если каждый ход сжигает сотни токенов до первой правки, тормозит контекст.

Строка состояния — ваш спидометр: глагол, секунды, токены, esc to interrupt.Смотреть на 1:08 - 3
Открыть дифф и увидеть, что притащила одна правка
Даже крошечной фиче нужно сначала найтись. Правка счетчика слов из видео трогает один файл и добавляет девять строк — а ход тратит 352 токена, пока спиннер не уляжется. В большом репозитории разведка означает обход каталогов и чтение файлов, не относящихся к запросу, — видео называет это «утопанием в ненужной информации».

Девять добавленных строк в одном файле — а спиннер все считает токены.Смотреть на 0:22
Часть 2 — Кормить меньшим контекстом
- 4
Запустить /init и создать CLAUDE.md
Введите /init и выберите «Initialize a new CLAUDE.md file with codebase documentation». Это задокументированная команда, дающая Claude постоянный бриф о вашем репозитории, чтобы новая сессия не переоткрывала проект перед каждой правкой. Главное лекарство от жалобы «он сперва читает все».

/init — документированный способ создать CLAUDE.md.Смотреть на 3:38 - 5
Дождитесь завершения разового сканирования
Claude читает package.json, README, роутер и прочее, а затем пишет файл — в запуске из видео спиннер Deciphering… появляется после примерно 90 токенов вызовов инструментов. Эту цену платите один раз. Со следующей сессии нужный Claude контекст уже лежит в CLAUDE.md, а не перечитывается с диска.

Разовое сканирование: чтение, поиск, затем запись.Смотреть на 2:22 - 6
Держать CLAUDE.md компактной — команды и архитектура
В готовом файле — команды разработки, слой базы данных и краткое резюме архитектуры. Оставайтесь в этих рамках: официальная документация говорит, что CLAUDE.md загружается в контекст при старте каждой сессии, и рекомендует меньше 200 строк. Раздутая CLAUDE.md воссоздает проблему, которую призвана решить, — специализированные сценарии переносите в skills, загружаемые по требованию.

Команды и архитектура — файл, который грузится каждую сессию. Держите коротким.Смотреть на 3:50 - 7
Брать документацию семантическим поиском, а не забивать контекст
Для вопросов по библиотекам видео показывает, как MCP Context7 вызывает get-library-docs с темой «best practices» и получает только релевантный раздел из репозитория TypeScript Microsoft. Семантический поиск возвращает лишь нужные куски вместо того, чтобы затаскивать в окно целые страницы документации.

get-library-docs возвращает совпавший раздел, а не весь мануал.Смотреть на 2:48 - 8
Проверить MCP-сервер через /mcp
Запустите /mcp и убедитесь, что сервер показывает «connected», — видео добавляет семантический кодовый сервер Serena через claude mcp add и проверяет его здесь. Две оговорки из видео и документации: MCP-сервер привязан к проекту — добавляйте его в каждом репозитории, где нужен; а сервер, зависающий на старте, задерживает каждую сессию этого проекта.

/mcp — укрытие медленного сервера: serena показывает зеленый connected.Смотреть на 5:31
Часть 3 — Модели, лимиты и мониторинг
- 9
Рутинную работу — более быстрой модели
Откройте /model — или пикер в вашей IDE — и подберите двигатель под задачу. Официальная документация рекомендует Sonnet как более дешевую повседневную модель и Opus для сложных рассуждений; простые задачи субагентов могут ехать на Haiku. Быстрая модель не лечит забитый контекст, но на мелких правках срезает и время ответа, и цену за токен.

Тот же промпт, другой двигатель: пикер живет в /model и в тулбаре IDE.Смотреть на 4:32 - 10
Знать, что происходит на лимите
Документация Anthropic проводит четкую черту: «You've hit your session limit» и сообщения недельного лимита привязаны к месту — смена модели не поможет, а в сообщении показано время сброса. Лимиты конкретной модели обходятся через /model, а с v2.1.234 меню /rate-limit-options может продолжить задачу после сброса автоматически.

Официальный ответ на вопрос «Что будет, когда я упрусь в лимит?»Смотреть на 4:44 - 11
Следить за расходом терминальным монитором
Видео рекомендует опенсорсный Claude Code Usage Monitor (Maciek-roboblog на GitHub, лицензия MIT, установка через uv или pip) и держит его во второй вкладке терминала. Он читает собственные логи сессий Claude Code, поэтому расход виден рядом с работой — отдельный веб-интерфейс держать открытым не нужно.

Монитор, который советует видео: Maciek-roboblog/Claude-Code-Usage-Monitor.Смотреть на 6:22 - 12
Следить за таймером сброса и burn rate
В TUI — полосы затрат, токенов и сообщений, обратный отсчет Time to Reset (в видео 2 ч 52 мин), распределение моделей и живой burn rate с предсказаниями вроде «Tokens will run out: 3:00 PM». Когда пятичасовое окно на виду, внезапное замедление перестает быть загадкой — вы видите, как приближается потолок.

Burn rate и отсчет сброса — вживую, во вкладке терминала.Смотреть на 6:50
Claude Code против Cursor, Codex и самого себя месяц назад
Ищущие «claude code slower than cursor» и «than codex» чаще всего сравнивают разные конфигурации, а не разные двигатели. По-настоящему различается вот что:
- 1Против Cursor — у Cursor собственный конвейер контекста, и на момент видео он урезал окно модели примерно до 120k токенов, тогда как Claude Code отдает Claude полные 200k, но грузит внутрь больше вашего репозитория. «Быстрее» в общем случае ни один: быстрее ощущается тот инструмент, что держит окно стройнее.
- 2Против Codex CLI — физика та же. Любой кодинг-агент тормозит, когда промпт тащит целый репозиторий; /clear, компактный файл контекста и фокусированные компакты переносятся на Codex один в один. Очереди моделей и рейт-лимиты зависят от тарифа, а не от терминала.
- 3Против Claude Code месячной давности («стал медленнее») — сперва подозревайте длину собственной сессии, а не релиз. Длинные сессии пересекают порог автокомпакта, и каждая компакция сама по себе большой запрос; /clear и двухстрочный ре-бриф обычно возвращают прежнюю прыть. Затем гляньте changelog и запустите claude --safe-mode, чтобы отсечь свои кастомизации.
- 4Против чата claude.ai — чат кажется мгновенным, потому что не читает ваш репозиторий. Claude Code меняет этот стартовый вес на способность действовать: полное контекстное окно, локальные инструменты, правки на диске. Оценивайте по времени задачи, а не по первому токену.
- 5Честный итог — сырая латентность моделей у топовых агентов похожа. Ощутимые различия — размер контекста, старт MCP и очереди рейт-лимитов — все три измеримы, и все три чинятся на этой странице.
Если вы сменили инструмент ради скорости, прогоните одну и ту же задачу дважды — с чтением /context перед каждым ходом — и сравните счетчики токенов. Большинство историй «этот инструмент быстрее» на деле — «та сессия была меньше».
Все еще медленно? Пройдитесь по списку
У «медленно» есть несколько отчетливо разных причин, и у каждой свой признак. Если шаги выше не объяснили ваше торможение, идите по этому списку:
- 1Сегодня крутится везде, во всех репозиториях → сначала status.claude.com. Сбой провайдера проявляется длинными ожиданиями и ретраями сразу повсюду; локально это не лечится, а счетчик токенов в строке состояния подозрительно низок, пока секунды растут.
- 2Ошибка вроде «Invalid API key · Please run /login» → это аутентификация, а не скорость, но сессию клинит так же. Запустите /login для повторной аутентификации; в упорных случаях документация советует /logout, закрыть Claude Code и начать заново. Заодно снимите случайный ANTHROPIC_API_KEY — он перекрывает вход по подписке.
- 3Медленно только после часа работы → контекстное окно заполнилось. Автокомпакт резюмирует старую историю у порога, и каждая компакция сама по себе большой запрос. Сделайте /compact с фокусом (например: оставить только план и дифф) или /clear и вставьте двухстрочный ре-бриф.
- 4Застряло на connecting или старте MCP → запустите /mcp, найдите зависший сервер и уберите его из проекта. Со стартом недавно починили по-настоящему: v2.1.292 запоминает медленные stdio-серверы на 7 дней и больше не заставляет первый headless-ход ждать ответа HTTP-серверов.
- 5Паузы на минуты, которые возобновляются сами → вы уперлись в лимит использования. В сообщениях о лимите сессии показано время сброса; против лимита на место смена модели не помогает, но /rate-limit-options (v2.1.234+) продолжит задачу после сброса, а /model работает только для лимитов конкретной модели.
- 6Сам терминал лагает — медленный скролл, текст-призрак, задержка набора → это рендеринг, а не инференс. Запустите claude --safe-mode: на одну сессию отключатся хуки и скрипты статуслайна; если лаг пропал, урезайте свой statusline-скрипт или хуки. Та же сессия в панели VS Code и в терминале сузит круг еще сильнее.
Еще одно из документации: если память сессии превысила 2,5 ГБ, перезапустите ее — claude --continue вернет разговор в свежем процессе, обычно быстрее того, что вы покинули.
