# Окно контекста Claude Code: что его заполняет и когда сбрасывать

> Руководство по окну контекста Claude Code: посмотрите, что его заполняет, прочитайте /context, выберите /compact или /clear и решите, когда помогает окно на 1M или свежая передача задачи.

Окно контекста Claude Code может ощущаться как блокнот проекта. Но это ещё и рабочий набор, который Claude несёт в следующий ответ.

**Короткий ответ:** Запустите `/context`, чтобы увидеть, что использует текущее окно. Используйте `/compact`, когда нужно продолжить работу над той же задачей, но можно обменять детали на сводку; используйте `/clear` для несвязанной задачи; делегируйте громоздкое исследование, когда вам нужны только его результаты. В Anthropic API текущие модели Fable, Sonnet и Opus уже работают с окном на 1M, и большее окно не делает каждую старую деталь одинаково полезной. Цены и доступ к моделям проверены в октябре 2026 года.

## Что такое окно контекста Claude Code и что его заполняет?

Окно контекста Claude Code — это информация, доступная модели для её следующего ответа. Оно включает больше, чем введённый вами текст: стартовые инструкции и память, описания доступных инструментов, файлы, которые читает Claude, вывод инструментов и сам разговор. [Руководство по окну контекста](https://code.claude.com/docs/en/context-window) от Anthropic разбирает эти источники.

При запуске сначала проверьте файлы инструкций проекта и пользователя. Затем следите, что задача заставляет Claude читать. Широкий запрос вроде «изучи этот репозиторий» привлекает много файлов и большие выводы; запрос, называющий функцию, ожидаемое изменение и цель проверки, даёт Claude меньшую область поиска. [Руководство по лучшим практикам Claude Code](https://code.claude.com/docs/en/best-practices) рекомендует конкретные промпты и очистку контекста между несвязанными задачами.

Окно контекста — это ёмкость, а не оценка. Заполнение большей его части не означает, что Claude надёжнее выучил проект. Какая-то информация существенна; какая-то — устаревший крюк, повторённый вывод или файл, который следующая задача никогда не использует.

## Как показать использование контекста и прочитать `/context`?

Чтобы показать использование контекста в Claude Code, введите `/context` — получите текущую сетку использования и предложения по оптимизации. Используйте `/context all`, чтобы развернуть разбивку по элементам. Anthropic говорит, что живой вид может включать, какие файлы `CLAUDE.md` и автоматической памяти загружены; это место для осмотра вашей сессии, а не число, которое стоит копировать с чужого скриншота. См. [справочник команд](https://code.claude.com/docs/en/commands).

`/context` также работает в headless-режиме: `claude -p "/context"` печатает тот же отчёт в Markdown, так что его можно сохранить и сравнить настройки. В чистом тесте 4 октября 2026 года (Claude Code 2.1.289, Opus 5.5, пустой проект без `CLAUDE.md`, подключено пять MCP-серверов) новая сессия стартовала с 12.5k из 1M токенов:

| Строка                             | Токены | Учтено в итоговых 12.5k? |
| ---------------------------------- | -----: | ------------------------ |
| Системный промпт                   |     2k | Да                       |
| Системные инструменты              |   8.1k | Да                       |
| Навыки                             |     2k | Да                       |
| Инструкции MCP-серверов            |    357 | Да                       |
| MCP-инструменты (отложенные)       |  20.8k | Нет                      |
| Системные инструменты (отложенные) |  12.9k | Нет                      |
| Буфер сжатия                       |     3k | Нет                      |

Загруженные строки складываются в итог. Отложенные определения инструментов и буфер сжатия перечислены, но находятся вне него, так что длинный список MCP-инструментов сам по себе не означает полное окно. Файлы инструкций вашего проекта и разговор ложатся поверх этой базы.

Читайте вывод как диагноз: определите, что представляют самые крупные категории, затем удалите только контент, не относящийся к задаче. Если доминируют инструкции — урежьте или ограничьте инструкции. Если доминирует вывод инструментов — сузьте следующее чтение или команду. Если история — это в основном старая задача, выберите сброс.

Не выводите оставшееся полезное окно только из процента, если вы сменили модель, используете шлюз или сравниваете модель на 200K с моделью на 1M. Подтвердите активную модель в `/status` и проверьте применимое окно в [текущей документации по конфигурации моделей](https://code.claude.com/docs/en/model-config).

## Что делает автосжатие Claude Code и когда оно срабатывает?

Автосжатие суммирует историю разговора, когда сессия приближается к настроенному лимиту контекста, а затем продолжает работу со сводкой в текущем разговоре. Это автоматическая версия обмена, который вы делаете с `/compact`: сохранить достаточно состояния, чтобы продолжить, сжимая детали. [Anthropic документирует, что повторно внедряется или суммируется](https://code.claude.com/docs/en/context-window), включая инструкции проекта, память, выбранные недавно прочитанные файлы и историю разговора.

Текущая документация Claude Code говорит, что модели с нативным окном на 1M по умолчанию сжимаются примерно на 967K токенов. Это оставляет примерно 33K токенов между триггером по умолчанию и окном в 1 000 000 токенов: `1,000,000 − 967,000 ≈ 33,000`. Это арифметика из документированного приблизительного порога, а не обещанный свободный резерв или реальное показание сессии. Некоторые модели сжимаются на 200K; шлюзы и настройки плана могут изменить эффективную границу. Проверьте [пороги для конкретных моделей](https://code.claude.com/docs/en/model-config), прежде чем менять настройку.

Если вы хотите более ранний триггер для текущей модели, документированная команда — `/autocompact 500k`; `/autocompact auto` восстанавливает значение, настроенное под модель. Эти значения — примеры, а не рекомендация выбирать 500K для каждой модели. Anthropic документирует принимаемые значения от 100K до 1M и отмечает, что настройки окружения или управляемые настройки могут переопределить ваш выбор. См. [конфигурацию автосжатия](https://code.claude.com/docs/en/model-config).

## Сжимать, очищать, делегировать, использовать контекст 1M или начать заново?

Выбирайте по тому, что должно остаться доступным для следующего шага. «Стоимость» в таблице означает стоимость контекста и непрерывности, а не долларовую цену.

| Выбор                     | Используйте, когда                                                                                                                          | Что сохраняет                                                                    | Что теряет или стоит                                                                                                                      |
| ------------------------- | ------------------------------------------------------------------------------------------------------------------------------------------- | -------------------------------------------------------------------------------- | ----------------------------------------------------------------------------------------------------------------------------------------- |
| `/compact` с инструкциями | Текущая задача продолжается и её решения всё ещё важны. Пример: `/compact Focus on the failing test, files changed, and next verification.` | Суммированная версия текущего разговора; ваши инструкции могут направить сводку. | Точные детали могут быть сжаты. Прочитайте сводку, прежде чем полагаться на сигнатуры, текст ошибок или тонкие решения.                   |
| `/clear`                  | Вы переключаетесь на несвязанную работу или сессия полна заброшенных подходов.                                                              | Ничего из активного разговора; старая сессия остаётся возобновляемой.            | Непрерывность. Снова дайте новой задаче нужные файлы и факты.                                                                             |
| Субагент                  | Вам нужно исследование, разбор логов или другой ограниченный результат, а не большая расшифровка в основной сессии.                         | Краткий результат субагента возвращается в основной разговор.                    | Его исследование остаётся в другом контексте, а его собственные запросы всё равно расходуют использование.                                |
| Модель с контекстом 1M    | У вашей модели есть окно на 1M и одна задача действительно нуждается в широком рабочем наборе.                                              | Больше одновременного ввода до сжатия.                                           | Больше ёмкости, но не гарантированное извлечение или фокус; доступ и биллинг зависят от модели, плана и провайдера.                       |
| Новая сессия + передача   | Задача завершена, разговор зашумлён или следующей фазе нужен чистый бриф.                                                                   | Только то состояние, которое вы запишете и заново введёте.                       | Любое несохранённое рассуждение или деталь. Сначала запишите текущее состояние, решения, изменённые файлы, проверки и следующее действие. |

Для сжатия в Claude Code поместите важное состояние в инструкцию: что сделано, что осталось, релевантные пути, ограничения и следующая проверка. Если точная информация должна выжить, поместите её в файл проекта и попросите Claude ссылаться на этот файл. Чтобы очистить контекст в Claude Code для несвязанной работы, используйте `/clear`: он начинает пустой разговор и не является более короткой формой `/compact`. [Урок Claude Academy](https://academy.claude.com/courses/claude-code-101/context-management) даёт то же основное правило: сжимайте продолжающуюся фичу, очищайте для новой.

Используйте субагента для ограниченного исследования, чей сырой вывод вам не нужен в основном контексте. [Руководство по субагентам](https://code.claude.com/docs/en/best-practices) от Anthropic говорит, что основной разговор получает сводку, пока субагент использует отдельный контекст. Это экономит место основной сессии; оно не делает исследование бесплатным.

## Есть ли у Claude Code окно контекста на 1M?

Да, контекст 1M в Claude Code доступен на большинстве текущих моделей. По проверке октября 2026 года [страница конфигурации моделей Claude Code](https://code.claude.com/docs/en/model-config) перечисляет доступ по моделям и планам; [справочник по окнам контекста Platform](https://platform.claude.com/docs/en/build-with-claude/context-windows) перечисляет размеры моделей.

В Anthropic API окно на 1M входит в стандарт на каждом плане, включая Pro, для моделей Fable, для Sonnet 5 и новее и для Opus 4.7 и новее. Для них не нужно выбирать вариант `[1m]`. Для более старых Opus 4.6 и Sonnet 4.6 вам нужен вариант `[1m]`, чтобы получить большее окно, и сможете ли вы его выбрать, зависит от вашего плана. Текущая документация утверждает, что подходящее использование 1M тарифицируется по стандартным ценам модели без надбавки за токены сверх 200K, хотя само использование Fable может расходоваться из кредитов использования на некоторых планах. Цены проверены в октябре 2026 года.

Используйте 1M, когда задача выигрывает от того, что большой связный набор справочного материала доступен сразу. Не переключайтесь просто потому, что контекст высокий. Для точечной правки или новой фичи меньший, более чистый рабочий набор может быть проще для рассуждения.

## Как снизить использование токенов Claude Code перед сбросом?

Начните с источников с высоким влиянием, которые загружаются повторно. Anthropic рекомендует держать каждый `CLAUDE.md` меньше 200 строк; перенесите инструкции, применимые только к определённым файлам, в правила с областью по пути, а нечастые процедуры — в навыки, вместо загрузки каждую сессию. Импорты организуют длинный файл, но не снижают его стоимость контекста. Подробности — в [руководстве по памяти проекта Claude](https://code.claude.com/docs/en/memory).

Затем контролируйте, что входит во время работы:

- Давайте конкретную задачу, целевой путь или символ и ожидаемый результат. Просите релевантные строки или сигнатуры, прежде чем запрашивать целый файл.
- Для логов или вывода тестов отфильтруйте до ошибок и соседних строк, прежде чем возвращать их Claude. [Руководство по затратам](https://code.claude.com/docs/en/costs) Anthropic предлагает хук, который грепает длинный лог по `ERROR`, чтобы Claude читал несколько сотен токенов совпадений вместо десятков тысяч.
- Используйте `/context`, чтобы найти загруженные файлы или память, которые не относятся к этой задаче. Держите настройку MCP/определений инструментов в рамках быстрой проверки: Claude Code сейчас по умолчанию откладывает определения MCP-инструментов, а `/mcp` позволяет отключить неиспользуемые серверы.
- Отдайте многословное исследование субагенту, когда вернуться должен только его вывод.

В Muvon мы строим Octocode и Octofs. Встроенных инструментов поиска и работы с файлами Claude Code хватает для многих задач. Когда навигации по коду нужен другой вид, [команды поиска и сигнатур Octocode](/blog/octocode-semantic-code-search) могут находить код по запросу на естественном языке и показывать сигнатуры файлов. Для узкой работы с файлами [Octofs](/blog/octofs-0-16-faster-filesystem-for-claude-code-and-codex) поддерживает представления по диапазонам и сгруппированные правки; эти возможности описывают, как он работает, а не измеренную экономию токенов. Сначала попробуйте встроенные инструменты, затем добавляйте инструмент только тогда, когда его вывод более целевой для задачи.

## Что говорят исследования context rot о длинных сессиях?

Длинный контекст полезен, но большее окно — не доказательство, что модель использует каждую часть одинаково хорошо. [Отчёт Context Rot](https://www.trychroma.com/research/context-rot) Chroma 2025 года оценил 18 моделей на контролируемых задачах и обнаружил, что производительность часто снижалась по мере роста длины ввода; дистракторы также затрудняли извлечение. Отчёт — это исследование протестированных моделей и задач, а не бенчмарк сегодняшнего рабочего процесса Claude Code.

[Статья Lost in the Middle](https://arxiv.org/abs/2307.03172) 2023 года, позже опубликованная в TACL, обнаружила, что производительность часто была максимальной, когда релевантная информация находилась ближе к началу или концу, и слабее, когда она располагалась в середине. Её набор моделей старше. Вместе статьи поддерживают практическое правило, а не универсальный порог: держите ключевые факты задачи легко находимыми, удаляйте нерелевантную историю и проверяйте важные решения вместо того, чтобы предполагать, что больше контекста означает более надёжное вспоминание.

Когда вы не уверены, что делать дальше, запустите `/context`, посмотрите на самые крупные категории и пройдите по этому списку: сузьте следующее чтение, делегируйте громоздкое исследование, сожмите с keep-инструкциями, если та же задача продолжается, или напишите передачу и очистите, если следующая задача другая. Перед правкой в новой сессии сверьте её с репозиторием и сохранённой передачей.

— Don

---

_Мы строим инструменты с открытым кодом для сфокусированных рабочих процессов кодинга. Если вы попробуете более узкое чтение или сессию с передачей сначала, расскажите нам, что сработало или где острые углы; можете [открыть issue](https://github.com/Muvon/octocode/issues)._
