Гигиена контекста
Самое контринтуитивное утверждение подкаста: системный промпт Claude Code урезали на 80%. Умной модели нужно меньше указаний, меньше ограничений и меньше примеров. Прямое следствие — наши скиллы и CLAUDE.md слишком длинные.
Цифра
Мы урезали системный промпт Claude Code на 80%. Причина в том, что по мере того как модели становятся умнее, им нужно меньше направления, меньше ограничений и меньше примеров.
Три механизма, которыми длинный промпт вредит
Переписывание правил: до и после
Возьмём наше собственное железное правило и перепиши его по этой логике.
Прямая рекомендация
«Ты хочешь подрезать свой контекст. Мне кажется, CLAUDE.md сейчас, вероятно, слишком длинные, и их стоит сокращать всё сильнее. И, наверное, многие скиллы тоже слишком длинные.»
Наши скиллы длинные. factory-tool — семь шагов плюс большая секция Gotchas,
которая растёт с каждой новой засадой. По этой логике его надо переработать в двух
направлениях:
- Каждое «НЕ ДЕЛАЙ» заменить на «делай так, потому что иначе X». См. пример выше.
- Gotchas вынести в отдельный файл, который подгружается только при отладке, а не висит в контексте каждого прогона. Секция симптом→причина→фикс полезна, когда что-то сломалось, и бесполезна, когда ты просто пишешь новый генератор.
Второе — это ровно тот принцип, который в воркшопах Anthropic называют
progressive disclosure: в постоянный контекст попадает только строка
description («когда мне это понадобится»), а тело подтягивается, когда реально
нужно.
Смежное: организация работы
Отдельный кусок разговора — как не сгореть, когда у тебя пять агентов одновременно. Он про ту же гигиену, только на уровне человека.
Разделение по инструментам
| Где | Что там |
|---|---|
| Claude в Slack | Всё параллельное: начальные разведки, PR, спеки, «понять что-то». У каждого канала своя память. Пример: агент нянчит PR, чинит тесты и тегает ревьюера в том же канале, где ревьюер сразу отвечает. |
| Claude Code | Одна активная сессия — то, на чём фокус сейчас. Плотная итеративная работа. |
Было: пять параллельных Claude Code. Стало: одна активная сессия плюс пачка фоновых в Slack. Термин для этого — multi-clauding.
Правило фокуса
«Быть продуктивнее, но работать меньше».
Механика: держать один проект в фокусе. Главный пожиратель времени — не сложность задач, а ленивый промпт, выданный на бегу в режиме многозадачности: «я поленился, а потом понял, что потратил время впустую».
Оговорка: оптимальное количество параллельных агентов зависит от того, кто ты и что делаешь. Но «должен быть какой-то оптимум» — и это не «чем больше, тем лучше».
Про слоп
На вопрос «не превратится ли всё в мусор, если я не читаю вывод внимательно» — ответ из двух частей:
- Есть команда
/simplify, которая упрощает репозиторий. - Более интересное: если тебе важны только выходы (видео), то качество кода под ними важно меньше — агенты упорные, разберутся. Организация нужна больше человеку, чтобы ему было комфортно в пространстве, чем агенту.
Это снимает часть тревоги про качество кода в генераторах. Наши генераторы — это инструменты для производства роликов, а не продукт. Критерий там — выход, а не красота внутренностей. Тратить агентские часы на вылизывание кода генератора, который работает, — по этой логике трата.
Но с оговоркой: это не относится к общим файлам завода (клиенты в
_shared/factory-client/, конфиг губернатора, портал). Там дрейф стоит дорого —
именно поэтому в контракте написано «копируй эталонный клиент, не пиши свой».
Мелочи из этого блока
/permissions— пред-одобрять и пред-запрещать bash, edit и MCP-инструменты. Появляется подсказкой прямо в интерфейсе. Для долгих автономных прогонов обязательно, иначе агент упрётся в запрос разрешения и встанет./config— отключить «recap», сводку после каждого действия.- auto mode — переключается
shift+tab. - Артефакты как формат обмена внутри компании — планы, разборы PR, статус-репорты, постмортемы. Просят Claude сделать артефакт и кидают ссылку.
- Скиллы на уровне пользователя, а не проекта — плюс отдельная папка под выходные артефакты.
- Про генерацию превью: модели плохо меняют выражение лица («сделай удивлённое» → получается уродливо), но хорошо меняют фон и текст при заданном лице. Рабочий приём — дать агенту image-gen API и попросить посмотреть на то, что он сгенерил, и подкручивать итеративно.