Anthropic Academy Courses My Profile Sign Out

Доверяй, но проверяй: проверка прогонов без присмотра

Вы поручили Claude задачу и дали ему работать, не наблюдая за каждым шагом. Теперь он говорит, что готово. Прежде чем отгружать эту работу, нужен способ проверить то, за чем вы даже не наблюдали. Эта проверка и делает автономный Claude Code безопасной опорой.

Идея проста: проверяйте пропорционально тому, сколько свободы дали прогону. Если вы наблюдали, как сообщения прокручиваются в короткой сессии, быстрого взгляда достаточно. Но прогон без присмотра или задача, сработавшая в continuous integration без человека в контуре, нуждается в настоящей проверке. Никто не видел, что произошло, так что приходится восстанавливать это постфактум.

Вот как это представить. Чем меньше вы наблюдали, тем больше проверяете.

Держите прогоны без присмотра в режиме auto

Когда прогон идёт без присмотра на работе, держите его в режиме auto, а не в bypass permissions. В режиме auto классификатор по-прежнему проверяет каждое действие на опасность. Это страховка, которую стоит сохранить.

Но чётко понимайте, что эта страховка делает, а чего нет. Классификатор никогда не судит, правилен ли код на самом деле. Он только подсвечивает опасные действия. Так что ваша планка проверки остаётся ровно там, где была. Установите эту планку исходя из того, насколько прогон был без присмотра.

Начинайте с диффа, а не с резюме

Не начинайте с резюме Claude о том, что он сделал. Начните с самого диффа.

  • Выполните /code-review, чтобы пройти по изменениям и подсветить проблемы.
  • Затем посмотрите собственными глазами на git diff.

Ловушка — аккуратное резюме, которое читается прекрасно, в то время как реальный дифф затронул файл, который, честно говоря, вы не ожидали там увидеть. Резюме вам этого не скажет. Дифф скажет.

Так что читайте, что изменилось. Сначала читайте файлы, которые были частью плана, затем ищите всё вне его. Чистый отчёт — не доказательство чистого кода.

Превратите тесты в шлюз, а не в обещание

Настоящий шлюз на прогоне без присмотра — прошли ли тесты и действительно ли Claude их прогнал или только заявил об этом. Не оставляйте это на доверие. Подключите это хуком, чтобы Claude не мог это пропустить.

Работу делают пара хуков:

  • Стоп-хук, который прогоняет ваши тесты и отказывается завершать ход при падении.
  • Хук post-tool-use, который делает линт и проверку типов после каждой правки.

Ключевая деталь — код выхода. Хук, выходящий с exit 2, подаёт падение прямо обратно Claude. Claude читает это падение и исправляет его без вашей просьбы. Лучше всего то, что проверка срабатывает при каждом прогоне, помните вы о просьбе или нет.

Получите холодное второе мнение

Ревью кода субагентом, которое вы запускали бы перед пул-реквестом, работает и здесь. Направьте его на прогон без присмотра.

Откройте свежую сессию или субагента и пусть он ревьюит изменённый код без памяти о том, как код строился. Поскольку у него нет заинтересованности в подходе, он ловит то, мимо чего оригинальный прогон сам себя уговорил. Второй ревьюер со свежими глазами находит то, что автор себе рационализировал.

Собираем всё вместе

Сделайте проверку настолько серьёзной, насколько прогон был без присмотра:

  • Прочитайте дифф сами.
  • Превратите тесты в хук, который закрывает ход.
  • Проверяйте автономные прогоны по их JSON-результату и коду выхода.
  • Получите холодное второе мнение на всё, что важно.

Делайте так, и «Claude сделал это, пока я не смотрел» больше не требует веры.