Почему агент не должен принимать собственную работу
Обещал разобрать этот пункт отдельно — разбираю.
В регламенте записано: агент не принимает свой же diff. Приёмку делает второй. Звучит как бюрократия, особенно когда работаешь один и лишних рук нет.
Причина простая. Ошибку порождает не невнимательность, а неверная модель задачи. А проверка идёт по той же модели, которая ошибку и породила.
Агент, который что-то реализовал, уже решил для себя, как это должно работать. Проверяя себя, он сверяет результат со своим же пониманием — и результат ему соответствует. Проверка проходит успешно, ошибка остаётся на месте.
Это не свойство нейросетей. У людей ровно так же: свой текст перечитываешь и не видишь пропущенного слова, потому что читаешь то, что хотел написать. Поэтому корректор — отдельный человек.
Как это выглядит в работе:
- 👀 первый агент по умолчанию ревьюер: ищет проблемы, но права править код не имеет
- 🔧 второй отвечает за реализацию и финальную приёмку
- 🧑 спорное и бизнес-смысл остаются за человеком
Отдельно про то, что именно должен проверять принимающий. Не «работает ли» — это покажет запуск. А другое:
- что сломается из того, что работало вчера;
- какие данные изменятся необратимо;
- где поведение разойдётся с тем, чего ждёт пользователь;
- что произойдёт при повторном запуске.
На эти вопросы автор изменений отвечает хуже всех, потому что он их уже мысленно закрыл, пока делал.
Если работаете с ИИ в одиночку и второго агента нет, минимальная замена — разнести роли во времени. Сначала реализация. Потом отдельная задача с формулировкой «найди, что здесь сломается», без контекста предыдущего разговора. Это хуже настоящей независимой приёмки, но заметно лучше, чем спросить «всё ли правильно» сразу после работы.
Проверка тем, кто делал, — это не проверка. Это перечитывание.
Telegram
Читать новые разборы в Telegram
Кейсы с цифрами, работа с ИИ-агентами и ошибки, за которые уже заплачено. В канале они выходят первыми, там же обсуждение и файлы.