Месяц с агентом для кода: три тихих регрессии, ноль — у автора

Ускорение от агента, который пишет код за вас, обнуляется, если вы мержите без построчного сомнения: техлид месяц отдал почти всё агенту для кода, а три правдоподобных бага поймали два самых младших в команде, тогда как он сам и существующие тесты не заметили ни одного. Для соло-разработчика без «медленного читателя» рядом это не карьерный анекдот, а цикл «агент печатает, вы листаете diff»; в кейсе разбирают, где агент реально экономит время и где ломает тихо.
Громкий баг против правдоподобного: два класса риска у агента
Лента про ИИ-инструменты полна скриншотов «стало в десять раз быстрее». Автор кейса контрастирует это с частью, которую не выкладывают: код компилируется, тесты зелёные, diff похож на ваш стиль, и только потом всплывает утечка кеша между пользователями или тихое расширение прав на роль.
Ожидаемый сбой от модели громкий: несуществующий API, проект не собирается; его видно сразу и чинить дёшево. Месяц с агентом показал другой класс: правдоподобные ошибки, которые проходят имеющийся CI так же, как прошли бы ваши черновики в чужом pull request, если бы вы их не дочитали.
Три регрессии, которые агент и тесты пропустили
За тот месяц автор перечисляет три примера. Все собирались и проходили уже написанные тесты.
Кеш
Ключ кеша завязан на изменяемый объект; при конкурентных запросах иногда отдавался результат другому пользователю. В тестах не было сценария с параллельной нагрузкой.
Повторы запросов
Обёртка повторяла попытку на любое исключение, включая ошибку валидации, которую повтором не лечится. Вместо чистого ответа 400 клиент получал подвисание порядка тридцати секунд и логи, похожие на сетевой сбой.
Права
«Упрощение» двух условий в одно выглядело аккуратно и незаметно расширило доступ для одной роли.
Ни один из этих сценариев не был «галлюцинацией в лоб». Это серверные паттерны, которые агент выдал в духе «код, который вы бы написали сами». Конкретный вендор агента или IDE в тексте поста не назван, только категория агента для кода; подменять Copilot, Claude Code или Cursor фактом из статьи нельзя.
Почему старший «пролистал», а младший — нет
Автор, техлид и ведущий backend-архитектор с большим стажем, пишет прямо: он не поймал ни одного бага, и это «сделало его слабым звеном». Младшие коллеги, двое, ловили ошибки построчным чтением, потому что не могли бегло просмотреть правки без понимания каждой строки.
У старшего сработало ревью по шаблону: вывод агента выглядел как ваш код, поэтому его пролистали так же, как когда-то пролистали бы свой. В цикле с плотным использованием ИИ модель, по мысли автора, печатает, а сомневаться остаётся человеку; медленное чтение младшего в такой схеме не «тормоз», а страховка.
Тезис «ИИ заменит младших» автор называет неверным: в цикле с агентом ценность как раз у того, кто не доверяет красивым правкам.
Четыре правила ревью после месяца с агентом
От агента автор не отказался. Он изменил контракт ревью. Четыре пункта из поста, без выдуманного конвейера промптов или CI:
- Код от агента ревьюить строже, чем от человека, а не слабее из-за «модель уже хорошая».
- Смотреть как на чужой pull request, убрать рефлекс «это же я бы так написал».
- «Тесты прошли» значит: прошли только те тесты, что уже были; каждый раз спрашивать, какой вход не покрыт.
- Пусть медленный читатель выигрывает спор: вопрос младшего коллеги вроде «зачем повтор на всё?» — это работа ревью, не придирка.
Для шаблонного кода, связки и одноразовых скриптов автор по-прежнему считает агента почти бесплатным; опасность в правдоподобном классе, где ускорение без такого контракта оставляет регрессии невидимыми для того, кто мержит.
Закрывающий вопрос автора к аудитории: ловили ли вы баг от ИИ-кода, который при ревью человека заметили бы сразу. Полезный чек для любого, кто один на репозитории и без второго глаза.
Источники
- Rudratosh Shastri (@rudratosh), «I let AI write my code for a month. The junior devs caught what it broke — I didn't.» — Dev.to (опубликовано 29 сентября 2026; материал сверен 30 сентября 2026 UTC).