Коротко
AI-агент может написать корректный код и всё равно внести неправильное изменение. Проблема часто скрыта не в модели, а в самом репозитории — его структуре, источниках правды и устаревших артефактах.
Главный риск coding agent — не обязательно плохой код. Он может сделать технически правильный коммит, который окажется неправильным для проекта, потому что репозиторий дал ему неверный или противоречивый контекст.
Для человека такие противоречия часто незаметны: команда помнит, какой файл актуален, кто владеет частью системы и к какой ревизии относится документация. Агент видит только то, что доступно в рабочем окружении. Если в репозитории несколько правдоподобных источников, ownership не обозначен, а артефакты устарели, модель может уверенно выбрать не тот путь.
Отсюда неприятный вывод: репозиторий — это уже часть среды исполнения агента. Качество результата зависит не только от модели и промпта, но и от того, насколько однозначно в проекте описаны правила, источники истины и актуальное состояние кода.
AGENTS.md и другие файлы инструкций полезны, но не решают проблему целиком. Они могут объяснить агенту правила, однако не устраняют противоречия между файлами и не гарантируют, что найденное доказательство относится к нужной ревизии. Инструкции — это слой контекста, а не автоматическая проверка готовности репозитория.
Именно вокруг этой проблемы появился open-source framework AIRepo. По исходному материалу, его задача — помочь проверить, готов ли репозиторий к работе с AI-агентами. Это важнее очередного обещания «агент пишет код сам»: сначала нужно понять, способен ли проект дать агенту однозначную картину происходящего.
Ограничения здесь существенные: в доступном описании нет подробностей о механике AIRepo, критериях проверки, поддерживаемых инструментах или результатах применения. Поэтому воспринимать framework как доказанный способ сделать любой репозиторий безопасным пока нельзя. Факт появления инструмента есть, но его практическую эффективность ещё предстоит оценить.
Если агент ошибается из-за противоречий в репозитории, что вы бы проверили первым: инструкции, ownership или актуальность документации? Источник: Все статьи подряд / Искусственный интеллект / Хабр