Две цифры, которые не сходятся. Использование AI-агентов в разработке в 2026 году на рекорде, отказаться от них команды уже не готовы. При этом доля разработчиков, которые говорят, что доверяют результату, схлопнулась почти до нуля.
Люди пользуются каждый день инструментом, которому не верят. Разберём, почему это нормально и как с этим жить.
Почему доверие упало
Не потому что модели стали хуже. Наоборот, они стали лучше, и вместе с этим им стали давать задачи крупнее.
Раньше модель дописывала строку, и ошибка была видна сразу. Теперь она правит десять файлов, и ошибка прячется в связи между ними. Проверять стало дороже, чем писать.
Вторая причина в том, что уверенный тон не изменился. Модель одинаково спокойно выдаёт правильный и неправильный ответ, а сигнала «здесь я не уверена» в коде нет.
Что делать вместо слепого доверия
Считайте AI-код чужим пул-реквестом. Не потому что он хуже, а потому что вы не видели, как он писался. К чужому PR у вас уже есть привычка: прочитать, задать вопрос, прогнать тесты.
Требуйте падающий тест до правки. Если агент чинит баг, пусть сначала напишет тест, который этот баг ловит. Тест, который упал до правки и прошёл после, доказывает работу лучше любого объяснения.
Ограничивайте размер шага. Задача на десять файлов проверяется хуже, чем пять задач по два файла. Дробление стоит времени на постановку и экономит время на ревью.
Не принимайте объяснение за доказательство. Модель хорошо объясняет, что она сделала. Это не то же самое, что проверка. Запустите.
Что это значит для расходов
Недоверие имеет цену. Значительная доля токенов в индустрии уходит на починку того, что сгенерировала сама модель.
Отсюда прямая связь между качеством постановки задачи и счётом в конце месяца. Чем точнее вход, тем меньше итераций, тем меньше вы платите.
Как это выглядит в команде
Три правила, которые снимают большую часть боли:
- Автор изменения это человек, который его отправил, а не модель. Отвечает он.
- Агент не мержит сам. Ни при каких настройках.
- Расход виден по каждому ключу и проекту, чтобы было понятно, где итерации съедают бюджет.
Последнее у нас настраивается отдельно: статистика по каждому ключу и суб-организации со своим бюджетом на команду.
Коротко
Доверять сгенерированному коду не нужно. Нужно построить процесс, в котором доверие не требуется: маленькие шаги, падающий тест до правки, обычное ревью и видимый расход.