Перейти к содержимому
Команда ClaudexiaAI CODE REVIEW

PR review bot на Claude и GPT: безопасный pipeline

Как собрать PR review bot на Claude или GPT: контекст diff, проверки CI, таблица маршрутизации, черновик комментариев и контроль публикации.

Какие модели сравнить

Не называйте модель лучшей без своей выборки. Соберите несколько закрытых PR с известными дефектами, уберите секреты и запустите один и тот же prompt.

СценарийКандидаты из текущего каталогаКритерий выбора
Обычный diffclaude-sonnet-5, gpt-6-solДоля полезных замечаний и время ответа
Авторизация и миграцииclaude-opus-5-5, gpt-6-astraНаходит ли бот риск с шагом воспроизведения
Быстрый предварительный фильтрdeepseek-v4-flash, gemini-3.7-flashСтабильный формат и низкая доля шума
Второе мнениеДругая модель из разрешённого спискаСовпадение по подтверждённым находкам

IDs проверены в live catalog Claudexia 4 октября 2026 года. Таблица задаёт план эксперимента. Она не содержит независимого рейтинга и не обещает одинаковую точность на чужом коде.

Архитектура review pipeline

ШагВходРезультатЗащита
ТриггерPull request и SHAОдно событие на commitИдемпотентный ключ
Сбор контекстаDiff, контракты, тесты, правилаОграниченный пакетИсключение секретов и дампов
AI-проходPrompt и ID моделиКандидаты на находкиЗапрет общих советов
ПроверкаЛинтер, typecheck, тестыПодтверждённые рискиНе публиковать без доказательства
ПубликацияЧерновик или комментарийОбратная связь по строкеРешение человека

Безопасный процесс для CI

  1. Workflow получает SHA и строит diff относительно базовой ветки.
  2. Фильтр исключает .env, ключи, production-дампы и большие бинарные файлы.
  3. Сборщик добавляет изменённые интерфейсы, тесты и локальные правила проекта.
  4. Модель должна вернуть JSON с файлом, строкой, последствием и шагом проверки.
  5. CI запускает затронутые тесты, линтер и typecheck.
  6. Публикатор оставляет draft, если находка не подтверждена командой.
  7. Владелец PR решает, нужен ли фикс. Бот не мержит ветку и не меняет код без отдельной команды.

В prompt полезно запретить фразы «можно улучшить» и «стоит рассмотреть». Каждая находка должна отвечать на три вопроса: какой сценарий ломается, почему это следует из diff и как повторить проблему. Такой формат легче проверить человеку.

Секрет хранится в secret CI и подставляется только в job ревью. Для повторных запусков используйте request ID, commit SHA и ограничение параллельности. Разбор облачного запуска собран в статье «Облачная автоматизация AI review», а общий pipeline с Claude и GPT описан в отдельном руководстве.

После регистрации в Claudexia создайте отдельный ключ для CI, выставьте лимит и сначала прогоните бота на закрытых PR. Для каждого репозитория храните свою статистику: полезные находки, подтверждённые дефекты, ложные срабатывания, время до комментария и стоимость запуска.

FAQ

Может ли review bot нажать merge?

Не выдавайте ему это право. Бот может собрать доказательства и поставить статус проверки, но merge должен зависеть от CI и ответственного человека.

Какой контекст передавать модели?

Diff, базовый контракт, затронутые тесты и правила репозитория. Полный монорепозиторий редко нужен и увеличивает шум.

Что делать при спорном комментарии?

Оставить его черновиком, приложить вывод теста и попросить автора подтвердить сценарий. Если воспроизведения нет, находку не следует публиковать как дефект.