Пул-реквестов от ИИ стало вчетверо больше: кто теперь проверяет код
По данным The Information, пул-реквесты от ИИ-агентов на GitHub выросли с 4 млн в месяц в сентябре 2025-го до 17 млн в марте 2026-го. 12 августа стартапы CodeRabbit и Blacksmith подняли суммарно почти $190 млн - на автоматическом ревью и CI-прогоне этого кода. Узкое место разработки сместилось с написания на проверку.
17 миллионов пул-реквестов в месяц от агентов - и каждый надо прочитать, собрать и решить, пускать ли в продакшн. Именно вокруг этого узкого места 12 августа сформировался новый венчурный кластер.
Откуда цифры
По данным The Information, ИИ-агенты отправляли на GitHub около 4 млн пул-реквестов в месяц в сентябре 2025 года. К марту 2026-го - уже больше 17 млн. Вчетверо за полгода. Авторами значатся Claude Code, Codex, Cursor и другие агенты.
Человек, которому это всё надо проверить, быстрее не стал.
$190 млн за один день
12 августа два стартапа в категории проверки кода объявили о раундах одновременно:
- CodeRabbit - $143 млн при оценке $1,5 млрд
- Blacksmith - $45 млн при оценке $550 млн
Три года назад этой категории почти не существовало. Логика инвесторов прямая: писать код стало дешевле (токены и подписки, но всё равно дешевле, чем раньше), а читать и проверять - нет. Производительность выросла на входе, а выход по-прежнему упирается в человека с правом мержа.
Что говорит статистика
Несколько цифр из источника, которые дают контекст:
- По данным Anthropic, больше 80% её кода теперь пишет модель.
- Опрос Sonar: 61% разработчиков регулярно получают от ИИ код, который выглядит правильным, но которому нельзя доверять.
- 38% считают, что ревьюить ИИ-код труднее, чем человеческий; обратного мнения придерживаются 27%.
- Главным навыком эпохи ИИ участники того же опроса назвали умение проверять сгенерированное.
Как работает CodeRabbit
Сооснователь и CEO Харджот Гилл описывает продукт не как «агентный цикл», а как конвейер, где большая часть работы - подготовка контекста.
Когда открывается пул-реквест, задача встаёт в очередь (в пике - 10 ревью в секунду). Репозиторий клонируется в одноразовую изолированную виртуалку, проект собирается, запускаются больше 20 линтеров и статических анализаторов. Дешёвые модели собирают 10-15 сигналов - сам дифф, граф связей кода, тикеты из Jira, логи упавших проверок, накопленные предпочтения команды - и сжимают их в бриф: файл на 4000 строк превращается в несколько затронутых функций.
Потом передовая модель расследует изменение: буквально пишет команды для терминала в изолированной песочнице, открывает файлы, ищет вызовы изменённой функции, гоняет тесты. Финальный этап - отдельная модель-судья, которая проверяет каждую находку и отбрасывает необоснованные. Всего в конвейере семь-восемь моделей; пользователь не видит, какая что делает.
Ключевая архитектурная ставка - живой граф связей кода вместо поиска похожих фрагментов. Дорогой баг, по словам команды, обычно живёт в файле, которого в диффе нет.
CodeRabbit против встроенного ревью от Anthropic
9 марта Anthropic запустила Code Review для Claude Code: пять параллельных агентов смотрят на изменение с разных углов, каждая находка получает оценку уверенности, публикуются только те, что выше порога. По данным Anthropic, доля пул-реквестов с замечаниями выросла с 16% до 54% при менее чем 1% ошибок.
CodeRabbit парирует несколькими аргументами. Ревью от Anthropic, скорее всего, работает на модели того же семейства, что писала код, - значит, они делят одни слепые пятна. CodeRabbit гоняет ансамбль моделей разных производителей плюс отдельного судью и акцентирует слово «независимый» в каждом релизе. Плюс практические отличия: четыре Git-платформы против одного GitHub у Anthropic, фиксированная цена за пользователя против $15-25 за одно ревью по токенам, доступность любым командам (не только Team и Enterprise).
Вместе с раундом CodeRabbit объявил о расширении продукта: компания называет себя теперь «слоем управления изменениями» (Agentic Change Management). Новый модуль Triage оценивает входящие пул-реквесты по ценности, риску, срочности и готовности: важное - людям, низкорисковое - в автоматические конвейеры, дубли и сырое - из очереди вон.
Текущий масштаб: 17 000 клиентов (Nvidia, BMW, Adyen в их числе), больше 2 млн ревью в неделю, выручка выросла в пять раз за год.
Как работает Blacksmith
Blacksmith отвечает за другой вид проверки - не чтение, а прогон. CI (continuous integration): каждое изменение заставляет машину заново собрать программу и прогнать сотни или тысячи тестов, и только зелёный результат пропускает дальше.
Стандартный вариант - GitHub Actions от Microsoft, где платят за минуты работы серверов. Таких минут в начале 2026 года набегало до 2,1 млрд в неделю против 500 млн в 2023-м.
Blacksmith начинался как замена этим серверам: одна строчка в конфиге - и те же тесты бегут на его машинах, по заявлению компании вдвое быстрее и вдвое дешевле. Секрет в железе: тесты - это цепочка последовательных шагов, которую не распараллелить на тысячу ядер, поэтому важна скорость одного ядра. А быстрые и дешёвые одиночные ядра стоят в игровых процессорах - на них и гоняет CI Blacksmith.
Число CI-задач растёт на 5-10% каждую неделю с начала 2026 года. Компания прямо связывает это с Claude Code и Codex: агент, который сам чинит и перепроверяет код, гоняет тесты чаще, чем человек. Число клиентов за год выросло с 800 до 6000; деньги раунда пойдут в основном в железо.
Что это значит
Если ты работаешь с ИИ-инструментами для разработки или управляешь командой, которая их использует, вот практический вывод: скорость генерации кода уже не главная переменная. Главная - сколько стоит проверить то, что нагенерировали.
CodeRabbit и Blacksmith показывают, что рынок это понял. CodeRabbit берёт фиксированную плату за пользователя и поддерживает четыре платформы - если команда не сидит только на GitHub и не хочет платить $15-25 за каждый ревью-прогон, это считаемая альтернатива. Blacksmith актуален, если CI-минуты уже заметны в бюджете: игровые ядра вместо стандартных серверов - ставка нишевая, но логика понятна.
Оба стартапа выросли на том, что агенты создали новую нагрузку, которую не заложили в старую инфраструктуру. Следующий вопрос - появятся ли агенты, которые будут проверять работу этих проверщиков.
Источник: Habr, 16 августа - https://habr.com/ru/articles/1070936/