VCLVibe Coding LabИИ в работе — без VPN
Подписаться
НейросетиНовостиСтатус нейросетейДоступ из РФ
РАЗДЕЛЫ
ТуториалыАвтоматизацииИнструментыВайбкодинг
БИБЛИОТЕКИ
ПромптыШаблоныMCP-серверыГлоссарийПодписаться в Telegram
ГлавнаяНовостиПул-реквестов от ИИ стало вчетверо больше: кто теперь проверяет код
НовостьНовостьClaude CodeCursor

Пул-реквестов от ИИ стало вчетверо больше: кто теперь проверяет код

VCL
Редакция
Vibe Coding Lab
16 августа 2026обновлено 16.08
5 мин чтения
КОРОТКО

По данным The Information, пул-реквесты от ИИ-агентов на GitHub выросли с 4 млн в месяц в сентябре 2025-го до 17 млн в марте 2026-го. 12 августа стартапы CodeRabbit и Blacksmith подняли суммарно почти $190 млн - на автоматическом ревью и CI-прогоне этого кода. Узкое место разработки сместилось с написания на проверку.

17 миллионов пул-реквестов в месяц от агентов - и каждый надо прочитать, собрать и решить, пускать ли в продакшн. Именно вокруг этого узкого места 12 августа сформировался новый венчурный кластер.

Откуда цифры

По данным The Information, ИИ-агенты отправляли на GitHub около 4 млн пул-реквестов в месяц в сентябре 2025 года. К марту 2026-го - уже больше 17 млн. Вчетверо за полгода. Авторами значатся Claude Code, Codex, Cursor и другие агенты.

Человек, которому это всё надо проверить, быстрее не стал.

$190 млн за один день

12 августа два стартапа в категории проверки кода объявили о раундах одновременно:

  • CodeRabbit - $143 млн при оценке $1,5 млрд
  • Blacksmith - $45 млн при оценке $550 млн

Три года назад этой категории почти не существовало. Логика инвесторов прямая: писать код стало дешевле (токены и подписки, но всё равно дешевле, чем раньше), а читать и проверять - нет. Производительность выросла на входе, а выход по-прежнему упирается в человека с правом мержа.

Что говорит статистика

Несколько цифр из источника, которые дают контекст:

  • По данным Anthropic, больше 80% её кода теперь пишет модель.
  • Опрос Sonar: 61% разработчиков регулярно получают от ИИ код, который выглядит правильным, но которому нельзя доверять.
  • 38% считают, что ревьюить ИИ-код труднее, чем человеческий; обратного мнения придерживаются 27%.
  • Главным навыком эпохи ИИ участники того же опроса назвали умение проверять сгенерированное.

Как работает CodeRabbit

Сооснователь и CEO Харджот Гилл описывает продукт не как «агентный цикл», а как конвейер, где большая часть работы - подготовка контекста.

Когда открывается пул-реквест, задача встаёт в очередь (в пике - 10 ревью в секунду). Репозиторий клонируется в одноразовую изолированную виртуалку, проект собирается, запускаются больше 20 линтеров и статических анализаторов. Дешёвые модели собирают 10-15 сигналов - сам дифф, граф связей кода, тикеты из Jira, логи упавших проверок, накопленные предпочтения команды - и сжимают их в бриф: файл на 4000 строк превращается в несколько затронутых функций.

Потом передовая модель расследует изменение: буквально пишет команды для терминала в изолированной песочнице, открывает файлы, ищет вызовы изменённой функции, гоняет тесты. Финальный этап - отдельная модель-судья, которая проверяет каждую находку и отбрасывает необоснованные. Всего в конвейере семь-восемь моделей; пользователь не видит, какая что делает.

Ключевая архитектурная ставка - живой граф связей кода вместо поиска похожих фрагментов. Дорогой баг, по словам команды, обычно живёт в файле, которого в диффе нет.

CodeRabbit против встроенного ревью от Anthropic

9 марта Anthropic запустила Code Review для Claude Code: пять параллельных агентов смотрят на изменение с разных углов, каждая находка получает оценку уверенности, публикуются только те, что выше порога. По данным Anthropic, доля пул-реквестов с замечаниями выросла с 16% до 54% при менее чем 1% ошибок.

CodeRabbit парирует несколькими аргументами. Ревью от Anthropic, скорее всего, работает на модели того же семейства, что писала код, - значит, они делят одни слепые пятна. CodeRabbit гоняет ансамбль моделей разных производителей плюс отдельного судью и акцентирует слово «независимый» в каждом релизе. Плюс практические отличия: четыре Git-платформы против одного GitHub у Anthropic, фиксированная цена за пользователя против $15-25 за одно ревью по токенам, доступность любым командам (не только Team и Enterprise).

Вместе с раундом CodeRabbit объявил о расширении продукта: компания называет себя теперь «слоем управления изменениями» (Agentic Change Management). Новый модуль Triage оценивает входящие пул-реквесты по ценности, риску, срочности и готовности: важное - людям, низкорисковое - в автоматические конвейеры, дубли и сырое - из очереди вон.

Текущий масштаб: 17 000 клиентов (Nvidia, BMW, Adyen в их числе), больше 2 млн ревью в неделю, выручка выросла в пять раз за год.

Как работает Blacksmith

Blacksmith отвечает за другой вид проверки - не чтение, а прогон. CI (continuous integration): каждое изменение заставляет машину заново собрать программу и прогнать сотни или тысячи тестов, и только зелёный результат пропускает дальше.

Стандартный вариант - GitHub Actions от Microsoft, где платят за минуты работы серверов. Таких минут в начале 2026 года набегало до 2,1 млрд в неделю против 500 млн в 2023-м.

Blacksmith начинался как замена этим серверам: одна строчка в конфиге - и те же тесты бегут на его машинах, по заявлению компании вдвое быстрее и вдвое дешевле. Секрет в железе: тесты - это цепочка последовательных шагов, которую не распараллелить на тысячу ядер, поэтому важна скорость одного ядра. А быстрые и дешёвые одиночные ядра стоят в игровых процессорах - на них и гоняет CI Blacksmith.

Число CI-задач растёт на 5-10% каждую неделю с начала 2026 года. Компания прямо связывает это с Claude Code и Codex: агент, который сам чинит и перепроверяет код, гоняет тесты чаще, чем человек. Число клиентов за год выросло с 800 до 6000; деньги раунда пойдут в основном в железо.

Что это значит

Если ты работаешь с ИИ-инструментами для разработки или управляешь командой, которая их использует, вот практический вывод: скорость генерации кода уже не главная переменная. Главная - сколько стоит проверить то, что нагенерировали.

CodeRabbit и Blacksmith показывают, что рынок это понял. CodeRabbit берёт фиксированную плату за пользователя и поддерживает четыре платформы - если команда не сидит только на GitHub и не хочет платить $15-25 за каждый ревью-прогон, это считаемая альтернатива. Blacksmith актуален, если CI-минуты уже заметны в бюджете: игровые ядра вместо стандартных серверов - ставка нишевая, но логика понятна.

Оба стартапа выросли на том, что агенты создали новую нагрузку, которую не заложили в старую инфраструктуру. Следующий вопрос - появятся ли агенты, которые будут проверять работу этих проверщиков.


Источник: Habr, 16 августа - https://habr.com/ru/articles/1070936/

Habr · 16 августа
Свежие новости — в Telegram
Главное за день — коротко, без воды.
Подписаться