VCLVibe Coding LabИИ в работе — без VPN
Подписаться
НейросетиНовостиСтатус нейросетейДоступ из РФ
РАЗДЕЛЫ
ТуториалыАвтоматизацииИнструментыВайбкодинг
БИБЛИОТЕКИ
ПромптыШаблоныMCP-серверыГлоссарийПодписаться в Telegram
ГлавнаяНовостиКитайский агент Qiushi Engine обошёл Claude Code в тесте автономных исследований
НовостьНовостьClaude Code

Китайский агент Qiushi Engine обошёл Claude Code в тесте автономных исследований

VCL
Редакция
Vibe Coding Lab
21 июля 2026обновлено 21.07
2 мин чтения
КОРОТКО

Qiushi Engine от Чжэцзянского университета занял первое место в бенчмарке ResearchClawBench, обойдя Claude Code от Anthropic. Тест проверяет, могут ли ИИ-агенты самостоятельно проводить исследования и воспроизводить выводы научных работ. При этом авторы признают: к надёжным новым открытиям агент пока не готов.

Китайский ИИ-агент занял первую строчку в бенчмарке, специально созданном для проверки автономных исследовательских способностей. Результат примечательный - но с оговорками.

Что такое ResearchClawBench

Benchmark разработала команда под руководством Shanghai Artificial Intelligence Laboratory. Задача теста - проверить, могут ли ИИ-агенты самостоятельно проводить исследования: воспроизводить выводы реальных научных статей или превосходить их авторов.

По сути, это попытка измерить то, что разработчики агентов обещают в пресс-релизах, - и сравнить обещания с реальностью.

Кто такой Qiushi Engine

Qiushi Engine создала команда под руководством Чжэцзянского университета (Zhejiang University). Официальный запуск состоялся на прошлой неделе.

Агент построен на базе большой языковой модели и, по словам разработчиков, предназначен для проведения научных исследований в реальных физических условиях. Ключевое заявление команды: Qiushi Engine способен на «сквозное автономное научное открытие» - в отличие от ряда других систем, ограниченных конкретными задачами.

Результат в бенчмарке

Qiushi Engine возглавил лидерборд ResearchClawBench, обойдя Claude Code от Anthropic. Конкретные числовые показатели в источнике не приводятся.

Важная оговорка

Сам факт лидерства в бенчмарке не означает, что агент готов делать настоящие открытия. Разработчики и авторы материала прямо указывают: Qiushi Engine пока не может надёжно генерировать новые знания. Воспроизвести чужой вывод и сделать собственный - разные вещи.

Что это значит

Если ты занимаешься R&D, автоматизацией аналитики или просто следишь за тем, как далеко зашли ИИ-агенты в научном поиске, - Qiushi Engine стоит держать в поле зрения. Результат в ResearchClawBench показывает, что китайские команды серьёзно работают над агентами для реальной исследовательской работы, а не только для чата.

Однако до момента, когда агент начнёт стабильно выдавать открытия, которых не было раньше, ещё далеко. Бенчмарк - это воспроизведение уже известного. Следующий шаг - генерация нового.

Источник: South China Morning Post, 21 июля 2025 - https://www.scmp.com/news/china/science/article/3361370/chinese-ai-agent-outperforms-anthropics-claude-code-autonomous-research

Scmp · 21 июля
Свежие новости — в Telegram
Главное за день — коротко, без воды.
Подписаться