VCLVibe Coding LabИИ в работе — без VPN
Подписаться
НейросетиНовостиСтатус нейросетейДоступ из РФ
РАЗДЕЛЫ
ТуториалыАвтоматизацииИнструментыВайбкодинг
БИБЛИОТЕКИ
ПромптыШаблоныMCP-серверыГлоссарийПодписаться в Telegram
ГлавнаяНовостиxAI выпустила Grok 4.6: агентный ИИ за полцены от конкурентов
НовостьРелизGrok

xAI выпустила Grok 4.6: агентный ИИ за полцены от конкурентов

VCL
Редакция
Vibe Coding Lab
12 августа 2026обновлено 12.08
4 мин чтения
КОРОТКО

xAI выпустила Grok 4.6 - модель для долгих агентных задач и сложных визуальных проектов. В Artificial Analysis Intelligence Index набирает 61 балл - уровень GPT-5.6 Sol. Цена от $2 за миллион входных токенов, примерно вдвое ниже сопоставимых предложений от OpenAI и Anthropic. Доступна в Cursor, Grok Build и через API.

12 августа xAI официально выпустила Grok 4.6 - следующую версию своей флагманской модели после Grok 4.5. Главный акцент: долго работающие агенты, сложные многошаговые задачи и визуальные проекты.

Что изменилось по сравнению с Grok 4.5

Grok 4.6 прошёл более длинный этап дополнительного обучения, чем предшественник. xAI использовала тщательно отобранные данные, сгенерированные моделями, - для развития рассуждений и понимания сложных технических концепций, улучшенный оптимизатор и обновлённую методику обучения.

Компания заново сгенерировала SFT-траектории с помощью самого Grok 4.5 для разных уровней сложности рассуждений, агентных окружений и областей: STEM, разработка ПО, интеллектуальная работа. Проблемные цепочки фильтровались автоматически.

После SFT модель дообучали с подкреплением (RL) на широком наборе агентных задач: от общего программирования до специализированных сред - оптимизация ядер, веб-разработка, системы автоматизированного проектирования (CAD).

По данным OrcaRouter и kie.ai, Grok 4.6 построен на той же архитектуре V9, что и Grok 4.5, и содержит 1,5 триллиона параметров. То есть база та же, но обучения сверху значительно больше.

Бенчмарки

В Artificial Analysis Intelligence Index - сводном рейтинге, объединяющем результаты девяти бенчмарков, - Grok 4.6 набирает 61 балл, что соответствует уровню GPT-5.6 Sol. Для сравнения: Grok 4.5 High там же набирал 56, Anthropic Fable 5 Max - 62.

По отдельным тестам картина смешанная:

  • DeepSWE v1.1 (инженерия ПО): 65,9% против 54% у Grok 4.5, но GPT-5.6 Sol Max там показывает 73%.
  • Terminal-Bench v3.0: 26% против 15,7% у Grok 4.5; GPT-5.6 Sol Max и Fable 5 Max - около 34%.
  • GDPVal-AA v2 (оценка интеллектуальной работы): 1753 - лидер в своей категории.
  • Также есть улучшения на CursorBench и FrontierCode.

Цифры - собственные данные xAI, третьи стороны их пока независимо не подтвердили.

Elon Musk в X назвал релиз «banger», сославшись на ELO-счёт 1753 и соотношение цена/возможности. Это число стоит воспринимать с осторожностью: по данным Basenor, публичные площадки вроде LMSYS Chatbot Arena на момент анонса ещё пересчитывали рейтинги, и независимых подтверждений пока нет - такие числа обычно стабилизируются через несколько дней или недель.

Что модель умеет на практике

xAI тестировала Grok 4.6 на проектах, требующих работы через большое количество последовательных шагов. Несколько наблюдений из официального анонса:

  • Модель способна самостоятельно изучить незнакомую предметную область, продумать архитектуру приложения, реализовать ключевые сценарии и продолжать улучшать результат с учётом обратной связи.
  • На длинных траекториях чаще появляется самопроверка: прежде чем двигаться дальше, модель проверяет собственные результаты.
  • В визуальных и интерактивных проектах Grok 4.6 с первой попытки выдаёт более качественный результат, чем обычно показывал Grok 4.5. Получив продуктовую идею, модель за один проход формирует и структуру приложения, и его визуальный язык.

Цена и доступность

Цены на API:

  • $2 за миллион входных токенов
  • $6 за миллион выходных токенов
  • Ускоренная версия - вдвое дороже

По данным Basenor, xAI прямо позиционирует это как «половина цены других фронтирных моделей» - и ориентируется на разработчиков и строителей агентов, у которых счета растут вместе с объёмом токенов.

Модель доступна:

  • Cursor (AI-редактор кода)
  • Grok Build (платформа xAI для разработчиков)
  • Grok Bot на X
  • xAI API
  • Сторонние платформы: OpenRouter, Vercel, Cloudflare

В течение первой недели xAI удваивает включённый объём использования Grok 4.6 в Cursor и Grok Build.

Безопасность

Механизмы защиты обновили под возросшие возможности модели. Перед релизом Grok 4.6 прошёл самый широкий набор тестов за всю историю компании - как на сами возможности, так и на корректность защитных настроек. После запуска идут дополнительные проверки, включая независимые.

Что это значит

Если ты строишь агентные пайплайны или активно используешь Cursor - Grok 4.6 стоит проверить прямо сейчас. По бенчмаркам он дотягивается до уровня GPT-5.6 Sol при вдвое более низкой цене за токен. На практике это может заметно снизить стоимость длинных агентных сессий.

Для российских пользователей: модель доступна через OpenRouter и Cloudflare, что даёт больше вариантов подключения без прямого выхода на xAI API.

Акция с двойным лимитом в Cursor и Grok Build действует только первую неделю - если хочешь прощупать модель без дополнительных расходов, самое время.


FAQ

Grok 4.6 - это отдельная модель или апдейт? Отдельная версия поверх той же базовой архитектуры V9, что и Grok 4.5, но с существенно расширенным обучением.

Как получить доступ без прямого VPN? Модель доступна через OpenRouter, Vercel и Cloudflare - партнёрские платформы, работающие в стандартном режиме.

Когда появятся независимые оценки бенчмарков? Пока неизвестно точно. xAI публикует собственные числа; публичные рейтинги вроде LMSYS Chatbot Arena обычно стабилизируются через несколько дней или недель после релиза.

Источник: Habr, перевод официального анонса xAI, 12 августа; Basenor, 12 августа; Unite.AI, 12 августа

Habr · 12 августа
Свежие новости — в Telegram
Главное за день — коротко, без воды.
Подписаться