VCLVibe Coding LabИИ в работе — без VPN
Подписаться
НейросетиНовостиСтатус нейросетейДоступ из РФ
РАЗДЕЛЫ
ТуториалыАвтоматизацииИнструментыВайбкодинг
БИБЛИОТЕКИ
ПромптыШаблоныMCP-серверыГлоссарийПодписаться в Telegram
ГлавнаяНовостиQwen3.8 Max вышла: выше Claude Fable 5 в агентном индексе, $6 за миллион выходных токенов
НовостьРелизqwen

Qwen3.8 Max вышла: выше Claude Fable 5 в агентном индексе, $6 за миллион выходных токенов

VCL
Редакция
Vibe Coding Lab
10 августа 2026обновлено 10.08
4 мин чтения
КОРОТКО

3 августа вышла финальная Qwen3.8 Max от Alibaba: 2,4 трлн параметров, контекст до 1 млн токенов, мультимодальность. По данным Artificial Analysis, в Agentic Index модель набрала 58,4 балла против 56,6 у Claude Fable 5. Цена - $2 вход / $6 выход за миллион токенов, в 5-8 раз дешевле Fable 5.

3 августа 2025 Alibaba выпустила финальную Qwen3.8 Max - модель, о которой в июле говорили только на уровне обещаний: без независимых тестов, без цены, без открытых весов. За неделю после релиза накопилось достаточно данных, чтобы проверить, что из этих обещаний выполнено.

Что за модель

Qwen3.8 Max - нативная мультимодальная модель на архитектуре MoE (смесь экспертов) с 2,4 трлн параметров. Принимает текст, изображения и видео, возвращает текст.

Контекстное окно - 1 млн токенов. В режиме мышления доступно до 983 тыс. входных и 131 тыс. выходных токенов. Для ориентира: миллион токенов вмещает примерно десять романов или несколько крупных репозиториев с документацией.

Гибридное мышление включено по умолчанию. Модель умеет вызывать функции, работать со встроенными инструментами и выдавать структурированный результат. Alibaba продвигает её для программирования и агентных процессов. На странице модели упоминаются проекты продолжительностью более десяти дней - пока это заявление производителя, независимого подтверждения нет.

API работает в QwenCloud.

Цифры из независимых тестов

Artificial Analysis прогнала Qwen3.8 Max через собственный набор тестов. Картина получилась неоднозначная.

В широком Intelligence Index Qwen3.8 Max набрала 58,1 балла, Claude Fable 5 - 62,1. Разрыв четыре балла. Июльское обещание «уровень сразу под Fable 5» по данным Habr выглядит точным.

В Agentic Index порядок меняется: Qwen3.8 Max - 58,4, Claude Fable 5 - 56,6. Выше Qwen стояли только два режима Claude Opus 5. Этот индекс собирает задачи, где модель работает через инструменты: терминал, многошаговые процессы, доведение задачи до конкретного результата.

Вывод простой: Claude Fable 5 сильнее в широком наборе интеллектуальных задач. Qwen3.8 Max лучше справляется с агентной работой. Для чат-бота первая цифра важнее. Для системы, которая ходит по инструментам и правит файлы, - уже вторая.

Фирменные графики Alibaba рисуют модель ещё увереннее - производитель выбирает тесты и соперников, так что независимая оценка полезнее.

Цена: в 5-8 раз дешевле Claude Fable 5

Alibaba установила ставки: $2 за миллион входных токенов и $6 за миллион выходных. Чтение закэшированного контекста - $0,25 за миллион.

Для сравнения: у Claude Fable 5 официальная цена $10 за вход и $50 за выход. Qwen дешевле в пять раз на входе и примерно в 8,3 раза на выходе.

Конкретный пример из источника: агентный процесс, который съел 10 млн входных и 5 млн выходных токенов, обойдётся в $50 на Qwen3.8 Max против $350 на Claude Fable 5. Разница семикратная.

Ещё деталь: Qwen3.8 Max дешевле даже предыдущей Qwen3.7 Max (та стоила $2,50 вход / $7,50 выход). Новый флагман получил скидку 20% ещё до того, как успел состариться.

Нюанс с токенами: модель говорит много

Скорость - около 82 выходных токенов в секунду через API Alibaba. Artificial Analysis измерила у Claude Fable 5 примерно 70 токенов в секунду. Первое появление ответа у Qwen - около 2,8 секунды.

Но есть нюанс. На полном прогоне Intelligence Index модель выдала около 150 млн токенов. Медиана сопоставимых моделей у Artificial Analysis - 66 млн. Qwen оказалась в 2,3 раза многословнее медианы.

Весь тестовый прогон обошёлся лаборатории в $1741. Эта сумма относится ко всему набору испытаний, а не к одному запросу - она показывает характер модели: Qwen охотно тратит токены на рассуждение. В длинном агентном цикле часть ценовой экономии может уйти на дополнительные шаги и подробные внутренние монологи.

Открытые веса: пока только обещаны

3 августа команда Qwen написала, что открытые веса появятся на следующей неделе. Вместе с флагманом обещана Qwen3.8-27B - версия, которую проще запускать вне больших облаков.

По состоянию на утро 10 августа поиск по официальному аккаунту Qwen на Hugging Face не находил ни одного репозитория Qwen3.8. API и чат доступны, открытые веса пока обещаны.

Даже после публикации весов Qwen3.8 Max не станет моделью для ноутбука. 2,4 трлн параметров занимают примерно 4,8 ТБ в BF16. Четырёхбитная версия потребует около 1,2 ТБ без накладных расходов. Такой локальный запуск начинается с серверной стойки.

Для большинства разработчиков интереснее будет именно Qwen3.8-27B - если обещание выполнят, она сможет попасть на рабочие станции и доступные GPU-серверы.

Что это значит

Если ты строишь агентные системы или работаешь с очень длинными документами, Qwen3.8 Max - разумный вариант для тестирования прямо сейчас. По агентным задачам она обходит Claude Fable 5, а по цене разрыв настолько ощутимый, что считать его в конкретных проектах стоит обязательно.

Для общих интеллектуальных задач и чат-сценариев Claude Fable 5 пока сильнее по индексу.

Обе модели доступны через API. Qwen3.8 Max работает через QwenCloud - это важно, если тебе нужен доступ без VPN: у Alibaba есть российские пользователи, и QwenCloud технически доступен из РФ, хотя стоит проверить актуальный статус оплаты самостоятельно.

Источник: Habr, 10 августа 2025

Habr · 10 августа
Свежие новости — в Telegram
Главное за день — коротко, без воды.
Подписаться