Qwen3.8 Max вышла: выше Claude Fable 5 в агентном индексе, $6 за миллион выходных токенов
3 августа вышла финальная Qwen3.8 Max от Alibaba: 2,4 трлн параметров, контекст до 1 млн токенов, мультимодальность. По данным Artificial Analysis, в Agentic Index модель набрала 58,4 балла против 56,6 у Claude Fable 5. Цена - $2 вход / $6 выход за миллион токенов, в 5-8 раз дешевле Fable 5.
3 августа 2025 Alibaba выпустила финальную Qwen3.8 Max - модель, о которой в июле говорили только на уровне обещаний: без независимых тестов, без цены, без открытых весов. За неделю после релиза накопилось достаточно данных, чтобы проверить, что из этих обещаний выполнено.
Что за модель
Qwen3.8 Max - нативная мультимодальная модель на архитектуре MoE (смесь экспертов) с 2,4 трлн параметров. Принимает текст, изображения и видео, возвращает текст.
Контекстное окно - 1 млн токенов. В режиме мышления доступно до 983 тыс. входных и 131 тыс. выходных токенов. Для ориентира: миллион токенов вмещает примерно десять романов или несколько крупных репозиториев с документацией.
Гибридное мышление включено по умолчанию. Модель умеет вызывать функции, работать со встроенными инструментами и выдавать структурированный результат. Alibaba продвигает её для программирования и агентных процессов. На странице модели упоминаются проекты продолжительностью более десяти дней - пока это заявление производителя, независимого подтверждения нет.
API работает в QwenCloud.
Цифры из независимых тестов
Artificial Analysis прогнала Qwen3.8 Max через собственный набор тестов. Картина получилась неоднозначная.
В широком Intelligence Index Qwen3.8 Max набрала 58,1 балла, Claude Fable 5 - 62,1. Разрыв четыре балла. Июльское обещание «уровень сразу под Fable 5» по данным Habr выглядит точным.
В Agentic Index порядок меняется: Qwen3.8 Max - 58,4, Claude Fable 5 - 56,6. Выше Qwen стояли только два режима Claude Opus 5. Этот индекс собирает задачи, где модель работает через инструменты: терминал, многошаговые процессы, доведение задачи до конкретного результата.
Вывод простой: Claude Fable 5 сильнее в широком наборе интеллектуальных задач. Qwen3.8 Max лучше справляется с агентной работой. Для чат-бота первая цифра важнее. Для системы, которая ходит по инструментам и правит файлы, - уже вторая.
Фирменные графики Alibaba рисуют модель ещё увереннее - производитель выбирает тесты и соперников, так что независимая оценка полезнее.
Цена: в 5-8 раз дешевле Claude Fable 5
Alibaba установила ставки: $2 за миллион входных токенов и $6 за миллион выходных. Чтение закэшированного контекста - $0,25 за миллион.
Для сравнения: у Claude Fable 5 официальная цена $10 за вход и $50 за выход. Qwen дешевле в пять раз на входе и примерно в 8,3 раза на выходе.
Конкретный пример из источника: агентный процесс, который съел 10 млн входных и 5 млн выходных токенов, обойдётся в $50 на Qwen3.8 Max против $350 на Claude Fable 5. Разница семикратная.
Ещё деталь: Qwen3.8 Max дешевле даже предыдущей Qwen3.7 Max (та стоила $2,50 вход / $7,50 выход). Новый флагман получил скидку 20% ещё до того, как успел состариться.
Нюанс с токенами: модель говорит много
Скорость - около 82 выходных токенов в секунду через API Alibaba. Artificial Analysis измерила у Claude Fable 5 примерно 70 токенов в секунду. Первое появление ответа у Qwen - около 2,8 секунды.
Но есть нюанс. На полном прогоне Intelligence Index модель выдала около 150 млн токенов. Медиана сопоставимых моделей у Artificial Analysis - 66 млн. Qwen оказалась в 2,3 раза многословнее медианы.
Весь тестовый прогон обошёлся лаборатории в $1741. Эта сумма относится ко всему набору испытаний, а не к одному запросу - она показывает характер модели: Qwen охотно тратит токены на рассуждение. В длинном агентном цикле часть ценовой экономии может уйти на дополнительные шаги и подробные внутренние монологи.
Открытые веса: пока только обещаны
3 августа команда Qwen написала, что открытые веса появятся на следующей неделе. Вместе с флагманом обещана Qwen3.8-27B - версия, которую проще запускать вне больших облаков.
По состоянию на утро 10 августа поиск по официальному аккаунту Qwen на Hugging Face не находил ни одного репозитория Qwen3.8. API и чат доступны, открытые веса пока обещаны.
Даже после публикации весов Qwen3.8 Max не станет моделью для ноутбука. 2,4 трлн параметров занимают примерно 4,8 ТБ в BF16. Четырёхбитная версия потребует около 1,2 ТБ без накладных расходов. Такой локальный запуск начинается с серверной стойки.
Для большинства разработчиков интереснее будет именно Qwen3.8-27B - если обещание выполнят, она сможет попасть на рабочие станции и доступные GPU-серверы.
Что это значит
Если ты строишь агентные системы или работаешь с очень длинными документами, Qwen3.8 Max - разумный вариант для тестирования прямо сейчас. По агентным задачам она обходит Claude Fable 5, а по цене разрыв настолько ощутимый, что считать его в конкретных проектах стоит обязательно.
Для общих интеллектуальных задач и чат-сценариев Claude Fable 5 пока сильнее по индексу.
Обе модели доступны через API. Qwen3.8 Max работает через QwenCloud - это важно, если тебе нужен доступ без VPN: у Alibaba есть российские пользователи, и QwenCloud технически доступен из РФ, хотя стоит проверить актуальный статус оплаты самостоятельно.
Источник: Habr, 10 августа 2025