Alibaba показала Qwen3.8-Max-Preview: 2,4 трлн параметров и никаких бенчмарков
19 июля Alibaba показала Qwen3.8-Max-Preview — мультимодальную MoE-модель на 2,4 трлн параметров. Превью уже доступно через Token Plan, Qoder и QoderWork за 10% стандартной цены. Бенчмарков, model card и лицензии пока нет. Команда называет модель «второй после Fable 5», но это заявление Alibaba, не независимая оценка.
Анонс случился 19 июля 2026 года на World AI Conference (WAIC) в Шанхае — через два дня после того, как Moonshot AI выпустила Kimi K3 с открытыми весами на 2,8 трлн параметров. Совпадение? Вряд ли.
Что именно объявила Alibaba
Qwen3.8-Max-Preview описывается как первая мультимодальная модель команды Qwen выше 1 трлн параметров. Разработчик Shuai Bai уточнил: модель работает с текстом, изображениями, видео и документами. По словам команды, Qwen3.8 должна обходить Qwen3.7-Max в задачах кодинга, full-stack разработки, анализа данных и офисных сценариев.
Превью уже живое и платное. Доступ через подписку Token Plan, а также через Qoder и QoderWork — по 10% стандартной цены.
Что Alibaba не раскрыла
Вот где начинается важное. Цифра 2,4 трлн параметров - это общий счётчик, а не активные параметры на токен. У MoE-моделей (а Qwen3.8-Max - именно такая) разница принципиальная.
Для сравнения: Qwen3-235B-A22B имеет 235 млрд параметров, но активирует только 22 млрд на токен. Qwen3-30B-A3B - около 3 млрд. Для Qwen3.8-Max этот ключевой показатель пока не опубликован.
Без него нельзя оценить реальную стоимость инференса. Как подсчитал Startup Fortune, модель на 2,4 трлн параметров в формате 4-bit требует около 1,2 терабайта только под веса. Одна видеокарта Nvidia H200 вмещает 141 ГБ. Восемь карт - тоже не хватит.
Чего ещё нет на дату анонса:
- таблица бенчмарков
- model card
- лицензия
- цена за токен
- репозиторий на Hugging Face
Открытые веса обещаны «скоро» - без даты и условий.
«Второй после Fable 5» - что за заявление
Команда Qwen написала, что модель «уступает только Fable 5» среди протестированных систем. Часть комьюнити на Hacker News отнеслась к этому скептически: Qwen называют «специалистом по бенчмаркам», а не универсальным лидером. Независимой проверки этого утверждения пока нет.
На Reddit (r/LocalLLaMA) разговор ушёл в практику: как вообще запускать 2,4 трлн параметров локально и будет ли дистиллированная версия под обычное железо. На X анонс разошёлся широко, в том числе через крупные аккаунты вроде kimmonismus, с акцентом на открытые веса.
Контекст: гонка китайских лабораторий
Анонс прямо накрылся на дату выпуска Kimi K3 от Moonshot AI - тоже гигантская модель (2,8 трлн параметров) с открытыми весами. Комьюнити на Hacker News в целом читает это как прямой ответ Alibaba на ход Moonshot.
Открытая конкуренция между китайскими лабораториями в сегменте frontier-моделей - это хорошая новость для всех, кто использует открытые веса. Но пока это только конкуренция анонсами.
Что это значит
Если ты работаешь с Qwen-моделями или следишь за рынком открытых весов: превью доступно по сильно сниженной цене, и это честный повод потестировать модель на своих задачах прямо сейчас.
Но переводить на неё рабочие процессы пока рано. Подожди пяти вещей - каждую можно проверить за минуту, как только она появится:
- Официальный пост в блоге Qwen с таблицей бенчмарков
- Активное число параметров на токен
- Репозиторий на Hugging Face с лицензионным файлом
- Цены на API
- Независимая оценка от Artificial Analysis или LMArena
До тех пор - тестируй на своём воркфлоу через официальную консоль, а продуктовый трафик оставь там, где он есть.
Источник: Asif Razzaq, Marktechpost, 19 июля 2026 - ссылка