Содержание
Qwen3.8 стала доступна для самостоятельного развёртывания
Команда Qwen выпустила на Hugging Face веса Qwen3.8-2.4T-A95B — самой мощной открытой модели в своей линейке. Это обещанное продолжение релиза Qwen3.8-Max: теперь компании и разработчики могут не только пользоваться облачным API, но и разворачивать текстовую модель на собственной инфраструктуре.
Что открыли
Qwen3.8 построена как Mixture of Experts: всего в ней 2,4 трлн параметров, но для каждого токена активируются около 95 млрд. Такая архитектура позволяет наращивать знания и возможности модели без пропорционального роста вычислений на каждом шаге. Нативное контекстное окно составляет 262 144 токена и может расширяться примерно до 1,01 млн токенов.
Открытая версия предназначена для текста и всегда работает в режиме рассуждений. Глубину анализа можно регулировать параметром reasoning_effort — от экономичного low до максимального xhigh. Модель также умеет сохранять контекст предыдущих рассуждений, что полезно для длинных агентных сценариев.
На что способна Qwen3.8
Alibaba заявляет заметный рост в программировании, исследовательских задачах, профессиональной работе и многошаговых действиях AI-агентов. В опубликованных тестах Qwen3.8-Max набрала 93 балла в PaperBench и 86,6 в Terminal Bench 2.1, а в ряде рабочих и юридических бенчмарков приблизилась к закрытым флагманским моделям или обошла их. Как обычно, результаты производителя стоит проверять на собственных задачах.
Почему это важно
Для большинства авторов и небольших команд эта модель слишком велика для локального компьютера: полноценное развёртывание потребует серверного кластера и специализированного ПО. Зато для бизнеса и облачных провайдеров открытые веса означают больший контроль над данными, настройкой и стоимостью инференса. Репозиторий уже совместим с vLLM, SGLang и TokenSpeed.
Для пользователей это усиливает конкуренцию между открытыми и закрытыми AI-сервисами. Возможности уровня Qwen-Max теперь можно адаптировать под внутренние базы знаний, кодовые проекты и автономные рабочие процессы без обязательной передачи данных внешнему API — с учётом условий собственной лицензии Qwen3.8-Max.