Алибаба выпустит Qwen 3.8-Flash-Next, представит архитектуру Qwen 4
Сообщение ChainCatcher, команда Alibaba Qwen в среду выпустит Qwen 3.8-Flash-Next, это модель смешанных экспертов (MoE) с общим количеством параметров 125 миллиардов, но каждый токен активирует только 6 миллиардов параметров. Команда позиционирует её как предварительную версию следующей архитектуры Qwen 4, а не как окончательную флагманскую модель.
Эта модель описывается как мультимодальная и построена на основе предстоящей архитектуры Qwen 4. Команда заявила, что предварительный выпуск этой ранней версии предназначен для того, чтобы разработчики могли подготовиться к последующей полной серии Qwen. Веса модели будут размещены на платформах Hugging Face и ModelScope.
На данный момент Qwen не опубликовал результаты бенчмаркинга этой модели и не выпустил сравнительные данные с собственной серией Qwen 3 или зарубежными конкурентами, конкретные цифры 125 миллиардов и 6 миллиардов параметров пока не получили официального подтверждения. В качестве модели с открытыми весами разработчики могут бесплатно загружать, донастраивать и запускать её, не отправляя данные в закрытое API, что помогает снизить затраты на хостинг модели.






