По данным Beating AI, Alibaba Qwen сегодня представила Qwen3.8-Flash, а веса модели с открытым исходным кодом также доступны под названием Qwen3.8-Flash-Next. Модель построена на архитектуре нового поколения Qwen4. Мультимодальная MoE-модель содержит 125 млрд параметров, из которых активируются только 6 млрд, а также 51 млрд параметров N-граммных эмбеддингов для оптимизации использования памяти.
В официальных бенчмарках Qwen3.8-Flash превзошла Claude Opus 4.6 на 9,1 пункта в SWE-bench Pro, примерно на 20 пунктов в JobBench, на 22,5 пункта в AndroidWorld и на 25,1 пункта в MathVision. Модель изначально поддерживает контекстное окно объёмом 262 тыс. токенов с возможностью расширения до 1 млн токенов. Qwen Cloud устанавливает стоимость обработки входных данных на уровне 1 юаня за миллион токенов, а выходных — 3 юаней за миллион токенов. Alibaba заявляет, что стоимость обучения составляет примерно одну девятую стоимости обучения Qwen3.7-Plus.