Alibaba выпустила Qwen3.8-Flash с 6 млрд активных параметров — модель превзошла Opus 4.6 в нескольких бенчмарках для ИИ-агентов

BABA4,67 %

По данным Beating AI, Alibaba Qwen сегодня представила Qwen3.8-Flash, а веса модели с открытым исходным кодом также доступны под названием Qwen3.8-Flash-Next. Модель построена на архитектуре нового поколения Qwen4. Мультимодальная MoE-модель содержит 125 млрд параметров, из которых активируются только 6 млрд, а также 51 млрд параметров N-граммных эмбеддингов для оптимизации использования памяти.

В официальных бенчмарках Qwen3.8-Flash превзошла Claude Opus 4.6 на 9,1 пункта в SWE-bench Pro, примерно на 20 пунктов в JobBench, на 22,5 пункта в AndroidWorld и на 25,1 пункта в MathVision. Модель изначально поддерживает контекстное окно объёмом 262 тыс. токенов с возможностью расширения до 1 млн токенов. Qwen Cloud устанавливает стоимость обработки входных данных на уровне 1 юаня за миллион токенов, а выходных — 3 юаней за миллион токенов. Alibaba заявляет, что стоимость обучения составляет примерно одну девятую стоимости обучения Qwen3.7-Plus.

Дисклеймер: Информация на этой странице может быть получена из источников третьих сторон и предоставляется только для ознакомления. Она не отражает взгляды или мнения Gate и не является финансовой, инвестиционной или юридической рекомендацией. Торговля виртуальными активами связана с высоким риском. Пожалуйста, не основывайте свои решения исключительно на данных этой страницы. Подробнее смотрите в Дисклеймере.
комментарий
0/400
Нет комментариев