Компания Alibaba анонсировала Qwen3-Next-80B-A3B — модель искусственного интеллекта, обладающую 80 миллиардами параметров и революционной эффективностью. В отличие от предшественников, она активирует лишь 3 миллиарда параметров на каждый токен, что делает обучение и инференс в десять раз дешевле и быстрее, чем у Qwen3-32B. Особенно хорошо модель справляется с текстами длиной от 32 тысяч токенов.
Основу Qwen3-Next-80B-A3B составляет гибридная архитектура Gated DeltaNet + Gated Attention, которая обеспечивает высокую скорость и точность. Дополнительно используется схему Mixture-of-Experts с 512 экспертами, из которых активно задействуется только десять, что оптимизирует вычислительные ресурсы.
Модель также поддерживает Multi-Token Prediction, что ускоряет генерацию текста без ущерба для качества. В тестах она показывает лучшие результаты по сравнению с Qwen3-32B, а в задачах анализа длинного контекста приближается к Qwen3-235B. Специализированные версии Qwen3-Next-80B-A3B-Instruct и Qwen3-Next-80B-A3B-Thinking демонстрируют отличные результаты в своих категориях. Новинка уже доступна на платформах Qwen Chat, HuggingFace и Alibaba Cloud. Также предлагается BotHub для упрощения работы с нейросетями, с бесплатными токенами для первых задач.


