Команда Qwen из Alibaba Cloud анонсировала пять новых компактных моделей Qwen3.5 с параметрами 9B, 4B, 2B и 0.8B. Все они имеют открытые веса и доступны под лицензией Apache 2.0. Это завершает серию, которая была представлена в три этапа: флагманская модель на 397B-A17B вышла 16 февраля, средние модели (122B-A10B, 35B-A3B, 27B) — 24 февраля, а теперь представлены компактные версии для локального использования. Модели можно найти на Hugging Face, ModelScope и Ollama, где для запуска 9B-версии достаточно одной команды: ollama run qwen3.5:9b.
По данным Qwen, 9B-модель показывает 82.5 на MMLU-Pro, что превосходит 80.8 у GPT-OSS-120B и 80.9 у Qwen3-30B-A3B. На GPQA Diamond разрыв еще более значительный: 81.7 против 73.4. Все модели используют гибридную архитектуру Gated DeltaNet + Gated Attention, поддерживая контекст до миллиона токенов. Даже 4B-модель демонстрирует впечатляющие результаты, такие как 79.1 на MMLU-Pro, работая на видеокартах уровня RTX 3060/4060. Самая компактная модель 0.8B предназначена для встраиваемых решений.

