Новая модель Qwen была представлена на платформе OpenRouter в ночь с 30 на 31 марта, при этом запуск прошел без официального пресс-релиза. Всё началось с одного твита исследователя Qwen, который опубликовал таблицу с бенчмарками. За первые два дня работы модели было обработано 400 миллионов completion-токенов в приблизительно 400 тысячах запросов.
По умолчанию контекстное окно модели составляет 1 миллион токенов. В тестах на Terminal-Bench 2.0 Qwen показала 61.6, что превысило 59.3 у Claude 4.5 Opus. На OmniDocBench v1.5 результаты составили 91.2 против 87.7. Однако на SWE-bench Verified модель пока уступает с 78.8 против 80.9 у Claude.
Ранние тесты сообщества на OpenRouter также показали, что скорость генерации токенов Qwen в 2-3 раза выше, чем у Claude Opus 4.6. Модель доступна через Alibaba Cloud Model Studio и Qwen Chat, а также совместима с Claude Code, Cline и OpenClaw. На данный момент Qwen остается бесплатной, окончательные цены еще не объявлены.

