Новые компактные модели Qwen3.5 от Alibaba Cloud

Команда Qwen из Alibaba Cloud выпустила пять новых компактных моделей серии Qwen3.5 с параметрами 9B, 4B, 2B и 0.8B. Все они имеют dense-формат и открытые веса под лицензией Apache 2.0. Это заключительная часть линейки, состоящей из трех этапов: флагманская модель на 397B-A17B была представлена 16 февраля, средние модели (122B-A10B, 35B-A3B, 27B) — 24 февраля, а теперь добавлены компактные версии для локального запуска. Модели доступны не только на Hugging Face, но и на ModelScope и Ollama. Для запуска 9B-версии требуется лишь команда: ollama run qwen3.5:9b. Главные результаты показывают, что 9B-модель набирает 82.5 на MMLU-Pro, обгоняя GPT-OSS-120B и Qwen3-30B-A3B. Все модели построены на гибридной архитектуре Gated DeltaNet + Gated Attention, поддерживая контекст до 262 тысяч токенов. Даже 4B-модель демонстрирует выдающиеся результаты, требуя видеокарту уровня RTX 3060/4060 для запуска. Модель 0.8B предназначена для встроенных устройств и edge-сценариев.

Понравилась статья? Поделиться с друзьями: