Команда Qwen из Alibaba Cloud выпустила пять новых компактных моделей серии Qwen3.5 с параметрами 9B, 4B, 2B и 0.8B. Все они имеют dense-формат и открытые веса под лицензией Apache 2.0. Это заключительная часть линейки, состоящей из трех этапов: флагманская модель на 397B-A17B была представлена 16 февраля, средние модели (122B-A10B, 35B-A3B, 27B) — 24 февраля, а теперь добавлены компактные версии для локального запуска. Модели доступны не только на Hugging Face, но и на ModelScope и Ollama. Для запуска 9B-версии требуется лишь команда: ollama run qwen3.5:9b. Главные результаты показывают, что 9B-модель набирает 82.5 на MMLU-Pro, обгоняя GPT-OSS-120B и Qwen3-30B-A3B. Все модели построены на гибридной архитектуре Gated DeltaNet + Gated Attention, поддерживая контекст до 262 тысяч токенов. Даже 4B-модель демонстрирует выдающиеся результаты, требуя видеокарту уровня RTX 3060/4060 для запуска. Модель 0.8B предназначена для встроенных устройств и edge-сценариев.
0
Понравилась статья? Поделиться с друзьями:
Вам также может быть интересно
Интернет-магазин профессиональной косметики и БАД В современном мире ухоженная внешность стала не только признаком
Услуги по пошиву штор на заказ в Орле Современный интерьер невозможно представить без красивых
Игровая зависимость давно перестала быть проблемой узкого круга людей. Она затрагивает подростков, взрослых, состоявшихся
Чистая питьевая вода — один из базовых элементов комфортной жизни, о котором задумываются далеко
Покупка квартиры в новостройках Севастополя При наличии желания стать обладателем квартиры в красивом и
В последние годы мировой и локальный рынки претерпели значительные изменения, что напрямую отразилось на