Alibaba Cloud запускает Aegaeon для оптимизации использования GPU

Компания Alibaba Cloud анонсировала инновационную систему под названием Aegaeon, способную сократить количество необходимых видеокарт Nvidia для работы с AI-моделями почти в пять раз. Эта разработка нацелена на решение одной из ключевых проблем облачных сервисов: неэффективного распределения вычислительных мощностей. В традиционных системах лишь несколько моделей, как Qwen или DeepSeek, находятся в постоянной загрузке, в то время как многие другие простаивают, используя ценные GPU. С помощью Aegaeon ресурсы перераспределяются в динамическом режиме. Ускорители могут переключаться между моделями в реальном времени, что происходит непосредственно во время обработки запросов. Инновация позволяет одному GPU обслуживать до семи моделей одновременно, в отличие от двух или трёх ранее. При этом задержки при смене задач сократились на 97%. Система уже активно используется на маркетплейсе Bailian от Alibaba Cloud, где представлено множество AI-моделей от сторонних разработчиков. Эксперты уверены, что Aegaeon станет важным шагом к более эффективному и экономичному AI, особенно в условиях нехватки мощных GPU.

Понравилась статья? Поделиться с друзьями: