Компания Alibaba Cloud анонсировала запуск инновационной системы Aegaeon, способной кардинально сократить потребность в видеокартах Nvidia для работы с AI-моделями. Эта система решает важную задачу эффективного распределения вычислительных ресурсов, которые часто используются неравномерно. В традиционных облачных сервисах лишь несколько моделей, такие как Qwen и DeepSeek, работают на полную мощность, в то время как остальные остаются неактивными, занимая дорогостоящие графические процессоры. Aegaeon позволяет динамически перераспределять ресурсы, что позволяет GPU переключаться между моделями в реальном времени во время генерации ответов. Теперь один графический процессор способен одновременно обрабатывать до семи моделей, тогда как раньше их было лишь два или три. Кроме того, время задержки при смене задач сократилось на впечатляющие 97%. Система уже внедрена на маркетплейсе Bailian, где представлены сотни AI-моделей от различных разработчиков. Эксперты уверены, что Aegaeon станет важным шагом к более устойчивому и экономичному AI, особенно в условиях нехватки мощных GPU.