Компания Alibaba сделала значительный шаг вперед в сфере искусственного интеллекта, презентовав модель Qwen3-Next-80B-A3B. Эта система обладает мощностью 80 миллиардов параметров, но активирует только 3 миллиарда на токен, что позволяет существенно снизить затраты на обучение и инференс — в десять раз по сравнению с предыдущей моделью Qwen3-32B. Особенно она эффективна при работе с текстами длиной от 32 тысяч токенов и более.
Модель построена на гибридной архитектуре Gated DeltaNet + Gated Attention, обеспечивающей высокую скорость и точность. Уникальная схема Mixture-of-Experts задействует 512 экспертов, из которых одновременно работают только десять, что позволяет оптимально распределять вычислительные ресурсы.
Кроме того, Qwen3-Next-80B-A3B поддерживает Multi-Token Prediction, что увеличивает скорость генерации текста без потери качества. В тестах эта модель опережает Qwen3-32B и близка к результатам Qwen3-235B, но по более низкой цене. Специализированные версии Qwen3-Next-80B-A3B-Instruct и Qwen3-Next-80B-A3B-Thinking показывают результаты, сравнимые с конкурентами, в том числе Google Gemini-2.5-Flash-Thinking.
Модель уже доступна на платформах Qwen Chat, HuggingFace, ModelScope, Kaggle и в облаке Alibaba Cloud. Используйте BotHub для автоматизации рутинных задач и получите 100 000 бесплатных токенов для начала работы с нейросетями!