Модель Qwen3-Max Thinking от компании Alibaba теперь доступна пользователям как на официальном сайте, так и в мобильных приложениях. Для активации этого нового режима необходимо выбрать модель Qwen3-Max и включить функцию «Мышление» (Thinking). Интересной особенностью является возможность настройки максимального бюджета токенов, которые модель может использовать для рассуждений. Это помогает оптимизировать баланс между производительностью и скоростью работы.
На данный момент Alibaba ограничилась краткими обновлениями в соцсети X и не сделала официального анонса с полными бенчмарками. В результате, информация о сравнении preview-версии Thinking с обычным Qwen3-Max и другими моделями остается ограниченной. Qwen3-Max Thinking базируется на самой крупной модели Alibaba, обладающей 1 трлн параметров, использует архитектуру «смесь экспертов» (MoE) и поддерживает длинный контекст до 262 тысяч токенов, делая акцент на кодировании и агентности. Модель доступна через облачные сервисы, открытых весов у Max на данный момент нет.