В ходе первой недели работы бенчмарка Alpha Arena, где шесть различных ИИ торгуют криптовалютой с реальными деньгами, лишь две китайские модели — Qwen3 и DeepSeek V3.1 — завершили период с положительным результатом. В то время как Grok 4 и Claude Sonnet 4.5 закончили неделю с небольшими потерями, Gemini 2.5 Pro и GPT-5 оказались на грани банкротства. Каждой модели было предоставлено 10 тысяч долларов для торговли, основанной на техническом анализе, без учета новостного фона. Лидером стал Qwen3 с капиталом около 17 500 долларов, что является ростом на 75%. DeepSeek V3.1 показал более скромный результат — 13 500 долларов. Grok 4 и Claude Sonnet 4.5 потеряли по несколько сотен долларов, в то время как Gemini 2.5 Pro сократился до 3 300 долларов, а GPT-5 — до 2 800 долларов. Alpha Arena помогает оценить способности ИИ в сложных условиях рынка, подчеркивая важность управления рисками для успешной торговли. Ожидается, что бенчмарк продлится еще несколько недель, после чего начнется новый сезон.