В интернете появились предполагаемые результаты технического отчета DeepSeek V4, который включает сравнительные данные на 12 известных бенчмарках. Пользователь с ником @xiangxiang103 поделился скриншотами, где новая модель китайской компании сопоставляется с Gemini 3.1 Pro, GPT-5.3, Opus 4.6 и GPT-4.1. Если информация окажется правдивой, то DeepSeek V4 уверенно лидирует по всем ключевым показателям. На тесте MMLU-Pro модель набрала 91,2 балла, в то время как ближайший конкурент, Gemini 3.1 Pro Preview, показал 90,0. В математическом тесте AIME 2025 DeepSeek V4 также лидирует с 96,4 балла, оставляя позади Gemini и GPT-5.3. В рейтинге на платформе Codeforces модель набрала 2767 баллов, что соответствует уровню сильного гроссмейстера. Однако в тесте SWE-bench Verified ее показатели составляют лишь 59,6%. В задаче WebArena DeepSeek V4 также оказался на первом месте с 58,7%. Если данные подтвердятся, DeepSeek V4 изменит расклад сил на рынке языковых моделей, оставив конкурентов позади.