Бенчмарки DeepSeek DeepSeek-V4 на ведущих оценках
Сильные результаты в рассуждении, коде, знаниях и китайских наборах — цифры, объясняющие, почему специалисты выбирают DeepSeek.
87.5%
MMLU-Pro
Выдающиеся знания и многозадачное рассуждение
90.1%
GPQA Diamond
Сложные научные Q&A на уровне flagship
84.4%
Chinese-SimpleQA
Надёжные фактические ответы на китайском
93.5%
LiveCodeBench
Оценки live-кодинга лидируют среди open source
3206
Codeforces
Рейтинг соревнований отражает сильное код-рассуждение
70.98
SuperCLUE Pro
Топовый композитный рейтинг на китайском
Оценки и приросты основаны на публичных тестах и официальных материалах; версии и настройки могут отличаться. Всегда сверяйтесь с последними официальными примечаниями DeepSeek.