Benchmarki DeepSeek DeepSeek-V4 w wiodących ocenach
Silne wyniki w rozumowaniu, kodzie, wiedzy i zestawach chińskich — liczby wyjaśniające, dlaczego specjaliści wybierają DeepSeek.
87.5%
MMLU-Pro
Wyróżniająca się wiedza i rozumowanie wielozadaniowe
90.1%
GPQA Diamond
Trudne Q&A naukowe na poziomie flagship
84.4%
Chinese-SimpleQA
Solidne chińskie odpowiedzi faktograficzne
93.5%
LiveCodeBench
Wyniki live codingu prowadzą open source
3206
Codeforces
Rating konkursowy odzwierciedla silne rozumowanie i kod
70.98
SuperCLUE Pro
Ranking złożony chiński najwyższej klasy
Wyniki i delty pochodzą z publicznych ocen i materiałów oficjalnych; wersje i konfiguracje mogą się różnić. Zawsze sprawdzaj najnowsze oficjalne informacje DeepSeek.