AI RACE— AI Race
← 전체 순위

🧠 Reasoning

Reasoning capabilities & academic knowledge — GPQA Diamond, MMLU-Pro, HLE.

모델 100/100개
#이용 방법
199.4바로가기
298.4바로가기
3
SpaceXAI
97.5–
497.2바로가기
597.2바로가기
696.8바로가기
796.2바로가기
896.1바로가기
9
Anthropic
96.0바로가기
1095.9바로가기
1195.6바로가기
1295.5바로가기
1395.3바로가기
14
SpaceXAI
95.1바로가기
1595.0바로가기
1694.5바로가기
1794.5바로가기
1894.2바로가기
1994.2바로가기
20
MiniMax
94.1바로가기
2194.0바로가기
22
OpenAI
94.0바로가기
2393.3바로가기
2493.3바로가기
2593.3바로가기
2693.3바로가기
2793.2바로가기
2893.2바로가기
2993.1바로가기
3093.0바로가기
3193.0바로가기
32
Thinking Machines
92.0–
3391.9바로가기
3491.7바로가기
35
91.7–
36
Tencent
91.7–
3791.5바로가기
38
OpenAI
91.5바로가기
3991.3바로가기
4091.3–
4191.1바로가기
4291.1–
4391.1바로가기
4491.0바로가기
45
SpaceXAI
90.8–
46
Nex AGI
90.5–
47
Institute of Foundation Models
90.5–
4890.4바로가기
4989.9바로가기
50
Motif Technologies
89.7–
51
89.6–
52
89.6–
53
Thinking Machines
89.4–
5489.3바로가기
5588.6바로가기
5688.6바로가기
57
SK Telecom
88.5–
5888.5–
5988.5바로가기
6088.3바로가기
6188.2바로가기
6288.2바로가기
63
InclusionAI
88.2–
64
OpenAI
88.1바로가기
6588.1바로가기
6687.8바로가기
6787.8바로가기
6887.3바로가기
69
87.3–
7087.2바로가기
7187.2–
7287.0바로가기
7386.8–
7486.8바로가기
7586.7바로가기
7686.6–
77
InclusionAI
86.6–
7886.5바로가기
7986.3바로가기
8086.2바로가기
8185.9바로가기
82
LG AI Research
85.8–
8385.6–
8485.6–
85
Institute of Foundation Models
85.5–
86
Xiaomi
85.5–
8785.2바로가기
8885.1바로가기
8984.9바로가기
9084.8바로가기
9184.8바로가기
92
OpenAI
84.6바로가기
9384.6바로가기
9484.5바로가기
9584.2바로가기
9684.1–
9784.0바로가기
9884.0바로가기
99
China Mobile
84.0–
10083.9바로가기

점수 산출 방식 — AIM Index

● 성능 85%● 최신성 15%
GPQA DiamondARC-AGIHLE

데이터 소스 (1)