OA0
OA0 是一个探索 AI 的社区
现在注册
已注册用户请  登录
社区运行状况
注册会员 1376
主题 846
模型 3026
技能包 13874
数据集 1047
论文 585
开源项目 665
模型名称 厂商 发布时间 智能评分
GPT-6 Astra (Non-reasoning) OpenAI 2026-09-03
47.85
DeepSeek V4 Flash (Non-reasoning) DeepSeek 2026-04-24
22.07
A.X-K2 SK Telecom
22.70
Agnes 2.5 Pro Alpha Sapiens AI
26.77
Agnes 2.5 Pro Beta Sapiens AI
35.24
Agnes 3.0 Flash Sapiens AI
35.50
Apertus 70B Instruct Swiss AI Initiative
5.11
Apertus 8B Instruct Swiss AI Initiative
4.83
Apodex 1.1 Apodex
30.37
Apriel-v1.5-15B-Thinker ServiceNow
13.82
Apriel-v1.6-15B-Thinker ServiceNow
13.40
Arctic Instruct Snowflake
5.44
Celeris-1 Celeris
6.35
Claude 2.0 Anthropic
5.51
Claude 2.1 Anthropic
5.59
Claude 3 Haiku Anthropic
5.58
Claude 3 Opus Anthropic
8.72
Claude 3 Sonnet Anthropic
5.88
Claude 3.5 Haiku Anthropic
8.94
Claude 3.5 Sonnet (June '24) Anthropic
7.21
Claude 3.5 Sonnet (Oct '24) Anthropic
7.88
Claude 3.7 Sonnet (Non-reasoning) Anthropic
15.27
Claude 3.7 Sonnet (Reasoning) Anthropic
17.71
Claude 4 Opus (Non-reasoning) Anthropic
16.61
Claude 4 Opus (Reasoning) Anthropic
20.64
Claude 4 Sonnet (Non-reasoning) Anthropic
16.61
Claude 4 Sonnet (Reasoning) Anthropic
18.92
Claude 4.1 Opus (Non-reasoning) Anthropic
18.57
Claude 4.1 Opus (Reasoning) Anthropic
22.85
Claude 4.5 Haiku (Non-reasoning) Anthropic
15.41
Claude 4.5 Haiku (Reasoning) Anthropic
16.88
Claude 4.5 Sonnet (Non-reasoning) Anthropic
19.34
Claude 4.5 Sonnet (Reasoning) Anthropic
20.67
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) Anthropic
49.63
Claude Fable 5.1 (Adaptive Reasoning, High Effort, Default Fallback) Anthropic
51.15
Claude Fable 5.1 (Adaptive Reasoning, Low Effort, Default Fallback) Anthropic
46.82
Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) Anthropic
53.35
Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback) Anthropic
48.92
Claude Fable 5.1 (Adaptive Reasoning, Xhigh Effort, Default Fallback) Anthropic
53.20
Claude Instant Anthropic
5.03
Claude Opus 4.5 (Non-reasoning) Anthropic
23.68
Claude Opus 4.5 (Reasoning) Anthropic
29.10
Claude Opus 4.6 (Adaptive Reasoning, Max Effort) Anthropic
31.95
Claude Opus 4.6 (Non-reasoning, High Effort) Anthropic
26.35
Claude Opus 4.7 (Adaptive Reasoning, Max Effort) Anthropic
40.69
Claude Opus 4.7 (Non-reasoning, High Effort) Anthropic
30.93
Claude Opus 4.8 (Adaptive Reasoning, Max Effort) Anthropic
41.79
Claude Opus 5 (Adaptive Reasoning, High Effort) Anthropic
48.12
Claude Opus 5 (Adaptive Reasoning, Low Effort) Anthropic
39.35
Claude Opus 5 (Adaptive Reasoning, Max Effort) Anthropic
50.78
Claude Opus 5 (Adaptive Reasoning, Medium Effort) Anthropic
44.83
Claude Opus 5 (Adaptive Reasoning, Xhigh Effort) Anthropic
49.68
Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort) Anthropic
30.06
Claude Sonnet 4.6 (Non-reasoning, High Effort) Anthropic
24.69
Claude Sonnet 4.6 (Non-reasoning, Low Effort) Anthropic
23.30
Claude Sonnet 5 (Adaptive Reasoning, High Effort) Anthropic
31.66
Claude Sonnet 5 (Adaptive Reasoning, Low Effort) Anthropic
24.26
Claude Sonnet 5 (Adaptive Reasoning, Max Effort) Anthropic
38.16
Claude Sonnet 5 (Adaptive Reasoning, Medium Effort) Anthropic
28.05
Claude Sonnet 5 (Adaptive Reasoning, Xhigh Effort) Anthropic
34.38
Claude Sonnet 5 (Non-reasoning, High Effort) Anthropic
23.20
Cogito v2.1 (Reasoning) Deep Cogito
Command A Cohere
6.96
Command A+ Cohere
13.13
Command-R (Mar '24) Cohere
5.03
Command-R+ (Apr '24) Cohere
5.30
DBRX Instruct Databricks
5.29
DeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning) Nous Research
5.08
DeepHermes 3 - Mistral 24B Preview (Non-reasoning) Nous Research
6.07
DeepSeek Coder V2 Lite Instruct DeepSeek
5.34
DeepSeek LLM 67B Chat (V1) DeepSeek
5.30
DeepSeek R1 (Jan '25) DeepSeek
11.41
DeepSeek R1 0528 (May '25) DeepSeek
13.12
DeepSeek R1 0528 Qwen3 8B DeepSeek
8.08
DeepSeek R1 Distill Llama 70B DeepSeek
7.89
DeepSeek R1 Distill Llama 8B DeepSeek
6.48
DeepSeek R1 Distill Qwen 1.5B DeepSeek
5.51
DeepSeek R1 Distill Qwen 14B DeepSeek
7.85
DeepSeek R1 Distill Qwen 32B DeepSeek
8.38
DeepSeek V3 (Dec '24) DeepSeek
8.49
DeepSeek V3 0324 DeepSeek
9.72
DeepSeek V3.1 (Non-reasoning) DeepSeek
13.71
DeepSeek V3.1 (Reasoning) DeepSeek
13.48
DeepSeek V3.1 Terminus (Non-reasoning) DeepSeek
13.93
DeepSeek V3.1 Terminus (Reasoning) DeepSeek
14.76
DeepSeek V3.2 (Non-reasoning) DeepSeek
16.04
DeepSeek V3.2 (Reasoning) DeepSeek
21.49
DeepSeek V3.2 Exp (Non-reasoning) DeepSeek
13.88
DeepSeek V3.2 Exp (Reasoning) DeepSeek
16.58
DeepSeek V3.2 Speciale DeepSeek
14.46
DeepSeek V4 Flash 0420 (Non-reasoning) DeepSeek
18.88
DeepSeek V4 Flash 0420 (Reasoning, High Effort) DeepSeek
26.01
DeepSeek V4 Flash 0420 (Reasoning, Max Effort) DeepSeek
24.17
DeepSeek V4 Flash 0731 (Reasoning, Max Effort) DeepSeek
34.33
DeepSeek V4 Flash Vision (Reasoning, Max Effort) DeepSeek
34.84
DeepSeek V4 Pro 0424 (Non-reasoning) DeepSeek
20.83
DeepSeek V4 Pro 0424 (Reasoning, High Effort) DeepSeek
30.11
DeepSeek V4 Pro 0424 (Reasoning, Max Effort) DeepSeek
30.45
DeepSeek V4 Pro 0813 (Reasoning, Max Effort) DeepSeek
36.00
DeepSeek V4.1 Flash (Reasoning, Max Effort) DeepSeek
39.46
DeepSeek-Coder-V2 DeepSeek
5.98
DeepSeek-V2-Chat DeepSeek
5.51
DeepSeek-V2.5 DeepSeek
6.55
DeepSeek-V2.5 (Dec '24) DeepSeek
6.62
Devstral 2 Mistral
8.62
Devstral Medium Mistral
9.01
Devstral Small (Jul '25) Mistral
7.60
Devstral Small (May '25) Mistral
8.74
Devstral Small 2 Mistral
7.54
DiffusionGemma 26B A4B Google
9.51
Doubao Seed Code ByteDance Seed
16.95
ERNIE 4.5 300B A47B Baidu
7.50
ERNIE 5.0 Thinking Preview Baidu
14.26
EXAONE 4.0 32B (Non-reasoning) LG AI Research
6.33
EXAONE 4.0 32B (Reasoning) LG AI Research
8.18
EXAONE 4.5 33B LG AI Research
13.21
EXAONE 4.5 33B (Non-reasoning) LG AI Research
Exaone 4.0 1.2B (Non-reasoning) LG AI Research
5.23
Exaone 4.0 1.2B (Reasoning) LG AI Research
5.27
Falcon-H1R-7B TII UAE
7.83
G9v3-39A5B AI9Stars
21.83
G9v3-3B AI9Stars
10.84
GLM 5.3 Flash Z AI
41.81
GLM 5V Turbo (Reasoning) Z AI
23.50
GLM-4.5 (Reasoning) Z AI
12.77
GLM-4.5-Air Z AI
11.09
GLM-4.5V (Non-reasoning) Z AI
6.70
GLM-4.5V (Reasoning) Z AI
7.56
GLM-4.6 (Non-reasoning) Z AI
14.93
GLM-4.6 (Reasoning) Z AI
18.53
GLM-4.6V (Non-reasoning) Z AI
8.35
GLM-4.6V (Reasoning) Z AI
11.22
GLM-4.7 (Non-reasoning) Z AI
17.36
GLM-4.7 (Reasoning) Z AI
22.24
GLM-4.7-Flash (Non-reasoning) Z AI
10.56
GLM-4.7-Flash (Reasoning) Z AI
14.87
GLM-5 (Non-reasoning) Z AI
21.78
GLM-5 (Reasoning) Z AI
27.91
GLM-5-Turbo Z AI
26.60
GLM-5.1 (Non-reasoning) Z AI
24.24
GLM-5.1 (Reasoning) Z AI
26.06
GLM-5.2 (Non-reasoning) Z AI
22.43
GLM-5.2 (max) Z AI
33.71
GLM-5.3 (max) Z AI
44.78
GPT-3.5 Turbo OpenAI
5.49
GPT-3.5 Turbo (0613) OpenAI
GPT-4 OpenAI
6.70
GPT-4 Turbo OpenAI
7.04
GPT-4.1 OpenAI
12.69
GPT-4.1 mini OpenAI
10.16
GPT-4.1 nano OpenAI
7.82
GPT-4.5 (Preview) OpenAI
9.58
GPT-4o (Aug '24) OpenAI
7.74
GPT-4o (ChatGPT) OpenAI
7.19
GPT-4o (March 2025, chatgpt-4o-latest) OpenAI
8.96
GPT-4o (May '24) OpenAI
7.33
GPT-4o (Nov '24) OpenAI
8.44
GPT-4o Realtime (Dec '24) OpenAI
GPT-4o mini OpenAI
6.66
GPT-4o mini Realtime (Dec '24) OpenAI
GPT-5 (ChatGPT) OpenAI
10.44
GPT-5 (high) OpenAI
22.98
GPT-5 (low) OpenAI
20.79
GPT-5 (medium) OpenAI
22.87
GPT-5 (minimal) OpenAI
11.45
GPT-5 Codex (high) OpenAI
24.88
GPT-5 mini (high) OpenAI
16.77
GPT-5 mini (medium) OpenAI
20.60
GPT-5 mini (minimal) OpenAI
9.91
GPT-5 nano (high) OpenAI
12.99
GPT-5 nano (medium) OpenAI
12.48
GPT-5 nano (minimal) OpenAI
7.09
GPT-5.1 (Non-reasoning) OpenAI
13.31
GPT-5.1 (high) OpenAI
24.74
GPT-5.1 Codex (high) OpenAI
23.70
GPT-5.1 Codex mini (high) OpenAI
20.38
GPT-5.2 (Non-reasoning) OpenAI
16.98
GPT-5.2 (medium) OpenAI
26.50
GPT-5.2 (xhigh) OpenAI
30.45
GPT-5.2 Codex (xhigh) OpenAI
28.50
GPT-5.3 Codex (xhigh) OpenAI
32.50
GPT-5.4 (Non-reasoning) OpenAI
18.16
GPT-5.4 (low) OpenAI
27.58
GPT-5.4 (xhigh) OpenAI
38.98
GPT-5.4 Pro (xhigh) OpenAI
GPT-5.4 mini (Non-Reasoning) OpenAI
11.14
GPT-5.4 mini (medium) OpenAI
19.75
GPT-5.4 mini (xhigh) OpenAI
24.07
GPT-5.4 nano (Non-Reasoning) OpenAI
11.69
GPT-5.4 nano (medium) OpenAI
20.01
GPT-5.4 nano (xhigh) OpenAI
20.72
GPT-5.5 (Non-reasoning) OpenAI
23.17
GPT-5.5 (high) OpenAI
36.98
GPT-5.5 (low) OpenAI
30.71
GPT-5.5 (medium) OpenAI
33.80
GPT-5.5 (xhigh) OpenAI
38.36
GPT-5.5 Instant (June 2026) OpenAI
26.01
GPT-5.5 Instant (May 2026) OpenAI
22.69
GPT-5.5 Pro (xhigh) OpenAI
GPT-5.6 Luna (Non-reasoning) OpenAI
15.53
GPT-5.6 Luna (high) OpenAI
32.12
GPT-5.6 Luna (low) OpenAI
21.01
GPT-5.6 Luna (max) OpenAI
37.32
GPT-5.6 Luna (medium) OpenAI
25.04
GPT-5.6 Luna (xhigh) OpenAI
34.56
GPT-5.6 Sol (Non-reasoning) OpenAI
28.33
GPT-5.6 Sol (high) OpenAI
42.35
GPT-5.6 Sol (low) OpenAI
33.47
GPT-5.6 Sol (max) OpenAI
46.97
GPT-5.6 Sol (medium) OpenAI
39.24
GPT-5.6 Sol (xhigh) OpenAI
44.01
GPT-5.6 Terra (Non-reasoning) OpenAI
20.78
GPT-5.6 Terra (high) OpenAI
34.24
GPT-5.6 Terra (low) OpenAI
27.50
GPT-5.6 Terra (max) OpenAI
42.08
GPT-5.6 Terra (medium) OpenAI
30.09
GPT-5.6 Terra (xhigh) OpenAI
37.95
GPT-6 Astra (high) OpenAI
50.92
GPT-6 Astra (low) OpenAI
45.78
GPT-6 Astra (max) OpenAI
52.67
GPT-6 Astra (medium) OpenAI
49.57
GPT-6 Astra (xhigh) OpenAI
52.39
Gemini 1.0 Pro Google
5.34
Gemini 1.0 Ultra Google
5.84
Gemini 1.5 Flash (May '24) Google
5.94
Gemini 1.5 Flash (Sep '24) Google
7.07
Gemini 1.5 Flash-8B Google
6.15
Gemini 1.5 Pro (May '24) Google
6.44
Gemini 1.5 Pro (Sep '24) Google
7.91
Gemini 2.0 Flash (Feb '25) Google
8.94
Gemini 2.0 Flash (experimental) Google
8.22
Gemini 2.0 Flash Thinking Experimental (Dec '24) Google
6.56
Gemini 2.0 Flash Thinking Experimental (Jan '25) Google
9.42
Gemini 2.0 Flash-Lite (Feb '25) Google
7.41
Gemini 2.0 Flash-Lite (Preview) Google
7.33
Gemini 2.0 Pro Experimental (Feb '25) Google
8.75
Gemini 2.5 Flash (Non-reasoning) Google
9.85
Gemini 2.5 Flash (Reasoning) Google
13.11
Gemini 2.5 Flash Preview (Non-reasoning) Google
8.66
Gemini 2.5 Flash Preview (Reasoning) Google
11.65
Gemini 2.5 Flash Preview (Sep '25) (Non-reasoning) Google
12.38
Gemini 2.5 Flash Preview (Sep '25) (Reasoning) Google
15.47
Gemini 2.5 Flash-Lite (Non-reasoning) Google
6.67
Gemini 2.5 Flash-Lite (Reasoning) Google
8.55
Gemini 2.5 Flash-Lite Preview (Sep '25) (Non-reasoning) Google
9.34
Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning) Google
10.35
Gemini 2.5 Pro Google
16.08
Gemini 2.5 Pro Preview (Mar' 25) Google
14.96
Gemini 2.5 Pro Preview (May' 25) Google
14.52
Gemini 3 Deep Think Google
Gemini 3 Flash Preview (Non-reasoning) Google
17.93
Gemini 3 Flash Preview (Reasoning) Google
26.33
Gemini 3 Pro Preview (high) Google
27.96
Gemini 3 Pro Preview (low) Google
22.32
Gemini 3.1 Flash-Lite Google
15.55
Gemini 3.1 Pro Preview Google
29.72
Gemini 3.5 Flash (high) Google
32.60
Gemini 3.5 Flash (medium) Google
33.63
Gemini 3.5 Flash (minimal) Google
23.85
Gemini 3.5 Flash-Lite Google
22.17
Gemini 3.6 Flash (high) Google
33.98
Gemini 3.7 Flash (high) Google
39.06
Gemini 3.7 Flash (low) Google
36.95
Gemini 3.7 Flash (medium) Google
39.62
Gemini 3.8 Flash (high) Google
40.93
Gemini 3.8 Flash (low) Google
33.45
Gemini 3.8 Flash (medium) Google
39.77
Gemma 3 12B Instruct Google
3.75
Gemma 3 1B Instruct Google
4.83
Gemma 3 270M Google
5.12
Gemma 3 27B Instruct Google
4.85
Gemma 3 4B Instruct Google
4.83
Gemma 3n E2B Instruct Google
4.83
Gemma 3n E4B Instruct Google
4.83
Gemma 3n E4B Instruct Preview (May '25) Google
5.81
Gemma 4 12B (Non-reasoning) Google
9.38
Gemma 4 12B (Reasoning) Google
14.18
Gemma 4 26B A4B (Non-reasoning) Google
13.13
Gemma 4 26B A4B (Reasoning) Google
16.67
Gemma 4 31B (Non-reasoning) Google
13.92
Gemma 4 31B (Reasoning) Google
18.98
Gemma 4 E2B (Non-reasoning) Google
6.48
Gemma 4 E2B (Reasoning) Google
7.77
Gemma 4 E4B (Non-reasoning) Google
7.46
Gemma 4 E4B (Reasoning) Google
8.91
Granite 3.3 8B (Non-reasoning) IBM
4.92
Granite 4.0 1B IBM
5.01
Granite 4.0 350M IBM
4.83
Granite 4.0 H 1B IBM
5.19
Granite 4.0 H 350M IBM
4.83
Granite 4.0 H Small IBM
6.05
Granite 4.0 Micro IBM
5.11
Granite 4.1 30B IBM
7.44
Granite 4.1 3B IBM
5.86
Granite 4.1 8B IBM
6.57
Granite 4.2 30B IBM
14.83
Granite 4.2 3B IBM
9.06
Granite 4.2 8B IBM
11.08
Grok 2 (Dec '24) SpaceXAI
7.11
Grok 3 SpaceXAI
12.11
Grok 3 Reasoning Beta SpaceXAI
10.36
Grok 3 mini Reasoning (high) SpaceXAI
14.62
Grok 4 SpaceXAI
22.49
Grok 4 Fast (Non-reasoning) SpaceXAI
11.06
Grok 4 Fast (Reasoning) SpaceXAI
17.94
Grok 4.1 Fast (Non-reasoning) SpaceXAI
11.28
Grok 4.1 Fast (Reasoning) SpaceXAI
20.37
Grok 4.20 0309 (Non-reasoning) SpaceXAI
14.61
Grok 4.20 0309 (Reasoning) SpaceXAI
25.22
Grok 4.20 0309 v2 (Non-reasoning) SpaceXAI
14.20
Grok 4.20 0309 v2 (Reasoning) SpaceXAI
25.66
Grok 4.3 (Non-reasoning) SpaceXAI
13.99
Grok 4.3 (high) SpaceXAI
24.88
Grok 4.3 (low) SpaceXAI
24.30
Grok 4.3 (medium) SpaceXAI
24.78
Grok 4.5 (high) SpaceXAI
38.81
Grok 4.6 (high) SpaceXAI
44.31
Grok 4.6 (low) SpaceXAI
35.12
Grok 4.6 (medium) SpaceXAI
42.84
Grok 4.6 (xhigh) SpaceXAI
44.20
Grok 4.7 (high) SpaceXAI
46.33
Grok 4.7 (xhigh) SpaceXAI
46.45
Grok Beta SpaceXAI
6.89
Grok Build 0.1 0616 SpaceXAI
27.17
Grok Code Fast 1 SpaceXAI
14.06
Grok-1 SpaceXAI
6.34
Hermes 3 - Llama-3.1 70B Nous Research
6.00
Hermes 4 - Llama-3.1 405B (Non-reasoning) Nous Research
7.41
Hermes 4 - Llama-3.1 405B (Reasoning) Nous Research
7.49
Hermes 4 - Llama-3.1 70B (Non-reasoning) Nous Research
6.66
Hermes 4 - Llama-3.1 70B (Reasoning) Nous Research
7.91
Hy3 Tencent
25.30
Hy3-preview (Non-reasoning) Tencent
17.04
Hy3-preview (Reasoning) Tencent
22.74
HyperCLOVA X SEED Think (32B) Naver
11.36
HyperNova 60B 2605 (high, based on gpt-oss-120b) Multiverse Computing
11.74
INTELLECT-3 Prime Intellect
10.61
Inkling (xhigh) Thinking Machines
24.98
Inkling Small Thinking Machines
27.78
JT-35B-Flash China Mobile
18.66
JT-4.1 Flash 236B A21B China Mobile
27.29
JT-MINI China Mobile
12.21
Jamba 1.5 Large AI21 Labs
6.01
Jamba 1.5 Mini AI21 Labs
5.21
Jamba 1.6 Large AI21 Labs
5.97
Jamba 1.6 Mini AI21 Labs
5.16
Jamba 1.7 Large AI21 Labs
6.07
Jamba 1.7 Mini AI21 Labs
5.22
Jamba Reasoning 3B AI21 Labs
5.67
K-EXAONE (Non-reasoning) LG AI Research
11.21
K-EXAONE (Reasoning) LG AI Research
14.37
K-EXAONE 2.0 0803 LG AI Research
19.69
K2 Horizon 0.9B MBZUAI Institute of Foundation Models
3.05
K2 Horizon 0.9B Institute of Foundation Models
3.05
K2 Horizon 3.7B MBZUAI Institute of Foundation Models
16.16
K2 Horizon 3.7B Institute of Foundation Models
15.61
K2 Horizon 375B A23B Institute of Foundation Models
30.50
K2 Horizon 7B MBZUAI Institute of Foundation Models
21.05
K2 Horizon 7B Institute of Foundation Models
20.60
K2 Horizon MoVA 36B A4B MBZUAI Institute of Foundation Models
25.67
K2 Horizon MoVA 36B A4B Institute of Foundation Models
25.30
K2 Think V2 Institute of Foundation Models
11.50
K2-V2 (high) Institute of Foundation Models
9.87
K2-V2 (low) Institute of Foundation Models
7.31
K2-V2 (medium) Institute of Foundation Models
9.02
KAT Coder Pro V2 KwaiKAT
21.70
KAT-Coder-Pro V1 KwaiKAT
18.59
Kimi K2 Kimi
12.72
Kimi K2 0905 Kimi
15.29
Kimi K2 Thinking Kimi
22.02
Kimi K2.5 (Non-reasoning) Kimi
19.43
Kimi K2.5 (Reasoning) Kimi
23.46
Kimi K2.6 Kimi
26.98
Kimi K2.6 (Non-reasoning) Kimi
23.57
Kimi K2.7 Code Kimi
25.81
Kimi K3 (low) Kimi
34.46
Kimi K3 (max) Kimi
43.59
Kimi Linear 48B A3B Instruct Kimi
7.30
LFM 40B Liquid AI
5.42
LFM2 1.2B Liquid AI
4.83
LFM2 2.6B Liquid AI
5.21
LFM2 24B A2B Liquid AI
5.95
LFM2 8B A1B Liquid AI
4.93
LFM2.5-1.2B-Instruct Liquid AI
5.21
LFM2.5-1.2B-Thinking Liquid AI
5.22
LFM2.5-2.6B Liquid AI
8.39
LFM2.5-8B-A1B Liquid AI
7.22
LFM2.5-VL-1.6B Liquid AI
4.83
Ling 2.6 Flash InclusionAI
9.68
Ling 3.0 Flash InclusionAI
24.94
Ling 3.0 Tiny InclusionAI
15.29
Ling-1T InclusionAI
9.17
Ling-2.6-1T InclusionAI
17.00
Ling-3.0-flash-Fin InclusionAI
22.60
Ling-3.0-flash-VL InclusionAI
24.57
Ling-flash-2.0 InclusionAI
7.81
Ling-mini-2.0 InclusionAI
5.54
Llama 2 Chat 13B Meta
5.30
Llama 2 Chat 70B Meta
5.30
Llama 2 Chat 7B Meta
5.71
Llama 3 Instruct 70B Meta
5.45
Llama 3 Instruct 8B Meta
4.83
Llama 3.1 Instruct 405B Meta
7.29
Llama 3.1 Instruct 70B Meta
6.60
Llama 3.1 Instruct 8B Meta
6.93
Llama 3.1 Nemotron Instruct 70B NVIDIA
6.94
Llama 3.1 Nemotron Nano 4B v1.1 (Reasoning) NVIDIA
7.31
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) NVIDIA
7.53
Llama 3.1 Tulu3 405B Allen Institute for AI
7.20
Llama 3.2 Instruct 11B (Vision) Meta
5.41
Llama 3.2 Instruct 1B Meta
4.83
Llama 3.2 Instruct 3B Meta
5.70
Llama 3.2 Instruct 90B (Vision) Meta
6.41
Llama 3.3 Instruct 70B Meta
7.66
Llama 3.3 Nemotron Super 49B v1 (Non-reasoning) NVIDIA
7.28
Llama 3.3 Nemotron Super 49B v1 (Reasoning) NVIDIA
8.93
Llama 4 Maverick Meta
9.99
Llama 4 Scout Meta
8.08
Llama 65B Meta
5.03
Llama Nemotron Super 49B v1.5 (Non-reasoning) NVIDIA
7.36
Llama Nemotron Super 49B v1.5 (Reasoning) NVIDIA
9.01
LongCat 2.0 LongCat
19.11
LongCat Flash Lite LongCat
11.47
Magistral Medium 1 Mistral
9.05
Magistral Medium 1.2 Mistral
11.83
Magistral Small 1 Mistral
8.22
Magistral Small 1.2 Mistral
8.59
Mercury 2 Inception
13.77
Mi:dm K 2.5 Pro Korea Telecom
11.04
Mi:dm K 2.5 Pro Preview Korea Telecom
MiMo-V2-Flash (Feb 2026) Xiaomi
22.44
MiMo-V2-Flash (Non-reasoning) Xiaomi
16.05
MiMo-V2-Flash (Reasoning) Xiaomi
20.82
MiMo-V2-Omni Xiaomi
23.92
MiMo-V2-Omni-0327 Xiaomi
25.12
MiMo-V2-Pro Xiaomi
28.64
MiMo-V2.5 Xiaomi
25.17
MiMo-V2.5-Pro Xiaomi
25.99
MiMo-V2.5-Pro (Non-reasoning) Xiaomi
18.29
MiMo-V2.6-Pro Xiaomi
46.32
MiniCPM-V 4.6 1.3B OpenBMB
5.69
MiniCPM5-1B (Non-reasoning) OpenBMB
8.69
MiniCPM5-1B (Reasoning) OpenBMB
8.80
MiniCPM5-2B OpenBMB
12.46
MiniMax M1 40k MiniMax
9.99
MiniMax M1 80k MiniMax
11.73
MiniMax-M2 MiniMax
18.63
MiniMax-M2.1 MiniMax
20.95
MiniMax-M2.5 MiniMax
22.80
MiniMax-M2.7 MiniMax
22.76
MiniMax-M3 MiniMax
29.22
Ministral 3 14B Mistral
6.04
Ministral 3 3B Mistral
4.84
Ministral 3 8B Mistral
5.48
Mistral 7B Instruct Mistral
5.03
Mistral Large (Feb '24) Mistral
5.76
Mistral Large 2 (Jul '24) Mistral
6.80
Mistral Large 2 (Nov '24) Mistral
7.56
Mistral Large 3 Mistral
9.27
Mistral Medium Mistral
5.49
Mistral Medium 3 Mistral
9.05
Mistral Medium 3.1 Mistral
9.18
Mistral Medium 3.5 Mistral
14.19
Mistral Saba Mistral
6.49
Mistral Small (Feb '24) Mistral
5.50
Mistral Small (Sep '24) Mistral
5.85
Mistral Small 3 Mistral
6.67
Mistral Small 3.1 Mistral
7.12
Mistral Small 3.2 Mistral
8.25
Mistral Small 4 (Non-reasoning) Mistral
8.99
Mistral Small 4 (Reasoning) Mistral
11.27
Mixtral 8x22B Instruct Mistral
5.74
Mixtral 8x7B Instruct Mistral
5.12
Molmo 7B-D Allen Institute for AI
5.56
Molmo2-8B Allen Institute for AI
5.00
Motif 3 Motif Technologies
33.57
Motif 3 (Beta) Motif Technologies
32.31
Motif-2-12.7B-Reasoning Motif Technologies
9.19
Muse Glimmer (high) Meta
17.48
Muse Spark Meta
31.30
Muse Spark 1.1 (xhigh) Meta
33.73
Muse Spark 1.2 (xhigh) Meta
39.58
Muse Spark 1.3 (max) Meta
48.09
Muse Spark 1.3 (xhigh) Meta
45.07
NVIDIA Nemotron 3 Nano 30B A3B (Non-reasoning) NVIDIA
6.85
NVIDIA Nemotron 3 Nano 30B A3B (Reasoning) NVIDIA
8.90
NVIDIA Nemotron 3 Nano 4B NVIDIA
7.38
NVIDIA Nemotron Nano 12B v2 VL (Non-reasoning) NVIDIA
5.82
NVIDIA Nemotron Nano 12B v2 VL (Reasoning) NVIDIA
7.48
NVIDIA Nemotron Nano 9B V2 (Non-reasoning) NVIDIA
6.84
NVIDIA Nemotron Nano 9B V2 (Reasoning) NVIDIA
7.43
Nanbeige4.1-3B Nanbeige
8.40
Nemotron 3 Nano Omni 30B A3B Reasoning NVIDIA
10.25
Nemotron 3 Super 120B A12B (Reasoning) NVIDIA
12.83
Nemotron 3 Ultra 550B A55B (Reasoning) NVIDIA
22.93
Nemotron 3.5 Lightning NVIDIA
12.86
Nemotron Cascade 2 30B A3B NVIDIA
11.67
Nex-N2-Pro (based on Qwen3.5-397B-A17B) Nex AGI
28.20
North Mini Code Cohere
9.91
Nova 2.0 Lite (Non-reasoning) Amazon
8.74
Nova 2.0 Lite (high) Amazon
13.37
Nova 2.0 Lite (low) Amazon
11.80
Nova 2.0 Lite (medium) Amazon
12.48
Nova 2.0 Omni (Non-reasoning) Amazon
8.15
Nova 2.0 Omni (low) Amazon
11.11
Nova 2.0 Omni (medium) Amazon
13.65
Nova 2.0 Pro Preview (Non-reasoning) Amazon
9.96
Nova 2.0 Pro Preview (low) Amazon
12.78
Nova 2.0 Pro Preview (medium) Amazon
14.16
Nova Lite Amazon
6.67
Nova Micro Amazon
5.88
Nova Premier Amazon
9.16
Nova Pro Amazon
6.96
OLMo 2 32B Allen Institute for AI
5.97
OLMo 2 7B Allen Institute for AI
5.58
Olmo 3 32B Think Allen Institute for AI
6.47
Olmo 3 7B Instruct Allen Institute for AI
5.24
Olmo 3 7B Think Allen Institute for AI
5.62
Olmo 3.1 32B Instruct Allen Institute for AI
6.50
Olmo 3.1 32B Think Allen Institute for AI
7.12
OpenChat 3.5 (1210) OpenChat
5.29
PALM-2 Google
5.37
Phi-3 Mini Instruct 3.8B Microsoft
5.82
Phi-4 Microsoft
5.92
Phi-4 Mini Instruct Microsoft
6.33
Phi-4 Multimodal Instruct Microsoft
5.81
Pixtral Large Mistral
7.15
Quasar 438B (max, based on GLM-5.2) Multiverse Computing
26.74
QwQ 32B Alibaba
9.47
QwQ 32B-Preview Alibaba
7.59
Qwen Chat 14B Alibaba
5.03
Qwen Chat 72B Alibaba
5.44
Qwen1.5 Chat 110B Alibaba
5.65
Qwen2 Instruct 72B Alibaba
6.33
Qwen2.5 Coder Instruct 32B Alibaba
6.74
Qwen2.5 Coder Instruct 7B Alibaba
5.79
Qwen2.5 Instruct 32B Alibaba
6.87
Qwen2.5 Instruct 72B Alibaba
7.73
Qwen2.5 Max Alibaba
8.02
Qwen2.5 Turbo Alibaba
6.43
Qwen3 0.6B (Non-reasoning) Alibaba
4.83
Qwen3 0.6B (Reasoning) Alibaba
4.83
Qwen3 1.7B (Non-reasoning) Alibaba
4.86
Qwen3 1.7B (Reasoning) Alibaba
5.19
Qwen3 14B (Non-reasoning) Alibaba
6.70
Qwen3 14B (Reasoning) Alibaba
8.15
Qwen3 235B A22B (Non-reasoning) Alibaba
8.29
Qwen3 235B A22B (Reasoning) Alibaba
9.50
Qwen3 235B A22B 2507 (Reasoning) Alibaba
12.71
Qwen3 235B A22B 2507 Instruct Alibaba
12.00
Qwen3 30B A3B (Non-reasoning) Alibaba
6.62
Qwen3 30B A3B (Reasoning) Alibaba
7.63
Qwen3 30B A3B 2507 (Reasoning) Alibaba
9.81
Qwen3 30B A3B 2507 Instruct Alibaba
7.52
Qwen3 32B (Non-reasoning) Alibaba
7.34
Qwen3 32B (Reasoning) Alibaba
8.59
Qwen3 4B (Non-reasoning) Alibaba
6.61
Qwen3 4B (Reasoning) Alibaba
7.23
Qwen3 4B 2507 (Reasoning) Alibaba
8.80
Qwen3 4B 2507 Instruct Alibaba
6.74
Qwen3 8B (Non-reasoning) Alibaba
5.99
Qwen3 8B (Reasoning) Alibaba
7.28
Qwen3 Coder 30B A3B Instruct Alibaba
9.59
Qwen3 Coder 480B A35B Instruct Alibaba
11.90
Qwen3 Coder Next Alibaba
9.24
Qwen3 Max Alibaba
15.61
Qwen3 Max (Preview) Alibaba
12.59
Qwen3 Max Thinking Alibaba
21.26
Qwen3 Max Thinking (Preview) Alibaba
16.29
Qwen3 Next 80B A3B (Reasoning) Alibaba
11.20
Qwen3 Next 80B A3B Instruct Alibaba
9.64
Qwen3 Omni 30B A3B (Reasoning) Alibaba
7.76
Qwen3 Omni 30B A3B Instruct Alibaba
6.01
Qwen3 VL 235B A22B (Reasoning) Alibaba
13.44
Qwen3 VL 235B A22B Instruct Alibaba
9.94
Qwen3 VL 30B A3B (Reasoning) Alibaba
9.45
Qwen3 VL 30B A3B Instruct Alibaba
7.93
Qwen3 VL 32B (Reasoning) Alibaba
11.87
Qwen3 VL 32B Instruct Alibaba
8.39
Qwen3 VL 4B (Reasoning) Alibaba
7.05
Qwen3 VL 4B Instruct Alibaba
5.66
Qwen3 VL 8B (Reasoning) Alibaba
8.17
Qwen3 VL 8B Instruct Alibaba
7.26
Qwen3.5 0.8B (Non-reasoning) Alibaba
5.40
Qwen3.5 0.8B (Reasoning) Alibaba
6.13
Qwen3.5 122B A10B (Non-reasoning) Alibaba
17.75
Qwen3.5 122B A10B (Reasoning) Alibaba
15.57
Qwen3.5 27B (Non-reasoning) Alibaba
19.37
Qwen3.5 27B (Reasoning) Alibaba
22.90
Qwen3.5 2B (Non-reasoning) Alibaba
6.19
Qwen3.5 2B (Reasoning) Alibaba
6.94
Qwen3.5 35B A3B (Non-reasoning) Alibaba
15.12
Qwen3.5 35B A3B (Reasoning) Alibaba
19.33
Qwen3.5 397B A17B (Non-reasoning) Alibaba
21.44
Qwen3.5 397B A17B (Reasoning) Alibaba
18.42
Qwen3.5 4B (Non-reasoning) Alibaba
10.81
Qwen3.5 4B (Reasoning) Alibaba
13.12
Qwen3.5 9B (Non-reasoning) Alibaba
13.27
Qwen3.5 9B (Reasoning) Alibaba
13.65
Qwen3.5 Omni Flash Alibaba
12.47
Qwen3.5 Omni Plus Alibaba
20.38
Qwen3.6 27B (Non-reasoning) Alibaba
19.83
Qwen3.6 27B (Reasoning) Alibaba
21.43
Qwen3.6 35B A3B (Non-reasoning) Alibaba
15.23
Qwen3.6 35B A3B (Reasoning) Alibaba
18.23
Qwen3.6 Max Preview Alibaba
28.37
Qwen3.6 Plus Alibaba
27.01
Qwen3.7 Max Alibaba
29.46
Qwen3.7 Plus Alibaba
25.16
Qwen3.8 2.4T A95B Alibaba
39.89
Qwen3.8 27B (Non-reasoning) Alibaba
20.15
Qwen3.8 27B (low) Alibaba
26.20
Qwen3.8 27B (medium) Alibaba
27.55
Qwen3.8 27B (xhigh) Alibaba
33.70
Qwen3.8 Max Alibaba
40.15
Qwen3.8 Max (0902) Alibaba
45.42
Qwen3.8-Flash-Next Alibaba
39.82
R1 1776 Perplexity
6.44
Reka Flash (Sep '24) Reka AI
6.43
Reka Flash 3 Reka AI
5.65
Ring-1T InclusionAI
10.90
Ring-2.6-1T InclusionAI
16.62
Ring-flash-2.0 InclusionAI
7.15
Sarvam 105B (high) Sarvam
8.79
Sarvam 30B (high) Sarvam
6.56
Sarvam M (Reasoning) Sarvam
5.31
Seed-OSS-36B-Instruct ByteDance Seed
12.10
Solar Mini Upstage
6.41
Solar Open 100B (Reasoning) Upstage
10.36
Solar Open2 250B Upstage
24.74
Solar Pro 2 (Non-reasoning) Upstage
7.00
Solar Pro 2 (Preview) (Non-reasoning) Upstage
7.91
Solar Pro 2 (Preview) (Reasoning) Upstage
9.07
Solar Pro 2 (Reasoning) Upstage
7.49
Solar Pro 3 Upstage
7.82
Solar Pro 4 Upstage
28.15
Sonar Perplexity
7.71
Sonar Pro Perplexity
7.61
Sonar Reasoning Perplexity
8.67
Sonar Reasoning Pro Perplexity
11.82
Step 3.5 Flash StepFun
16.62
Step 3.5 Flash 2603 StepFun
16.96
Step 3.7 Flash StepFun
19.48
Step 5 Preview StepFun
43.73
Step3 VL 10B StepFun
7.69
Tiny Aya Global Cohere
4.83
Tri-21B-Think Trillion Labs
8.99
Tri-21B-think Preview Trillion Labs
9.59
Trinity Large Thinking Arcee AI
10.82
gpt-oss-120b (high) OpenAI
11.60
gpt-oss-120b (low) OpenAI
10.21
gpt-oss-20b (high) OpenAI
8.97
gpt-oss-20b (low) OpenAI
9.95
o1 OpenAI
15.23
o1-mini OpenAI
9.77
o1-preview OpenAI
11.38
o1-pro OpenAI
12.42
o3 OpenAI
20.20
o3-mini OpenAI
12.47
o3-mini (high) OpenAI
10.96
o3-pro OpenAI
21.87
o4-mini (high) OpenAI
16.65
AI模型天梯榜数据来源:Artificial Analysis - Comparison of AI Models
方法论:/r/docs/methodology
关于 ·  帮助 ·  PING ·  隐私 ·  条款   
OA0 - Omni AI 0 一个探索 AI 的社区
沪ICP备2024103595号-2
耗时 198 ms
Developed with Cursor