AI 大模型能力排行

基于 Artificial Analysis 权威数据,每日更新

最后更新:2026/8/25 00:28:00

智能指数

综合智能评分,数值越高越好

响应速度

每秒输出 Token 数,数值越高越好

使用价格

每百万 Token 价格(美元),越低越好

首 Token 延迟

首个 Token 响应时间(秒),越低越好

大模型排名

瓦勒杉 - 综合智能指数排名

基于多项基准测试的加权评估,数值越高越好

模型详细数据

模型名称 提供商 智能指数 ↓编程指数 速度 首Token延迟 价格
Claude Opus 5 (Adaptive Reasoning, Max Effort)Anthropic63.178.052 t/s34.6s$10
Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)Anthropic62.577.050 t/s18.3s$10
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)Anthropic62.176.563 t/s43.7s$20
Claude Opus 5 (Adaptive Reasoning, High Effort)Anthropic61.576.547 t/s9.4s$10
GPT-5.6 Sol (max)OpenAI60.977.464 t/s74.8s$11
Grok 4.6 (high)SpaceXAI60.976.856 t/s31.4s$3.0
Grok 4.6 (xhigh)SpaceXAI60.075.956 t/s36.1s$3.0
Kimi K3 (max)Kimi59.776.234 t/s2.7s$6.0
GLM-5.3 (max)Z AI59.574.8--$2.1
GPT-5.6 Sol (xhigh)OpenAI59.078.364 t/s28.5s$11
Grok 4.6 (medium)SpaceXAI59.074.458 t/s20.9s$3.0
Claude Opus 5 (Adaptive Reasoning, Medium Effort)Anthropic58.674.346 t/s4.1s$10
Qwen3.8 MaxAlibaba58.171.843 t/s1.7s$3.0
Qwen3.8 2.4T A95BAlibaba57.771.945 t/s1.8s$3.0
GPT-5.6 Sol (high)OpenAI57.377.257 t/s12.1s$11
Claude Opus 4.8 (Adaptive Reasoning, Max Effort)Anthropic57.374.3--$10
Muse Spark 1.2 (xhigh)Meta56.872.2--$2.0
GPT-5.6 Terra (max)OpenAI56.676.7111 t/s60.5s$4.5
GPT-5.5 (xhigh)OpenAI56.374.9--$11
Gemini 3.7 Flash (high)Google56.076.1327 t/s6.7s$1.5
Grok 4.5 (high)SpaceXAI55.872.453 t/s10.3s$3.0
GPT-5.6 Sol (medium)OpenAI55.676.353 t/s5.5s$11
Claude Sonnet 5 (Adaptive Reasoning, Max Effort)Anthropic55.371.577 t/s116.8s$4.0
Claude Opus 4.7 (Adaptive Reasoning, Max Effort)Anthropic55.073.6--$10
GPT-5.5 (high)OpenAI54.771.6--$11
Gemini 3.7 Flash (medium)Google53.471.5301 t/s5.0s$1.5
DeepSeek V4 Pro 0813 (Reasoning, Max Effort)DeepSeek53.268.873 t/s1.4s$2.0
Muse Spark 1.1 (xhigh)Meta53.271.3--$2.0
GPT-5.4 (xhigh)OpenAI53.171.1--$5.6
GPT-5.6 Terra (xhigh)OpenAI52.870.695 t/s9.7s$4.5
GLM-5.2 (max)Z AI52.668.8--$2.1
Claude Opus 5 (Adaptive Reasoning, Low Effort)Anthropic52.566.945 t/s2.9s$10
GPT-5.6 Luna (max)OpenAI52.371.4139 t/s81.1s$0.5
Qwen3.8 27B (xhigh)Alibaba52.068.153 t/s1.1s$1.1
Gemini 3.5 Flash (high)Google52.070.1--$3.4
DeepSeek V4 Flash 0731 (Reasoning, Max Effort)DeepSeek51.869.1109 t/s0.9s$0.7
Grok 4.6 (low)SpaceXAI51.766.350 t/s4.8s$3.0
Gemini 3.6 Flash (high)Google51.669.2196 t/s12.9s$1.5
GPT-5.5 (medium)OpenAI51.471.5--$11
Gemini 3.7 Flash (low)Google50.971.0304 t/s0.9s$1.5
GPT-5.6 Sol (low)OpenAI50.769.758 t/s3.0s$11
GPT-5.6 Terra (high)OpenAI50.167.193 t/s2.7s$4.5
GPT-5.6 Luna (xhigh)OpenAI50.168.6130 t/s20.3s$0.5
Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)Anthropic48.463.0--$6.0
Kimi K3 (low)Kimi48.372.033 t/s2.9s$6.0
Gemini 3.1 Pro PreviewGoogle47.768.8123 t/s23.0s$4.5
Motif 3Motif Technologies47.463.5---
GPT-5.6 Luna (high)OpenAI47.063.3125 t/s7.1s$0.5
GPT-5.6 Terra (medium)OpenAI46.864.786 t/s1.9s$4.5
Gemini 3.5 Flash (medium)Google46.7-281 t/s9.4s$3.4
Qwen3.7 MaxAlibaba46.766.0--$3.8
GPT-5.3 Codex (xhigh)OpenAI45.5-128 t/s34.4s$4.8
MiniMax-M3MiniMax45.458.6133 t/s0.9s$0.5
DeepSeek V4 Pro (Reasoning, Max Effort)DeepSeek45.359.470 t/s1.2s$0.5
Motif 3 (Beta)Motif Technologies45.362.0---
Kimi K2.6Kimi45.161.8--$1.7
Claude Opus 4.6 (Adaptive Reasoning, Max Effort)Anthropic44.9---$10
Qwen3.8 27B (medium)Alibaba44.556.158 t/s1.2s$1.1
GPT-5.5 (low)OpenAI44.560.9--$11
Muse SparkMeta44.358.6---
Claude Opus 4.7 (Non-reasoning, High Effort)Anthropic43.9---$10
DeepSeek V4 Pro (Reasoning, High Effort)DeepSeek43.758.769 t/s1.3s$0.5
GPT-5.2 (xhigh)OpenAI43.3---$4.8
Kimi K2.7 CodeKimi43.060.843 t/s1.1s$1.7
MiMo-V2.5-ProXiaomi42.960.244 t/s3.1s$0.5
Qwen3.8 27B (low)Alibaba42.958.260 t/s1.1s$1.1
Claude Sonnet 5 (Non-reasoning, High Effort)Anthropic42.666.458 t/s1.3s$4.0
Inkling (xhigh)Thinking Machines42.352.161 t/s2.5s$1.8
Hy3Tencent42.258.874 t/s1.8s$0.2
DeepSeek V4 Flash (Reasoning, Max Effort)DeepSeek42.156.2--$0.2
GPT-5.6 Sol (Non-reasoning)OpenAI41.965.155 t/s1.3s$11
Claude Opus 4.5 (Reasoning)Anthropic41.9---$10
Nex-N2-ProNex AGI41.759.1136 t/s0.9s$1.0
Solar Pro 4Upstage41.652.745 t/s1.3s$0.5
MiMo-V2-ProXiaomi41.4----
GPT-5.6 Terra (low)OpenAI41.358.188 t/s1.7s$4.5
Inkling SmallThinking Machines41.252.9135 t/s1.7s$0.5
GPT-5.2 Codex (xhigh)OpenAI41.2---$4.8
Qwen3.6 Max PreviewAlibaba41.1---$2.9
GLM-5.1 (Reasoning)Z AI41.055.8--$2.1
GPT-5.4 mini (xhigh)OpenAI40.956.1--$1.7
Grok Build 0.1 0616SpaceXAI40.751.5--$1.3
Gemini 3 Pro Preview (high)Google40.6---$4.5
GLM-5 (Reasoning)Z AI40.6---$1.6
Qwen3.6 PlusAlibaba40.554.5--$1.1
GPT-5.4 (low)OpenAI40.2---$5.6
JT-4.1 Flash 236B A21BChina Mobile39.952.4---
Agnes 2.5 Pro AlphaSapiens AI39.758.8132 t/s1.4s$0.6
GPT-5.4 nano (xhigh)OpenAI39.756.1--$0.5
Qwen3.7 PlusAlibaba39.455.957 t/s1.3s$0.7
GLM-5-TurboZ AI39.1----
DeepSeek V4 Flash (Reasoning, High Effort)DeepSeek39.052.0--$0.2
GPT-5.6 Luna (medium)OpenAI38.950.7125 t/s2.3s$0.5
GPT-5.2 (medium)OpenAI38.9---$4.8
MiniMax-M2.7MiniMax38.952.6--$0.5
Claude Opus 4.6 (Non-reasoning, High Effort)Anthropic38.8---$10
Gemini 3 Flash Preview (Reasoning)Google38.7---$1.1
Nemotron 3 Ultra 550B A55B (Reasoning)NVIDIA38.349.3169 t/s1.0s$1.1
MiMo-V2.5Xiaomi38.056.857 t/s3.7s$0.2
Grok 4.20 0309 v2 (Reasoning)SpaceXAI38.0---$1.6
Grok 4.3 (high)SpaceXAI37.942.2--$1.6
Ling 3.0 FlashInclusionAI37.850.6407 t/s1.6s$0.1
Qwen3.6 27B (Reasoning)Alibaba37.753.758 t/s1.4s$1.4
GPT-5.1 (high)OpenAI37.549.4--$3.4
Gemini 3.5 Flash-LiteGoogle37.449.3352 t/s7.3s$0.8
Solar Open2 250BUpstage37.444.7---
Claude 4.5 Sonnet (Reasoning)Anthropic37.452.1--$6.0
Grok 4.20 0309 (Reasoning)SpaceXAI37.4---$3.0
MiMo-V2-Omni-0327Xiaomi37.3----
GPT-5 Codex (high)OpenAI37.0---$3.4
Grok 4.3 (medium)SpaceXAI36.9-125 t/s16.9s$1.6
Claude Sonnet 4.6 (Non-reasoning, High Effort)Anthropic36.8---$6.0
Grok 4.3 (low)SpaceXAI36.3-113 t/s8.2s$1.6
GLM-5.1 (Non-reasoning)Z AI36.3---$2.1
Kimi K2.5 (Reasoning)Kimi36.046.8--$1.2
MiMo-V2-OmniXiaomi35.9----
Gemini 3.5 Flash (minimal)Google35.8-244 t/s0.7s$3.4
GPT-5.5 (Non-reasoning)OpenAI35.856.5--$11
GPT-5.1 Codex (high)OpenAI35.6---$3.4
Claude Opus 4.5 (Non-reasoning)Anthropic35.6---$10
Kimi K2.6 (Non-reasoning)Kimi35.4---$1.7
GPT-5 (high)OpenAI35.337.8--$3.4
GLM 5V Turbo (Reasoning)Z AI35.3----
Muse Glimmer (high)Meta35.149.0105 t/s0.4s$0.6
Claude Sonnet 4.6 (Non-reasoning, Low Effort)Anthropic35.1-44 t/s1.1s$6.0
A.X-K2SK Telecom35.038.8---
GLM-5.2 (Non-reasoning)Z AI34.846.5110 t/s1.4s$2.1
GPT-5.6 Terra (Non-reasoning)OpenAI34.652.387 t/s0.7s$4.5
GPT-5 (medium)OpenAI34.6---$3.4
Qwen3.5 27B (Reasoning)Alibaba34.6---$0.8
Claude 4.1 Opus (Reasoning)Anthropic34.5---$30
MiniMax-M2.5MiniMax34.5---$0.5
GLM-4.7 (Reasoning)Z AI34.545.3--$1.0
Hy3-preview (Reasoning)Tencent34.4---$0.1
Qwen3.5 397B A17B (Reasoning)Alibaba34.348.276 t/s1.4s$1.4
GPT-5.5 Instant (May 2026)OpenAI34.3---$11
Grok 4SpaceXAI34.1---$6.0
MiMo-V2-Flash (Feb 2026)Xiaomi34.0----
LongCat 2.0LongCat34.045.342 t/s1.8s$1.3
G9v3-39A5BAI9Stars34.033.1---
GPT-5.6 Luna (low)OpenAI33.944.2124 t/s1.5s$0.5
Gemini 3 Pro Preview (low)Google33.9---$4.5
KAT Coder Pro V2KwaiKAT33.759.5108 t/s0.9s$0.5
Kimi K2 ThinkingKimi33.5---$1.1
o3-proOpenAI33.3---$35
GLM-5 (Non-reasoning)Z AI33.2---$1.6
Qwen3.5 122B A10B (Reasoning)Alibaba32.845.7134 t/s1.0s$1.1
DeepSeek V3.2 (Reasoning)DeepSeek32.844.2--$0.3
Qwen3.5 397B A17B (Non-reasoning)Alibaba32.7-74 t/s1.4s$1.4
Qwen3 Max ThinkingAlibaba32.5----
Qwen3.6 35B A3B (Reasoning)Alibaba32.141.9136 t/s1.0s$0.8
MiniMax-M2.1MiniMax32.1---$0.5
DeepSeek V4 Pro (Non-reasoning)DeepSeek31.9-63 t/s1.4s$0.5
GPT-5 (low)OpenAI31.9---$3.4
MiMo-V2-Flash (Reasoning)Xiaomi31.9---$0.1
Ring-2.6-1TInclusionAI31.742.8124 t/s2.2s$0.8
Claude 4 Opus (Reasoning)Anthropic31.7---$30
GPT-5 mini (medium)OpenAI31.6---$0.7
DeepSeek V3.1 Terminus (Reasoning)DeepSeek31.443.5--$1.9
Qwen3.5 Omni PlusAlibaba31.3-50 t/s1.2s$1.5
Qwen3.6 27B (Non-reasoning)Alibaba31.346.655 t/s1.5s$1.4
GPT-5.1 Codex mini (high)OpenAI31.3---$0.7
Grok 4.1 Fast (Reasoning)SpaceXAI31.3----
o3OpenAI31.1-139 t/s4.7s$3.5
K-EXAONE 2.0 0803LG AI Research31.040.6---
Step 3.7 FlashStepFun30.939.6131 t/s1.7s$0.4
GPT-5.4 nano (medium)OpenAI30.8---$0.5
GPT-5.4 mini (medium)OpenAI30.5---$1.7
Mistral Medium 3.5Mistral30.446.9131 t/s0.6s$3.0
Kimi K2.5 (Non-reasoning)Kimi30.1---$1.2
Qwen3.5 27B (Non-reasoning)Alibaba30.0---$0.8
Claude 4.5 Haiku (Reasoning)Anthropic29.943.9148 t/s12.1s$2.0
Claude 4.5 Sonnet (Non-reasoning)Anthropic29.9---$6.0
Qwen3.5 35B A3B (Reasoning)Alibaba29.9---$0.7
Claude 4 Sonnet (Reasoning)Anthropic29.837.6--$6.0
Gemma 4 31B (Reasoning)Google29.743.436 t/s1.0s-
DeepSeek V4 Flash (Non-reasoning)DeepSeek29.3---$0.1
GLM-4.6 (Reasoning)Z AI29.345.8--$1.0
GPT-5.5 Instant (June 2026)OpenAI29.239.4139 t/s0.9s$11
JT-35B-FlashChina Mobile29.0----
MiniMax-M2MiniMax28.9---$0.5
KAT-Coder-Pro V1KwaiKAT28.9----
Claude 4.1 Opus (Non-reasoning)Anthropic28.8---$30
MiMo-V2.5-Pro (Non-reasoning)Xiaomi28.4-39 t/s2.3s$0.5
GPT-5.4 (Non-reasoning)OpenAI28.3---$5.6
Qwen3.5 122B A10B (Non-reasoning)Alibaba28.243.3144 t/s1.0s$1.1
Gemini 3 Flash Preview (Non-reasoning)Google27.9---$1.1
Grok 4 Fast (Reasoning)SpaceXAI27.9---$0.3
Claude 3.7 Sonnet (Reasoning)Anthropic27.636.4---
GLM-4.7 (Non-reasoning)Z AI27.1---$1.0
GPT-5.6 Luna (Non-reasoning)OpenAI26.839.3123 t/s0.8s$0.5
Hy3-preview (Non-reasoning)Tencent26.6---$0.1
Ling-2.6-1TInclusionAI26.6---$0.8
Doubao Seed CodeByteDance Seed26.5----
GPT-5.2 (Non-reasoning)OpenAI26.5---$4.8
Step 3.5 Flash 2603StepFun26.5---$0.1
Gemma 4 26B A4B (Reasoning)Google26.139.3--$0.2
o4-mini (high)OpenAI26.1---$1.9
Claude 4 Opus (Non-reasoning)Anthropic26.0---$30
Claude 4 Sonnet (Non-reasoning)Anthropic26.0---$6.0
Step 3.5 FlashStepFun26.0---$0.1
Gemini 2.5 ProGoogle25.933.3--$3.4
DeepSeek V3.2 Exp (Reasoning)DeepSeek25.9---$0.3
GPT-5 mini (high)OpenAI25.815.6--$0.7
Nemotron 3 Super 120B A12B (Reasoning)NVIDIA25.737.7143 t/s1.1s$0.3
Gemini 3.1 Flash-LiteGoogle25.634.7--$0.6
Qwen3 Max Thinking (Preview)Alibaba25.5---$2.4
MiMo-V2-Flash (Non-reasoning)Xiaomi25.149.8---
DeepSeek V3.2 (Non-reasoning)DeepSeek25.1---$0.3
Grok 4.3 (Non-reasoning)SpaceXAI25.035.2106 t/s0.6s$1.6
Qwen3.6 35B A3B (Non-reasoning)Alibaba24.628.1138 t/s0.9s$0.8
Ling 3.0 TinyInclusionAI24.526.5203 t/s2.1s-
Qwen3 MaxAlibaba24.5---$2.4
Qwen3.5 35B A3B (Non-reasoning)Alibaba24.337.0178 t/s1.3s$0.7
Gemini 2.5 Flash Preview (Sep '25) (Reasoning)Google24.2----
gpt-oss-120b (high)OpenAI24.130.4185 t/s0.5s$0.3
Claude 4.5 Haiku (Non-reasoning)Anthropic24.1-96 t/s0.6s$2.0
Kimi K2 0905Kimi24.0---$1.1
o1OpenAI23.939.7--$26
Claude 3.7 Sonnet (Non-reasoning)Anthropic23.9---$6.0
Nemotron 3.5 LightningNVIDIA23.626.8308 t/s1.0s$0.1
Gemini 2.5 Pro Preview (Mar' 25)Google23.446.7---
GLM-4.6 (Non-reasoning)Z AI23.4---$1.0
GLM-4.7-Flash (Reasoning)Z AI23.3---$0.2
Grok 4.20 0309 (Non-reasoning)SpaceXAI22.9---$3.0
Grok 3 mini Reasoning (high)SpaceXAI22.9---$0.3
Command A+Cohere22.827.8228 t/s0.1s-
Gemini 2.5 Pro Preview (May' 25)Google22.7---$3.4
DeepSeek V3.2 SpecialeDeepSeek22.6----
K-EXAONE (Reasoning)LG AI Research22.532.1---
Gemma 4 31B (Non-reasoning)Google22.333.2106 t/s0.5s$0.2
ERNIE 5.0 Thinking PreviewBaidu22.3----
Gemma 4 12B (Reasoning)Google22.231.0137 t/s1.3s$0.1
Grok 4.20 0309 v2 (Non-reasoning)SpaceXAI22.2---$1.6
Nova 2.0 Pro Preview (medium)Amazon22.134.0118 t/s20.4s$3.4
Grok Code Fast 1SpaceXAI22.0----
Mercury 2Inception21.931.11164 t/s4.2s$0.4
Qwen3.5 9B (Reasoning)Alibaba21.828.787 t/s1.0s$0.2
DeepSeek V3.2 Exp (Non-reasoning)DeepSeek21.7---$0.3
DeepSeek V3.1 Terminus (Non-reasoning)DeepSeek21.7---$0.5
Apriel-v1.5-15B-ThinkerServiceNow21.6----
DeepSeek V3.1 (Non-reasoning)DeepSeek21.4---$0.8
Nova 2.0 Omni (medium)Amazon21.3---$0.8
Qwen3 Coder NextAlibaba21.336.2131 t/s0.9s$0.6
DeepSeek V3.1 (Reasoning)DeepSeek21.0---$0.9
Qwen3 VL 235B A22B (Reasoning)Alibaba20.9---$1.3
Nova 2.0 Lite (high)Amazon20.823.0194 t/s9.7s$0.8
Apriel-v1.6-15B-ThinkerServiceNow20.8----
GPT-5.1 (Non-reasoning)OpenAI20.7---$3.4
Qwen3.5 9B (Non-reasoning)Alibaba20.623.598 t/s0.6s$0.2
EXAONE 4.5 33BLG AI Research20.523.6---
Gemma 4 26B A4B (Non-reasoning)Google20.4-91 t/s0.5s$0.2
Qwen3.5 4B (Reasoning)Alibaba20.422.615 t/s0.6s$0.1
DeepSeek R1 0528 (May '25)DeepSeek20.4---$1.8
Gemini 2.5 Flash (Reasoning)Google20.3---$0.8
North Mini CodeCohere20.236.528 t/s0.3s-
GPT-5 nano (high)OpenAI20.1---$0.1
Qwen3 235B A22B 2507 (Reasoning)Alibaba19.922.1--$0.7
Nova 2.0 Pro Preview (low)Amazon19.825.9129 t/s4.4s$3.4
Mistral Small 4 (Reasoning)Mistral19.726.6154 t/s0.6s$0.3
Kimi K2Kimi19.7---$1.0
GLM-4.5 (Reasoning)Z AI19.7----
GPT-4.1OpenAI19.6---$3.5
Qwen3 Max (Preview)Alibaba19.4---$2.4
Devstral 2Mistral19.231.347 t/s0.8s-
Nova 2.0 Lite (medium)Amazon19.2-192 t/s13.4s$0.8
Qwen3.5 Omni FlashAlibaba19.2-225 t/s1.0s$0.3
o3-miniOpenAI19.2---$1.9
GPT-5 nano (medium)OpenAI19.2---$0.1
o1-proOpenAI19.1---$263
Gemini 2.5 Flash Preview (Sep '25) (Non-reasoning)Google19.1----
JT-MINIChina Mobile18.8----
Trinity Large ThinkingArcee AI18.725.8198 t/s0.7s$0.4
DeepSeek R1 (Jan '25)DeepSeek18.624.6--$2.5
Grok 3SpaceXAI18.6---$8.0
Seed-OSS-36B-InstructByteDance Seed18.5---$0.3
Qwen3 235B A22B 2507 InstructAlibaba18.4---$0.4
HyperNova 60B 2605Multiverse Computing18.323.2---
Qwen3 Coder 480B A35B InstructAlibaba18.2---$3.0
Qwen3 VL 32B (Reasoning)Alibaba18.1---$0.3
Magistral Medium 1.2Mistral18.021.3---
Nova 2.0 Lite (low)Amazon18.0-194 t/s4.5s$0.8
Sonar Reasoning ProPerplexity18.0----
MiniMax M1 80kMiniMax17.9---$1.0
Nemotron Cascade 2 30B A3BNVIDIA17.825.3---
GPT-5.4 nano (Non-Reasoning)OpenAI17.8---$0.5
Devstral Small 2Mistral17.729.3115 t/s0.6s-
Gemini 2.5 Flash Preview (Reasoning)Google17.7----
K2 Think V2MBZUAI Institute of Foundation Models17.421.0---
LongCat Flash LiteLongCat17.4----
GPT-5 (minimal)OpenAI17.3---$3.4
HyperCLOVA X SEED Think (32B)Naver17.2----
o1-previewOpenAI17.234.0--$29
Grok 4.1 Fast (Non-reasoning)SpaceXAI17.0----
K-EXAONE (Non-reasoning)LG AI Research16.9----
Qwen3 Next 80B A3B (Reasoning)Alibaba16.917.4205 t/s1.2s$0.4
GLM-4.6V (Reasoning)Z AI16.9---$0.5
GPT-5.4 mini (Non-Reasoning)OpenAI16.8---$1.7
Nova 2.0 Omni (low)Amazon16.7---$0.8
GLM-4.5-AirZ AI16.7---$0.4
Mi:dm K 2.5 ProKorea Telecom16.6----
Grok 4 Fast (Non-reasoning)SpaceXAI16.6---$0.3
Ring-1TInclusionAI16.3----
G9v3-3BAI9Stars16.29.9---
Qwen3.5 4B (Non-reasoning)Alibaba16.120.313 t/s0.6s$0.1
Mistral Large 3Mistral15.920.154 t/s0.6s$0.8
INTELLECT-3Prime Intellect15.7----
o3-mini (high)OpenAI15.716.3--$1.9
GLM-4.7-Flash (Non-reasoning)Z AI15.6---$0.2
GPT-5 (ChatGPT)OpenAI15.4----
gpt-oss-20b (high)OpenAI15.220.7114 t/s0.7s$0.1
Solar Open 100B (Reasoning)Upstage15.2----
Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning)Google15.2---$0.2
DeepSeek V3 0324DeepSeek15.221.2--$0.5
Grok 3 Reasoning BetaSpaceXAI15.2----
Nemotron 3 Nano Omni 30B A3B ReasoningNVIDIA15.013.8330 t/s0.5s$0.1
gpt-oss-120b (low)OpenAI14.921.2246 t/s0.6s$0.3
Mistral Small 3.1Mistral14.926.3--$0.1
GPT-4.1 miniOpenAI14.820.2--$0.7
Mistral Medium 3.1Mistral14.720.5--$0.8
Qwen3 30B A3B 2507 (Reasoning)Alibaba14.612.1--$0.8
Llama 4 MaverickMeta14.516.3101 t/s0.6s$0.4
Solar Pro 3Upstage14.516.2159 t/s1.1s$0.3
NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)NVIDIA14.514.4298 t/s0.6s$0.1
MiniMax M1 40kMiniMax14.5----
gpt-oss-20b (low)OpenAI14.4-136 t/s0.8s$0.1
Nova 2.0 Pro Preview (Non-reasoning)Amazon14.420.9132 t/s0.7s$3.4
Qwen3 VL 235B A22B InstructAlibaba14.4---$0.7
GPT-5 mini (minimal)OpenAI14.3---$0.7
K2-V2 (high)MBZUAI Institute of Foundation Models14.2----
Gemini 2.5 Flash (Non-reasoning)Google14.2---$0.8
DeepSeek V3 (Dec '24)DeepSeek14.223.0--$0.5
Ling 2.6 FlashInclusionAI14.225.3--$0.1
o1-miniOpenAI14.0----
Qwen3 Next 80B A3B InstructAlibaba13.8-189 t/s1.0s$0.4
GPT-4.5 (Preview)OpenAI13.6----
Tri-21B-think PreviewTrillion Labs13.6----
Qwen3 Coder 30B A3B InstructAlibaba13.6---$0.9
DiffusionGemma 26B A4BGoogle13.519.7---
Qwen3 235B A22B (Reasoning)Alibaba13.5---$2.6
Qwen3 VL 30B A3B (Reasoning)Alibaba13.4---$0.8
QwQ 32BAlibaba13.4---$0.7
Gemini 2.0 Flash Thinking Experimental (Jan '25)Google13.324.1---
Gemma 4 12B (Non-reasoning)Google13.2-140 t/s1.3s$0.1
Gemini 2.5 Flash-Lite Preview (Sep '25) (Non-reasoning)Google13.1---$0.2
Motif-2-12.7B-ReasoningMotif Technologies12.8----
Nova PremierAmazon12.7-48 t/s1.1s$5.0
Ling-1TInclusionAI12.7----
Mistral Medium 3Mistral12.5---$0.8
Magistral Medium 1Mistral12.5----
Solar Pro 2 (Preview) (Reasoning)Upstage12.5----
Llama Nemotron Super 49B v1.5 (Reasoning)NVIDIA12.4-122 t/s3.3s$0.4
K2-V2 (medium)MBZUAI Institute of Foundation Models12.4----
Celeris-1Celeris12.414.42067 t/s0.5s$0.3
Devstral MediumMistral12.4----
Mistral Small 4 (Non-reasoning)Mistral12.3-140 t/s0.5s$0.3
Tri-21B-ThinkTrillion Labs12.3----
GPT-4o (March 2025, chatgpt-4o-latest)OpenAI12.3----
Gemma 4 E4B (Reasoning)Google12.29.459 t/s0.3s$0.0
Gemini 2.0 Flash (Feb '25)Google12.2----
Claude 3.5 HaikuAnthropic12.215.9---
Llama 3.3 Nemotron Super 49B v1 (Reasoning)NVIDIA12.2----
Sarvam 105B (high)Sarvam11.9---$0.1
MiniCPM5-1B (Reasoning)OpenBMB11.9----
Qwen3 4B 2507 (Reasoning)Alibaba11.9----
Nova 2.0 Lite (Non-reasoning)Amazon11.8-202 t/s0.7s$0.8
Gemini 2.0 Pro Experimental (Feb '25)Google11.825.5---
Claude 3 OpusAnthropic11.819.5--$30
Devstral Small (May '25)Mistral11.8----
MiniCPM5-1B (Non-reasoning)OpenBMB11.7----
Gemini 2.5 Flash Preview (Non-reasoning)Google11.6----
Sonar ReasoningPerplexity11.6----
Magistral Small 1.2Mistral11.514.7--$0.8
Gemini 2.5 Flash-Lite (Reasoning)Google11.4---$0.2
Qwen3 32B (Reasoning)Alibaba11.415.3--$0.3
Ministral 3 14BMistral11.214.4104 t/s0.5s$0.2
GPT-4o (Nov '24)OpenAI11.1---$4.4
LFM2.5-2.6BLiquid AI11.07.7---
Nanbeige4.1-3BNanbeige11.09.6---
DeepSeek R1 Distill Qwen 32BDeepSeek11.0----
Qwen3 VL 32B InstructAlibaba11.0---$0.3
GLM-4.6V (Non-reasoning)Z AI10.9---$0.5
Qwen3 235B A22B (Non-reasoning)Alibaba10.8---$1.2
Mistral Small 3.2Mistral10.712.5--$0.1
Gemini 2.0 Flash (experimental)Google10.6----
Magistral Small 1Mistral10.6----
EXAONE 4.0 32B (Reasoning)LG AI Research10.5----
Qwen3 VL 8B (Reasoning)Alibaba10.5---$0.7
Nova 2.0 Omni (Non-reasoning)Amazon10.4---$0.8
Qwen3 14B (Reasoning)Alibaba10.413.8--$1.3
Llama 4 ScoutMeta10.38.2138 t/s0.5s$0.3
DeepSeek R1 0528 Qwen3 8BDeepSeek10.3----
Qwen2.5 MaxAlibaba10.1----
Hermes 4 - Llama-3.1 70B (Reasoning)Nous Research9.9-89 t/s0.6s$0.2
Gemini 1.5 Pro (Sep '24)Google9.923.6---
Solar Pro 2 (Preview) (Non-reasoning)Upstage9.9----
Qwen3 VL 30B A3B InstructAlibaba9.9---$0.3
Claude 3.5 Sonnet (Oct '24)Anthropic9.830.2--$6.0
DeepSeek R1 Distill Llama 70BDeepSeek9.8---$0.8
Falcon-H1R-7BTII UAE9.7----
DeepSeek R1 Distill Qwen 14BDeepSeek9.7----
GPT-4.1 nanoOpenAI9.611.1--$0.2
Ling-flash-2.0InclusionAI9.6---$0.2
Gemma 4 E2B (Reasoning)Google9.57.2---
Qwen3 Omni 30B A3B (Reasoning)Alibaba9.5-109 t/s0.9s$0.4
GPT-4o (Aug '24)OpenAI9.4---$4.4
SonarPerplexity9.4----
Qwen2.5 Instruct 72BAlibaba9.4---$0.5
Llama 3.3 Instruct 70BMeta9.311.986 t/s0.6s$0.7
Step3 VL 10BStepFun9.3----
Qwen3 30B A3B (Reasoning)Alibaba9.2---$0.8
Devstral Small (Jul '25)Mistral9.1----
Sonar ProPerplexity9.1----
QwQ 32B-PreviewAlibaba9.1----
Ministral 3 8BMistral9.09.7127 t/s0.5s$0.1
Mistral Large 2 (Nov '24)Mistral9.0----
GLM-4.5V (Reasoning)Z AI9.0---$0.9
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning)NVIDIA8.9-53 t/s0.7s$0.9
ERNIE 4.5 300B A47BBaidu8.9---$0.5
Qwen3 30B A3B 2507 InstructAlibaba8.9---$0.3
NVIDIA Nemotron Nano 12B v2 VL (Reasoning)NVIDIA8.8-83 t/s3.4s$0.3
Hermes 4 - Llama-3.1 405B (Reasoning)Nous Research8.8-30 t/s0.9s$1.5
Solar Pro 2 (Reasoning)Upstage8.8----
Gemma 4 E4B (Non-reasoning)Google8.7-59 t/s0.3s$0.0
NVIDIA Nemotron Nano 9B V2 (Reasoning)NVIDIA8.7-228 t/s2.5s$0.1
Granite 4.1 30BIBM8.710.4---
NVIDIA Nemotron 3 Nano 4BNVIDIA8.68.0---
Hermes 4 - Llama-3.1 405B (Non-reasoning)Nous Research8.6-33 t/s0.8s$1.5
Gemini 2.0 Flash-Lite (Feb '25)Google8.6----
Llama Nemotron Super 49B v1.5 (Non-reasoning)NVIDIA8.5-118 t/s3.7s$0.4
Qwen3 32B (Non-reasoning)Alibaba8.5---$0.3
Kimi Linear 48B A3B InstructKimi8.4----
K2-V2 (low)MBZUAI Institute of Foundation Models8.4----
GPT-4o (May '24)OpenAI8.424.2--$7.5
Gemini 2.0 Flash-Lite (Preview)Google8.4----
Llama 3.1 Nemotron Nano 4B v1.1 (Reasoning)NVIDIA8.4----
Llama 3.1 Instruct 405BMeta8.3----
Llama 3.3 Nemotron Super 49B v1 (Non-reasoning)NVIDIA8.3----
Qwen3 8B (Reasoning)Alibaba8.39.0--$0.7
Qwen3 4B (Reasoning)Alibaba8.2----
Qwen3 VL 8B InstructAlibaba8.2---$0.3
LFM2.5-8B-A1BLiquid AI8.1-346 t/s1.1s-
GPT-4o (ChatGPT)OpenAI8.1----
Claude 3.5 Sonnet (June '24)Anthropic8.126.0--$6.0
Llama 3.1 Tulu3 405BAllen Institute for AI8.1----
Ring-flash-2.0InclusionAI8.0---$0.2
Pixtral LargeMistral8.0----
Olmo 3.1 32B ThinkAllen Institute for AI7.9----
GPT-5 nano (minimal)OpenAI7.8---$0.1
Gemini 1.5 Flash (Sep '24)Google7.8----
Grok 2 (Dec '24)SpaceXAI7.8----
GPT-4 TurboOpenAI7.721.5--$15
Qwen3 VL 4B (Reasoning)Alibaba7.7----
Solar Pro 2 (Non-reasoning)Upstage7.6----
Command ACohere7.5-70 t/s0.3s$4.4
Nova ProAmazon7.5---$1.4
Llama 3.1 Nemotron Instruct 70BNVIDIA7.4-95 t/s2.7s$1.2
Qwen3.5 2B (Reasoning)Alibaba7.42.9---
Llama 3.1 Instruct 8BMeta7.45.4--$0.0
Gemma 3 27B InstructGoogle7.410.1---
Grok BetaSpaceXAI7.3----
NVIDIA Nemotron 3 Nano 30B A3B (Non-reasoning)NVIDIA7.2-257 t/s0.4s$0.1
NVIDIA Nemotron Nano 9B V2 (Non-reasoning)NVIDIA7.2-174 t/s1.2s$0.1
Qwen2.5 Instruct 32BAlibaba7.2----
Ministral 3 3BMistral7.14.8213 t/s0.6s$0.1
Mistral Large 2 (Jul '24)Mistral7.0---$3.0
Qwen2.5 Coder Instruct 32BAlibaba6.9----
Qwen3 4B 2507 InstructAlibaba6.9----
GPT-4OpenAI6.813.1--$38
GLM-4.5V (Non-reasoning)Z AI6.8---$0.9
Qwen3 14B (Non-reasoning)Alibaba6.8---$0.6
Hermes 4 - Llama-3.1 70B (Non-reasoning)Nous Research6.7-91 t/s0.6s$0.2
GPT-4o miniOpenAI6.711.4--$0.3
Gemini 2.5 Flash-Lite (Non-reasoning)Google6.7---$0.2
Mistral Small 3Mistral6.7---$0.1
Nova LiteAmazon6.7---$0.1
Qwen3 30B A3B (Non-reasoning)Alibaba6.6---$0.3
Llama 3.1 Instruct 70BMeta6.5---$0.6
DeepSeek-V2.5 (Dec '24)DeepSeek6.5----
Qwen3 4B (Non-reasoning)Alibaba6.5----
Granite 4.1 8BIBM6.49.5127 t/s0.4s$0.1
Sarvam 30B (high)Sarvam6.4---$0.0
Gemini 2.0 Flash Thinking Experimental (Dec '24)Google6.4----
DeepSeek-V2.5DeepSeek6.4----
Gemma 4 E2B (Non-reasoning)Google6.2----
Olmo 3.1 32B InstructAllen Institute for AI6.2----
Mistral SabaMistral6.2----
DeepSeek R1 Distill Llama 8BDeepSeek6.2----
Gemini 1.5 Pro (May '24)Google6.119.8---
Olmo 3 32B ThinkAllen Institute for AI6.1----
Llama 3.2 Instruct 90B (Vision)Meta6.0----
R1 1776Perplexity6.0----
Solar MiniUpstage6.0---$0.1
Reka Flash (Sep '24)Reka AI6.0---$0.3
Qwen2.5 TurboAlibaba6.0---$0.1
Grok-1SpaceXAI5.8----
Phi-4 Mini InstructMicrosoft5.73.845 t/s0.3s-
EXAONE 4.0 32B (Non-reasoning)LG AI Research5.7----
Qwen2 Instruct 72BAlibaba5.7----
Gemma 3 12B InstructGoogle5.55.8---
Qwen3.5 2B (Non-reasoning)Alibaba5.32.4---
Qwen3.5 0.8B (Reasoning)Alibaba5.2----
Gemini 1.5 Flash-8BGoogle5.2----
DeepHermes 3 - Mistral 24B Preview (Non-reasoning)Nous Research5.0----
Jamba 1.7 LargeAI21 Labs5.0----
Granite 4.0 H SmallIBM4.9-28 t/s13.1s$0.1
Qwen3 Omni 30B A3B InstructAlibaba4.8-108 t/s0.9s$0.4
Hermes 3 - Llama-3.1 70BNous Research4.8---$0.7
Jamba 1.5 LargeAI21 Labs4.8---$3.5
Qwen3 8B (Non-reasoning)Alibaba4.8---$0.3
DeepSeek-Coder-V2DeepSeek4.7----
OLMo 2 32BAllen Institute for AI4.7----
Jamba 1.6 LargeAI21 Labs4.7----
Phi-4Microsoft4.6-45 t/s0.9s$0.2
LFM2 24B A2BLiquid AI4.6----
Gemini 1.5 Flash (May '24)Google4.6----
Nova MicroAmazon4.4-273 t/s0.6s$0.1
Granite 4.1 3BIBM4.44.7---
Claude 3 SonnetAnthropic4.4----
Gemini 1.0 UltraGoogle4.317.6---
Mistral Small (Sep '24)Mistral4.3---$0.3
Phi-3 Mini Instruct 3.8BMicrosoft4.3----
Phi-4 Multimodal InstructMicrosoft4.2-18 t/s0.4s-
NVIDIA Nemotron Nano 12B v2 VL (Non-reasoning)NVIDIA4.2-164 t/s1.3s$0.3
Gemma 3n E4B Instruct Preview (May '25)Google4.2----
Mistral Large (Feb '24)Mistral4.1---$6.0
Qwen2.5 Coder Instruct 7B Alibaba4.1----
Mixtral 8x22B InstructMistral4.0----
Llama 3.2 Instruct 3BMeta3.9----
Llama 2 Chat 7BMeta3.9---$0.1
MiniCPM-V 4.6 1.3BOpenBMB3.80.7---
Jamba Reasoning 3BAI21 Labs3.8----
Reka Flash 3Reka AI3.7-90 t/s1.1s$0.3
Qwen1.5 Chat 110BAlibaba3.7----
Qwen3 VL 4B InstructAlibaba3.7----
Olmo 3 7B ThinkAllen Institute for AI3.6----
Claude 3 HaikuAnthropic3.5---$0.5
Claude 2.1Anthropic3.514.0---
OLMo 2 7BAllen Institute for AI3.5----
Molmo 7B-DAllen Institute for AI3.4----
Ling-mini-2.0InclusionAI3.4----
Claude 2.0Anthropic3.312.9---
DeepSeek R1 Distill Qwen 1.5BDeepSeek3.3----
DeepSeek-V2-ChatDeepSeek3.3----
GPT-3.5 TurboOpenAI3.210.7--$0.8
Mistral Small (Feb '24)Mistral3.2---$0.3
Mistral MediumMistral3.2---$3.0
Llama 3 Instruct 70BMeta3.1---$1.2
Llama 3.2 Instruct 11B (Vision)Meta3.0-65 t/s0.4s$0.3
LFM 40BLiquid AI3.0----
Arctic InstructSnowflake3.0----
Qwen Chat 72BAlibaba3.0----
Qwen3.5 0.8B (Non-reasoning)Alibaba2.91.2---
PALM-2Google2.84.6---
Gemini 1.0 ProGoogle2.7----
DeepSeek Coder V2 Lite InstructDeepSeek2.7----
Llama 2 Chat 70BMeta2.6----
Llama 2 Chat 13BMeta2.6----
DeepSeek LLM 67B Chat (V1)DeepSeek2.6----
OpenChat 3.5 (1210)OpenChat2.6----
DBRX InstructDatabricks2.6----
Sarvam M (Reasoning)Sarvam2.6----
Command-R+ (Apr '24)Cohere2.6---$6.0
Exaone 4.0 1.2B (Reasoning)LG AI Research2.5----
Olmo 3 7B InstructAllen Institute for AI2.4---$0.1
Exaone 4.0 1.2B (Non-reasoning)LG AI Research2.4----
LFM2 2.6BLiquid AI2.3----
LFM2.5-1.2B-ThinkingLiquid AI2.3----
LFM2.5-1.2B-InstructLiquid AI2.3----
Jamba 1.7 MiniAI21 Labs2.3----
Jamba 1.5 MiniAI21 Labs2.3---$0.3
Granite 4.0 H 1BIBM2.2----
Qwen3 1.7B (Reasoning)Alibaba2.2----
Jamba 1.6 MiniAI21 Labs2.1----
Gemma 3 270MGoogle2.0----
Granite 4.0 MicroIBM2.0----
Apertus 70B InstructSwiss AI Initiative2.0---$1.3
Mixtral 8x7B InstructMistral2.0---$0.5
DeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning)Nous Research1.9----
Llama 65BMeta1.7----
Qwen Chat 14BAlibaba1.7----
Claude InstantAnthropic1.77.8---
Mistral 7B InstructMistral1.7---$0.3
Command-R (Mar '24)Cohere1.7---$0.8
Molmo2-8BAllen Institute for AI1.6----
Granite 4.0 1BIBM1.6----
LFM2 8B A1BLiquid AI1.3----
Granite 3.3 8B (Non-reasoning)IBM1.3---$0.1
Qwen3 1.7B (Non-reasoning)Alibaba1.1----
LFM2.5-VL-1.6BLiquid AI1.0-359 t/s1.1s-
Granite 4.0 H 350MIBM1.0----
Granite 4.0 350MIBM1.0----
Apertus 8B InstructSwiss AI Initiative1.0---$0.1
Tiny Aya GlobalCohere1.0-132 t/s0.3s-
Llama 3 Instruct 8BMeta1.0---$0.1
Llama 3.2 Instruct 1BMeta1.0----
Gemma 3n E2B InstructGoogle1.0----
Gemma 3 1B InstructGoogle1.0----
Gemma 3n E4B InstructGoogle1.03.2--$0.1
Gemma 3 4B InstructGoogle1.02.7---
LFM2 1.2BLiquid AI1.0----
Qwen3 0.6B (Non-reasoning)Alibaba1.0----
Qwen3 0.6B (Reasoning)Alibaba1.0----
Claude Sonnet 5 (Adaptive Reasoning, Low Effort)Anthropic--60 t/s1.6s$4.0
Claude Sonnet 5 (Adaptive Reasoning, Medium Effort)Anthropic--61 t/s1.9s$4.0
Claude Sonnet 5 (Adaptive Reasoning, High Effort)Anthropic--60 t/s6.5s$4.0
Claude Sonnet 5 (Adaptive Reasoning, Xhigh Effort)Anthropic--73 t/s17.5s$4.0

数据来源:Artificial Analysis · 每日自动更新 · 仅供参考