按职业任务出现频率加权
Industry Capability Index
工程
覆盖多工程学科知识、定量推理、工具化交付和真实终端操作。
本站保留来源分数,不重新计算
每项权重与组成评测独立列出
来源指数 63 分
SOURCE LEADERBOARD
来源完整榜单
Artificial Analysis 工程,数值越高越好。同名模型的具体推理档位以原始来源为准。
| # | 模型 | 机构 | 能力指数 | 智能指数 | 开放性 | 单任务成本 | 任务耗时 | 输出 Token | 生成速度 | 发布日期 |
|---|---|---|---|---|---|---|---|---|---|---|
| 1 | Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)推理模型 | Anthropic | 62.9 | 59.9 | 闭源 | US$3.03 | 9.23 分钟 | 37,806 | 68 Token/s | 2026-06-09 |
| 2 | GPT-5.6 Sol (max)推理模型 | OpenAI | 60.0 | 58.9 | 闭源 | US$1.17 | 5.06 分钟 | 19,265 | 63 Token/s | 2026-07-09 |
| 3 | GPT-5.6 Sol (xhigh)推理模型 | OpenAI | 58.1 | 57.7 | 闭源 | US$0.68 | 3.35 分钟 | 12,048 | 60 Token/s | 2026-07-09 |
| 4 | Kimi K3推理模型 | Kimi | 57.8 | 57.1 | 闭源 | US$1.01 | 12.73 分钟 | 30,155 | 39 Token/s | 2026-07-16 |
| 5 | Claude Opus 4.8 (Adaptive Reasoning, Max Effort)推理模型 | Anthropic | 56.8 | 55.7 | 闭源 | US$1.62 | 11.18 分钟 | 40,022 | 60 Token/s | 2026-05-28 |
| 6 | GPT-5.6 Sol (high)推理模型 | OpenAI | 56.8 | 55.9 | 闭源 | US$0.43 | 2.30 分钟 | 7,941 | 58 Token/s | 2026-07-09 |
| 7 | Grok 4.5 (high)推理模型 | SpaceXAI | 55.1 | 53.8 | 闭源 | US$0.20 | 3.77 分钟 | 15,779 | 70 Token/s | 2026-07-08 |
| 8 | GPT-5.6 Sol (medium)推理模型 | OpenAI | 55.0 | 53.6 | 闭源 | US$0.24 | 1.38 分钟 | 4,744 | 57 Token/s | 2026-07-09 |
| 9 | GPT-5.5 (xhigh)推理模型 | OpenAI | 54.9 | 54.8 | 闭源 | US$0.90 | 3.54 分钟 | 17,427 | 82 Token/s | 2026-04-23 |
| 10 | Claude Sonnet 5 (Adaptive Reasoning, Max Effort)推理模型 | Anthropic | 54.8 | 53.4 | 闭源 | US$1.71 | 17.61 分钟 | 78,507 | 74 Token/s | 2026-06-30 |
| 11 | GPT-5.6 Terra (max)推理模型 | OpenAI | 54.7 | 55.0 | 闭源 | US$0.83 | 2.46 分钟 | 22,100 | 150 Token/s | 2026-07-09 |
| 12 | GPT-5.5 (high)推理模型 | OpenAI | 54.3 | 53.1 | 闭源 | US$0.56 | 2.33 分钟 | 10,919 | 78 Token/s | 2026-04-23 |
| 13 | Claude Opus 4.7 (Adaptive Reasoning, Max Effort)推理模型 | Anthropic | 54.3 | 53.5 | 闭源 | US$1.75 | 9.66 分钟 | 30,787 | 53 Token/s | 2026-04-16 |
| 14 | GLM-5.2 (max)推理模型 | Z AI | 53.3 | 51.1 | 开放权重 | US$0.44 | 3.73 分钟 | 43,901 | 196 Token/s | 2026-06-16 |
| 15 | Muse Spark 1.1 (xhigh)推理模型 | Meta | 53.1 | 50.6 | 闭源 | US$0.17 | 3.05 分钟 | 23,198 | 127 Token/s | 2026-07-09 |
| 16 | GPT-5.6 Terra (xhigh)推理模型 | OpenAI | 52.9 | 51.6 | 闭源 | US$0.46 | 1.60 分钟 | 12,625 | 131 Token/s | 2026-07-09 |
| 17 | Gemini 3.5 Flash (high)推理模型 | 51.5 | 50.2 | 闭源 | US$0.56 | 3.05 分钟 | 31,987 | 175 Token/s | 2026-05-19 | |
| 18 | GPT-5.5 (medium)推理模型 | OpenAI | 51.2 | 50.4 | 闭源 | US$0.29 | 1.20 分钟 | 5,353 | 74 Token/s | 2026-04-23 |
| 19 | GPT-5.6 Luna (max)推理模型 | OpenAI | 51.2 | 51.2 | 闭源 | US$0.22 | 1.90 分钟 | 22,450 | 197 Token/s | 2026-07-09 |
| 20 | GPT-5.6 Sol (low)推理模型 | OpenAI | 51.1 | 49.4 | 闭源 | US$0.12 | 0.79 分钟 | 2,637 | 56 Token/s | 2026-07-09 |
| 21 | GPT-5.6 Terra (high)推理模型 | OpenAI | 50.7 | 49.0 | 闭源 | US$0.30 | 1.10 分钟 | 8,568 | 130 Token/s | 2026-07-09 |
| 22 | GPT-5.4 (xhigh)推理模型 | OpenAI | 50.3 | 51.4 | 闭源 | US$0.32 | 3.37 分钟 | 30,179 | 149 Token/s | 2026-03-05 |
| 23 | Qwen3.7 Max推理模型 | Alibaba | 50.1 | 46.0 | 闭源 | US$0.57 | 2.07 分钟 | 25,316 | 204 Token/s | 2026-05-19 |
| 24 | GPT-5.6 Luna (xhigh)推理模型 | OpenAI | 50.1 | 49.1 | 闭源 | US$0.14 | 1.20 分钟 | 14,467 | 200 Token/s | 2026-07-09 |
| 25 | Gemini 3.1 Pro Preview推理模型 | 49.2 | 46.5 | 闭源 | US$0.19 | 1.55 分钟 | 12,013 | 129 Token/s | 2026-02-19 | |
| 26 | MiniMax-M3推理模型 | MiniMax | 48.1 | 44.4 | 开放权重 | US$0.12 | 4.05 分钟 | 26,260 | 108 Token/s | 2026-06-01 |
| 27 | Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)推理模型 | Anthropic | 47.8 | 47.2 | 闭源 | US$1.16 | 17.77 分钟 | 57,199 | 54 Token/s | 2026-02-17 |
| 28 | GPT-5.6 Luna (high)推理模型 | OpenAI | 47.8 | 46.1 | 闭源 | US$0.08 | 0.75 分钟 | 8,715 | 193 Token/s | 2026-07-09 |
| 29 | GPT-5.6 Terra (medium)推理模型 | OpenAI | 47.3 | 45.6 | 闭源 | US$0.11 | 0.49 分钟 | 3,774 | 128 Token/s | 2026-07-09 |
| 30 | Kimi K2.6推理模型 | Kimi | 47.2 | 44.2 | 开放权重 | US$0.30 | 13.38 分钟 | 41,293 | 51 Token/s | 2026-04-20 |
| 31 | Muse Spark推理模型 | Meta | 46.1 | 43.1 | 闭源 | — | — | 13,700 | — | 2026-04-08 |
| 32 | Grok Build 0.1 0616推理模型 | SpaceXAI | 46.0 | 39.8 | 闭源 | US$0.11 | 5.30 分钟 | 28,038 | 88 Token/s | 2026-06-16 |
| 33 | GLM-5.1 (Reasoning)推理模型 | Z AI | 45.9 | 40.2 | 开放权重 | US$0.20 | 5.55 分钟 | 27,417 | 82 Token/s | 2026-04-07 |
| 34 | DeepSeek V4 Pro (Reasoning, Max Effort)推理模型 | DeepSeek | 45.8 | 44.3 | 开放权重 | US$0.04 | 8.42 分钟 | 36,027 | 71 Token/s | 2026-04-24 |
| 35 | DeepSeek V4 Pro (Reasoning, High Effort)推理模型 | DeepSeek | 45.7 | 43.1 | 开放权重 | US$0.03 | 5.96 分钟 | 24,534 | 69 Token/s | 2026-04-24 |
| 36 | Grok 4.3 (high)推理模型 | SpaceXAI | 45.4 | 37.6 | 闭源 | US$0.08 | 2.07 分钟 | 15,646 | 126 Token/s | 2026-04-30 |
| 37 | MiMo-V2.5-Pro推理模型 | Xiaomi | 45.1 | 42.2 | 开放权重 | US$0.03 | 5.90 分钟 | 20,582 | 58 Token/s | 2026-04-22 |
| 38 | GPT-5.5 (low)推理模型 | OpenAI | 45.1 | 43.5 | 闭源 | US$0.09 | 0.42 分钟 | 1,955 | 77 Token/s | 2026-04-23 |
| 39 | Motif 3 (Beta)推理模型 | Motif Technologies | 44.6 | 44.1 | 闭源 | — | — | 35,424 | — | — |
| 40 | Kimi K2.7 Code推理模型 | Kimi | 44.6 | 41.9 | 开放权重 | US$0.08 | 6.85 分钟 | 19,735 | 48 Token/s | 2026-06-12 |
| 41 | Qwen3.6 Plus推理模型 | Alibaba | 43.6 | 39.6 | 闭源 | US$0.21 | 6.51 分钟 | 20,706 | 53 Token/s | 2026-04-02 |
| 42 | Inkling (xhigh)推理模型 | Thinking Machines | 43.5 | 40.7 | 开放权重 | US$0.12 | — | 26,571 | — | 2026-07-15 |
| 43 | Nex-N2-Pro推理模型 | Nex AGI | 43.4 | 41.0 | 开放权重 | US$0.04 | 3.83 分钟 | 31,464 | 137 Token/s | 2026-06-02 |
| 44 | Claude Sonnet 5 (Non-reasoning, High Effort)非推理模型 | Anthropic | 43.2 | 41.7 | 闭源 | US$0.31 | 2.29 分钟 | 9,216 | 67 Token/s | 2026-06-30 |
| 45 | GPT-5.6 Sol (Non-reasoning)非推理模型 | OpenAI | 42.9 | 41.2 | 闭源 | US$0.11 | 0.57 分钟 | 1,919 | 56 Token/s | 2026-07-09 |
| 46 | Qwen3.7 Plus推理模型 | Alibaba | 42.6 | 39.0 | 闭源 | US$0.11 | 8.18 分钟 | 26,131 | 53 Token/s | 2026-06-01 |
| 47 | GPT-5.6 Terra (low)推理模型 | OpenAI | 42.6 | 40.5 | 闭源 | US$0.07 | 0.27 分钟 | 2,121 | 130 Token/s | 2026-07-09 |
| 48 | Hy3推理模型 | Tencent | 42.4 | 41.2 | 开放权重 | US$0.00 | 7.62 分钟 | 26,950 | 59 Token/s | 2026-07-06 |
| 49 | Nemotron 3 Ultra 550B A55B (Reasoning)推理模型 | NVIDIA | 42.2 | 37.8 | 开放权重 | US$0.17 | 1.97 分钟 | 24,750 | 209 Token/s | 2026-06-04 |
| 50 | DeepSeek V4 Flash (Reasoning, Max Effort)推理模型 | DeepSeek | 42.2 | 40.3 | 开放权重 | US$0.02 | 6.14 分钟 | 48,994 | 133 Token/s | 2026-04-24 |
| 51 | MiniMax-M2.7推理模型 | MiniMax | 42.1 | 38.1 | 开放权重 | US$0.02 | 3.96 分钟 | 17,704 | 74 Token/s | 2026-03-18 |
| 52 | GPT-5.6 Luna (medium)推理模型 | OpenAI | 41.5 | 38.1 | 闭源 | US$0.03 | 0.28 分钟 | 3,369 | 198 Token/s | 2026-07-09 |
| 53 | MiMo-V2.5推理模型 | Xiaomi | 41.0 | 37.2 | 开放权重 | US$0.01 | 4.12 分钟 | 15,550 | 63 Token/s | 2026-04-22 |
| 54 | GPT-5.1 (high)推理模型 | OpenAI | 40.9 | 36.9 | 闭源 | US$0.19 | 2.65 分钟 | 16,844 | 106 Token/s | 2025-11-13 |
| 55 | GPT-5.4 mini (xhigh)推理模型 | OpenAI | 40.4 | 40.0 | 闭源 | US$0.32 | 5.46 分钟 | 54,851 | 167 Token/s | 2026-03-17 |
| 56 | GLM-5.2 (Non-reasoning)非推理模型 | Z AI | 40.3 | 34.1 | 开放权重 | US$0.05 | 0.40 分钟 | 3,182 | 132 Token/s | 2026-06-16 |
| 57 | JT-4.1 Flash 236B A21B非推理模型 | China Mobile | 40.0 | 38.8 | 闭源 | — | — | 15,928 | — | 2026-07-09 |
| 58 | Qwen3.6 27B (Reasoning)推理模型 | Alibaba | 39.3 | 37.1 | 开放权重 | US$0.20 | 7.10 分钟 | 24,384 | 57 Token/s | 2026-04-22 |
| 59 | Kimi K2.5 (Reasoning)推理模型 | Kimi | 39.2 | 35.4 | 开放权重 | US$0.05 | 4.95 分钟 | 15,340 | 52 Token/s | 2026-01-27 |
| 60 | GPT-5 (high)推理模型 | OpenAI | 38.6 | 34.7 | 闭源 | US$0.20 | 2.47 分钟 | 14,004 | 95 Token/s | 2025-08-07 |
| 61 | Claude 4.5 Sonnet (Reasoning)推理模型 | Anthropic | 38.3 | 36.4 | 闭源 | US$0.29 | 5.28 分钟 | 13,596 | 43 Token/s | 2025-09-29 |
| 62 | GPT-5.6 Luna (low)推理模型 | OpenAI | 38.1 | 33.3 | 闭源 | US$0.02 | 0.17 分钟 | 1,967 | 198 Token/s | 2026-07-09 |
| 63 | GLM-4.7 (Reasoning)推理模型 | Z AI | 38.1 | 33.7 | 开放权重 | US$0.22 | 3.62 分钟 | 27,045 | 125 Token/s | 2025-12-22 |
| 64 | GPT-5.4 nano (xhigh)推理模型 | OpenAI | 37.9 | 38.2 | 闭源 | US$0.10 | 5.29 分钟 | 54,264 | 171 Token/s | 2026-03-17 |
| 65 | LongCat 2.0推理模型 | LongCat | 37.8 | 33.5 | 开放权重 | — | — | 24,326 | — | 2026-06-29 |
| 66 | Qwen3.5 397B A17B (Reasoning)推理模型 | Alibaba | 37.3 | 33.7 | 开放权重 | US$0.19 | 4.25 分钟 | 16,013 | 63 Token/s | 2026-02-16 |
| 67 | GPT-5.5 (Non-reasoning)非推理模型 | OpenAI | 37.0 | 35.4 | 闭源 | US$0.07 | 0.28 分钟 | 1,295 | 77 Token/s | 2026-04-23 |
| 68 | Qwen3.6 35B A3B (Reasoning)推理模型 | Alibaba | 36.6 | 31.6 | 开放权重 | US$0.12 | 2.65 分钟 | 24,076 | 151 Token/s | 2026-04-16 |
| 69 | GPT-5.6 Terra (Non-reasoning)非推理模型 | OpenAI | 35.9 | 34.0 | 闭源 | US$0.09 | 0.24 分钟 | 1,839 | 126 Token/s | 2026-07-09 |
| 70 | DeepSeek V3.2 (Reasoning)推理模型 | DeepSeek | 34.9 | 32.0 | 开放权重 | US$0.00 | — | 13,955 | — | 2025-12-01 |
| 71 | Qwen3.5 122B A10B (Reasoning)推理模型 | Alibaba | 34.7 | 32.3 | 开放权重 | US$0.14 | 1.96 分钟 | 15,588 | 132 Token/s | 2026-02-24 |
| 72 | Step 3.7 Flash推理模型 | StepFun | 34.3 | 30.3 | 开放权重 | US$0.07 | 2.24 分钟 | 54,750 | 407 Token/s | 2026-05-29 |
| 73 | KAT Coder Pro V2非推理模型 | KwaiKAT | 34.2 | 33.7 | 闭源 | US$0.00 | — | 5,239 | — | 2026-03-27 |
| 74 | GPT-5 mini (high)推理模型 | OpenAI | 33.4 | 25.3 | 闭源 | US$0.02 | 1.79 分钟 | 11,654 | 109 Token/s | 2025-08-07 |
| 75 | Ring-2.6-1T推理模型 | InclusionAI | 33.3 | 30.6 | 开放权重 | US$0.19 | 3.53 分钟 | 27,732 | 131 Token/s | 2026-05-08 |
| 76 | DeepSeek V3.1 Terminus (Reasoning)推理模型 | DeepSeek | 33.1 | 30.4 | 开放权重 | US$0.11 | — | 8,864 | — | 2025-09-22 |
| 77 | GPT-5.5 Instant (June 2026)推理模型 | OpenAI | 32.9 | 28.9 | 闭源 | US$0.17 | — | 1,275 | — | 2026-06-25 |
| 78 | Claude 4 Sonnet (Reasoning)推理模型 | Anthropic | 32.8 | 28.9 | 闭源 | US$0.13 | — | 11,213 | — | 2025-05-22 |
| 79 | Claude 4.5 Haiku (Reasoning)推理模型 | Anthropic | 32.4 | 29.6 | 闭源 | US$0.14 | 3.06 分钟 | 17,826 | 97 Token/s | 2025-10-15 |
| 80 | GLM-4.6 (Reasoning)推理模型 | Z AI | 32.2 | 28.7 | 开放权重 | US$0.14 | 5.04 分钟 | 14,523 | 48 Token/s | 2025-09-30 |
| 81 | Mistral Medium 3.5推理模型 | Mistral | 31.8 | 29.9 | 开放权重 | US$0.33 | 2.79 分钟 | 21,223 | 127 Token/s | 2026-04-29 |
| 82 | Gemini 2.5 Pro推理模型 | 31.3 | 25.8 | 闭源 | US$0.15 | 1.11 分钟 | 9,640 | 144 Token/s | 2025-06-05 | |
| 83 | GPT-5.6 Luna (Non-reasoning)非推理模型 | OpenAI | 31.3 | 26.6 | 闭源 | US$0.02 | 0.12 分钟 | 1,466 | 203 Token/s | 2026-07-09 |
| 84 | Gemma 4 31B (Reasoning)推理模型 | 31.1 | 29.4 | 开放权重 | US$0.00 | 4.89 分钟 | 10,272 | 35 Token/s | 2026-04-02 | |
| 85 | Command A+推理模型 | Cohere | 31.0 | 22.5 | 开放权重 | US$0.00 | 1.78 分钟 | 18,575 | 174 Token/s | 2026-05-20 |
| 86 | Qwen3.6 27B (Non-reasoning)非推理模型 | Alibaba | 30.9 | 30.5 | 开放权重 | US$0.23 | 2.71 分钟 | 9,483 | 58 Token/s | 2026-04-22 |
| 87 | Gemini 3.1 Flash-Lite推理模型 | 30.7 | 25.0 | 闭源 | US$0.02 | 0.68 分钟 | 13,627 | 335 Token/s | 2026-03-03 | |
| 88 | NVIDIA Nemotron 3 Super 120B A12B (Reasoning)推理模型 | NVIDIA | 29.6 | 25.4 | 开放权重 | US$0.14 | 1.58 分钟 | 23,209 | 246 Token/s | 2026-03-11 |
| 89 | Gemma 4 26B A4B (Reasoning)推理模型 | 28.2 | 25.7 | 开放权重 | US$0.02 | — | 19,369 | — | 2026-04-02 | |
| 90 | Grok 4.3 (Non-reasoning)非推理模型 | SpaceXAI | 28.1 | 24.8 | 闭源 | US$0.12 | 0.92 分钟 | 5,855 | 107 Token/s | 2026-04-30 |
| 91 | Qwen3.5 122B A10B (Non-reasoning)非推理模型 | Alibaba | 28.0 | 27.6 | 开放权重 | US$0.10 | 1.00 分钟 | 8,822 | 146 Token/s | 2026-02-24 |
| 92 | Qwen3.6 35B A3B (Non-reasoning)非推理模型 | Alibaba | 27.7 | 24.2 | 开放权重 | US$0.37 | 1.14 分钟 | 13,411 | 195 Token/s | 2026-04-16 |
| 93 | gpt-oss-120b (high)推理模型 | OpenAI | 27.7 | 23.8 | 开放权重 | US$0.04 | 1.21 分钟 | 22,559 | 312 Token/s | 2025-08-05 |
| 94 | Qwen3.5 9B (Reasoning)推理模型 | Alibaba | 27.3 | 21.4 | 开放权重 | US$0.14 | 10.17 分钟 | 35,789 | 59 Token/s | 2026-03-02 |
| 95 | Mistral Small 4 (Reasoning)推理模型 | Mistral | 27.1 | 19.6 | 开放权重 | US$0.04 | 1.47 分钟 | 14,030 | 159 Token/s | 2026-03-16 |
| 96 | Mercury 2推理模型 | Inception | 26.2 | 21.4 | 闭源 | US$0.03 | 0.28 分钟 | 17,709 | 1039 Token/s | 2026-02-20 |
| 97 | Nova 2.0 Pro Preview (medium)推理模型 | Amazon | 25.0 | 21.8 | 闭源 | US$0.11 | 1.11 分钟 | 8,721 | 131 Token/s | 2025-11-27 |
| 98 | Qwen3 235B A22B 2507 (Reasoning)推理模型 | Alibaba | 24.8 | 19.6 | 开放权重 | US$0.09 | 4.33 分钟 | 16,657 | 64 Token/s | 2025-07-25 |
| 99 | Gemma 4 31B (Non-reasoning)非推理模型 | 24.6 | 21.8 | 开放权重 | US$0.02 | 0.77 分钟 | 3,152 | 69 Token/s | 2026-04-02 | |
| 100 | Magistral Medium 1.2推理模型 | Mistral | 24.6 | 17.9 | 闭源 | US$0.58 | 3.67 分钟 | 9,301 | 42 Token/s | 2025-09-18 |
| 101 | Qwen3.5 35B A3B (Non-reasoning)非推理模型 | Alibaba | 24.6 | 24.0 | 开放权重 | US$0.12 | 1.38 分钟 | 12,198 | 147 Token/s | 2026-02-24 |
| 102 | K2 Think V2推理模型 | MBZUAI Institute of Foundation Models | 24.3 | 17.3 | 开放权重 | — | — | 23,062 | — | 2025-12-15 |
| 103 | DeepSeek R1 (Jan '25)推理模型 | DeepSeek | 24.3 | 18.5 | 开放权重 | US$0.26 | — | 15,438 | — | 2025-01-20 |
| 104 | North Mini Code推理模型 | Cohere | 24.1 | 19.8 | 开放权重 | US$0.00 | 2.13 分钟 | 14,370 | 112 Token/s | 2026-06-09 |
| 105 | Qwen3 Next 80B A3B (Reasoning)推理模型 | Alibaba | 23.6 | 16.7 | 开放权重 | US$0.14 | 1.68 分钟 | 18,233 | 181 Token/s | 2025-09-11 |
| 106 | Nova 2.0 Pro Preview (low)推理模型 | Amazon | 23.5 | 19.6 | 闭源 | US$0.09 | 0.41 分钟 | 3,135 | 129 Token/s | 2025-11-27 |
| 107 | MiMo-V2-Flash (Non-reasoning)非推理模型 | Xiaomi | 23.3 | 24.7 | 开放权重 | — | — | 30,898 | — | 2025-12-16 |
| 108 | gpt-oss-120b (low)推理模型 | OpenAI | 23.2 | 14.9 | 开放权重 | US$0.02 | 0.14 分钟 | 2,787 | 332 Token/s | 2025-08-05 |
| 109 | Nova 2.0 Lite (high)推理模型 | Amazon | 23.1 | 18.2 | 闭源 | US$0.13 | 3.64 分钟 | 32,926 | 151 Token/s | 2025-10-29 |
| 110 | HyperNova 60B 2605推理模型 | Multiverse Computing | 22.9 | 17.8 | 开放权重 | US$0.02 | 1.40 分钟 | 31,132 | 370 Token/s | 2026-05-26 |
| 111 | Nanbeige4.1-3B推理模型 | Nanbeige | 22.8 | 11.1 | 开放权重 | — | — | 92,729 | — | 2026-02-11 |
| 112 | o3-mini (high)推理模型 | OpenAI | 22.7 | 15.6 | 闭源 | US$0.03 | 0.90 分钟 | 12,281 | 227 Token/s | 2025-01-31 |
| 113 | Qwen3 Coder Next非推理模型 | Alibaba | 22.3 | 21.1 | 开放权重 | US$0.15 | 1.80 分钟 | 10,588 | 98 Token/s | 2026-02-03 |
| 114 | Mistral Large 3非推理模型 | Mistral | 22.2 | 15.9 | 开放权重 | US$0.03 | 0.85 分钟 | 2,639 | 52 Token/s | 2025-12-02 |
| 115 | Devstral 2非推理模型 | Mistral | 22.2 | 19.2 | 开放权重 | US$0.00 | 1.02 分钟 | 4,271 | 70 Token/s | 2025-12-09 |
| 116 | NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)推理模型 | NVIDIA | 21.4 | 14.2 | 开放权重 | US$0.01 | 2.60 分钟 | 25,000 | 160 Token/s | 2025-12-15 |
| 117 | gpt-oss-20b (high)推理模型 | OpenAI | 20.4 | 14.9 | 开放权重 | US$0.02 | 1.50 分钟 | 20,243 | 225 Token/s | 2025-08-05 |
| 118 | DiffusionGemma 26B A4B推理模型 | 20.2 | 13.5 | 开放权重 | — | — | 14,134 | — | 2026-06-10 | |
| 119 | Qwen3 32B (Reasoning)推理模型 | Alibaba | 20.0 | 11.5 | 开放权重 | US$0.13 | 1.86 分钟 | 10,833 | 97 Token/s | 2025-04-28 |
| 120 | Solar Pro 3推理模型 | Upstage | 19.8 | 14.1 | 闭源 | — | — | 44,276 | — | 2026-04-06 |
| 121 | Qwen3 30B A3B 2507 (Reasoning)推理模型 | Alibaba | 19.5 | 14.4 | 开放权重 | US$0.06 | 2.17 分钟 | 19,274 | 148 Token/s | 2025-07-30 |
| 122 | DeepSeek V3 0324非推理模型 | DeepSeek | 19.5 | 15.4 | 开放权重 | US$0.04 | — | 1,493 | — | 2025-03-25 |
| 123 | Mistral Medium 3.1非推理模型 | Mistral | 19.2 | 14.7 | 闭源 | US$0.08 | 0.63 分钟 | 3,352 | 88 Token/s | 2025-08-12 |
| 124 | Llama 4 Maverick非推理模型 | Meta | 19.2 | 14.3 | 开放权重 | US$0.03 | 0.31 分钟 | 2,092 | 112 Token/s | 2025-04-05 |
| 125 | Devstral Small 2非推理模型 | Mistral | 19.1 | 17.4 | 开放权重 | US$0.00 | 1.00 分钟 | 4,643 | 77 Token/s | 2025-12-09 |
| 126 | Nova 2.0 Pro Preview (Non-reasoning)非推理模型 | Amazon | 18.8 | 14.4 | 闭源 | US$0.11 | 0.36 分钟 | 2,428 | 114 Token/s | 2025-11-27 |
| 127 | Qwen3 14B (Reasoning)推理模型 | Alibaba | 18.6 | 10.4 | 开放权重 | US$0.02 | 1.63 分钟 | 6,051 | 62 Token/s | 2025-04-28 |
| 128 | GPT-4.1 mini非推理模型 | OpenAI | 18.2 | 14.8 | 闭源 | US$0.06 | 0.47 分钟 | 2,346 | 84 Token/s | 2025-04-14 |
| 129 | Mistral Small 3.1非推理模型 | Mistral | 18.1 | 14.7 | 开放权重 | US$0.02 | 0.37 分钟 | 3,269 | 149 Token/s | 2025-03-17 |
| 130 | DeepSeek V3 (Dec '24)非推理模型 | DeepSeek | 17.9 | 14.2 | 开放权重 | US$0.01 | — | 1,419 | — | 2024-12-26 |
| 131 | Claude 3.5 Haiku非推理模型 | Anthropic | 17.7 | 12.3 | 闭源 | US$0.00 | — | 4,169 | — | 2024-10-22 |
| 132 | Ling 2.6 Flash非推理模型 | InclusionAI | 16.6 | 14.1 | 开放权重 | US$0.00 | 0.96 分钟 | 10,397 | 180 Token/s | 2026-04-21 |
| 133 | Llama 4 Scout非推理模型 | Meta | 16.4 | 10.0 | 开放权重 | US$0.01 | 0.22 分钟 | 1,081 | 83 Token/s | 2025-04-05 |
| 134 | Qwen3.5 2B (Reasoning)推理模型 | Alibaba | 16.1 | 7.6 | 开放权重 | — | — | 50,829 | — | 2026-03-02 |
| 135 | Qwen3 8B (Reasoning)推理模型 | Alibaba | 16.0 | 8.3 | 开放权重 | US$0.02 | 5.29 分钟 | 12,493 | 39 Token/s | 2025-04-28 |
| 136 | Mistral Small 3.2非推理模型 | Mistral | 15.9 | 10.6 | 开放权重 | US$0.13 | 0.75 分钟 | 6,899 | 154 Token/s | 2025-06-20 |
| 137 | Llama 3.1 Instruct 8B非推理模型 | Meta | 15.7 | 7.6 | 开放权重 | US$0.16 | 1.70 分钟 | 14,990 | 147 Token/s | 2024-07-23 |
| 138 | Magistral Small 1.2推理模型 | Mistral | 15.5 | 11.3 | 开放权重 | US$0.25 | 2.11 分钟 | 10,279 | 81 Token/s | 2025-09-17 |
| 139 | GPT-4.1 nano非推理模型 | OpenAI | 15.4 | 9.6 | 闭源 | US$0.04 | 0.65 分钟 | 7,705 | 196 Token/s | 2025-04-14 |
| 140 | Llama 3.3 Instruct 70B非推理模型 | Meta | 15.2 | 9.4 | 开放权重 | US$0.06 | 0.32 分钟 | 1,636 | 85 Token/s | 2024-12-06 |
| 141 | Ministral 3 14B非推理模型 | Mistral | 14.3 | 11.1 | 开放权重 | US$0.09 | 1.74 分钟 | 6,452 | 62 Token/s | 2025-12-02 |
| 142 | Qwen3.5 0.8B (Reasoning)推理模型 | Alibaba | 13.9 | 5.5 | 开放权重 | — | — | 23,949 | — | 2026-03-02 |
| 143 | Gemma 3 27B Instruct非推理模型 | 13.5 | 7.4 | 开放权重 | US$0.00 | — | 6,335 | — | 2025-03-12 | |
| 144 | NVIDIA Nemotron 3 Nano 4B推理模型 | NVIDIA | 13.0 | 8.7 | 开放权重 | — | — | 7,290 | — | 2026-03-16 |
| 145 | Granite 4.1 30B非推理模型 | IBM | 12.6 | 8.9 | 开放权重 | — | — | 3,381 | — | 2026-04-29 |
| 146 | Ministral 3 8B非推理模型 | Mistral | 11.8 | 9.0 | 开放权重 | US$0.07 | 1.16 分钟 | 7,899 | 114 Token/s | 2025-12-02 |
| 147 | Phi-4 Mini Instruct非推理模型 | Microsoft | 11.5 | 6.0 | 开放权重 | US$0.00 | 11.78 分钟 | 31,691 | 45 Token/s | 2024-02-26 |
| 148 | Ministral 3 3B非推理模型 | Mistral | 10.6 | 6.8 | 开放权重 | US$0.07 | 1.58 分钟 | 15,568 | 164 Token/s | 2025-12-02 |
| 149 | Qwen3.5 2B (Non-reasoning)非推理模型 | Alibaba | 10.0 | 5.6 | 开放权重 | — | — | 31,601 | — | 2026-03-02 |
| 150 | Gemma 3 12B Instruct非推理模型 | 8.5 | 5.5 | 开放权重 | US$0.00 | — | 21,194 | — | 2025-03-12 | |
| 151 | Granite 4.1 3B非推理模型 | IBM | 8.4 | 4.7 | 开放权重 | — | — | 4,789 | — | 2026-04-29 |
| 152 | MiniCPM-V 4.6 1.3B非推理模型 | OpenBMB | 7.5 | 4.2 | 开放权重 | — | — | 10,362 | — | 2026-05-11 |
| 153 | Qwen3.5 0.8B (Non-reasoning)非推理模型 | Alibaba | 6.0 | 3.3 | 开放权重 | — | — | 28,237 | — | 2026-03-02 |
本站展示的是 2026-07-21 公开快照,不是医疗、法律或行业产品认证。核验原始榜单 ↗
INDEX BREAKDOWN
指数由什么构成
权重来自 Artificial Analysis 的 Capability Indices Methodology;各底层评测由来源方独立运行。
35%
工程知识
土木、电气、机械等工程领域知识。
35%
推理
推导、尺寸计算和设计权衡中的多步骤定量推理。
25%
Agent 知识工作
规划并执行多步骤工程交付任务。
5%
Agent 终端使用
在真实终端环境中构建、编写脚本和调试。
HOW TO READ
怎样理解这个指数
在来源设定的加权任务组合中,哪些模型整体表现更强,以及优势来自哪些能力维度。
不能直接证明模型适合你的真实工作流,也不是安全性、合规性或专业部署认证。
结合单项评测、成本、速度、上下文、Provider 稳定性和你自己的任务验证。