按职业任务出现频率加权
Industry Capability Index
法律
覆盖法律知识、文件分析、长上下文推理、客户工作流与避免虚构法律引用。
本站保留来源分数,不重新计算
每项权重与组成评测独立列出
来源指数 59 分
SOURCE LEADERBOARD
来源完整榜单
Artificial Analysis 法律,数值越高越好。同名模型的具体推理档位以原始来源为准。
| # | 模型 | 机构 | 能力指数 | 智能指数 | 开放性 | 单任务成本 | 任务耗时 | 输出 Token | 生成速度 | 发布日期 |
|---|---|---|---|---|---|---|---|---|---|---|
| 1 | Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)推理模型 | Anthropic | 59.2 | 59.9 | 闭源 | US$2.48 | 5.72 分钟 | 23,446 | 68 Token/s | 2026-06-09 |
| 2 | GPT-5.6 Sol (max)推理模型 | OpenAI | 51.8 | 58.9 | 闭源 | US$1.12 | 3.84 分钟 | 14,600 | 63 Token/s | 2026-07-09 |
| 3 | GPT-5.6 Sol (xhigh)推理模型 | OpenAI | 50.9 | 57.7 | 闭源 | US$0.71 | 2.67 分钟 | 9,608 | 60 Token/s | 2026-07-09 |
| 4 | Grok 4.5 (high)推理模型 | SpaceXAI | 50.8 | 53.8 | 闭源 | US$0.22 | 2.62 分钟 | 10,988 | 70 Token/s | 2026-07-08 |
| 5 | Kimi K3推理模型 | Kimi | 50.0 | 57.1 | 闭源 | US$1.00 | 9.91 分钟 | 23,490 | 39 Token/s | 2026-07-16 |
| 6 | Claude Opus 4.8 (Adaptive Reasoning, Max Effort)推理模型 | Anthropic | 49.9 | 55.7 | 闭源 | US$1.41 | 8.11 分钟 | 29,010 | 60 Token/s | 2026-05-28 |
| 7 | Gemini 3.5 Flash (high)推理模型 | 49.3 | 50.2 | 闭源 | US$0.53 | 2.49 分钟 | 26,089 | 175 Token/s | 2026-05-19 | |
| 8 | GPT-5.6 Sol (high)推理模型 | OpenAI | 48.9 | 55.9 | 闭源 | US$0.47 | 1.90 分钟 | 6,573 | 58 Token/s | 2026-07-09 |
| 9 | Claude Opus 4.7 (Adaptive Reasoning, Max Effort)推理模型 | Anthropic | 48.3 | 53.5 | 闭源 | US$1.54 | 6.58 分钟 | 20,958 | 53 Token/s | 2026-04-16 |
| 10 | GPT-5.5 (xhigh)推理模型 | OpenAI | 48.2 | 54.8 | 闭源 | US$0.82 | 2.15 分钟 | 10,586 | 82 Token/s | 2026-04-23 |
| 11 | Gemini 3.1 Pro Preview推理模型 | 48.1 | 46.5 | 闭源 | US$0.17 | 0.85 分钟 | 6,563 | 129 Token/s | 2026-02-19 | |
| 12 | GPT-5.6 Sol (medium)推理模型 | OpenAI | 47.0 | 53.6 | 闭源 | US$0.30 | 1.18 分钟 | 4,037 | 57 Token/s | 2026-07-09 |
| 13 | GPT-5.5 (high)推理模型 | OpenAI | 46.9 | 53.1 | 闭源 | US$0.55 | 1.50 分钟 | 7,050 | 78 Token/s | 2026-04-23 |
| 14 | Claude Sonnet 5 (Adaptive Reasoning, Max Effort)推理模型 | Anthropic | 45.4 | 53.4 | 闭源 | US$1.43 | 10.94 分钟 | 48,762 | 74 Token/s | 2026-06-30 |
| 15 | GPT-5.6 Sol (low)推理模型 | OpenAI | 45.1 | 49.4 | 闭源 | US$0.17 | 0.66 分钟 | 2,213 | 56 Token/s | 2026-07-09 |
| 16 | GPT-5.5 (medium)推理模型 | OpenAI | 44.9 | 50.4 | 闭源 | US$0.34 | 0.93 分钟 | 4,146 | 74 Token/s | 2026-04-23 |
| 17 | Muse Spark 1.1 (xhigh)推理模型 | Meta | 44.3 | 50.6 | 闭源 | US$0.13 | 1.62 分钟 | 12,337 | 127 Token/s | 2026-07-09 |
| 18 | GPT-5.6 Terra (max)推理模型 | OpenAI | 43.6 | 55.0 | 闭源 | US$0.79 | 1.83 分钟 | 16,405 | 150 Token/s | 2026-07-09 |
| 19 | GPT-5.4 (xhigh)推理模型 | OpenAI | 42.1 | 51.4 | 闭源 | US$0.16 | 2.06 分钟 | 18,397 | 149 Token/s | 2026-03-05 |
| 20 | GPT-5.6 Terra (xhigh)推理模型 | OpenAI | 41.9 | 51.6 | 闭源 | US$0.46 | 1.22 分钟 | 9,596 | 131 Token/s | 2026-07-09 |
| 21 | Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)推理模型 | Anthropic | 41.7 | 47.2 | 闭源 | US$0.72 | 8.18 分钟 | 26,319 | 54 Token/s | 2026-02-17 |
| 22 | GPT-5.5 (low)推理模型 | OpenAI | 40.7 | 43.5 | 闭源 | US$0.15 | 0.31 分钟 | 1,432 | 77 Token/s | 2026-04-23 |
| 23 | GPT-5.6 Terra (high)推理模型 | OpenAI | 40.5 | 49.0 | 闭源 | US$0.30 | 0.86 分钟 | 6,654 | 130 Token/s | 2026-07-09 |
| 24 | Qwen3.7 Max推理模型 | Alibaba | 39.7 | 46.0 | 闭源 | US$0.58 | 0.98 分钟 | 11,943 | 204 Token/s | 2026-05-19 |
| 25 | GLM-5.2 (max)推理模型 | Z AI | 39.4 | 51.1 | 开放权重 | US$0.38 | 2.38 分钟 | 28,017 | 196 Token/s | 2026-06-16 |
| 26 | GPT-5.6 Luna (max)推理模型 | OpenAI | 39.4 | 51.2 | 闭源 | US$0.20 | 1.43 分钟 | 16,886 | 197 Token/s | 2026-07-09 |
| 27 | Muse Spark推理模型 | Meta | 39.4 | 43.1 | 闭源 | — | — | 6,577 | — | 2026-04-08 |
| 28 | Grok Build 0.1 0616推理模型 | SpaceXAI | 39.2 | 39.8 | 闭源 | US$0.07 | 3.02 分钟 | 15,988 | 88 Token/s | 2026-06-16 |
| 29 | Grok 4.3 (high)推理模型 | SpaceXAI | 37.9 | 37.6 | 闭源 | US$0.06 | 1.24 分钟 | 9,406 | 126 Token/s | 2026-04-30 |
| 30 | GPT-5.6 Terra (medium)推理模型 | OpenAI | 37.8 | 45.6 | 闭源 | US$0.13 | 0.39 分钟 | 2,961 | 128 Token/s | 2026-07-09 |
| 31 | GPT-5.6 Luna (xhigh)推理模型 | OpenAI | 37.7 | 49.1 | 闭源 | US$0.13 | 0.88 分钟 | 10,537 | 200 Token/s | 2026-07-09 |
| 32 | Inkling (xhigh)推理模型 | Thinking Machines | 37.3 | 40.7 | 开放权重 | US$0.08 | — | 15,161 | — | 2026-07-15 |
| 33 | DeepSeek V4 Pro (Reasoning, Max Effort)推理模型 | DeepSeek | 36.9 | 44.3 | 开放权重 | US$0.03 | 4.63 分钟 | 19,797 | 71 Token/s | 2026-04-24 |
| 34 | DeepSeek V4 Pro (Reasoning, High Effort)推理模型 | DeepSeek | 36.8 | 43.1 | 开放权重 | US$0.02 | 3.16 分钟 | 12,984 | 69 Token/s | 2026-04-24 |
| 35 | GPT-5.6 Luna (high)推理模型 | OpenAI | 36.3 | 46.1 | 闭源 | US$0.08 | 0.57 分钟 | 6,641 | 193 Token/s | 2026-07-09 |
| 36 | MiniMax-M3推理模型 | MiniMax | 36.2 | 44.4 | 开放权重 | US$0.10 | 2.42 分钟 | 15,666 | 108 Token/s | 2026-06-01 |
| 37 | GPT-5.1 (high)推理模型 | OpenAI | 35.6 | 36.9 | 闭源 | US$0.16 | 1.81 分钟 | 11,509 | 106 Token/s | 2025-11-13 |
| 38 | MiMo-V2.5-Pro推理模型 | Xiaomi | 35.6 | 42.2 | 开放权重 | US$0.02 | 3.40 分钟 | 11,855 | 58 Token/s | 2026-04-22 |
| 39 | Kimi K2.6推理模型 | Kimi | 35.3 | 44.2 | 开放权重 | US$0.20 | 5.34 分钟 | 16,489 | 51 Token/s | 2026-04-20 |
| 40 | GPT-5.6 Sol (Non-reasoning)非推理模型 | OpenAI | 35.3 | 41.2 | 闭源 | US$0.16 | 0.46 分钟 | 1,552 | 56 Token/s | 2026-07-09 |
| 41 | GPT-5 (high)推理模型 | OpenAI | 35.2 | 34.7 | 闭源 | US$0.19 | 1.93 分钟 | 10,948 | 95 Token/s | 2025-08-07 |
| 42 | Claude Sonnet 5 (Non-reasoning, High Effort)非推理模型 | Anthropic | 34.1 | 41.7 | 闭源 | US$0.30 | 1.90 分钟 | 7,617 | 67 Token/s | 2026-06-30 |
| 43 | GPT-5.6 Terra (low)推理模型 | OpenAI | 33.6 | 40.5 | 闭源 | US$0.08 | 0.21 分钟 | 1,619 | 130 Token/s | 2026-07-09 |
| 44 | Qwen3.6 Plus推理模型 | Alibaba | 33.5 | 39.6 | 闭源 | US$0.18 | 4.42 分钟 | 14,048 | 53 Token/s | 2026-04-02 |
| 45 | MiniMax-M2.7推理模型 | MiniMax | 33.4 | 38.1 | 开放权重 | US$0.01 | 2.52 分钟 | 11,255 | 74 Token/s | 2026-03-18 |
| 46 | GLM-5.1 (Reasoning)推理模型 | Z AI | 32.8 | 40.2 | 开放权重 | US$0.16 | 3.11 分钟 | 15,367 | 82 Token/s | 2026-04-07 |
| 47 | Motif 3 (Beta)推理模型 | Motif Technologies | 32.6 | 44.1 | 闭源 | — | — | 23,364 | — | — |
| 48 | GPT-5.6 Luna (medium)推理模型 | OpenAI | 32.0 | 38.1 | 闭源 | US$0.03 | 0.21 分钟 | 2,540 | 198 Token/s | 2026-07-09 |
| 49 | Kimi K2.7 Code推理模型 | Kimi | 31.7 | 41.9 | 开放权重 | US$0.05 | 4.08 分钟 | 11,750 | 48 Token/s | 2026-06-12 |
| 50 | GPT-5.4 mini (xhigh)推理模型 | OpenAI | 31.6 | 40.0 | 闭源 | US$0.24 | 2.96 分钟 | 29,721 | 167 Token/s | 2026-03-17 |
| 51 | Claude 4.5 Sonnet (Reasoning)推理模型 | Anthropic | 31.6 | 36.4 | 闭源 | US$0.25 | 3.29 分钟 | 8,469 | 43 Token/s | 2025-09-29 |
| 52 | Nemotron 3 Ultra 550B A55B (Reasoning)推理模型 | NVIDIA | 31.5 | 37.8 | 开放权重 | US$0.13 | 1.10 分钟 | 13,836 | 209 Token/s | 2026-06-04 |
| 53 | DeepSeek V4 Flash (Reasoning, Max Effort)推理模型 | DeepSeek | 31.3 | 40.3 | 开放权重 | US$0.01 | 2.76 分钟 | 22,046 | 133 Token/s | 2026-04-24 |
| 54 | Hy3推理模型 | Tencent | 31.1 | 41.2 | 开放权重 | US$0.00 | 4.68 分钟 | 16,563 | 59 Token/s | 2026-07-06 |
| 55 | Nex-N2-Pro推理模型 | Nex AGI | 30.8 | 41.0 | 开放权重 | US$0.03 | 2.88 分钟 | 23,683 | 137 Token/s | 2026-06-02 |
| 56 | Qwen3.7 Plus推理模型 | Alibaba | 30.2 | 39.0 | 闭源 | US$0.07 | 3.25 分钟 | 10,383 | 53 Token/s | 2026-06-01 |
| 57 | GPT-5.5 (Non-reasoning)非推理模型 | OpenAI | 30.2 | 35.4 | 闭源 | US$0.12 | 0.20 分钟 | 910 | 77 Token/s | 2026-04-23 |
| 58 | Kimi K2.5 (Reasoning)推理模型 | Kimi | 30.0 | 35.4 | 开放权重 | US$0.03 | 3.13 分钟 | 9,717 | 52 Token/s | 2026-01-27 |
| 59 | JT-4.1 Flash 236B A21B非推理模型 | China Mobile | 29.9 | 38.8 | 闭源 | — | — | 15,097 | — | 2026-07-09 |
| 60 | MiMo-V2.5推理模型 | Xiaomi | 29.2 | 37.2 | 开放权重 | US$0.01 | 2.28 分钟 | 8,596 | 63 Token/s | 2026-04-22 |
| 61 | GPT-5.6 Luna (low)推理模型 | OpenAI | 29.1 | 33.3 | 闭源 | US$0.02 | 0.13 分钟 | 1,495 | 198 Token/s | 2026-07-09 |
| 62 | Qwen3.6 27B (Reasoning)推理模型 | Alibaba | 28.8 | 37.1 | 开放权重 | US$0.17 | 4.68 分钟 | 16,074 | 57 Token/s | 2026-04-22 |
| 63 | Gemini 2.5 Pro推理模型 | 28.8 | 25.8 | 闭源 | US$0.12 | 0.61 分钟 | 5,310 | 144 Token/s | 2025-06-05 | |
| 64 | GPT-5.4 nano (xhigh)推理模型 | OpenAI | 28.6 | 38.2 | 闭源 | US$0.08 | 3.28 分钟 | 33,664 | 171 Token/s | 2026-03-17 |
| 65 | GPT-5.5 Instant (June 2026)推理模型 | OpenAI | 28.1 | 28.9 | 闭源 | US$0.09 | — | 606 | — | 2026-06-25 |
| 66 | LongCat 2.0推理模型 | LongCat | 27.8 | 33.5 | 开放权重 | — | — | 17,118 | — | 2026-06-29 |
| 67 | GLM-5.2 (Non-reasoning)非推理模型 | Z AI | 27.5 | 34.1 | 开放权重 | US$0.17 | 0.11 分钟 | 888 | 132 Token/s | 2026-06-16 |
| 68 | Qwen3.5 397B A17B (Reasoning)推理模型 | Alibaba | 26.8 | 33.7 | 开放权重 | US$0.14 | 2.64 分钟 | 9,950 | 63 Token/s | 2026-02-16 |
| 69 | GPT-5 mini (high)推理模型 | OpenAI | 26.6 | 25.3 | 闭源 | US$0.01 | 1.37 分钟 | 8,915 | 109 Token/s | 2025-08-07 |
| 70 | Gemini 3.1 Flash-Lite推理模型 | 26.4 | 25.0 | 闭源 | US$0.01 | 0.24 分钟 | 4,861 | 335 Token/s | 2026-03-03 | |
| 71 | Qwen3.6 35B A3B (Reasoning)推理模型 | Alibaba | 26.2 | 31.6 | 开放权重 | US$0.10 | 2.00 分钟 | 18,180 | 151 Token/s | 2026-04-16 |
| 72 | GPT-5.6 Terra (Non-reasoning)非推理模型 | OpenAI | 26.2 | 34.0 | 闭源 | US$0.09 | 0.19 分钟 | 1,419 | 126 Token/s | 2026-07-09 |
| 73 | Claude 4 Sonnet (Reasoning)推理模型 | Anthropic | 26.2 | 28.9 | 闭源 | US$0.14 | — | 7,796 | — | 2025-05-22 |
| 74 | DeepSeek V3.2 (Reasoning)推理模型 | DeepSeek | 25.9 | 32.0 | 开放权重 | US$0.01 | — | 8,368 | — | 2025-12-01 |
| 75 | GLM-4.7 (Reasoning)推理模型 | Z AI | 25.4 | 33.7 | 开放权重 | US$0.18 | 2.88 分钟 | 21,539 | 125 Token/s | 2025-12-22 |
| 76 | KAT Coder Pro V2非推理模型 | KwaiKAT | 25.3 | 33.7 | 闭源 | US$0.00 | — | 3,794 | — | 2026-03-27 |
| 77 | Claude 4.5 Haiku (Reasoning)推理模型 | Anthropic | 25.1 | 29.6 | 闭源 | US$0.10 | 1.78 分钟 | 10,375 | 97 Token/s | 2025-10-15 |
| 78 | DeepSeek V3.1 Terminus (Reasoning)推理模型 | DeepSeek | 25.0 | 30.4 | 开放权重 | US$0.18 | — | 4,117 | — | 2025-09-22 |
| 79 | Step 3.7 Flash推理模型 | StepFun | 24.4 | 30.3 | 开放权重 | US$0.03 | 0.97 分钟 | 23,643 | 407 Token/s | 2026-05-29 |
| 80 | Qwen3.5 122B A10B (Reasoning)推理模型 | Alibaba | 24.3 | 32.3 | 开放权重 | US$0.10 | 1.33 分钟 | 10,591 | 132 Token/s | 2026-02-24 |
| 81 | Grok 4.3 (Non-reasoning)非推理模型 | SpaceXAI | 22.7 | 24.8 | 闭源 | US$0.06 | 0.60 分钟 | 3,854 | 107 Token/s | 2026-04-30 |
| 82 | Mistral Medium 3.5推理模型 | Mistral | 22.6 | 29.9 | 开放权重 | US$0.24 | 1.46 分钟 | 11,127 | 127 Token/s | 2026-04-29 |
| 83 | Ring-2.6-1T推理模型 | InclusionAI | 22.0 | 30.6 | 开放权重 | US$0.11 | 1.70 分钟 | 13,353 | 131 Token/s | 2026-05-08 |
| 84 | GPT-5.6 Luna (Non-reasoning)非推理模型 | OpenAI | 21.6 | 26.6 | 闭源 | US$0.02 | 0.08 分钟 | 995 | 203 Token/s | 2026-07-09 |
| 85 | Qwen3.6 27B (Non-reasoning)非推理模型 | Alibaba | 21.5 | 30.5 | 开放权重 | US$0.19 | 1.94 分钟 | 6,800 | 58 Token/s | 2026-04-22 |
| 86 | Gemma 4 31B (Reasoning)推理模型 | 20.0 | 29.4 | 开放权重 | US$0.00 | 2.57 分钟 | 5,413 | 35 Token/s | 2026-04-02 | |
| 87 | Command A+推理模型 | Cohere | 19.9 | 22.5 | 开放权重 | US$0.00 | 0.88 分钟 | 9,251 | 174 Token/s | 2026-05-20 |
| 88 | Qwen3.6 35B A3B (Non-reasoning)非推理模型 | Alibaba | 18.8 | 24.2 | 开放权重 | US$0.26 | 0.83 分钟 | 9,716 | 195 Token/s | 2026-04-16 |
| 89 | GLM-4.6 (Reasoning)推理模型 | Z AI | 18.7 | 28.7 | 开放权重 | US$0.09 | 2.77 分钟 | 7,983 | 48 Token/s | 2025-09-30 |
| 90 | Qwen3.5 122B A10B (Non-reasoning)非推理模型 | Alibaba | 18.6 | 27.6 | 开放权重 | US$0.07 | 0.61 分钟 | 5,354 | 146 Token/s | 2026-02-24 |
| 91 | NVIDIA Nemotron 3 Super 120B A12B (Reasoning)推理模型 | NVIDIA | 17.9 | 25.4 | 开放权重 | US$0.13 | 0.96 分钟 | 14,126 | 246 Token/s | 2026-03-11 |
| 92 | Gemma 4 26B A4B (Reasoning)推理模型 | 17.6 | 25.7 | 开放权重 | US$0.02 | — | 10,785 | — | 2026-04-02 | |
| 93 | gpt-oss-120b (high)推理模型 | OpenAI | 17.2 | 23.8 | 开放权重 | US$0.04 | 0.72 分钟 | 13,502 | 312 Token/s | 2025-08-05 |
| 94 | Nova 2.0 Pro Preview (medium)推理模型 | Amazon | 16.4 | 21.8 | 闭源 | US$0.09 | 0.68 分钟 | 5,317 | 131 Token/s | 2025-11-27 |
| 95 | Qwen3.5 35B A3B (Non-reasoning)非推理模型 | Alibaba | 16.2 | 24.0 | 开放权重 | US$0.07 | 0.90 分钟 | 7,931 | 147 Token/s | 2026-02-24 |
| 96 | Mistral Small 4 (Reasoning)推理模型 | Mistral | 16.1 | 19.6 | 开放权重 | US$0.01 | 0.53 分钟 | 5,097 | 159 Token/s | 2026-03-16 |
| 97 | DeepSeek R1 (Jan '25)推理模型 | DeepSeek | 15.9 | 18.5 | 开放权重 | US$0.26 | — | 12,047 | — | 2025-01-20 |
| 98 | MiMo-V2-Flash (Non-reasoning)非推理模型 | Xiaomi | 15.7 | 24.7 | 开放权重 | — | — | 25,499 | — | 2025-12-16 |
| 99 | Nova 2.0 Pro Preview (low)推理模型 | Amazon | 15.6 | 19.6 | 闭源 | US$0.06 | 0.27 分钟 | 2,052 | 129 Token/s | 2025-11-27 |
| 100 | Magistral Medium 1.2推理模型 | Mistral | 15.6 | 17.9 | 闭源 | US$0.53 | 2.18 分钟 | 5,536 | 42 Token/s | 2025-09-18 |
| 101 | Qwen3 235B A22B 2507 (Reasoning)推理模型 | Alibaba | 15.3 | 19.6 | 开放权重 | US$0.06 | 3.29 分钟 | 12,668 | 64 Token/s | 2025-07-25 |
| 102 | Qwen3.5 9B (Reasoning)推理模型 | Alibaba | 15.0 | 21.4 | 开放权重 | US$0.12 | 8.38 分钟 | 29,502 | 59 Token/s | 2026-03-02 |
| 103 | Gemma 4 31B (Non-reasoning)非推理模型 | 14.7 | 21.8 | 开放权重 | US$0.01 | 0.41 分钟 | 1,688 | 69 Token/s | 2026-04-02 | |
| 104 | Mistral Large 3非推理模型 | Mistral | 14.3 | 15.9 | 开放权重 | US$0.05 | 0.63 分钟 | 1,964 | 52 Token/s | 2025-12-02 |
| 105 | DeepSeek V3 0324非推理模型 | DeepSeek | 14.1 | 15.4 | 开放权重 | US$0.03 | — | 786 | — | 2025-03-25 |
| 106 | HyperNova 60B 2605推理模型 | Multiverse Computing | 14.0 | 17.8 | 开放权重 | US$0.02 | 1.14 分钟 | 25,220 | 370 Token/s | 2026-05-26 |
| 107 | Devstral 2非推理模型 | Mistral | 13.9 | 19.2 | 开放权重 | US$0.00 | 0.70 分钟 | 2,965 | 70 Token/s | 2025-12-09 |
| 108 | K2 Think V2推理模型 | MBZUAI Institute of Foundation Models | 13.8 | 17.3 | 开放权重 | — | — | 11,001 | — | 2025-12-15 |
| 109 | Qwen3 Next 80B A3B (Reasoning)推理模型 | Alibaba | 13.8 | 16.7 | 开放权重 | US$0.12 | 1.30 分钟 | 14,158 | 181 Token/s | 2025-09-11 |
| 110 | Mercury 2推理模型 | Inception | 13.7 | 21.4 | 闭源 | US$0.02 | 0.13 分钟 | 8,109 | 1039 Token/s | 2026-02-20 |
| 111 | Llama 4 Maverick非推理模型 | Meta | 13.7 | 14.3 | 开放权重 | US$0.03 | 0.26 分钟 | 1,724 | 112 Token/s | 2025-04-05 |
| 112 | Nova 2.0 Lite (high)推理模型 | Amazon | 13.5 | 18.2 | 闭源 | US$0.06 | 2.32 分钟 | 20,964 | 151 Token/s | 2025-10-29 |
| 113 | Claude 3.5 Haiku非推理模型 | Anthropic | 13.4 | 12.3 | 闭源 | US$0.01 | — | 1,054 | — | 2024-10-22 |
| 114 | o3-mini (high)推理模型 | OpenAI | 13.3 | 15.6 | 闭源 | US$0.04 | 0.94 分钟 | 12,798 | 227 Token/s | 2025-01-31 |
| 115 | Qwen3 Coder Next非推理模型 | Alibaba | 12.7 | 21.1 | 开放权重 | US$0.08 | 1.13 分钟 | 6,644 | 98 Token/s | 2026-02-03 |
| 116 | Devstral Small 2非推理模型 | Mistral | 12.3 | 17.4 | 开放权重 | US$0.00 | 0.70 分钟 | 3,273 | 77 Token/s | 2025-12-09 |
| 117 | Qwen3 30B A3B 2507 (Reasoning)推理模型 | Alibaba | 12.3 | 14.4 | 开放权重 | US$0.05 | 1.73 分钟 | 15,393 | 148 Token/s | 2025-07-30 |
| 118 | DeepSeek V3 (Dec '24)非推理模型 | DeepSeek | 11.8 | 14.2 | 开放权重 | US$0.01 | — | 991 | — | 2024-12-26 |
| 119 | North Mini Code推理模型 | Cohere | 11.7 | 19.8 | 开放权重 | US$0.00 | 1.48 分钟 | 9,964 | 112 Token/s | 2026-06-09 |
| 120 | NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)推理模型 | NVIDIA | 11.7 | 14.2 | 开放权重 | US$0.01 | 2.19 分钟 | 21,009 | 160 Token/s | 2025-12-15 |
| 121 | Llama 3.1 Instruct 8B非推理模型 | Meta | 11.0 | 7.6 | 开放权重 | US$0.10 | 0.92 分钟 | 8,125 | 147 Token/s | 2024-07-23 |
| 122 | Nova 2.0 Pro Preview (Non-reasoning)非推理模型 | Amazon | 11.0 | 14.4 | 闭源 | US$0.07 | 0.23 分钟 | 1,540 | 114 Token/s | 2025-11-27 |
| 123 | GPT-4.1 mini非推理模型 | OpenAI | 10.8 | 14.8 | 闭源 | US$0.06 | 0.32 分钟 | 1,629 | 84 Token/s | 2025-04-14 |
| 124 | Mistral Small 3.1非推理模型 | Mistral | 10.7 | 14.7 | 开放权重 | US$0.01 | 0.25 分钟 | 2,273 | 149 Token/s | 2025-03-17 |
| 125 | Mistral Medium 3.1非推理模型 | Mistral | 10.7 | 14.7 | 闭源 | US$0.07 | 0.41 分钟 | 2,190 | 88 Token/s | 2025-08-12 |
| 126 | Solar Pro 3推理模型 | Upstage | 10.4 | 14.1 | 闭源 | — | — | 29,702 | — | 2026-04-06 |
| 127 | gpt-oss-120b (low)推理模型 | OpenAI | 10.2 | 14.9 | 开放权重 | US$0.02 | 0.12 分钟 | 2,392 | 332 Token/s | 2025-08-05 |
| 128 | Llama 4 Scout非推理模型 | Meta | 9.5 | 10.0 | 开放权重 | US$0.01 | 0.15 分钟 | 739 | 83 Token/s | 2025-04-05 |
| 129 | Mistral Small 3.2非推理模型 | Mistral | 9.5 | 10.6 | 开放权重 | US$0.11 | 0.59 分钟 | 5,417 | 154 Token/s | 2025-06-20 |
| 130 | gpt-oss-20b (high)推理模型 | OpenAI | 9.4 | 14.9 | 开放权重 | US$0.02 | 1.01 分钟 | 13,680 | 225 Token/s | 2025-08-05 |
| 131 | Nanbeige4.1-3B推理模型 | Nanbeige | 9.1 | 11.1 | 开放权重 | — | — | 88,878 | — | 2026-02-11 |
| 132 | Qwen3.5 2B (Reasoning)推理模型 | Alibaba | 8.6 | 7.6 | 开放权重 | — | — | 44,724 | — | 2026-03-02 |
| 133 | Llama 3.3 Instruct 70B非推理模型 | Meta | 8.3 | 9.4 | 开放权重 | US$0.06 | 0.24 分钟 | 1,227 | 85 Token/s | 2024-12-06 |
| 134 | Qwen3 14B (Reasoning)推理模型 | Alibaba | 7.8 | 10.4 | 开放权重 | US$0.01 | 1.26 分钟 | 4,679 | 62 Token/s | 2025-04-28 |
| 135 | DiffusionGemma 26B A4B推理模型 | 7.8 | 13.5 | 开放权重 | — | — | 10,585 | — | 2026-06-10 | |
| 136 | Ministral 3 3B非推理模型 | Mistral | 7.7 | 6.8 | 开放权重 | US$0.04 | 1.10 分钟 | 10,867 | 164 Token/s | 2025-12-02 |
| 137 | Ling 2.6 Flash非推理模型 | InclusionAI | 7.5 | 14.1 | 开放权重 | US$0.00 | 0.68 分钟 | 7,379 | 180 Token/s | 2026-04-21 |
| 138 | Magistral Small 1.2推理模型 | Mistral | 7.5 | 11.3 | 开放权重 | US$0.23 | 1.49 分钟 | 7,255 | 81 Token/s | 2025-09-17 |
| 139 | Qwen3 32B (Reasoning)推理模型 | Alibaba | 7.4 | 11.5 | 开放权重 | US$0.09 | 1.36 分钟 | 7,927 | 97 Token/s | 2025-04-28 |
| 140 | GPT-4.1 nano非推理模型 | OpenAI | 7.3 | 9.6 | 闭源 | US$0.04 | 0.60 分钟 | 7,055 | 196 Token/s | 2025-04-14 |
| 141 | Qwen3.5 0.8B (Reasoning)推理模型 | Alibaba | 7.1 | 5.5 | 开放权重 | — | — | 25,564 | — | 2026-03-02 |
| 142 | Ministral 3 8B非推理模型 | Mistral | 7.1 | 9.0 | 开放权重 | US$0.02 | 0.50 分钟 | 3,408 | 114 Token/s | 2025-12-02 |
| 143 | Ministral 3 14B非推理模型 | Mistral | 7.0 | 11.1 | 开放权重 | US$0.07 | 0.89 分钟 | 3,293 | 62 Token/s | 2025-12-02 |
| 144 | Phi-4 Mini Instruct非推理模型 | Microsoft | 6.9 | 6.0 | 开放权重 | US$0.00 | 10.22 分钟 | 27,499 | 45 Token/s | 2024-02-26 |
| 145 | NVIDIA Nemotron 3 Nano 4B推理模型 | NVIDIA | 6.4 | 8.7 | 开放权重 | — | — | 5,009 | — | 2026-03-16 |
| 146 | Granite 4.1 30B非推理模型 | IBM | 6.1 | 8.9 | 开放权重 | — | — | 2,806 | — | 2026-04-29 |
| 147 | Gemma 3 27B Instruct非推理模型 | 4.9 | 7.4 | 开放权重 | US$0.00 | — | 5,593 | — | 2025-03-12 | |
| 148 | Qwen3 8B (Reasoning)推理模型 | Alibaba | 4.4 | 8.3 | 开放权重 | US$0.01 | 3.26 分钟 | 7,694 | 39 Token/s | 2025-04-28 |
| 149 | Qwen3.5 2B (Non-reasoning)非推理模型 | Alibaba | 4.4 | 5.6 | 开放权重 | — | — | 21,234 | — | 2026-03-02 |
| 150 | Gemma 3 12B Instruct非推理模型 | 4.1 | 5.5 | 开放权重 | US$0.00 | — | 20,349 | — | 2025-03-12 | |
| 151 | Granite 4.1 3B非推理模型 | IBM | 3.7 | 4.7 | 开放权重 | — | — | 4,105 | — | 2026-04-29 |
| 152 | MiniCPM-V 4.6 1.3B非推理模型 | OpenBMB | 3.3 | 4.2 | 开放权重 | — | — | 7,916 | — | 2026-05-11 |
| 153 | Qwen3.5 0.8B (Non-reasoning)非推理模型 | Alibaba | 2.7 | 3.3 | 开放权重 | — | — | 18,451 | — | 2026-03-02 |
本站展示的是 2026-07-21 公开快照,不是医疗、法律或行业产品认证。核验原始榜单 ↗
INDEX BREAKDOWN
指数由什么构成
权重来自 Artificial Analysis 的 Capability Indices Methodology;各底层评测由来源方独立运行。
35%
法律知识
不同司法辖区的法规、原则和程序知识。
25%
Agent 知识工作
事项管理、起草流程和工具辅助研究。
15%
推理
多步骤论证、法律解释和冲突依据权衡。
10%
长上下文
综合合同、证据材料和判例文档包。
10%
非幻觉
避免虚构案例、法条或引用。
5%
Agent 客户交互
多轮、可调用工具的客户接洽工作流。
HOW TO READ
怎样理解这个指数
在来源设定的加权任务组合中,哪些模型整体表现更强,以及优势来自哪些能力维度。
不能直接证明模型适合你的真实工作流,也不是安全性、合规性或专业部署认证。
结合单项评测、成本、速度、上下文、Provider 稳定性和你自己的任务验证。