按职业任务出现频率加权
Industry Capability Index
医疗健康
覆盖医学与公共卫生知识、临床推理、医疗记录、药物管理、患者交互和避免幻觉。
本站保留来源分数,不重新计算
每项权重与组成评测独立列出
来源指数 49 分
SOURCE LEADERBOARD
来源完整榜单
Artificial Analysis 医疗健康,数值越高越好。同名模型的具体推理档位以原始来源为准。
| # | 模型 | 机构 | 能力指数 | 智能指数 | 开放性 | 单任务成本 | 任务耗时 | 输出 Token | 生成速度 | 发布日期 |
|---|---|---|---|---|---|---|---|---|---|---|
| 1 | Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)推理模型 | Anthropic | 48.5 | 59.9 | 闭源 | US$2.50 | 5.86 分钟 | 24,006 | 68 Token/s | 2026-06-09 |
| 2 | GPT-5.6 Sol (max)推理模型 | OpenAI | 45.1 | 58.9 | 闭源 | US$1.16 | 3.97 分钟 | 15,114 | 63 Token/s | 2026-07-09 |
| 3 | Claude Opus 4.8 (Adaptive Reasoning, Max Effort)推理模型 | Anthropic | 44.1 | 55.7 | 闭源 | US$1.44 | 8.47 分钟 | 30,315 | 60 Token/s | 2026-05-28 |
| 4 | GPT-5.6 Sol (xhigh)推理模型 | OpenAI | 43.7 | 57.7 | 闭源 | US$0.74 | 2.75 分钟 | 9,918 | 60 Token/s | 2026-07-09 |
| 5 | Grok 4.5 (high)推理模型 | SpaceXAI | 43.1 | 53.8 | 闭源 | US$0.26 | 2.68 分钟 | 11,211 | 70 Token/s | 2026-07-08 |
| 6 | GPT-5.6 Sol (high)推理模型 | OpenAI | 42.9 | 55.9 | 闭源 | US$0.47 | 1.97 分钟 | 6,797 | 58 Token/s | 2026-07-09 |
| 7 | Kimi K3推理模型 | Kimi | 42.5 | 57.1 | 闭源 | US$1.07 | 10.29 分钟 | 24,379 | 39 Token/s | 2026-07-16 |
| 8 | Claude Opus 4.7 (Adaptive Reasoning, Max Effort)推理模型 | Anthropic | 41.1 | 53.5 | 闭源 | US$1.57 | 6.75 分钟 | 21,499 | 53 Token/s | 2026-04-16 |
| 9 | Claude Sonnet 5 (Adaptive Reasoning, Max Effort)推理模型 | Anthropic | 40.9 | 53.4 | 闭源 | US$1.45 | 11.08 分钟 | 49,402 | 74 Token/s | 2026-06-30 |
| 10 | GPT-5.5 (xhigh)推理模型 | OpenAI | 40.9 | 54.8 | 闭源 | US$0.89 | 2.25 分钟 | 11,108 | 82 Token/s | 2026-04-23 |
| 11 | Muse Spark 1.1 (xhigh)推理模型 | Meta | 40.4 | 50.6 | 闭源 | US$0.15 | 1.68 分钟 | 12,753 | 127 Token/s | 2026-07-09 |
| 12 | GPT-5.6 Sol (medium)推理模型 | OpenAI | 40.2 | 53.6 | 闭源 | US$0.30 | 1.22 分钟 | 4,193 | 57 Token/s | 2026-07-09 |
| 13 | GPT-5.5 (high)推理模型 | OpenAI | 39.9 | 53.1 | 闭源 | US$0.59 | 1.57 分钟 | 7,348 | 78 Token/s | 2026-04-23 |
| 14 | GLM-5.2 (max)推理模型 | Z AI | 39.3 | 51.1 | 开放权重 | US$0.40 | 2.44 分钟 | 28,680 | 196 Token/s | 2026-06-16 |
| 15 | Gemini 3.5 Flash (high)推理模型 | 39.0 | 50.2 | 闭源 | US$0.56 | 2.55 分钟 | 26,768 | 175 Token/s | 2026-05-19 | |
| 16 | GPT-5.6 Terra (max)推理模型 | OpenAI | 38.8 | 55.0 | 闭源 | US$0.84 | 1.89 分钟 | 16,997 | 150 Token/s | 2026-07-09 |
| 17 | GPT-5.6 Sol (low)推理模型 | OpenAI | 38.8 | 49.4 | 闭源 | US$0.16 | 0.69 分钟 | 2,311 | 56 Token/s | 2026-07-09 |
| 18 | GPT-5.5 (medium)推理模型 | OpenAI | 37.9 | 50.4 | 闭源 | US$0.35 | 0.97 分钟 | 4,308 | 74 Token/s | 2026-04-23 |
| 19 | GPT-5.6 Terra (xhigh)推理模型 | OpenAI | 37.7 | 51.6 | 闭源 | US$0.48 | 1.26 分钟 | 9,904 | 131 Token/s | 2026-07-09 |
| 20 | GPT-5.4 (xhigh)推理模型 | OpenAI | 37.7 | 51.4 | 闭源 | US$0.14 | 2.18 分钟 | 19,557 | 149 Token/s | 2026-03-05 |
| 21 | GPT-5.6 Terra (high)推理模型 | OpenAI | 36.4 | 49.0 | 闭源 | US$0.32 | 0.88 分钟 | 6,862 | 130 Token/s | 2026-07-09 |
| 22 | GPT-5.6 Luna (max)推理模型 | OpenAI | 35.7 | 51.2 | 闭源 | US$0.20 | 1.49 分钟 | 17,612 | 197 Token/s | 2026-07-09 |
| 23 | Gemini 3.1 Pro Preview推理模型 | 35.1 | 46.5 | 闭源 | US$0.19 | 0.88 分钟 | 6,788 | 129 Token/s | 2026-02-19 | |
| 24 | Grok 4.3 (high)推理模型 | SpaceXAI | 34.9 | 37.6 | 闭源 | US$0.05 | 1.25 分钟 | 9,458 | 126 Token/s | 2026-04-30 |
| 25 | GPT-5.6 Luna (xhigh)推理模型 | OpenAI | 34.9 | 49.1 | 闭源 | US$0.13 | 0.91 分钟 | 10,954 | 200 Token/s | 2026-07-09 |
| 26 | Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)推理模型 | Anthropic | 34.8 | 47.2 | 闭源 | US$0.73 | 8.31 分钟 | 26,765 | 54 Token/s | 2026-02-17 |
| 27 | MiniMax-M3推理模型 | MiniMax | 34.4 | 44.4 | 开放权重 | US$0.10 | 2.45 分钟 | 15,919 | 108 Token/s | 2026-06-01 |
| 28 | Qwen3.7 Max推理模型 | Alibaba | 33.9 | 46.0 | 闭源 | US$0.76 | 1.02 分钟 | 12,449 | 204 Token/s | 2026-05-19 |
| 29 | Muse Spark推理模型 | Meta | 33.9 | 43.1 | 闭源 | — | — | 6,873 | — | 2026-04-08 |
| 30 | Grok Build 0.1 0616推理模型 | SpaceXAI | 33.6 | 39.8 | 闭源 | US$0.07 | 3.11 分钟 | 16,450 | 88 Token/s | 2026-06-16 |
| 31 | GPT-5.6 Terra (medium)推理模型 | OpenAI | 33.4 | 45.6 | 闭源 | US$0.13 | 0.40 分钟 | 3,082 | 128 Token/s | 2026-07-09 |
| 32 | Kimi K2.6推理模型 | Kimi | 33.2 | 44.2 | 开放权重 | US$0.21 | 5.52 分钟 | 17,047 | 51 Token/s | 2026-04-20 |
| 33 | DeepSeek V4 Pro (Reasoning, Max Effort)推理模型 | DeepSeek | 33.1 | 44.3 | 开放权重 | US$0.03 | 4.69 分钟 | 20,046 | 71 Token/s | 2026-04-24 |
| 34 | GLM-5.1 (Reasoning)推理模型 | Z AI | 33.0 | 40.2 | 开放权重 | US$0.17 | 3.11 分钟 | 15,380 | 82 Token/s | 2026-04-07 |
| 35 | GPT-5.5 (low)推理模型 | OpenAI | 32.9 | 43.5 | 闭源 | US$0.14 | 0.33 分钟 | 1,511 | 77 Token/s | 2026-04-23 |
| 36 | Inkling (xhigh)推理模型 | Thinking Machines | 32.8 | 40.7 | 开放权重 | US$0.06 | — | 15,603 | — | 2026-07-15 |
| 37 | GPT-5.6 Luna (high)推理模型 | OpenAI | 32.3 | 46.1 | 闭源 | US$0.08 | 0.60 分钟 | 6,895 | 193 Token/s | 2026-07-09 |
| 38 | MiMo-V2.5-Pro推理模型 | Xiaomi | 32.3 | 42.2 | 开放权重 | US$0.02 | 3.47 分钟 | 12,103 | 58 Token/s | 2026-04-22 |
| 39 | Motif 3 (Beta)推理模型 | Motif Technologies | 32.2 | 44.1 | 闭源 | — | — | 23,668 | — | — |
| 40 | GPT-5.6 Sol (Non-reasoning)非推理模型 | OpenAI | 31.7 | 41.2 | 闭源 | US$0.14 | 0.48 分钟 | 1,617 | 56 Token/s | 2026-07-09 |
| 41 | DeepSeek V4 Pro (Reasoning, High Effort)推理模型 | DeepSeek | 31.4 | 43.1 | 开放权重 | US$0.02 | 3.24 分钟 | 13,313 | 69 Token/s | 2026-04-24 |
| 42 | Claude Sonnet 5 (Non-reasoning, High Effort)非推理模型 | Anthropic | 30.9 | 41.7 | 闭源 | US$0.29 | 1.94 分钟 | 7,779 | 67 Token/s | 2026-06-30 |
| 43 | GPT-5.6 Terra (low)推理模型 | OpenAI | 30.4 | 40.5 | 闭源 | US$0.07 | 0.22 分钟 | 1,696 | 130 Token/s | 2026-07-09 |
| 44 | Nemotron 3 Ultra 550B A55B (Reasoning)推理模型 | NVIDIA | 29.7 | 37.8 | 开放权重 | US$0.13 | 1.11 分钟 | 13,937 | 209 Token/s | 2026-06-04 |
| 45 | DeepSeek V4 Flash (Reasoning, Max Effort)推理模型 | DeepSeek | 29.4 | 40.3 | 开放权重 | US$0.01 | 2.79 分钟 | 22,275 | 133 Token/s | 2026-04-24 |
| 46 | GLM-5.2 (Non-reasoning)非推理模型 | Z AI | 29.4 | 34.1 | 开放权重 | US$0.31 | 0.13 分钟 | 1,005 | 132 Token/s | 2026-06-16 |
| 47 | Kimi K2.7 Code推理模型 | Kimi | 29.3 | 41.9 | 开放权重 | US$0.04 | 4.25 分钟 | 12,236 | 48 Token/s | 2026-06-12 |
| 48 | MiniMax-M2.7推理模型 | MiniMax | 29.1 | 38.1 | 开放权重 | US$0.01 | 2.59 分钟 | 11,556 | 74 Token/s | 2026-03-18 |
| 49 | Qwen3.6 Plus推理模型 | Alibaba | 28.9 | 39.6 | 闭源 | US$0.21 | 4.66 分钟 | 14,826 | 53 Token/s | 2026-04-02 |
| 50 | GPT-5.1 (high)推理模型 | OpenAI | 28.7 | 36.9 | 闭源 | US$0.17 | 1.99 分钟 | 12,696 | 106 Token/s | 2025-11-13 |
| 51 | JT-4.1 Flash 236B A21B非推理模型 | China Mobile | 28.6 | 38.8 | 闭源 | — | — | 15,456 | — | 2026-07-09 |
| 52 | Qwen3.7 Plus推理模型 | Alibaba | 28.3 | 39.0 | 闭源 | US$0.08 | 3.37 分钟 | 10,753 | 53 Token/s | 2026-06-01 |
| 53 | Nex-N2-Pro推理模型 | Nex AGI | 28.3 | 41.0 | 开放权重 | US$0.02 | 2.94 分钟 | 24,142 | 137 Token/s | 2026-06-02 |
| 54 | GPT-5.6 Luna (medium)推理模型 | OpenAI | 28.0 | 38.1 | 闭源 | US$0.03 | 0.22 分钟 | 2,666 | 198 Token/s | 2026-07-09 |
| 55 | Hy3推理模型 | Tencent | 28.0 | 41.2 | 开放权重 | US$0.00 | 5.02 分钟 | 17,731 | 59 Token/s | 2026-07-06 |
| 56 | GPT-5 (high)推理模型 | OpenAI | 27.9 | 34.7 | 闭源 | US$0.20 | 2.01 分钟 | 11,417 | 95 Token/s | 2025-08-07 |
| 57 | GPT-5.4 mini (xhigh)推理模型 | OpenAI | 27.6 | 40.0 | 闭源 | US$0.26 | 3.16 分钟 | 31,670 | 167 Token/s | 2026-03-17 |
| 58 | MiMo-V2.5推理模型 | Xiaomi | 26.6 | 37.2 | 开放权重 | US$0.00 | 2.29 分钟 | 8,626 | 63 Token/s | 2026-04-22 |
| 59 | Kimi K2.5 (Reasoning)推理模型 | Kimi | 26.3 | 35.4 | 开放权重 | US$0.02 | 3.19 分钟 | 9,905 | 52 Token/s | 2026-01-27 |
| 60 | Claude 4.5 Sonnet (Reasoning)推理模型 | Anthropic | 26.2 | 36.4 | 闭源 | US$0.25 | 3.45 分钟 | 8,870 | 43 Token/s | 2025-09-29 |
| 61 | GPT-5.5 (Non-reasoning)非推理模型 | OpenAI | 25.8 | 35.4 | 闭源 | US$0.10 | 0.21 分钟 | 972 | 77 Token/s | 2026-04-23 |
| 62 | LongCat 2.0推理模型 | LongCat | 25.7 | 33.5 | 开放权重 | — | — | 17,606 | — | 2026-06-29 |
| 63 | GPT-5.6 Luna (low)推理模型 | OpenAI | 25.5 | 33.3 | 闭源 | US$0.02 | 0.13 分钟 | 1,580 | 198 Token/s | 2026-07-09 |
| 64 | GPT-5.6 Terra (Non-reasoning)非推理模型 | OpenAI | 25.3 | 34.0 | 闭源 | US$0.09 | 0.19 分钟 | 1,475 | 126 Token/s | 2026-07-09 |
| 65 | GLM-4.7 (Reasoning)推理模型 | Z AI | 25.1 | 33.7 | 开放权重 | US$0.19 | 2.97 分钟 | 22,168 | 125 Token/s | 2025-12-22 |
| 66 | Qwen3.6 27B (Reasoning)推理模型 | Alibaba | 24.8 | 37.1 | 开放权重 | US$0.18 | 4.94 分钟 | 16,990 | 57 Token/s | 2026-04-22 |
| 67 | GPT-5.4 nano (xhigh)推理模型 | OpenAI | 24.1 | 38.2 | 闭源 | US$0.09 | 3.59 分钟 | 36,845 | 171 Token/s | 2026-03-17 |
| 68 | GPT-5 mini (high)推理模型 | OpenAI | 23.5 | 25.3 | 闭源 | US$0.01 | 1.60 分钟 | 10,433 | 109 Token/s | 2025-08-07 |
| 69 | GPT-5.5 Instant (June 2026)推理模型 | OpenAI | 23.2 | 28.9 | 闭源 | US$0.05 | — | 647 | — | 2026-06-25 |
| 70 | Claude 4 Sonnet (Reasoning)推理模型 | Anthropic | 23.0 | 28.9 | 闭源 | US$0.07 | — | 6,782 | — | 2025-05-22 |
| 71 | DeepSeek V3.2 (Reasoning)推理模型 | DeepSeek | 22.7 | 32.0 | 开放权重 | US$0.00 | — | 8,629 | — | 2025-12-01 |
| 72 | Qwen3.6 35B A3B (Reasoning)推理模型 | Alibaba | 22.6 | 31.6 | 开放权重 | US$0.10 | 2.05 分钟 | 18,629 | 151 Token/s | 2026-04-16 |
| 73 | Claude 4.5 Haiku (Reasoning)推理模型 | Anthropic | 22.0 | 29.6 | 闭源 | US$0.10 | 1.80 分钟 | 10,507 | 97 Token/s | 2025-10-15 |
| 74 | Qwen3.5 397B A17B (Reasoning)推理模型 | Alibaba | 21.9 | 33.7 | 开放权重 | US$0.15 | 2.68 分钟 | 10,114 | 63 Token/s | 2026-02-16 |
| 75 | DeepSeek V3.1 Terminus (Reasoning)推理模型 | DeepSeek | 21.6 | 30.4 | 开放权重 | US$0.32 | — | 4,599 | — | 2025-09-22 |
| 76 | Step 3.7 Flash推理模型 | StepFun | 20.4 | 30.3 | 开放权重 | US$0.03 | 0.99 分钟 | 24,033 | 407 Token/s | 2026-05-29 |
| 77 | Qwen3.5 122B A10B (Reasoning)推理模型 | Alibaba | 20.4 | 32.3 | 开放权重 | US$0.11 | 1.35 分钟 | 10,737 | 132 Token/s | 2026-02-24 |
| 78 | KAT Coder Pro V2非推理模型 | KwaiKAT | 20.3 | 33.7 | 闭源 | US$0.00 | — | 3,894 | — | 2026-03-27 |
| 79 | GPT-5.6 Luna (Non-reasoning)非推理模型 | OpenAI | 20.3 | 26.6 | 闭源 | US$0.02 | 0.09 分钟 | 1,053 | 203 Token/s | 2026-07-09 |
| 80 | Mistral Medium 3.5推理模型 | Mistral | 20.1 | 29.9 | 开放权重 | US$0.26 | 1.49 分钟 | 11,333 | 127 Token/s | 2026-04-29 |
| 81 | Command A+推理模型 | Cohere | 19.5 | 22.5 | 开放权重 | US$0.00 | 0.87 分钟 | 9,090 | 174 Token/s | 2026-05-20 |
| 82 | Ring-2.6-1T推理模型 | InclusionAI | 19.3 | 30.6 | 开放权重 | US$0.12 | 1.76 分钟 | 13,776 | 131 Token/s | 2026-05-08 |
| 83 | Gemini 2.5 Pro推理模型 | 19.1 | 25.8 | 闭源 | US$0.12 | 0.65 分钟 | 5,619 | 144 Token/s | 2025-06-05 | |
| 84 | Grok 4.3 (Non-reasoning)非推理模型 | SpaceXAI | 19.1 | 24.8 | 闭源 | US$0.05 | 0.62 分钟 | 3,953 | 107 Token/s | 2026-04-30 |
| 85 | GLM-4.6 (Reasoning)推理模型 | Z AI | 18.9 | 28.7 | 开放权重 | US$0.10 | 2.88 分钟 | 8,286 | 48 Token/s | 2025-09-30 |
| 86 | Gemini 3.1 Flash-Lite推理模型 | 17.5 | 25.0 | 闭源 | US$0.01 | 0.25 分钟 | 5,019 | 335 Token/s | 2026-03-03 | |
| 87 | Gemma 4 31B (Reasoning)推理模型 | 17.4 | 29.4 | 开放权重 | US$0.00 | 2.80 分钟 | 5,886 | 35 Token/s | 2026-04-02 | |
| 88 | Qwen3.6 27B (Non-reasoning)非推理模型 | Alibaba | 17.2 | 30.5 | 开放权重 | US$0.20 | 1.98 分钟 | 6,917 | 58 Token/s | 2026-04-22 |
| 89 | gpt-oss-120b (high)推理模型 | OpenAI | 16.7 | 23.8 | 开放权重 | US$0.05 | 0.78 分钟 | 14,631 | 312 Token/s | 2025-08-05 |
| 90 | Gemma 4 26B A4B (Reasoning)推理模型 | 15.4 | 25.7 | 开放权重 | US$0.02 | — | 11,144 | — | 2026-04-02 | |
| 91 | NVIDIA Nemotron 3 Super 120B A12B (Reasoning)推理模型 | NVIDIA | 15.4 | 25.4 | 开放权重 | US$0.14 | 0.98 分钟 | 14,470 | 246 Token/s | 2026-03-11 |
| 92 | MiMo-V2-Flash (Non-reasoning)非推理模型 | Xiaomi | 15.2 | 24.7 | 开放权重 | — | — | 25,940 | — | 2025-12-16 |
| 93 | Qwen3.5 122B A10B (Non-reasoning)非推理模型 | Alibaba | 15.2 | 27.6 | 开放权重 | US$0.07 | 0.63 分钟 | 5,519 | 146 Token/s | 2026-02-24 |
| 94 | Mistral Small 4 (Reasoning)推理模型 | Mistral | 15.1 | 19.6 | 开放权重 | US$0.02 | 0.55 分钟 | 5,256 | 159 Token/s | 2026-03-16 |
| 95 | Qwen3.6 35B A3B (Non-reasoning)非推理模型 | Alibaba | 15.0 | 24.2 | 开放权重 | US$0.27 | 0.84 分钟 | 9,882 | 195 Token/s | 2026-04-16 |
| 96 | Magistral Medium 1.2推理模型 | Mistral | 14.4 | 17.9 | 闭源 | US$0.55 | 2.19 分钟 | 5,544 | 42 Token/s | 2025-09-18 |
| 97 | Mercury 2推理模型 | Inception | 14.2 | 21.4 | 闭源 | US$0.02 | 0.14 分钟 | 8,639 | 1039 Token/s | 2026-02-20 |
| 98 | Mistral Large 3非推理模型 | Mistral | 14.0 | 15.9 | 开放权重 | US$0.06 | 0.68 分钟 | 2,108 | 52 Token/s | 2025-12-02 |
| 99 | DeepSeek R1 (Jan '25)推理模型 | DeepSeek | 13.8 | 18.5 | 开放权重 | US$0.26 | — | 12,668 | — | 2025-01-20 |
| 100 | Llama 3.1 Instruct 8B非推理模型 | Meta | 13.6 | 7.6 | 开放权重 | US$0.10 | 0.92 分钟 | 8,164 | 147 Token/s | 2024-07-23 |
| 101 | Devstral 2非推理模型 | Mistral | 13.2 | 19.2 | 开放权重 | US$0.00 | 0.73 分钟 | 3,061 | 70 Token/s | 2025-12-09 |
| 102 | Gemma 4 31B (Non-reasoning)非推理模型 | 13.0 | 21.8 | 开放权重 | US$0.02 | 0.43 分钟 | 1,753 | 69 Token/s | 2026-04-02 | |
| 103 | Nova 2.0 Pro Preview (medium)推理模型 | Amazon | 12.8 | 21.8 | 闭源 | US$0.08 | 0.70 分钟 | 5,504 | 131 Token/s | 2025-11-27 |
| 104 | Nova 2.0 Pro Preview (low)推理模型 | Amazon | 12.6 | 19.6 | 闭源 | US$0.06 | 0.28 分钟 | 2,136 | 129 Token/s | 2025-11-27 |
| 105 | K2 Think V2推理模型 | MBZUAI Institute of Foundation Models | 12.5 | 17.3 | 开放权重 | — | — | 11,330 | — | 2025-12-15 |
| 106 | Qwen3.5 35B A3B (Non-reasoning)非推理模型 | Alibaba | 12.4 | 24.0 | 开放权重 | US$0.08 | 0.91 分钟 | 8,054 | 147 Token/s | 2026-02-24 |
| 107 | Mistral Medium 3.1非推理模型 | Mistral | 12.4 | 14.7 | 闭源 | US$0.08 | 0.43 分钟 | 2,301 | 88 Token/s | 2025-08-12 |
| 108 | Qwen3 235B A22B 2507 (Reasoning)推理模型 | Alibaba | 12.3 | 19.6 | 开放权重 | US$0.05 | 3.50 分钟 | 13,457 | 64 Token/s | 2025-07-25 |
| 109 | GPT-4.1 mini非推理模型 | OpenAI | 11.6 | 14.8 | 闭源 | US$0.06 | 0.33 分钟 | 1,656 | 84 Token/s | 2025-04-14 |
| 110 | Nova 2.0 Pro Preview (Non-reasoning)非推理模型 | Amazon | 11.4 | 14.4 | 闭源 | US$0.08 | 0.24 分钟 | 1,652 | 114 Token/s | 2025-11-27 |
| 111 | Devstral Small 2非推理模型 | Mistral | 11.4 | 17.4 | 开放权重 | US$0.00 | 0.72 分钟 | 3,357 | 77 Token/s | 2025-12-09 |
| 112 | o3-mini (high)推理模型 | OpenAI | 11.4 | 15.6 | 闭源 | US$0.02 | 1.10 分钟 | 15,006 | 227 Token/s | 2025-01-31 |
| 113 | Nova 2.0 Lite (high)推理模型 | Amazon | 11.3 | 18.2 | 闭源 | US$0.06 | 2.39 分钟 | 21,657 | 151 Token/s | 2025-10-29 |
| 114 | DeepSeek V3 (Dec '24)非推理模型 | DeepSeek | 11.1 | 14.2 | 开放权重 | US$0.01 | — | 1,129 | — | 2024-12-26 |
| 115 | Qwen3.5 9B (Reasoning)推理模型 | Alibaba | 11.0 | 21.4 | 开放权重 | US$0.12 | 8.43 分钟 | 29,688 | 59 Token/s | 2026-03-02 |
| 116 | Llama 4 Maverick非推理模型 | Meta | 10.9 | 14.3 | 开放权重 | US$0.03 | 0.26 分钟 | 1,760 | 112 Token/s | 2025-04-05 |
| 117 | DeepSeek V3 0324非推理模型 | DeepSeek | 10.9 | 15.4 | 开放权重 | US$0.03 | — | 867 | — | 2025-03-25 |
| 118 | Claude 3.5 Haiku非推理模型 | Anthropic | 10.7 | 12.3 | 闭源 | US$0.00 | — | 1,146 | — | 2024-10-22 |
| 119 | HyperNova 60B 2605推理模型 | Multiverse Computing | 10.6 | 17.8 | 开放权重 | US$0.02 | 1.19 分钟 | 26,477 | 370 Token/s | 2026-05-26 |
| 120 | Solar Pro 3推理模型 | Upstage | 10.5 | 14.1 | 闭源 | — | — | 30,941 | — | 2026-04-06 |
| 121 | Qwen3 Coder Next非推理模型 | Alibaba | 10.2 | 21.1 | 开放权重 | US$0.08 | 1.06 分钟 | 6,235 | 98 Token/s | 2026-02-03 |
| 122 | Mistral Small 3.1非推理模型 | Mistral | 10.0 | 14.7 | 开放权重 | US$0.01 | 0.27 分钟 | 2,366 | 149 Token/s | 2025-03-17 |
| 123 | North Mini Code推理模型 | Cohere | 9.7 | 19.8 | 开放权重 | US$0.00 | 1.51 分钟 | 10,216 | 112 Token/s | 2026-06-09 |
| 124 | Qwen3 Next 80B A3B (Reasoning)推理模型 | Alibaba | 9.6 | 16.7 | 开放权重 | US$0.12 | 1.44 分钟 | 15,573 | 181 Token/s | 2025-09-11 |
| 125 | Qwen3.5 0.8B (Reasoning)推理模型 | Alibaba | 9.5 | 5.5 | 开放权重 | — | — | 25,302 | — | 2026-03-02 |
| 126 | Nanbeige4.1-3B推理模型 | Nanbeige | 9.4 | 11.1 | 开放权重 | — | — | 82,030 | — | 2026-02-11 |
| 127 | Qwen3 32B (Reasoning)推理模型 | Alibaba | 9.3 | 11.5 | 开放权重 | US$0.09 | 1.33 分钟 | 7,774 | 97 Token/s | 2025-04-28 |
| 128 | gpt-oss-120b (low)推理模型 | OpenAI | 9.1 | 14.9 | 开放权重 | US$0.02 | 0.12 分钟 | 2,401 | 332 Token/s | 2025-08-05 |
| 129 | Llama 4 Scout非推理模型 | Meta | 9.0 | 10.0 | 开放权重 | US$0.01 | 0.15 分钟 | 762 | 83 Token/s | 2025-04-05 |
| 130 | gpt-oss-20b (high)推理模型 | OpenAI | 9.0 | 14.9 | 开放权重 | US$0.02 | 1.06 分钟 | 14,274 | 225 Token/s | 2025-08-05 |
| 131 | Llama 3.3 Instruct 70B非推理模型 | Meta | 9.0 | 9.4 | 开放权重 | US$0.06 | 0.24 分钟 | 1,221 | 85 Token/s | 2024-12-06 |
| 132 | DiffusionGemma 26B A4B推理模型 | 8.9 | 13.5 | 开放权重 | — | — | 10,835 | — | 2026-06-10 | |
| 133 | NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)推理模型 | NVIDIA | 8.9 | 14.2 | 开放权重 | US$0.02 | 2.49 分钟 | 23,962 | 160 Token/s | 2025-12-15 |
| 134 | Qwen3 30B A3B 2507 (Reasoning)推理模型 | Alibaba | 8.5 | 14.4 | 开放权重 | US$0.05 | 1.78 分钟 | 15,816 | 148 Token/s | 2025-07-30 |
| 135 | GPT-4.1 nano非推理模型 | OpenAI | 8.5 | 9.6 | 闭源 | US$0.04 | 0.60 分钟 | 7,082 | 196 Token/s | 2025-04-14 |
| 136 | Mistral Small 3.2非推理模型 | Mistral | 8.4 | 10.6 | 开放权重 | US$0.11 | 0.59 分钟 | 5,470 | 154 Token/s | 2025-06-20 |
| 137 | Qwen3 14B (Reasoning)推理模型 | Alibaba | 8.2 | 10.4 | 开放权重 | US$0.01 | 1.23 分钟 | 4,579 | 62 Token/s | 2025-04-28 |
| 138 | Ministral 3 3B非推理模型 | Mistral | 7.9 | 6.8 | 开放权重 | US$0.04 | 1.14 分钟 | 11,251 | 164 Token/s | 2025-12-02 |
| 139 | Qwen3.5 2B (Reasoning)推理模型 | Alibaba | 7.6 | 7.6 | 开放权重 | — | — | 42,485 | — | 2026-03-02 |
| 140 | Ministral 3 14B非推理模型 | Mistral | 7.5 | 11.1 | 开放权重 | US$0.07 | 0.92 分钟 | 3,408 | 62 Token/s | 2025-12-02 |
| 141 | Phi-4 Mini Instruct非推理模型 | Microsoft | 7.5 | 6.0 | 开放权重 | US$0.00 | 10.25 分钟 | 27,585 | 45 Token/s | 2024-02-26 |
| 142 | Ling 2.6 Flash非推理模型 | InclusionAI | 7.4 | 14.1 | 开放权重 | US$0.00 | 0.67 分钟 | 7,199 | 180 Token/s | 2026-04-21 |
| 143 | Ministral 3 8B非推理模型 | Mistral | 7.4 | 9.0 | 开放权重 | US$0.02 | 0.51 分钟 | 3,497 | 114 Token/s | 2025-12-02 |
| 144 | Magistral Small 1.2推理模型 | Mistral | 6.7 | 11.3 | 开放权重 | US$0.23 | 1.52 分钟 | 7,432 | 81 Token/s | 2025-09-17 |
| 145 | Gemma 3 27B Instruct非推理模型 | 6.6 | 7.4 | 开放权重 | US$0.00 | — | 5,655 | — | 2025-03-12 | |
| 146 | Qwen3 8B (Reasoning)推理模型 | Alibaba | 6.5 | 8.3 | 开放权重 | US$0.01 | 3.14 分钟 | 7,418 | 39 Token/s | 2025-04-28 |
| 147 | Granite 4.1 30B非推理模型 | IBM | 6.1 | 8.9 | 开放权重 | — | — | 2,918 | — | 2026-04-29 |
| 148 | NVIDIA Nemotron 3 Nano 4B推理模型 | NVIDIA | 5.6 | 8.7 | 开放权重 | — | — | 5,377 | — | 2026-03-16 |
| 149 | Gemma 3 12B Instruct非推理模型 | 5.0 | 5.5 | 开放权重 | US$0.00 | — | 20,438 | — | 2025-03-12 | |
| 150 | Granite 4.1 3B非推理模型 | IBM | 4.4 | 4.7 | 开放权重 | — | — | 4,192 | — | 2026-04-29 |
| 151 | MiniCPM-V 4.6 1.3B非推理模型 | OpenBMB | 3.7 | 4.2 | 开放权重 | — | — | 7,992 | — | 2026-05-11 |
| 152 | Qwen3.5 2B (Non-reasoning)非推理模型 | Alibaba | 3.2 | 5.6 | 开放权重 | — | — | 21,675 | — | 2026-03-02 |
| 153 | Qwen3.5 0.8B (Non-reasoning)非推理模型 | Alibaba | 2.3 | 3.3 | 开放权重 | — | — | 18,531 | — | 2026-03-02 |
INDEX BREAKDOWN
指数由什么构成
权重来自 Artificial Analysis 的 Capability Indices Methodology;各底层评测由来源方独立运行。
医学与健康知识
诊断、药理学、护理路径及相关临床知识。
Agent 知识工作
规划并协调 EHR、药房等多步骤工作流。
非幻觉
避免虚构药物相互作用、剂量或指南。
推理
生物学与医学场景中的多步骤临床推理。
Agent 患者交互
多轮、可调用工具的患者和会员支持工作流。
REPRESENTATIVE WORKFLOWS
来源定义的典型工作流
这些是指数希望覆盖的任务形态,用来解释评测范围,并不代表模型已经具备临床部署资格。
患者诊断与临床评估
医学知识 · 非幻觉 · 推理结合既往 EHR、最新检验与影像重新评估症状恶化的患者,形成鉴别诊断并指出替代解释。
治疗实施与操作
医学知识 · 非幻觉在术中出现意外情况时检索可比病例和影像先例,提取与当下决策相关的证据。
病历记录与整理
医学知识 · Agent 知识工作把随访口述记录整理为结构化 SOAP 病历,关联既往问题并标记仍需补充的信息。
药物管理与药房协同
医学知识 · 非幻觉 · 推理依据处方、体重和药液浓度换算单次用量,并检查是否处于安全日剂量范围。
继续教育与研究
医学知识 · Agent 知识工作 · 推理汇总新疗法的试验和安全性证据,对照现行标准并列出仍未解决的问题。
患者教育与照护协同
医学知识 · Agent 知识工作 · 患者交互把诊后摘要转成患者可理解的分步说明,并覆盖常见疑问、随访安排和联系路径。
HOW TO READ
怎样理解这个指数
在来源设定的加权任务组合中,哪些模型整体表现更强,以及优势来自哪些能力维度。
不能直接证明模型适合你的真实工作流,也不是安全性、合规性或专业部署认证。
结合单项评测、成本、速度、上下文、Provider 稳定性和你自己的任务验证。