MODEL ANALYSIS

Gemini 2.0 Flash Thinking exp. (Jan)

Google 的模型详情:聚合公开能力、价格、Token、速度、延迟和 Provider 实测数据,不重新评测或修改原始分数。

数据快照:2026-07-21查看原始来源 ↗
智能指数13.3*暂无排名
生成速度Token/s
API 价格输入 / 1M Token · 输出 $—
单任务成本来源未提供可比较价格
单任务输出Token

模型概览

Gemini 2.0 Flash Thinking exp. (Jan) 的 Intelligence Index 为 13.3,生成速度为 暂无数据 Token/s,完整评测成本为 暂无数据。这些指标分别反映能力、吞吐和评测经济性,不能合并成单一“最好”结论。

技术规格

机构
Google
发布日期
2025-01-21
推理类型
推理模型
模型权重
闭源
上下文窗口
1,000,000 Token
输入模态
文本、图像、语音、视频
输出模态
文本、图像、语音
性能来源
Provider 中位数

INTERACTIVE COMPARISON

模型指标比较器

切换指标并按状态、推理类型和权重开放性筛选。首屏服务端呈现前 24 个模型,浏览器随后载入完整数据,并始终保留当前模型。

23 / 577 个模型 · 正在载入全量数据
智能指数模型比较;当前显示 23 个模型。Claude Fable 559.9GPT-5.6 Sol (max)58.9GPT-5.6 Sol (xhigh)57.7Kimi K357.1GPT-5.6 Sol (high)55.9Claude Opus 4.8 (max)55.7GPT-5.6 Terra (max)55Grok 4.5 (high)53.8GPT-5.6 Sol (medium)53.6Claude Sonnet 5 (max)53.4GPT-5.6 Terra (xhigh)51.6GPT-5.6 Luna (max)51.2GLM-5.2 (max)51.1Muse Spark 1.1 (xhigh)50.6Gemini 3.5 Flash50.2GPT-5.6 Sol (low)49.4GPT-5.6 Luna (xhigh)49.1GPT-5.6 Terra (high)49Gemini 3.1 Pro Preview46.5GPT-5.6 Luna (high)46.1Qwen3.7 Max46GPT-5.6 Terra (medium)45.6Gemini 3.5 Flash (medium)45.4智能指数模型比较;当前显示 23 个模型。Claude Fable 559.9GPT-5.6 Sol (max)58.9GPT-5.6 Sol (xhig…57.7Kimi K357.1GPT-5.6 Sol (high)55.9Claude Opus 4.8 (…55.7GPT-5.6 Terra (ma…55Grok 4.5 (high)53.8GPT-5.6 Sol (medi…53.6Claude Sonnet 5 (…53.4GPT-5.6 Terra (xh…51.6GPT-5.6 Luna (max)51.2GLM-5.2 (max)51.1Muse Spark 1.1 (x…50.6Gemini 3.5 Flash50.2GPT-5.6 Sol (low)49.4GPT-5.6 Luna (xhi…49.1GPT-5.6 Terra (hi…49Gemini 3.1 Pro Pr…46.5GPT-5.6 Luna (hig…46.1Qwen3.7 Max46GPT-5.6 Terra (me…45.6Gemini 3.5 Flash …45.4

INTELLIGENCE

Artificial Analysis 智能指数

v4.1 由 9 项独立评测组成;数值越高越好。蓝色代表当前模型。

当前模型智能指数对比
当前模型智能指数对比;公开数据059.9Claude Fable 5: 59.9;AnthropicClaude Fable 559.9GPT-5.6 Sol (max): 58.9;OpenAIGPT-5.6 Sol (max)58.9GPT-5.6 Sol (xhigh): 57.7;OpenAIGPT-5.6 Sol (xhigh)57.7Kimi K3: 57.1;KimiKimi K357.1GPT-5.6 Sol (high): 55.9;OpenAIGPT-5.6 Sol (high)55.9Claude Opus 4.8 (max): 55.7;AnthropicClaude Opus 4.8 (max)55.7GPT-5.6 Terra (max): 55;OpenAIGPT-5.6 Terra (max)55Grok 4.5 (high): 53.8;SpaceXAIGrok 4.5 (high)53.8GPT-5.6 Sol (medium): 53.6;OpenAIGPT-5.6 Sol (medium)53.6Claude Sonnet 5 (max): 53.4;AnthropicClaude Sonnet 5 (max)53.4GPT-5.6 Terra (xhigh): 51.6;OpenAIGPT-5.6 Terra (xhigh)51.6GPT-5.6 Luna (max): 51.2;OpenAIGPT-5.6 Luna (max)51.2GLM-5.2 (max): 51.1;Z AIGLM-5.2 (max)51.1Muse Spark 1.1 (xhigh): 50.6;MetaMuse Spark 1.1 (xhigh)50.6Gemini 3.5 Flash: 50.2;GoogleGemini 3.5 Flash50.2GPT-5.6 Sol (low): 49.4;OpenAIGPT-5.6 Sol (low)49.4GPT-5.6 Luna (xhigh): 49.1;OpenAIGPT-5.6 Luna (xhigh)49.1GPT-5.6 Terra (high): 49;OpenAIGPT-5.6 Terra (high)49Gemini 3.1 Pro Preview: 46.5;GoogleGemini 3.1 Pro Preview46.5GPT-5.6 Luna (high): 46.1;OpenAIGPT-5.6 Luna (high)46.1当前模型智能指数对比;公开数据059.9Claude Fable 5: 59.9;AnthropicClaude Fable 559.9GPT-5.6 Sol (max): 58.9;OpenAIGPT-5.6 Sol (max)58.9GPT-5.6 Sol (xhigh): 57.7;OpenAIGPT-5.6 Sol (xhig…57.7Kimi K3: 57.1;KimiKimi K357.1GPT-5.6 Sol (high): 55.9;OpenAIGPT-5.6 Sol (high)55.9Claude Opus 4.8 (max): 55.7;AnthropicClaude Opus 4.8 (…55.7GPT-5.6 Terra (max): 55;OpenAIGPT-5.6 Terra (ma…55Grok 4.5 (high): 53.8;SpaceXAIGrok 4.5 (high)53.8GPT-5.6 Sol (medium): 53.6;OpenAIGPT-5.6 Sol (medi…53.6Claude Sonnet 5 (max): 53.4;AnthropicClaude Sonnet 5 (…53.4GPT-5.6 Terra (xhigh): 51.6;OpenAIGPT-5.6 Terra (xh…51.6GPT-5.6 Luna (max): 51.2;OpenAIGPT-5.6 Luna (max)51.2GLM-5.2 (max): 51.1;Z AIGLM-5.2 (max)51.1Muse Spark 1.1 (xhigh): 50.6;MetaMuse Spark 1.1 (x…50.6Gemini 3.5 Flash: 50.2;GoogleGemini 3.5 Flash50.2GPT-5.6 Sol (low): 49.4;OpenAIGPT-5.6 Sol (low)49.4GPT-5.6 Luna (xhigh): 49.1;OpenAIGPT-5.6 Luna (xhi…49.1GPT-5.6 Terra (high): 49;OpenAIGPT-5.6 Terra (hi…49Gemini 3.1 Pro Preview: 46.5;GoogleGemini 3.1 Pro Pr…46.5GPT-5.6 Luna (high): 46.1;OpenAIGPT-5.6 Luna (hig…46.1
查看图表数据
项目数值
Claude Fable 559.9
GPT-5.6 Sol (max)58.9
GPT-5.6 Sol (xhigh)57.7
Kimi K357.1
GPT-5.6 Sol (high)55.9
Claude Opus 4.8 (max)55.7
GPT-5.6 Terra (max)55
Grok 4.5 (high)53.8
GPT-5.6 Sol (medium)53.6
Claude Sonnet 5 (max)53.4
GPT-5.6 Terra (xhigh)51.6
GPT-5.6 Luna (max)51.2
GLM-5.2 (max)51.1
Muse Spark 1.1 (xhigh)50.6
Gemini 3.5 Flash50.2
GPT-5.6 Sol (low)49.4
GPT-5.6 Luna (xhigh)49.1
GPT-5.6 Terra (high)49
Gemini 3.1 Pro Preview46.5
GPT-5.6 Luna (high)46.1

INTELLIGENCE BREAKDOWN

9 项组成评测

各列保留来源站点的展示口径;GDPval 使用归一化值,AA-Omniscience 使用知识可靠指数,其余为通过率。

Gemini 2.0 Flash Thinking exp. (Jan) 分项成绩同图用于观察强弱轮廓,不应直接把不同评测的数值当作同一量纲。
Gemini 2.0 Flash Thinking exp. (Jan) 分项成绩;公开数据070.1SciCode: 32.9%SciCode32.9%Humanity's Last Exam: 7.1%Humanity's Last Exam7.1%GPQA Diamond: 70.1%GPQA Diamond70.1%Gemini 2.0 Flash Thinking exp. (Jan) 分项成绩;公开数据070.1SciCode: 32.9%SciCode32.9%Humanity's Last Exam: 7.1%Humanity's Last E…7.1%GPQA Diamond: 70.1%GPQA Diamond70.1%
查看图表数据
项目数值
SciCode32.9%
Humanity's Last Exam7.1%
GPQA Diamond70.1%

AA-BRIEFCASE

真实知识工作成果质量

Elo 来自对可交付成果的成对比较;同时观察分析质量、呈现质量和任务要求通过率。

AA-Briefcase Elo 对比
AA-Briefcase Elo 对比;公开数据01,583Claude Fable 5: 1,583;AnthropicClaude Fable 51,583Kimi K3: 1,543;KimiKimi K31,543GPT-5.6 Sol (max): 1,496;OpenAIGPT-5.6 Sol (max)1,496Claude Sonnet 5 (max): 1,388;AnthropicClaude Sonnet 5 (max)1,388Claude Opus 4.8 (max): 1,354;AnthropicClaude Opus 4.8 (max)1,354Grok 4.5 (high): 1,323;SpaceXAIGrok 4.5 (high)1,323Claude Sonnet 5 (xhigh): 1,298;AnthropicClaude Sonnet 5 (xhigh)1,298GLM-5.2 (max): 1,260;Z AIGLM-5.2 (max)1,260Claude Sonnet 5 (high): 1,199;AnthropicClaude Sonnet 5 (high)1,199MiniMax-M3: 1,110;MiniMaxMiniMax-M31,110Claude Opus 4.7 (Non-reasoning, high): 1,089;AnthropicClaude Opus 4.7 (Non-reasonin…1,089Claude Sonnet 5 (medium): 1,059;AnthropicClaude Sonnet 5 (medium)1,059DeepSeek V4 Pro (max): 932;DeepSeekDeepSeek V4 Pro (max)932Claude Sonnet 5 (low): 926;AnthropicClaude Sonnet 5 (low)926Qwen3.7 Max: 908;AlibabaQwen3.7 Max908MiMo-V2.5-Pro: 873;XiaomiMiMo-V2.5-Pro873Nemotron 3 Ultra: 870;NVIDIANemotron 3 Ultra870Gemini 3.5 Flash (medium): 869;GoogleGemini 3.5 Flash (medium)869AA-Briefcase Elo 对比;公开数据01,583Claude Fable 5: 1,583;AnthropicClaude Fable 51,583Kimi K3: 1,543;KimiKimi K31,543GPT-5.6 Sol (max): 1,496;OpenAIGPT-5.6 Sol (max)1,496Claude Sonnet 5 (max): 1,388;AnthropicClaude Sonnet 5 (…1,388Claude Opus 4.8 (max): 1,354;AnthropicClaude Opus 4.8 (…1,354Grok 4.5 (high): 1,323;SpaceXAIGrok 4.5 (high)1,323Claude Sonnet 5 (xhigh): 1,298;AnthropicClaude Sonnet 5 (…1,298GLM-5.2 (max): 1,260;Z AIGLM-5.2 (max)1,260Claude Sonnet 5 (high): 1,199;AnthropicClaude Sonnet 5 (…1,199MiniMax-M3: 1,110;MiniMaxMiniMax-M31,110Claude Opus 4.7 (Non-reasoning, high): 1,089;AnthropicClaude Opus 4.7 (…1,089Claude Sonnet 5 (medium): 1,059;AnthropicClaude Sonnet 5 (…1,059DeepSeek V4 Pro (max): 932;DeepSeekDeepSeek V4 Pro (…932Claude Sonnet 5 (low): 926;AnthropicClaude Sonnet 5 (…926Qwen3.7 Max: 908;AlibabaQwen3.7 Max908MiMo-V2.5-Pro: 873;XiaomiMiMo-V2.5-Pro873Nemotron 3 Ultra: 870;NVIDIANemotron 3 Ultra870Gemini 3.5 Flash (medium): 869;GoogleGemini 3.5 Flash …869
查看图表数据
项目数值
Claude Fable 51,583
Kimi K31,543
GPT-5.6 Sol (max)1,496
Claude Sonnet 5 (max)1,388
Claude Opus 4.8 (max)1,354
Grok 4.5 (high)1,323
Claude Sonnet 5 (xhigh)1,298
GLM-5.2 (max)1,260
Claude Sonnet 5 (high)1,199
MiniMax-M31,110
Claude Opus 4.7 (Non-reasoning, high)1,089
Claude Sonnet 5 (medium)1,059
DeepSeek V4 Pro (max)932
Claude Sonnet 5 (low)926
Qwen3.7 Max908
MiMo-V2.5-Pro873
Nemotron 3 Ultra870
Gemini 3.5 Flash (medium)869

AA-OMNISCIENCE

知识与幻觉

指数同时考虑正确回答和避免幻觉。当前模型准确率 暂无,幻觉率 暂无。

AA-Omniscience 指数对比
AA-Omniscience 指数对比;公开数据040.2Claude Fable 5: 40.2;AnthropicClaude Fable 540.2Gemini 3.1 Pro Preview: 32.9;GoogleGemini 3.1 Pro Preview32.9Claude Opus 4.8 (max): 27.4;AnthropicClaude Opus 4.8 (max)27.4Grok 4.5 (high): 26.4;SpaceXAIGrok 4.5 (high)26.4Gemini 3.5 Flash: 22.7;GoogleGemini 3.5 Flash22.7GPT-5.6 Sol (max): 21.7;OpenAIGPT-5.6 Sol (max)21.7Gemini 3.5 Flash (medium): 21.7;GoogleGemini 3.5 Flash (medium)21.7GPT-5.6 Sol (xhigh): 20.6;OpenAIGPT-5.6 Sol (xhigh)20.6GPT-5.6 Sol (high): 19.8;OpenAIGPT-5.6 Sol (high)19.8GPT-5.6 Sol (medium): 19;OpenAIGPT-5.6 Sol (medium)19Kimi K3: 18.4;KimiKimi K318.4GPT-5.6 Sol (low): 18.4;OpenAIGPT-5.6 Sol (low)18.4Muse Spark 1.1 (xhigh): 18;MetaMuse Spark 1.1 (xhigh)18Grok 4.3 (medium): 17;SpaceXAIGrok 4.3 (medium)17Claude Sonnet 5 (max): 15.3;AnthropicClaude Sonnet 5 (max)15.3Claude Opus 4.7 (Non-reasoning, high): 14.2;AnthropicClaude Opus 4.7 (Non-reasonin…14.2Qwen3.7 Max: 14.1;AlibabaQwen3.7 Max14.1Grok 4.3 (low): 13.7;SpaceXAIGrok 4.3 (low)13.7GPT-5.3 Codex (xhigh): 9.9;OpenAIGPT-5.3 Codex (xhigh)9.9Muse Spark: 4.1;MetaMuse Spark4.1AA-Omniscience 指数对比;公开数据040.2Claude Fable 5: 40.2;AnthropicClaude Fable 540.2Gemini 3.1 Pro Preview: 32.9;GoogleGemini 3.1 Pro Pr…32.9Claude Opus 4.8 (max): 27.4;AnthropicClaude Opus 4.8 (…27.4Grok 4.5 (high): 26.4;SpaceXAIGrok 4.5 (high)26.4Gemini 3.5 Flash: 22.7;GoogleGemini 3.5 Flash22.7GPT-5.6 Sol (max): 21.7;OpenAIGPT-5.6 Sol (max)21.7Gemini 3.5 Flash (medium): 21.7;GoogleGemini 3.5 Flash …21.7GPT-5.6 Sol (xhigh): 20.6;OpenAIGPT-5.6 Sol (xhig…20.6GPT-5.6 Sol (high): 19.8;OpenAIGPT-5.6 Sol (high)19.8GPT-5.6 Sol (medium): 19;OpenAIGPT-5.6 Sol (medi…19Kimi K3: 18.4;KimiKimi K318.4GPT-5.6 Sol (low): 18.4;OpenAIGPT-5.6 Sol (low)18.4Muse Spark 1.1 (xhigh): 18;MetaMuse Spark 1.1 (x…18Grok 4.3 (medium): 17;SpaceXAIGrok 4.3 (medium)17Claude Sonnet 5 (max): 15.3;AnthropicClaude Sonnet 5 (…15.3Claude Opus 4.7 (Non-reasoning, high): 14.2;AnthropicClaude Opus 4.7 (…14.2Qwen3.7 Max: 14.1;AlibabaQwen3.7 Max14.1Grok 4.3 (low): 13.7;SpaceXAIGrok 4.3 (low)13.7GPT-5.3 Codex (xhigh): 9.9;OpenAIGPT-5.3 Codex (xh…9.9Muse Spark: 4.1;MetaMuse Spark4.1
查看图表数据
项目数值
Claude Fable 540.2
Gemini 3.1 Pro Preview32.9
Claude Opus 4.8 (max)27.4
Grok 4.5 (high)26.4
Gemini 3.5 Flash22.7
GPT-5.6 Sol (max)21.7
Gemini 3.5 Flash (medium)21.7
GPT-5.6 Sol (xhigh)20.6
GPT-5.6 Sol (high)19.8
GPT-5.6 Sol (medium)19
Kimi K318.4
GPT-5.6 Sol (low)18.4
Muse Spark 1.1 (xhigh)18
Grok 4.3 (medium)17
Claude Sonnet 5 (max)15.3
Claude Opus 4.7 (Non-reasoning, high)14.2
Qwen3.7 Max14.1
Grok 4.3 (low)13.7
GPT-5.3 Codex (xhigh)9.9
Muse Spark4.1

INTELLIGENCE VS COST

能力与单任务成本

右上代表能力更高但成本也更高;理想区域通常靠近左上。横轴使用对数刻度,避免高价模型压扁主体分布。

智能指数与单任务成本
智能指数与单任务成本单任务成本(对数刻度)智能指数0 美元2.75 美元59.96Gemini 3.5 Flash: 单任务成本 0.586 美元;智能指数 50.203MiMo-V2.5-Pro: 单任务成本 0.031 美元;智能指数 42.239Mercury 2: 单任务成本 0.075 美元;智能指数 21.432Qwen3.5 122B A10B: 单任务成本 0.177 美元;智能指数 27.595GPT-5.6 Luna (low): 单任务成本 0.04 美元;智能指数 33.264GPT-5.6 Sol (low): 单任务成本 0.197 美元;智能指数 49.444Devstral 2: 单任务成本 0 美元;智能指数 19.157Nova 2.0 Pro Preview (medium): 单任务成本 0.173 美元;智能指数 21.765Qwen3.5 397B A17B: 单任务成本 0.333 美元;智能指数 33.682North Mini Code: 单任务成本 0 美元;智能指数 19.795Qwen3.5 122B A10B: 单任务成本 0.241 美元;智能指数 32.279MiMo-V2.5: 单任务成本 0.01 美元;智能指数 37.203Claude Sonnet 5 (max): 单任务成本 1.525 美元;智能指数 53.35GPT-5.6 Terra (medium): 单任务成本 0.175 美元;智能指数 45.574Gemini 2.5 Pro: 单任务成本 0.198 美元;智能指数 25.818MiniMax-M3: 单任务成本 0.125 美元;智能指数 44.437Qwen3.5 9B: 单任务成本 0.164 美元;智能指数 21.438Command A+: 单任务成本 0 美元;智能指数 22.51HyperNova 60B 2605: 单任务成本 0.018 美元;智能指数 17.804gpt-oss-20b (high): 单任务成本 0.018 美元;智能指数 14.885Qwen3.6 27B: 单任务成本 0.359 美元;智能指数 30.461Mistral Small 4: 单任务成本 0.098 美元;智能指数 19.556GPT-5.6 Luna (max): 单任务成本 0.209 美元;智能指数 51.236Mistral Large 3: 单任务成本 0.06 美元;智能指数 15.93GPT-5.6 Luna (medium): 单任务成本 0.05 美元;智能指数 38.051Gemini 3.1 Flash-Lite: 单任务成本 0.042 美元;智能指数 25.038Nemotron 3 Ultra: 单任务成本 0.244 美元;智能指数 37.762DeepSeek V4 Pro (high): 单任务成本 0.04 美元;智能指数 43.112Nova 2.0 Lite (high): 单任务成本 0.245 美元;智能指数 18.168NVIDIA Nemotron 3 Super: 单任务成本 0.206 美元;智能指数 25.406Qwen3.6 35B A3B: 单任务成本 0.598 美元;智能指数 24.163Ministral 3 3B: 单任务成本 0.126 美元;智能指数 6.801Qwen3.7 Max: 单任务成本 1.032 美元;智能指数 45.994Gemma 4 26B A4B: 单任务成本 0.029 美元;智能指数 25.695GPT-5.6 Sol (medium): 单任务成本 0.314 美元;智能指数 53.589Magistral Small 1.2: 单任务成本 0.254 美元;智能指数 11.292Ministral 3 14B: 单任务成本 0.149 美元;智能指数 11.053NVIDIA Nemotron 3 Nano: 单任务成本 0.018 美元;智能指数 14.177Grok 4.5 (high): 单任务成本 0.312 美元;智能指数 53.827GPT-5.6 Sol (Non-reasoning): 单任务成本 0.2 美元;智能指数 41.203GPT-5.6 Terra (high): 单任务成本 0.336 美元;智能指数 48.955Magistral Medium 1.2: 单任务成本 0.747 美元;智能指数 17.874Qwen3.6 35B A3B: 单任务成本 0.179 美元;智能指数 31.65GPT-5.6 Luna (xhigh): 单任务成本 0.139 美元;智能指数 49.068GPT-5.6 Sol (high): 单任务成本 0.453 美元;智能指数 55.867Qwen3.6 27B: 单任务成本 0.265 美元;智能指数 37.052Grok 4.3 (Non-reasoning): 单任务成本 0.293 美元;智能指数 24.752Llama 4 Maverick: 单任务成本 0.032 美元;智能指数 14.266Ministral 3 8B: 单任务成本 0.185 美元;智能指数 8.957Llama 3.3 70B: 单任务成本 0.081 美元;智能指数 9.403Claude Opus 4.8 (max): 单任务成本 1.797 美元;智能指数 55.692GPT-5.6 Terra (Non-reasoning): 单任务成本 0.179 美元;智能指数 33.967GPT-5.6 Terra (xhigh): 单任务成本 0.477 美元;智能指数 51.605Phi-4 Mini: 单任务成本 0 美元;智能指数 6.014Nova 2.0 Pro Preview: 单任务成本 0.246 美元;智能指数 14.356Claude 4.5 Haiku: 单任务成本 0.237 美元;智能指数 29.576Qwen3.7 Plus: 单任务成本 0.207 美元;智能指数 38.977GPT-5.6 Luna (high): 单任务成本 0.095 美元;智能指数 46.059Llama 4 Scout: 单任务成本 0.009 美元;智能指数 10.042Hy3: 单任务成本 0 美元;智能指数 41.231Gemini 3.1 Pro Preview: 单任务成本 0.291 美元;智能指数 46.459GPT-5.6 Terra (max): 单任务成本 0.825 美元;智能指数 54.953DeepSeek V4 Pro (max): 单任务成本 0.045 美元;智能指数 44.274GPT-5.5 Instant (June 2026): 单任务成本 0.539 美元;智能指数 28.86Qwen3 Next 80B A3B: 单任务成本 0.169 美元;智能指数 16.72gpt-oss-120b (low): 单任务成本 0.017 美元;智能指数 14.911GPT-5.6 Terra (low): 单任务成本 0.154 美元;智能指数 40.466Claude Fable 5: 单任务成本 2.75 美元;智能指数 59.861Devstral Small 2: 单任务成本 0 美元;智能指数 17.437Gemma 4 31B: 单任务成本 0.034 美元;智能指数 21.769Claude Sonnet 5 (Non-reasoning): 单任务成本 0.375 美元;智能指数 41.731Muse Spark 1.1 (xhigh): 单任务成本 0.261 美元;智能指数 50.623DeepSeek V4 Flash (max): 单任务成本 0.022 美元;智能指数 40.283GPT-5.6 Sol (max): 单任务成本 1.037 美元;智能指数 58.89GPT-5.6 Sol (xhigh): 单任务成本 0.682 美元;智能指数 57.654GPT-5.6 Luna (Non-reasoning): 单任务成本 0.055 美元;智能指数 26.56Mistral Medium 3.5: 单任务成本 0.563 美元;智能指数 29.947Ring-2.6-1T: 单任务成本 0.345 美元;智能指数 30.573Qwen3.5 35B A3B: 单任务成本 0.231 美元;智能指数 23.993gpt-oss-120b (high): 单任务成本 0.061 美元;智能指数 23.831Qwen3.6 Plus: 单任务成本 0.314 美元;智能指数 39.561Nova 2.0 Pro Preview (low): 单任务成本 0.213 美元;智能指数 19.606GLM-5.2 (max): 单任务成本 0.468 美元;智能指数 51.086Kimi K3: 单任务成本 0.954 美元;智能指数 57.112Qwen3 Coder Next: 单任务成本 0.329 美元;智能指数 21.109智能指数与单任务成本单任务成本(对数)智能指数0 美元2.75 美元59.96Gemini 3.5 Flash: 单任务成本 0.586 美元;智能指数 50.203MiMo-V2.5-Pro: 单任务成本 0.031 美元;智能指数 42.239Mercury 2: 单任务成本 0.075 美元;智能指数 21.432Qwen3.5 122B A10B: 单任务成本 0.177 美元;智能指数 27.595GPT-5.6 Luna (low): 单任务成本 0.04 美元;智能指数 33.264GPT-5.6 Sol (low): 单任务成本 0.197 美元;智能指数 49.444Devstral 2: 单任务成本 0 美元;智能指数 19.157Nova 2.0 Pro Preview (medium): 单任务成本 0.173 美元;智能指数 21.765Qwen3.5 397B A17B: 单任务成本 0.333 美元;智能指数 33.682North Mini Code: 单任务成本 0 美元;智能指数 19.795Qwen3.5 122B A10B: 单任务成本 0.241 美元;智能指数 32.279MiMo-V2.5: 单任务成本 0.01 美元;智能指数 37.203Claude Sonnet 5 (max): 单任务成本 1.525 美元;智能指数 53.35GPT-5.6 Terra (medium): 单任务成本 0.175 美元;智能指数 45.574Gemini 2.5 Pro: 单任务成本 0.198 美元;智能指数 25.818MiniMax-M3: 单任务成本 0.125 美元;智能指数 44.437Qwen3.5 9B: 单任务成本 0.164 美元;智能指数 21.438Command A+: 单任务成本 0 美元;智能指数 22.51HyperNova 60B 2605: 单任务成本 0.018 美元;智能指数 17.804gpt-oss-20b (high): 单任务成本 0.018 美元;智能指数 14.885Qwen3.6 27B: 单任务成本 0.359 美元;智能指数 30.461Mistral Small 4: 单任务成本 0.098 美元;智能指数 19.556GPT-5.6 Luna (max): 单任务成本 0.209 美元;智能指数 51.236Mistral Large 3: 单任务成本 0.06 美元;智能指数 15.93GPT-5.6 Luna (medium): 单任务成本 0.05 美元;智能指数 38.051Gemini 3.1 Flash-Lite: 单任务成本 0.042 美元;智能指数 25.038Nemotron 3 Ultra: 单任务成本 0.244 美元;智能指数 37.762DeepSeek V4 Pro (high): 单任务成本 0.04 美元;智能指数 43.112Nova 2.0 Lite (high): 单任务成本 0.245 美元;智能指数 18.168NVIDIA Nemotron 3 Super: 单任务成本 0.206 美元;智能指数 25.406Qwen3.6 35B A3B: 单任务成本 0.598 美元;智能指数 24.163Ministral 3 3B: 单任务成本 0.126 美元;智能指数 6.801Qwen3.7 Max: 单任务成本 1.032 美元;智能指数 45.994Gemma 4 26B A4B: 单任务成本 0.029 美元;智能指数 25.695GPT-5.6 Sol (medium): 单任务成本 0.314 美元;智能指数 53.589Magistral Small 1.2: 单任务成本 0.254 美元;智能指数 11.292Ministral 3 14B: 单任务成本 0.149 美元;智能指数 11.053NVIDIA Nemotron 3 Nano: 单任务成本 0.018 美元;智能指数 14.177Grok 4.5 (high): 单任务成本 0.312 美元;智能指数 53.827GPT-5.6 Sol (Non-reasoning): 单任务成本 0.2 美元;智能指数 41.203GPT-5.6 Terra (high): 单任务成本 0.336 美元;智能指数 48.955Magistral Medium 1.2: 单任务成本 0.747 美元;智能指数 17.874Qwen3.6 35B A3B: 单任务成本 0.179 美元;智能指数 31.65GPT-5.6 Luna (xhigh): 单任务成本 0.139 美元;智能指数 49.068GPT-5.6 Sol (high): 单任务成本 0.453 美元;智能指数 55.867Qwen3.6 27B: 单任务成本 0.265 美元;智能指数 37.052Grok 4.3 (Non-reasoning): 单任务成本 0.293 美元;智能指数 24.752Llama 4 Maverick: 单任务成本 0.032 美元;智能指数 14.266Ministral 3 8B: 单任务成本 0.185 美元;智能指数 8.957Llama 3.3 70B: 单任务成本 0.081 美元;智能指数 9.403Claude Opus 4.8 (max): 单任务成本 1.797 美元;智能指数 55.692GPT-5.6 Terra (Non-reasoning): 单任务成本 0.179 美元;智能指数 33.967GPT-5.6 Terra (xhigh): 单任务成本 0.477 美元;智能指数 51.605Phi-4 Mini: 单任务成本 0 美元;智能指数 6.014Nova 2.0 Pro Preview: 单任务成本 0.246 美元;智能指数 14.356Claude 4.5 Haiku: 单任务成本 0.237 美元;智能指数 29.576Qwen3.7 Plus: 单任务成本 0.207 美元;智能指数 38.977GPT-5.6 Luna (high): 单任务成本 0.095 美元;智能指数 46.059Llama 4 Scout: 单任务成本 0.009 美元;智能指数 10.042Hy3: 单任务成本 0 美元;智能指数 41.231Gemini 3.1 Pro Preview: 单任务成本 0.291 美元;智能指数 46.459GPT-5.6 Terra (max): 单任务成本 0.825 美元;智能指数 54.953DeepSeek V4 Pro (max): 单任务成本 0.045 美元;智能指数 44.274GPT-5.5 Instant (June 2026): 单任务成本 0.539 美元;智能指数 28.86Qwen3 Next 80B A3B: 单任务成本 0.169 美元;智能指数 16.72gpt-oss-120b (low): 单任务成本 0.017 美元;智能指数 14.911GPT-5.6 Terra (low): 单任务成本 0.154 美元;智能指数 40.466Claude Fable 5: 单任务成本 2.75 美元;智能指数 59.861Devstral Small 2: 单任务成本 0 美元;智能指数 17.437Gemma 4 31B: 单任务成本 0.034 美元;智能指数 21.769Claude Sonnet 5 (Non-reasoning): 单任务成本 0.375 美元;智能指数 41.731Muse Spark 1.1 (xhigh): 单任务成本 0.261 美元;智能指数 50.623DeepSeek V4 Flash (max): 单任务成本 0.022 美元;智能指数 40.283GPT-5.6 Sol (max): 单任务成本 1.037 美元;智能指数 58.89GPT-5.6 Sol (xhigh): 单任务成本 0.682 美元;智能指数 57.654GPT-5.6 Luna (Non-reasoning): 单任务成本 0.055 美元;智能指数 26.56Mistral Medium 3.5: 单任务成本 0.563 美元;智能指数 29.947Ring-2.6-1T: 单任务成本 0.345 美元;智能指数 30.573Qwen3.5 35B A3B: 单任务成本 0.231 美元;智能指数 23.993gpt-oss-120b (high): 单任务成本 0.061 美元;智能指数 23.831Qwen3.6 Plus: 单任务成本 0.314 美元;智能指数 39.561Nova 2.0 Pro Preview (low): 单任务成本 0.213 美元;智能指数 19.606GLM-5.2 (max): 单任务成本 0.468 美元;智能指数 51.086Kimi K3: 单任务成本 0.954 美元;智能指数 57.112Qwen3 Coder Next: 单任务成本 0.329 美元;智能指数 21.109

TOKEN USE

输出 Token 使用

Token 更多不等于回答更好;它同时影响成本和等待时间。先看同任务下的回答与推理构成。

单次 Intelligence 任务输出 Token
单次 Intelligence 任务输出 Token;公开数据05,070 TokenLlama 4 Scout: 1,249 Token;MetaLlama 4 Scout1,249 TokenLlama 3.3 70B: 1,686 Token;MetaLlama 3.3 70B1,686 TokenGPT-5.6 Sol (Non-reasoning): 2,074 Token;OpenAIGPT-5.6 Sol (Non-reasoning)2,074 TokenLlama 4 Maverick: 2,089 Token;MetaLlama 4 Maverick2,089 TokenGPT-5.6 Luna (Non-reasoning): 2,110 Token;OpenAIGPT-5.6 Luna (Non-reasoning)2,110 TokenGPT-5.6 Terra (Non-reasoning): 2,154 Token;OpenAIGPT-5.6 Terra (Non-reasoning)2,154 TokenGPT-5.6 Terra (low): 2,258 Token;OpenAIGPT-5.6 Terra (low)2,258 TokenGPT-5.6 Luna (low): 2,298 Token;OpenAIGPT-5.6 Luna (low)2,298 Tokengpt-oss-120b (low): 2,475 Token;OpenAIgpt-oss-120b (low)2,475 TokenGPT-5.5 Instant (June 2026): 2,493 Token;OpenAIGPT-5.5 Instant (June 2026)2,493 TokenGPT-5.6 Sol (low): 2,508 Token;OpenAIGPT-5.6 Sol (low)2,508 TokenMistral Large 3: 3,031 Token;MistralMistral Large 33,031 TokenNova 2.0 Pro Preview: 3,631 Token;AmazonNova 2.0 Pro Preview3,631 TokenGPT-5.6 Luna (medium): 3,663 Token;OpenAIGPT-5.6 Luna (medium)3,663 TokenGranite 4.1 30B: 3,709 Token;IBMGranite 4.1 30B3,709 TokenGPT-5.6 Terra (medium): 3,769 Token;OpenAIGPT-5.6 Terra (medium)3,769 TokenGPT-5.6 Sol (medium): 4,203 Token;OpenAIGPT-5.6 Sol (medium)4,203 TokenGemma 4 31B: 4,537 Token;GoogleGemma 4 31B4,537 TokenNova 2.0 Pro Preview (low): 4,915 Token;AmazonNova 2.0 Pro Preview (low)4,915 TokenGranite 4.1 3B: 5,070 Token;IBMGranite 4.1 3B5,070 Token单次 Intelligence 任务输出 Token;公开数据05,070 TokenLlama 4 Scout: 1,249 Token;MetaLlama 4 Scout1,249 TokenLlama 3.3 70B: 1,686 Token;MetaLlama 3.3 70B1,686 TokenGPT-5.6 Sol (Non-reasoning): 2,074 Token;OpenAIGPT-5.6 Sol (Non-…2,074 TokenLlama 4 Maverick: 2,089 Token;MetaLlama 4 Maverick2,089 TokenGPT-5.6 Luna (Non-reasoning): 2,110 Token;OpenAIGPT-5.6 Luna (Non…2,110 TokenGPT-5.6 Terra (Non-reasoning): 2,154 Token;OpenAIGPT-5.6 Terra (No…2,154 TokenGPT-5.6 Terra (low): 2,258 Token;OpenAIGPT-5.6 Terra (lo…2,258 TokenGPT-5.6 Luna (low): 2,298 Token;OpenAIGPT-5.6 Luna (low)2,298 Tokengpt-oss-120b (low): 2,475 Token;OpenAIgpt-oss-120b (low)2,475 TokenGPT-5.5 Instant (June 2026): 2,493 Token;OpenAIGPT-5.5 Instant (…2,493 TokenGPT-5.6 Sol (low): 2,508 Token;OpenAIGPT-5.6 Sol (low)2,508 TokenMistral Large 3: 3,031 Token;MistralMistral Large 33,031 TokenNova 2.0 Pro Preview: 3,631 Token;AmazonNova 2.0 Pro Prev…3,631 TokenGPT-5.6 Luna (medium): 3,663 Token;OpenAIGPT-5.6 Luna (med…3,663 TokenGranite 4.1 30B: 3,709 Token;IBMGranite 4.1 30B3,709 TokenGPT-5.6 Terra (medium): 3,769 Token;OpenAIGPT-5.6 Terra (me…3,769 TokenGPT-5.6 Sol (medium): 4,203 Token;OpenAIGPT-5.6 Sol (medi…4,203 TokenGemma 4 31B: 4,537 Token;GoogleGemma 4 31B4,537 TokenNova 2.0 Pro Preview (low): 4,915 Token;AmazonNova 2.0 Pro Prev…4,915 TokenGranite 4.1 3B: 5,070 Token;IBMGranite 4.1 3B5,070 Token
查看图表数据
项目数值
Llama 4 Scout1,249 Token
Llama 3.3 70B1,686 Token
GPT-5.6 Sol (Non-reasoning)2,074 Token
Llama 4 Maverick2,089 Token
GPT-5.6 Luna (Non-reasoning)2,110 Token
GPT-5.6 Terra (Non-reasoning)2,154 Token
GPT-5.6 Terra (low)2,258 Token
GPT-5.6 Luna (low)2,298 Token
gpt-oss-120b (low)2,475 Token
GPT-5.5 Instant (June 2026)2,493 Token
GPT-5.6 Sol (low)2,508 Token
Mistral Large 33,031 Token
Nova 2.0 Pro Preview3,631 Token
GPT-5.6 Luna (medium)3,663 Token
Granite 4.1 30B3,709 Token
GPT-5.6 Terra (medium)3,769 Token
GPT-5.6 Sol (medium)4,203 Token
Gemma 4 31B4,537 Token
Nova 2.0 Pro Preview (low)4,915 Token
Granite 4.1 3B5,070 Token

PRICE AND COST

价格与评测成本

API 标价、单任务成本和跑完整套评测的成本是三个不同口径,这里分开呈现。

单次 Intelligence 任务成本
单次 Intelligence 任务成本;公开数据01 美元Llama 4 Scout: 0.01 美元;MetaLlama 4 Scout0.01 美元MiMo-V2.5: 0.01 美元;XiaomiMiMo-V2.50.01 美元gpt-oss-120b (low): 0.02 美元;OpenAIgpt-oss-120b (low)0.02 美元gpt-oss-20b (high): 0.02 美元;OpenAIgpt-oss-20b (high)0.02 美元HyperNova 60B 2605: 0.02 美元;Multiverse ComputingHyperNova 60B 26050.02 美元NVIDIA Nemotron 3 Nano: 0.02 美元;NVIDIANVIDIA Nemotron 3 Nano0.02 美元DeepSeek V4 Flash (max): 0.02 美元;DeepSeekDeepSeek V4 Flash (max)0.02 美元Gemma 4 26B A4B: 0.03 美元;GoogleGemma 4 26B A4B0.03 美元MiMo-V2.5-Pro: 0.03 美元;XiaomiMiMo-V2.5-Pro0.03 美元Llama 4 Maverick: 0.03 美元;MetaLlama 4 Maverick0.03 美元Gemma 4 31B: 0.03 美元;GoogleGemma 4 31B0.03 美元GPT-5.6 Luna (low): 0.04 美元;OpenAIGPT-5.6 Luna (low)0.04 美元DeepSeek V4 Pro (high): 0.04 美元;DeepSeekDeepSeek V4 Pro (high)0.04 美元Gemini 3.1 Flash-Lite: 0.04 美元;GoogleGemini 3.1 Flash-Lite0.04 美元DeepSeek V4 Pro (max): 0.04 美元;DeepSeekDeepSeek V4 Pro (max)0.04 美元GPT-5.6 Luna (medium): 0.05 美元;OpenAIGPT-5.6 Luna (medium)0.05 美元GPT-5.6 Luna (Non-reasoning): 0.05 美元;OpenAIGPT-5.6 Luna (Non-reasoning)0.05 美元Mistral Large 3: 0.06 美元;MistralMistral Large 30.06 美元gpt-oss-120b (high): 0.06 美元;OpenAIgpt-oss-120b (high)0.06 美元Mercury 2: 0.07 美元;InceptionMercury 20.07 美元单次 Intelligence 任务成本;公开数据01 美元Llama 4 Scout: 0.01 美元;MetaLlama 4 Scout0.01 美元MiMo-V2.5: 0.01 美元;XiaomiMiMo-V2.50.01 美元gpt-oss-120b (low): 0.02 美元;OpenAIgpt-oss-120b (low)0.02 美元gpt-oss-20b (high): 0.02 美元;OpenAIgpt-oss-20b (high)0.02 美元HyperNova 60B 2605: 0.02 美元;Multiverse ComputingHyperNova 60B 26050.02 美元NVIDIA Nemotron 3 Nano: 0.02 美元;NVIDIANVIDIA Nemotron 3…0.02 美元DeepSeek V4 Flash (max): 0.02 美元;DeepSeekDeepSeek V4 Flash…0.02 美元Gemma 4 26B A4B: 0.03 美元;GoogleGemma 4 26B A4B0.03 美元MiMo-V2.5-Pro: 0.03 美元;XiaomiMiMo-V2.5-Pro0.03 美元Llama 4 Maverick: 0.03 美元;MetaLlama 4 Maverick0.03 美元Gemma 4 31B: 0.03 美元;GoogleGemma 4 31B0.03 美元GPT-5.6 Luna (low): 0.04 美元;OpenAIGPT-5.6 Luna (low)0.04 美元DeepSeek V4 Pro (high): 0.04 美元;DeepSeekDeepSeek V4 Pro (…0.04 美元Gemini 3.1 Flash-Lite: 0.04 美元;GoogleGemini 3.1 Flash-…0.04 美元DeepSeek V4 Pro (max): 0.04 美元;DeepSeekDeepSeek V4 Pro (…0.04 美元GPT-5.6 Luna (medium): 0.05 美元;OpenAIGPT-5.6 Luna (med…0.05 美元GPT-5.6 Luna (Non-reasoning): 0.05 美元;OpenAIGPT-5.6 Luna (Non…0.05 美元Mistral Large 3: 0.06 美元;MistralMistral Large 30.06 美元gpt-oss-120b (high): 0.06 美元;OpenAIgpt-oss-120b (hig…0.06 美元Mercury 2: 0.07 美元;InceptionMercury 20.07 美元
查看图表数据
项目数值
Llama 4 Scout0.01 美元
MiMo-V2.50.01 美元
gpt-oss-120b (low)0.02 美元
gpt-oss-20b (high)0.02 美元
HyperNova 60B 26050.02 美元
NVIDIA Nemotron 3 Nano0.02 美元
DeepSeek V4 Flash (max)0.02 美元
Gemma 4 26B A4B0.03 美元
MiMo-V2.5-Pro0.03 美元
Llama 4 Maverick0.03 美元
Gemma 4 31B0.03 美元
GPT-5.6 Luna (low)0.04 美元
DeepSeek V4 Pro (high)0.04 美元
Gemini 3.1 Flash-Lite0.04 美元
DeepSeek V4 Pro (max)0.04 美元
GPT-5.6 Luna (medium)0.05 美元
GPT-5.6 Luna (Non-reasoning)0.05 美元
Mistral Large 30.06 美元
gpt-oss-120b (high)0.06 美元
Mercury 20.07 美元

CONTEXT WINDOW

上下文窗口

上下文窗口表示单次请求可处理的最大 Token 数,不代表模型一定能在全窗口内保持同等检索质量。

上下文窗口对比
上下文窗口对比;公开数据010,000,000 TokenLlama 4 Scout: 10,000,000 Token;MetaLlama 4 Scout10,000,000 TokenMuse Spark 1.1 (xhigh): 1,048,576 Token;MetaMuse Spark 1.1 (xhigh)1,048,576 TokenKimi K3: 1,048,576 Token;KimiKimi K31,048,576 TokenGemini 3.5 Flash: 1,000,000 Token;GoogleGemini 3.5 Flash1,000,000 TokenMiMo-V2.5-Pro: 1,000,000 Token;XiaomiMiMo-V2.5-Pro1,000,000 TokenNova 2.0 Omni (medium): 1,000,000 Token;AmazonNova 2.0 Omni (medium)1,000,000 TokenGemini 3.5 Flash (minimal): 1,000,000 Token;GoogleGemini 3.5 Flash (minimal)1,000,000 TokenGPT-5.6 Luna (low): 1,000,000 Token;OpenAIGPT-5.6 Luna (low)1,000,000 TokenGPT-5.6 Sol (low): 1,000,000 Token;OpenAIGPT-5.6 Sol (low)1,000,000 TokenInkling: 1,000,000 Token;Thinking MachinesInkling1,000,000 TokenClaude Sonnet 5 (low): 1,000,000 Token;AnthropicClaude Sonnet 5 (low)1,000,000 TokenNova 2.0 Omni: 1,000,000 Token;AmazonNova 2.0 Omni1,000,000 TokenMiMo-V2.5: 1,000,000 Token;XiaomiMiMo-V2.51,000,000 TokenNVIDIA Nemotron 3 Nano: 1,000,000 Token;NVIDIANVIDIA Nemotron 3 Nano1,000,000 TokenClaude Sonnet 5 (max): 1,000,000 Token;AnthropicClaude Sonnet 5 (max)1,000,000 TokenGPT-5.6 Terra (medium): 1,000,000 Token;OpenAIGPT-5.6 Terra (medium)1,000,000 TokenGemini 2.5 Pro: 1,000,000 Token;GoogleGemini 2.5 Pro1,000,000 TokenMiniMax-M3: 1,000,000 Token;MiniMaxMiniMax-M31,000,000 TokenClaude Opus 4.7 (Non-reasoning, high): 1,000,000 Token;AnthropicClaude Opus 4.7 (Non-reasonin…1,000,000 TokenGPT-5.6 Luna (max): 1,000,000 Token;OpenAIGPT-5.6 Luna (max)1,000,000 Token上下文窗口对比;公开数据010,000,000 TokenLlama 4 Scout: 10,000,000 Token;MetaLlama 4 Scout10,000,000 TokenMuse Spark 1.1 (xhigh): 1,048,576 Token;MetaMuse Spark 1.1 (x…1,048,576 TokenKimi K3: 1,048,576 Token;KimiKimi K31,048,576 TokenGemini 3.5 Flash: 1,000,000 Token;GoogleGemini 3.5 Flash1,000,000 TokenMiMo-V2.5-Pro: 1,000,000 Token;XiaomiMiMo-V2.5-Pro1,000,000 TokenNova 2.0 Omni (medium): 1,000,000 Token;AmazonNova 2.0 Omni (me…1,000,000 TokenGemini 3.5 Flash (minimal): 1,000,000 Token;GoogleGemini 3.5 Flash …1,000,000 TokenGPT-5.6 Luna (low): 1,000,000 Token;OpenAIGPT-5.6 Luna (low)1,000,000 TokenGPT-5.6 Sol (low): 1,000,000 Token;OpenAIGPT-5.6 Sol (low)1,000,000 TokenInkling: 1,000,000 Token;Thinking MachinesInkling1,000,000 TokenClaude Sonnet 5 (low): 1,000,000 Token;AnthropicClaude Sonnet 5 (…1,000,000 TokenNova 2.0 Omni: 1,000,000 Token;AmazonNova 2.0 Omni1,000,000 TokenMiMo-V2.5: 1,000,000 Token;XiaomiMiMo-V2.51,000,000 TokenNVIDIA Nemotron 3 Nano: 1,000,000 Token;NVIDIANVIDIA Nemotron 3…1,000,000 TokenClaude Sonnet 5 (max): 1,000,000 Token;AnthropicClaude Sonnet 5 (…1,000,000 TokenGPT-5.6 Terra (medium): 1,000,000 Token;OpenAIGPT-5.6 Terra (me…1,000,000 TokenGemini 2.5 Pro: 1,000,000 Token;GoogleGemini 2.5 Pro1,000,000 TokenMiniMax-M3: 1,000,000 Token;MiniMaxMiniMax-M31,000,000 TokenClaude Opus 4.7 (Non-reasoning, high): 1,000,000 Token;AnthropicClaude Opus 4.7 (…1,000,000 TokenGPT-5.6 Luna (max): 1,000,000 Token;OpenAIGPT-5.6 Luna (max)1,000,000 Token
查看图表数据
项目数值
Llama 4 Scout10,000,000 Token
Muse Spark 1.1 (xhigh)1,048,576 Token
Kimi K31,048,576 Token
Gemini 3.5 Flash1,000,000 Token
MiMo-V2.5-Pro1,000,000 Token
Nova 2.0 Omni (medium)1,000,000 Token
Gemini 3.5 Flash (minimal)1,000,000 Token
GPT-5.6 Luna (low)1,000,000 Token
GPT-5.6 Sol (low)1,000,000 Token
Inkling1,000,000 Token
Claude Sonnet 5 (low)1,000,000 Token
Nova 2.0 Omni1,000,000 Token
MiMo-V2.51,000,000 Token
NVIDIA Nemotron 3 Nano1,000,000 Token
Claude Sonnet 5 (max)1,000,000 Token
GPT-5.6 Terra (medium)1,000,000 Token
Gemini 2.5 Pro1,000,000 Token
MiniMax-M31,000,000 Token
Claude Opus 4.7 (Non-reasoning, high)1,000,000 Token
GPT-5.6 Luna (max)1,000,000 Token

OUTPUT SPEED

回答生成速度

模型开始输出后每秒生成的 Token;不包含开始回答前的等待时间。

输出速度对比
输出速度对比;公开数据01,039.3 Token/sMercury 2: 1,039.3 Token/s;InceptionMercury 21,039.3 Token/sLFM2.5-VL-1.6B: 418 Token/s;Liquid AILFM2.5-VL-1.6B418 Token/sStep 3.7 Flash: 406.5 Token/s;StepFunStep 3.7 Flash406.5 Token/sGranite 4.0 H Small: 403.8 Token/s;IBMGranite 4.0 H Small403.8 Token/sHyperNova 60B 2605: 370.2 Token/s;Multiverse ComputingHyperNova 60B 2605370.2 Token/sLFM2.5-8B-A1B: 337 Token/s;Liquid AILFM2.5-8B-A1B337 Token/sGemini 3.1 Flash-Lite: 335.3 Token/s;GoogleGemini 3.1 Flash-Lite335.3 Token/sgpt-oss-120b (low): 332.2 Token/s;OpenAIgpt-oss-120b (low)332.2 Token/sNemotron 3 Nano Omni 30B A3B Reasoning: 317.6 Token/s;NVIDIANemotron 3 Nano Omni 30B A3B …317.6 Token/sgpt-oss-120b (high): 311.6 Token/s;OpenAIgpt-oss-120b (high)311.6 Token/sStep 3.5 Flash 2603: 297.5 Token/s;StepFunStep 3.5 Flash 2603297.5 Token/sNova Micro: 293.1 Token/s;AmazonNova Micro293.1 Token/sQwen3.5 Omni Flash: 247.5 Token/s;AlibabaQwen3.5 Omni Flash247.5 Token/sNVIDIA Nemotron 3 Super: 245.5 Token/s;NVIDIANVIDIA Nemotron 3 Super245.5 Token/sgpt-oss-20b (low): 244.7 Token/s;OpenAIgpt-oss-20b (low)244.7 Token/sgpt-oss-20b (high): 224.7 Token/s;OpenAIgpt-oss-20b (high)224.7 Token/sNemotron 3 Ultra: 209.2 Token/s;NVIDIANemotron 3 Ultra209.2 Token/sTrinity Large Thinking: 207.2 Token/s;Arcee AITrinity Large Thinking207.2 Token/sQwen3.7 Max: 203.7 Token/s;AlibabaQwen3.7 Max203.7 Token/sGPT-5.6 Luna (Non-reasoning): 202.9 Token/s;OpenAIGPT-5.6 Luna (Non-reasoning)202.9 Token/s输出速度对比;公开数据01,039.3 Token/sMercury 2: 1,039.3 Token/s;InceptionMercury 21,039.3 Token/sLFM2.5-VL-1.6B: 418 Token/s;Liquid AILFM2.5-VL-1.6B418 Token/sStep 3.7 Flash: 406.5 Token/s;StepFunStep 3.7 Flash406.5 Token/sGranite 4.0 H Small: 403.8 Token/s;IBMGranite 4.0 H Sma…403.8 Token/sHyperNova 60B 2605: 370.2 Token/s;Multiverse ComputingHyperNova 60B 2605370.2 Token/sLFM2.5-8B-A1B: 337 Token/s;Liquid AILFM2.5-8B-A1B337 Token/sGemini 3.1 Flash-Lite: 335.3 Token/s;GoogleGemini 3.1 Flash-…335.3 Token/sgpt-oss-120b (low): 332.2 Token/s;OpenAIgpt-oss-120b (low)332.2 Token/sNemotron 3 Nano Omni 30B A3B Reasoning: 317.6 Token/s;NVIDIANemotron 3 Nano O…317.6 Token/sgpt-oss-120b (high): 311.6 Token/s;OpenAIgpt-oss-120b (hig…311.6 Token/sStep 3.5 Flash 2603: 297.5 Token/s;StepFunStep 3.5 Flash 26…297.5 Token/sNova Micro: 293.1 Token/s;AmazonNova Micro293.1 Token/sQwen3.5 Omni Flash: 247.5 Token/s;AlibabaQwen3.5 Omni Flash247.5 Token/sNVIDIA Nemotron 3 Super: 245.5 Token/s;NVIDIANVIDIA Nemotron 3…245.5 Token/sgpt-oss-20b (low): 244.7 Token/s;OpenAIgpt-oss-20b (low)244.7 Token/sgpt-oss-20b (high): 224.7 Token/s;OpenAIgpt-oss-20b (high)224.7 Token/sNemotron 3 Ultra: 209.2 Token/s;NVIDIANemotron 3 Ultra209.2 Token/sTrinity Large Thinking: 207.2 Token/s;Arcee AITrinity Large Thi…207.2 Token/sQwen3.7 Max: 203.7 Token/s;AlibabaQwen3.7 Max203.7 Token/sGPT-5.6 Luna (Non-reasoning): 202.9 Token/s;OpenAIGPT-5.6 Luna (Non…202.9 Token/s
查看图表数据
项目数值
Mercury 21,039.3 Token/s
LFM2.5-VL-1.6B418 Token/s
Step 3.7 Flash406.5 Token/s
Granite 4.0 H Small403.8 Token/s
HyperNova 60B 2605370.2 Token/s
LFM2.5-8B-A1B337 Token/s
Gemini 3.1 Flash-Lite335.3 Token/s
gpt-oss-120b (low)332.2 Token/s
Nemotron 3 Nano Omni 30B A3B Reasoning317.6 Token/s
gpt-oss-120b (high)311.6 Token/s
Step 3.5 Flash 2603297.5 Token/s
Nova Micro293.1 Token/s
Qwen3.5 Omni Flash247.5 Token/s
NVIDIA Nemotron 3 Super245.5 Token/s
gpt-oss-20b (low)244.7 Token/s
gpt-oss-20b (high)224.7 Token/s
Nemotron 3 Ultra209.2 Token/s
Trinity Large Thinking207.2 Token/s
Qwen3.7 Max203.7 Token/s
GPT-5.6 Luna (Non-reasoning)202.9 Token/s
单次 Intelligence 任务耗时
单次 Intelligence 任务耗时;公开数据060.6 秒gpt-oss-120b (low): 7.4 秒;OpenAIgpt-oss-120b (low)7.4 秒GPT-5.6 Luna (Non-reasoning): 10.4 秒;OpenAIGPT-5.6 Luna (Non-reasoning)10.4 秒GPT-5.6 Luna (low): 11.7 秒;OpenAIGPT-5.6 Luna (low)11.7 秒Llama 4 Scout: 15.1 秒;MetaLlama 4 Scout15.1 秒GPT-5.6 Terra (Non-reasoning): 17 秒;OpenAIGPT-5.6 Terra (Non-reasoning)17 秒GPT-5.6 Terra (low): 17.4 秒;OpenAIGPT-5.6 Terra (low)17.4 秒GPT-5.6 Luna (medium): 18.9 秒;OpenAIGPT-5.6 Luna (medium)18.9 秒Llama 4 Maverick: 18.9 秒;MetaLlama 4 Maverick18.9 秒Llama 3.3 70B: 19.5 秒;MetaLlama 3.3 70B19.5 秒Mercury 2: 26.7 秒;InceptionMercury 226.7 秒GPT-5.6 Terra (medium): 29.4 秒;OpenAIGPT-5.6 Terra (medium)29.4 秒Nova 2.0 Pro Preview: 34 秒;AmazonNova 2.0 Pro Preview34 秒GPT-5.6 Sol (Non-reasoning): 36 秒;OpenAIGPT-5.6 Sol (Non-reasoning)36 秒Nova 2.0 Pro Preview (low): 37.8 秒;AmazonNova 2.0 Pro Preview (low)37.8 秒GPT-5.6 Luna (high): 42 秒;OpenAIGPT-5.6 Luna (high)42 秒GPT-5.6 Sol (low): 44.9 秒;OpenAIGPT-5.6 Sol (low)44.9 秒Mistral Large 3: 57.3 秒;MistralMistral Large 357.3 秒Qwen3.5 122B A10B: 57.9 秒;AlibabaQwen3.5 122B A10B57.9 秒GPT-5.6 Terra (high): 59.6 秒;OpenAIGPT-5.6 Terra (high)59.6 秒Gemini 3.1 Flash-Lite: 60.6 秒;GoogleGemini 3.1 Flash-Lite60.6 秒单次 Intelligence 任务耗时;公开数据060.6 秒gpt-oss-120b (low): 7.4 秒;OpenAIgpt-oss-120b (low)7.4 秒GPT-5.6 Luna (Non-reasoning): 10.4 秒;OpenAIGPT-5.6 Luna (Non…10.4 秒GPT-5.6 Luna (low): 11.7 秒;OpenAIGPT-5.6 Luna (low)11.7 秒Llama 4 Scout: 15.1 秒;MetaLlama 4 Scout15.1 秒GPT-5.6 Terra (Non-reasoning): 17 秒;OpenAIGPT-5.6 Terra (No…17 秒GPT-5.6 Terra (low): 17.4 秒;OpenAIGPT-5.6 Terra (lo…17.4 秒GPT-5.6 Luna (medium): 18.9 秒;OpenAIGPT-5.6 Luna (med…18.9 秒Llama 4 Maverick: 18.9 秒;MetaLlama 4 Maverick18.9 秒Llama 3.3 70B: 19.5 秒;MetaLlama 3.3 70B19.5 秒Mercury 2: 26.7 秒;InceptionMercury 226.7 秒GPT-5.6 Terra (medium): 29.4 秒;OpenAIGPT-5.6 Terra (me…29.4 秒Nova 2.0 Pro Preview: 34 秒;AmazonNova 2.0 Pro Prev…34 秒GPT-5.6 Sol (Non-reasoning): 36 秒;OpenAIGPT-5.6 Sol (Non-…36 秒Nova 2.0 Pro Preview (low): 37.8 秒;AmazonNova 2.0 Pro Prev…37.8 秒GPT-5.6 Luna (high): 42 秒;OpenAIGPT-5.6 Luna (hig…42 秒GPT-5.6 Sol (low): 44.9 秒;OpenAIGPT-5.6 Sol (low)44.9 秒Mistral Large 3: 57.3 秒;MistralMistral Large 357.3 秒Qwen3.5 122B A10B: 57.9 秒;AlibabaQwen3.5 122B A10B57.9 秒GPT-5.6 Terra (high): 59.6 秒;OpenAIGPT-5.6 Terra (hi…59.6 秒Gemini 3.1 Flash-Lite: 60.6 秒;GoogleGemini 3.1 Flash-…60.6 秒
查看图表数据
项目数值
gpt-oss-120b (low)7.4 秒
GPT-5.6 Luna (Non-reasoning)10.4 秒
GPT-5.6 Luna (low)11.7 秒
Llama 4 Scout15.1 秒
GPT-5.6 Terra (Non-reasoning)17 秒
GPT-5.6 Terra (low)17.4 秒
GPT-5.6 Luna (medium)18.9 秒
Llama 4 Maverick18.9 秒
Llama 3.3 70B19.5 秒
Mercury 226.7 秒
GPT-5.6 Terra (medium)29.4 秒
Nova 2.0 Pro Preview34 秒
GPT-5.6 Sol (Non-reasoning)36 秒
Nova 2.0 Pro Preview (low)37.8 秒
GPT-5.6 Luna (high)42 秒
GPT-5.6 Sol (low)44.9 秒
Mistral Large 357.3 秒
Qwen3.5 122B A10B57.9 秒
GPT-5.6 Terra (high)59.6 秒
Gemini 3.1 Flash-Lite60.6 秒

LATENCY

首个回答 Token 等待

推理模型的等待时间可能包含内部推理;低延迟更适合实时交互。

首个回答 Token:输入处理与推理等待
输入处理推理等待
首个回答 Token:输入处理与推理等待Phi-4 Multimodal: 0.6 秒Phi-4 Multimodal0.6 秒Ministral 3 3B: 0.6 秒Ministral 3 3B0.6 秒GPT-5.6 Luna (Non-reasoning): 0.6 秒GPT-5.6 Luna (Non-reasoning)0.6 秒GPT-5.6 Terra (Non-reasoning): 0.7 秒GPT-5.6 Terra (Non-reasoning)0.7 秒Ministral 3 8B: 0.7 秒Ministral 3 8B0.7 秒Granite 4.1 8B: 0.8 秒Granite 4.1 8B0.8 秒Mistral Small 4: 0.8 秒Mistral Small 40.8 秒Llama 4 Scout: 0.8 秒Llama 4 Scout0.8 秒Phi-4 Mini: 0.8 秒Phi-4 Mini0.8 秒首个回答 Token:输入处理与推理等待Phi-4 Multimodal: 0.6 秒Phi-4 Multimodal0.6 秒Ministral 3 3B: 0.6 秒Ministral 3 3B0.6 秒GPT-5.6 Luna (Non-reasoning): 0.6 秒GPT-5.6 Luna (Non…0.6 秒GPT-5.6 Terra (Non-reasoning): 0.7 秒GPT-5.6 Terra (No…0.7 秒Ministral 3 8B: 0.7 秒Ministral 3 8B0.7 秒Granite 4.1 8B: 0.8 秒Granite 4.1 8B0.8 秒Mistral Small 4: 0.8 秒Mistral Small 40.8 秒Llama 4 Scout: 0.8 秒Llama 4 Scout0.8 秒Phi-4 Mini: 0.8 秒Phi-4 Mini0.8 秒
查看图表数据
项目合计输入处理推理等待
Phi-4 Multimodal0.6 秒0.6 秒0 秒
Ministral 3 3B0.6 秒0.6 秒0 秒
GPT-5.6 Luna (Non-reasoning)0.6 秒0.6 秒0 秒
GPT-5.6 Terra (Non-reasoning)0.7 秒0.7 秒0 秒
Ministral 3 8B0.7 秒0.7 秒0 秒
Granite 4.1 8B0.8 秒0.8 秒0 秒
Mistral Small 40.8 秒0.8 秒0 秒
Llama 4 Scout0.8 秒0.8 秒0 秒
Phi-4 Mini0.8 秒0.8 秒0 秒

END-TO-END RESPONSE TIME

端到端响应时间

按收到 500 个输出 Token 计算,合计输入处理、推理和文本生成时间。

输出 500 Token 的完整响应时间
输入处理推理生成 500 Token
输出 500 Token 的完整响应时间Nova Micro: 2.6 秒Nova Micro2.6 秒GPT-5.6 Luna (Non-reasoning): 3.1 秒GPT-5.6 Luna (Non-reasoning)3.1 秒Ministral 3 3B: 3.6 秒Ministral 3 3B3.6 秒NVIDIA Nemotron Nano 12B v2 VL: 3.7 秒NVIDIA Nemotron Nano 12B v2 VL3.7 秒GPT-5.6 Luna (low): 3.7 秒GPT-5.6 Luna (low)3.7 秒Gemini 3.5 Flash (minimal): 3.8 秒Gemini 3.5 Flash (minimal)3.8 秒Qwen3.5 Omni Flash: 3.8 秒Qwen3.5 Omni Flash3.8 秒Ling 2.6 Flash: 3.9 秒Ling 2.6 Flash3.9 秒Mistral Small 4: 4 秒Mistral Small 44 秒输出 500 Token 的完整响应时间Nova Micro: 2.6 秒Nova Micro2.6 秒GPT-5.6 Luna (Non-reasoning): 3.1 秒GPT-5.6 Luna (Non…3.1 秒Ministral 3 3B: 3.6 秒Ministral 3 3B3.6 秒NVIDIA Nemotron Nano 12B v2 VL: 3.7 秒NVIDIA Nemotron N…3.7 秒GPT-5.6 Luna (low): 3.7 秒GPT-5.6 Luna (low)3.7 秒Gemini 3.5 Flash (minimal): 3.8 秒Gemini 3.5 Flash …3.8 秒Qwen3.5 Omni Flash: 3.8 秒Qwen3.5 Omni Flash3.8 秒Ling 2.6 Flash: 3.9 秒Ling 2.6 Flash3.9 秒Mistral Small 4: 4 秒Mistral Small 44 秒
查看图表数据
项目合计输入处理推理生成 500 Token
Nova Micro2.6 秒0.9 秒0 秒1.7 秒
GPT-5.6 Luna (Non-reasoning)3.1 秒0.6 秒0 秒2.5 秒
Ministral 3 3B3.6 秒0.6 秒0 秒3 秒
NVIDIA Nemotron Nano 12B v2 VL3.7 秒1.2 秒0 秒2.5 秒
GPT-5.6 Luna (low)3.7 秒1.2 秒0 秒2.5 秒
Gemini 3.5 Flash (minimal)3.8 秒0.9 秒0 秒2.9 秒
Qwen3.5 Omni Flash3.8 秒1.8 秒0 秒2 秒
Ling 2.6 Flash3.9 秒1.1 秒0 秒2.8 秒
Mistral Small 44 秒0.8 秒0 秒3.2 秒

CAPABILITY INDICES

专业能力指数

不同专题由不同评测组合形成,适合在相同专题内比较,不应跨专题直接比较。

Gemini 2.0 Flash Thinking exp. (Jan) 的专业能力成绩
专题能力指数单任务成本任务耗时输出 Token
编码24.1825

FAQ

常见问题

以下回答均由本页公开结构化数据生成,便于搜索引擎和 AI 系统理解明确事实。

Gemini 2.0 Flash Thinking exp. (Jan) 由谁开发?

Gemini 2.0 Flash Thinking exp. (Jan) 由 Google 开发,发布日期为 2025-01-21。

Gemini 2.0 Flash Thinking exp. (Jan) 的智能指数是多少?

当前公开 Intelligence Index 为 13.3,该数值为估算值。

Gemini 2.0 Flash Thinking exp. (Jan) 的生成速度是多少?

公开性能数据为 暂无数据 Token/s,来源为 Provider 中位数。

Gemini 2.0 Flash Thinking exp. (Jan) 的 API 价格是多少?

每 1M Token 的输入价格为 暂无数据,输出价格为 暂无数据。

Gemini 2.0 Flash Thinking exp. (Jan) 的上下文窗口是多少?

上下文窗口为 1,000,000 Token。

Gemini 2.0 Flash Thinking exp. (Jan) 是开放权重模型吗?

不是,模型权重未公开。

Gemini 2.0 Flash Thinking exp. (Jan) 可以通过哪些 Provider 使用?

原站记录了 0 家 Provider。Provider 明细尚未同步。