Providers

API Provider 性能

同一个模型由不同 API 服务商提供时,生成速度、价格和稳定性仍可能相差数倍。

数据快照:2026-07-21查看原始来源 ↗
比较模型

gpt-oss-120b;避免把不同模型的速度差误算到 Provider。

生成速度

开始返回后每秒生成的 Token 数,数值越高越快。

时间窗口

来源指标会随近期开通区域、负载和服务配置变化。

gpt-oss-120b(high)API Provider 完整比较
Provider上下文函数调用JSON许可单任务成本生成速度首块延迟完整响应推理耗时
Groq131k支持支持OpenUS$0.05479 Token/s0.71 秒5.92 秒4.17 秒
Scaleway128k支持支持OpenUS$0.07173 Token/s1.19 秒15.6 秒11.53 秒
Cloudflare116k支持支持Open116 Token/s1.03 秒22.6 秒17.25 秒
DeepInfra131k支持支持OpenUS$0.0249 Token/s0.63 秒51.81 秒40.94 秒
Microsoft Azure131k支持支持OpenUS$0.06349 Token/s0.68 秒7.85 秒5.73 秒
CoreWeave131k支持支持Open86 Token/s1.39 秒30.45 秒23.24 秒
DeepInfra (Turbo)131k支持支持Open347 Token/s0.58 秒7.78 秒5.76 秒
Makora128kOpen133 Token/s0.93 秒19.76 秒15.07 秒
Cerebras131k支持支持OpenUS$0.121,938 Token/s0.51 秒1.8 秒1.03 秒
Google Vertex131k支持支持Open399 Token/s0.41 秒6.68 秒5.01 秒
Clarifai131k支持支持Open
Baseten128k支持支持OpenUS$0.04320 Token/s0.3 秒8.11 秒6.25 秒
SambaNova131k支持支持Open700 Token/s0.95 秒4.52 秒2.86 秒
Parasail131k支持支持Open185 Token/s0.81 秒14.36 秒10.84 秒
CompactifAI131kOpenUS$0.02
Fireworks131k支持支持Open707 Token/s2.46 秒6 秒2.83 秒
Nebius128k支持支持Open308 Token/s1.02 秒9.14 秒6.5 秒
Hyperbolic131k支持Open
Databricks128k支持支持OpenUS$0.06335 Token/s0.66 秒8.11 秒5.96 秒
Amazon Bedrock131k支持支持OpenUS$0.06116 Token/s1.13 秒22.66 秒17.22 秒
Together AI131k支持支持Open579 Token/s0.6 秒4.92 秒3.45 秒
Novita131k支持支持OpenUS$0.02111 Token/s0.85 秒23.4 秒18.04 秒