MODEL PROVIDERS
Claude Fable 5 API Provider 比较
比较 Claude Fable 5 在 3 家 API Provider 上的价格、任务成本、输出速度、延迟和端到端响应。数据来自公开实测,不修改原始数值。
怎样读这页
同一个模型经不同 Provider 托管时,模型能力通常不变,但价格、限流、输出速度和首字延迟会不同。实时聊天优先看延迟,批处理优先看成本与吞吐,长上下文任务还要单独看对应提示类型。
本页的“输出速度”指开始生成后的 Token/s;“首个回答 Token”指从请求到可见回答的等待;“端到端响应”按输出 500 Token 计算,三者不是同一指标。
API PRICE
Provider API 价格
混合价按 7:2:1 的缓存读取、输入和输出 Token 比例计算,便于同口径比较。
查看图表数据
| 项目 | 数值 |
|---|---|
| Anthropic | 7.7 美元 |
| 7.7 美元 | |
| Azure | 14 美元 |
COST PER TASK
单次 Intelligence 任务成本
该值来自统一公开任务集的实际 Token 使用,不等于简单的 API 输入标价。
查看图表数据
| 项目 | 数值 |
|---|---|
| Anthropic | 2.75 美元 |
| 2.9 美元 | |
| Azure | 7.96 美元 |
SPEED VS PRICE
速度与价格的权衡
更靠左代表价格更低,更靠上代表输出更快;高亮点为当前输出最快 Provider。
Anthropic:API 混合价 / 1M Token 7.7 美元,输出速度 68.297 Token/s
OUTPUT SPEED
回答生成速度
中位输出速度之外,同时在图表说明中保留 P05–P95 范围,避免只看单点。
查看图表数据
| 项目 | 数值 |
|---|---|
| Anthropic | 68.3 Token/s |
| Azure | 67.7 Token/s |
| 67.2 Token/s |
LATENCY
首个回答 Token 等待
数值越低越适合实时交互;P05–P95 能反映请求抖动。
查看图表数据
| 项目 | 数值 |
|---|---|
| 85.9 秒 | |
| Anthropic | 111.3 秒 |
| Azure | 116.2 秒 |
END-TO-END RESPONSE
端到端响应时间
按 500 个输出 Token 计算,拆分输入处理、内部推理和文本生成。
查看图表数据
| 项目 | 合计 | 输入处理 | 推理 | 生成 500 Token |
|---|---|---|---|---|
| 93.3 秒 | 85.9 秒 | 0 秒 | 7.4 秒 | |
| Anthropic | 118.6 秒 | 111.3 秒 | 0 秒 | 7.3 秒 |
| Azure | 123.6 秒 | 116.2 秒 | 0 秒 | 7.4 秒 |
PROMPT TYPES
不同任务类型下的表现
中等文本、长文本、编码、视觉、并行与 100K 上下文的数据分开呈现,避免用单一中位数替代真实场景。
查看图表数据
| 项目 | 数值 |
|---|---|
| 中等文本 · Anthropic | 69.5 Token/s |
| 中等文本 · Google | 74.2 Token/s |
| 中等文本 · Azure | 70 Token/s |
| 长文本 · Anthropic | 68.3 Token/s |
| 长文本 · Google | 67.2 Token/s |
| 长文本 · Azure | 67.7 Token/s |
| 中等编码 · Anthropic | 71.9 Token/s |
| 中等编码 · Google | 71.6 Token/s |
| 中等编码 · Azure | 75.9 Token/s |
| 单图视觉 · Anthropic | 40 Token/s |
| 单图视觉 · Google | 38.6 Token/s |
| 单图视觉 · Azure | 38.9 Token/s |
| 并行请求 · Anthropic | 73.5 Token/s |
| 并行请求 · Google | 75.6 Token/s |
| 并行请求 · Azure | 75.8 Token/s |
| 100K 上下文 · Google | 64.5 Token/s |
查看图表数据
| 项目 | 数值 |
|---|---|
| 中等文本 · Anthropic | 58.3 秒 |
| 中等文本 · Google | 72.5 秒 |
| 中等文本 · Azure | 60.1 秒 |
| 长文本 · Anthropic | 111.3 秒 |
| 长文本 · Google | 85.9 秒 |
| 长文本 · Azure | 116.2 秒 |
| 中等编码 · Anthropic | 41.7 秒 |
| 中等编码 · Google | 42.6 秒 |
| 中等编码 · Azure | 43.4 秒 |
| 单图视觉 · Anthropic | 11.4 秒 |
| 单图视觉 · Google | 10.7 秒 |
| 单图视觉 · Azure | 10.4 秒 |
| 并行请求 · Anthropic | 73.4 秒 |
| 并行请求 · Google | 72.1 秒 |
| 并行请求 · Azure | 89.4 秒 |
| 100K 上下文 · Google | 213.4 秒 |
查看图表数据
| 项目 | 数值 |
|---|---|
| 中等文本 · Anthropic | 65.5 秒 |
| 中等文本 · Google | 79.2 秒 |
| 中等文本 · Azure | 67.2 秒 |
| 长文本 · Anthropic | 118.6 秒 |
| 长文本 · Google | 93.3 秒 |
| 长文本 · Azure | 123.6 秒 |
| 中等编码 · Anthropic | 48.6 秒 |
| 中等编码 · Google | 49.5 秒 |
| 中等编码 · Azure | 50 秒 |
| 单图视觉 · Anthropic | 23.9 秒 |
| 单图视觉 · Google | 23.7 秒 |
| 单图视觉 · Azure | 23.2 秒 |
| 并行请求 · Anthropic | 80.2 秒 |
| 并行请求 · Google | 78.7 秒 |
| 并行请求 · Azure | 96 秒 |
| 100K 上下文 · Google | 221.2 秒 |
FULL DATA
Provider 完整对照表
图表用于观察关系,表格保留精确数值,便于检索、引用和 AI 系统读取。
| Provider | 输入 / 1M | 输出 / 1M | 缓存命中 / 1M | 7:2:1 混合价 | 单任务成本 | 输出速度 | 速度 P05–P95 | 首 Token | 延迟 P05–P95 | 端到端 | 上下文 | 函数调用 | OpenAI 兼容 |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Anthropic ↗ | $10.00 | $50.00 | $1.00 | $7.70 | $2.75 | 68.3 Token/s | 44.8–87.4 | 111.3 秒 | 41.3–279.2 秒 | 118.6 秒 | 1,000,000 | 支持 | 支持 |
| Google ↗ | $10.00 | $50.00 | $1.00 | $7.70 | $2.90 | 67.2 Token/s | 45.5–86.6 | 85.9 秒 | 43.8–237.7 秒 | 93.3 秒 | 1,000,000 | 支持 | 支持 |
| Microsoft Azure ↗ | $10.00 | $50.00 | — | $14.00 | $7.96 | 67.7 Token/s | 50.8–86.5 | 116.2 秒 | 34.0–315.4 秒 | 123.6 秒 | 1,000,000 | 支持 | 支持 |
FAQ
常见问题
回答由本页结构化公开数据生成。
Claude Fable 5 有哪些 API Provider?
当前公开数据包含 Anthropic、Google、Azure,共 3 家。
哪家 Provider 输出最快?
Anthropic 的中位输出速度最高,为 68.3 Token/s。
哪家 Provider 延迟最低?
Google 的首个回答 Token 中位等待最低,为 85.9 秒。
哪家 Provider 单任务成本最低?
Anthropic 最低,为 US$2.75。
为什么同一个模型速度不同?
Provider 的推理硬件、批处理、路由、负载和服务配置不同,因此相同模型的吞吐和延迟会出现差异。