一次请求可容纳的输入与输出 Token 总量,不等于模型一定能有效利用全部长度。
Models
AI 模型总览
横向比较模型的 Intelligence Index、上下文窗口、单任务成本、生成速度、首字等待和完整响应时间。数据保持原始口径。
255 / 255 个模型
“—”表示当前公开快照中没有该项数据;带 * 的指数来自原始榜单的估算标记。
发出请求到收到第一个 Token 的时间,越低意味着越快开始回答。
从请求发出到回答完成的总时间,受推理长度和输出速度共同影响。
Models
横向比较模型的 Intelligence Index、上下文窗口、单任务成本、生成速度、首字等待和完整响应时间。数据保持原始口径。
“—”表示当前公开快照中没有该项数据;带 * 的指数来自原始榜单的估算标记。
一次请求可容纳的输入与输出 Token 总量,不等于模型一定能有效利用全部长度。
发出请求到收到第一个 Token 的时间,越低意味着越快开始回答。
从请求发出到回答完成的总时间,受推理长度和输出速度共同影响。