ModelPort
ModelPort · 使用指南

模型倍率与 API 计费说明|ModelPort 中转站

ModelPort 编辑 · 更新于

倍率不是一次请求的固定费用。实际费用需要结合模型单价、输入输出用量、缓存类别、上下文档位与最终使用的分组计算。

怎样看懂模型广场?

先选择模型所在平台和分组,再查看计费单位。按 token 计费的模型通常区分输入、输出与缓存;图片模型可能按张计费。若页面已经显示折后实付单价,不应再乘一次折扣倍率。价格档位、额外条件和个人适用价格以登录后的模型广场为准。

一个纯演示的计算例子

假设某模型的折后输入价为每百万 token 1 美元,输出价为每百万 token 4 美元;一次请求有 10,000 个普通输入 token 和 2,000 个输出 token,且没有缓存或其他收费项,则演示费用为 10,000 ÷ 1,000,000 × 1 + 2,000 ÷ 1,000,000 × 4 = 0.018 美元。这是计算示例,不是 ModelPort 的现行报价。

自动切组后按什么价格扣费?

按实际提供请求的分组计费,而不是始终按最便宜分组收费。同一模型在不同分组的倍率、缓存价格和服务能力可能不同。请求完成后,应结合用量记录的实际分组与计费明细核对;不能仅凭请求前看到的某个分组价格推断最终金额。

缓存与长上下文

缓存读取、缓存写入和普通输入可能使用不同单价;有些模型在上下文达到阈值后进入另一价格档位。客户端的总 token 数不一定等于某一个收费类别的数量。检查费用时要对应计费类别,不能把缓存命中率直接当成总费用折扣。

三种金额不要混淆

人民币实际支付金额、到账站内额度、模型价格表中的美元计价单位是不同口径,充值倍率或套餐可能影响其对应关系。站内额度不等于现金,也不等于 OpenAI 或 Anthropic 官方账户余额。拼团套餐另有资源限制,详情见拼团订阅说明

如果请求切组或扣费结果与预期不同,先看模型路由与实际分组,再按错误排查顺序核对响应。