模型与定价
XInfera 采用完全透明的按量付费模式。所有模型价格、计费类型、折扣以及兼容端点,都会在 模型广场 实时公布。
一、如何阅读模型价格
计费类型
目前支持 按量计费。按照消耗的输入(Prompt)和输出(Completion)Token 计费,价格通常按每百万 Token 展示(/1M Tokens),也可切换为按千 Token 展示。
缓存计费规则
对于支持缓存的模型,价格分为三部分:
- 输入——未命中缓存时的正常价格。
- 缓存(读缓存 / 命中缓存)——命中时的超低价格,通常约为正常输入价格的 10%。
- 写缓存(创建缓存)——首次将大段文本写入缓存的价格。
活动与折扣
模型名称和价格旁会出现实时折扣标签(例如 8.5 折)。系统会自动计算并展示折后价格。
过滤器与接口兼容性
- API 密钥分组——左侧过滤器可切换分组,如
default、vip、insider等,部分分组提供特价通道。 - 接口类型——每个模型会标明支持的协议,可配合对应官方 SDK 调用。
二、积分与换算规则
每一次 API 调用都会换算为系统 积分 并实时计费。
按量计费公式为:
单次积分消耗 = [ (输入Token数 × 输入单价)
+ (输出Token数 × 输出单价)
+ (缓存Token数 × 缓存单价) ]
信息
调用成功后,系统会在数秒内根据上游返回的真实用量(usage)从余额中扣费。