跳到主要内容

模型与定价

XInfera 采用完全透明的按量付费模式。所有模型价格、计费类型、折扣以及兼容端点,都会在 模型广场 实时公布。

一、如何阅读模型价格

计费类型

目前支持 按量计费。按照消耗的输入(Prompt)和输出(Completion)Token 计费,价格通常按每百万 Token 展示(/1M Tokens),也可切换为按千 Token 展示。

缓存计费规则

对于支持缓存的模型,价格分为三部分:

  • 输入——未命中缓存时的正常价格。
  • 缓存(读缓存 / 命中缓存)——命中时的超低价格,通常约为正常输入价格的 10%。
  • 写缓存(创建缓存)——首次将大段文本写入缓存的价格。

活动与折扣

模型名称和价格旁会出现实时折扣标签(例如 8.5 折)。系统会自动计算并展示折后价格。

过滤器与接口兼容性

  • API 密钥分组——左侧过滤器可切换分组,如 defaultvipinsider 等,部分分组提供特价通道。
  • 接口类型——每个模型会标明支持的协议,可配合对应官方 SDK 调用。

二、积分与换算规则

每一次 API 调用都会换算为系统 积分 并实时计费。

按量计费公式为:

单次积分消耗 = [ (输入Token数 × 输入单价)
+ (输出Token数 × 输出单价)
+ (缓存Token数 × 缓存单价) ]
信息

调用成功后,系统会在数秒内根据上游返回的真实用量(usage)从余额中扣费。