>
>
计费说明
提示
本文介绍的是按量计费(通用 API Key)的计费规则。若您使用 Token Plan 订阅套餐,额度扣减方式请以对应套餐说明为准。
本文为您介绍 SCNet 模型服务的计费方式、计费单位、扣费规则及结算说明。不同模型类型采用不同的计费策略,请在使用前仔细阅读对应模型的计费规则。
平台当前支持多种模型类型,不同模型采用不同的计费维度:
| 模型类型 | 计费方式 | 计费单位 |
|---|---|---|
| 大语言模型(LLM) | 按 Token 后付费 | 输入 / 缓存命中输入(如支持)/ 输出 Tokens |
| 向量模型(Embedding) | 按 Token 后付费 | 输入 Tokens |
| OCR 模型 | 按调用次数计费 | 次 / 页 / 张 |
实际计费方式以具体模型说明为准。
2.1.什么是 Token
Token 是模型处理文本的最小语义单元。在调用模型推理服务时:
2.2. Token 与字符的换算关系(参考)
一般情况下,不同语言的 Token 换算关系大致如下(仅供参考):
⚠️ 注意:
usage 字段为准2.3.Token 计费通用公式
费用 = Token 消耗量 × 模型单价3.1.计费方式
按 Token 后付费
分别统计 输入 Tokens 与 输出 Tokens
按模型对应的输入 / 输出单价计费
3.2.扣费规则
3.3.缓存命中计费说明
部分模型支持上下文缓存(Context Cache)。当请求的输入内容命中缓存时,命中部分的输入 Token 将以更低的单价计费。
不支持上下文缓存的模型
请求产生的全部输入 Token 均按“输入”价格计费,仅包含“输入”一个计费项。
支持上下文缓存的模型
输入 Token 按是否命中缓存拆分为两个计费项,并分别计费:
输出 Token 统一按“输出”价格计费。
如何查看缓存命中 Token
开发者可通过接口返回结果中的 usage 字段查看单次调用的缓存命中 Token 数量:
usage.prompt_tokens_details.cached_tokensusage.input_tokens_details.cached_tokensusage.cache_read_input_tokens适用模型范围与价格
4.1.计费方式
按 Token 后付费
仅统计 输入文本的 Token 数量
不产生输出 Token 费用
4.2.扣费规则
扣减费用 = 输入 Token 数 × 模型单价5.1.结算顺序
系统将按照以下顺序进行扣费:
赠送的免费 Tokens / 免费额度 → 现金余额5.2.费用查询
可在“模型API—账单”中查看消费明细。
5.3.充值与付费
请前往 「控制台 — 费用概览」 页面充值现金余额
建议根据业务用量按需充值