计费方式
系统内部以「额度(quota)」记账,$1 = 500,000 额度。一次调用的费用由三个数决定:
| 参数 | 含义 | 在哪看 |
|---|---|---|
模型倍率 |
每个模型按官网成本价登记,输入/输出共用一个倍率,输出按补全倍率放大 | 控制台「模型广场」每个模型的倍率 |
补全倍率 |
输出 tokens 相对输入的加价倍数(生成比理解贵,各模型不同) | 同上 |
分组倍率 |
你所在分组的整体系数,当前所有对客分组为 1.3 | 控制台「个人设置」的分组信息 |
一条调用的消耗 = 输入 tokens × 输入单价 + 输出 tokens × 输出单价,其中单价已含分组倍率。
余额扣减与每次调用的明细(模型、tokens、消耗)都可在控制台「日志」页逐条核对。
到岸价怎么构成
我们按各模型官网成本价登记模型倍率,并保持与官网同步巡检(每日自动比对,上游调价 24 小时内跟进); 在成本之上统一乘 1.3 的分组倍率形成你的实付价——即成本加成 30%,无隐藏费用。 三个真实算例(元/百万 tokens,实付价):
| 模型 | 输入(实付) | 输出(实付) | 对应成本价 |
|---|---|---|---|
glm-5.3-flash |
¥1.04 | ¥3.64 | ¥0.8 / ¥2.8 |
deepseek-v4.1-flash |
¥2.6 | ¥10.4 | ¥2 / ¥8 |
qwen-flash |
¥0.2 | ¥1.95 | ¥0.15 / ¥1.5 |
全部在售模型的实付单价表见模型广场;控制台「定价」页可查任意模型的实时倍率—— 控制台显示的就是结算依据。