Jev 按输入 token 计费。2026 年 9 月 20 日核查的官方模型规格中,Jev 1.13.0 的价格为每百万输入 token 0.042 美元,输出 token 免费。本页解释公开的模型单价,不承诺你账号的最终账单、额度或接入条件。
公开价格包含什么?
每十亿输入 token 42 美元,等同于每百万输入 token 0.042 美元。不要混淆十亿与百万的单位。输入包括提交给模型的上下文与问题;使用响应中的 usage.input_tokens 测量,而不是用字符数猜测。输出 token 可能仍显示在 usage 中,即使它的公开单价为零。
API 成本怎样计算?
估算模型费用 = 请求次数 × 每次平均输入 token ÷ 1,000,000 × 0.042 美元。例如,100,000 次请求、每次 1,000 token,共计一亿输入 token,费用为 100 × 0.042 = 4.20 美元。这是假设工作负载的算例,不是本站 API 实测 token 数。
不同调用量的成本算例
下表每行都假设每次计费输入为 1,000 token,已经包含问题。金额单位均为美元,没有自动换汇,也不代表地区专属报价。
每百万输入 token · 输出 token 免费
| 请求次数 | 每次输入 token | 输入 token 总量 | 估算模型费用(美元) |
|---|---|---|---|
| 1,000 | 1,000 | 1,000,000 | US$0.042 |
| 10,000 | 1,000 | 10,000,000 | US$0.420 |
| 100,000 | 1,000 | 100,000,000 | US$4.200 |
| 1,000,000 | 1,000 | 1,000,000,000 | US$42.000 |
哪些因素会增加总预算?
更多上下文和问题可能增加输入用量。额外调用、评测、重试和多阶段工作流可能增加处理量;失败请求是否计费应以服务商实际用量与账单为准。托管、检索、其他生成模型、网络费用及适用税费均不在表内。
限流和上下文会影响价格吗?
限制约束吞吐量和请求大小,不改变上述公式。核查时文档列出每分钟 1,200 次请求、每秒 250,000 token,并明确提醒限制会动态调整。总输入预算为 64k,state 加最长单个问题的预算为 32k。规划容量前要重新检查当前账号限制。
是否有免费额度?
本站不承诺免费额度或无限访问。请在官方控制台检查账号的访问、账单和赠送额度条款。公开的按 token 单价本身并不能证明存在免费层或服务等级承诺。
如何给真实应用做预算?
先收集代表性样本,记录 usage.input_tokens,分别计算常见输入与长输入的成本。对整个流程做预算,而不只计算一次模型请求。比较结果时固定模型版本,作出成本承诺前重新核对公开价格。