公开单价
此处为公开的模型单价。当前访问权限与计费条款请以官方来源为准。
价格核查日期:2026年9月17日核查官方定价
此处显示的单价来自官方模型页面。这是截至核查日期的公开价格记录,并非针对你账户的报价,也不保证价格始终不变。
大约需要多少钱?
快速估算模型输入成本,无需账户。
请计入每次调用发送的上下文和问题文本。输入 0 至 10 亿之间的整数。
共 150,000,000 个输入 token
调用次数 × 平均输入 token 数 ÷ 1,000,000 × US$0.042。输出:US$0.00。此估算不含其他服务,既不是账单,也不是价格保证。
价格核查日期:2026年9月17日核查官方定价
计算器中应该填什么
请使用 API 调用次数和每次调用的平均输入 token 数,而非文档数或人数。一份文档如果分成三次请求处理,就产生三次调用。一次请求即使包含多个问题,仍算一次调用,但输入量会增加。
计算方法如下:输入成本估算值等于 API 调用次数乘以每次调用的平均输入 token 数,除以 1,000,000,再乘以公开的每百万输入 token 单价。
查看技术细节
estimated input cost =
API calls × average input tokens per call
÷ 1,000,000 × published price per million input tokens本页计算器在你的浏览器中运行,不会调用 Jev,也不会上传文档或测量文档的 token 数。
可靠的预算要从实际输入用量开始
初步估算时,可以先用一个刻意简化的工作量,例如调用 10,000 次,每次平均输入 1,000 个 token。随后再用实际集成中观测到的用量替换这一假设。
API 会报告 usage.input_tokens。你可以用这个字段查看有代表性的短请求、典型请求和长请求。只看客户消息可能会低估输入量:问题指令、选项和其他上下文也会占用输入。TypeSafe 特别说明,增加 Choice 问题和选项会增加 token 数。Choice 文档
如果不同调用路径的输入差异很大,应分别记录。简短的路由判断和长文档审核不应仅因使用同一个模型,就共用一个平均值。
为整个处理流程制定预算
假设每份文档都需要一次初筛,其中一部分还需要二次审核,那么两条路径都要计入。如果重试时再次发送同一份文档,就又进行了一次尝试;不要把用户点击一次等同于只发出一次请求。
保留一份简单的工作量记录:运行了哪条路径、调用了几次、输入 token 用量是多少,以及是否需要人工介入。查看日志时,要区分有意重放的文档示例与真实请求。缓存的示例无法证明当前账户的费用或性能。
这份估算没有包含什么
- 重复调用、重试,以及平均输入长度的变化。
- 文本提取、检索、存储、托管,以及其他模型调用。
- 审核不确定结果或纠正错误决策所花费的时间。
- 税费、账户专属商务条款,或未来价格变化。
这些是制定预算时需要考虑的因素,并不意味着 TypeSafe 一定会收取这些附加费用。实际账单请以你的账户和当前官方条款为准。
API 单次成本低,整个工作流就便宜吗?
只有决策有用,低单价才有意义。比较不同方案时,应衡量获得一个可接受结果的总成本,包括审核和补救工作。单次调用更便宜,却把更多工单发给错误的团队,实际运行成本反而可能更高。
一个实用的实验是:把同一批获准使用的样例分别交给现有流程和引入 Jev 的流程,比较决策质量、审核比例、延迟和总调用次数。使用场景指南提供了一个便于起步的小型工作流。
定价常见问题
出现输出 token 字段,就代表额外收费吗?
API 可以报告输出 token 用量,而公开模型页面将输出列为免费。用量统计与当前收费政策是两回事。请结合上方的公开单价和你的账户条款判断。模型定价
多加几个问题,就能免费增加请求内容吗?
不能。多个问题可以共用同一份 state 和一次请求,但新增的问题内容仍会影响输入用量。如果适合工作流,可以把相互独立的问题合并提交,然后查看实际用量;不要假设固定价格可以覆盖无限多的工作。
速率限制是固定的吗?
TypeSafe 表示,早期访问阶段的限制可能变化。当前限制请查看模型页面,响应处理方式请参阅集成指南。这个计算器估算的是支出,不是可用吞吐量。
来源与延伸阅读
本指南依据官方文档和所链接的社区报告编写。社区观察均注明原作者。
我们如何核查来源