AI Token 计算器

在写下第一行代码之前,先估算您的 AI API 成本

覆盖主流厂商的输入、输出与缓存 Token,并将成本推算至数千次请求。一切均在您的浏览器中私密运行。

计算器

计算 AI API 成本

选择厂商和模型,输入 Token 数量,即可查看确切成本——并推算 1K、10K 与 100K 次请求的费用。

使用费率:输入 5/1M,输出 30/1M,缓存 0.5/1M(美元)。

结果

输入数值并点击“计算”以查看预计成本。

文档分析器

长文档成本分析器

粘贴或上传文档,选择任务类型,估算在各模型上处理它的成本。

100% 在浏览器中运行——您的文档绝不会上传到任何服务器。

估算

字符总数0
中文字符0
预计输入 Token0
预计输出 Token(×0.1)0

仅为字符启发式估算:中文字符 / 1.5 + 其他字符 / 4,并非任何模型的精确分词器。在冻结的三条 Gemini 3.7 Flash 日文样本中,低估幅度为 13.5%~25.6%。 阅读实验。

各模型的预计处理成本

基于 0 输入 + 0 输出 Token。

厂商模型预计成本(美元)
OpenAIGPT-5.6 Sol$0.00最便宜
OpenAIGPT-5.6 Terra$0.00
OpenAIGPT-5.6 Luna$0.00
AnthropicClaude Opus 5$0.00
AnthropicClaude Sonnet 5$0.00
AnthropicClaude Haiku 4.5$0.00
GoogleGemini 3.7 Flash$0.00
GoogleGemini 3.5 Flash$0.00
GoogleGemini 3.5 Flash-Lite$0.00
DeepSeekDeepSeek V4 Flash$0.00
DeepSeekDeepSeek V4 Pro$0.00
了解

AI Token 定价的运作方式

关于 Token、定价机制以及如何控制 AI 成本的快速入门。

什么是 AI Token?

Token 是一小段文本——在英文中约为 4 个字符或 ¾ 个单词。模型以 Token 为单位读写,API 厂商按处理的每百万 Token 计费。

输入 Token 与输出 Token

输入 Token 是您发送给模型的一切(提示词、上下文与文档)。输出 Token 是模型生成返回的内容。二者通常分别定价。

为何输出 Token 通常更贵

生成文本比读取文本更耗算力,因此输出 Token 通常比输入 Token 贵 2–5 倍。冗长的回答可能主导您的账单。

长文档如何增加成本

文档的每个字符都会转化为输入 Token。一份大型报告可能达数万 Token,而在每次请求中重新发送会迅速成倍增加成本。

如何降低 AI API 支出

对简单任务使用更小或更便宜的模型,缓存重复上下文,精简提示词,先摘要再分析,并限制输出长度。在采用前对比各厂商。

常见问题

常见问题解答

Token 是 AI 模型处理的最小文本单位——约为 4 个英文字符或四分之三个单词。厂商对输入和输出均按每百万 Token 计费。

将输入 Token 乘以模型每百万输入单价,将输出 Token 乘以每百万输出单价,加上任何缓存输入成本,再求和。本计算器会自动完成。

取决于文档长度和模型。将文档粘贴到上方的长文档成本分析器,即可估算 Token 并查看 GPT、Claude、Gemini 与 DeepSeek 的成本。

最低的单位 Token 价格并不代表每项任务的总成本最低。请比较带日期的费率,并结合实际工作负载测量重试、延迟、Token 数量和任务成功率。

在人工审核的参考数据中,所列 DeepSeek 模型的单位 Token 价格低于所列 OpenAI GPT 模型。价格经常变动,请务必核对所链接的官方价格页面。

同类 Claude 模型的单位 Token 价格可能高于 Google Gemini Flash 层级,而部分 Claude 与 Gemini Pro 费率较为接近。请查看审核日期和所链接的官方来源。

Token 数使用字符启发式估算(中文字符 / 1.5 + 其他字符 / 4),并非任何模型的精确分词器。在冻结的三语 Gemini 3.7 Flash 实验中,绝对误差为 2.1%~27.3%,其中三条日文样本均低估 13.5%~25.6%。请仅用于粗略预算,而非精确计费。

不会。所有文本分析完全在您的浏览器中进行。您粘贴的文本和上传的文件绝不会发送到服务器、上传或存储在任何地方。