什么是 AI Token?
Token 是一小段文本——在英文中约为 4 个字符或 ¾ 个单词。模型以 Token 为单位读写,API 厂商按处理的每百万 Token 计费。
覆盖主流厂商的输入、输出与缓存 Token,并将成本推算至数千次请求。一切均在您的浏览器中私密运行。
选择厂商和模型,输入 Token 数量,即可查看确切成本——并推算 1K、10K 与 100K 次请求的费用。
使用费率:输入 5/1M,输出 30/1M,缓存 0.5/1M(美元)。
输入数值并点击“计算”以查看预计成本。
粘贴或上传文档,选择任务类型,估算在各模型上处理它的成本。
仅为字符启发式估算:中文字符 / 1.5 + 其他字符 / 4,并非任何模型的精确分词器。在冻结的三条 Gemini 3.7 Flash 日文样本中,低估幅度为 13.5%~25.6%。 阅读实验。
基于 0 输入 + 0 输出 Token。
| 厂商 | 模型 | 预计成本(美元) |
|---|---|---|
| OpenAI | GPT-5.6 Sol | $0.00最便宜 |
| OpenAI | GPT-5.6 Terra | $0.00 |
| OpenAI | GPT-5.6 Luna | $0.00 |
| Anthropic | Claude Opus 5 | $0.00 |
| Anthropic | Claude Sonnet 5 | $0.00 |
| Anthropic | Claude Haiku 4.5 | $0.00 |
| Gemini 3.7 Flash | $0.00 | |
| Gemini 3.5 Flash | $0.00 | |
| Gemini 3.5 Flash-Lite | $0.00 | |
| DeepSeek | DeepSeek V4 Flash | $0.00 |
| DeepSeek | DeepSeek V4 Pro | $0.00 |
关于 Token、定价机制以及如何控制 AI 成本的快速入门。
Token 是一小段文本——在英文中约为 4 个字符或 ¾ 个单词。模型以 Token 为单位读写,API 厂商按处理的每百万 Token 计费。
输入 Token 是您发送给模型的一切(提示词、上下文与文档)。输出 Token 是模型生成返回的内容。二者通常分别定价。
生成文本比读取文本更耗算力,因此输出 Token 通常比输入 Token 贵 2–5 倍。冗长的回答可能主导您的账单。
文档的每个字符都会转化为输入 Token。一份大型报告可能达数万 Token,而在每次请求中重新发送会迅速成倍增加成本。
对简单任务使用更小或更便宜的模型,缓存重复上下文,精简提示词,先摘要再分析,并限制输出长度。在采用前对比各厂商。
Token 是 AI 模型处理的最小文本单位——约为 4 个英文字符或四分之三个单词。厂商对输入和输出均按每百万 Token 计费。
将输入 Token 乘以模型每百万输入单价,将输出 Token 乘以每百万输出单价,加上任何缓存输入成本,再求和。本计算器会自动完成。
取决于文档长度和模型。将文档粘贴到上方的长文档成本分析器,即可估算 Token 并查看 GPT、Claude、Gemini 与 DeepSeek 的成本。
最低的单位 Token 价格并不代表每项任务的总成本最低。请比较带日期的费率,并结合实际工作负载测量重试、延迟、Token 数量和任务成功率。
在人工审核的参考数据中,所列 DeepSeek 模型的单位 Token 价格低于所列 OpenAI GPT 模型。价格经常变动,请务必核对所链接的官方价格页面。
同类 Claude 模型的单位 Token 价格可能高于 Google Gemini Flash 层级,而部分 Claude 与 Gemini Pro 费率较为接近。请查看审核日期和所链接的官方来源。
Token 数使用字符启发式估算(中文字符 / 1.5 + 其他字符 / 4),并非任何模型的精确分词器。在冻结的三语 Gemini 3.7 Flash 实验中,绝对误差为 2.1%~27.3%,其中三条日文样本均低估 13.5%~25.6%。请仅用于粗略预算,而非精确计费。
不会。所有文本分析完全在您的浏览器中进行。您粘贴的文本和上传的文件绝不会发送到服务器、上传或存储在任何地方。