LLM API
成本计算器
粘贴一段示例提示词或输入 token 数量,设定你的用量,就能看到一个月在 Claude、GPT、Gemini、Llama 和 DeepSeek 上的花费;并排对比,每个价格都可编辑。
一个月的调用要花多少钱?
token 估算 = 字符数 / 4。真实分词器因模型和语言而异,通常在 10-15%;适合做预算,不适合做账单。
| 模型 | 输入 $/1M | 输出 $/1M | 每月成本 | 对比 | 若增长 10 倍 |
|---|
当你的 AI 搭建网站时,Yetty 让它上线,并通过 MCP 保持连接;你的 AI 可继续编辑、发布并读取线索。
LLM 计费
实际是怎么运作的
两个计量表,不是一个
输入和输出分别计费,输出每个 token 通常贵约 5 倍。便宜套餐上话多的模型,账单可能比贵套餐上简洁的模型还高。
你会重发整段对话
API 是无状态的:每一轮都把完整历史作为输入重新发送。一段 20 轮的对话,第 1 轮要付二十次费;所以长对话很快就变贵。
缓存是最大的杠杆
稳定的提示词前缀(系统提示词、文档、工具)可以缓存;厂商随后会对缓存输入给出很大折扣,常在 90% 左右。在上方开启它就能看到效果。
模型大小相差可达 25 倍
在小模型和旗舰模型之间,同一次调用价格可能相差 25 倍。把简单调用(分类、抽取、重排格式)路由给小模型,把旗舰留给难活。
token 不是单词
英文平均约每 token 4 个字符,但代码、JSON 和非拉丁语言分词更重。同一段"短"提示词,用希伯来语或日语可能明显更贵。
成功才是危险
成本随用量线性增长;上方的 10 倍列就是"我们的功能火了"情景。在上线前就为它做预算,而不是在事后的账单邮件里。
大家也在问
Claude API 每百万 token 多少钱?
截至 2026 年年中,主要价格约为 Claude Opus 每百万输入 token 5$、每百万输出 token 25$,Claude Sonnet 为 3$/15$,Claude Haiku 为 1$/5$。厂商经常调价并推出促销,正因如此这个计算器里每个价格单元格都可编辑;把默认值当作起点,把你厂商定价页上的当前数字粘进来。
我怎么估算自己的文本有多少 token?
英文的一个快速经验法则是每 4 个字符约 1 个 token,或每 1,000 个 token 约 750 个单词。真实的分词器因模型和语言而异;代码、非拉丁文字和异常格式可能让计数偏移 10-15% 甚至更多,所以用估算来做预算,需要精确账单时用厂商自己的 token 计数器。
我怎么降低 LLM API 成本?
最重要的三个杠杆:简单调用改用更小的模型(分类和抽取几乎用不上旗舰模型),缓存重复的提示词前缀(厂商对缓存输入的折扣很大,常在 90% 左右),并精简你发送的内容;更短的系统提示词和摘要过的历史记录会降低每次请求的输入账单。对可以等待的任务,Batch APIs 通常还能再打约 50% 的折扣。