AI提示词缓存成本计算器
计算开启提示词缓存后能省多少Token费用,对比OpenAI、Claude与Gemini的缓存读写折扣,帮你估算长系统提示与RAG场景的真实账单
在线工具即将上线
先通过下面的介绍了解它的用法吧
功能特点
- ✓ 输入提示词长度与调用次数,估算缓存前后费用
- ✓ 对比OpenAI、Claude、Gemini的缓存读写折扣
- ✓ 区分缓存命中与未命中的Token计费
- ✓ 估算长系统提示与RAG场景的月度节省
- ✓ 支持导出结果用于预算与成本评审
使用步骤
- 输入系统提示词与上下文的Token长度
- 填写每日/每月调用次数与缓存命中率
- 选择模型与定价方案
- 查看费用对比与节省比例
常见问题
AI提示词缓存成本计算器 是什么?
一款估算缓存费用的工具。功能:估算缓存前后费用、对比厂商折扣、区分命中与未命中计费、月度节省估算。输入:提示词长度、调用量、命中率与模型定价。输出:费用对比与节省金额。适合开发者、AI产品与成本负责人。
什么是提示词缓存?
是把重复的前缀内容(如长系统提示)在服务端缓存,后续请求命中时按更低的缓存读取价计费,从而降低成本与延迟。
哪些模型支持缓存?
OpenAI、Anthropic Claude 与 Google Gemini 等主流厂商均提供缓存能力,具体折扣与最小长度以其官方定价页为准。
缓存一定省钱吗?
只有当相同前缀被反复使用时才划算;缓存写入通常有附加费用,命中率低时可能不划算。
命中率怎么估?
按相同系统提示被复用的比例估算;长系统提示、固定知识库与RAG场景的命中率通常更高。
定价会变吗?
会。各厂商的缓存单价与规则会调整,请以官方最新定价为准。