您好,
这是一封由 LINUX DO 自动发送的邮件,旨在通知您的帖子已被移除。
AIGC未截图
此帖子被社区举报,管理人员选择将其移除。
5.6-sol-pro
真正正确的成本指标是:
...
因此:
上下文长度×缓存后的计费系数
才具有比较意义。
对于 90% 缓存命中:
...
当缓存读取价格为普通输入的 10% 时:
...
所以 10 万长上下文等价于 1.9 万个普通输入 token。它仍然比 1 万 token 的完全无缓存短上下文贵 90%。
你的核心观点可以压缩成一句严格表述:
缓存优化的是单位上下文成本,裁剪上下文优化的是参与计费的 token 总量;最终成本由二者乘积决定。