大模型的价格,有一项“输入 Token 的缓存命中价格”,这是什么东西?
以 DeepSeek V4 Flash 为例(下图),缓存命中的输入价格只有2分钱,足足是未命中的输入价格的五十分之一!
为什么相差这么大?我们能不能充分利用缓存,来降低费用呢?我写了一下自己的理解。http://t.cn/AXNYfyDy
发布于 云南
大模型的价格,有一项“输入 Token 的缓存命中价格”,这是什么东西?
以 DeepSeek V4 Flash 为例(下图),缓存命中的输入价格只有2分钱,足足是未命中的输入价格的五十分之一!
为什么相差这么大?我们能不能充分利用缓存,来降低费用呢?我写了一下自己的理解。http://t.cn/AXNYfyDy