メインコンテンツへスキップ
P

dsh-meow-cachebilling

phant0meow/dsh-meow-cachebilling

Per-round cache billing inside the composer context-meter popover: what the current call spends on cache hits, misses, and output in CNY, with automatic official peak/off-peak and per-model pricing; hidden on non-official DeepSeek routes.

インストール

dsh plugin --profile web add github:phant0meow/dsh-meow-cachebilling

README

meow-cachebilling

English

难道只有我在关心怎么省钱?你们都那么有钱的吗……

为什么会有这个插件

dsh缓存命中率高,ds服务器缓存处理也得当,价格也便宜,导致可能很多人都忽略了——

单价再便宜,当上下文越来越长的时候,它还是会越来越贵。

到最后一算,你实际上付的钱,可能90%以上都是为了买缓存。

也就是说如果有更好的换窗口策略,及时换窗口,ds的费用能大幅度下降。

这是真的,我试了换窗口勤快的策略,试了两天,然后发现,真的便宜了。

我让GPT给我算的,算法是这样的:

缓存命中实际上都是聊过的上下文,每轮带着,所以显得多。

但未命中的输入和ai输出,才是硬梆梆不能少的实际使用,是不是?

所以或许应该用“实际使用”去衡量两天不同的工作量,并比较两天的性价比。

GPT算出来我勤换窗口时,便宜了50.1%。

bdf3b8aafe29f33c510cedfee116ed5d

所以,正确的deepseek使用姿势是:

不断开新窗口,旧窗口就再也不动了。

很长的旧窗口,每动用一次,都要为缓存付很多钱。

如果是时间久了、服务器那边缓存都删除了的旧窗口,那想必更是天价,全都按miss算啊。

所以旧窗口碰都不碰是最优解。

(所以还需要配合记忆插件来把旧窗口的有用信息带走)

但是,具体什么时候换窗口,你就需要衡量了。

换窗口的成本是:

AI需要重读代码的miss输入(可以通过fork减少这项成本)。

你需要重新介绍任务和规则的人力成本(可以通过记忆插件减少这项成本)。

换窗口的收益是:

缓存费用清零、从零开始重新累积。

有成本,有收益,所以你需要判断更好的换窗口时机。

换的太早:缓存本就不贵、收益少;重读代码miss费用虚耗、且重复说车轱辘话很累。

换的太晚:你的账单早已悄悄被冗长的上下文偷吃干净了。

所以我就需要这么一个插件,来告诉我,当前轮,纯粹上下文缓存的部分,到底花了我多少钱。

这样我才能心里有个底,才能判断什么时候该换窗口。

所以就有了这个插件。

我写它之前还在dsh-plugin标签里全网找了,那么多计费插件,并没有人写这一项……真奇怪。难道只有我有这个需求吗?

可是这真的省钱啊……

功能

  • 只认 DeepSeek 官方 API:本插件仅针对官方版 DeepSeek 计价,其他 LLM API、第三方中转一律不显示读数——宁可不算,绝不算错账
  • 账单住在上下文菜单里:点开输入框右侧的上下文圆环,弹层底部就是本轮账单——本轮 API ¥0.0219+缓存/未命中/输出三行明细,和"上下文用了多少"同屏对看
  • 一轮 = 每次大模型 API 请求:AI 中途调用工具后再请求 API 也算新一轮,数字随每次请求刷新,永远只显示当前轮
  • 峰谷计价自动判定:工作日高峰时段(北京时间 09:00–12:00 / 14:00–18:00)按峰价,其余时段及周六日全天按谷半价——与系统时区无关,纯事件时刻换算
  • 模型分价:V4 Flash / V4 Pro 单价不同,按每轮实际使用的模型计
  • 金额不眼晕:≥¥0.01 保留两位小数;<¥0.01 保留 1 位有效数字——便宜到 0.000012 也看得出不是零

账单底部小字标注当前轮次、模型、峰/谷价与命中率。

安装

dsh plugin --profile web add meow-cachebilling

安装后重启 dsh web 即可,无需任何配置。

计价口径

项目口径
缓存本轮 cacheRead tokens × 命中单价
未命中(未命中输入 + 缓存写入)× 未命中单价
输出输出 tokens × 输出单价
时段工作日 09:00–12:00 / 14:00–18:00 为峰,其余(含周六日全天)为谷

内置价目表(元 / 百万 token,2026-08-17 官方刊例):

模型峰(命中/未命中/输出)
deepseek-v4-flash0.1 / 3 / 90.05 / 1.5 / 4.5
deepseek-v4-pro0.3 / 9 / 270.15 / 4.5 / 13.5

数据来源:usage.cacheReadTokens(DeepSeek API 的 prompt_cache_hit_tokens)。本插件是本地估算工具,实际扣费以 DeepSeek 账单为准。

说明

  • 仅支持 DeepSeek 官方 API 计价;其他 provider 的路由不会显示读数。
  • 未命中缓存的轮次会如实显示 ¥0——全新会话第一轮没有可复用的前缀,这是正常现象。
  • 价格如有调整,可在源码 src/index.ts 的价目表中自行修改。

License

MIT

関連プラグイン