Blog · 分析
最小 harness 如何做到 99.93% 缓存命中率
2026 年 8 月 14 日 · dshbase
跑 DeepSeek 最便宜的方式不只是便宜的模型——而是能复用模型已经算过的内容的 harness。开源 Agent Pi 的社区实测显示99.93% 前缀缓存命中率。
成本驱动因素
编码 Agent 每一步都要重发系统提示词、工具定义、历史对话和代码。自动前缀缓存在请求开头不变时复用已计算的前缀。缓存命中率就是复用的 token 占比——越高越便宜。
缓存为什么脆弱
加个时间戳、调换工具顺序、或重写前面内容,缓存就失效。缓存友好的 harness 会保持请求前缀稳定。
Pi 的做法
Pi 默认只给模型四个工具(读、写、改、跑),其余全按需开启;会话只追加不重写。实测结果:约 99.93% 命中率,有缓存约每 10 亿 token ¥19,无缓存 ¥900+。
7 倍差距
Composio 把 DeepSeek V4 Flash 接进 8 款 harness:Pi 每次成功任务约 $0.028(最低),Claude Code 约 $0.195(接近 7 倍)。同一个模型、不同 harness、账单天差地别。
结论
- 最小工具集 + 只追加会话 = 缓存命中的最大杠杆。
- DSH 方向一致:小活动面、一切皆插件、PTC 把中间数据留在上下文外。