上周在这发过 Orbi (给 GitHub Issue 打 ai-ready 标签,AI 写代码、另起一轮评审、合并、发版)。这回只贴账单。 9 月 22 日起,Orbi 自己仓库的交付全换成了 deepseek-flash ( V4.1-Flash )。我把 22 到 24 号合并的 20 个 PR 拉出来算了一遍,每个 PR 从写代码、评审、返工一直到合并,整条链路的 token 都算进去: 中位数 1061 万 token ,跑 60 分钟左右,调了 156 次模型 按官方价,非高峰中位数 $0.125 一个 PR ,最贵那个 $0.417 高峰价格翻倍,中位数 $0.249 ,最贵 $0.834 便宜就一个原因:97.1% 的 token 是缓存命中。DeepSeek 缓存命中每百万 token $0.003 ,没命中是 $0.15 ,差 50 倍。agent 一遍遍读同一批文件、同一段对话,缓存吃得很满。 中间踩过一个坑。一开始上下文窗口只配了 131K ,Pi ( Orbi 底下的 agent 运行时)过了 115K 左右就压缩会话,只留最近...