先附上reasonix,pi的安装文件具体教程在zip文件中后面都是环境配置和论述省token的原因https://pan.baidu.com/s/1cBvcOXxTAP3KIc_a0Ff8vQ?pwddfac 提取码:dfachttps://pan.baidu.com/s/1fhOefpiXp6NF3mcdGCD_cg?pwd4z6a 提取码:4z6a教程用 Reasonix Pi 把 AI 编程成本砍到 1/5 —— 高缓存命中实操适用人群想用 AI 编程智能体Claude Code 类工具但嫌 token 贵的人 工具ReasonixDeepSeek 专用缓存命中 99.82% Pi多模型通用工具包 环境Windows 11 Node.js v24Node ≥ 18 均可国内网络可全程走 npm 镜像一、先说原理为什么缓存命中率≈ 省钱比例 DeepSeek 的前缀缓存Context Caching机制自动启用无需任何配置开关逐字节严格前缀匹配每次请求都与历史请求从第 0 个 token 开始比对最长相同前缀按命中价计费只有新增尾部按未命中价计费命中价约为未命中价的 1/301/120V4 Flash 相差 31 倍V4 Pro 相差 120 倍前缀里任何一处改动——改系统提示、注入时间戳、重排历史、热插拔插件——都会让其后所有内容全部失效响应usage字段可观测prompt_cache_hit_tokens/prompt_cache_miss_tokens实测数据Reasonix 官方案例2026‑05‑01单用户单日V4 Flash指标数值命中 token435,033,856未命中 token767,616命中率99.82%实际费用~$12无缓存对照~$61→ 同样的活缓存做好直接省 80%。二、装什么前置Node.js ≥ 18去 nodejs.org 或 npmmirror.com 下载安装包即可。 两条命令国内加--registry镜像GitHub 直连不通也不影响二进制包由 npm 仓库分发npm i -g reasonix --registryhttps://registry.npmmirror.com npm i -g --ignore-scripts earendil-works/pi-coding-agent --registryhttps://registry.npmmirror.com验证安装reasonix --version # v1.37.0 pi --version # 0.85.0也可以装到本地项目文件夹node_modules/.bin下用npx调用npm i --ignore-scripts reasonix earendil-works/pi-coding-agent --registryhttps://registry.npmmirror.com npx reasonix --version npx pi --version三、配什么3.1 Reasonix主推DeepSeek 省钱主力打开 https://platform.deepseek.com 注册账号左侧充值支付宝充值几十块钱能跑很久API Keys → 创建 keysk‑开头只显示一次务必保存终端执行reasonix setup选 DeepSeek 预设 → 粘贴 key → 选模型v4‑flash 便宜够用v4‑pro 更强进阶免交互/服务器场景直接写两个文件即可无需跑向导。 Windows 路径%APPDATA%\reasonix\即C:\Users\你的用户名\AppData\Roaming\reasonix\config.tomlconfig_version 7 default_model deepseek-pro language zh [agent] temperature 0.0 reasoning_language zh.envkey 只放这里绝不放进 tomlDEEPSEEK_API_KEYsk-你的key验证reasonix doctor看 providers 是否 key:present、reasonix -p 测试跑通一次。3.2 Pi备用用 Claude/GPT 模型时# PowerShell $env:ANTHROPIC_API_KEY sk-ant-... # 或用订阅账号登录GitHub Copilot / Claude 订阅可直接复用 npx earendil-works/pi-ai login四、怎么用才高命中核心部分Reasonix 的省 token 十诫一个项目 一个长会话reasonix进入交互模式后别退出跑一整天别用reasonix run 任务跑批量任务——每次都是冷启动全价计费会话中途别改配置不切模型、不改系统提示、不热插拔 MCP 插件崩溃了用会话恢复 / checkpoint 继续不要开新会话让它自己长跑官方定位就是 leave it running可以放着不管双模型规划器 执行器分开跑各自维护稳定的缓存前缀随时敲/stats看命中率和花费错峰跑北京时间 09:00–12:00 和 14:00–18:00 是峰时价格翻倍长任务放晚上或清晨同一会话内别手动裁剪/重写历史有 PR 专门修复过 warm cache 下自动 prune 导致缓存全失效、成本 50120 倍翻车的问题工具结果第一次出现必然 miss 一次——这是机制决定的不是 bug长会话里这 0.2% 的 miss 无关紧要【此处可配图reasonix TUI 界面截图 /stats 输出截图】Pi 的用法用 Claude/GPT 时的选择pi进交互长会话pi --resume id续会话续前缀pi -p 任务一次性模式 每次全价只适合演示Anthropic 的缓存由 pi‑ai 自动处理cache_control断点无需手动配置⚠️ Pi 没有 Reasonix 那套缓存纪律用在 DeepSeek 上命中率只有通用框架水平3060%。想省 DeepSeek 的钱就用 Reasonix别混着用错工具五、怎么验证省钱效果TUI 内/stats本会话花费状态面板每轮实时显示花费颜色分级绿 $0.05/轮黄 $0.05–0.20红 ≥ $0.20内置 Web 面板http://localhost:18792token 用量、命中率、成本实时监控API 层响应usage里的prompt_cache_hit_tokens/prompt_cache_miss_tokens命中率 hit ÷ (hit miss)省钱估算命中率 × (1 − 命中价/未命中价) ≈ 省下的钱价格参考2026‑08‑16 起峰谷计价单位 $/百万 token写文章时以 platform.deepseek.com 官网为准模型 / 时段缓存命中未命中输出v4‑flash 谷时0.0070.220.66v4‑flash 峰时0.0140.441.32v4‑pro 谷时0.0220.661.98v4‑pro 峰时0.0441.323.96六、常见坑写文章时的防杠要点命中率只在长稳定会话里成立前几轮必然低别用短会话测命中率然后下结论服务端缓存是 best‑effort会被淘汰99% 是工程上限不是保证值通用客户端命中率低官方网页聊天 60–80%、Cherry Studio 等 30–60%不是模型不行是历史重排、动态注入破坏了前缀Reasonix 的设计哲学一句话不是在 Agent 上加缓存而是把 Agent Loop 改造成可缓存的形状——四根支柱Immutable Prefix系统提示 工具 schema few‑shot 在会话开始时冻结SHA‑256 指纹检测漂移Append‑Only Log历史只追加、绝不重排重写并行工具结果按声明顺序回写Volatile ScratchR1 推理草稿每轮重置不上送受控 compact只在上下文压力阈值、用户消息边界才折叠历史基准测试佐证同一任务、同一 DeepSeek 缓存普通 loop 命中率 32.8%Reasonix 90.2%τ‑bench‑lite单任务成本降 40%附两个工具定位对比ReasonixPi定位DeepSeek 原生为缓存而生的编码智能体多供应商通用 agent 工具包命中率99.82%长会话实测通用框架水平DeepSeek 上 30–60%适用省钱、长任务、放着跑用 Claude/GPT/Copilot 订阅安装npm 包自带 Go 二进制npm 包Node 运行一句话缓存是 DeepSeek 的命中率是客户端的灵活但缓存纪律靠自觉参考来源Reasonix 官方缓存案例github.com/esengine/DeepSeek‑Reasonix/tree/v1/benchmarks/real‑world‑cacheReasonix 仓库github.com/esengine/DeepSeek‑ReasonixPi 仓库github.com/earendil‑works/pi