Codex成本与额度约 3 分钟

四招打满 prompt 缓存

Four Settings to Cut Tokens

要点

  1. 稳定规则和 AGENTS.md 放前面,变动需求放后面,好打缓存。
  2. 长任务及时清掉失败方案和旧日志,只留目标和下一步。
  3. MCP 按项目按需加载,闲置工具会占上下文。
  4. 少切模型、目录和规则,配置稳才不会反复重新理解项目。

原帖开头

Codex 5.6 这 4 个设置,能砍掉 80% 无效 token 浪费,复杂长任务效率还能提升 70% 很多时候不是模型不够强,而是你的上下文、缓存和工具配置正在拖后腿。 1️⃣ 尽量吃满 prompt cache 固定不变的项目规则、AGENTS.md、开发规范、长期 prompt 放前面,经常变化的需求放后面。这样更容易命中缓存,减少重复计算和重复上下文token消耗。 2️⃣ 长任务要及时压缩上下文 不要让日志、失败方案和旧历史一直堆在会话里。 直接输入prompt: “请整理当前任务上下文,清理失效方案、重复日志和无关历史,只保留当