宝玉的分享· 宝玉·· 2026-04-06精选AI 评分80
Claude Code 省 Token 指南:慎用 1M 上下文,不开新会话或者总是开新会话都不对
AI 导读
作者指出频繁开启新会话会触发全价上下文重建从而增加成本,建议理解提示缓存机制后优先在活跃会话中继续工作。文中详细说明了缓存前缀匹配与存活时间规则,提供了禁用 1M 上下文及设置自动压缩阈值的 JSON 配置代码。此外还列出了精简 CLAUDE.md、限制模型阅读范围及使用子智能体隔离上下文等六条操作规则以减少 Token 消耗。
推荐理由
原文基于提示缓存机制纠正了频繁开新会话的习惯,并给出了模型切换与上下文压缩的具体配置方法。
来源:宝玉的分享 · baoyu.io