跳到内容
AI Coding Guideline
Esc
导航打开⌘J预览
本页内容

AI Coding Guideline

本指南面向 Claude Code、Codex 给出可落地实践,说明聊天问答与自主工具调用的本质差别,以及上下文、缓存和工程化如何决定速度、成本与质量

面向 Claude Code、Codex 等 AI 编程工具的实践指南。聊天是一问一答;编程 Agent 会在一轮任务里自主执行几十上百次工具调用。决定速度、成本和质量的,不是提示词写得妙不妙,而是上下文、缓存,以及把“找上下文”的开销工程化掉。

指南从哪里读起

三件更底层的事

  1. 上下文是稀缺资源。 系统提示、工具定义、CLAUDE.md、每一次文件读取、每一条命令输出,全都在消耗窗口。详见 什么是 Tokenize上下文窗口与 1M避免工具爆炸
  2. 缓存决定了成本和速度。 Agent 的每一轮请求都会把整个对话历史重新发给模型。Prompt Caching 让前缀不变的部分以 1/10 的价格命中,前提是不破坏前缀。详见 缓存是什么、如何控制避免大上下文反复重建缓存
  3. 把“找上下文”的开销工程化掉。 把可复用知识沉淀到 CLAUDE.md / AGENTS.mdSkillsRepoPrompt 的 Codemap

完整目录见 指南总览。迁移范围与上游提交见 内容来源

最后更新于 2026年8月31日

这个页面有帮助吗?