
Agent 最大的坏习惯不是答错是替你做。读一本游泳书和下水游是两件事。看书时你觉得动作都懂了下水才发现身体不听使唤。知识和技能走的是两条路知识可以靠阅读获取技能只能靠练习建立。光看不练看懂了只是虚假流畅度——合上书什么都没留下。Agent 当老师最大的问题就在这里它直接替你做了。你问怎么写它把代码贴给你你问怎么改它把改好的版本贴给你。全程在看没有做练的是识别不是提取。除此之外反馈也没有结构这轮说结构下轮说命名无法递进一次输出一整屏不知道从哪改起把参数知识当标准答案换个版本答案就变了没有目标也没有记忆每次见面都问你想学什么。coach 的解法用户动手AI 反馈用户改循环。AI 是反馈者不是代做者。动机先行不是题目先行来做这道题和你为什么想学这个是两种教练。前者给你一个抽象的练习后者先搞清楚你要解决什么问题。coach 第一步不是出题是问动机把动机翻译成可观察的目标——“能独立判断这段代码好不好、为什么”而不是提升编程能力。目标写进 mission.md你确认后才开始练。mission 一旦共识不每次重问下次来说继续练coach 读 mission 确认方向没变直接进练习。起手这次练什么每次练习从你的状态出发不是教练拍脑袋你带了作品来 → coach 问你觉得这里最大的问题是什么先让你自己判断你想练但没动手 → 给最小起手式比如先写最烂的一版写出来才有东西可改你不确定练什么 → coach 根据 mission 和上次的卡点推一个你刚好够得着的练习反馈原理和规矩每次反馈前coach 用四条原理校准ZPD——只说刚好够得着的下一步。太远的不管太近的不说。提取 识别——问你觉得这里为什么不对“不说这里应该改成 X”。看懂了是虚假流畅度费力从记忆里拉出来才是真会。知识降难度技能加难度——你缺知识给最小解释用类比或心智模型讲清底层形状不堆语法不堆术语你缺技能不给答案加难度让你自己挣出来。最后一条管节奏间隔 交错。同类练习不连续做变体题混入相关主题快速反馈即时闭环。原理之外还有硬规矩一次最多两个反馈点。多了你会先挑好改的最难的那条永远排最后。不直接给答案。说问题是 X你试试怎么改不说改成这样。反馈要触发提取不是替你写。展示挣扎过程不直接宣判。你可能觉得这样写行但跑起来会变成 X比这里错了有用——前者让你看到后果自己判断。每个反馈带具体例子。空泛的这里不够清晰不算反馈。比如你写了一条 skill 的 Done when 是用户理解了coach 不会说改成可观察的行为而是问“用户理解了’你怎么检查Agent 能从外部看到’理解’吗”——你自己想通要改成能从外部检查的比它直接告诉你记得牢。有状态不是金鱼“你好你想练什么”——每次都这样开场的教练没有记忆。coach 每个主题一个目录/memory/theme/ mission.md ← 动机与目标共识后谨慎改 progress.md ← 已会、卡点、间隔建议按日期追加 /references/ ← 外部权威资料链接 一句话摘要你说继续练 Xcoach 读 progress.md 的卡点字段从那里起步不是从零开始。每次练完coach 往 progress.md 追加你掌握了什么、卡在哪、建议几天后回来做变体题、下一步可以往哪走。间隔不是拍脑袋卡点掌握度打 1–10 分1 分隔 2 天5 分隔 13 天8 分隔 55 天10 分隔 144 天——弱的多练强的淡出。权威外置不靠参数知识反馈的依据不来自我觉得。优先级用户表达的标准 mission 中的目标 references/ 中的外部权威 参数知识设计练习、给反馈都引用外部资料参数知识是兜底。涉及具体 API、版本号、事实性内容时先查文档再说宁可慢不凭参数知识猜——教练教错比不教更糟。何时算完教练数的不是题数。你连续两次改完不需要反馈就对了——能独立判断好不好、为什么——到了这一步coach 就该闭嘴。开源链接coach