
pstack的perf-issue与hillclimb一次性能修复与持续优化的区别【免费下载链接】pstack-claudeClaude Code, Codex, Copilot, Pi, OpenCode, Gemini, and Prime Agent versions of Potetos pstack. Rigorous agent workflows with Cursor primitives translated for other harnesses.项目地址: https://gitcode.com/GitHub_Trending/ps/pstack-claudepstack是一个把 Poteto 的严格 Agent 工作流移植到 Claude Code、Codex、Pi 等多个运行时的开源项目。其中 poteto-mode 技能内置了两套性能工作流perf-issue针对单次性能问题的基线式修复和hillclimb围绕单一指标持续优化的爬山循环。搞懂两者的区别是用好 pstack 做 AI Agent 性能调优的第一步。什么时候用哪个一句话判断在 poteto-mode 的剧本清单中两者的定位写得很清楚Perf issue一次性的慢 → 采集基线、定位瓶颈、修复并复测然后收工。Hillclimb对一个可度量的指标进行持续、科学的改进 → 假设循环 决策日志 每次接受的修复一个提交。简单说修一次用 perf-issue要磨到目标值用 hillclimb。perf-issue 剧本结尾也明确提示若追求对某个指标的持续改进请转用 hillclimb 剧本。perf-issue一次性能修复的完整流程perf-issue.md 的核心态度是你拥有整个度量叙事——规划、评审、验证每一个数字绝不能用读源码代替去测量。流程共 6 步抓基线先采集基线 trace并用benchmark-checklist技能审查基线和之后的每一个数字按顺序尝试性能口诀从最便宜的开始别做删掉没用的活做了但别再做了缓存少做延后做趁没人注意时做并发做更便宜地做⚡ 前面某条口诀已达到目标就停手不要过度优化从 trace 规划修复跨函数边界先走 architect 设计委派子代理实现复审 diff抓修复后 trace对比产物解析前后工件做 diff结论不明不算通过在 PR 中引用度量数据走 Opening a PR 流程收尾。最终回复只要求四样东西基线数字、修复后数字、差值、工件路径。hillclimb持续优化的循环纪律hillclimb.md 面向把某个指标一路推到目标的场景核心纪律只有一句一次一个改动、一次一次测量保留或回滚绝不叠加未经验证的改动。完整循环先扎根再选指标用 how 技能摸清工作负载与架构选定能复现用户抱怨的用例定死一个指标、更好的方向、以及可检查的停止条件如比基线快至少 50%且至少跑满 10 轮防止早期幸运值提前终止搭建并冻结测量台架先证明台架有灵敏度能区分快慢用 benchmark-checklist 审查后冻结。冻结后的台架用一条可复现命令输出指标取 N 次中位数而非单次运行并记录基线与回归测试全绿打开决策日志一份decision.tsv每轮一行——假设、改动、前后数字、差值、测试、保留/回滚裁决假设要具体到机制写把 X 移出启动路径因为它阻塞首屏而不是试试加个 memo性能类假设按 perf-issue 的口诀顺序排序循环每轮一个假设 → 子代理小范围实现 → 台架前后测量 回归门禁 →指标越过噪声且门禁全绿才接受否则完整回滚。每次接受的修复一个提交每轮都记日志突破第一个平台期连续几次被拒后换类别、合并差一点的方案、重读源码甚至试更激进的改动——正确性和简洁性优先于数字按停止条件收尾绝不放宽条件凑数把接受的提交按落地顺序堆叠成 PR。回复内容包括指标与目标、基线到最终及百分比差值、迭代数保留 vs 回滚、每个接受的修复一行、决策日志路径以及如果继续压下一个会试的想法。两者区别速览维度perf-issuehillclimb目标修掉一次性的慢一个指标持续逼近目标值测量台架基线 修复后各采一次先建台架、验证灵敏度、冻结改动方式按口诀顺序尝试达标即停严格一次一个改动保留或回滚记录PR 中引用前后数字decision.tsv决策日志每轮一行提交策略修复即收工每个接受的修复单独一个提交停止条件目标达成显式停止条件目标值 最少迭代数背后支撑它们的三个技能这两个剧本不是孤立文档而是复用 pstack 的原则技能benchmark-checklist任何性能数字出厂前都要过的 7 问清单——限制器是什么双方都调优了吗数字没超物理上限吗有错误吗可复现吗各至少 5 次交替运行、报中位数有意义吗活真的执行了吗show-me-your-work提供decision.tsv决策日志格式让 hillclimb 的每一轮都可审计principle-prove-it-works禁止看代码觉得更快了一切结论必须来自真实工件的验证。如何选择并上手 给新手的建议用户说接口慢了帮我修一下 → 用perf-issue六步走完即交付用户说把 p50 延迟从 800ms 压到 300ms → 用hillclimb先花时间把测量台架建对并冻结再进循环想给项目定制自己的流程可在.agents/playbooks/下扩展这两个剧本并运行check-playbooks.mjs校验兼容性。两者的共同底座只有一条数字必须来自测量结论必须可复现。这正是 pstack 工作流区别于让 AI 随便改改的关键所在。【免费下载链接】pstack-claudeClaude Code, Codex, Copilot, Pi, OpenCode, Gemini, and Prime Agent versions of Potetos pstack. Rigorous agent workflows with Cursor primitives translated for other harnesses.项目地址: https://gitcode.com/GitHub_Trending/ps/pstack-claude创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考