ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

research 技能实战指南:在 skills13/skills 中用后台 Agent 完成主源文献研究,产出带引用的 Markdown 文件

research 技能实战指南:在 skills13/skills 中用后台 Agent 完成主源文献研究,产出带引用的 Markdown 文件 research 技能实战指南在 skills13/skills 中用后台 Agent 完成主源文献研究产出带引用的 Markdown 文件【免费下载链接】skillsSkills for Real Engineers. Straight from my .agents directory.项目地址: https://gitcode.com/GitHub_Trending/skills13/skills本文基于 docs/engineering/research.md 整理撰写并结合仓库内 research 技能本体、wayfinder、ask-matt 等源码级资料交叉印证。本文不输出任何外部链接仅以仓库内证据说明该技能的行为、边界与已知问题。导读research是 skills13/skills 技能仓库中一个模型自动触发型model-invoked的工程技能当你需要弄清楚某个工作目录之外的事实某个第三方 API 的行为、某份规范的真实表述、某个版本声明是否成立时它会在后台拉起一个独立 Agent只依据主源文献primary sources逐条核实然后把带引用的结论写成一个 Markdown 文件留在仓库里让你可以继续做手头的事。读完本文你将掌握该技能的触发时机、后台委托模型、文件落盘约定、七个高频问题及其已知缺陷以及它在整个技能体系ask-matt 路由图中的位置——既能照章使用也能绕开它的坑。一、research 是什么从拥有答案的源读取而非在对话里作答技能本体 skills/engineering/research/SKILL.md 的 frontmatter 中给出了精确的定位Investigate a question against high-trust primary sources and capture the findings as a Markdown file in the repo. Use when the user wants a topic researched, docs or API facts gathered, or reading legwork delegated to a background agent.即针对高信任的主源文献做调查并把发现以 Markdown 文件形式沉淀进仓库。文档 docs/engineering/research.md 进一步界定了主源文献的含义官方文档official docs源码source code规范specs第一方 APIfirst-party APIs其核心工作方式可以概括为两条每一个论断都要追回到拥有它的源。它不会在某个博客对 API 的转述上停步只要该 API 自己的文档可达就一定会去读原始文档。文档原文的表述是it follows every claim back to the source that owns it——每个说法都要找到其所有者。它不在对话里回答你。research的输出是一个文件写在仓库中本来就存放这类笔记的位置且每个论断都带链接。这是它的设计意图给你一份可以批注、可以交给另一个 Agent、也可以直接扔掉的文档而不是一个会随会话结束而消失的临时回答。技能本体把后台 Agent 的工作明确为三步见 SKILL.md针对问题调查主源文献官方文档、源码、规范、第一方 API而非对它们的二手转述把每个论断追回到拥有它的源。把发现写入单个 Markdown 文件为每个论断标注来源引用。把文件保存到仓库中本来就存放这类笔记的地方匹配既有约定如果没有约定就放到一个合理的位置并明确告知位置。从 agents/openai.yaml 可以看到其在 Codex 侧的注册元数据interface.display_name: Research、interface.short_description: Research from high-trust sources说明该技能在 Claude Code 与 Codex 双 harness 下均可被识别。二、什么时候用它一张需要什么就选什么的决策表2.1 触发方式两种触发路径显式触发直接输入/research。自动触发当任务演变为阅读苦力reading legwork时模型会自动捡起该技能。这一点也反映在 skills/engineering/README.md 中——research被列在Model-invoked模型可调用分组下说明它不属于disable-model-invocation: true的用户显式技能模型可以凭借丰富的触发措辞自主选择它。2.2 决策表当下一步是从工作目录之外弄清楚某件事第三方 API 如何表现、规范到底说了什么、某个版本声明是否成立时你需要的产出决定了该选哪个技能。原文档给出了这张对照表你需要什么该用哪个一个决策正在等待的外部事实research通过访谈方式与你一起做出的决策grilling要写进CONTEXT.md和 ADR 的持久架构决策grill-with-docs验证某个方案在你的代码库里是否可行prototype一个单会话装不下的庞大计划wayfinder2.3 research 与 grill-with-docs 的分界线产出物的保质期research与grill-with-docs之间的界线在于产出的保质期shelf liferesearch产出的是短命资产例如这个库当前的鉴权机制是怎么工作的截至本周。ADR架构决策记录记录的是你要长期保留的决策。因此如果你产出的是一份决策而不是一个事实你其实在 grilling访谈而不是 research。这是整个技能体系中非常关键的一个判断事实类问题交给 research决策类问题交给 grilling 系技能。三、委托式阅读research 的定义性动作3.1 后台运行你继续干活research最具辨识度的设计是阅读在后台 Agent 中运行。你继续工作它离开去把每个论断追到主源写成一个 Markdown 文件然后回来报告。原文档对此有一句精确的概括Research is legwork you delegate, not thinking you outsource: you get a document to grill, plan, or design against, and you still make the call.即research 是你可以委托出去跑腿的部分而不是外包出去的思考。你拿到一份可以拿去 grilling、planning 或 designing 的文档最终拍板的人仍然是你。这也解释了为什么在 ask-matt 的路由中它被列为 Standalone 技能research 产出的是喂给思考技能的事实材料它自己不做决定。3.2 未设防的委托嵌套是文档明说的粗糙边缘委托是不加设防的unguarded后台 Agent 还可以再拉起一个自己的后台 Agent。原文档直言这是该技能记录在案的最大粗糙边缘the skills best-documented rough edge具体表现见下文第四节的二次 Agent问题。3.3 文件落点与数量约定落点由仓库决定不由技能决定它匹配仓库里既有的笔记约定若仓库没有约定就选一个合理位置并告诉你路径。每次运行只写一个文件one file per run。这意味着research不会私自创建一套新的目录结构也不会污染仓库既有的组织方式。四、七个高频问题完整继承原文档的 QA原文档用整整一节回答了使用者的常见疑问本节完整保留这些问题与答案并补充源码佐证。Q1它又拉起了一个 research Agent这是设计如此吗不是。这是一个公开 bugissue #530。原因在于技能告诉调用方去拉起一个后台 Agent但没有限制 Agent 的类型于是它拉起来的是一个general-purposeAgent——这个 Agent 拿着同样的指令和Agent工具于是又触发了一轮同样的调用形成嵌套。已知证据均来自原文档记录有报告者实测单次 research 任务在三次重叠运行中消耗了约 45 万 tokens重复的那个运行在半小时后完全脱离视野地结束。该问题不仅限于 Claude Code同样的嵌套在 Codex GPT-5.6-sol 上也得到了复现。官方没有发布修复。有用户通过给本地已安装副本加一行指令——告诉已经是 subagent 的 Agent 自己完成工作——来打补丁但这只是指令层面的缓解不是结构性修复。操作建议调用后盯住后台任务列表发现重名重复任务就停掉它。Q2反向故障也存在——技能静默地什么都不做如果你的全局指令禁止 Agent 再次委派工作那么后台 Agent 会礼貌地拒绝任务而技能会静默地什么都不做。也就是说research的委托链条对宿主环境的指令是敏感的过度放开的指令导致嵌套Q1过度收紧的指令导致空转Q2。Q3文件应该放哪要不要提交进 git技能的立场是放在仓库本来就放笔记的地方除此之外没有更多意见。社区的共识是相对确定的ADR 保留research 文件不保留。来自 Discord 讨论中对此问题最尖锐的表述ADR yes. Everything else archive or delete after done. It otherwise becomes cruft of work and can poison future repo reads if youve drifted away from the spec/research.ADR 保留其余做完就归档或删除否则它会变成工作的杂物如果你已经偏离了规范/研究还会毒化未来对仓库的阅读。根本原因research 文件记录的是写下当天当时为真的内容所以过期的研究文件比没有更糟。综合来看这些产物其实不太属于 git社区也没有统一的规范存放地有人用 Obsidian有人用独立的知识仓库也有人放到 issue tracker 里。Q4什么算高信任主源由谁决定由模型决定。技能只命名了合格来源的种类官方文档、源码、规范、第一方 API但没有白名单no allowlist没有域名门禁no domain gate没有验证环节no verification pass这是该技能最初被提出时最响亮的反对声且从未被公开回应过Five research subagents pointed at junk just gives you five confident wrong answers faster. How are you gating what counts as high-trust sources?五个指向垃圾资料的 research 子代理只会更快地给你五个自信的错误答案。你如何把关什么算高信任源你真正拥有的缓解手段是每条论断上的引用随机跟两三条引用去看。如果它们落在对某件事的转述而不是那件事本身那么这次运行就在它唯一的工作上失败了。Q5之后的会话会复用早前运行的结果吗不会。没有任何机制自动加载过去的 research 文件它只是一份躺在仓库里的文档直到有人类或技能主动指向它。这是该设计早期就被提出的最强挑战the values the markdown becoming context the agent re-reads later, not the fetch itself. A write-once dead file is just a fancy search.价值在于 Markdown 后来成为 Agent 重读的上下文而不是抓取本身。一个只写一次的死文件只是花哨的搜索。已发布的技能没有解决这个问题。实践中的做法是刻意把文件喂进下一步——挂到 spec 上、引述进 grilling 会话、让一张 ticket 指向它。结合 to-spec 的定位把当前对话综合成 spec 并发布到 issue tracker这正是原文档所说to-spec 可以针对 research 文件做综合的用法。Q6为什么不直接让 Agent 去读文档你可以而且**去读一下文档这种两行提示词正是本技能取代的旧做法**。research相对提示词买到了两样东西后台运行会话的上下文保持干净不把整批阅读内容灌进你的主线程。输出一致性主源约束 带引用的文件输出每次都按同样的方式产出而不是取决于你当时怎么措辞。而相对于 harness宿主环境自带的 deep-research 模式差异在产物和源纪律上而不在搜索能力本身。原文档给了一条很务实的建议如果两行提示词在小问题上就能满足你就用两行提示词。Q7它什么时候停止阅读技能里没有停止准则。这个缺口表现为两个看似相反、实则同一根源的抱怨有的 Agent钻得太深有的 Agent覆盖面广却漏掉了真正关键的那一个细节。实践者的原话deep-research skills are a bit too deep sometimes. And telling an agent to research usually results in missing crucial details.deep-research 技能有时候太深了。而告诉一个 agent去研究通常会漏掉关键细节。范围界定scoping的责任在你。一个窄的、可回答的问题一个 API、一个行为、一个版本声明的效果远好于笼统的研究一下 X。Q8/wayfinder创建了 research 票据我需要自己解决吗不需要现在它会替你自动触发。在 v1.1 之后未发布的变更里charting 会话会为每张 research 票据拉起一个/research子代理并行烧掉它们结果捕获在一次性research/name分支上并带上票据的 context pointer。research票据是 wayfinder每会话只解决一张票据规则的唯一例外因为它们是 AFK无人值守没有人在等它们。这一点可以在 wayfinder 技能本体 中找到实现级印证。其 Ticket Types 一节定义了ResearchAFK类型Reading documentation, third-party APIs, or local resources like knowledge bases to surface a fact a decision waits on. Resolved by a subagent that calls the Skill tool with research. Use when knowledge outside the current working directory is required.阅读文档、第三方 API 或知识库等本地资源以浮现决策所等待的事实。由调用 Skill 工具并传入 research 的子代理解决。而在其Chart the map的第 5 步明确写着对刚创建的每张 research 票据拉起一个调用 research 的子代理并行解决把发现捕获到一次性research/name分支并带上票据的 context pointer。已知的两个坑子代理曾被观察到从一条本不该合并的分支上开了 draft PRissue #576之后删除该分支会破坏票据持有的 context pointer。五、成功判据Its working if原文档给出了五条可验证的成功标准逐条保留你自己的会话在继续推进。如果你坐在那儿看着它读说明委托没有发生。恰好出现一个新的后台任务。第二个名字高度相似的任务就是嵌套 bug 的信号。出现一个新的 Markdown 文件位于仓库本来就放笔记的目录下且 Agent 告诉了你它的路径。文件里每个论断都带链接随机跟两条落在官方文档、规范或真实源码文件上而不是落在某人的转述上。你能只凭这份文件就做出之前卡住你的决策无需自己再回头翻原始资料。这五条本质上是把委托二字翻译成了可观测的信号看任务列表、看文件、抽查引用、验证决策独立性。六、它在技能体系中的位置站在思考技能的上游6.1 随时可用的独立技能不待在构建链里原文档的定位是一个随时可调用的独立技能reach-for-it-anytime standalone它的产出喂给思考型技能而不是坐在构建链build chain中。它的文件是要拿进流程里的东西grilling 和 grill-with-docs 在事实已经摆上桌面时能问出更尖锐的问题to-spec 可以针对它做综合把研究结论合成进 spec。这一点与 grilling 技能本体skills/productivity/grilling/SKILL.md的设计是互相咬合的grilling 的规则是找事实是你Agent的活儿永远不是用户的——当一个前沿问题需要来自环境的事实文件系统、工具等时应派子代理去找而不是让用户自己查。research 正是这种Agent 找事实分工的规模化形态。6.2 唯一直接调用它的技能是 wayfinder在整张技能地图中wayfinder 是唯一直接调用 research 的技能它地图上的每张 research 票据都由一个/research子代理解决详见 Q8 及 wayfinder 的 Ticket Types 与 Chart the map 步骤。除此之外research 是独立的、随时可用的。6.3 整张地图看 ask-matt要纵览 research 在整个技能体系中的位置可以看 ask-matt 的路由。在其 Standalone独立技能一节中对/research的表述是Delegate reading legwork to abackground agent: it investigates a question againstprimary sources, then leaves a cited Markdown file in the repo. Keep working while it reads. The file it produces is something to takeintothe main flow at/grill-with-docs, since research feeds the thinking rather than replacing it.把阅读苦力委托给后台 Agent它针对主源文献调查问题然后在仓库里留下一份带引用的 Markdown 文件。它读的时候你继续工作。它产出的文件是要带进/grill-with-docs主流程的东西因为 research 喂养思考而不是取代思考。这与原文档 Where it fits 一节的结论完全一致也再次印证了全篇反复出现的核心判断research 负责把找事实外包出去做决策永远留在你自己手里。七、小结用对 research 的三个关键心法综合原文档与仓库源码使用research时最值得记住的三件事问题要窄没有停止准则的情况下一个一个 API、一个行为、一个版本声明式的窄问题产出质量远高于研究一下 X。引用要抽查没有白名单、没有验证环节高信任主源完全由模型判断你的防线是随机跟两三条引用确认它们落在源本身而非转述上。文件要主动投喂没有任何机制自动复用过去的 research 文件把它挂进 spec、引述进 grilling、指向 ticket它才从一次性的死文件变成下一次决策的上下文。同时记住社区约定ADR 保留research 文件做完即归档或删除因为过期的研究文件比没有更糟。另外调用后请盯住后台任务列表出现第二个名字几乎相同的任务时那大概率是嵌套 bugissue #530及时停掉它避免一次委托变成三次重叠运行、白白烧掉几十万 tokens。【免费下载链接】skillsSkills for Real Engineers. Straight from my .agents directory.项目地址: https://gitcode.com/GitHub_Trending/skills13/skills创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表