ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

如何用 Academic Research Skills 的 7 级证据金字塔给文献来源做证据质量评级?

如何用 Academic Research Skills 的 7 级证据金字塔给文献来源做证据质量评级? 如何用 Academic Research Skills 的 7 级证据金字塔给文献来源做证据质量评级【免费下载链接】academic-research-skillsAcademic Research Skills for Claude Code: research → write → review → revise → finalize项目地址: https://gitcode.com/GitHub_Trending/ac/academic-research-skills你手上有一批候选文献APA 引用、DOI、报告或预印本需要判断每一条到底属于什么等级的证据、能否作为主要证据引用。Academic Research Skills 是一个面向 Claude Code 的技能包其中deep-research技能把这件事做成了可执行流程source_verification_agent按照 7 级证据金字塔Level I–VII给每个来源定设计等级再按 6 个维度的 A–F 评分表合成总体等级最后产出一份带质量矩阵的 Source Verification Report。评级规则完整定义在 source_quality_hierarchy.md 中运行它需要 Claude Code 环境已加载该技能包你只需要准备好来源清单按触发方式让对应 agent 执行。先看懂 7 级金字塔等级是怎么划分的评级前的共同语言是这张等级表来自 source_verification_agent.md 与 source_quality_hierarchy.mdLevel证据类型权重示例ISystematic Reviews / Meta-analyses最高Cochrane reviews、Campbell reviewsIIRandomized Controlled Trials (RCTs)很高设计良好的 RCTIIIControlled Studies非随机高准实验、队列IVCase-Control / Cohort Studies中高纵向、回顾性研究VSystematic Reviews of Descriptive Studies中定性研究的综述VISingle Descriptive / Qualitative Studies低中案例研究、民族志VIIExpert Opinion / Committee Reports最低立场论文、社论每个等级在参考文档中都有特征与警示Caveats例如 Level I 的结论质量取决于其纳入的研究本身garbage in, garbage out在快速变化的领域可能过时Level II 在社会科学/教育学中常不可行。读评级结果时对照这些条目能理解某个等级为什么带保留意见。文档同时强调评级分两个不可混用的轴Study-design level研究设计在实验—描述光谱上的位置即上面这张表绝对且与学科无关Fitness for claim within a discipline该来源相对于它自己学科对特定论断而言的证据适配度。这就是为什么一个人文领域的一手档案设计等级只有 Level VI仍可能拿到总体 Grade A——因为 Level VI 在人文领域就是 gold standard。混用这两个轴会把优秀的解释性/定性研究压死在低分上。执行评级在 Claude Code 中触发 source verification准备条件只有一项候选来源清单。来源可以是你检索得到的文献列表APA 7.0 格式引用 DOI 更佳有 DOI 的来源能走更完整的存在性验证也可以是 Material Passport 里的literature_corpus[]语料。触发方式按 SKILL.md 的模式选择指南主路径有两条lit-review 模式有主题、需要文献梳理bibliography_agent先做系统检索并产出 Annotated Bibliography随后source_verification_agent对来源做证据分级。模式选择依据是Need literature review for a topic →lit-review。fact-check 模式已有一批论断/来源需要查核该模式只激活 Source Verification agent输出 Verification report300–800 词。触发示例可参考 fact_check_mode.md用户直接给出待查核的论断列表agent 逐条对照证据核验并给出判定。触发关键词包括 research、literature review、fact-check 及对应中文研究、文献回顾、事实查核等。执行流程中 source verification 属于 Phase 2Investigation其产物——Verified Graded Sources、Source quality matrix——是 Phase 3 综合阶段的前置输入即评级完成前流水线不会跳到综合。6 维度 A–F 评分表与总体等级合成设计等级定完后每个来源按 6 个标准各打一个 A–F 分完整表格见 source_quality_hierarchy.md 的 Grading Rubric 一节维度Grade A示例Grade F示例Evidence Level达到/超过本领域该论断的 gold standard无法归类或根本不适配该论断Peer Review严格同行评审自出版Methodology典范、可复现缺失/有缺陷Sample/Data大且具代表性未说明Currency3 年内对该主题已过时Conflicts无声明或检测出的利益冲突明确的未披露冲突合成总体等级走三步顺序不可跳过Integrity floorConflicts 为 F明确未披露冲突或 Peer Review 为 F 且该领域把正式评审视为常态则总体直接封顶 D——诚信问题不能被其他维度的强度抵消Base grade取 6 个维度分数的中位数A4 … F0 标度相邻等级平分取低Fitness adjustmentEvidence Level适配度为 A 时上调一级——达到本领域 gold standard 的来源可以到总体 A即使 Currency 或 Sample/Data 分数偏低但若 Methodology 为 F 则不适用此步且任何情况不超过 A。总体等级对应的使用决策是明确的A作为主要证据使用B作为支撑证据C附带明确保留意见使用D仅在无更好来源时用于兜底并承认其弱点F不要使用只在批评性引用时提及。Field-Specific Adjustments表按学科调整 gold standard 预期医学/健康以 Level I–II 为 gold standard教育学常见 Level IV–VI社科 Level III–V政策研究接受 Level IV–V VII专家报告人文的 gold standard 就是 Level VI 一手材料技术领域是 Level III 产业报告同行评审滞后于现实。给来源打分前先查这张表确定本领域的 gold standard 在第几级Evidence Level 维度才打得出 A。参考存在性验证防止金字塔打在虚构文献上证据等级再高前提也是来源真实存在。验证走三层覆盖度要求见 cross_agent_quality_definitions.md100% DOI 检查 50% WebSearch 抽查Tier 0Semantic Scholar API100% 覆盖有 DOI 的走 DOI 查询无 DOI 的走标题检索标题 Levenshtein 相似度 ≥ 0.70 且年份匹配±1 年内记为匹配。DOI 能解析但标题相似度 0.70 时标记DOI_MISMATCH——这是已知的幻觉引用模式之一Tier 1DOI 解析100% 覆盖DOI 必须解析到真实页面标题与作者匹配DOI 返回 404 或标题差异 3 个词自动标记Tier 2WebSearch 抽查50% 覆盖随机抽 50% 来源用精确标题 第一作者 年份检索确认来源存在于所声称的刊物、年份一致优先把 tier_3、tier_4学术非同行评审、灰色文献全部先查再从 tier_1/tier_2 中抽样。最终存在性判定是五选一S2_VERIFIEDSemantic Scholar 匹配、VERIFIEDDOI 解析且元数据匹配、PLAUSIBLE无 DOI 但 WebSearch 确认存在、UNVERIFIABLE所有方法都无法确认标记转人工、FABRICATED所有层级都失败CRITICAL必须移除。技能文档把这条定为 IRON RULEdifficult to verify 不算通过灰色地带即 FAIL——无法确认存在的文献不进入报告。核对输出报告、评估卡与完成条件评级完成后你会得到两类产物可以逐项核对Source Verification Report格式定义见 source_verification_agent.md 的 Output Format 一节核心是 Source Quality MatrixSourceLevelVenueAuthorMethodCurrencyCOIOverall简写引用I–VIIpass/warn/failpass/warn/failpass/warn/failpass/warn/failpass/warnGrade报告同时包含被标记来源的明细Issue / Severity / Recommendation: Include with caveat、Downgrade 或 Exclude / Evidence、Predatory Journal Alerts、COI 披露和 Verification Limitations哪些没验证到、为什么。Evidence Assessment Card按 evidence_assessment_template.md 逐来源一张卡覆盖 Source Identification、Evidence Level 及 Justification、Publication Venue、Author Credibility、Methodological Quality、Currency、COI 六段最后落到 Overall 的 A–F 与使用建议勾选框。模板的使用说明给出了批量作业的完成条件可作为验收清单每个来源都必须拿到 I–VII 的设计等级所有 Grade D/F 来源必须有书面理由任何 predatory journal 标记要求完整验证最低抽查20% 的来源做全卡评估。质量门槛方面agent 定义还要求所有 predatory 期刊检查有据可查、所有来源完成 COI 评估、至少 30% 的事实性论断经过独立来源交叉核验。fact-check 示例fact_check_mode.md展示了完整输出形态每条论断给出 Verdict、Verification Basis、Source 与 Correction Suggestion末尾附判定统计表。注意该文件中的具体数据如高校数量、师生比只是示例结果不要当作固定预期。边界与已知限制Domain Evidence Profile 只影响准入不改分数domain_evidence_profiles.md 定义的上位学科档案如cs_ml、humanities_interpretive、general_social_science只改变文献筛选接收哪些证据类型从不改变 A–F 总体等级、从不阻塞流程且需要学者确认后才生效默认值是unknown_user_defined中性单金字塔。clinical、education等仍是预留档案选择它们会回落到默认。Currency 是相对论断的奠基性或历史来源在论断就是关于该来源本身或其时代时不因年代扣分只有在时效与论断相关如论断领域现状时才套用 3/5/10 年分档。快速变化领域的取舍agent 核心原则指出快速领域中 2015 年的 meta-analysis 可能不如 2024 年的原始研究有相关性——等级高不代表自动可用。Predatory 期刊红旗激进邮件征稿、72 小时内录用、无法识别的编辑委员会、未被 Scopus/WoS/PubMed 收录、非 COPE/DOAJ 成员、影响因子异常、范围过宽等命中即列入 Predatory Journal Alerts核验资源DOAJ 白名单、COPE 成员名录、Scopus Source List 等在参考文档中列名按名检索即可。红旗不是审查flag 一个来源只表示上报疑虑不静默剔除——剔除必须走报告里的 Recommendation 并注明依据。核对完 Source Quality Matrix 后评级任务即告完成Grade A/B 的来源进入主要/支撑证据C 级附带保留意见使用D 级仅兜底F 级含FABRICATED与 predatory 全验证后确认的期刊来源移除。后续如需基于这份已验证的文献清单写论文deep-research的 Handoff Protocol 会把 Annotated Bibliography 交给academic-paper的 intake 阶段复用不必重新检索。【免费下载链接】academic-research-skillsAcademic Research Skills for Claude Code: research → write → review → revise → finalize项目地址: https://gitcode.com/GitHub_Trending/ac/academic-research-skills创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表