ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Zotero-arXiv-Daily 完整指南:每天自动收到个性化 arXiv 论文推荐

Zotero-arXiv-Daily 完整指南:每天自动收到个性化 arXiv 论文推荐 Zotero-arXiv-Daily 完整指南每天自动收到个性化 arXiv 论文推荐【免费下载链接】zotero-arxiv-dailyRecommend new arxiv papers of your interest daily according to your Zotero libarary.项目地址: https://gitcode.com/GitHub_Trending/zo/zotero-arxiv-daily每天手动刷 arXiv 新提交列表挑论文很耗时静态搜索关键词也跟不上兴趣的变化。Zotero-arXiv-Daily 以你 Zotero 图书馆的内容作为研究兴趣画像每天自动筛选出与你相关的 arXiv 新论文并推送到邮箱。全程依托 GitHub Actions 运行零费用也不需要你自己维护服务器。背景与价值它替你做了三件事科研信息获取常见三个麻烦每天的新论文太多热门分类动辄几十篇人工筛选成本很高。你关注什么取决于你最近读什么。手动设定的关键词是静态的而兴趣是动态的。想自动化就得自己写脚本、部署定时任务对只想收结果的人来说是额外负担。这个项目的思路是既然你的 Zotero 图书馆本身就记录了你读过什么那它天然就是最准确的兴趣画像。项目每天拉取你的图书馆、计算每篇新论文与你的相似程度把相关度最高的那部分直接发到邮箱。你不需要写代码也不需要跑任何服务配置一次即可长期生效。工作原理从你的图书馆到你的邮箱整个过程是一条单向流水线每天自动执行一次。系统先通过 Zotero API 拉取你图书馆里所有带摘要的论文按你配置的集合路径过滤出真正代表兴趣的部分然后从 arXiv、bioRxiv、medRxiv 等你勾选的来源抓取前一日的新论文接着用嵌入模型计算每篇新论文与你全部藏书的加权相似度——最近加入的论文权重更高保证推荐跟着你的新方向走最后由 LLM 为候选论文生成 TLDR 摘要和作者单位渲染成 HTML 邮件通过 SMTP 发出。快速上手四步完成部署第 1 步获取仓库并 Fork 到账号下部署依赖 GitHub Actions 工作流所以需要把仓库 Fork 到你自己的账号下顺手点个 Star。如果你想在本地先跑一遍体验可以用下面这条命令克隆代码git clone https://gitcode.com/GitHub_Trending/zo/zotero-arxiv-daily第 2 步设置 GitHub Secrets进入仓库 Settings → Secrets and variables → Actions点 New repository secret依次添加ZOTERO_ID、ZOTERO_KEY、SENDER、SENDER_PASSWORD、RECEIVER、OPENAI_API_KEY、OPENAI_API_BASE。Secrets 设置后加密存储、任何人不可见适合放密钥类信息。第 3 步设置 CUSTOM_CONFIG 变量在同一页面的 Variables 选项卡中新建名为CUSTOM_CONFIG的变量值填入 README 提供的 YAML 模板。模板里用${oc.env:XXX}语法引用上一步的 Secrets这样密钥不用明文写进配置其余项邮箱服务器、论文来源、LLM 模型等直接在 YAML 里填写。第 4 步手动触发测试工作流打开 Actions 页面选择Test-Workflow点 Run workflow 手动运行。这个测试流是调试版本无论日期都会固定抓取 5 篇 arXiv 论文方便你端到端验证配置是否正确。运行完成后查看日志和收件箱即可。正式工作流Send-emails-daily默认每天 22:00UTC自动运行抓取前一天发布的新论文无需任何手动操作。关键配置详解真正影响效果的参数参数含义示例ZOTERO_IDZotero 账号的用户 ID是一串数字而非用户名12345678ZOTERO_KEY具有读取权限的 Zotero API 密钥AB5tZ877P2j7…SENDER/SENDER_PASSWORDSMTP 发件账号及其授权码不是登录密码abcqq.comRECEIVER接收论文推荐邮件的地址abcoutlook.comsource.arxiv.category订阅的 arXiv 分类缩写列表[cs.AI,cs.CL]executor.source启用的论文来源可多源组合[arxiv,biorxiv]zotero.include_path只把指定集合下的论文计入兴趣画像[2026/survey/**]zotero.ignore_path排除指定集合下的论文[**/misc/**]executor.max_paper_num单次邮件最多推送的论文数20llm…model生成 TLDR 所用的 LLM 模型gpt-4o-mini其中ZOTERO_ID最容易填错它不是注册用户名而是 Zotero 官网 Applications 页面里那串数字 ID。另外注意Variables 与 Secrets 的展示方式不同变量是明文可见的所以一切密钥类内容都应放进 Secrets配置类内容才放 Variables。完整的配置项说明包括 bioRxiv/medRxiv 分类、嵌入模型选择、语言设置等可直接参考 默认配置模板 中的注释。效果展示推荐邮件长这样每天到达你邮箱的是一封排版好的 HTML 邮件按相关度排序。每篇论文包含标题与作者列表以及解析出的作者单位五星相关度评分直观反映与你兴趣画像的贴合程度arXiv 编号方便检索LLM 生成的 TLDR 摘要扫一眼就知道论文核心PDF 和 Code 按钮直达原文与代码仓库如有进阶定制可以深挖的模块入口如果你对算法本身感兴趣仓库结构相当清晰几个主要扩展点检索器模块已内置 arXiv、bioRxiv、medRxiv 三个来源用register_retriever装饰器即可注册一个新来源。重排模块默认使用本地 sentence-transformers 嵌入模型也可切换为嵌入 API 方式二者实现了同一接口。邮件构建模块邮件 HTML 模板在这里渲染改样式或加字段只需动这一个文件。调度时间写在 .github/workflows/main.yml默认每天 22:00UTC可按自己的习惯修改。避坑提示三条真实易错点ZOTERO_ID 填成用户名工作流会直接查不到图书馆。去 Zotero 官网 Applications 页面复制那串数字 ID密钥在同一页面创建并勾选读权限。SMTP 密码用了邮箱登录密码QQ、Gmail 等邮箱的 SMTP 发信需要单独的授权码用登录密码会静默发信失败。周末日志显示 No new papers found这是正常现象arXiv 周末不更新不是配置出错。想验证流程请手动运行 Test-Workflow它固定抓 5 篇论文任何时间都能测通。两个补充建议max_paper_num不要设得过高论文太多加上 TLDR 生成会拖长运行时间可能超出 Actions 的免费额度fork 之后建议对上游仓库开启 Watch新版本发布时及时把更新合并进你的分支避免功能停更。结语配置完成后每天刷一遍 arXiv这件事就从你的日程里消失了——图书馆里新增的每篇论文都会悄悄修正推荐口味邮箱里到的只剩值得读的那几篇。剩下的时间可以留给论文本身。【免费下载链接】zotero-arxiv-dailyRecommend new arxiv papers of your interest daily according to your Zotero libarary.项目地址: https://gitcode.com/GitHub_Trending/zo/zotero-arxiv-daily创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表