ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

XHS-Downloader 小红书作品批量下载终极指南

XHS-Downloader 小红书作品批量下载终极指南 XHS-Downloader 小红书作品批量下载终极指南【免费下载链接】XHS-Downloader小红书XiaoHongShu、RedNote链接提取/作品采集工具提取账号发布、收藏、点赞、专辑作品链接提取搜索结果作品、用户链接采集小红书作品信息提取小红书作品下载地址下载小红书作品文件项目地址: https://gitcode.com/gh_mirrors/xh/XHS-Downloader想象一下你攒了一周的收藏夹一口气下载了 60 篇笔记结果打开文件夹发现全是图片1、图片2、视频1这种名字同一个作者的作品和陌生人的混在一起重跑一遍还又下了一堆重复文件。这种混乱XHS-Downloader 的小红书作品批量下载功能可以一次性解决——改好命名规则、按作者归档、命令行挑着下、下挂了自动续传全都能配。读完这篇你会带走三样东西一套不会打架的文件命名方案、按作者自动归档的配置方法以及一套命令行挑图下载和避坑经验。先把工具跑起来如果你只想要程序包直接去 Releases 下载解压双击运行就行想改配置、看源码推荐源码方式。把仓库克隆到本地后用 uv 管理依赖最省事git clone https://gitcode.com/gh_mirrors/xh/XHS-Downloader cd XHS-Downloader uv sync --no-dev uv run main.pyPython 版本要求不低于 3.12。程序是文本界面TUI把小红书作品链接粘贴进输入框、点下载作品文件就能开下支持一次粘贴多个链接用空格分隔xhslink.com短链接也认。首次运行后会在Volume/目录下自动生成settings.json配置文件后面所有配置都改这一个文件即可改完重启程序生效。默认参数定义在 source/module/settings.py 里对着它就能看懂每个字段。场景一给文件定一套不会打架的命名规则默认命名格式是发布时间 作者昵称 作品标题三段用空格隔开。问题在于两篇笔记如果标题相同、发布时间又一样文件名就会撞车而标题里带问号、斜杠的笔记还可能被系统直接拒绝。name_format字段支持的变量远不止这三个字段之间用空格分隔可以任意组合字段名含义发布时间 / 最后更新时间作品发布或最后更新的时间作者昵称 / 作者ID创作者的名字或唯一编号作品标题 / 作品描述笔记的标题与正文描述作品ID / 作品类型笔记唯一编号以及图文、视频等类型点赞数量 / 收藏数量 / 评论数量 / 分享数量作品互动数据作品标签笔记携带的话题标签几个我常用的组合挑了三种不同思路作者ID 作品ID 作品标题作者ID 和作品ID 全局唯一彻底杜绝重名适合存量大、求稳的用户作品标签 作品标题 发布时间话题标签放最前文件管理器里排序时同一话题的作品会自动聚在一起发布时间 点赞数量 作品标题把数据塞进文件名以后回看归档时不用打开文件就知道当年哪篇爆过。在settings.json里改一行就完事name_format: 作者ID 作品ID 作品标题 建议把作品ID或作者ID放进格式里。纯标题命名看着漂亮但小红书笔记重名率很高唯一的编号才是防碰撞的保险。场景二按作者归档让文件夹自己长出来单靠文件名不够几百个文件堆在一个Download目录里照样难找。把author_archive设为true程序就会给每个作者开一个独立子文件夹文件夹名格式是作者ID_作者昵称。以后这个作者再发新内容你继续下载文件自动落到同一个文件夹里归档结构是滚动生长的不需要你手动整理。这里有两个进阶开关值得一起开mapping_data给作者设别名。比如某个博主你更习惯叫老饭就在映射表里写作者ID: 老饭文件夹名会直接用你的别名作者改名也不影响你的目录结构write_mtime把下载文件的修改时间改写成作品发布时间。这样文件管理器按时间排序时看到的顺序就是笔记的实际发布顺序而不是一堆下载那天全挤在一起的时间戳。如果还想让每篇笔记单独占一个文件夹图文作品往往有几张图加一个视频再打开folder_mode文件夹名会沿用命名格式生成的文件名。三层结构叠起来就是下载根目录 → 作者文件夹 → 单篇笔记文件夹最外层是程序帮你建的你只负责往里丢链接。场景三命令行挑着下只拿想要的图图文笔记动辄九张图有时候你只要第一张封面或者中间那两张。TUI 界面只能整篇下但命令行模式提供了--index参数按图片序号挑着下序号用空格隔开uv run main.py --url 作品链接 --index 1 3 5注意一个限制带了--index时一次只处理首个链接不带它时反而可以塞一串链接。批量挑图下载时可以把链接写进批处理脚本里逐条执行。命令行还能临时覆盖大部分配置比如--image_format WEBP改图片格式、--author_archive true临时开启作者归档不用动settings.json。想看完整参数表跑一次python main.py --help。踩坑实录这些坑都是替我下过一遍第一次批量下载我把一个博主的 40 篇作品全下了第二天又粘贴同一批链接补一次结果又下了一整套——因为当时download_record是关的程序只认文件在不在不记得下过谁。开启后程序会把成功下载的作品 ID 记进数据库重复链接直接跳过哪怕你把文件删了它也不重新下想重新下就得先去数据库里删掉对应记录。批量党强烈建议保持默认开启。第二次坑在画质上。不配 Cookie 程序也能跑但视频只能拿到低分辨率版本。Cookie 不是登录凭证而是网页版请求头的一部分按 README 里获取 Cookie一节的操作从浏览器开发者工具里复制出来填进settings.json的cookie字段即可。还有两个容易忽略的点。一是链接时效作品链接里携带日期信息太旧的链接可能触发风控批量下载前记得重新提取链接。二是图片格式image_format默认 JPEG设成HEIC能更省空间但部分作品没有 HEIC 源文件此时会回落到 WEBP想服务器给啥就是啥可以设AUTO。进阶玩法浏览器里攒链接程序里批量收如果你经常浏览小红书可以装配套的用户脚本配合 Tampermonkey 浏览器扩展。浏览到感兴趣的笔记时点脚本菜单里的推送下载任务链接会直接推给后台运行的主程序程序按你自己配的命名规则和归档方式处理。这样刷的时候顺手攒、回头一次批量下载就闭环了比手动复制链接省心很多。程序本身还支持断点续传下载中断再重跑时会自动读取已写入的临时文件字节数用 HTTP 的 Range 请求从断点继续不用整包重来。配合命令行模式你甚至可以写一个系统定时任务每天夜里自动跑一遍待下载链接文件把小红书作品批量下载变成一件完全不用动手的事。【免费下载链接】XHS-Downloader小红书XiaoHongShu、RedNote链接提取/作品采集工具提取账号发布、收藏、点赞、专辑作品链接提取搜索结果作品、用户链接采集小红书作品信息提取小红书作品下载地址下载小红书作品文件项目地址: https://gitcode.com/gh_mirrors/xh/XHS-Downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表