ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

三步跑通 douyin-downloader:去水印下载与作者主页批量抓取快速上手

三步跑通 douyin-downloader:去水印下载与作者主页批量抓取快速上手 三步跑通 douyin-downloader去水印下载与作者主页批量抓取快速上手【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloaderdouyin-downloader 是一款免费开源的抖音下载工具一条视频可以自动挑无水印高清源直接落地作者主页能按条数批量抓取图文笔记、合集、原声音乐和直播间也都能识别处理。它全程靠命令行驱动自带去重、失败退避重试、进度条和下载完整性校验Windows、macOS、Linux 三个平台都能跑不需要写代码把配置项改成自己的链接就行。装好环境并让第一条无水印视频落盘这一步把从零到手里有一个无水印视频整件事做完装依赖、配好登录 Cookie、填一条链接、点一次运行。先克隆仓库并安装依赖只需两行命令git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader # 克隆项目 cd douyin-downloader pip install -r requirements.txt # 装依赖跑完后终端不会出现红色 Traceback最后几行是 Successfully installed ... 之类的提示说明环境就绪网络慢就耐心等中断了重跑一遍 pip 即可。Cookie可以理解为你的抖音登录凭证接口靠它判断你是否已登录推荐用项目自带的自动脚本获取它会拉起浏览器替你登录cp config.example.yml config.yml # 复制模板生成正式配置 python -m tools.cookie_fetcher --config config.yml # 自动抓取登录 Cookie浏览器弹出后扫码登录回到终端按回车脚本会提示已写入 Cookie——此时打开config.yml能看到cookies:下面几个字段已填上值。一次配置长期使用日后下载开始大面积失败再重跑一遍刷新即可。现在把视频分享短链填进配置link: - https://v.douyin.com/xxxxx # 抖音分享短链 path: ./Downloaded/ # 保存目录 video: true # 保存视频本体 cover: true # 连带保存封面 json: true # 保存元数据 JSON保存后执行python run.py -c config.yml。终端会出现一条实时进度条走完即打印成功条数打开Downloaded/能看到以作者名命名的目录里面有.mp4视频、封面图和_data.json元数据作者、发布时间、描述都在里面文件名自带发布日期的时间戳。顺带一提项目基于同一套后端还做了个桌面端 Douzy粘贴链接、看任务状态都有可视化入口命令行流程不受影响习惯哪种用哪种。把主页链接换成批量抓取限定条数、按时间裁剪、只补增量想整站搬某位博主的作品就把link里的视频短链换成主页地址https://www.douyin.com/user/xxx再配三组关键字段mode: [post]表示抓发布作品改成like抓点赞、mix抓合集、music抓原声number.post: 50表示只取最近 50 条写0表示不设上限increase.post: true开启增量重复运行时磁盘上已存在的主文件会被跳过不会下载两遍。想按时间窗裁剪再补两行start_time: 2025-01-01和end_time: 留空即不限制上界。执行方式不变还是python run.py -c config.yml。终端会实时刷新每个任务的进度与耗时结束时汇总成功、失败、跳过三类计数文件默认按作者 → 类型 → 发布日期归档每个作品一个独立文件夹。批量规模大时记得看一眼磁盘余量把path指到大容量磁盘或顺手关掉music、cover开关减负空间立刻宽裕不少。⚠️ 边界说明工具适合保存自己有权使用的内容。请尊重创作者版权下载的内容仅用于个人学习、备份或研究不要二次传播更别拿来商用。扩展玩法图文、合集、原声与直播录制的自动识别除了单条视频和主页剩下的链接类型不用换命令——写进同一个link列表就行工具会逐个识别类型分别处理图文笔记/note/xxx或/gallery/xxx每张图片独立保存配一份元数据合集/collection/xxx或/mix/xxx遍历合集内全部作品一次存完原声音乐/music/xxx优先拿直链音频缺失时回退到该音乐下的首条作品收藏夹登录账号自己的收藏mode写collect或collectmix注意这两种模式必须单独使用不能和 post/like 混写。直播间是独立流程link填https://live.douyin.com/xxxx后直接运行它会先展示房间标题、主播和在线人数录制的文件存到Downloaded/{作者}/live/主播下播或你手动 CtrlC 中断已录部分都会完整保留不会因为中断丢数据。进阶开关还有两个comments.enabled: true给每条作品额外抓评论存成_comments.jsonnotifications配置 Bark / Telegram / Webhook下载完成后自动推消息适合挂机跑大任务。不对劲时照这张清单排查批量任务中途遇到异常是常态下表按症状 → 怎么处置排列先对号入座再动手症状背后的原因处置反复只拿到 20 条左右就停了翻页触发了平台风控确认配置里browser_fallback.enabled: true脚本会拉起浏览器手动完成验证后别急着关窗口让它把剩余作品爬完个别作品报失败作品被删、转私密或接口临时限流限流场景工具会按 1s/2s/5s 指数退避自动重试网络环境差时在配置里填proxy走代理文件下载到一半变卡磁盘快满了或大文件占用带宽换大容量磁盘并改path关掉music、cover等非必要开关减负下载反复失败且集中在近期Cookie 过期重跑一次python -m tools.cookie_fetcher --config config.yml刷新凭证其余配置不用动另外提一句工具默认 5 线程并发、限速 2 请求/秒失败自动重试且带文件完整性校验不完整的文件会清掉重下大多数偶发失败不用人工干预。想继续深入文档与源码目录上面的流程覆盖了日常 90% 的用法需要往下钻时看这三处就够了README.zh-CN.md——中文完整文档含全部功能对照表和每个配置项的说明查某个字段行为以它为准core/——下载主流程、链接类型识别和 API 客户端的源码想看无水印源是怎么挑的从这里入手docs/——功能方案与设计文档自动重登录、时间范围提前终止等新机制的设计思路都写在这里。现在就去复制一条抖音分享链接运行python run.py -c config.yml然后打开Downloaded/目录——无水印视频、封面和元数据 JSON 正躺在那里等你核对。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表