ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

抖音下载完整指南:douyin-downloader 五分钟跑通去水印批量下载与主页备份

抖音下载完整指南:douyin-downloader 五分钟跑通去水印批量下载与主页备份 抖音下载完整指南douyin-downloader 五分钟跑通去水印批量下载与主页备份【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloaderdouyin-downloader 是一个命令行抖音下载工具一条链接加一份 YAML 配置无水印视频、图文、合集与音乐就批量落盘归档。它把去水印挑源、SQLite 去重、失败重试这些杂活做成了默认行为适合想长期存档抖音内容、会一点命令行的你只想要点按钮式体验、完全不碰终端的用户不适合。5 分钟跑通clone 到第一条文件落地git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt跑完没有红色报错环境就就绪了Python 3.9Windows / macOS / Linux 通吃。前置提醒Cookie 是命门。抖音大量内容只对登录用户开放Cookie 没配好后面请求基本都会失败。好在项目内置了抓取脚本不用手动复制字符串cp config.example.yml config.yml pip install playwright python -m playwright install chromium python -m tools.cookie_fetcher --config config.yml浏览器弹出后扫码登录回终端按 EnterCookie 自动写进config.yml。跑完应看到抓取完成的提示cookies区块不再是YOUR_*占位符。✅link: - https://www.douyin.com/video/xxxxxxxx path: ./Downloaded/把 配置模板 里的示例link换成一条真实链接然后python run.py -c config.yml跑完应看到 Overall Summary 完成统计Downloaded/下多出以作者命名的目录里面的 mp4 就是无水印的再开music、cover、json三个开关原声、封面、元数据也会一并进作品文件夹。按需求挑场景想下载一条无水印视频不想动配置文件单条视频是最低成本场景命令行参数直接追加快捷链接或分享链接短链会自动解析python run.py -c config.yml -u https://v.douyin.com/xxxxx/ -t 8跑完应在终端看到下载完成统计新视频落在path指向的目录里。-t临时调并发不写回配置。想备份一个博主主页作品、合集一次跑完适用边界博主主页链接走mode勾选内容number给每种模式设上限0不限post / like / mix / music 可混着跑且跨模式自动去重收藏类collect/collectmix只能单独使用不能与其他模式混写。link: - https://www.douyin.com/user/MS4wLjABxxxx mode: [post, mix] number: post: 50 mix: 20跑完该博主内容按作者/post/、作者/mix/分目录归档文件名默认日期_标题_id不会互相覆盖。想录一整场直播直播间链接直接填进link程序自动拉流不用开录屏软件。边界先说清官方标注这是实验功能HLS 源保存的是播放列表而不是可直接播放的视频极端直播场景建议人工同时备份。link: - https://live.douyin.com/123456789 live: max_duration_seconds: 00表示录到主播下播录满时长、主播下播或你手动 CtrlC已录下的字节都保留成 FLV落在Downloaded/{作者}/live/下附带一份房间元数据 JSON 方便回溯。只要数据不要文件热搜和关键词只做数据收集时两条命令搞定产物是 JSONLpandas、jq 可直接二次筛选python run.py --hot-board 30 -p ./Downloaded python run.py --search 猫咪 --search-max 100 -p ./Downloaded跑完应在Downloaded/hot_board/与Downloaded/search/下各多出一个 JSONL 文件。想要评论或字幕转写在配置里开comments.enabled: true、transcript.enabled: true转写走 OpenAI 接口图文笔记不生成转写即可每个作品旁会多一个*_comments.json或转写文件。去重、续跑、挂了不白跑开完就不用再管database每条下载记录写进 SQLite默认dy_downloader.db。坑只删库不清文件不会触发重下判断是库记录 本地文件双重检查两者都清才会重新下载。increase.post默认true按磁盘上的非空主文件跳过已下作品redownload_missing_files默认true文件缺了会自动补下。坑想重下某条时把increase.post设false即可覆盖重下不用手动清库。retry_times默认 3 次内置指数退避与 2 请求/秒限速下载带 Content-Length 完整性校验残文件自动清理重试。坑网络抖动不用管它但别把限速也调没了。browser_fallback默认enabled: true、headless: false主页翻页被风控截断时自动开浏览器你手动过验证码。坑别设headless: true否则验证卡死只能干等超时。thread默认 5网络稳定再提到 8。坑一上来拉满容易触发风控反而比慢一点更慢。长任务可顺手开notificationsBark / Telegram / Webhook跑完手机收推送。卡住了先查这张表现象最可能原因一条命令或配置解决突然大面积失败Cookie 过期重跑python -m tools.cookie_fetcher --config config.yml主页只抓到 20 条左右翻页触发风控确认browser_fallback.enabled: true且headless: false弹窗手动过验证硬盘堆出重复文件去重没生效确认database: trueincrease.post保持默认true想重下某一条被跳过的被去重机制拦下increase.post: false再跑一次进度输出很吵日志未静默progress.quiet_logs: true排查时临时加-v速度慢并发偏保守thread提到 8、retry_times: 3逐步上调上线前自查三条先用单条视频验证 Cookie 和网络再上主页批量测试阶段把number.post设 15跑通后再放开到 0不同任务分配置文件如config_test.yml、config_daily.yml别共用一份Cookie 失效是周期性的维护项不是故障长任务记得开notifications。本项目仅供技术学习与个人数据管理使用请在合法合规前提下使用尊重内容版权与创作者权益。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表