
抖音批量下载实战指南单条视频到整个主页3 步配置 10 分钟跑通【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader凌晨一点运营新人小林还在浏览器里一条条保存竞品抖音视频存到第 40 个时已经磨掉半天耐心。开源项目 douyin-downloader 就是为这类脏活设计的粘贴一个链接自动识别类型并发下载无水印视频、封面、音乐和元数据。整理一个主页原本要两小时的活它十分钟跑完。能力总览哪些链接可以直接丢给它工具的装配逻辑在 core/ 目录链接解析先判断 URL 类型再由 DownloaderFactory 创建对应下载器你不用手动指定。内容类型链接形态对应用途单条短视频/video/视频ID收藏一条无水印作品图文笔记/note/笔记ID、/gallery/笔记ID下载图集合集/collection/合集ID、/mix/合集ID整合集拉取原声音乐/music/音乐ID下载该音乐关联作品博主主页/user/用户ID批量下载作品/喜欢/合集核心玩法分享短链v.douyin.com/短链自动解析后下载直播间live.douyin.com/房间ID直播实时录制FLV/HLS边界也要说清识别不了的链接会直接报错退出不会闷头跑空收藏合集类模式只支持登录 Cookie 对应账号自己的收藏夹无法抓取他人收藏。快速上手十分钟装好并跑通安装三条命令装完依赖要求 Python 3.8克隆后装依赖即可git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txtCookie 三种配法推荐自动获取Cookie 是访问抖音接口的通行证配置里有三种写法自动获取推荐配置写cookies: auto运行时自动打开浏览器引导登录写完自动落盘最省心整串粘贴从浏览器开发者工具复制完整 Cookie 字符串直接填入键值对填写按msToken、ttwid、sid_guard等字段逐项填结构最清晰。用浏览器回退功能的话需要再装一次依赖pip install playwright python -m playwright install chromium。最小配置6 行 YAML 跑通第一次下载link: - https://www.douyin.com/user/你的目标博主ID path: ./Downloaded/ mode: [post] # 下载发布的全部作品 number: {post: 50} # 最多 50 条0 表示全部 thread: 5 # 并发数 cookies: auto # 自动获取 Cookie推荐保存为config.yml执行python run.py -c config.yml命令行实时刷新每个任务的进度条跑完自动汇总成功/失败/跳过数量。完整的字段含义见 config.example.yml注释写得很细。产物说明任务跑完你得到什么默认按作者 / 模式 / 作品三级目录归档Downloaded/ ├── download_manifest.jsonl └── 作者名/ └── post/ └── 2024-02-07_作品标题_aweme_id/ ├── 2024-02-07_作品标题_aweme_id.mp4 ├── 2024-02-07_作品标题_aweme_id_cover.jpg └── 2024-02-07_作品标题_aweme_id_data.json两个关键文件值得留神_data.json存了点赞数、评论数、发布时间、话题标签做数据整理时不用回网页翻download_manifest.jsonl是全局清单每行一条 JSON记录日期、作者、标题、文件路径后期用命令行检索或导入表格都方便。一个反直觉细节文件名里的日期取自作品发布时间而非下载时间。隔三个月再备份归档仍按发布顺序排列只有发布时间字段缺失时才回退到当天日期并会在日志里告警属预期行为。自动化进阶从跑一次到每天自动跑批量下载最大的坑是重复拉取——博主更新 10 条重跑一遍结果 100 条全下。项目内置 SQLite 去重配合increase配置就得到增量同步increase: {post: true} # 跳过本地已存在的主媒体文件 start_time: 2024-01-01 # 只下指定时间段内的作品 end_time: 2024-12-31 filename_template: {date}_{title}_{id} # 命名模板可用 {author} {like_count} 等变量把这条命令挂进 crontab就是每天凌晨自动追更新作品进来、旧文件绝不动0 3 * * * cd /path/to/douyin-downloader python run.py -c monitor.yml调参建议thread新手保持 5 左右即可盲目拉高并发反而容易触发风控网络波动时把retry_times提到 5被限速时优先调低请求频率限流器 默认约 2 次/秒而不是加并发。场景对比三个真实用法各省多少时间场景一竞品账号监控之前运营每天手动刷 3 个竞品主页、逐条另存每天固定耗时约 2 小时且断更时完全无感知。之后3 个主页写进link开增量同步挂定时任务每天自动跑人只看汇总数字。关键配置mode: [post, like] number: {post: 0, like: 0} # 0 全量 increase: {post: true, like: true}场景二研究样本采集之前手动搜索关键词、翻页、逐条复制标题和互动数据进表格采 200 条样本要大半天。之后一条子命令直接导出带日期、作者、点赞评论数的 JSONL 文件跳过下载环节直接进分析流程。关键配置python run.py --search 关键词 --search-max 100 -p ./Downloaded场景三重要直播留存之前手机架在旁边录屏人不能离录完还要剪掉水印和界面。之后配置live段FLV 流实时录制主播下播或网络空闲自动停止已录部分保留全程无人值守。关键配置link: [https://live.douyin.com/房间ID] live: max_duration_seconds: 3600 # 0 录到主播下播 idle_timeout_seconds: 30嫌敲命令麻烦仓库还带了桌面客户端 Douzy共享同一套后端逻辑粘贴链接一键开始下载任务中心里看每个任务的状态、直接打开文件目录。问题速查表五个高频故障这样解现象可能原因处理方式接口提示未登录Cookie 失效可交互环境工具自动弹浏览器重登并重试服务器上用python -m tools.cookie_fetcher --config config.yml手动刷新主页只抓到 20 条左右接口翻页风控确认browser_fallback.enabled: true、headless: false浏览器弹窗里手动完成验证别急着关窗口个别视频失败作品被删、设私密或断网默认跳过失败项继续跑加-v看完整日志定位原因文件名日期不对发布时间缺失回退到当天属预期行为日志有告警介意的话检查filename_template变量重跑又全量下载没开增量或媒体文件被删检查increase对应模式为true删过文件会导致该条重下属设计如此使用边界三条红线记住就行用途适用于个人学习、研究分析、内部素材整理不用于商业性内容分发或侵权二次传播频率内置了请求间隔与并发上限rate_limit、thread保留这些限速逻辑别硬冲接口大规模高频抓取会干扰平台服务尊重下载内容标注来源遵守平台内容使用协议不用于恶意竞争或获取隐私信息。能力与合规是一体的——工具跑得再快用对了地方效率才真正属于你。行动清单今天就动手克隆仓库并执行pip install -r requirements.txt装好依赖配置cookies: auto跑一次自动登录确认能打开抖音接口试跑一个你关注博主的主页用上面 6 行最小配置验证产物目录挂上increase增量同步和 crontab 定时任务让它每天自己跑。 ✅四步走完小林那十个小时里九成机械重复的活就交出去了——把重复还给工具把时间还给你。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考