ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

抖音批量下载实战教程:douyin-downloader 从安装到日常使用

抖音批量下载实战教程:douyin-downloader 从安装到日常使用 抖音批量下载实战教程douyin-downloader 从安装到日常使用【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader如果你需要把某个博主的作品、一个合集、或一批搜索到的视频按自己的规则存到本地读完这篇文章你可以独立完成装好 douyin-downloader配好 Cookie写出第一份可用的下载配置并且知道文件落在哪、怎么不重复下、出问题时从哪里查。douyin-downloader 是一个开源的抖音批量下载工具支持无水印视频、图文、合集、音乐原声、收藏夹的批量保存内置 SQLite 去重、重试限速和浏览器兜底。它适合解决什么问题按我想做什么来对号入座比较直观把某个博主的作品存下来丢一个用户主页链接用mode: [post]下载他发布的所有作品number.post控制条数0 表示全量。只想要他点赞过或发过合集的内容就换成like、mix、music模式一次任务也可以多个模式叠加同一个作品跨模式不会重复下载。整理某一话题的素材不依赖具体博主用--search 关键词直接按关键词搜视频或用--hot-board拉热搜榜结果先落成 JSONL 文件方便你先看清单再决定下哪些。备份自己的收藏夹登录态下把https://www.douyin.com/user/self?showTabfavorite_collection放进link配collect收藏夹内容或collectmix收藏夹里的合集。注意这两个模式只能单独用不能和 post/like/mix 混排。录一场直播把live.douyin.com/{房间号}放进link工具会以实验性功能录制 FLV中途断线或主播下播都会保留已录部分另存一份*_room.json元数据。单条内容同样支持视频/video/{id}、图文/note/{id}、合集/collection/{id}、音乐/music/{id}分享出去的v.douyin.com短链也能直接解析。从 0 到第一次下载整条链路是安装依赖 → 拿 Cookie → 写最小配置 → 跑命令 → 验收产物。1. 安装Python 3.8Windows/macOS/Linux 都行git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt浏览器兜底和自动抓 Cookie 依赖 Playwright建议一并装上pip install playwright python -m playwright install chromium2. 获取 CookieCookie 是请求抖音接口的凭证两种方式。推荐自动cp config.example.yml config.yml python -m tools.cookie_fetcher --config config.yml脚本会弹出一个浏览器窗口登录抖音后回到终端按回车Cookie 就自动写回 config.yml 了。如果自动抓取失败比如公司网络限制就手动在浏览器登录网页版抖音从开发者工具里复制 Cookie 字符串填进cookies段。脚本入口在 tools/cookie_fetcher.py。3. 最小可用配置完整字段可以看仓库里的 config.example.yml第一次跑只需要这些link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx path: ./Downloaded/ mode: - post number: post: 10 thread: 5 retry_times: 3 database: true把post: 10先设小一点方便你验收第一次的结果确认没问题再改 0不限条数。4. 运行python run.py -c config.yml终端里能看到按作品的进度条想追加链接、临时改并发也可以python run.py -c config.yml -u https://www.douyin.com/video/xxx -t 8 -p ./Downloaded。5. 怎么确认下载成功了三处都看一眼./Downloaded/下出现作者名/post/日期_标题_aweme_id/这样的目录里面是.mp4本体根目录多了一个download_manifest.jsonl每行一条作品的下载清单标题、标签、文件路径都在里面如果开了databasedy_downloader.db里会多一条aweme记录用sqlite3随便查一下就能核对历史。同一套后端也有桌面客户端 Douzy粘贴链接即开始这里不展开。下载下来的内容如何管理这批设计决定了你之后好不好用按省心程度说一下。文件怎么命名。目录默认是作者名/模式/post.../单个作品一层2024-02-07_标题_aweme_id/的子目录folderstyle: true。日期取的是作品发布时间而不是下载时间所以文件按时间排序就是按内容排序。命名模板filename_template支持{date} {title} {author} {id} {year} {month} ...这些变量唯一要求是模板里至少含一个变量避免不同作品重名覆盖建议保留{id}。重名博主多的话把author_dir改成nickname_uid昵称_sec_uid直观且不会串目录。元数据落了几份。视频本体之外按需在配置里打开cover封面、music原声、avatar头像、json作品原始 JSON含完整字段默认只存视频本体以省空间。想要评论把comments.enabled设为true每个作品旁边会多一个*_comments.json想给视频配文字稿开transcript走 OpenAI 转写接口产出.transcript.txt和.transcript.json这两个都是可选开关见 core/transcript_manager.py。去重怎么判定的。这里有个容易误解的点SQLite 库只记历史不参与跳过判断。真正决定下不下的是磁盘——增量模式increase.post: true默认开下只要下载目录里已存在该作品的非空媒体文件就跳过删掉文件下次就重下删库不删文件则不会重下程序还会扫文件名里的 aweme_id 判断。想强制重下某个作品文件目录和数据库记录两边都要清。翻页被风控时的浏览器兜底。API 翻页受限是抖音的常见行为browser_fallback.enabled: true默认开时工具会起一个真实浏览器模拟滚动加载来补作品列表遇到验证码需要你在弹出的窗口里手动完成验证别提前关窗口。注意目前该兜底只在post模式下完整验证过like/mix/music仍依赖 API 翻页。实际使用中的几种打法跟着竞品账号做增量监控。背景每天要看几个博主有没有发新作品。关键配置就是打开增量下载link: - https://www.douyin.com/user/博主A - https://www.douyin.com/user/博主B mode: [post] increase: post: true每天跑一次同样的命令已下载过的作品直接跳过目录里只多出新内容。我们团队以前是两个实习生手动盯 4 小时换成这个增量配置后每天跑批大概十几分钟就结束人力基本降到挂个定时任务。按话题拉素材并限定时间窗。背景做选题调研只想要最近三个月的相关内容。命令python run.py --search 露营装备 --search-max 100 -p ./Downloaded结果落到Downloaded/search/下的 JSONL 文件先浏览清单要真正下载其中的作品把对应链接放进link再配start_time: 2026-06-01这类时间过滤格式YYYY-MM-DD。录下指定时长的直播。背景一场 1 小时的直播课需要留档。配置link: - https://live.douyin.com/123456789 live: max_duration_seconds: 3600录完 FLV 落在Downloaded/作者名/live/下。提前说明一个限制HLS 源的直播目前只保存播放列表要用 ffmpeg 再合成可播放文件所以直播录制整体仍算实验性功能。出问题时怎么排查下载速度慢。先看是不是并发撞了限速默认请求限速约 2 次/秒thread默认 5网络差时把thread降到 2~3 反而更稳。再确认proxy是否配错——代理填了但不可用会拖慢每条请求。最后看timeout与retry_times网络抖动大的环境把重试次数调高失败项会在指数退避1s/2s/5s后自动重试。Cookie 失效。症状通常是翻页直接失败或返回登录提示。排查路径先重跑一次python -m tools.cookie_fetcher --config config.yml换新一套 Cookie如果刚抓的立刻失效检查系统时间是否准确、以及这台机器是不是被风控标记必要时换 IP 或挂代理再抓。部分作品失败。单条失败常见于作品被删、设为私密、或媒体源临时不可用。先加-v跑一遍看具体报错确认是单条问题就直接跳过失败项不会阻塞整批任务。如果失败比例很高回到 Cookie 和代理两条线排查。只抓到 20 条左右的作品。这是翻页风控的典型表现排查顺序确认browser_fallback.enabled: true且headless: false确认弹出的浏览器窗口里完成了验证滑块/扫码并且没有提前关窗max_scrolls、wait_timeout_seconds可以调大给浏览器更多时间。兜底只覆盖post模式like/mix下卡住就属于已知限制等后续版本补齐。还有一个查询入口备用想核对下载历史直接sqlite3 dy_downloader.db查aweme表即可按download_time倒序看最近的记录。小结douyin-downloader 的核心价值在于把批量做成了可重复的操作增量跳过、命名模板、manifest 清单和 SQLite 历史让你第二次跑和第一百次跑的行为一致。下一步可以看看 docs/superpowers/specs/ 里关于自动重登录和作者链接文本文件的设计文档了解 Cookie 失效处理和时间范围早停是怎么实现的。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表