抖音去水印批量下载工具完整指南
2026/9/15 18:58:31 网站建设 项目流程

抖音去水印批量下载工具完整指南

【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader

你盯着屏幕复制第 50 条链接,右键另存为、手动去水印、再重命名——手指已经麻了。douyin-downloader 是一个开源的抖音批量下载工具:单条视频无水印下载、作者主页批量抓取、合集与音乐、直播录制,内置进度展示、指数退避重试与 SQLite 去重,让你用一条命令批量完成这些动作。

能力边界:哪些内容能下,哪些不能下

先说清它能接什么活。单条链接覆盖四种地址:视频(/video/{id})、图文(/note/{id})、合集(/collection/{id})、音乐(/music/{id},优先原声,缺失时回退到使用该音乐的首条作品);v.douyin.com短链自动解析。作者主页支持作品(post)、点赞(like)、合集(mix)、音乐(music)四种模式;collect/collectmix则下载当前登录账号的收藏夹与收藏合集。🎯 其他能力:直播间录制、按作品采集评论(含二级回复)、热搜快照与关键词搜索导出 JSONL、下载完成推送(Bark/Telegram/Webhook)、可选的 REST API 服务模式。

无水印与画质是自动的:优先选无水印视频源,按bit_rate阶梯自动挑最高码率,也可切换原画(每条作品多一次探测请求)。去重走"SQLite + 本地文件名"双重判断,增量下载和发布时间过滤(start_time/end_time)都可用,逐项说明见配置样例。

它明确不做的事有三点:

  • collect/collectmix只支持当前登录 Cookie 对应的账号,且必须单独使用,不能与其他模式混用;
  • 浏览器兜底目前只覆盖post翻页,like / mix / music 主要依赖 API 正常分页;
  • HLS 直播源只保存 playlist 文件,需要用 ffmpeg 后处理;webcast 直播接口仍标记为实验性。

快速跑通:5 步安装 douyin-downloader 并首次运行

要求 Python 3.8+,macOS / Linux / Windows 均可。第一步,克隆并装依赖:

git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt

如果要用浏览器兜底或自动获取 Cookie,再装一个浏览器内核:

pip install playwright python -m playwright install chromium

第二步,复制配置,把要下载的抖音链接写进link、下载目录写进path

cp config.example.yml config.yml

第三步,获取 Cookie——这是访问抖音 API 的通行证:

python -m tools.cookie_fetcher --config config.yml

会弹出浏览器,扫码登录后回到终端按 Enter,Cookie 自动写回配置,全程约两分钟。第四步,运行:

python run.py -c config.yml

示例配置默认从指定作者主页抓 1 条作品,适合作为冒烟测试。也可以在命令行直接追加链接与并发数:python run.py -c config.yml -u "https://www.douyin.com/video/xxx" -t 8 -p ./Downloaded。完成后文件落在Downloaded/{作者}/{mode}/{date}_{title}_{id}/下,含 .mp4 以及带点赞数、发布时间的_data.json元数据。

截图来自 Douzy 桌面版(同一套 Python 后端,目前内测中),用于展示链接下载的工作流。

三个进阶用法:增量采集、浏览器兜底、直播录制

增量采集:如何只下载新作品

问题:你关注了一批博主,只想追更,不想每次全量重抓。关键配置:

mode: [post] number: { post: 0 } increase: { post: true } database: true

预期结果:首次运行全量下载并记入dy_downloader.db,之后每次运行跳过已下载作品、只落盘新增的。配合start_time: "2025-01-01"按发布时间过滤时,post 模式在越过起始日期后提前停页,上千条作品的主页不用再翻完所有分页。增量策略实现见 core/user_modes/。

主页翻页被风控时,浏览器兜底怎么开

问题:主页只抓到 20 条作品,重跑多少次都停在这里。原因是翻页被风控,开启浏览器兜底:

browser_fallback: enabled: true headless: false max_scrolls: 240

预期结果:API 翻页受阻时弹出真实浏览器窗口,手动完成滑动验证后自动继续抓取;窗口不要提前关闭。兜底与重试参数在 control/ 下。

直播录制与评论采集:怎么配置

问题:直播内容没有回放,想连评论一起留档。把直播间地址写进link,打开两个开关:

live: max_duration_seconds: 3600 comments: enabled: true max_comments: 500

预期结果:时长设为0则一直录到主播下播;FLV 保存在Downloaded/{作者}/live/并附带房间元数据快照,下播或 Ctrl+C 中断时已录制的字节会保留;每条作品旁生成*_comments.jsoninclude_replies: true时再抓二级回复。

调优与排障:5 个高频症状与修复命令

  • 症状:主页只抓到 20 条作品→ 翻页触发风控 → 设browser_fallback.enabled: trueheadless: false,窗口弹出后手动过验证。
  • 症状:请求大面积失败或只能拿到公开内容→ Cookie 失效 → 重跑python -m tools.cookie_fetcher --config config.yml
  • 症状:进度条重复刷屏→ 进度阶段日志未静默 → 配置progress.quiet_logs: true,排查问题再临时加-v
  • 症状:想重下旧作品却被跳过→ 去重依赖数据库 + 本地文件双重判断 → 删掉本地含 aweme_id 的目录,并清掉dy_downloader.db里的对应记录。
  • 症状:下载频繁超时、速度反而变慢→ 并发过高触发限流 → 把thread降到 3-5,retry_times默认 3 次指数退避,网络不稳可填proxy

这个工具把"无水印、批量、去重、重试"压缩成了几个开关和一套默认策略,让你把精力花在选哪些作品上。下一步:打开 config.yml,把thread从 5 改成 8,跑一次python run.py -c config.yml,观察提速是否伴随限流报错,再决定要不要回调。

【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询