三步跑通 douyin-downloader:去水印下载与作者主页批量抓取快速上手
2026/9/15 13:31:02 网站建设 项目流程

三步跑通 douyin-downloader:去水印下载与作者主页批量抓取快速上手

【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader

douyin-downloader 是一款免费开源的抖音下载工具:一条视频可以自动挑无水印高清源直接落地,作者主页能按条数批量抓取,图文笔记、合集、原声音乐和直播间也都能识别处理。它全程靠命令行驱动,自带去重、失败退避重试、进度条和下载完整性校验,Windows、macOS、Linux 三个平台都能跑,不需要写代码,把配置项改成自己的链接就行。

装好环境并让第一条无水印视频落盘

这一步把"从零到手里有一个无水印视频"整件事做完:装依赖、配好登录 Cookie、填一条链接、点一次运行。

先克隆仓库并安装依赖,只需两行命令:

git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader # 克隆项目 cd douyin-downloader && pip install -r requirements.txt # 装依赖

跑完后终端不会出现红色 Traceback,最后几行是 "Successfully installed ..." 之类的提示,说明环境就绪;网络慢就耐心等,中断了重跑一遍 pip 即可。

Cookie(可以理解为你的抖音登录凭证,接口靠它判断你是否已登录)推荐用项目自带的自动脚本获取,它会拉起浏览器替你登录:

cp config.example.yml config.yml # 复制模板生成正式配置 python -m tools.cookie_fetcher --config config.yml # 自动抓取登录 Cookie

浏览器弹出后扫码登录,回到终端按回车,脚本会提示已写入 Cookie——此时打开config.yml能看到cookies:下面几个字段已填上值。一次配置长期使用,日后下载开始大面积失败再重跑一遍刷新即可。

现在把视频分享短链填进配置:

link: - https://v.douyin.com/xxxxx # 抖音分享短链 path: ./Downloaded/ # 保存目录 video: true # 保存视频本体 cover: true # 连带保存封面 json: true # 保存元数据 JSON

保存后执行python run.py -c config.yml。终端会出现一条实时进度条,走完即打印成功条数;打开Downloaded/能看到以作者名命名的目录,里面有.mp4视频、封面图和_data.json元数据(作者、发布时间、描述都在里面),文件名自带发布日期的时间戳。

顺带一提,项目基于同一套后端还做了个桌面端 Douzy,粘贴链接、看任务状态都有可视化入口;命令行流程不受影响,习惯哪种用哪种。

把主页链接换成批量抓取:限定条数、按时间裁剪、只补增量

想整站搬某位博主的作品,就把link里的视频短链换成主页地址(https://www.douyin.com/user/xxx),再配三组关键字段:mode: [post]表示抓发布作品(改成like抓点赞、mix抓合集、music抓原声);number.post: 50表示只取最近 50 条,写0表示不设上限;increase.post: true开启增量,重复运行时磁盘上已存在的主文件会被跳过,不会下载两遍。想按时间窗裁剪,再补两行start_time: "2025-01-01"end_time: ""(留空即不限制上界)。

执行方式不变,还是python run.py -c config.yml。终端会实时刷新每个任务的进度与耗时,结束时汇总成功、失败、跳过三类计数;文件默认按"作者 → 类型 → 发布日期"归档,每个作品一个独立文件夹。

批量规模大时记得看一眼磁盘余量:把path指到大容量磁盘,或顺手关掉musiccover开关减负,空间立刻宽裕不少。

⚠️ 边界说明:工具适合保存自己有权使用的内容。请尊重创作者版权,下载的内容仅用于个人学习、备份或研究,不要二次传播,更别拿来商用。

扩展玩法:图文、合集、原声与直播录制的自动识别

除了单条视频和主页,剩下的链接类型不用换命令——写进同一个link列表就行,工具会逐个识别类型分别处理:

  • 图文笔记(/note/xxx/gallery/xxx):每张图片独立保存,配一份元数据;
  • 合集(/collection/xxx/mix/xxx):遍历合集内全部作品一次存完;
  • 原声音乐(/music/xxx):优先拿直链音频,缺失时回退到该音乐下的首条作品;
  • 收藏夹(登录账号自己的收藏):modecollectcollectmix,注意这两种模式必须单独使用,不能和 post/like 混写。

直播间是独立流程:linkhttps://live.douyin.com/xxxx后直接运行,它会先展示房间标题、主播和在线人数,录制的文件存到Downloaded/{作者}/live/;主播下播或你手动 Ctrl+C 中断,已录部分都会完整保留,不会因为中断丢数据。

进阶开关还有两个:comments.enabled: true给每条作品额外抓评论存成_comments.jsonnotifications配置 Bark / Telegram / Webhook,下载完成后自动推消息,适合挂机跑大任务。

不对劲时照这张清单排查

批量任务中途遇到异常是常态,下表按"症状 → 怎么处置"排列,先对号入座再动手:

症状背后的原因处置
反复只拿到 20 条左右就停了翻页触发了平台风控确认配置里browser_fallback.enabled: true,脚本会拉起浏览器,手动完成验证后别急着关窗口,让它把剩余作品爬完
个别作品报失败作品被删、转私密,或接口临时限流限流场景工具会按 1s/2s/5s 指数退避自动重试;网络环境差时在配置里填proxy走代理
文件下载到一半变卡磁盘快满了,或大文件占用带宽换大容量磁盘并改path;关掉musiccover等非必要开关减负
下载反复失败且集中在近期Cookie 过期重跑一次python -m tools.cookie_fetcher --config config.yml刷新凭证,其余配置不用动

另外提一句:工具默认 5 线程并发、限速 2 请求/秒,失败自动重试且带文件完整性校验(不完整的文件会清掉重下),大多数"偶发失败"不用人工干预。

想继续深入:文档与源码目录

上面的流程覆盖了日常 90% 的用法,需要往下钻时看这三处就够了:

  • README.zh-CN.md——中文完整文档,含全部功能对照表和每个配置项的说明,查某个字段行为以它为准;
  • core/——下载主流程、链接类型识别和 API 客户端的源码,想看"无水印源是怎么挑的"从这里入手;
  • docs/——功能方案与设计文档,自动重登录、时间范围提前终止等新机制的设计思路都写在这里。

现在就去复制一条抖音分享链接,运行python run.py -c config.yml,然后打开Downloaded/目录——无水印视频、封面和元数据 JSON 正躺在那里等你核对。

【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询