抖音批量下载上手:去水印、增量、配置到跑通
2026/9/17 19:01:32 网站建设 项目流程

抖音批量下载上手:去水印、增量、配置到跑通

【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader

想把某个账号下的无水印视频全部拉下来,或者备份自己的收藏合集,手动点不现实。douyin-downloader 是一个 Python 命令行工具,专门做抖音内容的批量下载,自动处理无水印源选择、并发、重试和去重。这篇文章带你从安装配置到把第一批内容落盘。

它到底能干什么

收集参考素材。做同类内容时,最直接的用法是把某位创作者的作品一次性拉下来。工具会自动挑选无水印视频源,并可在同目录保存封面、原声音乐和 JSON 元数据,素材按作品归档,不用二次整理。number.post控制数量,0表示全量;配上start_time/end_time还能只取某个时间段之后的作品。单个作品链接同样支持,v.douyin.com短链会被自动解析成长链接。

离线备份自己的内容。当前登录账号的收藏夹、收藏合集可以整体下载,每个作品进独立目录,封面、音乐、数据各归其位。开启数据库后,重复运行会跳过已下载的作品;配合增量下载,第一次全量跑完后,以后只补新作品,适合定期给账号内容做本地副本。桌面版 Douzy 的收藏与喜欢工作台就是干这件事的,可以直接对某个合集发起整个合集下载:

做轻量数据分析。如果目的是数据而不是视频,--hot-board 30可以导出热搜榜快照,--search "关键词"能按关键词搜出作品列表落成 JSONL,都不需要完整下载文件。想连评论一起拿的话,打开comments开关,每个作品旁会多出一份评论 JSON。

跑起来

准备环境

需要 Python 3.9+,macOS、Linux、Windows 都能跑,没有额外系统级依赖。音频提取用的 ffmpeg 静态二进制已随依赖打包,不用单独安装。

克隆仓库并安装依赖

git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt

浏览器兜底和 Cookie 自动获取都依赖 Playwright,建议一并装好:

pip install playwright python -m playwright install chromium

准备 Cookie 并写最小可用配置

先复制配置模板:

cp config.example.yml config.yml

Cookie 是访问抖音接口的关键,推荐用内置工具自动获取:

python -m tools.cookie_fetcher --config config.yml

会自动打开浏览器,登录抖音后回到终端按 Enter,Cookie 就写进配置文件了。最小可用配置只需要动这几处:

link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx # 换成目标主页 mode: - post # 下载主页作品 number: post: 50 # 0 表示全量 thread: 5 # 并发数 retry_times: 3 database: true # 开启 SQLite 去重 path: ./Downloaded/

代理、完成通知、直播录制这些选填项按需再补。

第一次运行

python run.py -c config.yml

终端里是 Rich 进度条,每个作品的状态实时可见。也可以不改配置文件,直接用命令行追加链接和并发数:

python run.py -c config.yml -u "https://www.douyin.com/user/MS4wLjABAAAAxxxx" -t 8

跑完后文件落在Downloaded/作者名/post/日期_标题_aweme_id/下,视频、封面、音乐、元数据都在同一个作品目录里。下图来自桌面版 Douzy,它和 CLI 共享同一套下载后端,可以直观看到任务的形态:

几个值得留意的细节

增量下载怎么开:只拉新作品

increase: post: true database: true

增量依赖 SQLite 里的下载记录,再次运行同一任务时已下载的作品直接跳过,只拉新增内容。去重本身是双重的:数据库记录加本地文件名扫描,同一个作品跨模式也不会重复下载。

翻页受限就退回真实浏览器

browser_fallback: enabled: true headless: false

API 翻页被风控卡住、一次只能拿到 20 条时,工具会自动打开浏览器滚动加载作品列表,你手动过完验证即可继续。目前兜底只针对post模式完整验证过,其他模式仍以 API 分页为主。

顺手把评论采下来

comments: enabled: true include_replies: true # 连二级回复一起 max_comments: 1000 # 0 为不限

开启后每个作品的媒体文件旁会生成*_comments.json,评论文本和层级结构都在里面,做情感分析或评论挖掘时可以直接用。

录制直播,中断也不丢数据

link指向live.douyin.com/{room_id}时进入录制模式,默认输出 FLV。主播下播、网络空闲或你手动 Ctrl+C 时,已录制的字节都会保留:临时文件提升为正式文件,并附带一份直播间元数据 JSON。

桌面版的任务中心会把所有下载任务的状态汇总在一处,失败的条目可以单独重试:

容易踩的坑

批量下载卡在 20 条。抖音翻页有限流,API 直连只能拿到第一页。装上 Playwright,保持browser_fallback.enabled: trueheadless: false,浏览器弹出后手动过验证即可拿全。

部分类型 CLI 拿不到了。2026-09 起抖音风控要求网页 SDK 签名,单个视频、图文、合集、音乐这几类接口对 CLI 直连返回 403。这类下载改用桌面版 Douzy,它通过内置登录窗口代发请求,不受该限制影响。

删了文件重跑却还是跳过。程序按数据库记录加本地文件名双重去重,数据库里有记录就认为已下载。用sqlite3 dy_downloader.db删掉对应记录,或把作者目录和数据库文件一起删掉,才能重新下载。

接下来

图文、音乐、完成通知、REST API 服务等完整配置项,直接翻 config.example.yml 和 core/ 里的各下载器实现;设计决策与变更记录在 docs/superpowers/。使用中遇到问题,可以直接到仓库提 Issue。

【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询