抖音批量下载完整指南:开源工具 DouK-Downloader 从安装到自动化采集
2026/8/19 18:16:01 网站建设 项目流程

抖音批量下载完整指南:开源工具 DouK-Downloader 从安装到自动化采集

【免费下载链接】TikTokDownloaderTikTok 发布/喜欢/合辑/直播/视频/图集/音乐;抖音发布/喜欢/收藏/收藏夹/视频/图集/实况/直播/音乐/合集/评论/账号/搜索/热榜数据采集工具/下载工具项目地址: https://gitcode.com/GitHub_Trending/ti/TikTokDownloader

上个月,朋友托我把收藏夹里三百多条教学视频做成离线备份。我原打算一条条手动保存,结果一个下午只存下来不到四十条,还被平台的频率限制反复打断。后来换了个开源下载工具,同样的工作量压缩到半小时以内,评论区数据也顺手导成了表格。这篇文章就聊聊这个工具——DouK-Downloader——具体怎么用,以及它到底适合解决什么问题。

一页看懂它:能做什么,不能做什么

DouK-Downloader 是一个完全开源的抖音/TikTok 数据采集与下载工具,覆盖两个平台的视频、图集、实况、音乐,以及账号作品、喜欢、收藏、合集、直播、评论、搜索、热榜等数据。它默认以终端交互方式运行,也提供 Web API 接口,方便接入自己的程序。

它擅长的事情:

  • 批量下载单个或多个账号的发布、喜欢、收藏作品,支持按时间范围筛选
  • 整集下载合集作品,支持增量更新,只补齐新增内容
  • 获取直播推流地址,调用 FFmpeg 录制直播回放
  • 采集作品评论、账号详情、搜索结果、热榜数据
  • 把采集结果导出为 CSV、XLSX、SQLite,方便二次分析

它不擅长的事情:

  • 下载付费作品(作者明确表示不做支持)
  • 跳过初始化环节——首次使用必须配置 Cookie,这一步省不掉
  • 包办最新的加密算法:项目内置的加密参数算法已经过期失效且不再维护,个别功能需要你自行准备加密参数生成代码,动手前要有心理准备

一句话总结:它适合"想批量、想自动化"的人,不适合"点开就想用、不想看任何说明"的人。

5分钟跑通第一次下载

装好运行环境

项目要求 Python 3.12 及以上,建议用 uv 管理依赖,速度快、省心:

git clone https://gitcode.com/GitHub_Trending/ti/TikTokDownloader cd TikTokDownloader uv sync --no-dev uv run main.py

不想碰 Python 也没关系,Windows 10 以上和 macOS 可以用官方编译好的可执行文件,解压双击 main 就能跑。Mac 用户第一次运行如果被系统安全策略拦下,在终端执行xattr -cr 项目文件夹路径解除限制即可。首次启动会先确认免责声明,随后进入功能选择菜单,初次使用建议直接选"终端交互模式"。

把 Cookie 喂给程序

这一步直接决定你能拿到多高分辨率的视频。获取流程并不复杂:

  1. 浏览器打开并登录抖音网页版
  2. 按 F12 打开开发者工具,切到"网络"标签
  3. 刷新页面,在筛选框输入cookie-name:odin_tt
  4. 点开任意一个作品的评论区,选中返回的数据包,复制请求头里的 Cookie
  5. 回到程序,选择"从剪贴板读取 Cookie"

更完整的图文步骤可以翻一翻项目里的 docs/Cookie获取教程.md。

下载第一条视频

在终端交互模式里依次选择"批量下载链接作品"→"手动输入待采集的作品链接",粘贴任意抖音分享链接,回车,剩下的交给程序。

默认情况下文件会存到项目目录下的 Download 文件夹。看到"文件下载成功"和统计结果,说明整条链路已经跑通。

按任务讲:把功能用到实处

任务一:把某位创作者的全部作品搬进硬盘

在配置文件 settings.json 的 accounts_urls 里填入账号主页链接,用 earliest 和 latest 限定时间范围,用 mark 给账号起备注名,enable 控制是否参与下载。之后在终端交互模式选择"批量下载账号作品"。程序会自动跳过已下载的文件,实现增量更新;创作者改了昵称,文件名里的标识也会自动同步。

任务二:整集下载一个合集

把合集链接写进 mix_urls,同样支持 mark 备注和 enable 开关。适合那种按主题组织的教学合集,跑一遍就能把几十上百条作品一次性收齐,之后再跑只处理新增部分。

任务三:录下一场直播

选择"获取直播推流地址",按提示选择清晰度(常见档位如 FULL_HD1/HD1/SD1),程序会拿到推流地址并调用 FFmpeg 开始录制。前提是机器上装了 ffmpeg,或者在 settings.json 里指定 ffmpeg 的路径。

任务四:把采集能力变成接口

Web API 模式启动后,访问 http://127.0.0.1:5555/docs 就能看到自动生成的接口文档,常用的有 /douyin/detail(作品详情)、/douyin/account(账号作品)、/douyin/mix(合集)、/douyin/live(直播)、/douyin/comment(评论)。写几行代码就能接入自己的流程:

from httpx import post response = post( "http://127.0.0.1:5555/douyin/comment", json={"detail_id": "作品ID", "pages": 2}, headers={"token": ""}, ) print(response.json())

我踩过的坑,提前帮你排掉

坑一:以为每次运行都要重新填 Cookie。其实只在失效后更新。当你发现下载的视频分辨率明显下降,或者请求开始报错,再去换新 Cookie。Cookie 质量直接影响画质上限。

坑二:直接把终端窗口关掉。程序下载时会先写临时文件,运行结束才归位。正确退出方式是按 Ctrl+C,让程序有机会清理临时文件、保存进度。

坑三:期待加密参数开箱即用。项目说明写得很坦白:内置加密参数算法已过期失效,为合规不再维护,抖音侧部分功能需要自行准备加密参数生成代码。所以首次使用先跑通链接下载这类基础功能,再逐步尝试高级采集。

坑四:程序多开直接重复运行。想开多个实例,复制整个项目文件夹再运行,别在同一个目录里硬开。

进阶:让下载更快更稳

  • 走代理:settings.json 里设置 proxy 参数,采集 TikTok 或高频请求时明显更稳。
  • 控制请求节奏:项目内置智能延时机制,防止请求过猛。喜欢/收藏类数据要先把全量拉回来再做时间筛选,作品多时耗时长,可以用 max_pages 限制请求次数。
  • 调整下载参数:max_retry 控制失败重试次数,timeout 控制超时,max_size 限制单个文件大小上限,folder_mode 按文件夹归档。改完配置文件记得重启程序才生效。
  • 数据落库:storage_format 支持 CSV/XLSX/SQLite,采集到的评论、账号数据可以持久化保存,具体实现可以参考 src/storage/ 目录。

一个完整的实战:两周搭起竞品素材库

我把这套流程用在了自己的内容工作上:跟踪同领域的 5 个对标账号、2 个主题合集,外加每月一次的直播回放备份。

实际对比很直观:手动保存时,一个下午约 4 小时只能存下 40 条左右;切到 DouK-Downloader 后,5 个账号约 320 条作品一个多小时全部落地,多线程下载让等待时间大幅缩短。评论数据以 SQLite 保存,需要分析时直接查询,再不用对着网页一页页翻。每周跑一次增量下载,新增内容自动补齐,素材库基本实现了"无人值守"。

当然,速度快了更要管住手。这个工具的价值在于把重复劳动交给程序,而不是让你变成更高效的爬虫机器。

最后:边界与下一步

数据采集工具天然游走在灰色地带,请守住几条底线:只下载公开内容用于个人学习与研究;不碰付费内容和他人隐私;不要用高频请求给平台添麻烦;商业用途先确认授权。

如果看完想动手试试,建议按这个顺序来:先按上文跑通一条链接的下载,再配好 Cookie 尝试账号批量下载,最后再碰 Web API 和直播录制。过程中有疑问,项目文档目录 docs/ 下的说明,以及 src/ 下的源码(下载器在 src/downloader/,数据提取在 src/extract/,接口在 src/interface/)都能帮你把原理看明白。

把你的收藏夹交给程序去排队下载吧,省下来的时间,足够你做点更有价值的事。

【免费下载链接】TikTokDownloaderTikTok 发布/喜欢/合辑/直播/视频/图集/音乐;抖音发布/喜欢/收藏/收藏夹/视频/图集/实况/直播/音乐/合集/评论/账号/搜索/热榜数据采集工具/下载工具项目地址: https://gitcode.com/GitHub_Trending/ti/TikTokDownloader

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询