douyin-downloader 抖音批量下载教程:三步从零跑通,去水印下载与自动归档
2026/9/24 16:02:54 网站建设 项目流程

douyin-downloader 抖音批量下载教程:三步从零跑通,去水印下载与自动归档

【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader

第一次跑通这款抖音下载工具,你会得到一个本地文件夹:无水印视频、封面、音乐、JSON 元数据,按日期和标题自动分好格,直接归档。项目名叫 douyin-downloader,是一个开源的抖音批量下载工具,既能下单个作品,也能把作者整页主页作品备份下来。你只需要给它一个链接,解析、下载、去重它自己完成,全程在终端里一条命令完成。

先确认它适不适合你

  • 适合谁:想备份喜欢的创作者、想沉淀自己素材库的博主、需要批量取样做内容分析的人。需要在 Windows / macOS / Linux 上装了 Python 3.9+ 的电脑。
  • 覆盖什么:CLI 版专注抖音——单个视频、图文、合集、音乐,作者主页的 post / like / mix / music 模式,另有热搜榜导出、关键词搜索、评论采集、直播录制(实验性)。仓库里的 Douzy 桌面版则额外覆盖 TikTok、YouTube 等平台的日常下载。
  • 收费吗:免费开源,MIT 许可证,clone 下来就能用。

跑起来

第一步,装环境。Python 3.9+ 即可,三条命令拉代码、进目录、装依赖:

git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader python -m pip install -r requirements.txt

如果后面要用浏览器兜底翻页,再补装pip install playwrightpython -m playwright install chromium

第二步,拿到登录凭证。抖音接口必须带 Cookie,好在工具带了自动抓取脚本:把配置模板复制一份,运行抓取器,在弹出的浏览器里登录一次抖音,回终端按 Enter,Cookie 就自动写入 config.yml,全程不用手抄那串字符。

cp config.example.yml config.yml python -m tools.cookie_fetcher --config config.yml

第三步,发起第一次下载。config.yml里的link换成你要的链接,然后:

python run.py -c config.yml

到这里你已经会用它的大半,后面都是在这一条命令上叠加模式与选项。

场景实操

批量下载作者主页全部作品

  • 目标:把某位博主的作品整页搬回本地。
  • 怎么操作link指向/user/主页地址;mode里写post(只下发布作品,也可加 like、mix、music);数量想全量就改number.post0;顺手把increase.post保持true,已下载过的下次会自动跳过。
  • 得到什么:作品按"作者 / 模式 / 日期_标题_作品ID"建独立文件夹,视频优先选无水印、最高码率的源,需要的话再打开covermusicjson开关保存封面、原声和元数据。

用数量与时间过滤控制下载范围

  • 目标:只要某段时间内的作品,比如近半年的。
  • 怎么操作start_time/end_timeYYYY-MM-DD日期,结束日期当天也会包含进来;画质用video_quality控制,默认highest取最高转码档,填original会去探测上传原片、探不到自动回落。
  • 得到什么:文件夹里只落筛选范围内的文件,长期跟进一位博主时配合增量开关就是"只拉新作品"。

把抖音热搜与搜索结果存成数据

  • 目标:不下视频,只收集数据。
  • 怎么操作:热搜榜和关键词搜索是独立子命令,结果直接落成 JSONL 文件,方便后续分析:
python run.py --hot-board 30 python run.py --search "猫咪" --search-max 50
  • 得到什么:带条数统计的 JSONL 文件,存到配置的保存目录下。

评论采集与完成通知

  • 目标:作品之外的附带动作,让批量任务"下了就完事"。
  • 怎么操作:在配置里打开comments.enabled,每个作品会额外生成*_comments.json(可选是否含二级回复);notifications支持 bark / telegram / webhook 三种推送,批量任务一结束手机就收到成功或失败通知。转写功能在transcript段按需开启。
  • 得到什么:媒体文件旁多一批可分析的 JSON 和一条推送,不用守在终端前。

参数与进阶速查

参数 / 配置作用示例
-c / --config指定配置文件,默认 config.yml-c config.yml
-u / --url追加链接,不替换配置里的,可重复传-u "https://..."
-t / --thread并发下载数-t 8
mode下载范围:post / like / mix / musicmode: [post]
number.post各模式数量上限,0 不限0
start_time / end_time按发布日期过滤2024-01-01
video_quality画质:highest / original / 分辨率档original
increase.post增量开关,跳过已下载作品true
retry_times失败重试次数,自动退避3
databaseSQLite 去重与下载历史true
  • https://v.douyin.com/xxx这类短链直接粘贴即可,工具会先解析再下载。
  • 运行加-v能看到详细日志,排查问题第一步就是它。
  • 作者目录默认按昵称命名,重名会合并;改成author_dir: nickname_uid直观又唯一。

常见坑

Q1:Cookie 失效了怎么办?抖音接口必须登录凭证,失效时重新跑一次 cookie_fetcher 命令即可,不用手动改配置。

Q2:作者主页只抓到少量作品就停了?一般是翻页触发了风控。保持browser_fallback.enabled: trueheadless: false,浏览器弹出后手动过验证码;但要注意,当前抖音风控已拦截 CLI 的多数下载类型,README 建议日常下载优先用项目里的Douzy 桌面版,刷新 Cookie 并不能绕过这类拦截。

Q3:如何避免重复下载?database: trueincrease开关,会同时比对数据库记录和磁盘上的主文件,已下载的自动跳过;想重下就把increase.post设为false,不必清空数据库。

Q4:视频清晰度有保障吗?video_quality默认highest,在多档码率里挑最高且优先无水印;设original时探测原片,失败自动回落到最高转码档。

Q5:下下来的文件不完整怎么办?工具按 Content-Length 比对大小,redownload_missing_files默认为true,缺失或空文件会自动补下,网络抖动由retry_times退避重试兜底,基本不用人工干预。

写在最后

回到开头那个文件夹:批量备份、去重归档、增量更新,靠的就是同一条python run.py。完整配置说明见仓库里的 config.example.yml,中文手册见 README.zh-CN.md;遇到风控变化或想要新功能,欢迎到项目仓库提 Issue 参与讨论。项目是 MIT 许可证,现在就可以 clone 下来,把第一段想留住的抖音内容完整存进本地。

【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询