如何快速上手 douyin-downloader:抖音去水印批量下载完全指南
【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader
douyin-downloader 是一款面向实用场景的抖音内容下载工具,支持视频、图文、合集、音乐和用户主页作品的去水印批量下载,默认带进度条、重试与 SQLite 去重,并配套桌面端 Douzy。贴一个链接就能开始,适合想沉淀素材的创作者、需要批量数据的研究者和要备份收藏的普通用户。
🎯 能力速览
一句话概括:它能把你贴进的一个作品链接或一个作者主页链接,变成一套按作者、按日期组织好的下载档案。
- 主页作品批量获取:贴一个主页链接,
mode: [post, like, mix, music]指定范围,number.post: 0表示不限量全抓。 - 四种内容类型覆盖:视频、图文、合集、音乐单链接均支持,
v.douyin.com短链会自动解析出真实地址。 - 画质自动挑选:默认选无水印视频源,
video_quality可选 original 原画、highest 最高档或 1080p 等具体分辨率。 - 双重去重与增量下载:数据库记录加本地文件双重检查,打开
increase后只抓新发布作品。 - 浏览器兜底:API 翻页受限时自动启动浏览器读取作品列表,支持人工过验证码。
🚀 快速跑起来
五分钟内可以完成全部步骤并下载第一个作品。环境要求只有 Python 3.8 以上:
git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader && cd douyin-downloader pip install -r requirements.txt cp config.example.yml config.yml python -m tools.cookie_fetcher --config config.yml # 浏览器登录抖音,自动写入 cookie python run.py -c config.yml配置文件只保留这 5 项即可,其余走默认值:
link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx path: ./Downloaded/ mode: [post] number: {post: 1} # 先试下 1 条,确认无误再改成 50 或 0 thread: 5只想下单个视频的话,可以跳过配置文件,直接执行python run.py -u "视频完整链接",-u参数支持重复传入多个链接。
习惯用鼠标点选的话,可以用桌面端 Douzy(内测中,从项目 Releases 页下载安装包):把链接粘贴进工作台点「下载」,完成后在任务中心里能看到每个任务的状态与成功数量,还能一键打开输出目录。
🗂️ 按目标找配置
下面三组是最常见的下载目标,每组 2~3 个配置项,复制进config.yml就能用。
按作者归档整理
目标:让不同作者的作品互不混放,文件名也不打架。怎么做:设置folderstyle: true、author_dir: nickname_uid和filename_template: "{date}_{title}_{id}",完整注释见配置模板。得到什么:文件落到Downloaded/作者名_uid/post/日期_标题_aweme_id/目录下,视频、封面、JSON 元数据各自独立存放。
folderstyle: true author_dir: nickname_uid filename_template: "{date}_{title}_{id}"桌面端的「关注」页还能同步你关注的博主、按「有新作品」筛选并一键批量下载,相当于一条持续更新的归档流水线。
只抓新作品(增量下载)
目标:定期跑任务时只下载新发布的作品,不碰旧文件。怎么做:保持database: true(增量依赖数据库记录),并设置increase.post: true。得到什么:每次运行自动跳过已下载过的 aweme_id,磁盘不会因重复下载而膨胀。
increase: {post: true} database: true批量采集数据
目标:除了视频本体,还要评论数据,并控制时间范围。怎么做:打开comments.enabled: true,再用start_time/end_time(格式YYYY-MM-DD)圈定作品发布时间。得到什么:每个作品旁多一个_comments.json(可加二级回复),下载范围限定在指定时间段;另外--hot-board 30和--search "关键词"两个命令行参数还能把热搜榜、搜索结果直接导出成 JSONL 文件。
comments: {enabled: true} start_time: "2024-01-01" end_time: "2024-12-31"⚙️ 常用配置速查
日常调参最多用到的是这 8 项:
| 配置项(含义) | 什么时候需要改 |
|---|---|
mode(下载范围:post/like/mix/music/collect) | 想从作品切换到点赞、合集、音乐、收藏夹时 |
number.post等(各模式数量上限,0 为不限) | 想先试跑少量或全量抓取时 |
thread(并发下载数,默认 5) | 网络不稳定时降到 2~3,减少失败 |
retry_times(失败重试次数,默认 3) | 失败偏多时调到 5 |
start_time/end_time(发布时间过滤) | 只要某个时间段内的内容时 |
browser_fallback.enabled(浏览器兜底开关) | 批量下载卡在 20 条、翻页受限时 |
progress.quiet_logs(进度阶段静默日志) | 嫌日志刷屏时 |
database(SQLite 去重开关,默认 true) | 需要增量下载时必须保持 true |
⚠️ 避坑指南
「跑不起来」大多出在下面三处,按顺序排查即可。
现象:CLI 下载点赞、收藏夹或单个作品时返回 403,提示Blocked by ArgusSecurityPlugin。原因:2026-08 起抖音风控陆续封禁了这些接口的 API 直连请求。处理:这类下载改用桌面端 Douzy;主页作品保持browser_fallback.enabled: true,由浏览器页面自行读取。
现象:批量下载用户主页作品只能抓到前 20 条。原因:API 翻页被风控拦截,后续页面拉不到。处理:确认browser_fallback.enabled: true、headless: false,浏览器弹出后手动通过验证,别急着关窗口。
现象:重复运行同一任务不重新下载,或删了文件却发现它又没下。原因:去重判断是「数据库记录 + 本地文件」双重检查,只清一边会互相矛盾。处理:重新下载某作品时本地目录和数据库记录要一起删,具体 SQL 见中文 README的「重新下载」一节。
无论是做学习资料库、整理收藏夹,还是跑内容数据分析,douyin-downloader 都能把一个主页链接变成一份归档整齐的本地档案。请仅把它用于个人学习、研究与备份,尊重创作者的原作权益和平台规则。现在就可以打开config.example.yml,五分钟跑下第一条作品。
【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考