抖音TikTok数据采集工具完整指南:5步搭建双平台批量下载工作流
【免费下载链接】TikTokDownloaderTikTok 发布/喜欢/合辑/直播/视频/图集/音乐;抖音发布/喜欢/收藏/收藏夹/视频/图集/实况/直播/音乐/合集/评论/账号/搜索/热榜数据采集工具/下载工具项目地址: https://gitcode.com/GitHub_Trending/ti/TikTokDownloader
DouK-Downloader(原 TikTokDownloader)是一款完全开源、免费使用的抖音TikTok数据采集工具,覆盖双平台作品下载、直播录制、评论采集、搜索与热榜分析等全流程能力。无论你是想批量保存喜欢的内容,还是需要为创作做素材分析,这篇文章会带你用 5 个步骤完成从安装到进阶的全部操作,并解锁 TikTok视频批量下载、抖音Web API接口、抖音直播录制等实用技能。
🎯 从一个"素材荒"的下午说起
你做内容创作,最头疼的往往不是选题,而是素材。刷到 30 个优质创作者,想系统研究他们的选题结构、文案节奏、数据表现,一个一个手动保存?一个下午可能只能存下几十个文件,而且只有视频本身,点赞、评论、发布时间这些关键信息全都没有。
更麻烦的是双平台。抖音和 TikTok 的技术体系、接口规则完全不同,你要维护两套采集方案,成本直接翻倍。而这款工具存在的意义,就是把这套"脏活累活"封装成开箱即用的功能:一条命令启动,菜单里选一下,剩下的交给程序。
它解决的不仅是"能不能下载",而是三件事:批量、带元数据、可持续更新。
🗺️ 一张表看懂:它能做什么
先看能力全景,再决定怎么用它。下面是双平台的功能对照:
| 能力维度 | 抖音 | TikTok |
|---|---|---|
| 作品下载 | 发布 / 喜欢 / 收藏 / 收藏夹、单链接、合集、图集、实况 | 发布 / 喜欢、单链接、合辑、图集 |
| 直播处理 | 获取拉流地址、调用 FFmpeg 录制 | 获取拉流地址、调用 FFmpeg 录制 |
| 音乐资源 | 音乐作品批量下载 | 音乐作品批量下载 |
| 数据采集 | 评论、账号详情、搜索结果、热榜榜单 | 作品与账号详情 |
| 文件质量 | 最高画质、断点续传、自动跳过已下载 | TikTok 原画视频 |
除此之外,它还内置了一批"省心"机制:
- 增量更新:账号发布新作品后,再次运行只下载新增内容
- 自动去重:已下载的文件自动跳过,绝不重复劳动
- 多线程下载:配合智能延时请求,兼顾速度与稳定
- 数据留痕:采集结果可保存为 CSV / XLSX / SQLite,方便后续分析
- 多账号管理:配置文件里一次登记多个账号,可批量、可定时
⚙️ 第一步:5 分钟装好运行环境
前置条件只有一个:Python 3.12 及以上版本。用python --version可以快速确认。
方式一:源码 + uv(推荐,最省心)
git clone https://gitcode.com/GitHub_Trending/ti/TikTokDownloader cd TikTokDownloader uv sync --no-dev uv run main.py三行命令,依赖自动装好,程序直接启动。
方式二:源码 + pip(不想装 uv 时)
python -m venv venv source venv/bin/activate # Windows 下执行 venv\Scripts\activate pip install -r requirements.txt python main.py方式三:免环境,直接跑编译好的程序
如果你完全不想碰命令行,可以直接下载已编译的可执行文件,解压后双击运行。macOS 用户注意:首次运行前需在终端执行一次xattr -cr 项目文件夹路径来解除系统安全限制。
方式四:Docker 部署
项目自带Dockerfile,也支持直接拉取官方镜像,适合部署到服务器上长期运行,之后通过浏览器远程访问。
第一次启动时,程序会先显示免责声明,确认后进入主菜单。你可以看到代理状态检测、Cookie 配置、模式选择等完整入口,整个界面是中文引导式菜单,跟着数字序号走即可。
🔑 第二步:配好 Cookie,解锁完整画质
Cookie 是访问平台数据的"门票",它的重要性体现在两个地方:
- 分辨率:未登录状态的 Cookie 通常只能拿到低清资源,登录后的 Cookie 才能下载最高画质
- 访问权限:私密账号的作品,必须使用已登录且已关注该账号的 Cookie 才能采集
获取步骤其实很简单
- 用浏览器打开抖音或 TikTok 网站并完成登录
- 按
F12打开开发者工具,切到"网络"标签 - 勾选"保留日志",刷新页面
- 在请求列表里点开任意一个请求,找到
Cookie字段 - 复制完整的 Cookie 内容
复制完成后,回到程序主菜单,选择"从剪贴板读取 Cookie",程序会自动读取并写入配置文件,全程不用手动编辑任何文件。更详细的图文说明可以参考项目内的 Cookie 获取教程。
这里有一个重要提醒:Cookie 只需要配置一次,只有在失效导致下载失败或画质下降时,才需要重新获取。所以不要每次运行都重复配置。
如果你要使用 TikTok 平台,还需要补一个初始参数device_id。获取方式同样是开发者工具,在网络请求的"载荷"(Payload)里就能找到它:
🧭 第三步:三种运行模式,各取所需
工具提供了三种主流使用模式,对应三类人群:
| 模式 | 适合谁 | 特点 |
|---|---|---|
| 终端交互模式 | 普通用户 | 菜单导航,点选即用,覆盖全部功能 |
| 后台监听模式 | 自动化需求者 | 剪贴板监听、定时任务、自动处理,解放双手 |
| Web API 接口模式 | 开发者 | RESTful 接口,端口 5555,便于二次开发 |
终端交互模式是最直观的入口:批量下载链接、下载账号作品、获取直播地址、采集评论与热搜,全部通过菜单完成,不需要写任何代码。
后台监听模式则适合"挂机"场景:你把链接复制到剪贴板,程序自动识别并下载;也可以设定任务,定时去抓取指定账号的新作品。配合断点续传和自动去重,断网重连后也能无缝续跑。
Web API 接口模式是给程序员准备的能力,我们会在第六步单独演示。
📥 第四步:实战——批量下载一个账号的全部作品
假设你想把 5 个美食博主的全部作品都收下来做选题分析,不需要一个个复制链接。在配置文件中登记账号即可:
{ "accounts_urls": [ { "mark": "美食博主A", "url": "https://www.douyin.com/user/美食博主A的ID", "tab": "post", "enable": true }, { "mark": "旅行博主B", "url": "https://www.tiktok.com/@traveler", "tab": "liked", "enable": true } ] }字段含义都很直白:mark是给账号起的备注名,tab选择抓取发布作品(post)还是喜欢列表(liked),enable控制是否启用。配置完成后,在终端交互模式里选择"批量下载账号作品",程序就会按账号逐个抓取。
下载时你可以顺手做两件事:
- 按账号归档:开启
separate后,每个账号的作品存进独立文件夹 - 自定义命名:比如用"创建时间_作者昵称_描述"的格式,后期检索一目了然
这套流程跑过一次之后,第二次运行就是纯增量:只下载新增作品,已有的自动跳过,昵称或标识变更也会自动同步到文件名里。
🔌 第五步:实战——用抖音Web API接口做二次开发
如果你有自己的程序,想把采集能力集成进去,Web API 模式是最高效的路径。启动该模式后,浏览器访问http://127.0.0.1:5555/docs就能看到自动生成的完整接口文档。
接口按平台分为两组,抖音以/douyin/开头,TikTok 以/tiktok/开头,核心接口如下:
| 接口 | 作用 |
|---|---|
/douyin/share | 解析分享链接的最终地址 |
/douyin/detail | 获取单个作品数据 |
/douyin/account | 获取账号作品数据 |
/douyin/mix | 获取合集作品数据 |
/douyin/live | 获取直播流数据 |
/douyin/comment | 获取作品评论数据 |
调用方式就是一个普通的 POST 请求,下面以采集评论为例:
from httpx import post headers = {"token": ""} # 按需填写接口鉴权 token data = {"detail_id": "0123456789", "pages": 2} api = "http://127.0.0.1:5555/douyin/comment" response = post(api, json=data, headers=headers) print(response.json())返回的是标准 JSON,可以直接接进你的分析脚本、数据看板或内容管理系统。TikTok 平台的接口用法完全一致,只是把路径换成/tiktok/开头。
🚀 进阶玩法:直播录制、数据留痕与定制化
直播录制一条龙
需要录直播?不用自己抓流。工具可以自动获取抖音和 TikTok 的直播拉流地址,然后调用 FFmpeg 完成录制。从"找地址"到"存文件"全程自动化,录制过程中还可以截图和时间标记。
把数据变成分析素材
这是很多人忽略的价值点:下载之外,工具采集的评论、热搜、搜索、账号数据都可以持久化保存为 CSV / XLSX / SQLite。比如你想知道某个话题下用户都在讨论什么,跑一次评论采集,把结果导入表格,词频、情感倾向、高赞回复一目了然。热搜榜单数据还能帮你判断当下的内容风向。
高级配置随需调整
项目的配置文件支持精细调优,例如:
{ "max_threads": 5, "chunk_size": 1048576, "max_retry": 3, "timeout": 30 }网络不佳时降低线程数、调大超时时间,往往比反复重试更有效;支持代理设置,跨境场景也能稳定运行。如果你想深入定制,源码采用清晰的模块化设计,下载器、数据提取、接口封装、缓存管理各自独立,二次开发入口很好找:加密参数在 src/encrypt/,接口封装在 src/interface/。
❓ 高频问题自查表
| 现象 | 处理建议 |
|---|---|
| 下载速度慢或频繁失败 | 检查代理是否正常;更新 Cookie;适当调低max_threads |
| 视频画质不够高 | 换上已登录账号的 Cookie,未登录状态只能拿到低清资源 |
| 私密账号抓不到 | 使用已登录 Cookie,且该账号需要关注目标用户 |
| 提示加密参数失效 | 项目为合规考虑已停止维护参数算法,需按文档自行配置加密参数生成代码 |
| 程序启动报错 | 确认 Python ≥ 3.12;执行uv sync重装依赖;查看日志目录定位原因 |
| TikTok 功能异常 | 检查device_id等初始参数是否已正确配置 |
🚀 现在,让工具替你完成重复劳动
到这里,你已经掌握了这款抖音TikTok数据采集工具的完整用法:装好环境、配好 Cookie、选对模式、跑通批量下载,再按需接入 API 或直播录制。剩下的就是动手实践:
git clone https://gitcode.com/GitHub_Trending/ti/TikTokDownloader cd TikTokDownloader uv sync --no-dev uv run main.py建议第一次先下载一条链接试试手感,确认 Cookie 生效后,再逐步扩展到账号批量采集和数据分析。工具是免费的,能力是完整的,把重复的体力活交给程序,把时间留给真正的创作与判断——这才是采集工具的正确打开方式。
【免费下载链接】TikTokDownloaderTikTok 发布/喜欢/合辑/直播/视频/图集/音乐;抖音发布/喜欢/收藏/收藏夹/视频/图集/实况/直播/音乐/合集/评论/账号/搜索/热榜数据采集工具/下载工具项目地址: https://gitcode.com/GitHub_Trending/ti/TikTokDownloader
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考