抖音评论采集不求人:三步用浏览器控制台批量导出 Excel
【免费下载链接】TikTokCommentScraper项目地址: https://gitcode.com/gh_mirrors/ti/TikTokCommentScraper
想复盘一条爆款视频,却发现几百上千条评论只能靠手动复制?这个痛处,TikTokCommentScraper 这个开源的抖音评论采集工具能直接解决:把整个过程压缩成三步——复制一段 JS、粘进浏览器控制台、双击一个脚本。它不要求你懂爬虫,甚至不要求你安装 Python,鼠标点几下就能把整套评论区导成 Excel。
先从我的翻车经历说起
去年我做了一期抽奖视频,中奖名单要从评论区核对。评论区叠了 800 多条,我打算手动滚屏、逐条复制到表格里。结果呢?滚到凌晨两点,眼睛花了不说,第二天统计时发现漏掉了十几条,还分不清哪条是回复哪条是楼中楼。
后来同事丢给我这个工具,我才意识到:评论区批量采集这种事,根本不需要写复杂爬虫,浏览器自己就能"滚"完整个评论区。
它凭什么不用装爬虫框架?
这个抖音评论采集工具的底层思路很朴素——它不向服务器发任何请求,而是借你正在看的那个页面,在开发者控制台里执行一段 JavaScript,模拟真人往下滚动。
整个过程分三个阶段:
- 滚屏加载:脚本不断把最后一条评论滚入视野,触发抖音的懒加载,直到连续多次刷新都无新内容。
- 展开回复:自动找到所有"查看回复"按钮并逐个点击,把二级评论也捞出来。
- 提取打包:全部渲染完毕后,用 XPath 定位评论节点,抽取昵称、内容、时间、点赞数等信息,拼成 CSV 文本。
因为全程是"人"在操作页面,抖音的反爬机制基本感知不到异常,这也是它采集稳定性不错的原因。
安全提醒:脚本本体不发任何网络请求,唯一的敏感操作是把结果写进剪贴板。但任何时候,都别盲目往控制台粘贴来路不明的代码——粘贴前花两分钟通读一遍,这是对自己的账号负责。
三步上手,新手也能照做
第一步:取代码
Windows 用户最省事,项目自带了一个裁剪过的 Python 环境(约 7MB),直接双击根目录下的Copy JavaScript for Developer Console.cmd,采集代码就自动进了剪贴板。
其他系统用户执行一条命令即可:
python src/CopyJavascript.py第二步:在浏览器里跑
用 Chrome、Edge、Brave 这类 Chromium 内核浏览器打开目标视频页,先确认评论区能手动滚动加载。然后按 F12 打开控制台,把剪贴板里的代码粘贴进去回车。
接下来的几分钟交给脚本自己表演:控制台会实时打印"Loading 1st level comment number xxx"这类进度,直到出现CSV copied to clipboard!就说明采集完成。
第三步:导出 Excel
回到项目目录,双击Extract Comments from Clipboard.cmd(非 Windows 用户跑python src/ScrapeTikTokComments.py)。脚本会读取剪贴板里的 CSV,转换后生成一个带时间戳的Comments_<时间戳>.xlsx,用 Excel 或 LibreOffice 打开即可。
你能拿到一整套数据,不只是评论
这是我认为它最超出预期的地方——导出内容分两个维度:
帖子维度(每次采集都会附带):
| 字段 | 说明 |
|---|---|
| Post URL | 视频链接 |
| Publisher | 作者昵称、@账号、主页链接 |
| Publish Time | 发布时间 |
| Post Likes / Shares | 点赞数、分享数 |
| Description | 视频文案 |
评论维度(每条评论一行):
| 字段 | 说明 |
|---|---|
| Comment Text | 评论内容 |
| Nickname / User @ | 昵称与账号 |
| Time / Likes | 评论时间与点赞数 |
| Is 2nd Level Comment | 是否二级回复 |
| User Replied To | 回复的是哪条评论的谁 |
| Number of Replies | 这条楼中楼挂了几条回复 |
层级关系被完整保留,楼中楼也标清了"回复了谁",直接拿去做对话还原、情感分析都够用。
三个容易被忽略的贴心细节
缺失诊断:采集结束时,控制台会打印"魔法消失的评论数"。因为抖音前端显示的总数常常偏多——比如图标写着 750 条,实际渲染出来只有 740 条。作者实测 3000 条的视频,有 64 条从未被渲染。工具把这个差值明明白白告诉你,方便你判断数据可信度。
性能参考:200 条以内基本一分钟内搞定;3000 条以下一般五分钟内能跑完,中端笔记本在加载阶段会略有卡顿。再大的量建议分段处理。
回复归属算法:脚本会向前查找回复的父评论,自动维护"这条回复属于谁"的对应关系,CSV 里直接给你,省了二次加工。
什么样的人会需要它
- 办抽奖、投票的博主:评论区即名单,导出来就能批量核对。
- 内容创作者:每期视频的评论区复盘,看用户真正在意什么。
- 市场与学术研究:竞品评论区观察、用户情感分析、互动关系网络,底层数据全靠它。
- 不写代码的运营:全程鼠标 + 回车,唯一要做的"编程"就是粘贴。
动手试试
克隆到本地,跟着上面的三步走一遍,半小时内你就能拿到第一份评论 Excel:
git clone https://gitcode.com/gh_mirrors/ti/TikTokCommentScraper建议先用评论少的视频练手,跑通流程后再挑战几千条的大视频。如果你在抖音改版后发现选择器失效,也欢迎到项目里提交 issue——开源工具的生命力,正来自社区里每一个动手的人。
相关资源
- 浏览器端采集脚本:src/ScrapeTikTokComments.js
- 数据处理脚本:src/ScrapeTikTokComments.py
- 代码复制辅助脚本:src/CopyJavascript.py
- 依赖清单:requirements.txt
【免费下载链接】TikTokCommentScraper项目地址: https://gitcode.com/gh_mirrors/ti/TikTokCommentScraper
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考