XiaohongshuSkills一键抓取笔记数据看板:曝光、观看、点赞与CSV导出实战
【免费下载链接】XiaohongshuSkills支持小红书自动发布、自动评论、自动检索的 Skill。支持 OpenClaw、Codex、CC 等项目地址: https://gitcode.com/gh_mirrors/xi/XiaohongshuSkills
XiaohongshuSkills(RedBookSkills)是一款支持小红书自动发布、自动评论、自动检索的开源 Skill,兼容 OpenClaw、Codex、Claude Code 等 AI 工具。本文带你实战它的「内容数据看板」功能:一条命令抓取笔记的曝光、观看、封面点击率、点赞等 10+ 项指标,并一键导出为 Excel 可直接打开的 CSV 文件,5 分钟即可完成小红书笔记数据的自动化采集。
小红书笔记数据手动整理有多痛?
做过小红书账号运营的朋友都知道,每周复盘笔记数据都是一件体力活:
- 登录创作者中心 → 数据分析 → 逐列复制表格
- 粘贴到 Excel,对齐列名、补齐缺失值
- 多篇笔记、多个账号重复操作
而 XiaohongshuSkills 的content-data命令可以直接抓取创作者中心「笔记基础信息」数据表,把曝光、观看、点赞等指标原样带回本地,甚至直接落地为 CSV 文件。
3 步完成环境准备与首次登录
环境要求
| 依赖 | 要求 |
|---|---|
| Python | 3.10+ |
| 浏览器 | Google Chrome |
| 操作系统 | Windows(目前仅测试 Windows) |
先获取项目代码:
git clone https://gitcode.com/gh_mirrors/xi/XiaohongshuSkills cd XiaohongshuSkills pip install -r requirements.txt依赖清单见 requirements.txt。
首次扫码登录
python scripts/cdp_publish.py login命令会弹出 Chrome 窗口,用手机小红书扫码登录即可。登录态默认缓存 12 小时,之后可先检查状态:
python scripts/cdp_publish.py check-login💡 浏览器由 scripts/chrome_launcher.py 统一管理,支持
--headless无头启动、--restart重启、--kill关闭。
一键抓取笔记数据看板
登录后,一条命令即可抓取「笔记基础信息」数据表:
python scripts/cdp_publish.py content-data该命令会先校验创作者中心登录态,然后打开statistics/data-analysis页面抓取数据表,输出 JSON 结果。核心抓取逻辑位于 scripts/cdp_publish.py。
每条笔记包含以下 12 个字段:
| 字段 | 说明 |
|---|---|
| 标题 / 发布时间 | 笔记基础信息 |
| 曝光 | 笔记曝光次数 |
| 观看 | 笔记观看次数 |
| 封面点击率 | 自动格式化为百分比 |
| 点赞 / 评论 / 收藏 | 互动核心指标 |
| 涨粉 / 分享 | 传播与增长数据 |
| 人均观看时长 | 格式化为秒数 |
| 弹幕 | 视频笔记弹幕数 |
缺失的指标会自动填充-,保证表格列结构稳定,方便后续统计。
一步导出 CSV,Excel 直接打开
加一个--csv-file参数,数据即可落盘为 CSV 文件:
python scripts/cdp_publish.py content-data \ --csv-file "D:/data/content_data.csv"导出成功后命令行会打印CONTENT_DATA_CSV:加上文件的绝对路径。这个细节对中文用户很友好:CSV 采用UTF-8 with BOM编码写入(见 _write_content_data_csv),用 Excel 双击打开不会乱码,标题、曝光、观看等列名与网页表格一一对应。
字段映射与列定义在 _map_note_infos_to_content_rows 中,想扩展自定义列也可以从这里入手。
分页与筛选参数说明
content-data支持分页抓取,适合笔记较多的账号:
| 参数 | 默认值 | 作用 |
|---|---|---|
--page-num | 1 | 页码(从 1 开始) |
--page-size | 10 | 每页条数 |
--type | 0 | 接口类型筛选值 |
--reuse-existing-tab | 关 | 复用已有标签页,减少窗口切换 |
例如一次拉取 50 条数据并导出:
python scripts/cdp_publish.py --reuse-existing-tab content-data \ --page-num 1 --page-size 50 \ --csv-file "D:/data/content_data.csv"多账号场景下,可用--account 账号名指定账号后执行同一命令,各账号 Cookie 相互隔离。
它是怎么抓到数据的?双通道容错机制
content-data的抓取策略分为两级(实现见 scripts/cdp_publish.py):
- 页面上下文直取:优先在已登录的页面上下文中直接请求创作者中心的数据分析接口,带上完整登录凭证,速度快、可控性强;
- 网络请求兜底:若直取失败,则自动回退为监听页面自身发出的网络请求来捕获数据,结果中通过
capture_mode字段标明本次使用的是哪种模式。
输出 JSON 中还会带上requested_page_num/resolved_page_num等参数回显字段,方便核对实际生效的分页条件。
常见问题速查
提示NOT_LOGGED_IN?先运行python scripts/cdp_publish.py login重新扫码,确认登录创作者中心账号。
页面改版导致抓取失败?项目已按 2026 年 2–3 月创作者中心改版适配过选择器与等待策略;若后续页面再次变动,优先检查cdp_publish.py中的相关逻辑。
可以在 AI 工具中直接调用吗?可以。将项目作为 Skill 挂载后,直接对 AI 说「帮我抓取笔记基础信息表」即可触发content-data流程,参考 SKILL.md 与 docs/claude-code-integration.md。
只发内容不抓数据?发布链路走 scripts/publish_pipeline.py,支持图文/视频发布、话题标签自动写入、无头模式,与数据抓取互不干扰。
加入交流社区
⚠️ 风险提示:小红书自动化存在被平台风控、限流的风险,建议仅在测试号上验证,控制频率,并对发布内容做人工复核。本项目仅供学习研究,请遵守平台规则。
项目采用 MIT 协议开源,更多完整命令可查阅 README.md。欢迎通过下方二维码联系作者交流自动化实践:
【免费下载链接】XiaohongshuSkills支持小红书自动发布、自动评论、自动检索的 Skill。支持 OpenClaw、Codex、CC 等项目地址: https://gitcode.com/gh_mirrors/xi/XiaohongshuSkills
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考