小红书数据采集工具 xhs:一条命令装完,笔记评论数据 5 分钟到手 小红书数据采集工具 xhs一条命令装完笔记评论数据 5 分钟到手【免费下载链接】xhs基于小红书 Web 端进行的请求封装。https://reajason.github.io/xhs/项目地址: https://gitcode.com/gh_mirrors/xh/xhs周报截止前夜你为了 600 篇笔记手动誊写标题、点赞、收藏进 Excel凌晨一点手指发麻还把两个竞品的数据抄串了。这种纯体力活真不该再用双手干——小红书数据采集工具 xhs 把小红书 Web 端的请求封装成了 Python 接口几行代码就能批量拿到笔记、用户、评论等公开数据。小红书数据采集xhs 到底能拉哪些数据笔记详情一次拿全get_note_by_id()返回标题、正文、点赞、收藏、评论数、图片链接等信息直接输出结构化 JSON灌进表格或数据库都能用关键词搜索加排序get_note_by_keyword()按关键词找笔记支持按热度、时间排序一眼定位话题下的头部内容用户侧数据成体系get_user_info()拿主页资料get_user_notes()拿发布列表收藏列表、点赞列表也都有对应接口多级评论全覆盖get_note_comments()抓一级评论get_note_sub_comments()深挖楼中楼回复完整还原讨论现场不止会读点赞、收藏、关注、发评论等交互操作也有登录支持二维码和手机号两种方式小红书数据采集工具适合谁三类人对号入座内容创作者和新媒体小编用关键词搜索加热度排序扫一遍话题下的爆款笔记哪个方向互动多一目了然选题从此有据可依电商选品和品牌运营定期用get_user_notes()拉竞品账号的发布列表再交叉核对每篇的互动数据对方的更新节奏和内容规律全进你自己的数据库产品运营和口碑研究团队把一级评论和子评论连起来分析评论区里用户的真实原话就是成本最低的市场调研小红书笔记数据采集三步走到出结果第一步装依赖。三条命令搞定pip install xhs pip install playwright playwright install之所以要 playwright网站对每个请求都会出几道安全题也就是 x-s 签名这个工具靠模拟真实浏览器替你作答所以浏览器内核得先装好。第二步备好 Cookie。在小红书网页版登录从开发者工具里复制 Cookie 填进脚本。a1、web_session、webId三个字段必须有缺一个就像门禁卡少刷一道门不会开。第三步跑示例看输出。打开 示例脚本把里面的 cookie 换成你自己的运行。屏幕上打印出一篇笔记的完整 JSON——标题、正文、点赞、收藏、评论数、图片链接——就算跑通了数据已经在你手里。小红书数据爬取避坑签名、多账号与合规边界签名偶尔不配合是常态示例脚本已内置重试循环多试几次一般就好若频繁失败把浏览器加载后的等待时间适当调长一点相当于让模拟浏览器先热热身再答题详见 docs/basic.rst多账号共用签名服务要统一 a1把签名封装成独立服务参考 example/basic_sign_server.py 或 xhs-api/ 里的 Docker 签名服务时所有账号 Cookie 中的 a1 字段必须保持一致不然签名错误会一直报控制请求频率请求之间留足间隔火力全开容易触发风控甚至 IP 封禁细一点、慢一点才用得久只取公开数据项目出自个人学习用途请只抓取公开可访问的内容遵守相关法律法规与平台规则不给目标网站施加压力说到底xhs 把签名、解析这些最磨人的环节收进了底层你只管调接口、收 JSON。现在就pip install xhs装上照着示例脚本跑一遍昨天还在手抄的表格今天就该由脚本自己干——这周的数据别再浪费手指头了。【免费下载链接】xhs基于小红书 Web 端进行的请求封装。https://reajason.github.io/xhs/项目地址: https://gitcode.com/gh_mirrors/xh/xhs创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考