【爬虫软件】小红书按关键词批量采集笔记，含笔记正文、转评赞藏等！

最新推荐文章于 2025-04-22 11:36:42 发布

python布道者0516

最新推荐文章于 2025-04-22 11:36:42 发布

阅读量3.6k

点赞数 17

分类专栏： XHS软件文章标签：爬虫笔记

本文链接：https://blog.youkuaiyun.com/2301_81153914/article/details/142114606

版权

一、背景介绍

1.1 爬取目标

熟悉我的小伙伴都了解，我之前开发过2款软件：

【GUI软件】小红书搜索结果批量采集，支持多个关键词同时抓取！
【GUI软件】小红书详情数据批量采集，含笔记内容、转评赞藏等！

现在介绍的这个软件，相当于以上2个软件的结合版，即根据关键词爬取笔记的详情数据。

开发界面软件的目的：方便不懂编程代码的小白用户使用，无需安装python，无需改代码，双击打开即用！

软件界面截图：软件运行界面

爬取结果截图：
结果截图1

1.2 演示视频

软件使用演示：（不懂编程的小白直接看视频，了解软件作用即可，无需看代码）

演示视频：

【软件演示】爬小红薯搜索详情软件

1.3 软件亮点说明

几点说明：在这里插入图片描述

二、代码讲解

2.1 爬虫采集-搜索接口

首先，定义接口地址作为请求地址：

# 请求地址
url = 'https://edith.xiaohongshu.com/api/sns/web/v1/search/notes'

2.2 爬虫采集-详情接口

首先，定义接口地址作为请求地址：

# 请求地址
url = 'https://edith.xiaohongshu.com/api/sns/web/v1/feed'

2.3 两接口逻辑同理

定义一个请求头，用于伪造浏览器：

# 请求头
h1 = {
   
	'Accept': 'application/json, text/plain, */*',
	'Accept-Encoding': 'gzip, deflate, br',
	'Accept-Language': 'zh-CN,zh;q=0.9,en;q=0.8,en-GB;q=0.7,en-US;q=0.6',
	'Content-Type': 'application/json;charset=UTF-8',
	'Cookie': '换成自己的cookie值',
	'Origin': 'https://www.xiaohongshu.com',
	'Referer': 'https://www.xiaohongshu.com/',
	'Sec-Ch-Ua': '"Microsoft Edge";v="119", "Chromium";v="119", "Not?A_Brand";v="24"',
	'Sec-Ch-Ua-Mobile': '?0',
	'Sec-Ch-Ua-Platform':

最低0.47元/天解锁文章