【GUI软件】小红书蒲公英数据批量爬取!高效筛选优质博主,助力品牌商!一、背景介绍
1.0 爬取目标
▲ 爬取目标
众所周知,蒲公英是小红书推出的优质创作者商业合作服务平台,致力于为品牌和博主提供内容合作服务,可以高效的为品牌匹配出最符合的优质博主。 蒲公英平台,需要有一定权限的企业资质账号才能申请开通。开通之后,进入【寻找博主】页面,即可根据一定的筛选条件过滤出满足的博主列表,如下:
▲ 寻找博主页面
上面是筛选条件,下面是筛选结果。 其他个性化筛选条件,可以和我沟通定制
爬取过程中,有log文件详细记录运行过程,方便回溯
爬取过程中,自动保存结果到csv文件(每爬一条存一次,防止数据丢失)
可爬34个关键字段,含:关键词,页码,小红书昵称 ,小红书号,地址,机构,数据更新至,小红书链接,粉丝数,账号类型,图文报价,视频报价,合作笔记数,预估阅读单价_图文,图文3秒阅读,日常_阅读中位数,日常_互动中位数,日常_阅读来源发现页占比,日常_阅读来源搜索页占比 需要填写cookie值到txt配置文件中,获取方法如下:
▲ 在开发者模式中获取cookie值
2.3 软件界面模块
主窗口部分:
# 创建主窗口
root = tk.Tk()
root.title('蒲公英爬虫 