
Python
文章平均质量分 76
李老师搞技术
农民工IT女初学者,关注下吧
展开
-
【Python】Python存储爬虫抓取数据的5种方式比较
爬虫抓取数据后,怎样存储才是最好的方式呢?先来盘点一下可以使用的存储方式以json格式存储到文本文件存储到excel存储到sqlite存储到mysql数据库存储到mongodb1、以json格式存储到文本文件这是最简单,最方便,最使用的存储方式,json格式保证你在打开文件时,可以直观的检查所存储的数据,一条数据存储一行,这种方式适用于爬取数据量比较小的情况,后续的读取分析也是很方便的。2、存储到excel如果爬取的数据很容易被整理成表格的形式,那么存储到excel是一个比较不错的选择,打原创 2021-08-30 08:36:37 · 541 阅读 · 0 评论 -
【Python】Python入门—实现scrapy爬虫每天定时抓取数据
前言。1.1. 需求背景。每天抓取的是同一份商品的数据,用来做趋势分析。要求每天都需要抓一份,也仅限抓取一份数据。但是整个爬取数据的过程在时间上并不确定,受本地网络,代理速度,抓取数据量有关,一般情况下在20小时左右,极少情况下会超过24小时。1.2. 实现功能。通过以下三步,保证爬虫能自动隔天抓取数据:每天凌晨00:01启动监控脚本,监控爬虫的运行状态,一旦爬虫进入空闲状态,启动爬虫。一旦爬虫执行完毕,自动退出脚本,结束今天的任务。一旦脚本距离启动时间超过24小时,自动退出脚本,等待第二.原创 2021-08-30 08:45:34 · 2948 阅读 · 0 评论