Python爬虫入门之爬取图片

本文介绍了一种使用Python的requests库来下载网络上的图片的方法。通过简单的代码实现,可以将指定URL的图片保存到本地指定路径。代码还包含了错误处理机制,确保在遇到问题时能够给出相应的提示。

摘要生成于 C知道 ,由 DeepSeek-R1 满血版支持, 前往体验 >

import requests
import os

url = input("Please input URL\n")
root = "D://pics//" 
kv = {
		"User-agent":"Mozilla/5.0"
		}
path = root + url.split('/')[-1] #本地存储目录
try:
	if not os.path.exists(root):
		os.mkdir(root)
	if not os.path.exists(path):
		r = requests.get(url,headers = kv)
		print(r.request.headers)
		with open(path,"wb") as f:
			f.write(r.content)
			f.close()
			print("Win!!!")
	else :
		print("Oh,no!!!")
except:
	print("Oh,shit!!!")


Python爬虫是一种可以自动从网页上获取数据的程序。以下是使用Python编写简单的爬虫程序来爬取图片的基本过程: 1. 准备工作:导入所需的库,例如requests和re。设置请求头,以模拟浏览器发送请求。创建一个文件夹来存储下载的图片。 2. 发送请求并获取响应:使用requests库发送GET请求,传入目标网址和请求头。获取响应内容。 3. 解析响应内容:使用正则表达式找到所有图片的URL。正则表达式的模式可以根据具体的网页结构进行调整。 4. 遍历图片URL并下载:使用循环遍历每个图片URL,发送请求并获取响应。将响应内容保存到文件中,命名为图片的标题加上图片的后缀。 下面是一个简单的爬虫程序示例: ```python import requests import re import os image_folder = &#39;表情包&#39; # 设置保存图片的文件夹名称 if not os.path.exists(image_folder): os.mkdir(image_folder) headers = { &#39;User-Agent&#39;: &#39;Mozilla/5.0 (Windows NT 10.0; Win64; x64; rv:98.0) Gecko/20100101 Firefox/98.0&#39; } response = requests.get(&#39;https://qq.yh31.com/zjbq/&#39;, headers=headers) response.encoding = &#39;utf-8&#39; t = r&#39;<img src="(.*?)" alt="(.*?)" width="160" height="120">&#39; result = re.findall(t, response.text) for img in result: res = requests.get(img[0]) s = img[0].split(&#39;.&#39;)[-1] with open(image_folder + &#39;/&#39; + img[1] + &#39;.&#39; + s, mode=&#39;wb&#39;) as file: file.write(res.content) ``` 请注意,根据不同的网站和页面结构,代码中的正则表达式模式和其他部分可能需要进行适当的调整。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值