python之爬虫的入门04------爬虫代理ip、保存为CSV表格

一、爬虫伪装—使用代理ip

import urllib.request
import random

url = 'http://45.32.164.128/ip.php'                                      #URL地址

iplist = ['112.91.159.66:3128','119.31.210.170:7777','221.7.255.168:8080']    #多个代理IP地址

'''
细致的设置代理,可以用opener的open方法打开URL:
'''
proxy_support = urllib.request.ProxyHandler({'http':random.choice(iplist)})   # 参数是一个字典{'类型':'代理IP:端口号'}

opener = urllib.request.build_opener(proxy_support)                          # 订制创建一个opener

urllib.request.install_opener(opener)                                    #安装opener


response = urllib.request.urlopen(url)
html = response.read().decode('utf8')
print(html)

二、保存为CSV表格

import csv


def write_msg(data):
    '''这个函数用来将爬取的数据写入文件'''
    with open("csvfile.csv", 'a+', newline='') as f:
        wf = csv.writer(f)
        wf.writerow(data)

if __name__ == '__main__':
    head = ['msg', 'area', 'price', 'address', 'user', 'phone']

    with open('./csvfile.csv', 'a+') as f:
        wf = csv.writer(f)
        wf.writerow(head)

    data = ['1', '2', '4', '6', 'g', 'uy']
    write_msg(data)

    data = ['3', '1', 'a', '6', 'g', 'uy']
    write_msg(data)

    data = ['w', 'wdveg546thfwer4335refveergrtbg5', '我的', 'we', 'fvr', 'df43ferrver3442ergfregbvrvebevevevfvervfvr']
    write_msg(data)
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值