股票数据Scrapy爬虫

功能描述

• 目标:获取上证A股股票名称和交易信息
• 输出:保存到文件中
• 技术路线:采用scrapy框架进行爬取
此处选取股票信息静态存储在HTML页面中的页面进行爬取,之后会写一篇动态的爬取方式

程序结构设计

(1)首先得到股票代码,此处选取证券之星获得上证A股股票代码
(2)根据股票代码到网易财经获取个股详细信息
(3)将结果存储到文件

代码实现

此处在spiders文件下新创建了一个stocks.py文件
stocks.py

# -*- coding: utf-8 -*-
import re
import scrapy


class StocksSpider(scrapy.Spider):
    name = 'stocks'
    start_urls = ['http://quote.stockstar.com/stock/stock_index.htm']

    def parse(self, response):
        for href in response.css('a::attr(href)').extract():
            try:
                stock = re.search(r'/gs/sh_\d{6}.shtml', href).group(0).split('_')[1].split('.')[0]
                url = "http://quotes.money.163.com/" + '0' + stock + '.html'
                yield scrapy.Request(url=
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
红包 添加红包
表情包 插入表情
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值