python读取excel或pdf

python读取excel

import xlrd

file = 'TEST.xlsx'

def read_excel():

    wb = xlrd.open_workbook(filename=file)  # 打开文件
    print(wb.sheet_names())  # 获取所有表格名字
    
    sheet1 = wb.sheet_by_name('test1')  # 通过名字读取表格
    print(sheet1.name, sheet1.nrows, sheet1.ncols)

    for i in range(1, sheet1.nrows):
		print(sheet1.row_values(i))     #行
    
    for i in range(1, sheet1.ncols):
    	print(sheet1.col_values(i))     #列

    print(sheet1.cell(1,0).value)       #获取表格里的内容,三种方式
    print(sheet1.cell_value(1,0))
    print(sheet1.row(1)[0].value)

python读取pdf

import pdfplumber

path = 'TEST.pdf'
pdf = pdfplumber.open(path)

for page in pdf.pages:
    # 获取当前页面的全部文本信息,包括表格中的文字
    print(page.extract_text())                        

    for table in page.extract_tables():
        print(table)
        print('-----------------------')
        for row in table:
            print(row)
        print('-----------------------')

pdf.close()
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值