目录
1 数据格式转换
查看与转换表格某一列的数据格式:
(1)查看数据类型:某一列的数据格式:df[“列属性名称”].dtype
(2)数据类型转换:某一列的数据类型转换需要用到数据转换函数:
df[列属性名称]=df[列属性名称].astype(“新的数据类型”)
代码举例如下:
import numpy as np
import pandas as pd
df=pd.read_excel("D:/Python/Python数据分析/酒店数据1.xlsx")
print(df)
print(df["评分"].dtype) #查看类型这一列的数据类型
print(df["评分"])
df["评分"]=df["评分"].astype("int") #进行数据表格的数据类型转换需要用到数据类型转换函数df["列名称"].astype("类型名称”)
print(df["评分"])
print(df["评分"].dtype)
2 数据的排序
2.1 单个表格列数据的排序需要用到函数:
df.sort_values(by=列名称,ascending=True(升)/False(降))
print(df.sort_values(by="评分",ascending=False)["评分"])
2.2 多排序问题:
对于多列排序问题,主要是遇到其中一个列数据相同的时候需要看另外一个列数据进行排序,使用的函数及其使用规则如下:
df.sort_values(by=[列1,列2…],ascending=[True,False…])
其中函数参数by=[,]前后顺序代表了多列排序优先级顺序,ascending=[,]中False和True代表了相应每列的排序原则(升降))
3 基本统计数据分析
3.1 描述性统计
对于数值型的数据通常都需要进行相应的常见统计数据分析,最常见的描述性统计函数是.describe(),它可以给出数据的多项统计指标&