Pandas相关
Pandas 是 Python 语言的一个扩展程序库,用于数据分析。 是一个强大的分析结构化数据的工具集,基础是 Numpy(提供高性能的矩阵运算)。
应用场景
Pandas 可以从各种文件格式比如 CSV、JSON、SQL、Microsoft Excel 导入数据。
Pandas 可以对各种数据进行运算操作,比如归并、再成形、选择,还有数据清洗和数据加工特征。
Pandas 广泛应用在学术、金融、统计学等各个数据分析领域。
数据结构
Pandas 的主要数据结构是 Series (一维数据)与 DataFrame(二维数据)。
Series 是一种类似于一维数组的对象或列表,它由一组数据(各种 Numpy 数据类型)以及一组与之相关的数据标签(即索引)组成。Series 可以看作是 DataFrame 中的一列,也可以是单独存在的一维数据结构。
DataFrame 是一个二维表格型的数据结构,它含有一组有序的列,每列可以是不同的值类型(数值、字符串、布尔型值)。DataFrame 既有行索引也有列索引,它可以被看做由 Series 组成的字典(共同用一个索引)即多个 Series 按列排列构成的表格&#x