大家好,我是陆砚码,今天我们来聊聊Python中的Pandas库,这是一个强大的数据处理工具,能帮助我们高效地处理和分析数据。
Pandas库的核心是两种数据结构:Series和DataFrame。Series类似于带索引的列表或字典,而DataFrame则是一个二维表格,类似于Excel表格或SQL表。
Series:一维数组
Series是一维的,可以存储各种数据类型,比如整数、字符串、浮点数等。创建Series时,我们需要指定数据和可选的索引。
import pandas as pd
s1 = pd.Series([10, 20, 30, 40])
print(s1)
这里我们创建了一个Series,数据是[10, 20, 30, 40],默认的索引是整数序列。
DataFrame:二维表格
DataFrame是一个二维表格,可以存储不同类型的数据。创建DataFrame时,我们可以使用字典、列表嵌套列表或从外部文件读取数据。
data = {
