三、Pandans数据清洗与聚合1、Pandas基础知识1.1 Series 和 DataFrame 核心概念Pandas是Python中数据分析的核心库,提供了两种最主要的数据结构:Series和DataFrame,理解这两种数据结构的差异和使用场景,是掌握Pandas的首步。Series是一维带索引的数组,类似于 Excel 中的一列或 Python 中的字典升级版。每个 Series 都有一个是显示的索引(index),这使得数据查找比普通列表更灵活。当你不指定索引时,Pandas 会自动生成从0开始的整数索引。import pandas as pd # 创建Series:方式一 - 直接传入列表 s = pd.Series([10, 20, 30]) print(s) # 0 10 # 1 20 # 2 30 # dtype: int64 # 创建Series:方式二 - 指定索引 s = pd.Series([10, 20, 30], index=['a', 'b', 'c']) print(s['a']) # 10,通过标签获取数据 print(s.values) # [10 20 30],获取底层数组 print(s.index) # Index(['a', 'b', 'c'], dtype='object') # Series支持向量化运算 s2 = s * 2 print(s2) # a 20, b 40, c 60DataFrame是