使用Pandas进行数据清洗与分析。
核心数据结构DataFrame:
python
import pandas as pd
# 创建DataFrame
data = {'Name': ['Alice', 'Bob'], 'Age': [25, 30]}
df = pd.DataFrame(data)
数据清洗:
python
# 处理空值
df.fillna(0, inplace=True)
# 过滤数据
adults = df[df['Age'] >= 18]
# 分组统计
age_group = df.groupby('Name')['Age'].mean()
读取与保存:支持Excel、CSV等多种格式。
python
df = pd.read_csv('data.csv')
df.to_excel('output.xlsx', index=False)
核心价值:为机器学习、数据可视化准备高质量数据。
核心数据结构DataFrame:
python
import pandas as pd
# 创建DataFrame
data = {'Name': ['Alice', 'Bob'], 'Age': [25, 30]}
df = pd.DataFrame(data)
数据清洗:
python
# 处理空值
df.fillna(0, inplace=True)
# 过滤数据
adults = df[df['Age'] >= 18]
# 分组统计
age_group = df.groupby('Name')['Age'].mean()
读取与保存:支持Excel、CSV等多种格式。
python
df = pd.read_csv('data.csv')
df.to_excel('output.xlsx', index=False)
核心价值:为机器学习、数据可视化准备高质量数据。

1368

被折叠的 条评论
为什么被折叠?



