我这篇文章主要是介绍需要在旧的csv文件中获取所需要的记录,并将这些记录拷贝到一个新的csv文件中进行保存。
创建新的Dataframe
假设旧的数据文件为‘图书清单.csv’, 我使用的是Anaconda 3.6,即Python 3系列,对于带中文的文件名,需要指定引擎engine=‘python’,且如果文件中的内容是有中文内容的,还需要指定编码格式encoding='utf-8’
book = pd.read_csv('图书清单.csv', sep=',', engine='python', encoding='utf-8')
获取源数据的列名列表
使新的Dataframe的列名与之前数据中的列名保持一致
cols = books.columns.values
创建Dataframe
直接参数指定新的Dataframe的列名
data = pd.Dataframe(columns=cols)
在Dataframe中追加数据记录
这里假设我们需要源数据的第1-3行的记录,所以,直接进行Dataframe.append(),由于我们的新旧数据结构一致(新旧数据的列名不变),所以可以不像Pandas提供的文档那样先将需要追加的数据存入又一个新的df2中,再df = df.append(df2)
注意:一定记得赋值回来!赋值回来!赋值回来!
data = data.append(book.loc[1:3])
验证结果
可以直接使用print()打印查看data里是否已经成功添加的数据记录,但是我更喜欢保存成文件输出,毕竟这是我需要的数据,所以最后我再用pandas.to_csv()将Dataframe输出到新的csv文件
# 输出到csv
data.to_csv('结果.csv')
# 直接打印查看
print(data)

本文详细介绍如何使用Python的Pandas库从旧的CSV文件中选取特定记录,并将这些记录复制到新的CSV文件中。通过创建新的DataFrame,指定列名,然后使用append方法追加数据,最后保存到新的CSV文件。

1万+

被折叠的 条评论
为什么被折叠?



