使用pandas库对csv文件进行筛选保存

脚本专栏 2024/11/18 佚名

2 0 1

神剑山庄资源网 Design By www.hcban.com

这个操作现在看来真没啥难的，但是我找相关的资料真的找了好久。

多数大佬都是直接pandas官网甩我脸上，然后举一个入门级的例子。

https://pandas.pydata.org/docs/reference/index.html

首先导入pandas库

import pandas as pd

然后使用read_csv来打开指定的csv文件

df = pd.read_csv('./IP2LOCATION.csv',encoding= 'utf-8')

这个函数里面需要写入csv文件的路径，如果是把csv文件保存到了python的工程文件夹下，则只需要./文件名即可，然后encoding='utf-8'是使用utf-8方式编码，有时候需要换成gbk。

虽然我们读取的是csv文件，但其实由于我们使用的是pandas库，所以我们实际获得的是一个DataFrame的数据结构。

可以使用print(type(df))进行检验

print(type(df))

DataFrame 是表格型的数据结构。因此，我们可以将其当做表格。DataFrame 是以表格类似展示，而且还包含行标签、列标签。

我们可以添加一个列标签，使用方法为pandas.DataFrame.columns

在我们的例子中DataFrame类型的变量为df，因此使用方法为df.columns，我们添加的列标签为a、b、c、d、e、f

df.columns = ['a','b','c','d','e','f']

然后，我们想把某一列中等于特定值的那些行提取出来

可以将读出来的内容当做一个列表，然后这个列表的元素是表中的每一行，然后这每一行也是一个列表，也就是列表中的列表。

比如，我想将表中第5列中值为Andhra Pradesh的行提取出来，并且由于我们之前定义了第五列的列标签为e

因此代码为：

data = df[df['e'] == 'Andhra Pradesh']

最后我们可以通过pandas中的to_csv，来将筛选出来的数据保存到新的csv文件中。

data.to_csv('my_IP2LOCATION.csv')

用法为表名.to_csv（'所要保存地方的路径/表名.csv')

最后总结一下我们的代码

import pandas as pd

df = pd.read_csv('./IP2LOCATION.csv',encoding= 'utf-8')
# print(type(df))
df.columns = ['a','b','c','d','e','f']
data = df[df['e'] == 'Andhra Pradesh']
data.to_csv('my_IP2LOCATION.csv')

IP2LOCATION.csv内容如下：

总共有759727行

然后经过我们的筛选后的my_IP2LOCATION.csv

只有3461行

PS：可以使用print(len(df.values))来查看行数

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持。

pandas库,筛选,保存,csv文件

标签：

pandas库,筛选,保存,csv文件

神剑山庄资源网 Design By www.hcban.com

神剑山庄资源网 免责声明：本站文章均来自网站采集或用户投稿，网站不提供任何软件下载或自行开发的软件！如有用户或公司发现本站内容信息存在侵权行为，请邮件告知！ 858582#qq.com

神剑山庄资源网 Design By www.hcban.com

评论“使用pandas库对csv文件进行筛选保存”

暂无使用pandas库对csv文件进行筛选保存的评论...

www.hcban.com 神剑山庄资源网

139,976影音资源

144,792福利资源

21,817软件资源

631,128技术资源

更新日志

2024年11月18日

使用pandas库对csv文件进行筛选保存

pandas库,筛选,保存,csv文件

tensorflow pb to tflite 精度下降详解

Python HTMLTestRunner测试报告view按钮失效解决方案

评论“使用pandas库对csv文件进行筛选保存”

更新日志

友情链接