Pandas数据帧筛选方法汇总,值得收藏
liuian 2024-12-20 17:18 71 浏览
子集选择是数据操作中最常执行的步骤之一。Pandas提供了许多不同的方法来筛选数据帧,来获得选定的数据子集。在本文中,我们就要来处理数据时遇到的问题以及解决办法。
开始之前,我们先来创建一个示例数据帧。
#创建一个简单的数据帧
df = pd.DataFrame({
'name' : [ 'Chi', 'Alex', 'Sam', 'Hoang', 'Linh', 'Dung', 'Anh'],
'function' : [ 'Marketing', 'Tech', 'Tech', 'Finance', 'Finance', 'Marketing', 'HR'],
'address' : [ 'Hanoi', 'Saigon', 'Hanoi', 'Saigon', 'Hanoi', 'Hanoi', 'Saigon'],
'gender' : ['F', 'M', 'F', 'M', 'M', 'M', 'F'],
'favourite_fruit' : [ 'apple', 'banana', 'orange', 'watermelon', 'grape', np.NAN, 'kumquat'],
'age' : [20,25,21,26,30,31,23]
})以下是我们创建的 df 数据帧:
基于多个条件选择行
基于某些特定条件选择行范围的方法很少。
#使用数据帧方法
df[(df.age >=25) & (df.address == 'Hanoi')]
#使用query函数
df.query('age >= 25 & address == "Hanoi"')
#使用loc函数
df.loc[(df.age >= 25) & (df.address == 'Hanoi')] 所有这些方法产生的结果如下:
使用loc、iloc选择一系列行
在本节中,介绍几种使用 loc 和 iloc 筛选数据帧的方法。
1.使用loc选择一系列行
df.loc[0:3] 输出:
2.使用iloc选择一系列行
df.iloc[0:3]输出:
为什么 df.loc [0:3] 返回4行,而 df.iloc[0:3] 仅返回3行?
如我们所见,使用 loc 和 iloc 的结果有所不同。造成这种差异的原因是:
- loc不返回基于索引位置的输出,而是基于索引的标签。
- iloc根据索引中的位置选择行。这也意味着iloc只能处理整数。
你也可以参考下面的示例,获取更多参考。在下方的示例中,把 index 设置为“name”列,这样你就可以更清楚地理解它的用法和我的解释了。
df4 = df.copy()
df4.set_index('name', inplace = True) 输出:
接下来让我们再次尝试上面的示例,看看loc如何处理索引标签。
index = ['Chi', 'Sam', 'Hoang']
df4.loc[index] 输出:
根据条件选择必需列
如果有几百列数据,而你可能只想选择其中的某些列,那么可以在loc语句中的条件之后添加列的列表中。
我们可以通过下面的示例来获取 age≥25 岁的人的“name”、“gender”和“address”。
df.loc[(df.age >=25), ['name','gender','address']] 输出:
同时选择行和列
1.使用loc、iloc选择所有行和某些特定列
#使用 iloc
df4.iloc[:,[1,2,3]]
#使用 loc和列名称
df4.loc[:, ['address','gender','favourite_fruit']]输出:
2.使用loc、iloc选择一系列特定的行和列
# 使用 iloc
df4.iloc[2:6,3:4]
# 使用 loc
df4.loc['Sam':'Dung',['favourite_fruit']]输出:
3.使用loc、iloc选择不相交的行和列
#使用 iloc
df4.iloc[[1,3],[2,4]]
#使用 loc
df4.loc[['Alex','Hoang'],['gender','age']]输出:
4.使用 get.loc 和索引方法选择行和列
column_start = df4.columns.get_loc('address')
column_end = df4.columns.get_loc('favourite_fruit')
df4.iloc[1:4,column_start:column_end] 也可以使用.loc方法执行类似的任务。这两个操作产生相同的结果。
row_start = df4.index[1]
row_end = df4.index[3]
df4.loc[row_start:row_end, 'address':'gender']输出:
在数据帧中选择单个元素
以下几种方法可以选择数据集中的单个元素,包括 loc、iloc、iat 和 at 方法。
通过代码,我们来看看 df4 数据,看看 Hoang 最喜欢的水果是什么?
row_position = df4.index.get_loc('Hoang')column_position = df4.columns.get_loc('favourite_fruit')
#使用 iloc
df4.iloc[row_position,column_position]
#使用 iat
df4.iat[row_position,column_position]
#使用 loc
df4.loc['Hoang','favourite_fruit']
#使用 at
df4.at['Hoang','favourite_fruit'] 基本上,上述4种方法检索都得到了相同的结果,即“watermelon(西瓜)”。但是,这些方法的运行速度略有不同,at 和 iat 方法比 loc 和 iloc 方法快一点。
总结
以上为Pandas筛选数据帧时的一些常用技巧。如果你在学习Pandas,或者需要Pandas来筛选数据,这些技巧值得一学!
相关推荐
- 华硕人工客服24小时吗(华硕售后人工客服)
-
华硕服务中心广东省惠州市惠东县城平深路(创富斜对面)惠东同心电脑城1L11(1.3km)笔记本电脑,平板电脑华硕服务中心广东省惠州市惠东县平山镇同心电脑城1F26(1.3km)笔记本电脑,平...
- 电脑音量小喇叭不见了(电脑声音喇叭图标不见了怎么办)
-
如果您电脑上的小喇叭(扬声器)不见了,可以尝试以下方法找回:1.检查设备管理器:在Windows下,右键点击“我的电脑”(或此电脑)->点击“属性”->点击“设备管理器”,查看“声音、视...
- 腾达路由器手机设置教程(腾达路由器手机设置教程视频)
-
用手机设置腾达路由器的方法如下:1在手机上打开浏览器,输入路由器背面的管理IP和用户及对应的密码2一般第一次打开,默认会跳出设置向导,准备好宽带用户名和密码,3按向导提示输入相应内容4在无线设置的安全...
- 自配电脑配置推荐(自配电脑配置推荐百度)
-
首先,像这类软件最低要求不高。最高没上限。纯粹看你的工程量大小。CPU有双核,内存有4G,就可以运行。但是实际体验肯定比较差,卡是肯德。渲染时间也会超长,一个小作品渲染几小时是正常的。稍微大点的工程也...
- 2025年平板性价比排行(2020年值得买的平板)
-
推荐台电P30S好。 基本配置:10.1英寸IPS广视角屏幕,1280*800分辨率,16:10的黄金显示比例,K9高压独立功放,支持3.5mm耳麦接口,联发科MT8183八核处理器,4GB...
- 2020显卡天梯图10月(2020显卡天梯图极速空间)
-
排行球队名称积分已赛胜平负进球失球净胜球 1?诺维奇城974629107753639 2?沃特福德91462710...
-
- 笔记本电脑无线网络连接(笔记本电脑无线网络连接不上怎么办)
-
一、笔记本电脑怎么连接wifi---win7系统笔记本连接wifi1、要先创建无线网络连接,将鼠标移到Win7的开始菜单,然后点击“控制面板”。2、然后点击“网络和Internet”。3、再打开“网络和共享中心”,这是Win7系统必有的功...
-
2025-12-22 05:55 liuian
- wind数据库(wind数据库官网)
-
先购买wind数据库,安装好wind取得使用权后,按照wind所给提示,输入账户和密码可使用wind数据库。Wind资讯金融终端是一个集实时行情、资料查询、数据浏览、研究分析、新闻资讯为一体的金融数据...
- 如何关闭360家庭防火墙(如果关闭360家庭防火墙)
-
关闭方法如下:1.打开手机360主界面之后,点击“安全防护中心”。2.点击第三列“入口防护”下方的“查看状态”按钮。3.在列出的功能项中找到“局域网防护”,直接点击后面的“关闭”按钮,关闭所有的“局域...
- 笔记本电脑型号配置怎么看(怎么查自己电脑的型号)
-
查电脑的配置和型号方法:方法一:1、右键单击“此电脑”,点击属性2、这里可以看到操作系统,CPU等大致信息3、点击设备管理器4、这里可以查看具体硬件的详细信方法二:1、首先打开电脑上的“控制面板”2、...
- pscs6序列号是什么
-
AdobePhotoshopCS6就二个版本(测试版和正式版)1、AdobePhotoshopCS6是AdobePhotoshop的第13代,是一个较为重大的版本更新。2、Photoshop在前几...
- win7桌面图片怎么设置(win7如何设置桌面图片)
-
1、首先用鼠标右键单击桌面的空白处。然后在弹出的菜单上选择“个性化”选项。这样就弹出了的个性化窗口上能显示看到“桌面背景”按钮。点击它即可。2、继续打开了选择“桌面背景”选项,然后在上面选择你想要设置...
- windows安卓下载(win安卓版)
-
2265安卓网是安全的,2265安卓网成立于2012年初,网站一直努力为各位安卓爱好者提供最新、最全的安卓游戏软件资源下载。经过几个月的努力、和广大安卓用户的支持、2265安卓网截至到2012年6月已...
- 一周热门
- 最近发表
- 标签列表
-
- python判断字典是否为空 (50)
- crontab每周一执行 (48)
- aes和des区别 (43)
- bash脚本和shell脚本的区别 (35)
- canvas库 (33)
- dataframe筛选满足条件的行 (35)
- gitlab日志 (33)
- lua xpcall (36)
- blob转json (33)
- python判断是否在列表中 (34)
- python html转pdf (36)
- 安装指定版本npm (37)
- idea搜索jar包内容 (33)
- css鼠标悬停出现隐藏的文字 (34)
- linux nacos启动命令 (33)
- gitlab 日志 (36)
- adb pull (37)
- python判断元素在不在列表里 (34)
- python 字典删除元素 (34)
- vscode切换git分支 (35)
- python bytes转16进制 (35)
- grep前后几行 (34)
- hashmap转list (35)
- c++ 字符串查找 (35)
- mysql刷新权限 (34)
