百度360必应搜狗淘宝本站头条
当前位置:网站首页 > IT知识 > 正文

Python2大类方法筛选excel特定的值以及范围

liuian 2024-12-20 17:18 82 浏览

1.前言

查询筛选是数据分析常用的功能,我们在做数据挖掘时往往需要先进行数据预处理,然后就可以按各种条件以及相关的组合筛选中所需数据, 我们主要从以下方面来分析查询和筛选常用的操作。①在中括号里设定筛选条件筛选特定的行;②使用isin方法筛选特定的值 ;③loc和iloc以后分享。

完整代码如下所示。

  # 2种小方法使用Python进行excel数据筛选
  import pandas as pd
  dataFrame = pd.read_csv('./商品需求训练集.csv')
  dataFrame.head()
  # 1. 在中括号里设定筛选条件筛选特定范围
  # 1.1筛选label列中大于0的数据
  a = dataFrame[dataFrame['label'] > 0]
  a
  # 1.2多个筛选条件,用"&"或"|"连接起来。注意用小括号将筛选条件括起来
  b = dataFrame[(dataFrame['label'] > 0) & (dataFrame['is_sale_day']==1)]
  # 1.3筛选label列中在(0, 10]范围之内并且is_sale_day等于1的数据。
  c = dataFrame[(dataFrame['label'] > 0) & (dataFrame['label'] <= 10) & (dataFrame['is_sale_day']==1)]
  # 1.4 更改label范围为(0,100]查询结果如下:
  c = dataFrame[(dataFrame['label'] > 0) & (dataFrame['label'] <= 100) & (dataFrame['is_sale_day']==1)]
  c# 
  # 1.5 筛选出大于label变量平均值的数据,并降序处理
  d = dataFrame[dataFrame['label'] > dataFrame['label'].mean()].sort_values(by='label', ascending=False)
  d.head()
  # 2. 使用isin方法进行筛选
  # 我们需要锁定筛选某些具体的值的,这时候就需要isin了。
  # 比如我们要限定label取值只能为274.0, 115.0, 118.0时。
  # 此时可将其作为列表传入到isin方法中
  # 2.1 筛选单个的值
  lst = [274.0]
  e1 = dataFrame[dataFrame.label.isin(lst )]
  e2 = dataFrame[dataFrame['label'].isin(lst)]
  e1, e2
  # 2.2 同时筛选多个的值
  lst2 = [274.0, 115.0, 118.0]
  g = dataFrame[dataFrame["label"].isin(lst2)]
  g

2.步骤

1.在中括号里设定筛选条件过滤行

1.1 在中括号中输入单个筛选条件

我们以某个比赛中的训练集的数据为例,数据的基本信息如下所示。

比如说,我们想要筛选label列中大于0的数据,具体代码如下所示。

  
  a = dataFrame[dataFrame['label'] > 0]
  a

运行结果如下所示。

1.2 在中括号中输入多个筛选条件(2个)

如果说有多个筛选条件,可以用“&”(表示“且”)或“|”(表示“或”)连接起来。就比如说,筛选label列中大于0和is_sale_day等于1的数据,注意要用小括号将并列的筛选条件括起来。否则可能出错,或者查找不到正确的数据。具体代码如下所示。

  
  b = dataFrame[(dataFrame['label'] > 0) & (dataFrame['is_sale_day']==1)]
  b

具体运行结果如下所示。可以看出筛选出来的结果同时满足label大于0和is_sale_day等于1的条件。

1.3 在中括号中三个筛选条件

比如说筛选在label在某一范围内的数据,设定上限和下限需要用到两个条件,然后根据自己的情况可以再增加一些条件。如筛选label范围为(0,100]并且is_sale_day的值等于1的情况, 具体代码如下所示。

  
  c = dataFrame[(dataFrame['label'] > 0) 
  & (dataFrame['label'] <= 10) 
  & (dataFrame['is_sale_day']==1)]
  c

如下所示,查询无结果。可知在该条件下没有符合要求的项。


尝试更改label范围为(0,100]查询结果如下:

1.4 筛选出大于label变量平均值的数据,并升序处理

如下所示,其中默认为升序排序,我们可以设置参数ascending=False将其变为降序排序。

  
  d = dataFrame[dataFrame['label'] > dataFrame['label'].mean()].sort_values(by='label', ascending=False)
  d.head()

具体结果如下所示。


2.使用isin方法进行筛选

在之前,我们筛选条件基本上都是给出范围,但实际上很多时候我们需要锁定筛选某些具体的值,这时候isin方法就可以派上用场了。

比如我们要限定label取值只能为274.0, 115.0, 118.0时。此时可将其作为列表传入到isin方法中,具体代码如下所示。

2.1筛选单个的值

  
  lst = [274.0]
  e1 = dataFrame[dataFrame.label.isin(lst)]
  e2 = dataFrame[dataFrame['label'].isin(lst)]
  e1, e2

如上所示,将需要查询的值以列表的方式进行传入,然后获取数据中的待查询列(如上第二行和第三行代码所示,有两种方法可以获取列),最后调用isin()方法。

类似地,当我们想要同时查询多个值时,只需要更改列表中的值即可。

2.2 同时筛选多个的值

我们需要将label列中值为274.0, 115.0, 118.0 的所在行全部筛选出来,具体代码如下所示。

  
  lst2 = [274.0, 115.0, 118.0]
  g = dataFrame[dataFrame["label"].isin(lst2)]
  g

如上所示,具体的运行结果如下所示。

相关推荐

电脑音量小喇叭不见了(电脑声音喇叭图标不见了怎么办)

如果您电脑上的小喇叭(扬声器)不见了,可以尝试以下方法找回:1.检查设备管理器:在Windows下,右键点击“我的电脑”(或此电脑)->点击“属性”->点击“设备管理器”,查看“声音、视...

腾达路由器手机设置教程(腾达路由器手机设置教程视频)

用手机设置腾达路由器的方法如下:1在手机上打开浏览器,输入路由器背面的管理IP和用户及对应的密码2一般第一次打开,默认会跳出设置向导,准备好宽带用户名和密码,3按向导提示输入相应内容4在无线设置的安全...

自配电脑配置推荐(自配电脑配置推荐百度)

首先,像这类软件最低要求不高。最高没上限。纯粹看你的工程量大小。CPU有双核,内存有4G,就可以运行。但是实际体验肯定比较差,卡是肯德。渲染时间也会超长,一个小作品渲染几小时是正常的。稍微大点的工程也...

2025年平板性价比排行(2020年值得买的平板)

推荐台电P30S好。 基本配置:10.1英寸IPS广视角屏幕,1280*800分辨率,16:10的黄金显示比例,K9高压独立功放,支持3.5mm耳麦接口,联发科MT8183八核处理器,4GB...

2020显卡天梯图10月(2020显卡天梯图极速空间)

排行球队名称积分已赛胜平负进球失球净胜球  1?诺维奇城974629107753639 2?沃特福德91462710...

路由器加密防蹭网(路由器加密防蹭网吗)
  • 路由器加密防蹭网(路由器加密防蹭网吗)
  • 路由器加密防蹭网(路由器加密防蹭网吗)
  • 路由器加密防蹭网(路由器加密防蹭网吗)
  • 路由器加密防蹭网(路由器加密防蹭网吗)
笔记本电脑无线网络连接(笔记本电脑无线网络连接不上怎么办)
笔记本电脑无线网络连接(笔记本电脑无线网络连接不上怎么办)

一、笔记本电脑怎么连接wifi---win7系统笔记本连接wifi1、要先创建无线网络连接,将鼠标移到Win7的开始菜单,然后点击“控制面板”。2、然后点击“网络和Internet”。3、再打开“网络和共享中心”,这是Win7系统必有的功...

2025-12-22 05:55 liuian

wind数据库(wind数据库官网)

先购买wind数据库,安装好wind取得使用权后,按照wind所给提示,输入账户和密码可使用wind数据库。Wind资讯金融终端是一个集实时行情、资料查询、数据浏览、研究分析、新闻资讯为一体的金融数据...

如何关闭360家庭防火墙(如果关闭360家庭防火墙)

关闭方法如下:1.打开手机360主界面之后,点击“安全防护中心”。2.点击第三列“入口防护”下方的“查看状态”按钮。3.在列出的功能项中找到“局域网防护”,直接点击后面的“关闭”按钮,关闭所有的“局域...

笔记本电脑型号配置怎么看(怎么查自己电脑的型号)

查电脑的配置和型号方法:方法一:1、右键单击“此电脑”,点击属性2、这里可以看到操作系统,CPU等大致信息3、点击设备管理器4、这里可以查看具体硬件的详细信方法二:1、首先打开电脑上的“控制面板”2、...

pscs6序列号是什么

AdobePhotoshopCS6就二个版本(测试版和正式版)1、AdobePhotoshopCS6是AdobePhotoshop的第13代,是一个较为重大的版本更新。2、Photoshop在前几...

win7桌面图片怎么设置(win7如何设置桌面图片)

1、首先用鼠标右键单击桌面的空白处。然后在弹出的菜单上选择“个性化”选项。这样就弹出了的个性化窗口上能显示看到“桌面背景”按钮。点击它即可。2、继续打开了选择“桌面背景”选项,然后在上面选择你想要设置...

windows安卓下载(win安卓版)

2265安卓网是安全的,2265安卓网成立于2012年初,网站一直努力为各位安卓爱好者提供最新、最全的安卓游戏软件资源下载。经过几个月的努力、和广大安卓用户的支持、2265安卓网截至到2012年6月已...

电脑ppt怎么制作(电脑ppt怎么制作软件)
  • 电脑ppt怎么制作(电脑ppt怎么制作软件)
  • 电脑ppt怎么制作(电脑ppt怎么制作软件)
  • 电脑ppt怎么制作(电脑ppt怎么制作软件)
  • 电脑ppt怎么制作(电脑ppt怎么制作软件)
电脑系统网站排行榜(电脑系统网址还有哪些)

车架号查询网站:http://www.yiparts.com/vin通过车架号查询车辆信息。新国标电动车一般是15位纯数字的车架号,如175721508069087,1757前四位是企业代码,由企业申...