百度360必应搜狗淘宝本站头条
当前位置:网站首页 > IT知识 > 正文

Pandas .loc 和 .iloc数据切片的差异

liuian 2025-09-06 06:25 18 浏览

在 Python 编程中,切片(slicing)是一种从字符串、列表或元组中提取子集的强大工具。同样,在 Pandas 库中,切片也可用于 Series 和 DataFrame 对象,但其行为方式略有不同,容易导致“越界”错误。本文将详细探讨如何在 Pandas 中正确使用切片操作,分析 .loc 和 .iloc 方法的差异,并通过示例代码阐明其工作原理。

1. Python 中的基本切片操作

在 Python 中,切片允许从序列(如字符串、列表或元组)中提取指定范围的元素。Python 切片遵循“包含起始索引,不包含结束索引”的规则。

示例:字符串切片

假设我们有一个字符串:

text = "abcdefghij"  # 包含 10 个字符
  • text[0] 返回第一个字符:"a"
  • text[4] 返回索引 4 的字符(即第 5 个字符):"e"
  • text[7] 返回索引 7 的字符(即第 8 个字符):"h"
  • text[4:7] 返回从索引 4 到索引 6(不包含 7)的子字符串:"efg"

示例:列表切片

对于列表,切片行为类似:

my_list = [10, 20, 30, 40, 50, 60, 70, 80, 90, 100]
  • my_list[4] 返回索引 4 的元素:50
  • my_list[7] 返回索引 7 的元素:80
  • my_list[4:7] 返回从索引 4 到索引 6 的子列表:[50, 60, 70]

若要提取从索引 7 到列表末尾的元素,可以使用以下方法:

my_list[7:]  # 返回 [80, 90, 100]

或者显式指定结束索引:

my_list[7:10]  # 虽然索引 10 不存在,但返回 [80, 90, 100]

2. Pandas 中的切片操作

在 Pandas 中,Series 和 DataFrame 支持切片,但行为因使用 .loc 或 .iloc 而异。以下详细说明这两种方法。

2.1 创建 Pandas Series

以下是一个简单的 Pandas Series 示例:

import pandas as pd

s = pd.Series([10, 20, 30, 40, 50, 60, 70, 80, 90, 100])

2.2 使用.loc 和.iloc 进行切片

  • .loc 基于标签(label-based):根据索引的标签(可以是数字、字符串等)进行切片,包含结束标签。
  • .iloc 基于位置(position-based):根据整数位置进行切片,遵循 Python 的“包含起始索引,不包含结束索引”规则。

示例:.loc 和.iloc 的行为差异

# 使用 .loc 切片
print(s.loc[4:7])  # 输出索引 4 到 7(包含 7)的元素
# 输出:
# 4    50
# 5    60
# 6    70
# 7    80
# dtype: int64

# 使用 .iloc 切片
print(s.iloc[4:7])  # 输出索引 4 到 6(不包含 7)的元素
# 输出:
# 4    50
# 5    60
# 6    70
# dtype: int64

.loc 的包含结束标签行为与 Python 标准切片不同,这可能会让开发者感到意外。原因在于,Pandas 允许自定义索引,而非总是使用连续的整数索引。

2.3 自定义索引的复杂性

当 Series 使用自定义索引(如字符串)时,.loc 的行为更直观。考虑以下示例:

s = pd.Series([10, 20, 30, 40, 50, 60, 70, 80, 90, 100], 
              index=['a', 'b', 'c', 'd', 'e', 'f', 'g', 'h', 'i', 'j'])
print(s.loc['d':'g'])  # 输出从标签 'd' 到 'g'(包含 'g')的元素
# 输出:
# d    40
# e    50
# f    60
# g    70
# dtype: int64

若索引非连续或非有序,.loc 仍会尝试包含起始和结束标签之间的所有元素。例如:

s = pd.Series([10, 20, 30, 40, 50], index=['j', 'i', 'g', 'f', 'e'])
print(s.loc['i':'e'])  # 输出从标签 'i' 到 'e'(包含 'e')
# 输出:
# i    20
# g    30
# f    40
# e    50
# dtype: int64

2.4 非唯一索引的问题

当索引包含重复值时,.loc 切片可能报错。例如:

s = pd.Series([10, 20, 30, 40, 50], index=['a', 'a', 'b', 'b', 'c'])
# print(s.loc['a':'b'])  # 报错:ValueError: cannot get left slice bound for non-unique label 'a'

解决方法是先对索引排序:

s_sorted = s.sort_index()
print(s_sorted.loc['a':'b'])
# 输出:
# a    10
# a    20
# b    30
# b    40
# dtype: int64

3. 在 DataFrame 中使用切片

DataFrame 的切片行为与 Series 类似,但需要注意 .loc 和 .iloc 的使用场景。以下示例使用一个出租车数据集:

df = pd.read_csv('taxi.csv')  # 假设 taxi.csv 包含出租车行程数据

示例:DataFrame 切片

假设 df 的索引是默认的整数索引:

print(df.loc[100:105])  # 输出索引 100 到 105(包含 105)的行
print(df.iloc[100:105])  # 输出索引 100 到 104(不包含 105)的行

若将某列(如 trip_pickup_datetime)设为索引:

df = df.set_index('trip_pickup_datetime')
# print(df.loc['2023-01-01 00:00:00':'2023-01-01 01:00:00'])  # 可能报错,若索引非唯一
df_sorted = df.sort_index()
print(df_sorted.loc['2023-01-01 00:00:00':'2023-01-01 01:00:00'])

4. 切片操作的注意事项

  1. 推荐使用 .loc.iloc:避免直接使用方括号([]),因为在 Series 中方括号表示元素选择,而在 DataFrame 中表示列选择,容易引发混淆。
  2. .loc 包含结束标签:与 Python 标准切片不同,.loc 的切片包含结束索引。
  3. .iloc 遵循 Python 切片规则:基于位置的切片,始终不包含结束索引。
  4. 非唯一索引需排序:在使用 .loc 进行切片前,确保索引唯一或已排序,否则可能导致错误。
  5. DataFrame 复杂索引:当 DataFrame 使用非数字索引(如日期时间)时,.loc 更适合处理基于标签的范围选择。

5. 结论

Pandas 的切片功能为数据处理提供了灵活性,但 .loc 和 .iloc 的行为差异需要特别注意。.loc 基于标签且包含结束标签,适合自定义索引;.iloc 基于位置且不包含结束索引,与 Python 标准切片一致。在处理非唯一或无序索引时,排序索引是避免错误的关键。通过合理使用这两种方法,开发者可以高效、准确地操作 Pandas 的 Series 和 DataFrame。

<script type="text/javascript" src="//mp.toutiao.com/mp/agw/mass_profit/pc_product_promotions_js?item_id=7521976811677286938"></script>

相关推荐

搭建一个20人的办公网络(适用于20多人的小型办公网络环境)

楼主有5台机上网,则需要一个8口路由器,组网方法如下:设备:1、8口路由器一台,其中8口为LAN(局域网)端口,一个WAN(广域网)端口,价格100--400元2、网线N米,这个你自己会看了:)...

笔记本电脑各种参数介绍(笔记本电脑各项参数新手普及知识)

1、CPU:这个主要取决于频率和二级缓存,频率越高、二级缓存越大,速度越快,现在的CPU有三级缓存、四级缓存等,都影响相应速度。2、内存:内存的存取速度取决于接口、颗粒数量多少与储存大小,一般来说,内...

汉字上面带拼音输入法下载(字上面带拼音的输入法是哪个)

使用手机上的拼音输入法打成汉字的方法如下:1.打开手机上的拼音输入法,在输入框中输入汉字的拼音,例如“nihao”。2.根据输入法提示的候选词,选择正确的汉字。例如,如果输入“nihao”,输...

xpsp3安装版系统下载(windowsxpsp3安装教程)

xpsp3纯净版在采用微软封装部署技术的基础上,结合作者的实际工作经验,融合了许多实用的功能。它通过一键分区、一键装系统、自动装驱动、一键设定分辨率,一键填IP,一键Ghost备份(恢复)等一系列...

没有备份的手机数据怎么恢复

手机没有备份恢复数据方法如下1、使用数据线将手机与电脑连接好,在“我的电脑”中可以看到手机的盘符。  2、将手机开启USB调试模式。在手机设置中找到开发者选项,然后点击“开启USB调试模式”。  3、...

电脑怎么激活windows11专业版

win11专业版激活方法有多种,以下提供两种常用的激活方式:方法一:使用激活密钥激活。在win11桌面上右键点击“此电脑”,选择“属性”选项。进入属性页面后,点击“更改产品密钥或升级windows”。...

华为手机助手下载官网(华为手机助手app下载专区)

华为手机助手策略调整,已不支持从应用市场下载手机助手,目前华为手机助手是需要在电脑上下载或更新手机助手到最新版本,https://consumer.huawei.com/cn/support/his...

光纤线断了怎么接(宽带光纤线断了怎么接)

宽带光纤线断了可以重接,具体操作方法如下:1、光纤连接的时候要根据束管内,同色相连,同芯相连,按顺序进行连接,由大到小。一般有三种连接方法,分别是熔接、活动连接和机械连接。2、连接的时候要开剥光缆,抛...

深度操作系统安装教程(深度操作系统安装教程图解)
  • 深度操作系统安装教程(深度操作系统安装教程图解)
  • 深度操作系统安装教程(深度操作系统安装教程图解)
  • 深度操作系统安装教程(深度操作系统安装教程图解)
  • 深度操作系统安装教程(深度操作系统安装教程图解)
win7旗舰版和专业版区别(win7旗舰版跟专业版)

1、功能区别:Win7旗舰版比专业版多了三个功能,分别是Bitlocker、BitlockerToGo和多语言界面; 2、用途区别:旗舰版的功能是所有版本中最全最强大的,占用的系统资源,...

万能连接钥匙(万能wifi连接钥匙下载)

1、首先打开wifi万能钥匙软件,若手机没有开启WLAN,就根据软件提示打开WLAN开关;2、打开WLAN开关后,会显示附近的WiFi,如果知道密码,可点击相应WiFi后点击‘输入密码’连接;3、若不...

雨林木风音乐叫什么(雨林木风是啥)

雨林木风的创始人是陈年鑫先生。陈年鑫先生于1999年创立了雨林木风公司,其初衷是为满足中国市场对高品质、高性能电脑的需求。在陈年鑫先生的领导下,雨林木风以技术创新、产品质量和客户服务为核心价值,不断推...

aics6序列号永久序列号(aics6破解序列号)

关于AICS6这个版本,虽然是比较久远的版本,但是在功能上也是十分全面和强大的,作为一名平面设计师的话,AICS6的现有的功能已经能够应付几乎所有的设计工作了……到底AICC2019的功能是不是...

win7正在启动windows 卡住(win7正在启动windows卡住了 进入安全模式)
  • win7正在启动windows 卡住(win7正在启动windows卡住了 进入安全模式)
  • win7正在启动windows 卡住(win7正在启动windows卡住了 进入安全模式)
  • win7正在启动windows 卡住(win7正在启动windows卡住了 进入安全模式)
  • win7正在启动windows 卡住(win7正在启动windows卡住了 进入安全模式)
手机可以装电脑系统吗(手机可以装电脑系统吗怎么装)

答题公式1:手机可以通过数据线或无线连接的方式给电脑装系统。手机安装系统需要一定的技巧和软件支持,一般需要通过数据线或无线连接的方式与电脑连接,并下载相应的软件和系统文件进行安装。对于大部分手机用户来...