百度360必应搜狗淘宝本站头条
当前位置:网站首页 > IT知识 > 正文

pandas每天一题-题目14:新增列的多种方式

liuian 2024-12-20 17:20 68 浏览


这是一个关于 pandas 从基础到进阶的练习题系列,来源于 github 上的 guipsamora/pandas_exercises 。这个项目从基础到进阶,可以检验你有多么了解 pandas。

我会挑选一些题目,并且提供比原题库更多的解决方法以及更详尽的解析

计划每天更新一期,希望各位小伙伴先自行思考,再查看答案。如果对你有帮助,记得转发推荐给你的好友!

上期文章:pandas每天一题-题目13:文本筛选

后台回复"数据",可以下载本题数据集

如下数据:

import pandas as pd
import numpy as np

df = pd.read_csv('chipotle.tsv',
                 sep='\t',
                 converters={'item_price': lambda x: float(x[1:-1])})

数据描述:

  • 此数据是订单明细表。一个订单会包含很多明细项,表中每个样本(每一行)表示一个明细项
  • order_id 列存在重复
  • item_name 是明细项物品名称
  • quantity 是明细项数量
  • item_price 是该明细项的总价钱

前面章节讲解过的知识点,本文不再讲解!

**需求:新增一列 unit_price ,计算方式为 item_price/quantity **

下面是答案了

注意,本文所有方式,都可以用于新增列和修改原有列数据


方式1

网络上最常出现的方式:

df['unit_price'] = df['item_price'] / df['quantity']
df

点评:

这种方式最大的缺点是修改了原数据


方式2

简单的表达式,可以使用 eval 进一步简化:

df.eval('unit_price = item_price/quantity')

注意,方法返回一个新的 DataFrame,而原来的表格(df)并没有改变

点评:

  1. eval 非常适合一些简单的表达式
  2. 由于计算逻辑是字符串,此时可以把计算逻辑放入 excel 表格中
  3. 不会修改原数据,适合临时数据列

方式3

为什么 eval 只能用在简单的表达式?因为复杂的表达式它无法从文本中解析。

而方式1又比较繁琐,并且会改变原数据。

为此,pandas 提供一个方法:

df.assign(unit_price = df.item_price/df.quantity)

初学者可能不太理解这里的写法,实际上它只不过是普通的方法调用。

value = df.item_price/df.quantity
df.assign(unit_price = value)
  • 行1:2个列计算,得到的仍然是一列(Series)
  • 行2:调用 assign 方法,给参数 unit_price 赋值

assign 方法是动态参数,也就是说任何 df 没有的列名作为参数,视为新增列。存在的列名作为参数,视为覆盖原有列

但是,这种设计有一个缺陷,python 参数名字是有限制,比如参数名字不能有空格。

那么如果列名真的需要有空格怎么办?

我们可以利用字典解包方式调用方法:

args = {
    '单 价':df.item_price/df.quantity
}
df.assign(**args)

这里还不能体现出复杂表达式的场景,例如我们加载数据时没有处理 item_price 列,此时这一列是文本。

我们可以在表达式中做文本转数值以及计算单价2步操作:

df = pd.read_csv('chipotle.tsv', sep='\t')

args = {
    '单 价': df.item_price.apply(lambda x: float(x[1:-1])) / df.quantity
}

df.assign(**args)

关于文本转数值请回看之前的章节



更多 pandas 高级应用教程,请订阅我的 pandas 专栏:


推荐阅读:

  1. 懂Excel就能轻松入门Python数据分析包pandas(五):重复值处理
  2. Python进阶系列:细讲Python推导式
  3. 为什么你总是学不会Python,入门Python的4大陷阱

相关推荐

2025年平板性价比排行(2020年值得买的平板)

推荐台电P30S好。 基本配置:10.1英寸IPS广视角屏幕,1280*800分辨率,16:10的黄金显示比例,K9高压独立功放,支持3.5mm耳麦接口,联发科MT8183八核处理器,4GB...

2020显卡天梯图10月(2020显卡天梯图极速空间)

排行球队名称积分已赛胜平负进球失球净胜球  1?诺维奇城974629107753639 2?沃特福德91462710...

路由器加密防蹭网(路由器加密防蹭网吗)
  • 路由器加密防蹭网(路由器加密防蹭网吗)
  • 路由器加密防蹭网(路由器加密防蹭网吗)
  • 路由器加密防蹭网(路由器加密防蹭网吗)
  • 路由器加密防蹭网(路由器加密防蹭网吗)
笔记本电脑无线网络连接(笔记本电脑无线网络连接不上怎么办)
笔记本电脑无线网络连接(笔记本电脑无线网络连接不上怎么办)

一、笔记本电脑怎么连接wifi---win7系统笔记本连接wifi1、要先创建无线网络连接,将鼠标移到Win7的开始菜单,然后点击“控制面板”。2、然后点击“网络和Internet”。3、再打开“网络和共享中心”,这是Win7系统必有的功...

2025-12-22 05:55 liuian

wind数据库(wind数据库官网)

先购买wind数据库,安装好wind取得使用权后,按照wind所给提示,输入账户和密码可使用wind数据库。Wind资讯金融终端是一个集实时行情、资料查询、数据浏览、研究分析、新闻资讯为一体的金融数据...

如何关闭360家庭防火墙(如果关闭360家庭防火墙)

关闭方法如下:1.打开手机360主界面之后,点击“安全防护中心”。2.点击第三列“入口防护”下方的“查看状态”按钮。3.在列出的功能项中找到“局域网防护”,直接点击后面的“关闭”按钮,关闭所有的“局域...

笔记本电脑型号配置怎么看(怎么查自己电脑的型号)

查电脑的配置和型号方法:方法一:1、右键单击“此电脑”,点击属性2、这里可以看到操作系统,CPU等大致信息3、点击设备管理器4、这里可以查看具体硬件的详细信方法二:1、首先打开电脑上的“控制面板”2、...

pscs6序列号是什么

AdobePhotoshopCS6就二个版本(测试版和正式版)1、AdobePhotoshopCS6是AdobePhotoshop的第13代,是一个较为重大的版本更新。2、Photoshop在前几...

win7桌面图片怎么设置(win7如何设置桌面图片)

1、首先用鼠标右键单击桌面的空白处。然后在弹出的菜单上选择“个性化”选项。这样就弹出了的个性化窗口上能显示看到“桌面背景”按钮。点击它即可。2、继续打开了选择“桌面背景”选项,然后在上面选择你想要设置...

windows安卓下载(win安卓版)

2265安卓网是安全的,2265安卓网成立于2012年初,网站一直努力为各位安卓爱好者提供最新、最全的安卓游戏软件资源下载。经过几个月的努力、和广大安卓用户的支持、2265安卓网截至到2012年6月已...

电脑ppt怎么制作(电脑ppt怎么制作软件)
  • 电脑ppt怎么制作(电脑ppt怎么制作软件)
  • 电脑ppt怎么制作(电脑ppt怎么制作软件)
  • 电脑ppt怎么制作(电脑ppt怎么制作软件)
  • 电脑ppt怎么制作(电脑ppt怎么制作软件)
电脑系统网站排行榜(电脑系统网址还有哪些)

车架号查询网站:http://www.yiparts.com/vin通过车架号查询车辆信息。新国标电动车一般是15位纯数字的车架号,如175721508069087,1757前四位是企业代码,由企业申...

清理磁盘碎片怎么清理(清理磁盘碎片怎么清理不了)

清除磁盘碎片的方法是通过使用磁盘清理工具来进行操作。首先,明确结论是清除磁盘碎片可以提高电脑的性能和运行速度。其次,原因是磁盘碎片是指文件在硬盘上存储时被分割成多个碎片,导致读取速度变慢。清除磁盘碎片...

怎么安装qq软件(怎样安装qq)
  • 怎么安装qq软件(怎样安装qq)
  • 怎么安装qq软件(怎样安装qq)
  • 怎么安装qq软件(怎样安装qq)
  • 怎么安装qq软件(怎样安装qq)
kms激活win7提示不是vl版(不是vol版无法使用kms激活)

1.可以通过KMS激活或者使用激活工具进行激活。2.因为VL版的Windows需要通过企业或者教育机构购买,所以需要使用KMS激活或者激活工具进行激活。3.如果想要更加稳定和安全的激活方式,可以...