百度360必应搜狗淘宝本站头条
当前位置:网站首页 > IT知识 > 正文

pandas每天一题-题目14:新增列的多种方式

liuian 2024-12-20 17:20 46 浏览


这是一个关于 pandas 从基础到进阶的练习题系列,来源于 github 上的 guipsamora/pandas_exercises 。这个项目从基础到进阶,可以检验你有多么了解 pandas。

我会挑选一些题目,并且提供比原题库更多的解决方法以及更详尽的解析

计划每天更新一期,希望各位小伙伴先自行思考,再查看答案。如果对你有帮助,记得转发推荐给你的好友!

上期文章:pandas每天一题-题目13:文本筛选

后台回复"数据",可以下载本题数据集

如下数据:

import pandas as pd
import numpy as np

df = pd.read_csv('chipotle.tsv',
                 sep='\t',
                 converters={'item_price': lambda x: float(x[1:-1])})

数据描述:

  • 此数据是订单明细表。一个订单会包含很多明细项,表中每个样本(每一行)表示一个明细项
  • order_id 列存在重复
  • item_name 是明细项物品名称
  • quantity 是明细项数量
  • item_price 是该明细项的总价钱

前面章节讲解过的知识点,本文不再讲解!

**需求:新增一列 unit_price ,计算方式为 item_price/quantity **

下面是答案了

注意,本文所有方式,都可以用于新增列和修改原有列数据


方式1

网络上最常出现的方式:

df['unit_price'] = df['item_price'] / df['quantity']
df

点评:

这种方式最大的缺点是修改了原数据


方式2

简单的表达式,可以使用 eval 进一步简化:

df.eval('unit_price = item_price/quantity')

注意,方法返回一个新的 DataFrame,而原来的表格(df)并没有改变

点评:

  1. eval 非常适合一些简单的表达式
  2. 由于计算逻辑是字符串,此时可以把计算逻辑放入 excel 表格中
  3. 不会修改原数据,适合临时数据列

方式3

为什么 eval 只能用在简单的表达式?因为复杂的表达式它无法从文本中解析。

而方式1又比较繁琐,并且会改变原数据。

为此,pandas 提供一个方法:

df.assign(unit_price = df.item_price/df.quantity)

初学者可能不太理解这里的写法,实际上它只不过是普通的方法调用。

value = df.item_price/df.quantity
df.assign(unit_price = value)
  • 行1:2个列计算,得到的仍然是一列(Series)
  • 行2:调用 assign 方法,给参数 unit_price 赋值

assign 方法是动态参数,也就是说任何 df 没有的列名作为参数,视为新增列。存在的列名作为参数,视为覆盖原有列

但是,这种设计有一个缺陷,python 参数名字是有限制,比如参数名字不能有空格。

那么如果列名真的需要有空格怎么办?

我们可以利用字典解包方式调用方法:

args = {
    '单 价':df.item_price/df.quantity
}
df.assign(**args)

这里还不能体现出复杂表达式的场景,例如我们加载数据时没有处理 item_price 列,此时这一列是文本。

我们可以在表达式中做文本转数值以及计算单价2步操作:

df = pd.read_csv('chipotle.tsv', sep='\t')

args = {
    '单 价': df.item_price.apply(lambda x: float(x[1:-1])) / df.quantity
}

df.assign(**args)

关于文本转数值请回看之前的章节



更多 pandas 高级应用教程,请订阅我的 pandas 专栏:


推荐阅读:

  1. 懂Excel就能轻松入门Python数据分析包pandas(五):重复值处理
  2. Python进阶系列:细讲Python推导式
  3. 为什么你总是学不会Python,入门Python的4大陷阱

相关推荐

赶紧收藏!编程python基础知识,本文给你全部整理好了

想一起学习编程Python的同学,趁我粉丝少,可以留言、私信领编程资料~Python基础入门既然学习Python,那么至少得了解下这门编程语言,知道Python代码执行过程吧。Python的历...

创建绩效改进计划 (PIP) 的6个步骤

每个经理都必须与未能达到期望的员工抗衡,也许他们的表现下降了,他们被分配了新的任务并且无法处理它们,或者他们处理了自己的任务,但他们的行为对他人造成了破坏。许多公司转向警告系统,然后在这些情况下终止。...

PI3K/AKT信号通路全解析:核心分子、上游激活与下游效应分子

PI3K/AKT/mTOR(PAM)信号通路是真核细胞中高度保守的信号转导网络,作用于促进细胞存活、生长和细胞周期进程。PAM轴上生长因子向转录因子的信号传导受到与其他多条信号通路的多重交叉相互作用的...

互联网公司要求签PIP,裁员连N+1都没了?

2021年刚画上句号,令无数互联网公司从业者闻风丧胆的绩效公布时间就到了,脉脉上已然炸了锅。阿里3.25、腾讯二星、百度四挡、美团绩效C,虽然名称五花八门,实际上都代表了差绩效。拿到差绩效,非但不能晋...

Python自动化办公应用学习笔记3—— pip工具安装

3.1pip工具安装最常用且最高效的Python第三方库安装方式是采用pip工具安装。pip是Python包管理工具,提供了对Python包的查找、下载、安装、卸载的功能。pip是Python官方提...

单片机都是相通的_单片机是串行还是并行

作为一个七年的从业者,单片机对于我个人而言它是一种可编程的器件,现在长见到的电子产品中几乎都有单片机的身影,它们是以单片机为核心,根据不同的功能需求,搭建不同的电路,从8位的单片机到32位的单片机,甚...

STM32F0单片机快速入门八 聊聊 Coolie DMA

1.苦力DMA世上本没有路,走的人多了,便成了路。世上本没有DMA,需要搬运的数据多了,便有了DMA。大多数同学应该没有在项目中用过这个东西,因为一般情况下也真不需要这个东西。在早期的单片机中...

放弃51单片机,直接学习STM32开发可能会面临的问题

学习51单片机并非仅仅是为了学习51本身,而是通过它学习一种方法,即如何仅仅依靠Datasheet和例程来学习一种新的芯片。51单片机相对较简单,是这个过程中最容易上手的选择,而AVR单片机则更为复杂...

STM32串口通信基本原理_stm32串口原理图

通信接口背景知识设备之间通信的方式一般情况下,设备之间的通信方式可以分成并行通信和串行通信两种。并行与串行通信的区别如下表所示。串行通信的分类1、按照数据传送方向,分为:单工:数据传输只支持数据在一个...

单片机的程序有多大?_单片机的程序有多大内存

之前一直很奇怪一个问题,每次写好单片机程序之后,用烧录软件进行烧录时,能看到烧录文件也就是hex的文件大小:我用的单片机芯片是STM32F103C8T6,程序储存器(flash)只有64K。从...

解析STM32单片机定时器编码器模式及其应用场景

本文将对STM32单片机定时器编码器模式进行详细解析,包括介绍不同的编码器模式、各自的优缺点以及相同点和不同点的应用场景。通过阅读本文,读者将对STM32单片机定时器编码器模式有全面的了解。一、引言...

两STM32单片机串口通讯实验_两个32单片机间串口通信

一、实验思路连接两个STM32单片机的串口引脚,单片机A进行发送,单片机B进行接收。单片机B根据接收到单片机A的指令来点亮或熄灭板载LED灯,通过实验现象来验证是否通讯成功。二、实验器材两套STM32...

基于单片机的智能考勤机设计_基于51单片机的指纹考勤机

一、设计背景随着科技水平的不断发展,在这么一个信息化的时代,智能化信息处理已是提高效率、规范管理和客观审查的最有效途径。近几年来,国内很多公司都在加强对企业人员的管理,考勤作为企业的基础管理,是公司...

STM32单片机详细教学(二):STM32系列单片机的介绍

大家好,今天给大家介绍STM32系列单片机,文章末尾附有本毕业设计的论文和源码的获取方式,可进群免费领取。前言STM32系列芯片是为要求高性能、低成本、低功耗的嵌入式应用设计的ARMCortexM...

STM32单片机的 Hard-Fault 硬件错误问题追踪与分析

有过单片机开发经验的人应该都会遇到过硬件错误(Hard-Fault)的问题,对于这样的问题,有些问题比较容易查找,有些就查找起来很麻烦,甚至可能很久都找不到问题到底是出在哪里。特别是有时候出现一次,后...