Python之容器:字典(dict)缺失值处理不优雅?试试defaultdict
liuian 2024-11-28 00:42 28 浏览
引言
前面我们已经介绍了Python中字典(dict)的使用,在处理字典缺失键时,一种方式是加分支判断处理,但是有点繁琐;另外一种,是使用setdefault()方法,似乎已经简化了缺失值的处理。但是,setdefault()方法,其实还是有两个问题的:
1、setdefault()这个方法的名字比较怪,对不熟悉的童鞋来说,可读性比较差,需要在脑子里绕一会儿,一时半会儿难以理解这个代码要干啥;
2、还是不够高效,代码行数似乎还可以精简
针对缺失键的场景,Python提供了更加好用的工具,这就是collections包中的defaultdict。
本文的主要内容大致如下:
1、回顾一下使用dict在应对缺失值的做法
2、defaultdict的使用
dict缺失键的常规做法
以人员按照年龄的分组计数为例,来说明缺失值的应对场景。
首先生成测试数据,然后以常规的分支判断来统计:
from faker import Faker
from rich import print
fk = Faker('zh_CN')
# 为了数据尽量聚集,我们生成18~28年龄的测试数据
persons = [(fk.unique.name(), fk.random_int(18, 28)) for _ in range(100)]
print(persons)
# 按照年龄统计人数
count_by_age = {}
# 通过判断键值是否存在,分支处理
for name, age in persons:
if age in count_by_age:
count_by_age[age] += 1
else:
count_by_age[age] = 1
print(count_by_age)
执行结果:
我们也可以试着用前面提到过的setdefault()方法来处理,可以把分支判断的代码省掉:
count_by_age = {}
# 使用setdefault()方法来处理
for name, age in persons:
cnt = count_by_age.setdefault(age, 0)
count_by_age[age] += 1
print(count_by_age)
虽然有点奇怪……
接下来试试defaultdict来处理。
defaultdict的使用
简单看下defaultdict的定义:
传入一个default_factory的“函数”,这个函数会在当key不存在时,被调用,用来生成一个新的默认值。
接下来,看下上面的例子,使用defaultdict的实现:
from faker import Faker
from collections import defaultdict
fk = Faker('zh_CN')
# 为了数据尽量聚集,我们生成18~28年龄的测试数据
persons = [(fk.unique.name(), fk.random_int(18, 28)) for _ in range(100)]
# 按照年龄统计人数,这次不使用dict,改用defaultdict
count_by_age = defaultdict(int)
# 通过判断键值是否存在,分支处理
for name, age in persons:
count_by_age[age] += 1
print(count_by_age)
count_by_age2 = {}
# 使用setdefault()方法来处理
# 用来跟defaultdict处理的结果做对比
for name, age in persons:
cnt = count_by_age2.setdefault(age, 0)
count_by_age2[age] += 1
print(count_by_age2)
# 从定义来看,defaultdict与dict中元素相同时,比较时会返回True
print(count_by_age == count_by_age2)
执行结果:
可以看到,使用defaultdict时,我们直接通过索引的方式对不存在的key进行索引并执行更新操作,一行代码就搞定了。
其内部的实现逻辑是,首先判断key不存在时,会通过构造defaultdict对象时,传入的“函数”构造一个默认值,比如:
int()默认会创建一个值为0的整数对象,str()会创建一个值为""的字符串对象。
# 0
print(int())
# ''空字符串
print(str())
# 长度为0
print(len(str()))
其实,当需要进行分组收集时,defaultdict会更加好用。
比如,不同于前面的分组计数,我们这次要把每个年龄的人名都放在一起,放到一个list中,我们通过defaultdict来实现:
from faker import Faker
from rich import print
from collections import defaultdict
fk = Faker('zh_CN')
# 为了数据尽量聚集,我们生成18~28年龄的测试数据
persons = [(fk.unique.name(), fk.random_int(18, 28)) for _ in range(100)]
# 按照年龄分组收集
collect_by_age = defaultdict(list)
# 通过判断键值是否存在,分支处理
for name, age in persons:
collect_by_age[age].append(name)
print(collect_by_age)
代码中,我们使用list作为工厂函数进行默认值的构造,当key不存在时,创建一个空列表对象。
执行结果:
我们还可以自定义工厂函数来指定默认值,比如,我们默认每个人的年龄都是18:
def default_age():
return 18
persons = defaultdict(default_age)
print(persons['zs'])
persons['zs'] = 25
print(persons['zs'])
执行结果:
首次访问时,不存在,则会创建默认值18。
前面,之所以在函数上面打了引号,其实并不一定只能是函数,其实,只要是可调用的对象,比如,我们传入一个自定义类名,则会默认调用其__init__方法:
class Student:
def __init__(self):
self.name = 'unknown'
self.age = 0
def __str__(self):
return f"Student(name: {self.name}, age: {self.age})"
stus = defaultdict(Student)
print(stus['zs'])
stus['zs'].name = '张三'
stus['zs'].age = 18
print(stus['zs'])
执行结果:
总结
关于字典中缺失值处理的场景,本文首先介绍了dict中常规的分支判断的处理方法,以及通过setdefault()简化分支处理的方法。之后,引入defaultdict,介绍了更加灵活、强大的处理方法。根据实际使用场景,可以自行选择!
- 上一篇:如何检查Python列表是否为空?
- 下一篇:python之容器详解——字典
相关推荐
- 10种常见的MySQL错误,你可中招?
-
【51CTO.com快译】如果未能对MySQL8进行恰当的配置,您非但可能遇到无法顺利访问、或调用MySQL的窘境,而且还可能给真实的应用生产环境带来巨大的影响。本文列举了十种MySQL...
- MySQL主从如何保证数据一致性
-
MySQL主从(主备)搭建请点击基于Spring的数据库读写分离。MySQL主备基本原理假设主备切换前,我们的主库是节点A,节点B是节点A的备库,客户端的读写都是直接访问节点A,节点B只是将A的更新同...
- MySQL低版本升级操作流程
-
(关注“数据库架构师”公众号,提升数据库技能,助力职业发展)0-升级背景MySQL5.5发布于2010年,至今已有十年历史,官方已经停止更新。2008年发布的MySQL5.1版本,在2018年...
- MySQL数据库知识
-
MySQL是一种关系型数据库管理系统;那废话不多说,直接上自己以前学习整理文档:查看数据库命令:(1).查看存储过程状态:showprocedurestatus;(2).显示系统变量:show...
- Mysql 8.4数据库安装、新建用户和数据库、表单
-
1、下载MySQL数据库yuminstall-ywgetperlnet-toolslibtirpc#安装wget和perl、net-tools、libtirpcwgethtt...
- mysql8.0新功能介绍
-
MySQL8.0新特性集锦一、默认字符集由latin1变为utf8mb4在8.0版本之前,默认字符集为latin1,utf8指向的是utf8mb3,8.0版本默认字符集为utf8mb4,utf8默...
- 全网最详细解决Windows下Mysql数据库安装后忘记初始root 密码方法
-
一、准备重置root的初始化密码Win+R键启动命令输入窗口;输入cmd打开命令执行窗口;##界面如下##输入命令:netstopmysqld#此操作会停止当前运行的...
- 互联网大厂面试:MySQL使用grant授权后必须flush privilege吗
-
从我上大学时,数据库概论老师就告诉我,MySQL使用grant对用户授权之后,一定记得要用flushprivilege命令刷新缓存,这样才能使赋权命令生效。毕业工作以后,在很多的技术文档上,仍然可以...
- # mysql 8.0 版本无法使用 sqlyog 等图形界面 登录 的解决方法
-
30万以下的理想L6来了##mysql8.0版本无法使用sqlyog等图形界面登录的解决方法当我们在cmd下登录mysql时正常时,用sqlyog等图形界面连接数据库时却...
- MySQL触发器介绍
-
前言:在学习MySQL的过程中,可能你了解过触发器的概念,不清楚各位是否有详细的去学习过触发器,最近看了几篇关于触发器的文档,分享下MySQL触发器相关知识。1.触发器简介触发器即trigg...
- 管理员常用的MySQL命令汇总(一)
-
以下是管理员常用的MySQL命令:以管理员身份连接到MySQL:mysql-uroot-p创建新的MySQL用户:CREATEUSER'username'@'...
- Linux(CentOS) 在线安装MySQL8.0和其他版本,修改root密码
-
一:安装MySQL数据库1),下载并安装MySQL官方的YumRepositorymysql官方仓库地址:https://dev.mysql.com/downloads/repo/yum/选择自...
- 解决 MySQL 8.0 一直拒绝 root 登录问题
-
Accessdeniedforuser'root'@'localhost'(usingpassword:YES)这个错误在网上搜一下,能看到非常多的此类...
- 大模型MCP之MYSQL安装
-
前言学习大模型的时候需要一个mysql,原因还是在公司使用电脑的时候不允许按照Docker-Desktop,我的宿主机其实是MAC,我习惯上还是在centsos上面安装,就发现这件过去很简单的事情居然...
- MySQL ERROR 1396
-
ERROR1396(HY000):OperationCREATEUSERfailedfor'usera'@'%'问题描述mysql>create...
- 一周热门
-
-
Python实现人事自动打卡,再也不会被批评
-
【验证码逆向专栏】vaptcha 手势验证码逆向分析
-
Psutil + Flask + Pyecharts + Bootstrap 开发动态可视化系统监控
-
一个解决支持HTML/CSS/JS网页转PDF(高质量)的终极解决方案
-
再见Swagger UI 国人开源了一款超好用的 API 文档生成框架,真香
-
网页转成pdf文件的经验分享 网页转成pdf文件的经验分享怎么弄
-
C++ std::vector 简介
-
系统C盘清理:微信PC端文件清理,扩大C盘可用空间步骤
-
飞牛OS入门安装遇到问题,如何解决?
-
10款高性能NAS丨双十一必看,轻松搞定虚拟机、Docker、软路由
-
- 最近发表
- 标签列表
-
- python判断字典是否为空 (50)
- crontab每周一执行 (48)
- aes和des区别 (43)
- bash脚本和shell脚本的区别 (35)
- canvas库 (33)
- dataframe筛选满足条件的行 (35)
- gitlab日志 (33)
- lua xpcall (36)
- blob转json (33)
- python判断是否在列表中 (34)
- python html转pdf (36)
- 安装指定版本npm (37)
- idea搜索jar包内容 (33)
- css鼠标悬停出现隐藏的文字 (34)
- linux nacos启动命令 (33)
- gitlab 日志 (36)
- adb pull (37)
- python判断元素在不在列表里 (34)
- python 字典删除元素 (34)
- vscode切换git分支 (35)
- python bytes转16进制 (35)
- grep前后几行 (34)
- hashmap转list (35)
- c++ 字符串查找 (35)
- mysql刷新权限 (34)