图片转文字--四种OCR工具的安装和使用
liuian 2025-05-10 23:18 2 浏览
本文仅测试简单的安装和使用,
下一步应该是测试不同数据集下的检测准确率和检测效率,敬请期待。
作者的系统环境是:
笔记本:ThindPad P520
OS:win11
显卡:Quadro P520
一、EasyOCR
源码地址:
https://github.com/JaidedAI/EasyOCR
1、安装anaconda
为什么要安装anaconda?
因为我日常开发用python3.11的版本,使用YOLOv8需要python3.8的环境,这次使用EasyOCR需要python3.10的环境,需要切换python环境。
anaconda的安装和配置,请参考《YOLOv8入门篇--YOLOv8的安装和使用》。
2、创建虚拟环境(指定python3.10)
查看已有的conda虚拟环境
切换到创建好的虚拟环境
conda create -n testOCR python=3.10
conda env list
conda activate testOCR
或者在pycharm开发环境下,选择conda+python3.10创建虚拟环境,并命名为testOCR,效果一样。
3、安装EasyOCR
pip install easyocr
4、写代码测试
import easyocr
reader = easyocr.Reader(['ch_sim','en']) # this needs to run only once to load the model into memory
result = reader.readtext('img.png')
print(result)
二、CnOCR
源码地址:
https://github.com/breezedeus/CnOCR
1、安装anaconda
同上,略过。
2、创建虚拟环境(指定python3.10)
查看已有的conda虚拟环境
切换到创建好的虚拟环境
conda create -n testCNOCR python=3.10
conda env list
conda activate testCNOCR
或者在pycharm开发环境下,选择conda+python3.10创建虚拟环境,并命名为testCNOCR,效果一样。
3、安装CnOCR
pip install cnocr
碰到如下错误:
Failed to build Polygon3
ERROR: Could not build wheels for Polygon3, which is required to install pyproject.toml-based projects
3.1、试试源码安装
git clone https://github.com/breezedeus/CnOCR
cd CnOCR
pip install -r requirement.txt
出现同样的错误,参考这篇文章:
https://wenku.csdn.net/answer/1pak5c8m9v
和
https://github.com/PaddlePaddle/PaddleOCR/issues/9668
需要安装一下:
https://visualstudio.microsoft.com/zh-hans/visual-cpp-build-tools/
这次通过了,
Successfully built polygon3
4、写代码测试
from cnocr import CnOcr
img_fp = './images/img.png'
ocr = CnOcr() # 所有参数都使用默认值
out = ocr.ocr(img_fp)
print(out)
三、Tesseract
Tesseract官方仓库:
https://github.com/tesseract-ocr/tesseract
Tesseract是用C++进行开发的,因此如果要在python中进行使用,需要借助第三方依赖pytesseract
首先需要在本机上安装Tesseract
安装包下载地址:
https://digi.bib.uni-mannheim.de/tesseract/
安装过程可参考:
https://blog.csdn.net/weixin_51571728/article/details/120384909
安装过程记得在“Additional languange data(download)”中,选上中文相关的4种语言,如下面两图:
配置完成后,在命令行输入tesseract -v打印出版本信息则表示安装成功。
1、安装anaconda
同上,略过。
2、创建虚拟环境(指定python3.10)
查看已有的conda虚拟环境
切换到创建好的虚拟环境
conda create -n testTEOCR python=3.10
conda env list
conda activate testTEOCR
或者在pycharm开发环境下,选择conda+python3.10创建虚拟环境,并命名为testTEOCR,效果一样。
3、安装pytesseract
pip install pytesseract
4、写代码测试
import pytesseract
from PIL import Image
def demo():
# 重要!!!
pytesseract.pytesseract.tesseract_cmd = r'C:\Program Files\Tesseract-OCR\tesseract.exe'
# 打开要识别的图片
image = Image.open('./images/img.png')
# 使用pytesseract调用image_to_string方法进行识别,传入要识别的图片,lang='chi_sim'是设置为中文识别,
text = pytesseract.image_to_string(image, lang='chi_sim')
# 输入所识别的文字
print(text)
if __name__ == '__main__':
demo()
四、PaddleOCR
PaddleOCR是百度旗下的产品,目前已经迭代到第四版。
PaddleOCR官方仓库:
https://github.com/PaddlePaddle/PaddleOCR
1、安装anaconda
同上,略过。
2、创建虚拟环境(指定python3.10)
查看已有的conda虚拟环境
切换到创建好的虚拟环境
conda create -n testPAOCR python=3.10
conda env list
conda activate testPAOCR
或者在pycharm开发环境下,选择conda+python3.10创建虚拟环境,并命名为testPAOCR,效果一样。
3、安装PaddleOCR
pip install PaddleOCR
4、写代码测试
import cv2
from paddleocr import PaddleOCR
if __name__ == '__main__':
ocr = PaddleOCR(use_angle_cls=True, lang="ch", ocr_version='PP-OCRv4')
image_input_fullname = 'images/img.png'
img = cv2.imread(image_input_fullname)
result = ocr.ocr(img, cls=True)
print(result)
运行代码,提示缺少paddle
安装paddle,又提示缺少xx。
罗列如下:
pip install paddle
pip install common
pip install dual
pip install tight
pip install data
pip install prox
再次运行,碰到如下错误:
ModuleNotFoundError: No module named 'paddle.distributed'
pip install paddlepaddle
再次运行,下载模型,输出检测结果。
相关推荐
- x-cmd install | jellex - 用 Python 语法在终端里玩转 JSON 数据!
-
还在为命令行下处理JSON数据烦恼吗?jellex来了!它是一款基于终端的交互式JSON和JSONLines数据处理工具,让你用熟悉的Python语法,轻松过滤、转换和探索JSO...
- 一篇长文带你在Python里玩转Json数据
-
Json简介Json(JavaScriptObjectNotation)很多网站都会用到Json格式来进行数据的传输和交换,就像上篇我提到的网易云音乐接口,它们返回的数据都是Json格式的。这因为...
- Python JSON 魔法手册:数据转换的终极艺术
-
对话实录小白:(崩溃)我从API拿到了JSON数据,怎么变成Python对象?专家:(掏出魔法书)用json模块,轻松实现数据转换!JSON基础三连击1.字符串Python对...
- Python JSON 详解教程(python json())
-
JSON(JavaScriptObjectNotation)是一种轻量级的数据交换格式(lightweightdatainterchangeformat)常用于Web应用、配置文件(co...
- Python 数据的 JSON 格式序列化及反序列化
-
在Python中,将数据转换为JSON格式非常简单,可以使用内置的json模块。json模块提供了json.dumps()和json.dump()方法,用于将Python对象...
- 如何使Python类可JSON序列化(python json 类)
-
技术背景在Python开发中,JSON(JavaScriptObjectNotation)是一种常用的数据交换格式。然而,Python的json模块默认只能序列化一些基本数据类型,如字典、列表、字...
- 详细介绍一下Python如何对JSON格式数据进行处理?
-
在Python中对于JSON数据的处理是在日常开发中的常见需求之一。通常情况下,对JSON数据的处理主要涉及到如下的的几个步骤对于JSON数据的解析操作对于JSON数据的处理操作对于JSON数据的格式...
- Python 字典l转换成 JSON(python转化字典)
-
本文需要5分钟。如果对您有用可以点赞评论关注.Python字典到JSONJSON(JavaScriptObjectNotation)是一种轻量级的数据交换格式,它基于ECMAScrip...
- 打造熟悉的VS界面风格(vs界面设计美化)
-
用惯了老机子的VS界面,换新机子时,各种不适应。现在重新打造老款样式:1)下载VisualStudio2013ColorThemeEditorhttps://marketplace.vis...
- 办公小技巧:全部亮相 让Excel单元格完全显示文本
-
平时我们在使用Excel制作表格的时候,经常会遇到由于文本内容较多,导致这些内容无法在一个单元格中完全显示。常规的方法是将单元格设置为“自动换行”,但是这样会影响整个文件的美观。下例是某小区的入住登记...
- WinForms 中的 CheckBox 控件使用指南
-
在WinForms中,CheckBox控件是一个允许用户选择或取消选择的单选按钮。它通常用于表示布尔值(真/假)或允许多选的情况。以下是如何使用CheckBox控件的一些基本信息和示例代码。创建...
- 图片转文字--四种OCR工具的安装和使用
-
本文仅测试简单的安装和使用,下一步应该是测试不同数据集下的检测准确率和检测效率,敬请期待。作者的系统环境是:笔记本:ThindPadP520OS:win11显卡:QuadroP520一、EasyO...
- C# 给Word每一页设置不同图片水印
-
Word中设置水印时,可加载图片设置为水印效果,但通常添加水印效果时,会对所有页面都设置成统一效果,如果需要对每一页或者某个页面设置不同的水印效果,则可以参考本文中的方法。下面,将以C#代码为例,对W...
- 集成的面向对象控件Xtreme Controls正式发布v17.0.0
-
CodejockXtremeControls为Windows图形用户软件工程师提供众多的有关MFC的控件产品,该产品是通过完全测试并专门为图形用户设计的一款专业控件。它是一款集成了面向对象的控件被...
- Win10 Build 10061老问题修复新问题来
-
|责编:刘菲菲【中关村在线软件资讯】4月23日消息:微软今天正式推送了Windows10Build10061预览版这个版本除了正常的功能更新和调整外,还修复了多个bug。其中一部分对于开发者开...
- 一周热门
-
-
Python实现人事自动打卡,再也不会被批评
-
Psutil + Flask + Pyecharts + Bootstrap 开发动态可视化系统监控
-
一个解决支持HTML/CSS/JS网页转PDF(高质量)的终极解决方案
-
再见Swagger UI 国人开源了一款超好用的 API 文档生成框架,真香
-
【验证码逆向专栏】vaptcha 手势验证码逆向分析
-
网页转成pdf文件的经验分享 网页转成pdf文件的经验分享怎么弄
-
C++ std::vector 简介
-
python使用fitz模块提取pdf中的图片
-
《人人译客》如何规划你的移动电商网站(2)
-
Jupyterhub安装教程 jupyter怎么安装包
-
- 最近发表
-
- x-cmd install | jellex - 用 Python 语法在终端里玩转 JSON 数据!
- 一篇长文带你在Python里玩转Json数据
- Python JSON 魔法手册:数据转换的终极艺术
- Python JSON 详解教程(python json())
- Python 数据的 JSON 格式序列化及反序列化
- 如何使Python类可JSON序列化(python json 类)
- 详细介绍一下Python如何对JSON格式数据进行处理?
- Python 字典l转换成 JSON(python转化字典)
- 打造熟悉的VS界面风格(vs界面设计美化)
- 办公小技巧:全部亮相 让Excel单元格完全显示文本
- 标签列表
-
- python判断字典是否为空 (50)
- crontab每周一执行 (48)
- aes和des区别 (43)
- bash脚本和shell脚本的区别 (35)
- canvas库 (33)
- dataframe筛选满足条件的行 (35)
- gitlab日志 (33)
- lua xpcall (36)
- blob转json (33)
- python判断是否在列表中 (34)
- python html转pdf (36)
- 安装指定版本npm (37)
- idea搜索jar包内容 (33)
- css鼠标悬停出现隐藏的文字 (34)
- linux nacos启动命令 (33)
- gitlab 日志 (36)
- adb pull (37)
- table.render (33)
- uniapp textarea (33)
- python判断元素在不在列表里 (34)
- python 字典删除元素 (34)
- react-admin (33)
- vscode切换git分支 (35)
- vscode美化代码 (33)
- python bytes转16进制 (35)