python图像识别库-pytesseract

内容目录

      • 一、安装
        • 1.安装tesseract OCR
          • 1) MAC中安装
          • 2) Windows中安装
          • 3) 中文报下载
      • 二、pytesseract的简单使用

pytesseract是python的一个用于图像提取的库, 它实际上是对Tesseract OCR引擎的封装。pytesseract使得在Python项目中调用Tesseract变得更加简便,主要用于从图像中提取和识别文本信息。

一、安装

1.安装tesseract OCR

需要先安装tesseract OCR
什么是OCR:

Tesseract OCR(Optical Character Recognition,光学字符识别)是一个开源的OCR引擎,最初由HP实验室开发,后由Google维护并持续优化。Tesseract设计用于识别打印文本和手写文本,支持多种语言,包括一些稀有和古语种。

Tesseract的工作原理是通过复杂的图像处理和机器学习算法来识别图像中的字符。其流程大致包括以下几个步骤:

  • 图像预处理:包括灰度化、二值化、降噪、倾斜校正等,以提高识别精度。
  • 文字检测:在图像中定位文本区域,区分文本和非文本区域。
  • 特征提取:从文本区域提取有助于识别字符的关键特征。
  • 字符识别:利用机器学习模型,如神经网络,将提取的特征与已知字符模板匹配,识别出字符。
  • 版面分析:理解文本的布局,如行、列、段落等,对于复杂文档的识别尤为重要。
  • 语言模型:结合语言上下文,提高识别准确率,特别是在识别模糊或有破损文字时。

Tesseract支持通过训练数据定制和优化特定的语言和字体,用户可以根据自己的需求训练特定领域的模型以提高识别精度。它提供命令行工具供用户直接使用,也开放API接口,允许集成到各种应用程序中,如Web服务、移动应用和桌面软件等。

1) MAC中安装
brew install tesseract

查看tesseract是否安装成功

tesseract --version

我电脑上安装后的目录在: /opt/homebrew/bin/tesseract

2) Windows中安装

官方提供了安装包, 可以在官网下载: tesseract OCR下载地址
在这里插入图片描述

tips: 需要注意, 因为mac用的brew安装的, 不用配置环境变量, 而windows下安装完需要配置环境变量

3) 中文报下载

下载中文包, 不然会识别不了中文
中文包下载地址

在这里插入图片描述

把文件下载后放到目录: /opt/homebrew/share/tessdata (我的目录在这, 按照真实语言库文件路径修改, 可以通过命令tesseract --list-langs查看)
查看所有语言库:

tesseract --list-langs

简单测试:

def extract_text_from_image(image_path):# 打开图片文件img = Image.open(image_path)# 使用pytesseract进行OCR识别,默认情况下它会调用Tesseract命令行工具text = pytesseract.image_to_string(img, lang='chi_sim')return textif __name__ == "__main__":# 图片路径,请替换为你的图片路径image_path = './images/word_image1.png'text = extract_text_from_image(image_path)print(f"提取的文本内容:\n{text}")

图片:在这里插入图片描述

提取的文本内容:
江 使 用 pytesseract 进 行 0CR 识 别 , 默 认 情 况 下 它 会 调 用 Tesseract 命 令 行 工 具
text = pyteSsseract .image_to_stringCimg,1Lang=“chi_sim「 )

结果还是会有一些错误
配合图像识别的库可以包括两个: pytesseract和PIL, 可以简单的理解为, 前者负责从图像中提取文字信息,后者则提供图像处理功能,确保进入OCR引擎的图像最适合文字识别。

二、pytesseract的简单使用

识别文字: 从图片中提取出文字

# 打开图片文件
img = Image.open('your_image_path.jpg')# 使用pytesseract进行OCR识别,默认是英文,可以加lang参数指定语言
text = pytesseract.image_to_string(img)print(text)

预处理图像:为了提高识别率,可以先对图片进行预处理,如调整大小、灰度化、二值化等。

img = img.convert('L')  # 转为灰度图像
img = img.point(lambda x: 0 if x < 128 else 255, '1')  # 二值化

指定语言:如果图片中的文字不是英文,可以通过lang参数指定语言, 就是下载的语言包。

text = pytesseract.image_to_string(img, lang='chi_sim')  # 识别简体中文

区域识别:如果只需要识别图片中的一部分,可以先裁剪图片。

cropped_img = img.crop((left, top, right, bottom))
text = pytesseract.image_to_string(cropped_img)

除此之外还有很多高阶用法, 可以参考官网或者仓库
pytesseract github地址

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.mzph.cn/pingmian/22930.shtml

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

17K star,一款开源免费的手机电脑无缝同屏软件

导读&#xff1a;白茶清欢无别事&#xff0c;我在等风也等你。 作为程序员&#xff0c;在我们的工作中经常需要把手机投票到电脑进行调试工作&#xff0c;选择一款功能强大的投屏软件是一件很必要的事情。今天给大家介绍一款开源且免费的投屏软件&#xff0c;极限投屏&#xff…

Arthas调优工具使用

1&#xff0c;服务器端下载 curl -O https://arthas.aliyun.com/arthas-boot.jar 2&#xff0c;服务器端启动 java -jar arthas-boot.jar 选定要绑定的Java进程ID 3&#xff0c;本地idea安装Arthas idea 4&#xff0c;选定方法右键trace,生成命令 trace com.xxx.xxx.xxx.vouche…

C语言数据结构快速排序的非递归、归并排序、归并排序的非递归等的介绍

文章目录 前言一、快速排序非递归二、归并排序五、归并排序非递归总结 前言 C语言数据结构快速排序的非递归、归并排序、归并排序的非递归等的介绍 一、快速排序非递归 快速排序非递归的定义 快速排序非递归&#xff0c;需要使用栈来实现。将左右下标分别push到栈中。在栈为…

基于Tricore的Tasking链接文件解读

目录 1.链接文件有什么用&#xff1f; 2.文件结构和语法解析 2.1 文件结构 2.2 语法解析 3.小结 玩惯了ld文件&#xff0c;突然让搞lsl&#xff0c;被其中花里胡哨的语法搞晕了&#xff0c;例如&#xff1a; memory cpu0_dlmu{mau 8;size 64k;type ram;map cached …

腾讯中视频计划项目玩法,号称执行就有收入

腾讯中视频掘金计划是一个创新的短视频创作与分享平台&#xff0c;类似于西瓜视频&#xff0c;允许用户发布原创视频内容&#xff0c;并将其同步至腾讯旗下的多个平台&#xff0c;用户基数大&#xff0c;相信视频播放量也会比较大。 操作流程&#xff1a; 1. 注册并登录腾讯中…

深入对比:Transformer与RNN的详细解析

在深度学习领域&#xff0c;特别是在自然语言处理&#xff08;NLP&#xff09;中&#xff0c;循环神经网络&#xff08;RNN&#xff09;和Transformer模型都扮演着举足轻重的角色。然而&#xff0c;随着技术的不断发展&#xff0c;Transformer模型逐渐崭露头角&#xff0c;成为…

OrangePi 安装 CANN 套件及体验 AI 应用

CANN 环境安装&#xff08;桌面端跳过&#xff09; CANN 环境存在于下载页面的官方工具中&#xff0c;点击下载即可进入下载页面。 CANN 安装包就在倒数第二项&#xff0c;下载后传到开发板上。 给 CANN 安装包赋予运行权限并运行即可。 chmod x Ascend-cann-toolkit_7.0.0_l…

MQTT协议使用总结

MQTT是基于TCP/IP协议栈构建的异步通信消息协议&#xff0c;是一种轻量级的发布/订阅信息传输协议MQTT在时间和空间上&#xff0c;将消息发送者与接受者分离&#xff0c;可以在不可靠的网络环境中进行扩展。适用于设备硬件存储空间有限或网络带宽有限的场景。 物联网平台支持设…

2.1.4 采用配置类与注解方式使用MyBatis

实战概述&#xff1a;采用配置类与注解方式使用MyBatis 创建MyBatis配置类 在net.huawei.mybatis.config包中创建MyBatisConfig类&#xff0c;用于配置MyBatis核心组件&#xff0c;包括数据源、事务工厂和环境设置。 配置数据源和事务 使用PooledDataSource配置MySQL数据库连接…

kafka-消费者服务搭建配置简单消费(SpringBoot整合Kafka)

文章目录 1、使用efak 创建 主题 my_topic1 并建立6个分区并给每个分区建立3个副本2、创建生产者发送消息3、application.yml配置4、创建消费者监听器5、创建SpringBoot启动类6、屏蔽 kafka debug 日志 logback.xml7、引入spring-kafka依赖 1、使用efak 创建 主题 my_topic1 并…

DP动态规划(上)

文章目录 动态规划基本概念斐波那契数列问题C 实现Python 实现Java 实现 迷你结C、Python和Java在实现动态规划时有哪些性能差异&#xff1f;迷你结哪种语言在动态规划中更适合大规模数据处理?迷你结C有哪些知名的库适用于动态规划和大数据处理?动态规划辅助库大数据处理库 迷…

【网络协议 | HTTP】HTTP总结与全梳理(一) —— HTTP协议超详细教程

&#x1f525;博客简介&#xff1a;开了几个专栏&#xff0c;针对 Linux 和 rtos 系统&#xff0c;嵌入式开发和音视频开发&#xff0c;结合多年工作经验&#xff0c;跟大家分享交流嵌入式软硬件技术、音视频技术的干货。   ✍️系列专栏&#xff1a;C/C、Linux、rtos、嵌入式…

二叉树练习题(2024/6/5)

1翻转二叉树 给你一棵二叉树的根节点 root &#xff0c;翻转这棵二叉树&#xff0c;并返回其根节点。 示例 1&#xff1a; 输入&#xff1a;root [4,2,7,1,3,6,9] 输出&#xff1a;[4,7,2,9,6,3,1]示例 2&#xff1a; 输入&#xff1a;root [2,1,3] 输出&#xff1a;[2,3,1]…

dirfuzz-web敏感目录文件扫描工具

dirfuzz介绍 dirfuzz是一款基于Python3的敏感目录文件扫描工具&#xff0c;借鉴了dirsearch的思路&#xff0c;扬长避短。在根据自身实战经验的基础上而编写的一款工具&#xff0c;经过断断续续几个月的测试、修改和完善。 项目地址&#xff1a;https://github.com/ssrc-c/di…

运维开发介绍

目录 1.什么是运维开发 2.作用 3.优点 4.缺点 5.应用场景 5.1.十个应用场景 5.2.网站和Web应用程序 6.案例 7.小结 1.什么是运维开发 运维开发&#xff08;DevOps&#xff09;是一种结合软件开发&#xff08;Development&#xff09;与信息技术运维&#xff08;Opera…

什么是回调函数?callback()

首先要知道一个点就是 在js中&#xff0c;函数是可以作为函数的参数传递的 所以其实回调函数 就是这个传进去的参数 其实回调函数的本质样子和普通函数是一样的 <!DOCTYPE html> <html lang"en"> <head><meta charset"UTF-8">…

embedding层的理解

一文读懂Embedding的概念&#xff0c;以及它和深度学习的关系 - 知乎 (zhihu.com) 感觉这篇知乎真的大道至简。个人感觉embedding层和普通的线性层没有什么区别~就是为了降维和升维用的。也就是向量的维度变化&#xff01;

基于SOA海鸥优化算法的三维曲面最高点搜索matlab仿真

目录 1.程序功能描述 2.测试软件版本以及运行结果展示 3.核心程序 4.本算法原理 5.完整程序 1.程序功能描述 基于SOA海鸥优化算法的三维曲面最高点搜索matlab仿真&#xff0c;输出收敛曲线以及三维曲面最高点搜索结果。 2.测试软件版本以及运行结果展示 MATLAB2022A版本…

Wireshark抓包工具使用 项目实战

Wireshark 是一个开源的网络协议分析器&#xff0c;它可以让你捕获和分析网络数据包&#xff0c;帮助你诊断网络问题、监控网络流量、分析协议和进行安全审计。以下是一些基本的 Wireshark 用法&#xff1a; 捕获数据包&#xff1a; 打开 Wireshark&#xff0c;选择要捕获数据包…

国外创意二维码营销案例:巴西宠物食品品牌户外活动“救救宠物爪子吧”

2024年5月份&#xff0c;巴西宠物食品品牌Purina Brasil 与广告公司Publicis Brasil合作&#xff0c;推出了一次特别的户外营销活动——Salve as Patinhas(Save the Paws)&#xff08;救救宠物爪子吧&#xff09;&#xff0c;非常有意思&#xff01; 随着全球气候变暖&#xf…