【案例】python集成OCR识别工具调研

一、前言

因项目需要OCR识别能力,且要支持私有化部署。本文将对比市场一些开源的OCR识别工具,从中选择适合项目需要的OCR,且后续进一步研究/训练对应OCR模型。
主要OCR识别有:Tesseract_OCR、PaddleOCR、EasyOCR、dddd_ocr、CnOCR
备注说明:后面的图片测试使用如下
请添加图片描述

二、Tesseract_OCR

Pillow是一个免费开源的图像处理库,它可以用来读取、操作和保存各种各样的图片文件。Tesseract-OCR则是一个强大的光学字符识别引擎,可以离线识别,可以准确地识别图像中的文字,要配合本地安装tesseract-ocr.exe文件一起使用。
Tesseract-OCR特点:

  • Tesseract支持UTF-8编码格式,并且可以“开箱即用”地识别100多种语言
  • Tesseract支持多种输出格式:纯文本,hOCR(HTML),PDF等
  • 官方建议,为了获得更好的OCR结果,最好提供给高质量的图像
  • Tesseract进行识别其他语言的训练,具体的训练方式请参考官方提供的文档:https://tesseract-ocr.github.io/tessdoc/

2.1、安装过程

安装环境

相关推荐

  1. python调用微信自带OCR实现内容识别(全)

    2024-07-11 01:44:04       24 阅读
  2. python图片字符识别Tessreact库OCR

    2024-07-11 01:44:04       40 阅读
  3. Ocr识别

    2024-07-11 01:44:04       28 阅读

最近更新

  1. docker php8.1+nginx base 镜像 dockerfile 配置

    2024-07-11 01:44:04       53 阅读
  2. Could not load dynamic library ‘cudart64_100.dll‘

    2024-07-11 01:44:04       55 阅读
  3. 在Django里面运行非项目文件

    2024-07-11 01:44:04       46 阅读
  4. Python语言-面向对象

    2024-07-11 01:44:04       56 阅读

热门阅读

  1. Spring源码(二) refresh () 方法

    2024-07-11 01:44:04       20 阅读
  2. GraalVM简介及使用

    2024-07-11 01:44:04       19 阅读
  3. 徐州服务器租用:论带宽的作用有哪些

    2024-07-11 01:44:04       20 阅读
  4. 1. Go 九九乘法表

    2024-07-11 01:44:04       24 阅读
  5. Perl词法作用域:自定义编程环境的构建术

    2024-07-11 01:44:04       22 阅读
  6. SQL Server 设置端口详解

    2024-07-11 01:44:04       20 阅读
  7. MyBatis 框架核心及面试知识要点

    2024-07-11 01:44:04       23 阅读