java使用Tess4J实现OCR图片文字识别

news/2024/11/29 0:43:36/

目录

  • 介绍
  • 一、maven如下
  • 二、下载语言模型
    • 1.下载语言模型
    • 2.百度云下载
  • 三、测试
    • 1.测试代码
    • 2.测试图片
    • 3.效果

介绍

Tess4J 是 Tesseract OCR 的 java api 实现库,你可以通过 java 调用来轻松的实现图片识别并提取文字,也就是 OCR 图片提取文字技术。

Tess4J 支持识别的的图片格式:

  • TIFF、JPEG、GIF、PNG 和 BMP 图像格式
  • 多页 TIFF 图像
  • PDF文档格式

Tesseract OCR的github官网

Tesseract OCR 使用手册

Tess4J 官网

一、maven如下

        <dependency><groupId>net.sourceforge.tess4j</groupId><artifactId>tess4j</artifactId><version>5.7.0</version></dependency><!-- 解决输出的时候 slf4j 报错 -->   <dependency><groupId>org.slf4j</groupId><artifactId>slf4j-api</artifactId><version>1.8.0-beta4</version></dependency><dependency><groupId>org.slf4j</groupId><artifactId>slf4j-simple</artifactId><version>1.8.0-beta4</version></dependency>

二、下载语言模型

如果因为网络问题,你访问不了 github 或语言模型下载缓慢失败,可以直接看第2步百度云下载。

1.下载语言模型

tesseract 支持一百多种语言识别,你可以从 Traineddata 语言模型说明下载页面 选择自己想要识别的.traineddata 格式的语言模型文件下载。

(1)特殊的模型

  • 如果你想识别图片里的各种方向的文字可以下载 osd.traineddata 模型

  • 如果你想识别图片里的各种数学公式、方程可以下载 equ.traineddata 模型

(2)语言模型

tesseract 在 GitHub 上的有三个独立的语言模型存储库 tessdata、tessdata-best、tessdata-fast 他们分别都存储了语言模型,他们的区别是:

如何训练得到的速度识别准确性是否支持旧版是否支持再训练
tessdata传统+LSTM(并整合tessdata-best)比 tessdata-best 更快比 tessdata-best 准确度稍低支持不支持
tessdata-best仅 LSTM(基于langdata)最慢最准确不支持支持
tessdata-fast比 tessdata-best 更小的 LSTM网络整合最快的最不准确不支持不支持

我测试识别一张多文字图片的时候,tessdata-best 效果最好但花了快10秒,tessdata 花了3秒但效果稍微差一点。你可以根据自己的需要去选择下载语言模型文件,我这里选择的是 tessdata-best 库里下载 chi_sim.traineddata (简体中文)、eng.traineddata (英文模型)。

因为网络问题,如果你访问不了 github 或下载缓慢,可以从我的百度云下载 tessdata 和 tessdata-best,里面包含了所有的语言模型文件,(如果你只需要中英文的模型可以看我第 2 步):

百度云下载: tessdata-4.1.0.zip 约 635 MB (链接:https://pan.baidu.com/s/1e2UKTpMqnfhpCoq6NquIAQ
提取码:jc9p)

百度云下载: tessdata_best-4.1.0.zip 约1.29 GB (链接:https://pan.baidu.com/s/1dcHpukvaH6Rtma_drfqD9g
提取码:w3gh)

(3)项目的 resources 文件夹下新建 tessdata 文件夹,然后把上面下载的 .traineddata 格式的语言模型文件复制到 tessdata 下。

2.百度云下载

如果因为网络问题,你访问不了 github 或下载缓慢失败,可以从百度云下载我的 tessdata.zip ,里面包含了中英文语言模型 ,解压后把 tessdata 文件夹复制到你的 resources 文件夹下即可:

百度云下载: tessdata.zip 约27MB (链接:https://pan.baidu.com/s/1nXHJ_e4kzOGHbFwh95ijEg
提取码:k1qu)

三、测试

1.测试代码


import net.sourceforge.tess4j.Tesseract;
import net.sourceforge.tess4j.TesseractException;
import java.io.File;
import java.awt.*;public class MainServer {public static void main(String[] args) throws TesseractException {long start = System.currentTimeMillis();System.out.println("开始OCR文字识图,请稍后...");//加载要识别的图片File image = new File("F:\\image\\test1.jpg");//设置配置文件夹微视、识别语言、识别模式Tesseract tesseract = new Tesseract();tesseract.setDatapath("src/main/resources/tessdata");//设置识别语言为中文简体,(如果要设置为英文可改为"eng")tesseract.setLanguage("chi_sim");//使用 OSD 进行自动页面分割以进行图像处理tesseract.setPageSegMode(1);//设置引擎模式是神经网络LSTM引擎tesseract.setOcrEngineMode(1);//开始识别整张图片中的文字String result = tesseract.doOCR(image);long time = System.currentTimeMillis()-start;System.out.println("识别结束,耗时:"+time+" 毫秒,识别结果如下:");System.out.println();System.out.println(result);}
}

上面示例中是识别整张图片中的文字,如果你只想识别图片中特定部分的文字,可以像下面这样选定长宽范围识别:

String result = tesseract.doOCR(image, new Rectangle(300, 200));

2.测试图片

请添加图片描述

3.效果

请添加图片描述


参考:

Optical Character Recognition with Tesseract


http://www.ppmy.cn/news/703722.html

相关文章

iOS之iOS11、iPhone X、Xcode9 适配指南

更新iOS11后&#xff0c;发现有些地方需要做适配&#xff0c;整理后按照优先级分为以下三类&#xff1a; 1.单纯升级iOS11后造成的变化&#xff1b; 2.Xcode9 打包后造成的变化&#xff1b; 3.iPhoneX的适配 一、单纯升级iOS11后造成的变化 1. 升级后&#xff0c;发现某个拥有t…

登陆apple pay显示无法登录服务器,apple pay无法添加卡怎么办?未能连接到apple pay的解决方法...

apple pay无法添加卡怎么办?出现未能连接到apple pay的解决方法!随着2月8日苹果关法的apple pay 移动支付登陆中国大陆&#xff0c;相信很多苹果手机用户都第一时间绑定了银行卡&#xff0c;但部分用户在绑定银行卡时却出现了“未能连接到 Apple Pay”和“无法添加卡”的错误提…

iphone x php兼容吗,iPhone X/8/8P 都支持什么网络?别买错了

哎妹最近在听毛不易的《像我这样的人》&#xff0c;很好听&#xff0c;顺便也给你们安利一下吧~ 好了&#xff0c;咱们边听歌边唠吧。眼看着 iPhone X 就要上市了&#xff0c;相信很多小伙伴在很久之前就已经勒好裤腰带&#xff0c;准备大干一场了&#xff01;不过哎妹准备静静…

Unreal Engine游戏引擎

Unreal Engine&#xff08;下文简称为UE&#xff09;&#xff0c;是一款由Epic Games开发的游戏引擎&#xff0c;用于创建电子游戏、虚拟现实和增强现实应用、数字孪生等内容。UE支持实时渲染、高品质的图形效果和物理模拟、可扩展的蓝图视觉脚本语言&#xff0c;以及跨平台和多…

漏洞扫描工具

主机漏洞扫描工具Goby 官网地址 https://gobies.org/#dl 1.下载之后更改语言为中文&#xff1a; 2.如果启动程序出现这个错误无视并叉掉即可&#xff1a; 3.点击圆圈扫描或者右上角加号添加扫描任务 内网综合扫描工具fscan 一款内网综合扫描工具&#xff0c;方便一键自动…

使用docker安装mysql主从集群

1.安装MySQL主容器 1.1首先&#xff0c;使用以下命令创建MySQL主容器&#xff1a; sudo docker run --name mysql-master -p 3306:3306 -e MYSQL_ROOT_PASSWORD123456 -d mysql:latest 在这里&#xff0c;使用了Docker官方提供的MySQL镜像&#xff0c;并且使用了MySQL的默认3…

记一次工作上Sqlserver每日备份失败及如何解决

发现数据库迁移后sqlserver不再执行每日备份&#xff0c;重新写了每日备份计划当天凌晨也没成功&#xff0c;后来发现sqlserver代理没有启动&#xff0c;启动后也没有成功备份&#xff0c;后来发现在sqlserver代理的错误日志中看到一条 “尚未定义空闲CPU条件-OnIdle作业条件将…

2.5 Android ebpf帮助函数解读(四)

61.long bpf_sock_ops_cb_flags_set(struct bpf_sock_ops *bpf_sock, int argval) 描述:尝试设置bpf_sock_ops相关联的完整TCP套接字的bpf_sock_ops_cb_flags字段的值为argval。 bpf_sock_ops_cb_flags字段的主要应用,是确定是否应在 TCP 代码的不同地方调用类型为BPF_PROG…