Java也能做OCR！SpringBoot 整合 Tess4J 实现图片文字识别

前言

今天给大家分享一个SpringBoot整合Tess4j库实现图片文字识别的小案例，希望xdm喜欢。

文末有案例代码的Git地址，可以自己下载了去玩玩儿或继续扩展也行。

话不多说，开整吧。

什么是Tess4j库

先简单给没听过的xdm解释下，这里要分清楚Tesseract和Tess4j的区别。

Tesseract是一个开源的光学字符识别（OCR）引擎，它可以将图像中的文字转换为计算机可读的文本。支持多种语言和书面语言，并且可以在命令行中执行。它是一个流行的开源OCR工具，可以在许多不同的操作系统上运行。

Tess4J是一个基于Tesseract OCR引擎的Java接口，可以用来识别图像中的文本，说白了，就是封装了它的API，让Java可以直接调用。

搞清楚这俩东西，就足够了。

案例

1、引入依赖

既然是SpringBoot，基础依赖我就不赘述了，这里贴下Tess4J的依赖，是可以用maven下载的。

<!-- tess4j -->

<dependency>

    <groupId>net.sourceforge.tess4j</groupId>

    <artifactId>tess4j</artifactId>

    <version>4.5.4</version>

</dependency>

2、yml配置

这里，我特地把训练数据的目录路径配置在yml里，后续可以扩展到配置中心。

server:

  port: 8888

# 训练数据文件夹的路径

tess4j:

  datapath: D:/tessdata

然后我解释下什么是训练数据

Tesseract OCR库通过训练数据来学习不同语言和字体的特征，以便更好地识别图片中的文字。

在安装Tesseract OCR库时，通常会生成一个包含多个子文件夹的训练数据文件夹，其中每个子文件夹都包含了特定语言或字体的训练数据。

比如我这里是下载后放到了D盘的tessdata目录下，如图所示，其实就是一个.traineddata为后缀的文件，大小约2M多。

如果你没有特定的训练数据需求，使用默认的训练数据文件即可，我这里就是直接下载默认的来用的。

还有一点要注意的是，直接读resource目录下的路径是读不到的哈，所以我放到了D盘，训练数据本身也是更推荐放到独立的位置，方便后续训练数据。

3、config配置类

我们新建一个配置类，初始化一下Tesseract类，交给Spring管理，这样借用了Spring的单例模式。

package com.example.tesseractocr.config;

import net.sourceforge.tess4j.Tesseract;

import org.springframework.beans.factory.annotation.Value;

import org.springframework.context.annotation.Bean;

import org.springframework.context.annotation.Configuration;

/**

 * @作者: 公众号【Java分享客栈】

 * @日期: 2023/10/12 22:58

 * @描述:

 */

@Configuration

public class TesseractOcrConfiguration {

   @Value("${tess4j.datapath}")

   private String dataPath;

   @Bean

   public Tesseract tesseract() {

      Tesseract tesseract = new Tesseract();

      // 设置训练数据文件夹路径

      tesseract.setDatapath(dataPath);

      // 设置为中文简体

      tesseract.setLanguage("chi_sim");

      return tesseract;

   }

}

4、service实现

就几行代码，非常简单。

package com.example.tesseractocr.service;

import lombok.AllArgsConstructor;

import net.sourceforge.tess4j.*;

import org.springframework.stereotype.Service;

import org.springframework.web.multipart.MultipartFile;

import javax.imageio.ImageIO;

import java.awt.image.BufferedImage;

import java.io.ByteArrayInputStream;

import java.io.IOException;

import java.io.InputStream;

@Service

@AllArgsConstructor

public class OcrService {

    private final Tesseract tesseract;

   /**

    * 识别图片中的文字

    * @param imageFile 图片文件

    * @return 文字信息

    */

    public String recognizeText(MultipartFile imageFile) throws TesseractException, IOException {

        // 转换

        InputStream sbs = new ByteArrayInputStream(imageFile.getBytes());

        BufferedImage bufferedImage = ImageIO.read(sbs);

        // 对图片进行文字识别

        return tesseract.doOCR(bufferedImage);

    }

}

5、新增rest接口

我们新建一个rest接口，用来测试效果，使用上传图片文件的方式。

package com.example.tesseractocr.controller;

import com.example.tesseractocr.service.OcrService;

import lombok.AllArgsConstructor;

import net.sourceforge.tess4j.TesseractException;

import org.springframework.http.MediaType;

import org.springframework.web.bind.annotation.PostMapping;

import org.springframework.web.bind.annotation.RequestMapping;

import org.springframework.web.bind.annotation.RequestParam;

import org.springframework.web.bind.annotation.RestController;

import org.springframework.web.multipart.MultipartFile;

import java.io.IOException;

@RequestMapping("/api")

@RestController

@AllArgsConstructor

public class OcrController {

    private final OcrService ocrService;

    @PostMapping(value = "/recognize", consumes = MediaType.MULTIPART_FORM_DATA_VALUE)

    public String recognizeImage(@RequestParam("file") MultipartFile file) throws TesseractException, IOException {

      // 调用OcrService中的方法进行文字识别

      return ocrService.recognizeText(file);

    }

}

6、测试效果

这里我用ApiPost工具来测试下最终效果

我准备的一张图片如下，是从知乎上随便截取的一张。

我们调接口试一下，这里要设置Header的Content-Type，别忘了哈。

这里是body中的参数，我们选择form-data中的File属性，表示以上传文件形式来调接口。

看下效果，其实还是挺不错的，我和图片比对了一下，基本上都识别出来了。

总结

是不是非常简单xdm，反正我觉得挺有意思的，后面抽空再试试训练数据。

好了，今天的小知识，你学会了吗？

如果喜欢，请点赞+关注↓↓↓，持续分享干货哦！

Java也能做OCR！SpringBoot 整合 Tess4J 实现图片文字识别的更多相关文章

【图片识别】Java中使用tess4J进行图片文字识别（支持中文）（转）
http://blog.csdn.net/wsk1103/article/details/54173282 java中识别文字比较简单,使用的软件是tesseractocr(使用的版本是3.02,3以 ...
springboot整合ueditor实现图片上传和文件上传功能
springboot整合ueditor实现图片上传和文件上传功能写在前面: 在阅读本篇之前,请先按照我的这篇随笔完成对ueditor的前期配置工作: springboot+layui 整合百度富文本 ...
【图片识别】java 图片文字识别 ocr （转）
http://www.cnblogs.com/inkflower/p/6642264.html 最近在开发的时候需要识别图片中的一些文字,网上找了相关资料之后,发现google有一个离线的工具,以下为 ...
springboot整合thumbnailator实现图片压缩
springboot整合thumbnailator实现图片压缩前言最近由于首页产品列表图片显示太慢,经过研究发现是用户上传的图片太大. 针对这个问题,想到的解决方案是: 1. 产品上传时,限定图片 ...
java 图片文字识别 ocr
最近在开发的时候需要识别图片中的一些文字,网上找了相关资料之后,发现google有一个离线的工具,以下为java使用的demo 在此之前,使用这个工具需要在本地安装OCR工具: 下面一个是一定要安装的 ...
小试Office OneNote 2010的图片文字识别功能（OCR）
原文:小试Office OneNote 2010的图片文字识别功能(OCR) 自Office 2003以来,OneNote就成为了我电脑中必不可少的软件,它集各种创新功能于一身,可方便的记录下各种类型 ...
[C13] 应用实例：图片文字识别(Application Example: Photo OCR)
应用实例:图片文字识别(Application Example: Photo OCR) 问题描述和流程图(Problem Description and Pipeline) 图像文字识别应用所作的事是 ...
一篇文章搞定百度OCR图片文字识别API
一篇文章搞定百度OCR图片文字识别API https://www.jianshu.com/p/7905d3b12104
【原】Coursera—Andrew Ng机器学习—课程笔记 Lecture 18—Photo OCR 应用实例:图片文字识别
Lecture 18—Photo OCR 应用实例:图片文字识别 18.1 问题描述和流程图 Problem Description and Pipeline 图像文字识别需要如下步骤: 1.文字侦测 ...
JAVA的图片文字识别技术
从2013年的记录看,JAVA中图片文字识别技术大部分采用ORC的tesseract的软件功能,后来渐渐开放了java-api调用接口. 图片文字识别技术,还是采用训练的方法.并未从根本上解决图片与文 ...

随机推荐

linux 服务器上如何判断网络是否开通
项目上由于升级了kafka需要测试下网络是否是通的,因此需要使用命令 nc -zv ip地址端口这个命令来跑一下网络是否是通的,最后发现是新的kafka的config使用了新的端口,没有开通网络 ...
Java 使用ArrayList获取10个1-20之间的随机数，要求不能重复
代码如下: public static void main(String[] args) { List<Integer> nums = new ArrayList<Integer&g ...
使用 nuxt3 开发简约优雅的个人 blog
起因很早前我就有过搭建个人博客的想法,但是我希望使用纯前端实现,这样就不需要付出额外的后端维护成本,维护成本又低,而且更加安全.网上也有很多博客框架但是也不符合我的需求,所以我使用了nuxt3 + ...
Vue Router 源码分析💪
专栏分享:vue2源码专栏,玩具项目专栏,硬核推荐欢迎各位 ITer 关注点赞收藏本篇文章参考版本:vue-router v3.x 最终成果,实现了一个可运行的核心路由工程:柏成/vue-rou ...
C#.NET Framework 使用BC库（BouncyCastle） RSA 公钥加密私钥解密 ver:20230706
C#.NET Framework 使用BC库(BouncyCastle) RSA 公钥加密私钥解密 ver:20230706 环境说明: .NET Framework 4.6 的控制台程序 . 20 ...
unity前后端通信
1. 配置请求体中的Json字符串 1 request_data = new RequestBodyClass(); 2 request_data.a = "Json第一个字段"; ...
Python爬虫突破验证码技巧 - 2Captcha
在互联网世界中,验证码作为一种防止机器人访问的工具,是爬虫最常遇到的阻碍.验证码的类型众多,从简单的数字.字母验证码,到复杂的图像识别验证码,再到更为高级的交互式验证码,每一种都有其独特的识别方法和应 ...
Django学习笔记：第二章django的安装和创建应用
1.安装Django 终端运行 pip install django 查看django是否安装成功 python -m django --version 1.1 安装虚拟环境在控制台运行 pip i ...
图解 Vue 响应式原理
Vue 初始化模板渲染组件渲染为了便于理解,本文将从以下两个方面进行探索: 从 Vue 初始化,到首次渲染生成 DOM 的流程. 从 Vue 数据修改,到页面更新 DOM 的流程. Vue 初始 ...
学习lspci：总线
00:00.0 Host bridge 总线地址 00:00.0 是指PCI总线上的第一个设备,也称为根复杂性总线.在PCI架构中,每个设备都有唯一的总线地址,由域号.总线号.设备号和功能号组成.其中 ...

Java也能做OCR！SpringBoot 整合 Tess4J 实现图片文字识别

前言

什么是Tess4j库

案例

1、引入依赖

2、yml配置

3、config配置类

4、service实现

5、新增rest接口

6、测试效果

相关地址

总结

Java也能做OCR！SpringBoot 整合 Tess4J 实现图片文字识别的更多相关文章

随机推荐

热门专题