Android 图片文字识别DEMO（基于百度OCR）_手机图片文字识别功能源码

作者：Cpp五条 | 2024-06-07 01:19:55

踩

手机图片文字识别功能源码

枸杞菊花茶了解一下.jpg

前言

OCR 是 Optical Character Recognition 的缩写，翻译为光学字符识别，指的是针对印刷体字符，采用光学的方式将纸质文档中的文字转换成为黑白点阵的图像文件，通过识别软件将图像中的文字转换成文本格式，供文字处理软件进一步编辑加工的技术（好吧，这是我查来的）。简单的来说，OCR技术就是可以把图片上的文字识别出来，并以文本格式的形式提取出来。

这个技术的应用方面很广泛，比如说把纸质书籍的内容转化为电子书，之前都需要人手打，但是现在只要扫描一下，将扫描出来的图片通过OCR技术转化成文本格式，效率和成本不知提升了多少倍。

有人可能会想，这个技术听起来好高端，不懂计算机图形学，模式识别，机器学习巴拉巴拉东西的人，是不是无法接触到这样的技术，实现这样的功能，（好像是的，emmm…），不过，虽然咱们自己实现不了，但是有人把轮子造好了呀，我们只要使用人家造好的轮子，就能实现图片文字识别的功能。

先来看一下我实现的效果吧，随手拿了办公桌上有字的东西（拿了枸杞茶和菊花茶的包装…），用自己写的demo拍了照识别了一下
图片文字识别1
图片文字识别2
界面下方显示的图片是手机拍的照片，界面上方显示的是从照片中识别出来的文字信息。可以看出识别的正确率还是挺高的。

我这边用的轮子是百度文字识别。下面我将介绍一下我是如何实现上述的文字识别功能。

请求模块定义

百度其实有提供图片识别Android的SDK，就像其他的SDK一样，只要导入一系列包之后就可以调用识别。寻求快速开发的小伙伴可以了解一下，我看了一下文档，实现还是十分容易的。 OCR Android SDK
但是，我在demo中使用的并非是SDK，而是使用另外一种方法——以网络api的方式来进行识别。涉及到的技术有 retrofit+rxjava 进行网络请求（在之前的一篇博客中有介绍如何使用 retrofit+rxjava ，贴一下链接），Android应用动态权限的申请，FileProvider，图片的base64转码，以及热门的MVP框架。

先看一下项目结构项目结构.png
module目录下存放的是MVP架构的三个模块，bean目录下存放的是网络请求返回的数据类型，apiservice中存放的是retrofit有关网络请求的接口。
根据百度OCR官方给出的接口 api请求说明.png
我们定义出如下的接口方法。

 /**
     * 通过图片URL的形式，获取图片内的文字信息
     * @param accessToken 通过API Key和Secret Key获取的access_token
     * @param url 图片的url
     * @return observable对象用于rxjava,从RecognitionResultBean中可以获得图片文字识别的信息
     */
    @POST("rest/2.0/ocr/v1/general_basic")
    @FormUrlEncoded
    Observable<RecognitionResultBean> getRecognitionResultByUrl(@Field</1
2
3
4
5
6
7
8
9

声明：本文内容由网友自发贡献，不代表【wpsshop博客】立场，版权归原作者所有，本站不承担相应法律责任。如您发现有侵权的内容，请联系我们。转载请注明出处：https://www.wpsshop.cn/w/Cpp五条/article/detail/683364