当前位置:   article > 正文

cnocr:用来做中文OCR的Python3包,装上就能用!

cnocr


向AI转型的程序员都关注了这个号????????????

机器学习AI算法工程   公众号:datayx

cnocr是用来做中文OCR的Python 3包。cnocr自带了训练好的识别模型,安装后即可直接使用。

cnocr主要针对的是排版简单的印刷体文字图片,如截图图片,扫描件等。cnocr目前内置的文字检测和分行模块无法处理复杂的文字排版定位。如果要用于场景文字图片的识别,需要结合其他的场景文字检测引擎使用。

示例

安装真的很简单

pip install cnocr

请使用Python3 (3.4, 3.5, 3.6以及之后版本应该都行

可直接使用的模型

cnocr的ocr模型可以分为两阶段:第一阶段是获得ocr图片的局部编码向量,第二部分是对局部编码向量进行序列学习,获得序列编码向量。目前两个阶段分别包含以下的模型:

  1. 局部编码模型(emb model)

  • conv:多层的卷积网络;

  • conv-lite:更小的多层卷积网络;

  • densenet:一个小型的densenet网络;

  • densenet-lite:一个更小的densenet网络。

声明:本文内容由网友自发贡献,不代表【wpsshop博客】立场,版权归原作者所有,本站不承担相应法律责任。如您发现有侵权的内容,请联系我们。转载请注明出处:https://www.wpsshop.cn/w/笔触狂放9/article/detail/593635
推荐阅读
相关标签
  

闽ICP备14008679号