运用tensorflow实现自然场景文字检测,keras/pytorch实现crnn+ctc实现不定长中文OCR识别

运用tensorflow实现自然场景文字检测,keras/pytorch实现crnn+ctc实现不定长中文OCR识别

最近在学习计算机视觉相关的内容,在github上发现了非常好的项目chinese-ocr
该项目主要实现以下三个功能:
1. 文字方向检测 0、90、180、270度检测(这个功能不太实用,现实中角度不太会这么巧合)
2. 文字检测 后期将切换到keras版本文本检测 实现keras端到端的文本检测及识别(项目里面有两个模型keras和pytorch,建议直接用pytorch,它的效果好很多。)
3. 不定长OCR识别
项目地址:
chinese-OCR
https://github.com/jiangxiluning/chinese-ocr
其中遇到的坑有以下几个:
1、在chinese-ocr目录下运行时,会出现python的各种包找不到的情况,需要在代码中import部分将目录添加进去:类似下图

  • 5
    点赞
  • 69
    收藏
    觉得还不错? 一键收藏
  • 38
    评论
基于tensorflowkeras/pytorch实现自然场景文字检测及端到端的OCR中文文字识别 功能 文字检测 实现keras端到端的文本检测识别(项目里面有两个模型keraspytorch。) 不定OCR识别 Ubuntu下环境构建 Bash ##GPU环境 sh setup-python3-gpu.sh ##CPU python3环境 sh setup-python3-cpu.sh ##额外依赖的安装包 apt install graphviz pip3 install graphviz pip3 install pydot pip3 install torch torchvision 模型 一共分为3个网络 文本方向检测网络-Classify(vgg16) 文本区域检测网络-CTPN(CNN+RNN) EndToEnd文本识别网络-CRNN(CNN+GRU/LSTM+CTC) 文字方向检测-vgg分类 基于图像分类,在VGG16模型的基础上,训练0、90、180、270度检测的分类模型. 详细代码参考angle/predict.py文件,训练图片8000张,准确率88.23% 模型地址[BaiduCloud](链接:https://pan.baidu.com/s/1Sqbnoeh1lCMmtp64XBaK9w 提取码:n2v4) 文字区域检测CTPN 支持CPU、GPU环境,一键部署, 文本检测训练参考 OCR 端到端识别:CRNN ocr识别采用GRU+CTC端到到识别技术,实现不分隔识别不定文字 提供keraspytorch版本的训练代码,在理解keras的基础上,可以切换到pytorch版本,此版本更稳定 使用 体验 运行demo.py或者pytorch_demo.py(建议) 写入测试图片的路径即可,如果想要显示ctpn的结果,修改文件./ctpn/ctpn/other.py 的draw_boxes函数的最后部分,cv2.inwrite('dest_path',img),如此,可以得到ctpn检测文字区域框以及图像的ocr识别结果 在进行体验的时候,注意要更改里面的一些内容(比如模型文件等)

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 38
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值