CTPN(tensorflow)+CRNN(pytorch)+CTC

本文介绍了一种基于CTPN(tensorflow)+CRNN(pytorch)+CTC的不定长文本检测和识别方法。该方案在python3.6环境下,结合tensorflow1.10和pytorch0.4.1,实现了高效的文本识别流程。文章详细描述了环境部署、模型训练及效果展示,特别强调了中文语料库的应用。
部署运行你感兴趣的模型镜像

基于CTPN(tensorflow)+CRNN(pytorch)+CTC的不定长文本检测和识别

2018年10月25日 10:02:38 稻穗子 阅读数:414

转发来源:https://swift.ctolib.com/ooooverflow-chinese-ocr.html

chinese-ocr

基于CTPN(tensorflow)+CRNN(pytorch)+CTC的不定长文本检测和识别

环境部署

 
  1. sh setup.sh

  2.  
  3. 使用环境: python 3.6 + tensorflow 1.10 +pytorch 0.4.1

  • 注:CPU环境执行前需注释掉for gpu部分,并解开for cpu部分的注释

Demo

python demo.py    

下载 预训练模型

CRNN

将pytorch-crnn.pth放入/train/models中

CTPN

将checkpoints.zip解压后的内容放入/ctpn/checkpoints中

模型训练

warp-ctc安装pytorch版

详见 warp-ctc.pytorch

CTPN训练

详见 tensorflow-ctpn

CRNN训练

1.数据准备

下载训练集

  • 共约364万张图片,按照99:1划分成训练集和验证集
  • 数据利用中文语料库(新闻 + 文言文),通过字体、大小、灰度、模糊、透视、拉伸等变化随机生成
  • 包含汉字、英文字母、数字和标点共5990个字符
  • 每个样本固定10个字符,字符随机截取自语料库中的句子
  • 图片分辨率统一为280x32

修改/train/config.py中train_data_rootvalidation_data_root以及image_path

2.训练

 
  1. cd train

  2. python train.py

3.训练结果

 

效果展示

CTPN

OCR

参考

warp-ctc-pytorch
chinese_ocr-(tensorflow+keras)
CTPN-tensorflow
crnn-pytorch

您可能感兴趣的与本文相关的镜像

PyTorch 2.5

PyTorch 2.5

PyTorch
Cuda

PyTorch 是一个开源的 Python 机器学习库,基于 Torch 库,底层由 C++ 实现,应用于人工智能领域,如计算机视觉和自然语言处理

评论 3
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
红包 添加红包
表情包 插入表情
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值