1. 开篇
循着第一篇CRNN的路径,我们介绍这个系列的第二篇论文——GRCNN.因为CRNN已经搭建起了一个清晰简洁的文字识别框架,加上受到RCNN(Recurrent Convolution Neural Network)的启发,本文很自然的将CRNN的backbone替换成了RCNN,从而提出了GRCNN的识别方法。代码实现可见:GitHub - chibohe/text_recognition_toolbox: text_recognition_toolbox: The reimplementation of a series of classical scene text recognition papers with Pytorch in a uniform way.
2. 论文解读
2.1 总览
GRCNN是2017年提出的论文,论文的全称是《Gated Recurrent Convolution Neural Network for OCR》。本文的整体架构和CRNN类似,都是分成特征提取层、序列模型和转译层。主要的改进点在特征提取层,具体是在卷积神经网络的前向信息中加入了循环信息,即在高层中能同时保证不同感受野信息的输入,从而能兼顾对不同尺度特征的提取。算法整体架构如下:



6101

被折叠的 条评论
为什么被折叠?



