Sep, 2021

TrOCR: 基于 Transformer 的带预训练模型的光学字符识别

TL;DR本文提出了一种名为 TrOCR 的端到端文本识别方法,其中使用了预训练的图像 Transformer 和文本 Transformer 模型,不仅适用于印刷体和手写体,还适用于场景文本识别任务,并在准确率方面优于当前最先进的模型。