我爱计算机视觉

0获赞0粉丝0关注

Mask TextSpotter v3 来了！最强端到端文本识别模型

场景文本的识别可以用文本检测+文本识别两个过程来做，近年来端到端的场景文本识别（即Text Spotting）越来越引起学术界的重视，而华中科技大学白翔老师组的 Mask TextSpotter v1、v2 一直是该领域的代表性工作。近日 Mask TextSpotter v3 发布，代码已开源，论文 Mask TextSpotter v3: Segmentation Proposal Network for Robust Scene Text Spotting 详细介绍了其要解决的问题、使用的方案和达到的性能，此次更新依然带来惊喜，在多个数据集上大幅刷新了SOTA！该文作者信息：作者来自华中科技大学和 Faceb

我爱计算机视觉