下载客户端

无障碍

Github Star 7.2K，超级好用的OCR数据合成与半自动标注工具，强烈推荐！

机器之心

关注

2020-12-17 00:00

北京

来源：澎湃新闻·澎湃号·湃客

机器之心发布

机器之心编辑部

OCR 方向的工程师，一定需要知道这个 OCR 开源项目：PaddleOCR。短短几个月，累计 Star 数量已超过 7.2K，频频登上 Github Trending 日榜月榜，称它为 OCR 方向目前最火的 repo 绝对不为过。

12 月，它又带来四大新发布与升级，核心内容先睹为快：

全新发布数据合成工具 Style-Text：可以批量合成大量与目标场景类似的图像，在多个场景验证，效果均提升 15% 以上。

全新发布半自动数据标注工具 PPOCRLabel：有了它数据标注工作事半功倍，相比 labelimg 标注效率提升 60% 以上，社区小规模测试，好评如潮。

多语言识别模型效果升级：中文、英文、韩语、法语、德语、日文识别效果均优于 EasyOCR。

PP-OCR 开发体验再升级：支持动态图开发（训练调试更方便），静态图部署（预测效率更高），鱼与熊掌可以兼得。

PaddleOCR 历史表现回顾

先看下 PaddleOCR 自今年开源以来，短短几个月在 GitHub 上的表现：

6 月，8.6M 超轻量模型发布，GitHub Trending 全球趋势榜日榜第一。

8 月，开源 CVPR2020 顶会 SOTA 算法，再上 GitHub 趋势榜单！

10 月，发布 PP-OCR 算法，开源 3.5M 超超轻量模型，再下 Paperswithcode 趋势榜第一

这个含金量，广大的 GitHub 开发者们自然懂，3.5M 超超轻量模型的效果图大家直接看，绝对杠杠的。

火车票、表格、金属铭牌、翻转图片、外语都是妥妥的，3.5M 的模型能达到这个识别精度，绝对是良心之作了！

传送门：https://github.com/PaddlePaddle/PaddleOCR

那么最近的 12 月份更新，又给大家带来哪些惊喜呢？

全新发布 OCR 数据合成工具：Style-Text

相比于传统的数据合成算法，Style-Text 可以实现特殊背景下的图片风格迁移，只需要少许目标场景图像，就可以合成大量数据，效果展示如下：

1、相同背景批量数据合成

2、相同文字批量数据合成

3、图片分离前景背景

除了拉风的效果，采用这样的合成数据和真实数据一起训练，可以显著提升特殊场景的性能指标，分别以两个场景为例：

怎么样，绝对是黑科技了吧。这项能力核心算法是基于百度自研的文本编辑算法《Editing Text in the Wild》。

论文地址：https://arxiv.org/abs/1908.03047

不同于常用的基于 GAN 的数据合成工具，Style-Text 主要框架包括 ①文本前景风格迁移模块 ②背景抽取模块 ③融合模块。经过这样三步，就可以迅速实现图片文字风格迁移啦。

超强 OCR 数据标注工具：PPOCRLabel

除了数据合成，数据标注也一直是深度学习开发者关注的重点，无论是从成本还是时间上面，提高标注效率，降低标注成本太重要了。PPOCRLabel 通过内置高质量的 PPOCR 中英文超轻量预训练模型，可以实现 OCR 数据的高效标注。CPU 机器运行也是完全没问题的。话不多说，直接看 PPOCRLabel 效果演示：

用法也是非常的简单，标注效率提升 60%-80% 是妥妥的。只能说，真的太香了。

最好的多语言模型效果

简单对比一下目前主流 OCR 方向开源 repo 的核心能力：

中英文模型性能及功能对比

其中，多语言识别模型准确率对比（仅 EasyOCR 提供）

测试数据及环境说明：

中英文场景：针对 OCR 实际应用场景，包括合同，车牌，铭牌，火车票，化验单，表格，证书，街景文字，名片，数码显示屏等，收集的 300 张图像，每张图平均有 17 个文本框，PaddleOCR 的 F1-Score 超过 0.5，这个性能已经很不错了。

多语言场景：PaddleOCR 选择了开源数据 ICDAR2017 – MLT（多语言文本识别测试集），并抽取其中的法语、德语、日语、韩语数据作为评测集合。其中测试图片大多来自于自然场景，例如广告牌、路标、海报等。

PP-OCR 开发体验再升级

动态图和静态图是深度学习框架常用的两种模式。在动态图模式下，代码编写运行方式符合 Python 程序员的习惯，易于调试，但在性能方面， Python 执行开销较大，与 C++ 有一定差距。

相比动态图，静态图在部署方面更具有性能的优势。静态图程序在编译执行时，预先搭建好的神经网络可以脱离 Python 依赖，在 C++ 端被重新解析执行，而且拥有整体网络结构也能进行一些网络结构的优化。

飞桨动态图中新增了动态图转静态图的功能，支持用户使用动态图编写组网代码。预测部署时，飞桨会对用户代码进行分析，自动转换为静态图网络结构，兼顾了动态图易用性和静态图部署性能两方面优势。

良心出品的中英文文档教程

别的不需要多说了，大家访问 GitHub 点过 star 之后自己体验吧：

https://github.com/PaddlePaddle/PaddleOCR

微信扫描二维码添加运营同学，并回复【OCR】，运营同学会邀请您加入官方交流群，获得更高效的问题答疑。

如果您加入官方 QQ 群，您将遇上大批志同道合的深度学习同学。

官方 QQ 群：1108045677。

如果您想详细了解更多飞桨的相关内容，请参阅以下文档。

官网地址：https://www.paddlepaddle.org.cn

PaddleOCR 项目地址：

GitHub: https://github.com/PaddlePaddle/PaddleOCR

Gitee: https://gitee.com/paddlepaddle/PaddleOCR

转载请联系本公众号获得授权

投稿或寻求报道：content@jiqizhixin.com喜欢此内容的人还喜欢

原标题：《Github Star 7.2K，超级好用的OCR数据合成与半自动标注工具，强烈推荐！》

阅读原文

特别声明

本文为澎湃号作者或机构在澎湃新闻上传并发布，仅代表该作者或机构观点，不代表澎湃新闻的观点或立场，澎湃新闻仅提供信息发布平台。申请澎湃号请用电脑访问http://renzheng.thepaper.cn。

我要举报

评论（ 0 ）

</div></div></div></div></div></div><div><div class="index_submit__iSwPL">发表</div></div></form></div></div></div></div></div><div class="index_hotCommentWrapper__gkiI5"/><div><div><div class="index_lodaing__glGNU"><span role="img" aria-label="sync" class="anticon anticon-sync anticon-spin"><svg viewbox="64 64 896 896" focusable="false" data-icon="sync" width="1em" height="1em" fill="currentColor" aria-hidden="true"><path d="M168 504.2c1-43.7 10-86.1 26.9-126 17.3-41 42.1-77.7 73.7-109.4S337 212.3 378 195c42.4-17.9 87.4-27 133.9-27s91.5 9.1 133.8 27A341.5 341.5 0 01755 268.8c9.9 9.9 19.2 20.4 27.8 31.4l-60.2 47a8 8 0 003 14.1l175.7 43c5 1.2 9.9-2.6 9.9-7.7l.8-180.9c0-6.7-7.7-10.5-12.9-6.3l-56.4 44.1C765.8 155.1 646.2 92 511.8 92 282.7 92 96.3 275.6 92 503.8a8 8 0 008 8.2h60c4.4 0 7.9-3.5 8-7.8zm756 7.8h-60c-4.4 0-7.9 3.5-8 7.8-1 43.7-10 86.1-26.9 126-17.3 41-42.1 77.8-73.7 109.4A342.45 342.45 0 01512.1 856a342.24 342.24 0 01-243.2-100.8c-9.9-9.9-19.2-20.4-27.8-31.4l60.2-47a8 8 0 00-3-14.1l-175.7-43c-5-1.2-9.9 2.6-9.9 7.7l-.7 181c0 6.7 7.7 10.5 12.9 6.3l56.4-44.1C258.2 868.9 377.8 932 512.2 932c229.2 0 415.5-183.7 419.8-411.8a8 8 0 00-8-8.2z"/></svg></span> 加载中</div></div></div></div></div></div><div class="index_content___Uhtm"><div class="index_banner__Dg2d_"><div class="rt_ad" id="rt_ad"/></div><div class="index_commonsider__3D368"><div class="mdCard"><div class="index_ppreport__slNZB index_zwb__Q0Tlm"><div class="index_reporttop__VGXP7"><img src="/_next/static/media/pp_report.644295c3.png"/></div><div class="index_content___Uhtm"><ul/><button>查看更多</button></div></div></div><div class="mdCard"><div class="index_ppreport__slNZB index_caixun__PpO3O"><div class="index_moneytop__c_UkG"><img src="/_next/static/media/logo_caixun.cd299678.png"/></div><div class="index_content___Uhtm"><ul/><button>查看更多</button></div></div></div><div class="mdCard"><div class="index_ppreport__slNZB index_crossword__toY3q"><div class="index_moneytop__c_UkG"><img src="/_next/static/media/logo_104x44_tianzi_white@2x.b88d1296.png"/></div><div class="index_content___Uhtm"><ul/><button>开始答题</button></div></div></div><div class="index_ppreport__slNZB index_notranstion__R0Uwz"><div class="index_rebangtop__tpSSj"><img src="/_next/static/media/logo_rebang.f9ee1ca1.png"/></div><div class="index_content___Uhtm"><ul/></div></div><div class="se_ad" id="rt_ad1"/><div><div class="scale_connent__Qjc3N"><div class="scale_vcode__Pj3i0"><img src="/_next/static/media/scalecode.ed629179.png"/><h4><b>扫码下载</b><b>澎湃新闻客户端</b></h4></div><div class="scale_links__NoB8o"><p><a href="https://m.thepaper.cn/download?id=2" target="_blank">Android版</a></p><p><a href="https://apps.apple.com/cn/app/id878962716?mt=8" target="_blank">iPhone版</a></p><p><a href="https://apps.apple.com/cn/app/id986646876?mt=8" target="_blank">iPad版</a></p></div></div></div><div class="index_content__2xnNC"><div class="index_maxwidth__8UwRQ"><div id="juzhen" class="ant-row card" style="margin-left:-5px;margin-right:-5px"><div style="padding-left:5px;padding-right:5px" class="ant-col ant-col-6"><a>关于澎湃</a></div><div style="padding-left:5px;padding-right:5px" class="ant-col ant-col-6"><a>加入澎湃</a></div><div style="padding-left:5px;padding-right:5px" class="ant-col ant-col-6"><a>联系我们</a></div><div style="padding-left:5px;padding-right:5px" class="ant-col ant-col-6"><a>广告合作</a></div><div style="padding-left:5px;padding-right:5px" class="ant-col ant-col-6"><a>法律声明</a></div><div style="padding-left:5px;padding-right:5px" class="ant-col ant-col-6"><a>隐私政策</a></div><div id="ppjuzhen" style="padding-left:5px;padding-right:5px" class="ant-col ant-col-6"><div class="index_juzhencontent__iSta9"><span class="index_cursor__UXmdF">澎湃矩阵</span><ul class="index_juzhenul__T9Y_U"><li><a target="_blank" rel="noopener noreferrer" href="https://weibo.com/thepapernewsapp">澎湃新闻微博</a></li><li class="index_wechartcontent__yM1tu"><span>澎湃新闻公众号</span><div class="index_wechat__82gBN"><img src="/_next/static/media/wechat.ebe50fdd.png"/></div></li><li><a target="_blank" rel="noopener noreferrer" href="https://www.douyin.com/user/MS4wLjABAAAAzMDwcAi4v-kdwAGtt9Ni1jfE0hV9-TiUVlNLX7mb9Hw">澎湃新闻抖音号</a></li><li/><li><a target="_blank" rel="noopener noreferrer" href="https://www.ipshanghai.cn">IP SHANGHAI</a></li><li><a target="_blank" rel="noopener noreferrer" href="https://www.sixthtone.com">SIXTH TONE</a></li></ul></div></div><div id="ppbaoliao" style="padding-left:5px;padding-right:5px" class="ant-col ant-col-6"><div class="index_juzhencontent__iSta9"><span class="index_cursor__UXmdF">新闻报料</span><ul class="index_juzhenul__T9Y_U index_baoliaoul__d9Csd"><li class="index_noCursor__cCs4f"><span>报料热线: 021-962866</span></li><li><a href="mailto:news@thepaper.cn"><span>报料邮箱: news@thepaper.cn</span></a></li></ul></div></div></div></div></div><div class="index_beian__uhLsE"><p><a href="https://beian.miit.gov.cn" target="_blank">沪ICP备14003370号</a></p><p><a href="https://www.beian.gov.cn/portal/registerSystemInfo?recordcode=31010602000299" target="_blank">沪公网安备31010602000299号</a></p><p>互联网新闻信息服务许可证：31120170006</p><p>增值电信业务经营许可证：沪B2-2017116</p><p>© 2014-2023 上海东方报业有限公司</p></div><div class="index_renzheng__UYHh9"><div><a target="cyxyv" href="https://v.yunaq.com/certificate?domain=www.thepaper.cn&from=label&code=90030"><img src="/_next/static/media/label_sm_90030.2e849b63.png" alt=""/></a></div><div><img src="/_next/static/media/wuzhangai.a66118af.png" alt=""/></div></div></div></div></div><div class="index_light__hRATr"><div class="index_feedBack__KglnL"><span class="index_feedIcon__7bsOT"/><span>反馈</span></div><div class="index_backtop__Gb9ym"><div duration="0" class="ant-back-top"/></div></div></main></div></body>