Github Star 9.7K,超级好用的OCR数据合成与半自动标注工具,强烈推荐!
一、导读
OCR方向的工程师,一定需要知道这个OCR开源项目:PaddleOCR
短短几个月,累计Star数量已超过9.7K,
频频登上Github Trending 日榜月榜,
称它为 OCR方向目前最火的repo绝对不为过。
最近,它又带来四大新发布与升级:
核心内容先睹为快:
全新发布数据合成工具Style-Text: 可以批量合成大量与目标场景类似的图像,在多个场景验证,效果均提升15%以上。
全新发布半自动数据标注工具PPOCRLabel: 有了它数据标注工作事半功倍,相比labelimg标注效率提升60%以上,社区小规模测试,好评如潮。
多语言识别模型效果升级: 在开源测试集评估,中文、英文、韩语、法语、德语、日文识别效果均优于EasyOCR。
PP-OCR开发体验再升级: 支持动态图开发(训练调试更方便),静态图部署(预测效率更高),鱼与熊掌可以兼得。
二、PaddleOCR历史表现回顾
先看下PaddleOCR自去年6月开源以来,短短几个月在GitHub上的表现:
6月,8.6M超轻量模型发布,GitHub Trending 全球趋势榜日榜第一。
8月,开源CVPR2020顶会SOTA算法,再上GitHub趋势榜单!
10月,发布PP-OCR算法,开源3.5M超超轻量模型,再登Paperswithcode 趋势榜第一。
这个含金量,广大的GitHub开发者们自然懂,3.5M超超轻量模型的效果图大家直接看,绝对杠杠的。
火车票、表格、金属铭牌、翻转图片、外语都是妥妥的,3.5M的模型能达到这个识别精度,绝对是良心之作了!
传送门:
Github:https://github.com/PaddlePaddle/PaddleOCR
那么最近的12月份更新,又给大家带来哪些惊喜呢?
三、全新发布OCR数据合成工具:Style-Text
相比于传统的数据合成算法,Style-Text可以实现特殊背景下的图片风格迁移,只需要少许目标场景图像,就可以合成大量数据,效果展示如下:
1、相同背景批量数据合成
2、相同文字批量数据合成
3、图片分离前景背景
除了拉风的效果,采用这样的合成数据和真实数据一起训练,可以显著提升特殊场景的性能指标,分别以两个场景为例:
怎么样,绝对是黑科技了吧。
这项能力核心算法是基于百度和华科合作研发的文本编辑算法《Editing Text in the Wild》https://arxiv.org/abs/1908.03047
不同于常用的基于GAN的数据合成工具,Style-Text主要框架包括 ①文本前景风格迁移模块 ②背景抽取模块 ③融合模块。经过这样三步,就可以迅速实现图片文字风格迁移啦。
四、超强OCR数据标注工具:PPOCRLabel
除了数据合成,数据标注也一直是深度学习开发者关注的重点,无论是从成本还是时间上面,提高标注效率,降低标注成本太重要了。
PPOCRLabel通过内置高质量的PPOCR中英文超轻量预训练模型,可以实现OCR数据的高效标注。CPU机器运行也是完全没问题的。
话不多说,直接看PPOCRLabel效果演示:
用法也是非常的简单,标注效率提升60%-80%是妥妥的。只能说,真的太香了。
五、最好的多语言模型效果
简单对比一下目前主流OCR方向开源repo的核心能力:
中英文模型性能及功能对比
其中,部分多语言模型性能及功能(F1-Score)对比(仅EasyOCR提供)
值得一提的是,目前已经有全球开发者通过PR或者issue的方式为PaddleOCR提供多语言的字典和语料,在PaddleOCR上已经完成了全球主流语言的广泛覆盖:包括中文简体、中文繁体、英文、法文、德文、韩文、日文、意大利文、西班牙文、葡萄牙文、俄罗斯文、阿拉伯文、印地文、维吾尔文、波斯文、乌尔都文、塞尔维亚文(latin)、欧西坦文、马拉地文、尼泊尔文、塞尔维亚文、保加利亚文、乌克兰文、白俄罗斯文、泰卢固文、卡纳达文、泰米尔文,也欢迎更多开发者可以参与共建。
六、PP-OCR开发体验再升级
动态图和静态图是深度学习框架常用的两种模式。在动态图模式下,代码编写运行方式符合Python程序员的习惯,易于调试,但在性能方面, Python执行开销较大,与C++有一定差距。
相比动态图,静态图在部署方面更具有性能的优势。静态图程序在编译执行时,预先搭建好的神经网络可以脱离Python依赖,在C++端被重新解析执行,而且拥有整体网络结构也能进行一些网络结构的优化。
飞桨动态图中新增了动态图转静态图的功能,支持用户使用动态图编写组网代码。预测部署时,飞桨会对用户代码进行分析,自动转换为静态图网络结构,兼顾了动态图易用性和静态图部署性能两方面优势。
七、良心出品的中英文文档教程
别的不需要多说了,大家访问GitHub点过star之后自己体验吧:
https://github.com/PaddlePaddle/PaddleOCR
扫描下方二维码报名
立即加入技术交流群
本周还有两节深度技术公开课等你来参加,带你玩转PaddleOCR~
官网地址:
https://www.paddlepaddle.org.cn
PaddleOCR项目地址:
GitHub: https://github.com/PaddlePaddle/PaddleOCR
Gitee: https://gitee.com/paddlepaddle/PaddleOCR
↓↓↓点击阅读原文链接,参与报名
Github Star 9.7K,超级好用的OCR数据合成与半自动标注工具,强烈推荐!相关推荐
- Github Star 8.4K,超级好用的OCR数据合成与半自动标注工具,强烈推荐!
一.导读 OCR方向的工程师,一定需要知道这个OCR开源项目:PaddleOCR 短短几个月,累计Star数量已超过8.5K, 频频登上Github Trending 日榜月榜, 称它为 OCR方向目 ...
- Github Star 7.2K,超级好用的OCR数据合成与半自动标注工具,强烈推荐!
机器之心发布 机器之心编辑部 OCR 方向的工程师,一定需要知道这个 OCR 开源项目:PaddleOCR.短短几个月,累计 Star 数量已超过 7.2K,频频登上 Github Trending ...
- 2.3 万 Star!直追微软 Visio,这个简洁实用的在线绘图工具必须推荐给你
[导语]:一款简洁强大的绘图工具,功能上直追 Microsoft Visio. 简介 Diagrams.net 是一款简洁强大的在线绘图工具,也许读者朋友们没听过这个工具,但是可能很多都听过 draw ...
- Github Star 11.5K项目再发版:AAAI 2021 顶会论文开源,80+多语言模型全新升级
一.导读 OCR方向的工程师,一定需要知道这个OCR开源项目:PaddleOCR 短短半年时间,累计Star数量已超过11.5K, 频频登上Github Trending和Paperswithcode ...
- GitHub Star 20000+,这个项目价值百万
导 读 OCR方向的工程师,之前一定听说过PaddleOCR这个项目, 累计Star数量已超过20000+, 频频登上GitHub Trending和Paperswithcode 日榜月榜第一, 在M ...
- GitHub star 7k+:史上最全图像分割资料集锦
GitHub:数据增广最全资料集锦 点击上方,选择星标或置顶,不定期资源大放送! 阅读大概需要5分钟 Follow小博主,每天更新前沿干货 作者:mrgloom 编辑:Amusi 转自:Cver 前言 ...
- 【React 实战教程】从0到1 构建 github star管理工具
前言 在日常使用github中,除了利用git进行项目版本控制之外,最多的用处就是游览各式的项目,在看到一些有趣或者有用的项目之后,我们通常就会顺手star,目的是日后再看.但是当我们star了许多项 ...
- 揭秘:GitHub Star 5W人追更,这个框架是打工人石锤了!
作为一个 GitHub Star 破 5w,Fork 超 3w 的 Java 框架,一切都在证明,Spring Boot 已经成为了 Java 程序员必备的技能. 不夸张的说,Spring Boot ...
- 高效管理 GitHub Star,用这几个插件就能做到!
如果你是像我一样的 GitHub 深度用户,常年浸泡在论坛上,每次看到好项目就会随手留下 Star,久而久之,你应该就会发现,Star 过的项目到了千级甚至万级的地步. 这时,你应该就会面临跟我一样的 ...
最新文章
- SpringBoot之集成swagger2
- 数据库名、实例名、数据库域名、全局数据库名、服务名,
- hexo+markdown添加本地图片无法显示
- 算法导论——动态规划:0-1背包问题(完全解)
- 简明代码介绍类激活图CAM, GradCAM, GradCAM++
- Spring Boot——易班优课YOOC课群在线测试自动答题解决方案(二)答案储存
- 【oracle】多个用户的对象 导出导入
- zeppelin的安装与使用
- Java——Arrays类操作数组的工具类
- 昨天帮同学的学校写了首校歌
- 判断一个程序员水平高低的标准?
- Linux环境下安装部署AWStats日志分析系统实例
- 前端学习(3165):react-hello-react之UUID库
- code vs 代码格式化排版_23行代码,教你用python实现百度翻译!(建议收藏)
- Mr.J--.c 和.cpp 后缀详解
- [DP]Luogu 2014NOIP提高组 飞扬的小鸟题解
- 微服务升级_SpringCloud Alibaba工作笔记0014---Nacos简介和下载_10万微服务实例在线管理
- 近300个 Windows 10 可执行文件易受 DLL 劫持攻击
- 没有找到 AUTOBACKUP
- drush cc all 报错
热门文章
- SSH Tunnel扫盲(ssh port forwarding端口转发)
- JDBC防止SQL注入
- 数组字符串那些经典算法:最大子序列和,最长递增子序列,最长公共子串,最长公共子序列,字符串编辑距离,最长不重复子串,最长回文子串 (转)...
- rose-scanning reading
- Unix网络编程 chart
- RAID组中的“Foreign”状态磁盘
- 华为机试HJ40:统计字符
- java 一级缓存,MyBatis一级缓存避坑完全指南
- java飞机大战子弹怎么修改_java改版飞机大战源码
- java数据库的连接方式_java与各个数据库的连接方式