大小只有8.6M！百度开源超轻量中英文OCR模型爆红Github - 代码天地

大小只有8.6M！百度开源超轻量中英文OCR模型爆红Github

其他 2020-09-25 19:06:34 阅读次数: 0

光学字符识别（OCR）是指电子设备（例如扫描仪或数码相机）检查纸上打印的字符，通过检测暗、亮的模式确定其形状，然后用字符识别方法将形状翻译成计算机文字的过程。

前几个月，猿妹曾和大家分享过一个热门的中文OCR项目———chineseocr_lite。这两天猿妹才知道，百度也开源了一款超轻量级中文OCR，总模型大小仅8.6M，只有chineseocr_lite，那真真是超轻量级别的神级OCR。

PaddleOCR旨在打造一套丰富、领先、且实用的OCR工具库，助力使用者训练出更好的模型，支持iOS和Android系统，功能如此齐全，难怪霸榜Github热榜：

大小只有8.6M！百度开源超轻量中英文OCR模型爆红Github

PaddleOCR具有以下特性：

超轻量级中文OCR模型，总模型仅8.6M
使用通用中文OCR模型
多种预测推理部署方案，包括服务部署和端侧部署
多种文本检测训练算法，EAST、DB
多种文本识别训练算法，Rosetta、CRNN、STAR-Net、RARE
可运行于Linux、Windows、MacOS等多种系统

说了这么多，还是一起来看看效果吧，先来看看通用中文OCR效果展示：

大小只有8.6M！百度开源超轻量中英文OCR模型爆红Github

再来看看超轻量级中文OCR效果展示，无论是横排文字还是竖排文字，都是不在话下的，而且识别准确率相当高。

大小只有8.6M！百度开源超轻量中英文OCR模型爆红Github

当然你要说他零失误那就有点夸张了，比如下面这一张，就出现了一个字识别错误：

大小只有8.6M！百度开源超轻量中英文OCR模型爆红Github

支持空格的中文OCR效果展示

大小只有8.6M！百度开源超轻量中英文OCR模型爆红Github

通用模型

大小只有8.6M！百度开源超轻量中英文OCR模型爆红Github

除了丰富的功能，文档教程也是十分全面，不信你看：

大小只有8.6M！百度开源超轻量中英文OCR模型爆红Github

有什么不懂的直接找文档准没错，不知道百度开源的这款神器你粉了么？

最后附上Github地址：https://github.com/PaddlePaddle/PaddleOCR

猜你喜欢

转载自blog.csdn.net/GYHYCX/article/details/108798195

大小只有8.6M！百度开源超轻量中英文OCR模型爆红Github

8.6M超轻量中英文OCR模型开源，训练部署一条龙

今晚直播丨飞桨8.6M超轻量中英文OCR模型解读

PP-OCR: 3.5M超轻量中英文OCR模型详解(四) 文本识别优化瘦身策略

革新OCR结构化技术应用，百度中英文OCR结构化模型StrucTexT预训练模型

百度开源的超轻量级OCR

大厂开源真香，百度开源的超轻量级OCR工具库强大且实用

GitHub开源：17M超轻量级中文OCR模型、支持NCNN推理

stopwords.txt下载百度云（中英文）

window10的输入法指示器只有M没有中英文指示？

Java-基于百度API的图片文字识别（支持中文，英文和中英文混合）

解决Jsoup下载图片大小只有1M的问题

百度输入法开启AI时代，突破方言、中英文混合识别难题

百度ERNIE 2.0强势发布！16项中英文任务表现超越BERT和XLNet

Python使用OCR识别中英文

百川智能发布开源中英文大模型；GitHub调查显示92%的程序员使用AI编码工具；第一季度中国云服务支出增长6%丨每日大事件...

rtsp协议中英文对照（RTSP1.0和RTSP2.0版本都有，自己结合谷歌和百度翻译，可能有很多不准确）

吴恩达机器学习课程资源（笔记、中英文字幕视频、课后作业，提供百度云镜像！）

LLM模型中英文评测基准

基于python和tesseract库的中英文识别（OCR)

baichuan-7B: 开源可商用支持中英文的最好大模型

CharacterUtils 判断中英文，英文大小写

使用百度OCR

中英文分句

中英文统计

中英文换行

从百度掉队谈起：给百度开药，其实只有一条

神仙打架——号称是性能最强的中英文百亿参数量开源模型Baichuan-13B他来了！

【AI实战】开源可商用的中英文大语言模型baichuan-7B，从零开始搭建

中英文情感分析模型汇总

今日推荐

开放签电子签章：停止新增，优化体验，前进更进（五一假期前工作）

开源日报 | 中学生开源前端动画引擎；全球首个Llama3 8B中文版开源模型；联想电脑恐出局；Linus讽刺AI炒作

“百模大战”必有一战 | 2024中国“百模大战”竞争格局分析

最强开源大模型 Llama 3 上架 Gitee AI

虽然老乡鸡开源的不是代码，但背后的原因却让人很暖心

富文本编辑器 Quill 2.0 重磅发布，特性、可靠性与开发者体验大幅提升

周排行

SVN同步出现问题

解决 nginx 出现 413 Request Entity Too Large 的问题

第一节区块链服务BaaS的总体架构以及基本模块设计的一种方案

ITeye 2013年度盘点——社区赠书书单

IDEA / git 和github 的新手使用教程史上最简单的 IntelliJ IDEA 教程史上最简单的 GitHub 教程

测试工程方法：测试用例设计综合策略

Spark优化(三)：对多次使用的RDD进行持久化

使用STM32 ST-LINK Utility 设置读保护后不能运行

exgcd 解同余方程ax=b(%n)

Android使用脚本进行多渠道打包

每日归档

更多

2024-04-22(39)

2024-04-21(0)

2024-04-20(6)

2024-04-19(5)

2024-04-18(0)

2024-04-17(5)

2024-04-16(70)

2024-04-15(42)

2024-04-14(0)

2024-04-13(119)