在无人问津的角落,百度paddleocr发布了v6版本

PP-OCRv6 正式发布!
PaddleOCR 的新型 OCR 模型系列可扩展至 150 万至 3450 万个参数,带来更高的准确性、更快的推理速度和更广泛的部署选项——从浏览器和边缘设备到服务器。

新增内容:
1.微型/小型/中型模型:150万、770万、3450万参数
2.与 PP-OCRv5 相比,检测准确率提高 4.9%,识别准确率提高 5.1%。
3.使用 OpenVINO 时,CPU 推理速度最高可提升 5.2 倍
4. 50 种语言在一个统一的模型中
5. 新场景:PCB、CAD 图纸、数码管、点阵文本
6. Apache 2.0 开源
7. 轻量级 OCR,专为 AI 数据时代而打造。

官网demo:https://paddleocr.com

代码:GitHub - PaddlePaddle/PaddleOCR: Turn any PDF or image document into structured data for your AI. A powerful, lightweight OCR toolkit that bridges the gap between images/PDFs and LLMs. Supports 100+ languages. · GitHub

模型:PP-OCRv6 - a PaddlePaddle Collection

天梯图:

CAD测试图:

15 个赞

这个看起来有点像百度的那个飞浆平台的

2 个赞

paddle呀,就是百度的飞桨平台

1 个赞

百度这个在业界还是挺好的,看来也有良心产品

8 个赞

百度呀,没体验过这种。但对于百度文心一言 就是起个大早赶一个晚集。

paddle真是百度难得一见的长久存活的好东西了

3 个赞

也算是为数不多的好产品了,说明他还是知道怎么做的,但是现在生态纯摆烂

paddleOCR属于是相当良心了,但是paddle本身就是半死不活的,难用的要死 :distorted_face:

1 个赞

复杂表格类的,和minerU比起来还是差了么一点点

原来自己电脑性能不够的就在paddle和colab学习 :grinning_face:

paddleocr不至于无人问津吧

正好在做ocr, 本来打算用的,发现windows上不好跑起来。最后用的RapidOCR, 效果不是很好。
我用新版的试试,看看兼容性怎么样

paddleocr属于百度为数不多 拿得出手的良心之作了

2 个赞

厉害,又发布了,别的不说哈,这个Paddle在OCR领域还是非常猛的,好像很多厂商都采购部署了,前段时间朋友国企单位的票据系统大量用了这个OCR模型

PP-OCRv5 server版本已经很强了,不知道v6在gpu推理方面速度是否有提升

现在ai来了,对于ocr的需求越来越大,我之前让ai自己跑一个模型识别图片效果不好。这个模型在windows下用cpu跑效果可以么

之前用ppocr5的小模型,纯cpu可以在100毫秒内完成图片中一行文字的识别。精度感觉也很好,6代应该会更好吧