FREE PREVIEW
精选预览
PaddleOCR(文字识别)
一、工具介绍
PaddleOCR 是由百度(Baidu)基于其自研的深度学习框架 PaddlePaddle 开发的一款开源 OCR(光学字符识别) 工具箱。它是目前全球范围内最顶尖、最流行的中英文 OCR 开源项目之一,被誉为 OCR 领域的“国货之光”。它不仅能识别文字,还能识别表格、布局分析(分清标题、正文和图片)、印章检测等。
二、工具安装
【1】检查你的 Python 版本
在开始之前,你需要确定你的电脑上是否已经安装了 Python,以及 Python 的版本是否兼容。:按下 Win + R 键,输入 cmd,然后回车。在命令行输入以下命令并回车:
如果显示了 Python 的版本号(例如:Python 3.10.x 或 Python 3.9.x),说明你已经安装了 Python。
【2】Python 版本兼容性判断
- 如果你的 Python 版本是 3.8 \~ 3.11:可以 直接安装 PaddleOCR 2.6.2,跳过第 3 步。如果你的 Python 版本是 3.12 或更高:你需要安装 Miniconda 并创建一个虚拟环境,按照第 3 步操作。
【3】安装 Miniconda 并创建虚拟环境
- 关闭所有 VPN / 代理 / 加速器软件。
- 直接复制并运行下面这行“核武器”命令(强制使用清华源,忽略默认源):
- 等待环境创建完成(出现
done),然后激活环境:
(此时命令行左侧会出现 `paddle_env` 字样)
【4】安装 PaddleOCR
如果你创建虚拟环境,请确保你当前位于激活的虚拟环境里
- 安装 PaddlePaddle 2.6.2:
- 安装 PaddleOCR 2.6.2:
- 安装必要的图像处理库:
【5】验证 PaddleOCR 是否安装成功
- 在某个文件夹中新建一个txt文档,命名为
test_ocr.py,然后用记事本或代码编辑器打开它。 - 将以下代码复制到
test_ocr.py文件中保存:
- 在该文件夹空白处鼠标右键
在终端中打开,先激活虚拟环境(如果需要):然后输入以下命令并回车(如果一切正常,你将看到终端输出你当前屏幕上识别出的文字和坐标。):
3,402 字正文8 个章节1 项配套资源
继续阅读完整内容
注册后提交学习会员申请。管理员确认线下开通后,即可阅读全部指南、正文图片和私有附件。
登录并申请学习会员