Back to skills
extension
Category: Content & MediaNo API key required

image_ocr

本地 OCR 文字识别 — 使用 PaddleOCR 从图片/扫描件/PDF 中提取文字,支持中英文,可搭配 OpenVINO 硬件加速,完全本地运行

personAuthor: yuppiezhubgithub

本地 OCR 文字识别

When to Use

当用户需要从图片、扫描件、PDF 等影像文件中提取文字信息时使用此技能。所有处理完全在本地完成,不上传任何数据。

Prerequisites

  • Python 3.8+
  • 安装依赖:pip install paddleocr paddlepaddle opencv-python
  • 可选:安装 OpenVINO 加速 pip install openvino-dev

Steps

  1. 接收用户提供的图片路径和识别语言
  2. 调用 PaddleOCR 引擎对图片进行文字检测与识别
  3. 若启用 OpenVINO,使用 GPU/NPU 硬件加速
  4. 整理识别结果,按行输出文字内容
  5. 返回完整的识别文本

Example

# 中文识别
python main.py --mode ocr --image ./scan.jpg --lang ch

# 英文识别
python main.py --mode ocr --image ./english_doc.png --lang en

Note

  • 首次运行会自动下载 PaddleOCR 模型(约 50MB)
  • 推荐在 Intel Core Ultra 上启用 OpenVINO 以使用 NPU 加速