本地 OCR 文字识别
When to Use
当用户需要从图片、扫描件、PDF 等影像文件中提取文字信息时使用此技能。所有处理完全在本地完成,不上传任何数据。
Prerequisites
- Python 3.8+
- 安装依赖:
pip install paddleocr paddlepaddle opencv-python - 可选:安装 OpenVINO 加速
pip install openvino-dev
Steps
- 接收用户提供的图片路径和识别语言
- 调用 PaddleOCR 引擎对图片进行文字检测与识别
- 若启用 OpenVINO,使用 GPU/NPU 硬件加速
- 整理识别结果,按行输出文字内容
- 返回完整的识别文本
Example
# 中文识别
python main.py --mode ocr --image ./scan.jpg --lang ch
# 英文识别
python main.py --mode ocr --image ./english_doc.png --lang en
Note
- 首次运行会自动下载 PaddleOCR 模型(约 50MB)
- 推荐在 Intel Core Ultra 上启用 OpenVINO 以使用 NPU 加速
微信扫一扫