CV / PaddleOCR
PaddleOCR v5 Mobile Recognition
Text-line recognition on reComputer R Series with Hailo-8 or Hailo-10H.
26 次下载
大小
7.48 MB内存
4GB+精度
Hailo HEF / HailoRT选择你正在使用的设备,设置指南和文档将相应更新。
快速开始
部署
sudo docker run --rm \
--name cm5-hailo8-paddle-ocr-v5-mobile-recognition \
--privileged \
--net=host \
-e PYTHONUNBUFFERED=1 \
--device /dev/hailo0:/dev/hailo0 \
-v /usr/lib/libhailort.so.4.23.0:/usr/lib/libhailort.so.4.23.0:ro \
-v /usr/lib/libhailort.so:/usr/lib/libhailort.so:ro \
ghcr.io/seeed-projects/recomputer-hailo8-cv/paddle_ocr_v5_mobile_recognition:latest \
python web_detection.py --model_path model/paddle_ocr_v5_mobile_recognition.hef --video_path video/test.mp4模型详情
reComputer R Series (CM5 + Hailo-10H)PaddleOCR v5 Mobile Recognition 在 reComputer R Series(CM5 + Hailo-10H)上运行
PaddleOCR v5 Mobile Recognition 通过 HailoRT 5.1.1 在 Hailo-10H 上将一张裁剪的文本行图像解码为带 CTC 置信度值的文本字符串。
本页面向搭配 PCIe Hailo-10H 加速器的 reComputer R Series(CM5 + Hailo-10H)。
模型信息
| 属性 | 值 |
|---|---|
| 架构 | PaddleOCR v5 Mobile(CRNN 风格 CTC 识别器) |
| 任务 | 文本识别 |
| 输入 | 48×320×3(单行文本) |
| 输出 | CTC logits → 解码字符串 + 置信度 |
| 参数量 | 4.1M |
| 计算量 | 1.5G |
| 精度 | 62.37 识别指标(Model Zoo 参考值) |
| HEF | Hailo Model Zoo v5.4.0,Hailo-10H |
硬件与主机设置
| 项目 | 值 |
|---|---|
| 开发板 | reComputer R Series(树莓派 CM5) |
| 加速器 | Hailo-10H,PCIe 接口,设备节点为 /dev/hailo0 |
| 主机驱动 | hailo-h10-all apt 包 |
| 运行时 | HailoRT 5.1.1(主机与容器主次版本需一致) |
| 容器内 Python | 3.13,aarch64 |
bash
sudo apt update
sudo apt install hailo-h10-all -y
sudo reboot
# After reboot
hailortcli fw-control identify
ls /dev/hailo0
# Docker
curl -fsSL https://get.docker.com -o get-docker.sh
sudo sh get-docker.sh --mirror Aliyun
sudo systemctl enable docker
sudo systemctl start docker使用演示视频运行
bash
sudo docker run --rm \
--name hailo10h-paddle-ocr-recognition \
--privileged \
--net=host \
-e PYTHONUNBUFFERED=1 \
--device /dev/hailo0:/dev/hailo0 \
-v /usr/lib/libhailort.so.5.1.1:/usr/lib/libhailort.so.5.1.1:ro \
-v /usr/lib/libhailort.so:/usr/lib/libhailort.so:ro \
ghcr.io/seeed-projects/recomputer-hailo10h-cv/paddle_ocr_v5_mobile_recognition:latest \
python web_detection.py --model_path model/paddle_ocr_v5_mobile_recognition.hef --video_path video/test.mp4打开 http://<Board_IP>:8000 查看 Web 预览——演示为单行文本;识别出的字符串和置信度绘制在画面下方的白色条带上(通过 letterbox 保持宽高比)。
REST API
bash
curl -X POST "http://<Board_IP>:8000/api/models/paddle_ocr_v5_mobile_recognition/predict" \
-F "file=@line.png"| 端点 | 方法 | 用途 |
|---|---|---|
/api/models/paddle_ocr_v5_mobile_recognition/predict | POST | 解码文本 + 置信度(JSON) |
/api/video_feed | GET | MJPEG 预览流 |
/api/video/upload + /api/video/analyze | POST | 离线视频分析 |
开发说明
- 源码模块:
src/hailo10h_paddle_ocr_v5_mobile_recognition/ - Dockerfile:
docker/hailo10h/paddle_ocr_v5_mobile_recognition.dockerfile - 容器镜像:
ghcr.io/seeed-projects/recomputer-hailo10h-cv/paddle_ocr_v5_mobile_recognition:latest - 包含 CTC 双批次维度修复和 letterbox 化 MJPEG 预览;执行器为 HailoRT 5.1.1 的
create_infer_modelAPI。 - 将由检测模块裁剪出的文本行送入本模型,读取每个检测区域内的文本。
输入与输出
Input: cropped single-line text image or demo video frame. Output: CTC-decoded text, confidence, and annotated MJPEG preview.