外观
08 普通 OCR 调试
OCR 页使用公开 OCR 模型识别常规文字。它与使用项目.ddwf字库的 点阵OCR 是两套功能。
普通 OCR 与点阵 OCR
| 项目 | 普通 OCR | 点阵 OCR |
|---|---|---|
| 识别依据 | 公开 OCR 模型 | 项目.ddwf字库和已勾选颜色 |
| 主要对象 | 常规印刷体、多语种文字 | 固定点阵或像素字形 |
| 调试页 | OCR | 点阵OCR |
| 默认精度 | 0.30 | 0.80 |
| 生成命令 | OCR(...) | 识字(...)或找字(...) |
参数
| 参数 | 默认值 | 说明 |
|---|---|---|
| 模型 | ppocr_v6/small | 默认显示 PP-OCRv6 Small(中英日多语种),也可选择 PP-OCRv6 Tiny(中英多语种) |
| 文本 | 空 | 可选正则;为空时返回阈值内全部候选 |
| 范围 | 当前共享范围 | 0,0,0,0表示完整活动图片 |
| 精度 | 0.30 | 候选阈值 |
| 偏移 | 0,0,0,0 | 不调整范围边界 |
Small 支持中、英、日文字;Tiny 体积更小,支持中、英文字。模型必须在桌面环境中可用。模型列表加载失败、所选模型不可用或模型文件无法加载时,抓抓会阻止测试,而不是使用另一个模型静默替代。
切换 OCR 模型后,请重新执行测试并检查结果。
识别全部候选
- 选择活动图片并设置共享范围。
- 切换到 OCR 页。
- 选择可用模型。
- 把 文本 留空,先保留默认精度
0.30和零偏移。 - 点击 识别测试。
- 在结果区域查看文字候选,并在画布确认候选框位置。
空文本表示不写入expected限制并接受阈值内全部候选,不表示缺少必填项。它也会清除同一测试会话中上一次使用的正则。
按文本或正则匹配
在 文本 中填写一个可选正则,例如^开始$,再执行测试。若候选中没有匹配项,但 OCR 实际识别出了其他文字,结果会显示OCR未命中并保留候选文字和框。这与模型调用失败不同。
判断时分清三种结果:
- 已命中:候选文字满足文本或正则。
OCR未命中:OCR 有候选,但没有满足文本或正则。- 测试失败:范围、模型或成品程序调用存在错误。
范围和偏移
OCR 的范围规则与共享范围与裁剪一致。偏移w1,h1,w2,h2分别调整左、上、右、下边界,调整后仍必须与活动图片形成有效区域。
范围部分越界时使用交集并提示;完全无交集或偏移后范围无效时,不会调用 OCR 测试。
生成代码
测试稳定后点击 生成代码,抓抓会复制当前配置,格式为:
text
OCR(x1,y1,x2,y2,"期望文本","模型",精度,w1,h1,w2,h2)1
生成代码不会修改节点。导入前应保留当前项目,并确认所选模型仍可用。具体导入风险见代码导入与反向验证。
测试建议
- 先用空文本确认模型能识别出候选,再添加正则。
- 正则越严格,越要检查“未命中”时的候选内容。
- 切换模型后重新测试,不沿用上一模型的结果。
- 画面更新后重新截图并复核范围、精度和候选框。