盲文图像识别的工作原理
图像阅读器首先查找点状组件,并将其对齐到两列三行的盲文点字网格。每个检测到的点字格都会变成一个 Unicode 盲文点字模式。
语言规则只在图像被转换为点字格之后才应用,这使图像识别与语言翻译保持分离。
高对比度的印刷凸点会被测量为盲文点字格,而不是被猜测成英文单词。
在回译之前检查并修正 Unicode 盲文。
低置信度的照片可以使用视觉辅助兜底,而不是返回一个自信的错误答案。
图像阅读器首先查找点状组件,并将其对齐到两列三行的盲文点字网格。每个检测到的点字格都会变成一个 Unicode 盲文点字模式。
语言规则只在图像被转换为点字格之后才应用,这使图像识别与语言翻译保持分离。
使用侧光照明,让凸起的凸点投射出可见的阴影。保持页面平整,避免眩光,并拍摄完整的一行,不要裁掉顶部或底部的凸点。
在平光正面照明下,纯色背景上的红色或黑色印刷凸点目前比白色压印凸点更可靠。
它可以提供辅助,但图像质量很重要。Braille.tools 首先使用几何凸点检测,只有在网格无法可靠解析时才回退到视觉 AI。
当前 Beta 版本支持 PNG、JPEG 和 WebP 图片,最大 4 MB。
压印凸点盲文在尽力而为的基础上受支持。侧光照明以及清晰、端正的照片能显著提高检测效果。
两者都有,按顺序进行。阅读器通过几何方式检测点字格来执行盲文 OCR,然后应用 UEB 语言规则,将检测到的点字格翻译成英文。
准确度取决于图像质量:平整的页面、高对比度和清晰的凸点形状能带来最佳结果。每个检测到的点字格在翻译前都可编辑,因此你可以修正阅读器遗漏的任何内容。