本页面描述的功能已在 Luxonis Hub 中移除或替换。功能可能受限,仅面向 Hub Original 客户。请参考最新的指南来配置设备、管理集群和部署应用。
该应用利用光学字符识别(OCR)技术,从图像(尤其专注于书籍封面和书脊)中无缝提取文本。通过采用先进的神经网络,该应用能够高效地检测图像中的文本区域,并准确识别其内容。OCR 流程包括两个关键阶段:文本检测和文本识别。文本检测模型直接在摄像头画面中运行,快速定位图像中的文本区域。检测到文本区域后,将其传递给主机系统上运行的文本识别模型,该模型解码文本并将其转换为机器可读格式。该应用集成了 Open Library。它会基于识别出的文本进行搜索,获取已识别书籍的相关信息。该应用提供用户友好的前端界面。用户可以通过设备的摄像头轻松拍摄书籍封面或书脊的图像。应用会立即处理这些图像,并在前端以清晰有序的方式呈现提取的文本。