我有一个关于Azure Form Recognizer的手写文本OCR的问题。 在Azure的示例标签工具中添加标签之前,在手写PDF文件上运行OCR时,OCR通常会错误地检测文本。对于其他表单分析和提取技术,通常提供一个选项来输入应该被检测到的文本,以本质上“校正”OCR。对于在示例标签工具(Docker图像)中训练Azure Form Recognizer,我看不到一种覆盖OCR文本并输入正确文本的方法。 有没有
我对ML世界很陌生,一直在阅读有关ML和TensorFlow的内容。我的目标是在Android手机上实时阅读以下示例:所以我尝试了firebase ML OCR,它工作得很好,它读取完整的值,但是它不读取小数点,也读取了很多周围的文本。因此,我的想法是,我应该首先检测黑色和红色的边框,然后检测内部的单个数字。
走这条路对吗?我怎样才能做到这一点?另外,如何使用两种模型,一种是提取图像的一部分(黑色和红色边界区域),然后将它们传递