OCR技术现在到了啥水平如果图像模糊到人眼识别不出来的话,它还可以识别出来么

那应该先对离焦的图做deblur,然后再调OCR引擎吧。
■网友

一种去水印的营业执照识别方法 - CSDN博客肉眼看得清的基本上不会出错吧。肉眼看不出来的看运气了 :(

■网友
说实在的,这个问题问的有些外行!
先说答案,经过训练的模型(CNN,SVN等等),对任何输入图像来说,都能输出它认为最接近的结果的!举个例子,看不清楚字符,让你猜,你也能根据一些先验知识(不管是有意识还是无意识)说出你认为的结果的。但是,结果是否有意义,对不对,谁能知道?这就是另外一个问题了。(补充:针对题主的问题,我想表达的是算法能输出结果,和结果是否准确,是两回事。所以,不管清楚与否,识别模型都能给出结论。好吧,我默认为题主的意思,识别出准确的结果。人眼都看不清楚,也不知道原来是什么,怎么判断模型给出的结果是不是准确呢?)
对于OCR来说,不存在什么创新和创造,只是一个训练和推理的过程。你给它输入什么数据集,告诉它这是什么,训练之后,它就能做出判断,数据集越大,准确度越高。对于题主的问题,也会给出它的判断。如果训练过程中,人为做一些模糊的数据集(知道是什么),对它进行训练,它能给出更准确的答案,可以人为做一些模糊的测试数据去验证(前提是知道真实结果)。对于Deep learning,数据集足够大,可以超过人脑的判断力。就像下棋的按个阿尔法狗。

■网友
我在刚开始写爬虫的时候,模拟登录环节要应对验证码的时候面对过这个问题。然后用了Google的tesseract,然后测验了一下。图片大小正常,在适当的干扰点,干扰线条和字符倾斜下,不经过训练效果也很好,识别度很高。但是图片比较小(当时是1.5kb) 即使没有任何干扰,只用黑白色,效果都非常差。然后QQ有个识别图片文字功能,情况类似。有经验的人推荐我用cnn去训练,说效果会很好,至今没有尝试。。。。
■网友
我的OCR记忆还留在一年多以前。当时用的最新的技术是 LSTM+CTC,标注数据有100多万行文字,整行识别效果很好(现在还有一堆标注数据放在那里 )。
第二个问题,如果图像模糊人眼识别不出来的话,机器能不能识别出来?一行文字中偶尔的有一两个模糊的字看不清的话,最后的识别结果可能是对的,大多是最后进行语法纠正的结果。
说白了,我的理解是,你的标注数据决定了你的分类器能处理的图像的情况。高清大图训练出来的模型可能去识别稍微模糊的图片就不行了。如果人都看不清,怎么进行标注呢?

■网友
无论是人还是机器,都需要必要的信息才能识别。

■网友
我只知道如果人都看不懂的话AI大部分都会给一个很肯定的离谱答案。
详情请参考3b1b的视频 #滑稽

■网友
人眼都看不清,那基本就没戏了
以车牌识别为例,能做到这样已经很了不起了





多图预警!!!!土豪随意~~~
OCR技术现在到了啥水平如果图像模糊到人眼识别不出来的话,它还可以识别出来么

OCR技术现在到了啥水平如果图像模糊到人眼识别不出来的话,它还可以识别出来么

OCR技术现在到了啥水平如果图像模糊到人眼识别不出来的话,它还可以识别出来么

OCR技术现在到了啥水平如果图像模糊到人眼识别不出来的话,它还可以识别出来么

OCR技术现在到了啥水平如果图像模糊到人眼识别不出来的话,它还可以识别出来么

OCR技术现在到了啥水平如果图像模糊到人眼识别不出来的话,它还可以识别出来么


推荐阅读