前往小程序,Get更优阅读体验!
立即前往
首页
学习
活动
专区
工具
TVP
发布
社区首页 >专栏 >教程 | OpenCV场景文字检测

教程 | OpenCV场景文字检测

作者头像
OpenCV学堂
发布2019-04-29 15:56:24
4K0
发布2019-04-29 15:56:24
举报
文章被收录于专栏:贾志刚-OpenCV学堂

TEXT扩展模块概述

OpenCV在TEXT扩展模块中支持场景文字识别,最早的场景文字检测是基于级联检测器实现,OpenCV中早期的场景文字检测是基于极值区域文本定位与识别、最新的OpenCV3.4.x之后的版本添加了卷积神经网络实现场景文字检测,后者的准确性与稳定性比前者有了很大的改观,不再是鸡肋算法,是可以应用到实际场景中的。值得一提的是基于CNN实现场景文字检测算法OpenCV中采用了是华中科技大学贡献的模型,模型结构如下:

代码演示

基于极值区域文本定位的方法实现场景文字检测演示如下:

代码语言:javascript
复制
def cascade_classfier_text_detect():
    img = cv.imread("D:/images/cover_01.jpg")
    vis = img.copy()

    # Extract channels to be processed individually
    channels = cv.text.computeNMChannels(img)
    cn = len(channels)-1
    for c in range(0,cn):
      channels.append((255-channels[c]))

    # Apply the default cascade classifier to each independent channel (could be done in parallel)
    print("Extracting Class Specific Extremal Regions from "+str(len(channels))+" channels ...")
    print("    (...) this may take a while (...)")
    for channel in channels:

      erc1 = cv.text.loadClassifierNM1('trained_classifierNM1.xml')
      er1 = cv.text.createERFilterNM1(erc1,16,0.00015,0.13,0.2,True,0.1)

      erc2 = cv.text.loadClassifierNM2('trained_classifierNM2.xml')
      er2 = cv.text.createERFilterNM2(erc2,0.5)

      regions = cv.text.detectRegions(channel,er1,er2)

      rects = cv.text.erGrouping(img,channel,[r.tolist() for r in regions])

      #Visualization
      for r in range(0,np.shape(rects)[0]):
        rect = rects[r]
        cv.rectangle(vis, (rect[0],rect[1]), (rect[0]+rect[2],rect[1]+rect[3]), (255, 0, 0), 2)
        cv.rectangle(vis, (rect[0],rect[1]), (rect[0]+rect[2],rect[1]+rect[3]), (0, 0, 255), 1)


    #Visualization
    cv.imshow("Text detection result", vis)
    cv.imwrite("D:/test_detection_demo_02.png", vis)
    cv.waitKey(0)

基于卷积神经网络模型实现场景文字检测演示如下:

代码语言:javascript
复制
def cnn_text_detect():
    image = cv.imread("D:/images/cover_01.jpg")
    cv.imshow("input", image)
    result = image.copy()
    detector = cv.text.TextDetectorCNN_create("textbox.prototxt", "TextBoxes_icdar13.caffemodel")
    boxes, scores = detector.detect(image);
    threshold = 0.5
    for r in range(np.shape(boxes)[0]):
        if scores[r] > threshold:
            rect = boxes[r]
            cv.rectangle(result, (rect[0], rect[1]), (rect[0] + rect[2], rect[1] + rect[3]), (255, 0, 0), 2)

    cv.imshow("Text detection result", result)
    cv.waitKey()

    cv.waitKey(0)
    cv.destroyAllWindows()

运行结果

基于极值区域文本定位

基于卷积神经网络检测

对比发现,明显基于卷积神经网络的方法更加的靠谱!所以请使用TEXT模块中的卷积神经网络实现场景文字检测。

本文参与 腾讯云自媒体同步曝光计划,分享自微信公众号。
原始发表:2019-01-14,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 OpenCV学堂 微信公众号,前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体同步曝光计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
目录
  • TEXT扩展模块概述
  • 代码演示
  • 运行结果
相关产品与服务
文字识别
文字识别(Optical Character Recognition,OCR)基于腾讯优图实验室的深度学习技术,将图片上的文字内容,智能识别成为可编辑的文本。OCR 支持身份证、名片等卡证类和票据类的印刷体识别,也支持运单等手写体识别,支持提供定制化服务,可以有效地代替人工录入信息。
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档