我正在尝试使用python和opencv构建手写识别系统。
字符的识别不是问题,而是分段。
我已经成功地:

  • 将一个单词分割成单个字符
  • 单句分割成所需顺序的单词。

  • 但是我无法在文档中分割不同的行。我尝试对轮廓进行排序(以避免线段分割,仅使用字词分割),但没有奏效。
    我使用以下代码对手写文档中包含的单词进行了分割,但是它以乱序方式返回单词(它以从左到右的排序方式返回单词):
    import cv2
    import numpy as np
    #import image
    image = cv2.imread('input.jpg')
    #cv2.imshow('orig',image)
    #cv2.waitKey(0)
    
    #grayscale
    gray = cv2.cvtColor(image,cv2.COLOR_BGR2GRAY)
    cv2.imshow('gray',gray)
    cv2.waitKey(0)
    
    #binary
    ret,thresh = cv2.threshold(gray,127,255,cv2.THRESH_BINARY_INV)
    cv2.imshow('second',thresh)
    cv2.waitKey(0)
    
    #dilation
    kernel = np.ones((5,5), np.uint8)
    img_dilation = cv2.dilate(thresh, kernel, iterations=1)
    cv2.imshow('dilated',img_dilation)
    cv2.waitKey(0)
    
    #find contours
    im2,ctrs, hier = cv2.findContours(img_dilation.copy(), cv2.RETR_EXTERNAL, cv2.CHAIN_APPROX_SIMPLE)
    
    #sort contours
    sorted_ctrs = sorted(ctrs, key=lambda ctr: cv2.boundingRect(ctr)[0])
    
    for i, ctr in enumerate(sorted_ctrs):
        # Get bounding box
        x, y, w, h = cv2.boundingRect(ctr)
    
        # Getting ROI
        roi = image[y:y+h, x:x+w]
    
        # show ROI
        cv2.imshow('segment no:'+str(i),roi)
        cv2.rectangle(image,(x,y),( x + w, y + h ),(90,0,255),2)
        cv2.waitKey(0)
    
    cv2.imshow('marked areas',image)
    cv2.waitKey(0)
    

    请注意,我可以在此处将所有单词分段,但它们出现的顺序是有序的。有没有办法按照从上到下的顺序对这些轮廓进行排序



    将图像分割成单独的行,以便可以使用上述代码将每一行分割成单词?

    最佳答案

    通过更改上面的代码,我得到了所需的分割:

    kernel = np.ones((5,5), np.uint8)
    

    我将其更改为:
    kernel = np.ones((5,100), np.uint8)
    

    现在我得到的输出如下python - opencv-裁剪手写线(线段)-LMLPHP
    这也适用于手写文本图像,这些文本的线条并非完全水平:

    编辑:
    要使单个字符脱离单词,请执行以下操作:
  • 使用以下代码来调整包含单词的轮廓的大小。
    im = cv2.resize(image,None,fx=4, fy=4, interpolation = cv2.INTER_CUBIC)
    
  • 应用与线段分割相同的轮廓检测过程,但核大小为(5,5),即:
    kernel = np.ones((5,5), np.uint8)
    img_dilation = cv2.dilate(im_th, kernel, iterations=1)
    
  • 关于python - opencv-裁剪手写线(线段),我们在Stack Overflow上找到一个类似的问题:https://stackoverflow.com/questions/46282691/

    10-11 22:45