使用OpenCV改进.pdf图像中的水平线检测

Jac*_*olo 4 python opencv tesseract image-processing computer-vision

我已经将该项目的.pdf文件转换为.jpg图像。我的目标是识别通常以.pdf表格形式显示的空格(例如____________),该空格指示用户签名的形式,用于填写某种信息。我一直在使用边缘检测cv2.Canny()和cv2.HoughlinesP()功能。

这种方法效果很好,但是似乎有很多误报来自无处。当我查看“ edges”文件时,在其他单词周围显示出一堆杂音。我不确定这种噪音来自何处。

我应该继续调整参数,还是找到一种更好的方法来查找这些空白的位置?

nat*_*ncy 6

假设您要尝试在.pdf表单上查找水平线,这是一种简单的方法:

  • 将图像转换为灰度和自适应阈值图像
  • 构造特殊的内核以仅检测水平线
  • 执行形态转换
  • 查找轮廓并绘制图像

使用此示例图片

转换为灰度和自适应阈值以获得二进制图像

gray = cv2.cvtColor(image,cv2.COLOR_BGR2GRAY)
thresh = cv2.threshold(gray, 0, 255, cv2.THRESH_BINARY_INV + cv2.THRESH_OTSU)[1]
Run Code Online (Sandbox Code Playgroud)

然后我们创建一个内核,cv2.getStructuringElement()并执行形态转换以隔离水平线

horizontal_kernel = cv2.getStructuringElement(cv2.MORPH_RECT, (15,1))
detected_lines = cv2.morphologyEx(thresh, cv2.MORPH_OPEN, horizontal_kernel, iterations=2)
Run Code Online (Sandbox Code Playgroud)

从这里我们可以cv2.HoughLinesP()用来检测线,但是由于我们已经对图像进行了预处理并隔离了水平线,因此我们可以找到轮廓并绘制结果

cnts = cv2.findContours(detected_lines, cv2.RETR_EXTERNAL, cv2.CHAIN_APPROX_SIMPLE)
cnts = cnts[0] if len(cnts) == 2 else cnts[1]

for c in cnts:
    cv2.drawContours(image, [c], -1, (36,255,12), 3)
Run Code Online (Sandbox Code Playgroud)

完整代码

import cv2

image = cv2.imread('2.png')
gray = cv2.cvtColor(image,cv2.COLOR_BGR2GRAY)
thresh = cv2.threshold(gray, 0, 255, cv2.THRESH_BINARY_INV + cv2.THRESH_OTSU)[1]

horizontal_kernel = cv2.getStructuringElement(cv2.MORPH_RECT, (15,1))
detected_lines = cv2.morphologyEx(thresh, cv2.MORPH_OPEN, horizontal_kernel, iterations=2)

cnts = cv2.findContours(detected_lines, cv2.RETR_EXTERNAL, cv2.CHAIN_APPROX_SIMPLE)
cnts = cnts[0] if len(cnts) == 2 else cnts[1]

for c in cnts:
    cv2.drawContours(image, [c], -1, (36,255,12), 3)

cv2.imshow('thresh', thresh)
cv2.imshow('detected_lines', detected_lines)
cv2.imshow('image', image)
cv2.waitKey()
Run Code Online (Sandbox Code Playgroud)

  • 您可以使用“cv2.getStructuringElement()”内核大小,因此将“(15,1)”更改为“(11,1)”将“放松”过滤器。另外,更改“cv2.morphologyEx()”中的迭代次数可能会有所帮助 (2认同)