小编ida*_*dar的帖子

如何处理和提取图像中的文本

我正在尝试使用 python cv2 从图像中提取文本。结果很可悲,我想不出改进代码的方法。我相信在提取文本之前需要处理图像,但不确定如何处理。

示例图像

我试图将它转换成黑白,但没有运气。

import cv2
import os
import pytesseract
from PIL import Image
import time

pytesseract.pytesseract.tesseract_cmd='C:\\Program Files\\Tesseract-OCR\\tesseract.exe'

cam = cv2.VideoCapture(1,cv2.CAP_DSHOW)

cam.set(cv2.CAP_PROP_FRAME_WIDTH, 8000)
cam.set(cv2.CAP_PROP_FRAME_HEIGHT, 6000)

while True:
    return_value,image = cam.read()
    image=cv2.cvtColor(image,cv2.COLOR_BGR2GRAY)
    image = image[127:219, 508:722]
    #(thresh, image) = cv2.threshold(image, 128, 255, cv2.THRESH_BINARY | cv2.THRESH_OTSU)
    cv2.imwrite('test.jpg',image)
    print('Text detected: {}'.format(pytesseract.image_to_string(Image.open('test.jpg'))))
    time.sleep(2)

cam.release()
#os.system('del test.jpg')
Run Code Online (Sandbox Code Playgroud)

python opencv image image-processing python-tesseract

5
推荐指数
1
解决办法
6942
查看次数