
pip install pillow -i http://pypi.douban.com/simple --trusted-host pypi.douban.com
pip install pytesseract -i http://pypi.douban.com/simple --trusted-host pypi.douban.com识别验证码,需要先对图像进行预处理,去除会影响识别准确度的线条或噪点,提高识别准确度。
实例1
importcv2ascv
importpytesseract
fromPILimportImage
defrecognize_text(image):
# 边缘保留滤波 去噪
dst = cv.pyrMeanShiftFiltering(image, sp=10, sr=150)
# 灰度图像
gray = cv.cvtColor(dst, cv.COLOR_BGR2GRAY)
# 二值化
ret, binary = cv.threshold(gray, 0, 255, cv.THRESH_BINARY_INV|cv.THRESH_OTSU)
# 形态学操作 腐蚀 膨胀
erode = cv.erode(binary, None, iterations=2)
dilate = cv.dilate(erode, None, iterations=1)
cv.imshow('dilate', dilate)
# 逻辑运算 让背景为白色 字体为黑 便于识别
cv.bitwise_not(dilate, dilate)
cv.imshow('binary-image', dilate)
# 识别
test_message = Image.fromarray(dilate)
text = pytesseract.image_to_string(test_message)
print(f'识别结果:{text}')
src = cv.imread(r'./test/044.png')
cv.imshow('input image', src)
recognize_text(src)
cv.waitKey(0)
cv.destroyAllWindows()运行效果如下:
识别结果:3n3D
Process finished with exit code 0实例2
importcv2ascv
importpytesseract
fromPILimportImage
defrecognize_text(image):
# 边缘保留滤波 去噪
blur =cv.pyrMeanShiftFiltering(image, sp=8, sr=60)
cv.imshow('dst', blur)
# 灰度图像
gray = cv.cvtColor(blur, cv.COLOR_BGR2GRAY)
# 二值化
ret, binary = cv.threshold(gray, 0, 255, cv.THRESH_BINARY_INV|cv.THRESH_OTSU)
print(f'二值化自适应阈值:{ret}')
cv.imshow('binary', binary)
# 形态学操作 获取结构元素 开操作
kernel = cv.getStructuringElement(cv.MORPH_RECT, (3, 2))
bin1 = cv.morphologyEx(binary, cv.MORPH_OPEN, kernel)
cv.imshow('bin1', bin1)
kernel = cv.getStructuringElement(cv.MORPH_OPEN, (2, 3))
bin2 = cv.morphologyEx(bin1, cv.MORPH_OPEN, kernel)
cv.imshow('bin2', bin2)
# 逻辑运算 让背景为白色 字体为黑 便于识别
cv.bitwise_not(bin2, bin2)
cv.imshow('binary-image', bin2)
# 识别
test_message = Image.fromarray(bin2)
text = pytesseract.image_to_string(test_message)
print(f'识别结果:{text}')
src = cv.imread(r'./test/045.png')
cv.imshow('input image', src)
recognize_text(src)
cv.waitKey(0)
cv.destroyAllWindows()运行效果如下:
二值化自适应阈值:181.0
识别结果:8A62N1
Process finished with exit code 0实例3
importcv2ascv
importpytesseract
fromPILimportImage
defrecognize_text(image):
# 边缘保留滤波 去噪
blur = cv.pyrMeanShiftFiltering(image, sp=8, sr=60)
cv.imshow('dst', blur)
# 灰度图像
gray = cv.cvtColor(blur, cv.COLOR_BGR2GRAY)
# 二值化 设置阈值 自适应阈值的话 黄色的4会提取不出来
ret, binary = cv.threshold(gray, 185, 255, cv.THRESH_BINARY_INV)
print(f'二值化设置的阈值:{ret}')
cv.imshow('binary', binary)
# 逻辑运算 让背景为白色 字体为黑 便于识别
cv.bitwise_not(binary, binary)
cv.imshow('bg_image', binary)
# 识别
test_message = Image.fromarray(binary)
text = pytesseract.image_to_string(test_message)
print(f'识别结果:{text}')
src = cv.imread(r'./test/045.jpg')
cv.imshow('input image', src)
recognize_text(src)
cv.waitKey(0)
cv.destroyAllWindows()运行效果如下:
二值化设置的阈值:185.0
识别结果:7364
Process finished with exit code 0示例4:处理带有简单干扰点的验证码此示例适用于背景有散落噪点,但字符相对清晰的验证码。核心是使用中值滤波去除椒盐噪声,并结合形态学开运算消除小点。
importcv2
importpytesseract
fromPILimportImage
defrecognize_text_with_dots(image_path):
# 读取图片
img = cv2.imread(image_path)
# 1. 中值滤波,有效去除孤立的噪点(如椒盐噪声)
median = cv2.medianBlur(img, 3)
# 2. 转换为灰度图
gray = cv2.cvtColor(median, cv2.COLOR_BGR2GRAY)
# 3. 二值化(使用Otsu自动阈值)
_, binary = cv2.threshold(gray, 0, 255, cv2.THRESH_BINARY_INV+cv2.THRESH_OTSU)
# 4. 形态学开运算:先腐蚀后膨胀,去除细小白色噪点
kernel = cv2.getStructuringElement(cv2.MORPH_ELLIPSE, (2, 2))
opened = cv2.morphologyEx(binary, cv2.MORPH_OPEN, kernel)
# 5. 将图像反相(白底黑字)以满足Tesseract的默认期望
result = cv2.bitwise_not(opened)
# 6. 调用Tesseract OCR识别,指定配置为单个统一文本块
text = pytesseract.image_to_string(Image.fromarray(result), config='--psm 8')
returntext.strip()
# 使用示例
captcha_code = recognize_text_with_dots('./test/captcha_with_noise.png')
print(f"识别结果: {captcha_code}")示例5:处理字符粘连的验证码当验证码字符之间粘连严重时,可以尝试使用腐蚀操作进行轻微分离,但需谨慎控制迭代次数,避免字符断裂。
importcv2
importpytesseract
importnumpyasnp
fromPILimportImage
defrecognize_text_sticky(image_path):
img = cv2.imread(image_path)
# 预处理:去噪、灰度化、二值化(步骤同示例4,此处省略详细代码)
gray = cv2.cvtColor(img, cv2.COLOR_BGR2GRAY)
_, binary_inv = cv2.threshold(gray, 0, 255, cv2.THRESH_BINARY_INV+cv2.THRESH_OTSU)
# 关键步骤:轻微腐蚀以尝试分离粘连字符
# 使用一个细长的水平核,旨在切断水平方向的粘连
kernel_horizontal = np.array([[0, 0, 0, 0, 0],
[1, 1, 1, 1, 1],
[0, 0, 0, 0, 0]], dtype=np.uint8)
# 迭代次数为1,防止过度腐蚀
eroded = cv2.erode(binary_inv, kernel_horizontal, iterations=1)
# 后续可以再进行一次膨胀以修复字符因腐蚀变细的部分
kernel_solid = cv2.getStructuringElement(cv2.MORPH_RECT, (2, 2))
dilated = cv2.dilate(eroded, kernel_solid, iterations=1)
final_image = cv2.bitwise_not(dilated)
text = pytesseract.image_to_string(Image.fromarray(final_image), config='--psm 8')
returntext.strip()
# 使用示例
captcha_code = recognize_text_sticky('./test/sticky_captcha.png')
print(f"识别结果: {captcha_code}")示例6:使用轮廓分析辅助定位与识别(适用于验证码在图片中位置不固定)此方法先找到验证码文本的轮廓区域,将其裁剪出来再进行识别,可以排除图片中其他区域的干扰。
importcv2
importpytesseract
fromPILimportImage
defrecognize_text_by_contour(image_path):
img = cv2.imread(image_path)
gray = cv2.cvtColor(img, cv2.COLOR_BGR2GRAY)
# 二值化,获取黑白图
_, binary = cv2.threshold(gray, 127, 255, cv2.THRESH_BINARY_INV)
# 查找轮廓
contours, _ = cv2.findContours(binary, cv2.RETR_EXTERNAL, cv2.CHAIN_APPROX_SIMPLE)
# 假设最大的轮廓是验证码文本区域(可根据实际情况调整逻辑)
ifcontours:
largest_contour = max(contours, key=cv2.contourArea)
x, y, w, h = cv2.boundingRect(largest_contour)
# 在原图上裁剪出验证码区域
roi = img[y:y+h, x:x+w]
# 对裁剪区域进行常规预处理和识别
roi_gray = cv2.cvtColor(roi, cv2.COLOR_BGR2GRAY)
_, roi_binary = cv2.threshold(roi_gray, 0, 255, cv2.THRESH_BINARY_INV+cv2.THRESH_OTSU)
roi_binary = cv2.bitwise_not(roi_binary)
text = pytesseract.image_to_string(Image.fromarray(roi_binary), config='--psm 8')
returntext.strip()
else:
return"未找到有效轮廓"
# 使用示例
captcha_code = recognize_text_by_contour('./test/captcha_in_scene.png')
print(f"识别结果: {captcha_code}")通过Python结合OpenCV和Tesseract-OCR,我们可以构建一个本地化的、可定制的验证码识别工具。其核心优势在于预处理流程的完全可控性,开发者可以根据具体的验证码特征调整算法参数。
核心要点总结:
pillow、pytesseract库以及Tesseract-OCR可执行程序,并需要在pytesseract.py中配置好引擎路径。OpenCV(负责图像处理)与pytesseract(负责调用OCR引擎)的协同工作。局限性:
因此,此技术方案更适用于处理样式相对固定、复杂度不高的传统图形验证码。对于更复杂或商业级的场景,可能需要考虑接入专业的云OCR API服务,或者采用深度学习模型进行端到端的训练与识别。
“无他,惟手熟尔”!有需要的用起来!
如果你觉得这篇文章有用,欢迎点赞、转发、收藏、留言、推荐❤!
本文分享自 Nicholas与Pypi 微信公众号,前往查看
如有侵权,请联系 cloudcommunity@tencent.com 删除。
本文参与 腾讯云自媒体同步曝光计划 ,欢迎热爱写作的你一起参与!