我正在嘗試從解析度為 20x10 的影像中讀取數字。我知道這個問題可能是重復的。我已經解決了這里關于堆疊溢位的大部分問題,但似乎沒有一個答案對我有用。這是我試圖從中讀取文本的影像:

這是我當前的代碼:
import pytesseract as pt
from PIL import Image
pt.pytesseract.tesseract_cmd = r"C:\Program Files\Tesseract-OCR\tesseract.exe"
img = Image.open('foo.PNG')
text = pt.image_to_string(img)
print(text)
?
我是pytesseract影像處理新手。任何建議或幫助將不勝感激。
uj5u.com熱心網友回復:
實際上,我不得不說tesseract玩起來非常敏感。根據我的經驗,我可以很容易地說,如果你——作為一個人——不能清楚地閱讀文本,你也不應該期望tesseract閱讀它。
首先; 為了得到更好的結果,必須做好預處理。我強烈建議任何處理 tesseract 的人檢查他們
現在即使 DPI 滿足,現在您也會失去準確性并產生噪音。
注意:這也不意味著更高的解析度意味著更好的結果。請檢查這里。
注意:如果您確實需要繼續處理這些型別的影像,您可能需要查看這里。首先您獲得更高的解析度,然后進行去模糊操作,這可能有助于解決問題。
轉載請註明出處,本文鏈接:https://www.uj5u.com/qiye/337940.html
標籤:Python 图像处理 写字楼 python-tesseract
上一篇:SpringSecurityBCryptPasswordEncoder:編碼后的密碼看起來不像使用相同密碼的BCrypt
