utiliser pytesseract pour reconnaître le texte de l'image

Question

J'ai besoin d'utiliser pytesseract pour extraire le texte de cette image:

et le code:

from PIL import Image, ImageEnhance, ImageFilter import pytesseract path = 'pic.gif' img = Image.open(path) img = img.convert('RGBA') pix = img.load() for y in range(img.size[1]): for x in range(img.size[0]): if pix[x, y][0] < 102 or pix[x, y][1] < 102 or pix[x, y][2] < 102: pix[x, y] = (0, 0, 0, 255) else: pix[x, y] = (255, 255, 255, 255) img.save('temp.jpg') text = pytesseract.image_to_string(Image.open('temp.jpg')) # os.remove('temp.jpg') print(text)

et le "temp.jpg" est

Pas mal, mais le résultat de l'impression est ,2 WW Ce n'est pas le bon texte2HHH, alors comment puis-je supprimer ces points noirs?

Smith John · Answer

Voici ma solution:

import pytesseract from PIL import Image, ImageEnhance, ImageFilter im = Image.open("temp.jpg") # the second one im = im.filter(ImageFilter.MedianFilter()) enhancer = ImageEnhance.Contrast(im) im = enhancer.enhance(2) im = im.convert('1') im.save('temp2.jpg') text = pytesseract.image_to_string(Image.open('temp2.jpg')) print(text)

nishit chittora · Answer

Voici ma petite avancée avec la suppression du bruit et de la ligne arbitraire dans certaines gammes de fréquences de couleur.

import pytesseract from PIL import Image, ImageEnhance, ImageFilter im = Image.open(img) # img is the path of the image im = im.convert("RGBA") newimdata = [] datas = im.getdata() for item in datas: if item[0] < 112 or item[1] < 112 or item[2] < 112: newimdata.append(item) else: newimdata.append((255, 255, 255)) im.putdata(newimdata) im = im.filter(ImageFilter.MedianFilter()) enhancer = ImageEnhance.Contrast(im) im = enhancer.enhance(2) im = im.convert('1') im.save('temp2.jpg') text = pytesseract.image_to_string(Image.open('temp2.jpg'),config='-c tessedit_char_whitelist=0123456789abcdefghijklmnopqrstuvwxyz -psm 6', lang='eng') print(text)

SIM · Answer

Pour extraire le texte directement à partir du Web, vous pouvez essayer l’implémentation suivante (making use of the first image):

import io import requests import pytesseract from PIL import Image, ImageFilter, ImageEnhance response = requests.get('https://i.stack.imgur.com/HWLay.gif') img = Image.open(io.BytesIO(response.content)) img = img.convert('L') img = img.filter(ImageFilter.MedianFilter()) enhancer = ImageEnhance.Contrast(img) img = enhancer.enhance(2) img = img.convert('1') img.save('image.jpg') imagetext = pytesseract.image_to_string(img) print(imagetext)

Dinesh Chandra Kumawat · Answer

J'ai quelque chose d'approche pytesseract différente pour notre communauté . Voici mon approche

import pytesseract from PIL import Image text = pytesseract.image_to_string(Image.open("temp.jpg"), lang='eng', config='--psm 10 --oem 3 -c tessedit_char_whitelist=0123456789') print(text)