成人视屏在线观看-国产99精品-国产精品1区2区-欧美一级在线观看-国产一区二区日韩-色九九九

您的位置:首頁技術(shù)文章
文章詳情頁

基于Python的OCR實現(xiàn)示例

瀏覽:3日期:2022-07-31 09:58:14

摘要:

近幾天在做一個東西,其中需要對圖像中的文字進行識別,看了前輩們的文章,找到兩個較簡單的方法:使用python的pytesseract庫和調(diào)用百度AI平臺接口。寫下這篇文章做一個比較簡短的記錄和學(xué)習(xí),后期如果有新內(nèi)容再行補充。

1、使用python的pytesseract庫

主要是安裝庫,比較簡單,直接使用 pip install 安裝即可;另外,如果進行中文識別,需要下載語言包,并配置好相應(yīng)環(huán)境,具體操作可以進行百度,教程有不少。因為這個識別方法比較簡單(但效果并不是很理想),下面直接貼出測試代碼:

import pytesseractfrom PIL import Imageimg = Image.open(’./testImages/test01.jpg’)pytesseract.pytesseract.tesseract_cmd = ’C:/Program Files (x86)/Tesseract-OCR/tesseract.exe’s = pytesseract.image_to_string(img, lang=’chi_sim’) #不加lang參數(shù)的話,默認進行英文識別print(s)

2、調(diào)用百度AI平臺接口(有調(diào)用次數(shù)限制,通用50000次/天,學(xué)習(xí)完全夠用)

這個類似于調(diào)用接口實現(xiàn)詞法分析等操作,首先通過注冊獲得APP_ID、API_KEY、SECRET_KEY,然后調(diào)用接口實現(xiàn)OCR。由于是在線API,如果圖片體積比較大,涉及到上傳數(shù)據(jù)、分析數(shù)據(jù)、返回數(shù)據(jù)等一系列操作,需要一定的時間。此外,因為返回的是 dict 類型數(shù)據(jù),所以需要對結(jié)果進行處理(這套算法是按行識別文字的,準確率較高,基本可以直接將結(jié)果進行提取和拼接)。實現(xiàn)起來比較簡單,下面直接貼出代碼:

from aip import AipOcrAPP_ID = ’00000000’API_KEY = ’00000000000000000000’SECRET_KEY = ’00000000000000000000’client = AipOcr(APP_ID, API_KEY, SECRET_KEY) def get_file_content(filePath): with open(filePath, ’rb’) as fp: return fp.read() def image2text(fileName): image = get_file_content(fileName) dic_result = client.basicGeneral(image) res = dic_result[’words_result’] result = ’’ for m in res: result = result + str(m[’words’]) return result getresult = image2text(’./test01.jpg’)print(getresult)

小結(jié):

主要是初次接觸OCR這個領(lǐng)域所做的一些筆記,后續(xù)再深入進行學(xué)習(xí)。

python實現(xiàn)的ocr接口

import pytesseractimport requestsfrom PIL import Imagefrom PIL import ImageFilterfrom StringIO import StringIOfrom werkzeug.utils import secure_filenamefrom gevent import monkeyfrom gevent.pywsgi import WSGIServermonkey.patch_all()from flask import Flask,render_template,jsonify,request,send_from_directoryimport timeimport osimport base64import randomapp = Flask(__name__)UPLOAD_FOLDER=’upload’app.config[’UPLOAD_FOLDER’] = UPLOAD_FOLDERbasedir = os.path.abspath(os.path.dirname(__file__))ALLOWED_EXTENSIONS = set([’png’,’jpg’,’JPG’,’PNG’])def allowed_file(filename): return ’.’ in filename and filename.rsplit(’.’,1)[1] in ALLOWED_EXTENSIONS@app.route(’/’,methods=[’GET’],strict_slashes=False)def indexpage(): return render_template(’index.html’)@app.route(’/’,methods=[’POST’],strict_slashes=False)def api_upload(): log = open('error.log','w+') file_dir = os.path.join(basedir, app.config[’UPLOAD_FOLDER’]) if not os.path.exists(file_dir): os.makedirs(file_dir) print request.headers print >> log, request.headers f = request.files[’file’] postLang = request.form.get('lang', type=str) log.close() if f and allowed_file(f.filename): fname = secure_filename(f.filename) ext = fname.rsplit(’.’,1)[1] unix_time = int(time.time()) new_filename = str( random.randrange(0, 10001, 2))+str(unix_time)+’.’+ext f.save(os.path.join(file_dir,new_filename)) if cmp(postLang, 'chi_sim'): strboxs = pytesseract.image_to_boxes(Image.open('/var/OCRhtml/upload/' + new_filename), lang='chi_sim') strdata = pytesseract.image_to_string(Image.open('/var/OCRhtml/upload/' + new_filename), lang='chi_sim') print 'Chinese' else: strboxs = pytesseract.image_to_boxes(Image.open('/var/OCRhtml/upload/'+new_filename)) strdata = pytesseract.image_to_string(Image.open('/var/OCRhtml/upload/'+new_filename)) return jsonify({'errno':0, 'msg':'succeed ','data':strdata,'info':strboxs}) else: return jsonify({'errno':1001, 'errmsg':u'failed'})if __name__ == ’__main__’: http_server = WSGIServer((’’, 80), app) http_server.serve_forever()

到此這篇關(guān)于基于Python的OCR實現(xiàn)示例的文章就介紹到這了,更多相關(guān)Python OCR 內(nèi)容請搜索好吧啦網(wǎng)以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持好吧啦網(wǎng)!

標簽: Python 編程
相關(guān)文章:
主站蜘蛛池模板: 亚洲精品m在线观看 | 91亚洲综合 | 天干夜天天夜天干天ww | 一级一片一_级一片一 | 欧美一级视频精品观看 | 在线综合+亚洲+欧美中文字幕 | 欧美日韩国产亚洲一区二区三区 | 亚洲欧美在线观看播放 | 久久久精品免费观看 | 久久久久综合国产 | 成年女人毛片免费观看中文w | 91免费公开视频 | 在线观看国产一区二区三区 | 中文字幕亚洲另类天堂 | 亚洲成a人片在线播放 | 免费看美女无遮掩的软件 | 亚洲免费播放 | 青青热久久国产久精品 | 亚洲情a成黄在线观看动 | 黄色美女网站免费看 | 午夜伦y4480影院中文字幕 | 国产成人99久久亚洲综合精品 | 亚洲一级毛片免费看 | 欧美一区二区视频三区 | 成人精品一区二区三区中文字幕 | 久久偷看各类wc女厕 | 国产欧美久久久精品影院 | 美女视频黄色网址 | 日韩在线视频免费不卡一区 | 日韩欧美国产高清在线观看 | 国产精品亚洲片夜色在线 | 99久免费精品视频在线观看2 | 国产亚洲人成在线影院 | 99爱在线视频这里只有精品 | 一级午夜a毛片免费视频 | 99视频在线观看视频 | 欧美一级毛片片免费 | 欧美一级久久久久久久大片 | 亚洲国产成人精品一区91 | 日韩在线欧美 | 国产成人无精品久久久久国语 |