- 熱門文章
-
- 江蘇省行政區(qū)域重新劃分了 江蘇未來(lái)重點(diǎn)發(fā)展城市 未來(lái)蘇北*大城市
- 10元一畝農(nóng)場(chǎng)土地出租 無(wú)人村*出租荒地 100畝荒山18萬(wàn)出售
- 遼寧省88鄉(xiāng)鎮(zhèn)個(gè)合村并鎮(zhèn) 遼寧合村并鎮(zhèn)試點(diǎn)名單 遼寧省合村并鎮(zhèn)時(shí)間表
- 周林頻譜治療儀的危害(周林頻譜治療儀的功效)
- 退伍軍人補(bǔ)貼新政策2020 退伍軍人每月發(fā)1200元 5類退伍軍人有福了
- 上海水果店裝修效果圖
- 香港房子一尺等于多少平方
- 九牧與九牧王的區(qū)別 不僅僅一字之差
- 農(nóng)村蓋房有什么風(fēng)水講究 農(nóng)村吉宅順口溜 建房十大忌諱
- 2023全國(guó)取消燃?xì)獬跹b費(fèi)嗎
- 隨機(jī)文章
請(qǐng)問(wèn)證件的 OCR識(shí)別 是什么意思啊
OCR(Optical Character Recognition,光學(xué)字符識(shí)別),是屬于圖型識(shí)別(Pattern Recognition,PR)的一門學(xué)問(wèn)。其目的就是要讓計(jì)算機(jī)知道它到底看到了什么,尤其是文字資料。 由于OCR是一門與識(shí)別率拔河的技術(shù),因此如何除錯(cuò)或利用輔助信息提高識(shí)別正確率,是OCR最重要的課題,ICR(Intelligent Character Recognition)的名詞也因此而產(chǎn)生。而根據(jù)文字資料存在的媒體介質(zhì)不同,及取得這些資料的方式不同,就衍生出各式各樣、各種不同的應(yīng)用。在此對(duì)OCR作一基本介紹,包括其技術(shù)簡(jiǎn)介以及其應(yīng)用介紹。 一、OCR的發(fā)展要談OCR的發(fā)展,早在60、70年代,世界各國(guó)就開始有OCR的研究,而研究的初期,多以文字的識(shí)別方法研究為主,且識(shí)別的文字僅為0至9的數(shù)字。以同樣擁有方塊文字的日本為例,1960年左右開始研究OCR的基本識(shí)別理論,初期以數(shù)字為對(duì)象,直至1965至1970年之間開始有一些簡(jiǎn)單的產(chǎn)品,如印刷文字的郵政編碼識(shí)別系統(tǒng),識(shí)別郵件上的郵政編碼,幫助郵局作區(qū)域分信的作業(yè);也因此至今郵政編碼一直是各國(guó)所倡導(dǎo)的地址書寫方式。OCR可以說(shuō)是一種不確定的技術(shù)研究,正確率就像是一個(gè)無(wú)窮趨近函數(shù),知道其趨近值,卻只能靠近而無(wú)法達(dá)到,永遠(yuǎn)在與100%作拉鋸戰(zhàn)。因?yàn)槠錉砍兜囊蛩靥嗔?,書寫者的?xí)慣或文件印刷品質(zhì)、掃描儀的掃瞄品質(zhì)、識(shí)別的方法、學(xué)習(xí)及測(cè)試的樣本……等等,多少都會(huì)影響其正確率,也因此,OCR的產(chǎn)品除了需有一個(gè)強(qiáng)有力的識(shí)別核心外,產(chǎn)品的操作使用方便性、所提供的除錯(cuò)功能及方法,亦是決定產(chǎn)品好壞的重要因素。一個(gè)OCR識(shí)別系統(tǒng),其目的很簡(jiǎn)單,只是要把影像作一個(gè)轉(zhuǎn)換,使影像內(nèi)的圖形繼續(xù)保存、有表格則表格內(nèi)資料及影像內(nèi)的文字,一律變成計(jì)算機(jī)文字,使能達(dá)到影像資料的儲(chǔ)存量減少、識(shí)別出的文字可再使用及分析,當(dāng)然也可節(jié)省因鍵盤輸入的人力與時(shí)間。從影像到結(jié)果輸出,須經(jīng)過(guò)影像輸入、影像前處理、文字特征抽取、比對(duì)識(shí)別、最后經(jīng)人工校正將認(rèn)錯(cuò)的文字更正,將結(jié)果輸出。在此逐一介紹:影象輸入:欲經(jīng)過(guò)OCR處理的標(biāo)的物須透過(guò)光學(xué)儀器,如影像掃描儀、傳真機(jī)或任何攝影器材,將影像轉(zhuǎn)入計(jì)算機(jī)??萍嫉倪M(jìn)步,掃描儀等的輸入裝置已制作的愈來(lái)愈精致,輕薄短小、品質(zhì)也高,對(duì)OCR有相當(dāng)大的幫助,掃描儀的分辨率使影像更清晰、掃除速度更增進(jìn)OCR處理的效率。影象前處理:影像前處理是OCR系統(tǒng)中,須解決問(wèn)題最多的一個(gè)模塊,從得到一個(gè)不是黑就是白的二值化影像,或灰階、彩色的影像,到獨(dú)立出一個(gè)個(gè)的文字影像的過(guò)程,都屬于影像前處理。包含了影像正規(guī)化、去除噪聲、影像矯正等的影像處理,及圖文分析、文字行與字分離的文件前處理。在影像處理方面,在學(xué)理及技術(shù)方面都已達(dá)成熟階段,因此在市面上或網(wǎng)站上有不少可用的鏈接庫(kù);在文件前處理方面,則憑各家本領(lǐng)了;影像須先將圖片、表格及文字區(qū)域分離出來(lái),甚至可將文章的編排方向、文章的題綱及內(nèi)容主體區(qū)分開,而文字的大小及文字的字體亦可如原始文件一樣的判斷出來(lái)。文字特征抽?。?jiǎn)我宰R(shí)別率而言,特征抽取可說(shuō)是OCR的核心,用什么特征、怎么抽取,直接影響識(shí)別的好壞,也所以在OCR研究初期,特征抽取的研究報(bào)告特別的多。而特征可說(shuō)是識(shí)別的籌碼,簡(jiǎn)易的區(qū)分可分為兩類:一為統(tǒng)計(jì)的特征,如文字區(qū)域內(nèi)的黑/白點(diǎn)數(shù)比,當(dāng)文字區(qū)分成好幾個(gè)區(qū)域時(shí),這一個(gè)個(gè)區(qū)域黑/白點(diǎn)數(shù)比之聯(lián)合,就成了空間的一個(gè)數(shù)值向量,在比對(duì)時(shí),基本的數(shù)學(xué)理論就足以應(yīng)付了。而另一類特征為結(jié)構(gòu)的特征,如文字影像細(xì)線化后,取得字的筆劃端點(diǎn)、交叉點(diǎn)之?dāng)?shù)量及位置,或以筆劃段為特征,配合特殊的比對(duì)方法,進(jìn)行比對(duì),市面上的線上手寫輸入軟件的識(shí)別方法多以此種結(jié)構(gòu)的方法為主。對(duì)比數(shù)據(jù)庫(kù):當(dāng)輸入文字算完特征后,不管是用統(tǒng)計(jì)或結(jié)構(gòu)的特征,都須有一比對(duì)數(shù)據(jù)庫(kù)或特征數(shù)據(jù)庫(kù)來(lái)進(jìn)行比對(duì),數(shù)據(jù)庫(kù)的內(nèi)容應(yīng)包含所有欲識(shí)別的字集文字,根據(jù)與輸入文字一樣的特征抽取方法所得的特征群組。對(duì)比識(shí)別:這是可充分發(fā)揮數(shù)**算理論的一個(gè)模塊,根據(jù)不同的特征特性,選用不同的數(shù)學(xué)距離函數(shù),較有名的比對(duì)方法有,歐式空間的比對(duì)方法、松弛比對(duì)法(Relaxation)、動(dòng)態(tài)程序比對(duì)法(Dynamic Programming,DP),以及類神經(jīng)網(wǎng)絡(luò)的數(shù)據(jù)庫(kù)建立及比對(duì)、HMM(Hidden Markov Model)…等著名的方法,為了使識(shí)別的結(jié)果更穩(wěn)定,也有所謂的專家系統(tǒng)(Experts System)被提出,利用各種特征比對(duì)方法的相異互補(bǔ)性,使識(shí)別出的結(jié)果,其信心度特別的高。字詞后處理:由于OCR的識(shí)別率并無(wú)法達(dá)到百分之百,或想加強(qiáng)比對(duì)的正確性及信心值,一些除錯(cuò)或甚至幫忙更正的功能,也成為OCR系統(tǒng)中必要的一個(gè)模塊。字詞后處理就是一例,利用比對(duì)后的識(shí)別文字與其可能的相似候選字群中,根據(jù)前后的識(shí)別文字找出最合乎邏輯的詞,做更正的功能。字詞數(shù)據(jù)庫(kù):為字詞后處理所建立的詞庫(kù)。人工校正:OCR最后的關(guān)卡,在此之前,使用者可能只是拿支鼠標(biāo),跟著軟件設(shè)計(jì)的節(jié)奏操作或僅是觀看,而在此有可能須特別花使用者的精神及時(shí)間,去更正甚至找尋可能是OCR出錯(cuò)的地方。一個(gè)好的OCR軟件,除了有一個(gè)穩(wěn)定的影像處理及識(shí)別核心,以降低錯(cuò)誤率外,人工校正的操作流程及其功能,亦影響OCR的處理效率,因此,文字影像與識(shí)別文字的對(duì)照,及其屏幕信息擺放的位置、還有每一識(shí)別文字的候選字功能、拒認(rèn)字的功能、及字詞后處理后特意標(biāo)示出可能有問(wèn)題的字詞,都是為使用者設(shè)計(jì)盡量少使用鍵盤的一種功能,當(dāng)然,不是說(shuō)系統(tǒng)沒(méi)顯示出的文字就一定正確,就像完全由鍵盤輸入的工作人員也會(huì)有出錯(cuò)的時(shí)候,這時(shí)要重新校正一次或能允許些許的錯(cuò),就完全看使用單位的需求了。結(jié)果輸出:其實(shí)輸出是件簡(jiǎn)單的事,但卻須看使用者用OCR到底為了什么?有人只要文本文件作部份文字的再使用之用,所以只要一般的文字文件、有人要漂漂亮亮的和輸入文件一模一樣,所以有原文重現(xiàn)的功能、有人注重表格內(nèi)的文字,所以要和Excel等軟件結(jié)合。無(wú)論怎么變化,都只是輸出檔案格式的變化而已。
其他文章
- 張國(guó)榮感情語(yǔ)錄
- 烏當(dāng)中學(xué)怎么樣
- 黃家駒的AMANI是什么意思
- yu是聲母韻母還是整體認(rèn)讀
- 什么是農(nóng)業(yè)示范園
- 嘉睿的意思 佳睿的意思 晟睿的意思
- 雄姿英發(fā)是什么意思
- 怎么仿寫詩(shī)歌
- 短時(shí)評(píng)怎么寫
- 廁所里的搞笑詩(shī)
- 陌上初熏 是什么意思
- 什么叫戲歌
- 成語(yǔ)成語(yǔ)什么化雨
- 青島大學(xué)膠州校區(qū)介紹
- or的中文是什么意思
- 關(guān)于童年的詩(shī)
- Hanson或Hansen做英文名怎樣
- 引吭高歌讀音
- 餃子的來(lái)歷和由來(lái)
- 相的組詞有哪些詞語(yǔ)
- 烏衣巷的解釋
- 用 勤 組成的詞語(yǔ)有哪些
- 阜陽(yáng)市城郊中學(xué)怎么樣
- 去海邊穿什么鞋兒童
- 十九繁體
- 硫酸霧化學(xué)式
- 你們知道味字可以組什么詞嗎
- 美人魚怎么畫
- 艾子教孫 文言文翻譯
- 黑龍江財(cái)經(jīng)大學(xué)怎么樣