為什麼要研究神經網絡?
有人問我,你為什麼突然有興趣研究這個了,其實答案很簡單也很無奈,市面上現在沒有合適的可以識別古籍毛筆字尤其是繁體的軟件。太多的法本需要整理成電子文檔來保存,在下一直的志願就是以後能建立一個道教圖書館,裡面放上各門各派的法本,任天下道友隨意觀看。
但要建立這個,需要有一個良好的識別軟件,能夠對古籍的文字進行提取,並且對於那些字庫中不存在的諱字及符文,能夠自動轉換成圖片,這個無論是adobe acrobat pro,ABBYY_FineReader,或是漢王 PDF OCR,中文的識別還是偏重於規則的漢字上,而在設計時也是通過內部的一定變形來進行泛化,用來識別毛筆字,尤其對於那些豎排的無標點手寫古籍來說,只能說是慘不忍睹。
既然沒有人做這個事,就只能自己來做了。