← 返回卷宗
隨意雜談

為什麼要研究神經網絡?

古籍神經網絡識別

   有人問我,你為什麼突然有興趣研究這個了,其實答案很簡單也很無奈,市面上現在沒有合適的可以識別古籍毛筆字尤其是繁體的軟件。太多的法本需要整理成電子文檔來保存,在下一直的志願就是以後能建立一個道教圖書館,裡面放上各門各派的法本,任天下道友隨意觀看。

   但要建立這個,需要有一個良好的識別軟件,能夠對古籍的文字進行提取,並且對於那些字庫中不存在的諱字及符文,能夠自動轉換成圖片,這個無論是adobe acrobat pro,ABBYY_FineReader,或是漢王 PDF OCR,中文的識別還是偏重於規則的漢字上,而在設計時也是通過內部的一定變形來進行泛化,用來識別毛筆字,尤其對於那些豎排的無標點手寫古籍來說,只能說是慘不忍睹。

  既然沒有人做這個事,就只能自己來做了。

本文由 三符道長 撰於 2015年5月11日。轉載請註明出處。