>910,>911
eTypist13、読んでココ13,スキャナーはDR150を使い、
文庫本をテキストデータ化している。

先ず読み取り革命
ルビ削除が出来ないため、問題外。
日本語OCRの精度は、eと読んでとは、若干eの方が良い。
そのためOCR処理はeを使っている。
eで残念なのは、アルファベットに対応しないこと。
OCR時、本文に横文字が入ると、その部分は全く認識しない。
同じ状況でも、読んではまあそれなりに認識する。

斜め原稿の処理やその他のバッチ処理は、読んでに軍配が上がる。
OCRファクトリーと言うバッチ機能だが、これはeにはない便利な部分。

実際の作業だが、
DR-150で読み込み(斜補正無)から読んでのOCRファクトリで斜補正とノイズ削除。
eを使用しOCR。
これで、まあ99%以上の確度でテキストデータ化出来る。