【ADF】スキャナで連続取り込み017.jpg【OCR】
レス数が900を超えています。1000を超えると表示できなくなるよ。
0920名無しさん@お腹いっぱい。
2011/11/14(月) 00:25:12.86ID:le+l0NJKeTypist13、読んでココ13,スキャナーはDR150を使い、
文庫本をテキストデータ化している。
先ず読み取り革命
ルビ削除が出来ないため、問題外。
日本語OCRの精度は、eと読んでとは、若干eの方が良い。
そのためOCR処理はeを使っている。
eで残念なのは、アルファベットに対応しないこと。
OCR時、本文に横文字が入ると、その部分は全く認識しない。
同じ状況でも、読んではまあそれなりに認識する。
斜め原稿の処理やその他のバッチ処理は、読んでに軍配が上がる。
OCRファクトリーと言うバッチ機能だが、これはeにはない便利な部分。
実際の作業だが、
DR-150で読み込み(斜補正無)から読んでのOCRファクトリで斜補正とノイズ削除。
eを使用しOCR。
これで、まあ99%以上の確度でテキストデータ化出来る。
レス数が900を超えています。1000を超えると表示できなくなるよ。