ID:6y7yxttoさんはOCRはあまり使わない人なんだろう。

スキャンしたままの状態だとコントラストが低めで紙質の風合いまで残ってる。
印刷物の情報は「インクで刷り込まれた部分」なので紙質はノイズ。
コントラストを高めて紙の質感を飛ばし、インク部を濃くしてやることで
OCRの認識率はかなり向上する。
(単に白黒2値化しても紙のザラザラまで「真っ黒」な点として残るのでダメ)

補正は同一条件原稿の中で一枚だけ手作業でパラメータを決め
あとはバッチ処理で全自動でやるので労力はほとんどかからない。

ScanSnapから直PDFみたいな作業してるとわかりにくいけど
画像の下処理の有無で資料の使いやすさはずいぶん変わる。


一言でまとめると「勉強不足」だ。