ま、普通に考えても、ただ「画像」としか認識してないOCRソフトが
(まさに)機械的かつ汎用的に行う前処理よりも
人間が画像の性質や状態を目で見て判断して施した前処理の方が
より適切なデータに仕上がることのほうが多いだろう。