前処理なくても認識はできるが精度悪いだろ?
精度上げたいならOCRソフトで試行錯誤するより
前処理で認識しやすい状態を作った方が速くて確実。
透明txt付きPDFなら画像の視認性upにもなる。

コントラストを調整すれば文字と背景の閾値を目で確認できる。
その後背景を白く飛ばせば誤認識が減る。

一度最適値だせば1冊丸ごとor同種の媒体全部一括処理できる。
スキャナの調整もフラットベッドでも再プレビューしない限り変わらない。