文字列検索には、文字貼り付けPDFよりもテキストファイルがよい。
だからOCRの出力はテキストファイル。
読むだけならいいけど、引用する場合にはちゃんと元の画像に当たりたい。
誤認識と思われるものが本当に誤認識かを確かめる必要もあるし。
そこで、画像ファイルを探す。

その時のために、画像ファイル名と
それを入れたフォルダ名
(場合によってはDVD-Rなどの外部メディアに名前を付けて、その名前)
をテキストファイル内に書き記しておくこと。
それさえやれば、htmlでリンクしておかなくてもいいでしょう。

全文でなく、目次と索引などだけOCRに読ませて置いたものでも、
それに画像ファイル名を書いておくこと。

これをやっていない頃の画像ファイルを探すのは大変。
自分が付けそうな名前を推定してファイル検索をするわけで。