Danke für Ihre Antwort, die aber meine Frage nicht klärt. Ich lade ein durchsuchbares (von einem Programm erstelltes) PDF hoch. Datev machte es zuerst undurchsuchbar und liest es dann per OCR. Die OCR erkennt aber nur das, was sie wichtig findet, IBAN etc. Ich möchte nach allem (das ist im Original-PDF ja alles drin) suchen können und zwar nicht per OCR, sondern im originalen PDF. Gibt es für dieses widersinnige Vorgehen einen Grund? [Ich selbst verfahre genau umgekehrt, durchsuchbare PDFs lasse ich unangetastet, andere (gescannte) mache ich - per OCR - (weitgehend, abhängig von der Qualität des Scans) durchsuchbar.
... Mehr anzeigen