Nicht alle PDFs enthalten Text
Ein aus Word exportiertes PDF enthält Text. Ein vom Scanner erzeugtes PDF enthält Bilder von Text. Für eine einfache Lese-App ist das zweite stumm — da ist nichts zu lesen. Alte Skripte, archivierte Berichte, Bibliotheksscans, fotografierte Verträge: Ein riesiger Teil der PDFs, durch die Menschen wirklich durchmüssen, fällt in diese Kategorie.
OCR, lokal
VocaRead erkennt gescannte Seiten mit Apple Vision OCR, auf deinem Gerät. Die Seiten verlassen dein iPhone nie: kein Upload, kein Cloud-Dienst, kein Konto. Das zählt bei einem Arbeitsdokument, und es bedeutet, dass OCR auch im Flugmodus funktioniert. Die Erkennung läuft beim Import, Seite für Seite, und das Ergebnis ist ein normales Buch in deiner Bibliothek, mit einer Hervorhebung, die der Stimme folgt.
Was in 2.6 und 3.0 besser wurde
Ein PDF gut vorzulesen heißt vor allem, das Falsche nicht vorzulesen. Die letzten Versionen haben die Extraktion deutlich klüger gemacht:
- Komplexe Layouts. Zweispaltige Aufsätze werden Spalte für Spalte gelesen, nicht Zeile für Zeile quer über den Spaltenzwischenraum.
- Kopf-, Fußzeilen und Seitenzahlen werden erkannt und übersprungen, statt auf jeder Seite vorgelesen zu werden.
- Kapitelerkennung findet Überschriften im PDF und macht daraus eine Kapitelliste, damit du wie in einem EPUB kapitelweise navigieren kannst — ohne Fließtext zu verlieren, der nur wie eine Überschrift aussieht.
- Trennstriche und Ligaturen werden vor der Sprachausgabe repariert: „Ver-ständnis“ wird zu „Verständnis“, „fi“ zu „fi“.
- Einleitungen und Prologe werden jetzt erkannt, sodass die Wiedergabe beim eigentlichen Anfang beginnt.
So importierst du einen Scan
- Tippe in der Bibliothek auf + und wähle das PDF aus „Dateien“, oder nutze Teilen › VocaRead aus Mail, Safari oder einer Scan-App.
- VocaRead erkennt, dass die Seiten Bilder sind, und startet OCR. Eine Fortschrittsanzeige zeigt die erkannten Seiten; ein 300-Seiten-Scan dauert auf einem aktuellen iPhone ein paar Minuten.
- Wähle eine Stimme und drücke auf Wiedergabe. Alles andere — Tempo, Schlaftimer, Lesezeichen — funktioniert wie bei jedem Buch.
Bessere Ergebnisse erzielen
- Gerade und gut beleuchtet scannen. Der eingebaute Dokumentenscanner des iPhones (Notizen oder Dateien) liefert hervorragendes Material.
- 300 dpi bevorzugen, wenn du wählen kannst. Winziger Text in niedrig aufgelösten Scans ist der Ort, an dem sich OCR-Fehler häufen.
- Namen einmal korrigieren. Wenn ein wiederkehrender Name falsch gelesen oder ausgesprochen wird, füge eine Ausspracheregel hinzu — sie gilt für das ganze Buch.
- Mit Markierungen kombinieren. Markiere Passagen beim Hören und exportiere sie als Markdown in deine Notizen.
Für normale, textbasierte PDFs siehe wie du jedes PDF in ein Hörbuch verwandelst. Bereit, es an dem Stapel Scans auszuprobieren? Lade VocaRead — 90 Minuten kostenloses Hören pro Dokument.