Niet alle PDF's bevatten tekst
Een PDF geëxporteerd uit Word bevat tekst. Een PDF gemaakt door een scanner bevat afbeeldingen van tekst. Voor een eenvoudige lees-app is de tweede stom — er valt niets te lezen. Oude readers, gearchiveerde rapporten, bibliotheekscans, gefotografeerde contracten: een enorm deel van de PDF's waar mensen echt doorheen moeten valt in deze categorie.
OCR, lokaal
VocaRead herkent gescande pagina's met Apple Vision OCR, op je apparaat. De pagina's verlaten je iPhone nooit: geen upload, geen clouddienst, geen account. Dat telt bij een werkdocument, en het betekent dat OCR ook in vliegtuigmodus werkt. De herkenning draait tijdens het importeren, pagina voor pagina, en het resultaat is een normaal boek in je bibliotheek, met markering die de stem volgt.
Wat beter werd in 2.6 en 3.0
Een PDF goed voorlezen draait vooral om het niet voorlezen van de verkeerde dingen. Recente versies maakten de extractie een stuk slimmer:
- Complexe lay-outs. Artikelen in twee kolommen worden kolom voor kolom gelezen, niet regel voor regel dwars over de kolomruimte.
- Kop- en voetteksten, paginanummers worden herkend en overgeslagen in plaats van op elke pagina voorgelezen.
- Hoofdstukherkenning vindt koppen in de PDF en maakt er een hoofdstukkenlijst van, zodat je per hoofdstuk kunt navigeren zoals in een EPUB — zonder proza te verliezen dat alleen maar op een kop lijkt.
- Afbrekingen en ligaturen worden hersteld vóór het uitspreken: "be-grip" wordt "begrip", "fi" wordt "fi".
- Inleidingen en prologen worden nu herkend, zodat het afspelen bij het echte begin start.
Zo importeer je een scan
- Tik op + in de bibliotheek en kies de PDF uit Bestanden, of gebruik Deel › VocaRead vanuit Mail, Safari of een scan-app.
- VocaRead merkt dat de pagina's afbeeldingen zijn en start OCR. Een voortgangsindicator toont de pagina's die herkend worden; een scan van 300 pagina's duurt een paar minuten op een recente iPhone.
- Kies een stem en druk op afspelen. Al het andere — snelheid, slaaptimer, bladwijzers — werkt zoals bij elk boek.
Betere resultaten halen
- Scan recht en goed belicht. De ingebouwde documentscanner van de iPhone (Notities of Bestanden) levert uitstekende invoer.
- Kies 300 dpi als je kunt kiezen. Piepkleine tekst in scans van lage resolutie is waar OCR-fouten zich ophopen.
- Corrigeer namen één keer. Als een terugkerende naam verkeerd wordt gelezen of uitgesproken, voeg dan een uitspraakregel toe en die geldt voor het hele boek.
- Combineer met markeringen. Markeer passages terwijl je luistert en exporteer ze als Markdown naar je notities.
Voor gewone, tekstgebaseerde PDF's, zie hoe je elke PDF in een luisterboek verandert. Klaar om het op die stapel scans te proberen? Download VocaRead — 90 minuten gratis luisteren per document.