Tous les PDF ne contiennent pas de texte
Un PDF exporté depuis Word contient du texte. Un PDF produit par un scanner contient des images de texte. Pour une app de lecture basique, le second est muet — il n'y a rien à lire. Vieux polycopiés, rapports archivés, scans de bibliothèque, contrats photographiés : une énorme part des PDF que les gens doivent vraiment lire entre dans cette catégorie.
L'OCR, en local
VocaRead reconnaît les pages scannées avec l'OCR Apple Vision, sur votre appareil. Les pages ne quittent jamais votre iPhone : pas d'envoi, pas de service cloud, pas de compte. Ça compte pour un document professionnel, et ça signifie que l'OCR fonctionne aussi en mode avion. La reconnaissance s'exécute pendant l'import, page par page, et le résultat est un livre normal dans votre bibliothèque, avec le surlignage qui suit la voix.
Ce qui s'est amélioré en 2.6 et 3.0
Bien lire un PDF à voix haute, c'est surtout ne pas lire ce qu'il ne faut pas. Les dernières versions ont rendu l'extraction bien plus intelligente :
- Mises en page complexes. Les articles sur deux colonnes sont lus colonne par colonne, pas ligne par ligne en traversant la gouttière.
- En-têtes, pieds de page, numéros de page sont détectés et ignorés au lieu d'être lus à chaque page.
- La détection des chapitres repère les titres dans le PDF et en fait une liste de chapitres, pour naviguer comme dans un EPUB — sans perdre de la prose qui ressemble seulement à un titre.
- Césures et ligatures sont réparées avant la synthèse : « compré-hension » redevient « compréhension », « fi » redevient « fi ».
- Introductions et prologues sont désormais détectés, la lecture démarre donc au vrai début.
Comment importer un scan
- Touchez + dans la bibliothèque et choisissez le PDF dans Fichiers, ou utilisez Partager › VocaRead depuis Mail, Safari ou une app de numérisation.
- VocaRead détecte que les pages sont des images et lance l'OCR. Un indicateur montre les pages en cours de reconnaissance ; un scan de 300 pages prend quelques minutes sur un iPhone récent.
- Choisissez une voix et lancez la lecture. Tout le reste — vitesse, minuteur de sommeil, signets — fonctionne comme pour n'importe quel livre.
Obtenir de meilleurs résultats
- Scannez droit et bien éclairé. Le scanner de documents intégré à l'iPhone (Notes ou Fichiers) produit une excellente source.
- Préférez 300 dpi quand vous avez le choix. Les petits caractères des scans basse résolution concentrent les erreurs d'OCR.
- Corrigez les noms une fois. Si un nom récurrent est mal lu ou mal prononcé, ajoutez une règle de prononciation et elle s'applique à tout le livre.
- Combinez avec les surlignages. Marquez des passages pendant l'écoute et exportez-les en Markdown vers vos notes.
Pour les PDF classiques, avec du texte, voyez comment transformer n'importe quel PDF en livre audio. Prêt à essayer sur cette pile de scans ? Téléchargez VocaRead — 90 minutes d'écoute gratuite par document.