Nem todos os PDF contêm texto
Um PDF exportado do Word contém texto. Um PDF feito por um scanner contém imagens de texto. Para uma app de leitura básica, o segundo é mudo — não há nada para ler. Sebentas antigas, relatórios arquivados, digitalizações de biblioteca, contratos fotografados: uma enorme fatia dos PDF que as pessoas precisam mesmo de ler cai nesta categoria.
OCR, localmente
O VocaRead reconhece páginas digitalizadas com OCR do Apple Vision, no seu dispositivo. As páginas nunca saem do seu iPhone: sem envio, sem serviço na nuvem, sem conta. Isso importa num documento de trabalho, e significa que o OCR também funciona em modo de voo. O reconhecimento corre durante a importação, página a página, e o resultado é um livro normal na sua biblioteca, com o realce a seguir a voz.
O que melhorou na 2.6 e na 3.0
Ler bem um PDF em voz alta é sobretudo não ler o que não deve. As versões recentes tornaram a extração muito mais inteligente:
- Layouts complexos. Os artigos a duas colunas são lidos coluna a coluna, não linha a linha atravessando o espaço entre elas.
- Cabeçalhos, rodapés e números de página são detetados e ignorados em vez de lidos em cada página.
- A deteção de capítulos encontra os títulos no PDF e transforma-os numa lista de capítulos, para navegar por capítulo como num EPUB — sem perder prosa que apenas parece um título.
- Hifenização e ligaturas são reparadas antes da fala: "compre-ensão" volta a ser "compreensão", "fi" volta a ser "fi".
- Introduções e prólogos são agora detetados, por isso a reprodução começa no verdadeiro início.
Como importar uma digitalização
- Toque em + na biblioteca e escolha o PDF a partir de Ficheiros, ou use Partilhar › VocaRead a partir do Mail, Safari ou de uma app de digitalização.
- O VocaRead deteta que as páginas são imagens e executa o OCR. Um indicador mostra as páginas a serem reconhecidas; uma digitalização de 300 páginas demora alguns minutos num iPhone recente.
- Escolha uma voz e carregue em reproduzir. Tudo o resto — velocidade, temporizador de sono, marcadores — funciona como com qualquer livro.
Obter melhores resultados
- Digitalize direito e com boa luz. O scanner de documentos integrado do iPhone (Notas ou Ficheiros) produz uma entrada excelente.
- Prefira 300 dpi quando puder escolher. O texto minúsculo das digitalizações de baixa resolução é onde os erros de OCR se concentram.
- Corrija os nomes uma vez. Se um nome recorrente é mal lido ou mal pronunciado, adicione uma regra de pronúncia e ela aplica-se a todo o livro.
- Combine com realces. Marque passagens enquanto ouve e exporte-as em Markdown para as suas notas.
Para PDF normais, com texto, veja como transformar qualquer PDF num audiolivro. Pronto para experimentar nessa pilha de digitalizações? Descarregue o VocaRead — 90 minutos de escuta grátis por documento.