모든 PDF에 텍스트가 있는 건 아닙니다
Word에서 내보낸 PDF에는 텍스트가 있습니다. 스캐너로 만든 PDF에는 텍스트의 이미지가 있습니다. 기본적인 읽기 앱에게 후자는 침묵입니다. 읽을 것이 없으니까요. 오래된 강의 자료, 보관된 보고서, 도서관 스캔본, 촬영한 계약서. 사람들이 정말로 읽어야 하는 PDF의 상당수가 이 범주에 속합니다.
OCR, 기기 안에서
VocaRead는 Apple Vision OCR을 기기에서 실행해 스캔된 페이지를 인식합니다. 페이지는 iPhone을 떠나지 않습니다. 업로드도, 클라우드 서비스도, 계정도 없습니다. 업무 문서라면 중요한 부분이고, 비행기 모드에서도 OCR이 동작한다는 뜻이기도 합니다. 인식은 가져오는 동안 페이지 단위로 진행되며, 결과물은 음성을 따라 강조되는 평범한 책이 되어 서재에 들어갑니다.
2.6과 3.0에서 좋아진 점
PDF를 잘 읽어 준다는 것은 대부분 읽지 말아야 할 것을 읽지 않는 데 달려 있습니다. 최근 버전에서 추출이 훨씬 똑똑해졌습니다.
- 복잡한 레이아웃. 2단 논문은 단 사이를 가로질러 줄 단위로 읽지 않고 단별로 읽습니다.
- 머리글, 바닥글, 페이지 번호를 감지해 건너뛰므로 매 페이지마다 읽어 주지 않습니다.
- 챕터 감지가 PDF의 제목을 찾아 챕터 목록으로 만들어 EPUB처럼 챕터 단위로 이동할 수 있습니다. 제목처럼 보일 뿐인 본문은 잃지 않습니다.
- 하이픈 분리와 합자를 음성 합성 전에 복원합니다. "under-standing"은 "understanding"으로, "fi"는 "fi"로.
- 서론과 프롤로그를 감지하므로 재생이 진짜 시작 지점에서 시작됩니다.
스캔본 가져오는 방법
- 서재에서 +를 탭하고 파일 앱에서 PDF를 선택하거나, Mail·Safari·스캔 앱에서 공유 › VocaRead를 사용하세요.
- VocaRead가 페이지가 이미지임을 감지하고 OCR을 실행합니다. 진행 표시기가 인식 중인 페이지를 보여 주며, 300쪽 스캔본은 최신 iPhone에서 몇 분 정도 걸립니다.
- 음성을 고르고 재생을 누르세요. 속도, 수면 타이머, 책갈피 등 나머지는 다른 책과 똑같이 동작합니다.
더 나은 결과를 얻으려면
- 반듯하고 밝게 스캔하세요. iPhone에 내장된 문서 스캐너(메모 또는 파일 앱)가 훌륭한 입력을 만들어 줍니다.
- 가능하면 300dpi를 선택하세요. 저해상도 스캔의 작은 글씨에 OCR 오류가 몰립니다.
- 이름은 한 번만 고치세요. 반복되는 이름이 잘못 읽히거나 발음되면 발음 규칙을 추가하세요. 책 전체에 적용됩니다.
- 하이라이트와 함께 쓰세요. 들으면서 구절을 표시하고 Markdown으로 내보내 메모에 넣으세요.
일반 텍스트 기반 PDF라면 PDF를 오디오북으로 만드는 방법을 참고하세요. 쌓여 있는 스캔본으로 시험해 볼 준비가 되셨나요? VocaRead를 다운로드하세요. 문서마다 90분 무료입니다.