Salt la conținut

Copiază text dintr-un PDF neselectabil pe Mac

De Eduard Bruch, dezvoltatorul Optic · Actualizat

Un PDF în care nu poți selecta text este de obicei o scanare: fiecare pagină este o imagine cu text, nu text propriu-zis. Ca să copiezi din el pe un Mac, încearcă să selectezi textul în Previzualizare (Live Text îl poate recunoaște) sau folosește o aplicație OCR de ecran ca să citești de pe ecran partea de pagină de care ai nevoie.

Răspuns scurt: Previzualizare cu Live Text merită o încercare. Când nu preia textul, alegerea mea este Optic, o aplicație din bara de meniu care copiază textul din orice zonă pe care o tragi peste ecran (4,99 USD (achiziție unică) în Mac App Store).

Declarație: eu construiesc Optic.

De ce unele PDF-uri nu au text selectabil

Un PDF poate conține text real, imagini sau ambele. Documentele scanate, paginile fotografiate, faxurile și unele formulare exportate conțin doar imagini ale paginilor. Orice vizualizator de PDF vede același lucru: pixeli în formă de litere, fără caractere dedesubt care să poată fi selectate.

Un al doilea caz, mai rar, este un PDF al cărui autor a restricționat copierea. Aceasta este o alegere a proprietarului documentului. Asigură-te că ai dreptul să reutilizezi textul înainte să-l copiezi pe orice cale.

Încearcă mai întâi Previzualizare

Live Text funcționează acolo unde îl acceptă Apple: imaginile din Previzualizare, Fotografii, Quick Look și Safari. Nu funcționează pe ferestre arbitrare de aplicații, în apeluri video sau pe textul interfeței.

  1. Deschide PDF-ul în Previzualizare.
  2. Mărește ca textul să fie mare și clar.
  3. Ține cursorul peste un rând. Dacă devine cursor de text, trage pentru a selecta și apasă Command-C.

Dacă merge sau nu depinde de document. Dacă nu se evidențiază nimic, treci la următoarea variantă.

Copiază textul de pe ecran cu Optic

Lui Optic nu îi pasă cum a fost făcut PDF-ul. Citește ce este vizibil pe ecran într-un chenar pe care îl desenezi.

  1. Deschide PDF-ul în Previzualizare sau în orice vizualizator de PDF și mărește la o dimensiune confortabilă.
  2. Fă clic pe pictograma Optic din bara de meniu.
  3. Alege Captură text și trage un chenar peste paragraful de care ai nevoie.
  4. Lipește cu Command-V.

Recunoașterea rulează pe Mac-ul tău cu framework-ul Vision de la Apple, la setarea lui precisă, deci documentul nu părăsește niciodată calculatorul. Textul mai mare și mai clar pe ecran dă rezultate mai bune, așa că mărirea înainte de captură ajută la textul mărunt și la scanările șterse.

Paragrafe mai curate

Paginile scanate frâng adesea rândurile în mijlocul propozițiilor. În Setări, setează întreruperile de rând la Îmbinare inteligentă ca să unești rândurile frânte păstrând sfârșiturile de propoziție sau la Elimină ca să obții un singur rând lung. Elimină spațiile este activat implicit.

Lucrul pe mai multe pagini

Optic captează o zonă pe rând. Pentru câteva paragrafe de pe mai multe pagini, derulează, captează, lipește și repetă. Istoricul din bara de meniu păstrează ultimele tale 20 de capturi, dacă vrei să le lipești mai târziu într-o altă ordine.

Limbi amestecate

Scanările în alte limbi funcționează atât timp cât limba este una dintre cele 21 pe care le recunoaște Optic, precum germana, franceza, spaniola, poloneza sau japoneza. Fiecare limbă poate fi activată sau dezactivată în Setări.

Extrage textul dintr-un PDF întreg pe Mac

Dacă ai nevoie de tot textul unui PDF, nu doar de un pasaj, calea depinde de fișier. Un PDF cu strat de text: deschide-l în Previzualizare, apasă Command-A, apoi Command-C și lipește. Un PDF scanat, fără strat de text, are nevoie de o aplicație OCR pentru documente care deschide fișiere și creează un PDF cu text căutabil. Optic este altă treabă: copiază pasajul pe care îl vezi, pagină cu pagină, și nu procesează întregul fișier.

Unde nu se potrivește Optic

Lămurește-ți treaba înainte să cumperi ceva:

  • Nu deschide fișierul PDF. Pagina trebuie să fie vizibilă pe ecran.
  • Nu face OCR pe un document întreg. Nu există mod pentru documente întregi, nu procesează foldere și nu produce PDF-uri cu text căutabil. Dacă ai nevoie ca o carte scanată întreagă să devină un fișier cu text căutabil, folosește software dedicat de OCR pentru PDF.
  • Fără extragere de tabele. Tabelele ies ca linii de text.
  • Scrisul de mână nu este o funcție promisă. Este făcut pentru text tipărit.
  • Fără traducere.

Optic se potrivește cazului obișnuit: ai nevoie acum de o propoziție, un paragraf, un număr de cont sau o referință dintr-o scanare. Pentru alt text de pe ecran, vezi copiază text de oriunde de pe ecranul Mac-ului și ce nu poate face recunoașterea textului din Previzualizare. Pentru scanări în alte limbi, vezi OCR pentru text în limbi străine pe Mac; ca să asculți un pasaj captat, vezi citește text cu voce tare de pe ecran pe Mac.

Întrebări frecvente

De ce nu pot evidenția text într-un PDF pe Mac?

Cel mai probabil PDF-ul conține imagini scanate ale paginilor, nu text. Încearcă Live Text în Previzualizare sau un instrument OCR de ecran.

Cum copiez text dintr-un PDF scanat pe Mac?

Deschide-l în Previzualizare și încearcă să selectezi textul. Dacă nu merge, trage un chenar peste text cu o aplicație OCR de ecran precum Optic și lipește.

Cum extrag text dintr-un PDF pe Mac?

Dacă textul se selectează în Previzualizare, apasă Command-A și Command-C. Dacă este o scanare, copiază pasajele de care ai nevoie cu o aplicație OCR de ecran (alegerea mea este Optic) sau folosește o aplicație OCR pentru documente pentru tot fișierul. Mai multe: cele mai bune aplicații OCR de ecran pentru Mac.

Poate Optic să-mi facă PDF-ul căutabil?

Nu. Optic copiază în clipboard textul din zona pe care o selectezi. Nu modifică și nu creează fișiere PDF.

Este PDF-ul încărcat undeva?

Nu cu Optic. Recunoașterea se face pe Mac-ul tău, iar aplicația nu are acces la rețea.

Descarcă Optic din Mac App Store · Toate faptele despre Optic