Kopírování textu z nevybratelného PDF na Macu
Autor: Eduard Bruch, vývojář aplikace Optic · Aktualizováno
PDF, ve kterém nejde vybrat text, je obvykle sken: každá stránka je obrázek textu, ne text samotný. Chcete-li z něj na Macu kopírovat, zkuste vybrat text v Náhledu (Živý text ho může rozpoznat), nebo použijte aplikaci pro OCR obrazovky a přečtěte potřebnou část stránky z obrazovky.
Stručně: Náhled se Živým textem stojí za jeden pokus. Když text nezachytí, moje volba je Optic, aplikace v liště nabídek, která zkopíruje text z libovolné oblasti přetažené přes obrazovku (4,99 USD (jednorázový nákup) v Mac App Storu).
Upozornění: Optic vyvíjím já.
Proč některá PDF nemají vybratelný text
PDF může obsahovat skutečný text, obrázky, nebo obojí. Naskenované dokumenty, fotografované stránky, faxy a některé exportované formuláře obsahují jen obrázky stránek. Každý prohlížeč PDF vidí totéž: pixely ve tvaru písmen, pod kterými nejsou žádné znaky k výběru.
Druhým, vzácnějším případem je PDF, jehož autor kopírování omezil. To je rozhodnutí vlastníka dokumentu. Než text jakoukoli cestou zkopírujete, ujistěte se, že máte právo ho znovu použít.
Nejdřív zkuste Náhled
Živý text funguje tam, kde ho Apple podporuje: u obrázků v Náhledu, ve Fotkách, v Rychlém náhledu a v Safari. Nefunguje v libovolných oknech aplikací, videohovorech ani u textu v uživatelském rozhraní.
- Otevřete PDF v Náhledu.
- Přibližte, aby byl text velký a ostrý.
- Najeďte na řádek. Pokud se kurzor změní na textový, tažením vyberte a stiskněte Command-C.
Zda to funguje, závisí na dokumentu. Pokud se nic nezvýrazní, přejděte na další možnost.
Zkopírujte text z obrazovky pomocí Opticu
Opticu nezáleží na tom, jak bylo PDF vytvořeno. Čte to, co je vidět na obrazovce uvnitř rámečku, který nakreslíte.
- Otevřete PDF v Náhledu nebo v jakémkoli prohlížeči PDF a přibližte na pohodlnou velikost.
- Klikněte na ikonu Opticu v liště nabídek.
- Zvolte Zachytit text a přetáhněte rámeček přes odstavec, který potřebujete.
- Vložte pomocí Command-V.
Rozpoznávání běží na vašem Macu s frameworkem Vision od Applu v jeho přesném nastavení, takže dokument váš počítač neopustí. Větší a ostřejší text na obrazovce dává lepší výsledky, takže přiblížení před zachycením pomáhá u drobného písma a slabých skenů.
Čistší odstavce
Naskenované stránky často lámou řádky uprostřed vět. V Nastavení nastavte konce řádků na Chytré sloučení, aby se zalomené řádky spojily a konce vět zůstaly, nebo na Odstranit pro jeden dlouhý řádek. Oříznutí bílých znaků je ve výchozím nastavení zapnuté.
Práce s více stránkami
Optic zachytává vždy jednu oblast. U několika odstavců napříč stránkami posouvejte, zachyťte, vložte a opakujte. Historie v liště nabídek uchovává vašich posledních 20 zachycení, pokud je chcete později vložit v jiném pořadí.
Smíšené jazyky
Skeny v jiných jazycích fungují, pokud je jazyk jedním z 21, které Optic rozpoznává, například němčina, francouzština, španělština, polština nebo japonština. Každý jazyk lze v Nastavení zapnout nebo vypnout.
Extrakce textu z celého PDF na Macu
Pokud potřebujete veškerý text PDF, ne jen pasáž, cesta závisí na souboru. PDF s textovou vrstvou: otevřete ho v Náhledu, stiskněte Command-A, pak Command-C a vložte. Naskenované PDF bez textové vrstvy potřebuje aplikaci pro OCR dokumentů, která otevírá soubory a vytváří vyhledávatelná PDF. Optic dělá jinou práci: kopíruje pasáž, kterou vidíte, stránku po stránce, a celý soubor nezpracovává.
Kde se Optic nehodí
Než cokoli koupíte, ujasněte si úlohu:
- Neotevírá soubor PDF. Stránka musí být vidět na obrazovce.
- Neprovádí OCR celého dokumentu. Neexistuje režim celého dokumentu, zpracování složek ani výstup vyhledávatelného PDF. Pokud potřebujete celou naskenovanou knihu proměnit ve vyhledávatelný soubor, použijte specializovaný software pro OCR PDF.
- Žádná extrakce tabulek. Tabulky vyjdou jako řádky textu.
- Rukopis není slibovaná funkce. Je určen pro tištěný text.
- Žádný překlad.
Optic se hodí pro běžný případ: potřebujete větu, odstavec, číslo účtu nebo odkaz ze skenu, hned teď. Pro další text na obrazovce viz kopírování textu odkudkoli na obrazovce Macu a co rozpoznávání textu v Náhledu neumí. Pro skeny v jiných jazycích viz OCR cizojazyčného textu na Macu; k poslechu zachycené pasáže viz čtení textu nahlas z obrazovky na Macu.
Časté otázky
Proč na Macu nemohu zvýraznit text v PDF?
PDF s největší pravděpodobností obsahuje naskenované obrázky stránek místo textu. Zkuste Živý text v Náhledu nebo nástroj pro OCR obrazovky.
Jak na Macu zkopíruji text z naskenovaného PDF?
Otevřete ho v Náhledu a zkuste vybrat text. Pokud to selže, přetáhněte rámeček přes text aplikací pro OCR obrazovky, jako je Optic, a vložte.
Jak na Macu extrahuji text z PDF?
Pokud se text v Náhledu vybere, stiskněte Command-A a Command-C. Pokud jde o sken, zkopírujte potřebné pasáže aplikací pro OCR obrazovky (moje volba je Optic), nebo pro celý soubor použijte aplikaci pro OCR dokumentů. Více: nejlepší aplikace pro OCR obrazovky na Macu.
Může Optic udělat moje PDF vyhledávatelným?
Ne. Optic kopíruje text z vybrané oblasti do schránky. PDF soubory nemění ani nevytváří.
Nahrává se PDF někam?
S Opticem ne. Rozpoznávání probíhá na vašem Macu a aplikace nemá přístup k síti.