MammothPDF
Eszközök

PDF → szöveg

Válaszd ki az oldalakat, és a szöveg .txt fájlként jön ki: bekezdésekben, amelyek egy szerkesztőben újratördelődnek, vagy soronként, ahogy az oldalon áll. Az OCR-en átfuttatott szkenn ugyanúgy kinyerhető; amelyik nem járt ott, annak nincs szövege. Minden a böngésződben fut - a fájl nem hagyja el az eszközödet.

Húzd ide a PDF fájlokat

Húzd be közvetlenül az asztalodról

vagy
  • Csak PDF fájlok
  • Fájlonként max. 15 MB
  • 2 fájl egy menetben - Pro-val korlátlan

A szöveg olvasási sorrendben jön ki, ahogy egy kereső látja - OCR-ezett szkennből is.

Gyakori kérdések

Mi lesz az eredmény?

PDF-enként egy sima .txt fájl a kijelölt oldalak szövegével olvasási sorrendben - bekezdésekben, amelyek egy szerkesztőben újratördelődnek, vagy soronként, ahogy az oldalon áll -, az oldalak között választhatóan oldalcímmel vagy üres sorral. Minden a böngésződben fut; a fájl soha nem kerül feltöltésre.

Szkennelt PDF-fel is működik?

Csak ha a szkennek van szövegrétege. Az OCR eszközön átfuttatott szkenn ugyanúgy kinyerhető, mint bármely fájl - a láthatatlan szöveget olvassuk. Amelyiknek nincs, annak nincs szövege; a fájllista jelzi, és az OCR-re mutat.

Miért furcsa sorrendben jön néhány sor?

A szöveget soronként olvassuk, fentről lefelé, aszerint, hol áll a sor az oldalon. A hasábos vagy dobozos elrendezés összefésülődhet; válts a Sorok elrendezésre, hogy minden sort úgy láss, ahogy van, vagy szűkítsd az oldalakat.

Mi lesz a táblázatokkal, űrlapokkal?

Válaszd a Sorok elrendezést: minden sor a saját sorában marad, szóközzel ott, ahol az oldalon hézag van, így a táblázat sorai sorok maradnak. A Bekezdések mód folyószöveghez való - egy blokk sorait összefűzi, az elválasztásokat összeforrasztja.

Hiányzik valami, vagy meglepett az eredmény?