Szöveg kinyerése PDF-ből, akár szkennelt fájlból is
Hogyan alakítható szöveggé egy PDF, akár szkennelt is?
A szöveg kinyerése PDF-ből azt jelenti, hogy az eszköz hozzáfér az egyes oldalak szavaihoz. Digitális PDF esetén ez egyszerű, mert a szavak szövegrétegként a fájlban vannak. A szkennelt PDF-ben viszont egyáltalán nincs szövegréteg: minden oldal egy szövegről készült kép, ezért sok átalakító üres fájlt ad vissza a szkennelt dokumentumokra. A Linnk mesterséges intelligenciára épülő PDF szövegkinyerője nem erre a rétegre támaszkodik. MI-modellek (a Linnk ChatGPT-, Claude- és Gemini-modelleket használ) olvassák be az egyes oldalak képét, strukturált szöveggé építik újra, majd egyszerű szövegként, olvasási sorrendben írják ki, így egy kéthasábos oldalt általában először az egyik hasábon lefelé, majd a következőn olvas végig. A fénymásolóval szkennelt iratok, faxolt űrlapok, archív jelentések és alkalmazásból exportált PDF-ek ugyanígy kerülnek feldolgozásra. A számokat, dátumokat, azonosítókat és összegeket számjegyről számjegyre másolja; az olvashatatlan számjegyet kérdőjellel, az olvashatatlan szövegrészt pedig [illegible] jelöléssel látja el ahelyett, hogy találgatna. Ugyanabból a futtatásból Markdown és kereshető PDF is készül, kérésre pedig Word-fájl is. A felismert szöveg másolása mindig ingyenes. Tiszta, egyenes, jól megvilágított szkennelés adja általában a legjobb eredményt; a halvány vagy elmosódott oldalakat érdemes gyorsan ellenőrizni.
Last updated: 2026. október
PDF szöveggé alakítása három lépésben
Így jut el a PDF-től a szövegig, akár szkennelt, faxolt vagy alkalmazásból exportált a fájl.
Töltse fel a PDF-et
Húzzon egy szkennelt vagy digitális PDF-et a fenti mezőbe. Az Egyszerű szöveg formátum már ki van választva, a kimeneti nyelv pedig Eredeti megtartása. Egy oldalról készült JPG, PNG, WEBP vagy HEIC fotó is megfelel; ezt egyoldalas szkennelésként olvassa be.
A Linnk minden oldalt beolvas
MI-modellek olvassák be az egyes oldalak képét, és olvasási sorrendben építik újra a szöveget. Ez általában oldalanként kevesebb mint egy perc, egy átlagos szkennelésnél gyakran fél perc körül, és az oldal munka közben becsült időt mutat.
Másolja ki a szöveget, vagy töltse le a TXT-fájlt
A felismert szöveget ingyen kimásolhatja, a .txt fájl letöltéséhez pedig jelentkezzen be ingyenes fiókkal. A Markdown és a kereshető PDF ugyanabból a futtatásból készül, Word-fájl pedig kérésre, néhány további perc alatt állítható elő.
Mit tud ez a PDF szövegkinyerő?
Azokhoz a PDF-ekhez készült, amelyeken a hagyományos szövegkinyerők elakadnak: szkennelt iratokhoz, faxokhoz és többhasábos oldalakhoz.
Szöveg kinyerése PDF-ből, szkennelt fájlból is
Sok PDF–szöveg átalakító csak a fájlban tárolt szövegréteget másolja ki, így a szövegréteg nélküli szkennelt dokumentum üresen jön vissza. A Linnk ehelyett minden oldal képét beolvassa, így egy fénymásolóval szkennelt irat, egy fax vagy egy telefonos szkennelőalkalmazással készült PDF is másolható, kereshető szöveget ad.
Szöveg olvasási sorrendben
A kimenet azt a sorrendet követi, ahogyan Ön az oldalt olvasná, nem azt, ahogyan a szöveg a fájlban éppen tárolódik. Egy kéthasábos cikk általában az első hasábon lefelé, majd a másodikon halad, ahelyett hogy a sorokat a hasábköz fölött fűzné össze.
Számjegyek másolva, hiányok jelölve
Számlavégösszegek, ügyszámok, dátumok és azonosítók számjegyről számjegyre kerülnek át. Az olvashatatlan számjegyből kérdőjel lesz, az olvashatatlan szövegrész [illegible] jelölést kap, így pontosan tudja, mely helyeket kell a szkennelt eredetivel összevetni.
Eredeti nyelv vagy fordítás
Tartsa meg az eredeti nyelvet, vagy fordítsa le a szöveget egy másik nyelvre ugyanabban a futtatásban. Alapértelmezés szerint egy magyar nyelvű levél magyarul marad, egy japán jelentés pedig japánul, beleértve a jobbról balra írt nyelveket, valamint a kínait, a japánt és a koreait is.
Három további formátum egy feltöltésből
Ugyanabból az átalakításból Markdownt is kap, megtartott címsorokkal, listákkal és táblázatokkal, valamint valódi szövegként újraépített, kereshető PDF-et, amelyben a fotók és bélyegzők visszakerülnek a helyükre. Word-fájl kérésre készül, általában néhány további perc alatt.
A szöveg másolása ingyenes
Ha csak egy bekezdésre van szüksége egy e-mailhez vagy egy idézetre a szakdolgozatához, másolja ki az eredményből. Ez mindig ingyenes. A .txt fájl és a többi formátum letöltéséhez ingyenes fiók szükséges.
PDF átalakítása szöveggé – tudnivalók
Amit érdemes tudni, mielőtt egy PDF-et szöveggé alakít.
Bemenet
- Szkennelt PDF-ek
- Oldalanként beolvasva
- Digitális PDF-ek
- Ugyanígy beolvasva
- Oldalakról készült fotók
- JPG, PNG, WEBP, HEIC, HEIF
- Word, PowerPoint, Excel
- Nem támogatott; ezekben már van szöveg
Kimenet
- Egyszerű szöveg
- Olvasási sorrendben
- Markdown és kereshető PDF
- Ugyanabból a futtatásból
- Word (DOCX)
- Kérésre készül
- Szokásos sebesség
- Általában kevesebb mint egy perc oldalanként
Pontosság
- Számok, dátumok és azonosítók
- Számjegyről számjegyre másolva
- Olvashatatlan számjegyek vagy részek
- ? vagy [illegible] jelöléssel, találgatás nélkül
- Írásrendszerek
- A legelterjedtebbek, köztük arab, héber, kínai, japán és koreai
- Legjobb eredmény
- Tiszta, egyenes, jól megvilágított szkennelésből
Hozzáférés
- Előnézet
- Ingyenes, fiók nélkül
- Szöveg másolása
- Mindig ingyenes
- Letöltés
- Ingyenes fiókkal
- Hosszabb dokumentumok
- Előfizetéssel, lásd linnk.ai/pricing
Szöveg kinyerése PDF-ből: a lehetőségek összehasonlítása
Így viszonyul a Linnk a szavak PDF-ből való kinyerésének szokásos módjaihoz.
| Feature | Linnk PDF szövegkinyerő | Másolás és beillesztés PDF-olvasóból | Online PDF–TXT átalakítók | Asztali PDF-szerkesztők OCR-rel |
|---|---|---|---|---|
| Szkennelt PDF szövegréteg nélkül | Beolvassa az oldalképeket, és szöveget ad | Nincs mit kijelölni | Gyakran üres vagy majdnem üres fájl | OCR-lépés után működik |
| Tiszta digitális PDF | Ugyanúgy olvassa, mint a szkennelt fájlt | Működik, oldalanként | Gyors és általában pontos | Exportálás szövegként |
| Kéthasábos oldalak | Szöveg olvasási sorrendben | A sorok átnyúlhatnak a hasábokon | Változó | Változó |
| Olvashatatlan számjegyek | Kérdőjellel jelölve | Azt másolja, ami a fájlban van | A szövegréteget változatlanul másolja | Alkalmazásonként eltér |
| Kimeneti nyelv | Megmarad, vagy ugyanabban a futtatásban lefordítható | Megmarad | Megmarad | Megmarad |
| További formátumok ugyanabból a feltöltésből | Markdown, kereshető PDF, Word kérésre | Nincs | Oldalanként eltér | Word, PDF és más, az alkalmazástól függően |
| Költség | Ingyenes előnézet és szövegmásolás; letöltés ingyenes fiókkal | Ingyenes | Gyakran ingyenes | Gyakran fizetős licenc |
Az összehasonlítás a 2026. szeptemberi állapotot tükrözi. Más eszközök eltérnek és gyakran változnak; ellenőrizze mindegyik aktuális funkcióit.
Kik használják a PDF szövegkinyerőt?
Akiknek a PDF-ben lévő szavakra van szükségük, nem magára a PDF-re.
Egyetemi hallgatók és kutatók
Idézeteket és részleteket emelhet át szkennelt folyóiratcikkekből, könyvfejezetekből és archív jelentésekből a jegyzeteibe anélkül, hogy újragépelné őket.
Jogi asszisztensek és ügyvédjelöltek
Egy szkennelt szerződést vagy bírósági beadványt egyszerű szöveggé alakíthat, így a pontok kereshetők és beilleszthetők egy tervezetbe, majd az aláírt eredetivel összevethetők.
Fejlesztők és adatcsapatok
Szkennelt és digitális PDF-ek szövegét táplálhatja be keresőindexekbe, szkriptekbe vagy nyelvi modellekbe. Az olvashatatlan részek jelölve vannak, így könnyen kiszűrhetők vagy ellenőrzésre küldhetők.
Irodai és adminisztratív munkatársak
A faxolt űrlapok, levelek és beszállítói dokumentumok szövegét kiemelheti, és beillesztheti egy e-mailbe, egy hibajegybe vagy egy adatbázismezőbe.
Levéltárosok és családfakutatók
Gépelt iratokat, régi hírleveleket és nyomtatott jelentéseket írhat át kereshető szöveggé, miközben a szkennelt képek maradnak a referenciapéldány.
Több nyelven dolgozó csapatok
Arab, héber, kínai, japán vagy koreai PDF-ek szövegét a saját írásrendszerében kapja meg, iktatásra, keresésre vagy fordítónak való átadásra készen.
Gyakori kérdések a PDF szöveggé alakításáról
Hogyan alakíthatok egy PDF-et szöveggé?
Miért ad üres fájlt a PDF–szöveg átalakítóm?
Honnan tudhatom, hogy a PDF-em szkennelt-e?
Mennyire pontos a szöveg kinyerése szkennelt PDF-ből?
Egyszerű szöveget vagy Markdownt válasszak?
Milyen fájlokat tölthetek fel?
Milyen nyelveket ismer fel, és lefordítja-e a szöveget?
Mennyi ideig tart?
Ingyenes ez a PDF szövegkinyerő?
Hosszú PDF-et is szöveggé alakíthatok?
Miért a Linnk, és nem egy ingyenes PDF–TXT oldal?
Megőrzik a PDF-jeimet az átalakítás után?
Nyerje ki a szöveget a PDF-jéből
Húzzon ide egy szkennelt vagy digitális PDF-et, ellenőrizze a szöveget, és másolja ki ingyen.