Szöveg kinyerése PDF-ből, akár szkennelt fájlból is

Olyan eszközt keres, amellyel a szöveg kinyerése PDF-ből akkor is működik, ha a fájl szkennelt? Sok eszköz csak a PDF-ben tárolt szövegréteget másolja ki, így egy szkennelt dokumentumból üres fájl lesz. A Linnk ehelyett minden oldal képét beolvassa, és olvasási sorrendben adja vissza a szöveget, beillesztésre vagy .txt fájlként való mentésre készen. A felismert szöveg másolása mindig ingyenes.
Kimeneti formátum
Ezeket is megkapja Markdown · Word · Kereshető PDF
Kimeneti nyelv
Titkosított és privát 154 nyelv és dialektus A táblázatok táblázatok maradnak Fájlok 72 óra után törlődnek

Hogyan alakítható szöveggé egy PDF, akár szkennelt is?

A szöveg kinyerése PDF-ből azt jelenti, hogy az eszköz hozzáfér az egyes oldalak szavaihoz. Digitális PDF esetén ez egyszerű, mert a szavak szövegrétegként a fájlban vannak. A szkennelt PDF-ben viszont egyáltalán nincs szövegréteg: minden oldal egy szövegről készült kép, ezért sok átalakító üres fájlt ad vissza a szkennelt dokumentumokra. A Linnk mesterséges intelligenciára épülő PDF szövegkinyerője nem erre a rétegre támaszkodik. MI-modellek (a Linnk ChatGPT-, Claude- és Gemini-modelleket használ) olvassák be az egyes oldalak képét, strukturált szöveggé építik újra, majd egyszerű szövegként, olvasási sorrendben írják ki, így egy kéthasábos oldalt általában először az egyik hasábon lefelé, majd a következőn olvas végig. A fénymásolóval szkennelt iratok, faxolt űrlapok, archív jelentések és alkalmazásból exportált PDF-ek ugyanígy kerülnek feldolgozásra. A számokat, dátumokat, azonosítókat és összegeket számjegyről számjegyre másolja; az olvashatatlan számjegyet kérdőjellel, az olvashatatlan szövegrészt pedig [illegible] jelöléssel látja el ahelyett, hogy találgatna. Ugyanabból a futtatásból Markdown és kereshető PDF is készül, kérésre pedig Word-fájl is. A felismert szöveg másolása mindig ingyenes. Tiszta, egyenes, jól megvilágított szkennelés adja általában a legjobb eredményt; a halvány vagy elmosódott oldalakat érdemes gyorsan ellenőrizni.

Szkennelt vagy digitálismindkét PDF-típus működik
Olvasási sorrendegyszerű szöveg kimenet
Számjegyről számjegyreszámok, dátumok és azonosítók
Ingyenesa felismert szöveg másolása

Last updated: 2026. október

PDF szöveggé alakítása három lépésben

Így jut el a PDF-től a szövegig, akár szkennelt, faxolt vagy alkalmazásból exportált a fájl.

1

Töltse fel a PDF-et

Húzzon egy szkennelt vagy digitális PDF-et a fenti mezőbe. Az Egyszerű szöveg formátum már ki van választva, a kimeneti nyelv pedig Eredeti megtartása. Egy oldalról készült JPG, PNG, WEBP vagy HEIC fotó is megfelel; ezt egyoldalas szkennelésként olvassa be.

2

A Linnk minden oldalt beolvas

MI-modellek olvassák be az egyes oldalak képét, és olvasási sorrendben építik újra a szöveget. Ez általában oldalanként kevesebb mint egy perc, egy átlagos szkennelésnél gyakran fél perc körül, és az oldal munka közben becsült időt mutat.

3

Másolja ki a szöveget, vagy töltse le a TXT-fájlt

A felismert szöveget ingyen kimásolhatja, a .txt fájl letöltéséhez pedig jelentkezzen be ingyenes fiókkal. A Markdown és a kereshető PDF ugyanabból a futtatásból készül, Word-fájl pedig kérésre, néhány további perc alatt állítható elő.

Mit tud ez a PDF szövegkinyerő?

Azokhoz a PDF-ekhez készült, amelyeken a hagyományos szövegkinyerők elakadnak: szkennelt iratokhoz, faxokhoz és többhasábos oldalakhoz.

Szöveg kinyerése PDF-ből, szkennelt fájlból is

Sok PDF–szöveg átalakító csak a fájlban tárolt szövegréteget másolja ki, így a szövegréteg nélküli szkennelt dokumentum üresen jön vissza. A Linnk ehelyett minden oldal képét beolvassa, így egy fénymásolóval szkennelt irat, egy fax vagy egy telefonos szkennelőalkalmazással készült PDF is másolható, kereshető szöveget ad.

Szöveg olvasási sorrendben

A kimenet azt a sorrendet követi, ahogyan Ön az oldalt olvasná, nem azt, ahogyan a szöveg a fájlban éppen tárolódik. Egy kéthasábos cikk általában az első hasábon lefelé, majd a másodikon halad, ahelyett hogy a sorokat a hasábköz fölött fűzné össze.

Számjegyek másolva, hiányok jelölve

Számlavégösszegek, ügyszámok, dátumok és azonosítók számjegyről számjegyre kerülnek át. Az olvashatatlan számjegyből kérdőjel lesz, az olvashatatlan szövegrész [illegible] jelölést kap, így pontosan tudja, mely helyeket kell a szkennelt eredetivel összevetni.

Eredeti nyelv vagy fordítás

Tartsa meg az eredeti nyelvet, vagy fordítsa le a szöveget egy másik nyelvre ugyanabban a futtatásban. Alapértelmezés szerint egy magyar nyelvű levél magyarul marad, egy japán jelentés pedig japánul, beleértve a jobbról balra írt nyelveket, valamint a kínait, a japánt és a koreait is.

Három további formátum egy feltöltésből

Ugyanabból az átalakításból Markdownt is kap, megtartott címsorokkal, listákkal és táblázatokkal, valamint valódi szövegként újraépített, kereshető PDF-et, amelyben a fotók és bélyegzők visszakerülnek a helyükre. Word-fájl kérésre készül, általában néhány további perc alatt.

A szöveg másolása ingyenes

Ha csak egy bekezdésre van szüksége egy e-mailhez vagy egy idézetre a szakdolgozatához, másolja ki az eredményből. Ez mindig ingyenes. A .txt fájl és a többi formátum letöltéséhez ingyenes fiók szükséges.

PDF átalakítása szöveggé – tudnivalók

Amit érdemes tudni, mielőtt egy PDF-et szöveggé alakít.

Bemenet

Szkennelt PDF-ek
Oldalanként beolvasva
Digitális PDF-ek
Ugyanígy beolvasva
Oldalakról készült fotók
JPG, PNG, WEBP, HEIC, HEIF
Word, PowerPoint, Excel
Nem támogatott; ezekben már van szöveg

Kimenet

Egyszerű szöveg
Olvasási sorrendben
Markdown és kereshető PDF
Ugyanabból a futtatásból
Word (DOCX)
Kérésre készül
Szokásos sebesség
Általában kevesebb mint egy perc oldalanként

Pontosság

Számok, dátumok és azonosítók
Számjegyről számjegyre másolva
Olvashatatlan számjegyek vagy részek
? vagy [illegible] jelöléssel, találgatás nélkül
Írásrendszerek
A legelterjedtebbek, köztük arab, héber, kínai, japán és koreai
Legjobb eredmény
Tiszta, egyenes, jól megvilágított szkennelésből

Hozzáférés

Előnézet
Ingyenes, fiók nélkül
Szöveg másolása
Mindig ingyenes
Letöltés
Ingyenes fiókkal
Hosszabb dokumentumok
Előfizetéssel, lásd linnk.ai/pricing

Szöveg kinyerése PDF-ből: a lehetőségek összehasonlítása

Így viszonyul a Linnk a szavak PDF-ből való kinyerésének szokásos módjaihoz.

FeatureLinnk PDF szövegkinyerőMásolás és beillesztés PDF-olvasóbólOnline PDF–TXT átalakítókAsztali PDF-szerkesztők OCR-rel
Szkennelt PDF szövegréteg nélkülBeolvassa az oldalképeket, és szöveget adNincs mit kijelölniGyakran üres vagy majdnem üres fájlOCR-lépés után működik
Tiszta digitális PDFUgyanúgy olvassa, mint a szkennelt fájltMűködik, oldalankéntGyors és általában pontosExportálás szövegként
Kéthasábos oldalakSzöveg olvasási sorrendbenA sorok átnyúlhatnak a hasábokonVáltozóVáltozó
Olvashatatlan számjegyekKérdőjellel jelölveAzt másolja, ami a fájlban vanA szövegréteget változatlanul másoljaAlkalmazásonként eltér
Kimeneti nyelvMegmarad, vagy ugyanabban a futtatásban lefordíthatóMegmaradMegmaradMegmarad
További formátumok ugyanabból a feltöltésbőlMarkdown, kereshető PDF, Word kérésreNincsOldalanként eltérWord, PDF és más, az alkalmazástól függően
KöltségIngyenes előnézet és szövegmásolás; letöltés ingyenes fiókkalIngyenesGyakran ingyenesGyakran fizetős licenc

Az összehasonlítás a 2026. szeptemberi állapotot tükrözi. Más eszközök eltérnek és gyakran változnak; ellenőrizze mindegyik aktuális funkcióit.

Kik használják a PDF szövegkinyerőt?

Akiknek a PDF-ben lévő szavakra van szükségük, nem magára a PDF-re.

Egyetemi hallgatók és kutatók

Idézeteket és részleteket emelhet át szkennelt folyóiratcikkekből, könyvfejezetekből és archív jelentésekből a jegyzeteibe anélkül, hogy újragépelné őket.

Jogi asszisztensek és ügyvédjelöltek

Egy szkennelt szerződést vagy bírósági beadványt egyszerű szöveggé alakíthat, így a pontok kereshetők és beilleszthetők egy tervezetbe, majd az aláírt eredetivel összevethetők.

Fejlesztők és adatcsapatok

Szkennelt és digitális PDF-ek szövegét táplálhatja be keresőindexekbe, szkriptekbe vagy nyelvi modellekbe. Az olvashatatlan részek jelölve vannak, így könnyen kiszűrhetők vagy ellenőrzésre küldhetők.

Irodai és adminisztratív munkatársak

A faxolt űrlapok, levelek és beszállítói dokumentumok szövegét kiemelheti, és beillesztheti egy e-mailbe, egy hibajegybe vagy egy adatbázismezőbe.

Levéltárosok és családfakutatók

Gépelt iratokat, régi hírleveleket és nyomtatott jelentéseket írhat át kereshető szöveggé, miközben a szkennelt képek maradnak a referenciapéldány.

Több nyelven dolgozó csapatok

Arab, héber, kínai, japán vagy koreai PDF-ek szövegét a saját írásrendszerében kapja meg, iktatásra, keresésre vagy fordítónak való átadásra készen.

Gyakori kérdések a PDF szöveggé alakításáról

Hogyan alakíthatok egy PDF-et szöveggé?
Töltse fel a PDF-et, akár szkennelt, akár digitális, és hagyja kiválasztva az Egyszerű szöveg formátumot. A Linnk minden oldalt beolvas, és olvasási sorrendben adja vissza a szöveget; ingyen kimásolhatja, vagy ingyenes fiókkal letöltheti .txt fájlként. Szkennelt dokumentumnál egy egyenes, egyenletesen megvilágított másolat adja általában a legtisztább eredményt.
Miért ad üres fájlt a PDF–szöveg átalakítóm?
A PDF valószínűleg szkennelt. Sok átalakító a PDF-ben tárolt szövegréteget másolja ki, a szkennelt oldalnak viszont nincs ilyen rétege: egy szövegről készült kép. A Linnk magát az oldalképet olvassa be, így a szkennelt fájlokból is szöveget kap.
Honnan tudhatom, hogy a PDF-em szkennelt-e?
Nyissa meg, és próbáljon kijelölni egyetlen szót. Ha az egyes szavak külön kijelölhetők, a fájlban van szövegréteg. Ha semmi sem jelölődik ki, vagy az egész oldal egy blokként jelölődik ki, akkor szkennelt. Itt mindkét típus működik.
Mennyire pontos a szöveg kinyerése szkennelt PDF-ből?
Tiszta szkennelésnél általában pontos. A számokat, azonosítókat, dátumokat és összegeket számjegyről számjegyre másolja, az olvashatatlan számjegyet kérdőjellel, az olvashatatlan részt [illegible] jelöléssel látja el ahelyett, hogy találgatna. Halvány, hullámos vagy elmosódott oldalaknál gyors ellenőrzés lehet szükséges, ezért nézzen át minden jelölt részt, mielőtt támaszkodna rá.
Egyszerű szöveget vagy Markdownt válasszak?
Az egyszerű szöveg csak a szavakat adja olvasási sorrendben, ami kereséshez, beillesztéshez és szkriptekhez ideális. A Markdown ezen felül megtartja a címsorokat, listákat és táblázatokat, utóbbiakat Markdown-táblázatként. Mindkettő ugyanabból a futtatásból készül, így nem kell előre döntenie.
Milyen fájlokat tölthetek fel?
Szkennelt és digitális PDF-eket egyaránt, valamint JPG, PNG, WEBP, HEIC és HEIF képeket; minden képet egyoldalas szkennelésként olvas be. Word-, PowerPoint- és Excel-fájlokat itt nem fogad el, mert ezek már tartalmazzák a szövegüket. Ha PDF helyett fotókból indul ki, a Scanned Image to Text eszköz erre készült.
Milyen nyelveket ismer fel, és lefordítja-e a szöveget?
A legelterjedtebb nyelveket és írásrendszereket olvassa, köztük a jobbról balra írt arabot és hébert, valamint a kínait, a japánt és a koreait. A kimeneti nyelv beállítása Eredeti megtartása, így a szöveg úgy marad, ahogy írták; ha más nyelven szeretné megkapni, indítás előtt váltson a Fordítás… lehetőségre, és válassza ki a nyelvet.
Mennyi ideig tart?
Általában oldalanként kevesebb mint egy percig, egy átlagos szkennelésnél fél perc körül. Az oldal munka közben percben megadott becslést mutat. A Word-fájl néhány perccel tovább tart, mert az átalakítás után és csak kérésre készül el.
Ingyenes ez a PDF szövegkinyerő?
Az előnézet fiók nélkül ingyenes, a felismert szöveg másolása pedig mindig ingyenes. A .txt fájl és a többi formátum letöltéséhez ingyenes fiók szükséges.
Hosszú PDF-et is szöveggé alakíthatok?
Igen. A dokumentumok első oldalai ingyen alakíthatók át, a hosszabb dokumentumokat pedig az előfizetéses csomagok fedezik. Az aktuális lehetőségeket a linnk.ai/pricing oldalon találja.
Miért a Linnk, és nem egy ingyenes PDF–TXT oldal?
Tiszta digitális PDF esetén egy ingyenes PDF–TXT oldal gyakran elég. A Linnk arra az esetre való, amikor nem: szövegréteg nélküli szkennelt fájlokra, kéthasábos oldalakra, amelyek sorai összekeveredhetnek, és olyan dokumentumokra, ahol azt szeretné, hogy az olvashatatlan számokat jelölje, ne kitalálja. Ugyanabból a feltöltésből Markdownt és kereshető PDF-et is kap.
Megőrzik a PDF-jeimet az átalakítás után?
Nem sokáig. A fájlok titkosított kapcsolaton keresztül érkeznek, az átalakított fájlokat pedig 72 óra elteltével automatikusan törli a rendszer; ezt az eredményoldal is jelzi. Különösen bizalmas dokumentumok esetén bármely online eszköz használata előtt nézze meg a szervezete szabályait.

Nyerje ki a szöveget a PDF-jéből

Húzzon ide egy szkennelt vagy digitális PDF-et, ellenőrizze a szöveget, és másolja ki ingyen.