PDF OCR – muunna skannattu PDF haettavaksi PDF:ksi
Mitä PDF OCR tarkoittaa, ja miten skannatusta PDF:stä tehdään haettava?
PDF OCR eli PDF:n tekstintunnistus tarkoittaa, että jokainen sivukuva ajetaan OCR:n (optinen merkintunnistus) läpi, jolloin sanoista tulee merkkejä, joita voi hakea, valita ja kopioida. Skannaus on pelkkä kuva sivusta: Ctrl+F ei löydä mitään, eikä yhtäkään riviä voi kopioida. Linnkin OCR-työkalu lukee jokaisen sivun tekoälymalleilla (Linnk käyttää ChatGPT-, Claude- ja Gemini-malleja), rakentaa sivun uudelleen jäsennellyksi tekstiksi ja kirjoittaa uuden, tekstipohjaisen PDF:n. Valokuvat, logot, leimat ja allekirjoitukset rajataan skannauksesta ja sijoitetaan takaisin paikoilleen. Selvyyden vuoksi: kyse ei ole näkymättömästä tekstikerroksesta alkuperäisen kuvan päällä. PDF rakennetaan uudelleen, joten se näyttää lähes alkuperäiseltä mutta ei pikselilleen samalta. Haalistuneessa, tahraisessa tai vinossa skannauksessa lopputulos on usein parempi, koska teksti tulee puhtaana ja suorana eikä peri epätarkkuutta. Numerot, päivämäärät ja tunnisteet kopioidaan numero numerolta, ja kohdat, joita OCR ei pysty lukemaan, merkitään arvaamisen sijaan. Haaleat tai käpristyneet sivut kannattaa silti vilkaista nopeasti läpi.
Last updated: syyskuu 2026
Näin skannatusta PDF:stä tulee haettava
Kolme vaihetta sivukuvasta PDF:ään, jossa on oikeaa tekstiä.
Lataa skannaus
Pudota skannattu PDF tai sivusta otettu JPG-, PNG-, WEBP-, HEIC- tai HEIF-kuva; valokuva lasketaan yhden sivun skannaukseksi. Haettava PDF on valmiiksi valittuna, ja teksti säilyy alkuperäisellä kielellään.
Anna OCR:n lukea jokainen sivu
Tekoälymallit lukevat jokaisen sivukuvan ja rakentavat sen uudelleen tekstiksi, yleensä alle minuutissa sivua kohden. Työn aikana sivulla näkyy arvio minuutteina, ja ensimmäisiä sivuja voi esikatsella maksutta ilman tiliä.
Lataa haettava PDF
Luo ilmainen tili, niin voit ladata haettavan PDF:n. Markdown, pelkkä teksti ja asettelutaulukko syntyvät samasta muunnoksesta, ja Word-tiedoston voi pyytää erikseen muutaman lisäminuutin odotuksella.
PDF:n tekstintunnistus – mitä työkalu tekee
Tehty skannauksille, fakseille ja puhelinkuville, joissa tekstiä ei alun perin ole.
Oikeaa tekstiä, ei kuvaa tekstistä
Jokainen uuden PDF:n sana on todellinen merkki. Ctrl+F löytää sen, voit valita ja kopioida kappaleen, ja asiakirjahaku pystyy indeksoimaan tiedoston.
Kuvat, leimat ja allekirjoitukset paikoillaan
Sivun kuvat rajataan skannauksesta ja sijoitetaan takaisin paikoilleen, joten allekirjoitetussa sopimuksessa näkyy yleensä yhä allekirjoitus ja todistuksessa sinetti.
Puhdasta tekstiä kuluneista skannauksista
Koska sivu rakennetaan uudelleen eikä sitä vain jäljennetä, vino, haalea tai kahvitahrainen skannaus muuttuu tyypillisesti suoraksi, luettavaksi tekstiksi. Hyvin sumeat sivut voivat silti vaatia nopean tarkistuksen.
Numerot kopioidaan numero numerolta
Summat, päivämäärät, tunnisteet ja viitenumerot kopioidaan numero numerolta. Numero, josta OCR ei saa selvää, merkitään kysymysmerkillä, ja lukukelvoton kohta merkitään [illegible], joten mitään ei arvata huomaamatta.
Lisää muotoja samasta muunnoksesta
Yksi muunnos antaa myös Markdownin, pelkän tekstin ja asettelutaulukon, jossa on oma välilehti jokaiselle sivulle. Tarvitsetko Wordin? Se rakennetaan pyynnöstä ja vie yleensä muutaman minuutin.
Säilytä kieli tai käännä
Tuloste säilyttää oletuksena asiakirjan alkuperäisen kielen. Valitse Säilytä alkuperäinen -kohdan sijaan Käännä kielelle…, niin haettava PDF valmistuu toisella kielellä samassa muunnoksessa.
PDF OCR lyhyesti
Mitä voit odottaa ennen kuin lataat skannauksen.
Syöte
- Skannattu PDF
- Luetaan sivu kerrallaan
- Puhelinkuvat
- JPG, PNG, WEBP, HEIC, HEIF
- Digitaalinen PDF
- Käy myös
- Word, PowerPoint, Excel
- Eivät käy tässä
Tuloste
- Haettava PDF
- Rakennettu uudelleen oikeaksi tekstiksi
- Kuvat, leimat, allekirjoitukset
- Palautetaan paikoilleen
- Sama muunnos
- Markdown, teksti, asettelutaulukko
- Word-tiedosto
- Rakennetaan pyynnöstä
Tarkkuus
- Numerot ja päivämäärät
- Kopioidaan numero numerolta
- Epäselvä numero
- Merkitään kysymysmerkillä
- Lukukelvoton kohta
- Merkitään [illegible]
- Haaleat tai käpristyneet sivut
- Nopea tarkistus suositeltava
Nopeus ja käyttö
- Tyypillinen nopeus
- Yleensä alle minuutti sivulta
- Esikatselu
- Ilmainen, ilman tiliä
- Lataus
- Ilmainen tili
- Pidemmät asiakirjat
- Maksulliset tilaukset
Skannatun PDF:n OCR eri tavoin – vertailu
Miten Linnkin tapa eroaa tavallisista reiteistä haettavaan PDF:ään – myös siinä, missä muut pärjäävät paremmin.
| Feature | Linnk PDF OCR | Työpöydän PDF-ohjelmat | Ilmaiset OCR-verkkopalvelut | Skannaussovellusten OCR |
|---|---|---|---|---|
| Miten teksti päätyy PDF:ään | Sivu rakennetaan uudelleen oikeaksi tekstiksi | Yleensä piilotettu tekstikerros skannauksen alla | Yleensä piilotettu tekstikerros; vaihtelee palvelun mukaan | Tekstikerros tai erillinen tekstivienti |
| Miltä sivu näyttää jälkeenpäin | Lähellä alkuperäistä, ei pikselilleen sama | Alkuperäinen skannauskuva säilyy sellaisenaan | Alkuperäinen skannauskuva säilyy sellaisenaan | Alkuperäinen kuva säilyy, usein rajattuna ja oiottuna |
| Haalistuneet tai vinot skannaukset | Tuloksena puhdasta, suoraa tekstiä | Näkyvä sivu pysyy skannauksen kaltaisena | Näkyvä sivu pysyy skannauksen kaltaisena | Jotkin sovellukset oikaisevat kuvan |
| Lukukelvoton teksti | Merkitään [illegible] tai kysymysmerkillä | Vaihtelee | Vaihtelee | Vaihtelee |
| Muut tulosteet | Word, Markdown, pelkkä teksti, asettelutaulukko | Usein Word ja muita vientimuotoja | Vaihtelee, usein Word tai teksti | Yleensä PDF tai teksti |
| Missä se toimii | Selaimessa, ei mitään asennettavaa | Asennettava ohjelma, yleensä maksullinen | Selaimessa | Puhelinsovellus |
Vertailu syyskuulta 2026. Ominaisuudet vaihtelevat tuotteen ja tilauksen mukaan; taulukko kuvaa kunkin ryhmän tyypillistä toimintaa.
Kuka tekee skannatuista PDF:istä haettavia?
Jokainen, jonka pitää löytää jotain asiakirjasta, joka on skannattu eikä kirjoitettu.
Juristit ja lakiassistentit
Käsittele skannatut sopimukset, oikeudenkäyntiasiakirjat ja todisteaineistot OCR:llä, niin lauseke, päivämäärä tai osapuolen nimi löytyy haulla eikä sivu sivulta lukemalla.
Toimisto- ja arkistotiimit
Muuta kansiollinen skannattuja kirjeitä, laskuja ja lomakkeita haettaviksi PDF:iksi, joista jaettu levy tai asiakirjajärjestelmä todella löytää etsimäsi.
Tutkijat ja opiskelijat
Kopioi lainauksia skannatuista kirjan luvuista, arkistoasiakirjoista ja vanhoista opinnäytteistä kirjoittamatta niitä uudelleen, ja sivun kuvat pysyvät paikoillaan.
Kirjanpitäjät ja tilitoimistot
Hae skannatuista tiliotteista ja kuiteista summaa tai viitenumeroa; luvut kopioidaan sivulta numero numerolta.
HR ja hallinto
Säilytä allekirjoitetut työtarjoukset ja perehdytyslomakkeet haettavina PDF:inä, ja allekirjoitukset näkyvät yhä sivulla.
Kaikki, jotka skannaavat puhelimella
Ota puhelimella kuva kirjeestä, ilmoituksesta tai lomakkeesta ja saat takaisin PDF:n, josta voi hakea ja kopioida tekstiä – et pelkkää valokuvaa.
Kysymyksiä PDF OCR:stä
Mitä PDF OCR tarkoittaa?
Miten PDF:stä tehdään haettava?
Mitä valokuville, logoille, leimoille ja allekirjoituksille tapahtuu?
Voinko tehdä PDF:lle OCR:n verkossa asentamatta mitään?
Kuinka tarkka tekstintunnistus on skannatussa PDF:ssä?
Millaisia tiedostoja voin ladata?
Mitä kieliä OCR osaa lukea?
Voinko saada Wordin, Markdownin tai pelkän tekstin sen sijaan?
Kauanko skannatun PDF:n OCR kestää?
Onko palvelu ilmainen, ja onko pituudelle rajaa?
Pysyvätkö tiedostoni yksityisinä?
Tee skannatusta PDF:stäsi haettava ja kopioitava
Pudota skannaus tai puhelinkuva ja esikatsele haettavaa PDF:ää ennen rekisteröitymistä.