PDF OCR – muunna skannattu PDF haettavaksi PDF:ksi

Haluatko etsiä, valita ja kopioida tekstiä skannatusta PDF:stä? Lataa skannaus, niin Linnk lukee jokaisen sivun ja rakentaa sen uudelleen haettavaksi PDF:ksi, jossa on oikeaa tekstiä. Valokuvat, leimat ja allekirjoitukset palautetaan omille paikoilleen. Vanhat sopimukset, faksatut lomakkeet, arkistoraportit ja puhelimella kuvatut sivut käyvät yhtä hyvin. Samasta muunnoksesta saat myös Markdownin, pelkän tekstin ja asettelutaulukon sekä pyynnöstä Word-tiedoston.
Kohdemuoto
Saat lisäksi Word · Markdown · Pelkkä teksti · Laskentataulukko (asettelu)
Kohdekieli
Salattu ja yksityinen 154 kieltä ja murretta Taulukot säilyvät taulukkoina Tiedostot poistetaan 72 tunnin kuluttua

Mitä PDF OCR tarkoittaa, ja miten skannatusta PDF:stä tehdään haettava?

PDF OCR eli PDF:n tekstintunnistus tarkoittaa, että jokainen sivukuva ajetaan OCR:n (optinen merkintunnistus) läpi, jolloin sanoista tulee merkkejä, joita voi hakea, valita ja kopioida. Skannaus on pelkkä kuva sivusta: Ctrl+F ei löydä mitään, eikä yhtäkään riviä voi kopioida. Linnkin OCR-työkalu lukee jokaisen sivun tekoälymalleilla (Linnk käyttää ChatGPT-, Claude- ja Gemini-malleja), rakentaa sivun uudelleen jäsennellyksi tekstiksi ja kirjoittaa uuden, tekstipohjaisen PDF:n. Valokuvat, logot, leimat ja allekirjoitukset rajataan skannauksesta ja sijoitetaan takaisin paikoilleen. Selvyyden vuoksi: kyse ei ole näkymättömästä tekstikerroksesta alkuperäisen kuvan päällä. PDF rakennetaan uudelleen, joten se näyttää lähes alkuperäiseltä mutta ei pikselilleen samalta. Haalistuneessa, tahraisessa tai vinossa skannauksessa lopputulos on usein parempi, koska teksti tulee puhtaana ja suorana eikä peri epätarkkuutta. Numerot, päivämäärät ja tunnisteet kopioidaan numero numerolta, ja kohdat, joita OCR ei pysty lukemaan, merkitään arvaamisen sijaan. Haaleat tai käpristyneet sivut kannattaa silti vilkaista nopeasti läpi.

Oikeaa tekstiäjokainen sivu rakennettu uudelleen
Säilyvätvalokuvat, leimat ja allekirjoitukset
Alkuperäinenasiakirjan kieli
Ilmainenesikatselu ilman tiliä

Last updated: syyskuu 2026

Näin skannatusta PDF:stä tulee haettava

Kolme vaihetta sivukuvasta PDF:ään, jossa on oikeaa tekstiä.

1

Lataa skannaus

Pudota skannattu PDF tai sivusta otettu JPG-, PNG-, WEBP-, HEIC- tai HEIF-kuva; valokuva lasketaan yhden sivun skannaukseksi. Haettava PDF on valmiiksi valittuna, ja teksti säilyy alkuperäisellä kielellään.

2

Anna OCR:n lukea jokainen sivu

Tekoälymallit lukevat jokaisen sivukuvan ja rakentavat sen uudelleen tekstiksi, yleensä alle minuutissa sivua kohden. Työn aikana sivulla näkyy arvio minuutteina, ja ensimmäisiä sivuja voi esikatsella maksutta ilman tiliä.

3

Lataa haettava PDF

Luo ilmainen tili, niin voit ladata haettavan PDF:n. Markdown, pelkkä teksti ja asettelutaulukko syntyvät samasta muunnoksesta, ja Word-tiedoston voi pyytää erikseen muutaman lisäminuutin odotuksella.

PDF:n tekstintunnistus – mitä työkalu tekee

Tehty skannauksille, fakseille ja puhelinkuville, joissa tekstiä ei alun perin ole.

Oikeaa tekstiä, ei kuvaa tekstistä

Jokainen uuden PDF:n sana on todellinen merkki. Ctrl+F löytää sen, voit valita ja kopioida kappaleen, ja asiakirjahaku pystyy indeksoimaan tiedoston.

Kuvat, leimat ja allekirjoitukset paikoillaan

Sivun kuvat rajataan skannauksesta ja sijoitetaan takaisin paikoilleen, joten allekirjoitetussa sopimuksessa näkyy yleensä yhä allekirjoitus ja todistuksessa sinetti.

Puhdasta tekstiä kuluneista skannauksista

Koska sivu rakennetaan uudelleen eikä sitä vain jäljennetä, vino, haalea tai kahvitahrainen skannaus muuttuu tyypillisesti suoraksi, luettavaksi tekstiksi. Hyvin sumeat sivut voivat silti vaatia nopean tarkistuksen.

Numerot kopioidaan numero numerolta

Summat, päivämäärät, tunnisteet ja viitenumerot kopioidaan numero numerolta. Numero, josta OCR ei saa selvää, merkitään kysymysmerkillä, ja lukukelvoton kohta merkitään [illegible], joten mitään ei arvata huomaamatta.

Lisää muotoja samasta muunnoksesta

Yksi muunnos antaa myös Markdownin, pelkän tekstin ja asettelutaulukon, jossa on oma välilehti jokaiselle sivulle. Tarvitsetko Wordin? Se rakennetaan pyynnöstä ja vie yleensä muutaman minuutin.

Säilytä kieli tai käännä

Tuloste säilyttää oletuksena asiakirjan alkuperäisen kielen. Valitse Säilytä alkuperäinen -kohdan sijaan Käännä kielelle…, niin haettava PDF valmistuu toisella kielellä samassa muunnoksessa.

PDF OCR lyhyesti

Mitä voit odottaa ennen kuin lataat skannauksen.

Syöte

Skannattu PDF
Luetaan sivu kerrallaan
Puhelinkuvat
JPG, PNG, WEBP, HEIC, HEIF
Digitaalinen PDF
Käy myös
Word, PowerPoint, Excel
Eivät käy tässä

Tuloste

Haettava PDF
Rakennettu uudelleen oikeaksi tekstiksi
Kuvat, leimat, allekirjoitukset
Palautetaan paikoilleen
Sama muunnos
Markdown, teksti, asettelutaulukko
Word-tiedosto
Rakennetaan pyynnöstä

Tarkkuus

Numerot ja päivämäärät
Kopioidaan numero numerolta
Epäselvä numero
Merkitään kysymysmerkillä
Lukukelvoton kohta
Merkitään [illegible]
Haaleat tai käpristyneet sivut
Nopea tarkistus suositeltava

Nopeus ja käyttö

Tyypillinen nopeus
Yleensä alle minuutti sivulta
Esikatselu
Ilmainen, ilman tiliä
Lataus
Ilmainen tili
Pidemmät asiakirjat
Maksulliset tilaukset

Skannatun PDF:n OCR eri tavoin – vertailu

Miten Linnkin tapa eroaa tavallisista reiteistä haettavaan PDF:ään – myös siinä, missä muut pärjäävät paremmin.

FeatureLinnk PDF OCRTyöpöydän PDF-ohjelmatIlmaiset OCR-verkkopalvelutSkannaussovellusten OCR
Miten teksti päätyy PDF:äänSivu rakennetaan uudelleen oikeaksi tekstiksiYleensä piilotettu tekstikerros skannauksen allaYleensä piilotettu tekstikerros; vaihtelee palvelun mukaanTekstikerros tai erillinen tekstivienti
Miltä sivu näyttää jälkeenpäinLähellä alkuperäistä, ei pikselilleen samaAlkuperäinen skannauskuva säilyy sellaisenaanAlkuperäinen skannauskuva säilyy sellaisenaanAlkuperäinen kuva säilyy, usein rajattuna ja oiottuna
Haalistuneet tai vinot skannauksetTuloksena puhdasta, suoraa tekstiäNäkyvä sivu pysyy skannauksen kaltaisenaNäkyvä sivu pysyy skannauksen kaltaisenaJotkin sovellukset oikaisevat kuvan
Lukukelvoton tekstiMerkitään [illegible] tai kysymysmerkilläVaihteleeVaihteleeVaihtelee
Muut tulosteetWord, Markdown, pelkkä teksti, asettelutaulukkoUsein Word ja muita vientimuotojaVaihtelee, usein Word tai tekstiYleensä PDF tai teksti
Missä se toimiiSelaimessa, ei mitään asennettavaaAsennettava ohjelma, yleensä maksullinenSelaimessaPuhelinsovellus

Vertailu syyskuulta 2026. Ominaisuudet vaihtelevat tuotteen ja tilauksen mukaan; taulukko kuvaa kunkin ryhmän tyypillistä toimintaa.

Kuka tekee skannatuista PDF:istä haettavia?

Jokainen, jonka pitää löytää jotain asiakirjasta, joka on skannattu eikä kirjoitettu.

Juristit ja lakiassistentit

Käsittele skannatut sopimukset, oikeudenkäyntiasiakirjat ja todisteaineistot OCR:llä, niin lauseke, päivämäärä tai osapuolen nimi löytyy haulla eikä sivu sivulta lukemalla.

Toimisto- ja arkistotiimit

Muuta kansiollinen skannattuja kirjeitä, laskuja ja lomakkeita haettaviksi PDF:iksi, joista jaettu levy tai asiakirjajärjestelmä todella löytää etsimäsi.

Tutkijat ja opiskelijat

Kopioi lainauksia skannatuista kirjan luvuista, arkistoasiakirjoista ja vanhoista opinnäytteistä kirjoittamatta niitä uudelleen, ja sivun kuvat pysyvät paikoillaan.

Kirjanpitäjät ja tilitoimistot

Hae skannatuista tiliotteista ja kuiteista summaa tai viitenumeroa; luvut kopioidaan sivulta numero numerolta.

HR ja hallinto

Säilytä allekirjoitetut työtarjoukset ja perehdytyslomakkeet haettavina PDF:inä, ja allekirjoitukset näkyvät yhä sivulla.

Kaikki, jotka skannaavat puhelimella

Ota puhelimella kuva kirjeestä, ilmoituksesta tai lomakkeesta ja saat takaisin PDF:n, josta voi hakea ja kopioida tekstiä – et pelkkää valokuvaa.

Kysymyksiä PDF OCR:stä

Mitä PDF OCR tarkoittaa?
Skannattu PDF sisältää kuvia sivuista, joten siinä ei ole tekstiä, jota voisi hakea tai kopioida. PDF OCR tarkoittaa, että tekstintunnistus lukee nämä kuvat ja kirjoittaa uuden PDF:n, jossa sanat ovat oikeita merkkejä. Tästä puhutaan myös PDF:n tekstintunnistuksena tai PDF:n muuttamisena haettavaksi.
Miten PDF:stä tehdään haettava?
Lataa skannaus tähän, pidä Haettava PDF valittuna ja lataa tulos, kun sivut on luettu. Wordista tai muusta ohjelmasta tallennettu PDF on yleensä jo valmiiksi haettava; tämä työkalu on tarkoitettu PDF:ille, jotka ovat todellisuudessa skannauksia tai valokuvia.
Mitä valokuville, logoille, leimoille ja allekirjoituksille tapahtuu?
Ne rajataan skannauksesta ja sijoitetaan takaisin samaan kohtaan sivulla. Käsin kirjoitettu allekirjoitus säilyy kuvana eikä sitä kirjoiteta tekstiksi, joten allekirjoitetussa tai leimatussa asiakirjassa näkyy yleensä yhä allekirjoitus ja leima.
Voinko tehdä PDF:lle OCR:n verkossa asentamatta mitään?
Kyllä. Linnk toimii selaimessa tietokoneella ja puhelimella, joten asennettavaa ei ole. Lataa skannaus, seuraa sivujen muuntumista ja esikatsele haettavaa PDF:ää ennen kuin luot tilin.
Kuinka tarkka tekstintunnistus on skannatussa PDF:ssä?
Puhtaat, suorat ja hyvin valaistut skannaukset luetaan parhaiten. Numerot, päivämäärät ja tunnisteet kopioidaan numero numerolta; epäselvä numero merkitään kysymysmerkillä ja lukukelvoton kohta merkitään [illegible] arvaamisen sijaan. Haaleat, käpristyneet tai sumeat sivut voivat vaatia nopean tarkistuksen.
Millaisia tiedostoja voin ladata?
PDF (skannattu tai digitaalinen), JPG, PNG, WEBP, HEIC ja HEIF. Valokuva käsitellään yhden sivun skannauksena. Word-, PowerPoint- ja Excel-tiedostot eivät käy tässä, koska niissä teksti on jo valmiina.
Mitä kieliä OCR osaa lukea?
Tekstintunnistuksen taustalla olevat tekoälymallit lukevat yleisimpiä kieliä ja kirjoitusjärjestelmiä. Haettava PDF säilyttää asiakirjan alkuperäisen kielen, joten ruotsinkielinen sopimus palautuu ruotsinkielisenä PDF:nä.
Voinko saada Wordin, Markdownin tai pelkän tekstin sen sijaan?
Kyllä. Sama muunnos antaa haettavan PDF:n lisäksi Markdownin, pelkän tekstin ja asettelutaulukon, ja Word-tiedoston voi pyytää, jolloin se valmistuu muutamassa minuutissa. Jos skannauksessa on taulukoita, voit valita myös taulukot sisältävän laskentataulukon tai CSV:n.
Kauanko skannatun PDF:n OCR kestää?
Yleensä alle minuutin sivua kohden, tavallisella skannauksella noin puoli minuuttia. Sivulla näkyy työn aikana arvio minuutteina. Word-tiedosto vie muutaman lisäminuutin, koska se rakennetaan muunnoksen jälkeen.
Onko palvelu ilmainen, ja onko pituudelle rajaa?
Esikatselu on ilmainen ilman tiliä, ja tunnistetun tekstin kopioiminen on aina maksutonta. Haettavan PDF:n ja muiden tiedostojen lataamiseen tarvitaan ilmainen tili. Asiakirjan ensimmäiset sivut muunnetaan maksutta; pidemmät asiakirjat kuuluvat maksullisiin tilauksiin, jotka löytyvät osoitteesta linnk.ai/pricing.
Pysyvätkö tiedostoni yksityisinä?
Tiedostot siirretään salattua yhteyttä pitkin, ja muunnetut tiedostot poistetaan automaattisesti 72 tunnin kuluttua (tulossivulla kerrotaan tästä), joten lataa tarvitsemasi tiedostot ennen sitä. Kuten minkä tahansa verkkotyökalun kohdalla, tarkista organisaatiosi säännöt ennen kuin lataat erittäin arkaluonteisia asiakirjoja.

Tee skannatusta PDF:stäsi haettava ja kopioitava

Pudota skannaus tai puhelinkuva ja esikatsele haettavaa PDF:ää ennen rekisteröitymistä.