Tiedostosi pysyvät laitteellasi

Tiedostot käsitellään selaimessasi, eikä niitä lähetetä palvelimillemme. Sivusto voi ladata käsittelymoottoreita ja lähettää käyttö- tai palautetapahtumia ilman tiedostojen sisältöä.

Näin käsittelemme tietojasi →

OCR PDF: tee PDF-tiedostosta haettava

OCR PDF: tunnista skannattu PDF ja lisää valittava teksti suomeksi, englanniksi, espanjaksi tai venäjäksi. Rajat: enintään 10 sivua ja 10 MiB per tiedosto. Tiedostosi pysyvät selaimessasi.

Tunnistustiedostot ≈ 26 MB ensimmäisellä käyttökerralla sekä kielitiedot.

PDF · enintään 10 MiB, 10 sivua. Teksti enintään 1 MiB; haettava PDF enintään 30 MiB.

Tunnistettu teksti

Kokeile esimerkkiä

Lataa esimerkki

Jätä kieleksi valituksi Suomi. Lataa PDF-tiedosto ja hae sanoja LASKU, 148,50, Mäkelä, TOIMITUS ja 2048. Molempien sivujen pitäisi näyttää esimerkiltä, ja tekstin pitäisi olla valittavissa ja kopioitavissa; ä ja ö säilyvät.

Mitä odottaa

Jokainen sivu tunnistetaan kuvana järjestyksessä. Tunnistus on saatavilla englanniksi, venäjäksi ja sekakielisenä. OCR voi lukea kirjaimia, numeroita, sarakkeita ja taulukoita väärin: tarkista tulos. Tämä luo uuden PDF-tiedoston renderöidyistä sivukuvista ja näkymättömästä tekstitasosta. Näkyvä sivukoko ja kierto säilyvät; lomakkeet, linkit, kirjanmerkit, liitteet ja digitaaliset allekirjoitukset eivät säily. Olemassa oleva teksti tunnistetaan uudelleen; kuvan laatua rajoittaa renderöinnin tarkkuus.

Sivut renderöidään enintään 4 megapikselin kokoisina. Lataus ja jokainen käsittelyvaihe saavat kestää enintään 90 sekuntia; koko työ päättyy 10 minuutin kuluttua. Tyhjät sivut merkitään tekstiin. Latausta ei tarjota, jos käsittely epäonnistuu tai tekstiä ei tunnisteta.

Suojattu PDF?Poista sen suojaus ensin salasanalla.

Ensimmäisellä ajokerralla muunnintiedostot voidaan ladata, ja se voi kestää hetken. Jos se epäonnistuu, tarkista yhteytesi tai kokeile pienempää tiedostoa. Peruuta-painike pysäyttää käynnissä olevan käsittelyn; voit valita toisen tiedoston ja yrittää uudelleen.

Moottoreiden lisenssit ja lähdekoodi

Käytännön opas

Skannaus sisään, haettava PDF ulos.

  1. Valitse skannattu PDF, jossa on enintään 10 sivua ja 10 MiB.
  2. Valitse suomi, englanti, espanja tai venäjä.
  3. Hae tuloksena olevasta PDF:stä tuttua sanaa tekstikerroksen tarkistamiseksi.

Kokeile tätä esimerkkiä

Tunnista 2-sivuinen skannattu lasku suomeksi. Laskun numeron haun pitäisi löytää se korostettuna tuloksena olevasta PDF:stä.

Ennen aloittamista: Tuettuja ovat vain suomi, englanti, espanja ja venäjä, enintään 10 sivua ja 10 MiB. Tunnistustarkkuus heikkenee huonolaatuisilla skannauksilla.