Tunnista teksti skannatuista, kuvapohjaisista PDF-tiedostoista paikallisesti selaimessasi — monikielinen, sivualueen valinta, TXT-vienti. Ei latausta millekään palvelimelle, täysin ilmainen, ei rekisteröitymistä.
Käyttöohje
1
Lataa skannattu PDF
Lataa skannattu tai kuvapohjainen PDF, valitse sitten kieli ja sivualue
2
Paikallinen tunnistus
Sivut renderöidään ja OCR-käsitellään yksi kerrallaan selaimessasi — mitään ei ladata palvelimelle, edistyminen näkyy reaaliajassa
3
Kopioi tai lataa
Tulokset virtaavat esikatseluun — kopioi tai lataa TXT-tiedostona, kirjautumista ei tarvita
UKK
Miksi jokaisen sivun käsittely kestää 5–15 sekuntia?
OCR-moottori toimii kokonaan selaimessasi (ei palvelinta). Jokainen sivu vaatii renderöinnin, esikäsittelyn ja tunnistuksen, joten nopeus riippuu laitteestasi. Kielen ensimmäinen käyttökerta lataa myös kielitiedot kerran (tallennetaan välimuistiin).
Miten tämä eroaa PDF tekstiksi -työkalusta?
PDF tekstiksi lukee tiedoston sisäänrakennetun tekstikerroksen — välitön, mutta skannatuissa tiedostoissa sellaista ei ole. Tämä työkalu lukee sivukuvat OCR:n avulla, ja se on suunniteltu skannatuille ja kuvatuille asiakirjoille. Työkalut täydentävät toisiaan.
Kuinka tarkka se on?
Puhdas painettu teksti tunnistuu hyvin; käsiala, epätarkat valokuvat ja monimutkaiset taulukot heikentävät tarkkuutta. Valitse oikea kieli, skannaa 300 DPI:n tarkkuudella ja tarkista tärkeät numerot ja nimet jälkikäteen.
Ladataanko tiedostoni palvelimelle?
Ei. Renderöinti ja tunnistus tapahtuvat kokonaan selaimessasi. Tiedostot eivät koskaan poistu laitteeltasi, ja muisti tyhjennetään sivun päivityksen yhteydessä. Rajoitukset: 30 Mt ja 30 sivua tiedostoa kohden.
Sinä päätät, mitä työkaluja rakennamme seuraavaksiLähetä toive →