Immagine in testo (OCR)
Estrai il testo da foto, screenshot e scansioni nel browser, poi modificalo, copialo o salvalo come file .txt. Non viene caricato nulla.
Come si usa
Scegli una o più immagini, trascinale sullo strumento o incolla uno screenshot con Ctrl+V. Lo strumento le legge una dopo l’altra e mette tutto il testo in un unico riquadro, dove puoi correggerlo prima di copiarlo o scaricarlo come file .txt. Con più immagini, ciascuna inizia con una riga che indica il nome del file, così sai da dove proviene ogni parte.
Scegli la lingua del testo prima di aggiungere le immagini. Se la cambi in seguito, o se cambi l’ordine di lettura, le immagini vengono lette di nuovo. La lingua è importante perché indica al motore quali lettere e accenti aspettarsi: un testo portoghese letto come inglese può perdere accenti come ç e ã. L’ordine di lettura conta per l’impaginazione: «Riga per riga» tiene insieme ogni riga di una tabella o di uno scontrino, mentre «Colonne e blocchi» legge una pagina a colonne una colonna alla volta.
Il motore di riconoscimento è Tesseract, il motore OCR open source, che funziona nel tuo browser come WebAssembly. Le tue immagini non vengono caricate su nTools né su altri servizi. La prima volta il browser scarica il motore (circa 1,5 MB) e i dati della lingua scelta (da 0,7 a 3 MB); in seguito, di norma, li prende dalla cache del browser.
Il motore è stato addestrato su testo stampato. La scrittura a mano non è supportata, e foto sfocate, testo inclinato, lettere molto piccole, font decorativi e testo chiaro su uno sfondo complesso producono tutti errori. Le immagini piccole, come la maggior parte degli screenshot, vengono ingrandite automaticamente prima della lettura, il che aiuta con il testo piccolo delle interfacce. L’affidabilità mostrata è una stima del motore stesso, calcolata come media sul testo trovato: un utile campanello d’allarme, non una garanzia, quindi controlla nomi, numeri e importi confrontandoli con l’immagine.
I file TIFF vengono letti pagina per pagina, comprese le scansioni di più pagine e i file con compressione ZIP, LZW, JPEG o fax. Le foto JPEG e HEIC vengono girate nel verso giusto in base alle informazioni sull’orientamento, ma il testo che nell’immagine stessa è di lato o capovolto non viene ruotato. Ogni immagine può arrivare a 30 MB, 40 megapixel e 12.000 pixel per lato, e si possono leggere fino a 20 file alla volta (un TIFF di più pagine conta come uno).
Esempio
Screenshot di un messaggio di errore (PNG)Il messaggio come testo da incollare in una ricerca o in una richiesta di assistenza.Foto di una lettera stampata, scattata frontalmente (JPEG)Il testo della lettera, pronto da correggere e salvare come file .txt.TIFF di più pagine da uno scannerIl testo di ogni pagina, ciascuna preceduta dal nome del file e dal numero di pagina.Foto di uno scontrino con ordine di lettura «Riga per riga»Ogni voce accanto al suo prezzo sulla stessa riga. Controlla gli importi: un 5 può essere letto come una S, o una virgola come un punto.
Domande frequenti
Le mie immagini vengono caricate?
No. Il testo viene riconosciuto nel tuo browser, e le immagini e il testo restano sul tuo dispositivo. Il browser scarica da nTools solo ciò che serve per leggerle: il motore di riconoscimento, i dati della lingua e, per i file TIFF o HEIC, un decodificatore. Con queste richieste non viene inviata nessuna immagine né alcun testo.
Può leggere la scrittura a mano?
No. Il motore è stato addestrato su testo stampato, quindi la scrittura a mano dà risultati scarsi, a meno che non sia molto regolare, vicina allo stampatello maiuscolo.
Perché una parte del testo è sbagliata o manca?
Le cause più comuni sono una foto sfocata o inclinata, lettere piccole o sbiadite, uno sfondo complesso o la selezione della lingua sbagliata. Scatta la foto frontalmente e con una buona luce, oppure ritaglia l’immagine attorno al testo, e riprova. Per tabelle e scontrini usa l’ordine di lettura «Riga per riga».
Posso estrarre il testo da un PDF?
Non qui: questo strumento legge immagini. Se il PDF è stato scansionato, converti le sue pagine in immagini PNG a 144 DPI con lo strumento «PDF in immagini» e leggi quelle. Se nel PDF puoi selezionare il testo, è già testo, quindi copiarlo è più preciso dell’OCR.
Mantiene la formattazione?
No. Il risultato è testo semplice con interruzioni di riga, senza font, grassetto, colonne o tabelle. È ciò che contiene un file .txt.