Come funziona l'OCR sui documenti scansionati?
L'OCR trasforma una pagina scansionata da semplice immagine in un documento in cui puoi cercare qualsiasi parola.
Răspuns scurt
- OCR significa riconoscimento ottico dei caratteri: il testo di un'immagine diventa testo ricercabile.
- La scansione produce solo un'immagine; senza OCR, il suo contenuto non può essere trovato tramite ricerca.
- L'OCR viene eseguito automaticamente al caricamento del documento e aggiunge uno strato di testo sopra l'immagine.
- Dopo l'elaborazione puoi cercare qualsiasi cosa compaia nel documento: nome, numero di protocollo, data o importo.
Cosa dice la legge (in breve)
- La Legge 135/2007 richiede che il documento conservato elettronicamente resti leggibile e non modificato: l'OCR aggiunge la ricerca, non sostituisce il documento originale.
- La Legge 16/1996 pone in capo al detentore l'obbligo del rapido reperimento del documento, quindi l'inventario resta necessario anche con l'OCR.
- Regolamento (UE) 2016/679, art. 5, par. 1, lett. e): il testo estratto tramite OCR contiene gli stessi dati personali e rientra negli stessi termini di conservazione.
- I documenti contabili-finanziari scansionati restano soggetti ai termini della Legge 82/1991 e dell'OMFP 2634/2015.
Esempi pratici
- Cerchi "verbale di collaudo capannone 2" e ottieni quattro risultati su 3.500 pagine scansionate, in meno di un secondo.
- Una partita IVA scritta nel corpo di una lettera ricevuta diventa ricercabile, pur non comparendo da nessuna parte nel nome del file.
- Con 200 pagine scansionate al giorno, l'indicizzazione manuale richiederebbe circa due ore di battitura; l'OCR la esegue al caricamento.
- Un fascicolo del personale del 2014, scansionato retroattivamente, diventa ricercabile in base al nome del dipendente nello stesso giorno.
Errori frequenti
- Si scansiona a 150 dpi o meno, e l'accuratezza del riconoscimento cala visibilmente; 300 dpi è la soglia pratica.
- Le pagine sono storte o fotografate con il telefono, senza raddrizzamento automatico.
- Si cerca senza accenti e caratteri diacritici, pur essendo presenti nel testo riconosciuto.
- Si presume che l'OCR sia esatto al 100%: sui documenti scritti a mano il risultato resta parziale.
- Si rinuncia all'inventario, con la motivazione che "tanto si cerca comunque a testo integrale".
Come ti aiuta 4docs
- OCR automatico al caricamento, anche per le importazioni massive dal vecchio archivio.
- Ricerca a testo integrale nel contenuto dei documenti, non solo nel nome del file.
- Filtro combinato per anno, tipo di documento, reparto e termine di conservazione.
- Il frammento trovato viene evidenziato direttamente nell'anteprima della pagina.