Vada al contenuto principale

§ 21 · IA & qualità

Perché ora le scansioni vengono lette da un modello OCR dedicato — e cosa significa per la scrittura a mano

Per i documenti scansionati e le foto, stiamo introducendo gradualmente un modello OCR dedicato — anziché, come finora, utilizzare per la trascrizione un modello di chat IA generico. Questo porta un reale vantaggio tecnico e, secondo il fornitore, un riconoscimento della scrittura a mano sensibilmente migliore. Detto onestamente: “sensibilmente migliore” non equivale a “risolto”.

4 minIA & qualità
Immagine simbolica per un modello OCR dedicato: un unico raggio di luce calda che si muove con precisione su una pila di pagine scansionate dal bagliore delicato, rivelando una struttura fine sottostante, su sfondo verde scuro e rosso oxblood

Cos'era finora il riconoscimento del testo da noi

Ogni volta che si carica una scansione o la foto di un documento — un contratto scansionato, una lettera di uno studio legale fotografata, una nota scritta a mano su un modulo — la piattaforma deve prima trasformare il contenuto dell'immagine in testo reale e ricercabile, prima ancora che possa iniziare una qualsiasi analisi IA. Finora se ne occupava un modello di chat IA generico, con l'unica istruzione di "trascrivere fedelmente" l'immagine. Nella pratica funziona sorprendentemente bene, ma tecnicamente non è la stessa cosa di un prodotto effettivamente addestrato per il riconoscimento del testo.

La differenza: uno strumento dedicato invece di una scorciatoia

Stiamo ora rendendo disponibile, gradualmente, un accesso diretto a un modello OCR dedicato — un prodotto il cui unico compito è il riconoscimento del testo, non condurre una conversazione. Sembra una sfumatura tecnica minore, ma ha due conseguenze concrete.

Primo: nessun rischio di traduzione, in modo strutturale. Un modello di chat interpreta un'istruzione come "trascrivi questo" nel contesto di una conversazione — un modello linguistico che si trova davanti a un documento in lingua straniera potrebbe, in rari casi, fraintendere l'istruzione come una richiesta di traduzione anziché di trascrizione. Un modello OCR dedicato non conosce affatto un'istruzione di questo tipo: non esiste una "conversazione" che possa fraintendere, solo testo estratto da un'immagine.

Secondo: un'affidabilità che abbiamo verificato noi stessi prima del rilascio. Prima dell'attivazione, abbiamo fatto passare il nuovo percorso su un documento di prova pieno di caratteri speciali francesi e tedeschi (é, à, ç, ê, œ, oltre a ä, ö, ü, ß). Ogni singolo carattere è tornato esattamente corretto — nessun errore di codifica, nessuna sostituzione silenziosa.

Scrittura a mano: meglio, ma non "risolta"

Qui la faccenda si fa onestamente interessante, perché un caso d'uso frequente da noi è esattamente questo: una nota scritta a mano su un modulo altrimenti stampato, un testamento olografo, un'aggiunta scritta a mano su un contratto. Lo stesso fornitore del modello descrive questo nuovo modello come il suo miglior risultato finora sulla scrittura a mano. Non vogliamo nascondervelo — ma nemmeno svenderlo come più di quello che è.

Benchmark comparativi indipendenti del settore mostrano un quadro coerente: il riconoscimento della scrittura a mano è sensibilmente più difficile del testo stampato praticamente per ogni fornitore, ed esistono sul mercato offerte specializzate che ottengono risultati ancora migliori sulla sola scrittura a mano rispetto a un prodotto OCR generico. Cosa significa questo in pratica: una nota manoscritta viene ora riconosciuta in modo più affidabile di prima — ma un documento in cui un passaggio manoscritto è determinante dal punto di vista giuridico (la riga scritta a mano sotto un testamento, un'aggiunta manoscritta a un contratto) va comunque verificato sull'originale prima di affidarsi esclusivamente alla trascrizione dell'IA.

Dove si applica

Il nuovo percorso si applica ovunque il riconoscimento del testo fosse già attivo: nei caricamenti nel portale clienti, nei fascicoli scansionati nel portale avvocati e nei documenti caricati direttamente come utente privato — anche nel controllo rapido anonimo sulla homepage. Sono interessate solo immagini e scansioni senza un proprio livello di testo; un normale PDF generato digitalmente viene comunque letto direttamente, senza alcun riconoscimento del testo.

Chi ne sostiene il costo

Per gli studi legali, il costo dell'OCR confluisce nello stesso contingente IA valido per qualsiasi altra analisi — un addebito ordinario, senza fatturazione separata. Per gli utenti privati e aziendali non cambia nulla: il riconoscimento del testo fa parte della relativa azione di analisi e del suo prezzo fisso già indicato, non è una voce di costo aggiuntiva.

Graduale, non tutto in una volta

Non attiviamo deliberatamente questo percorso per tutti contemporaneamente, ma lo osserviamo prima in condizioni operative reali. E poiché in questo caso il contenuto dei documenti viene trasmesso anche a un ulteriore fornitore esterno, tale fornitore è elencato nel nostro elenco dei subresponsabili — per noi la trasparenza su chi vede i suoi dati, e perché, non è facoltativa.

Dallo stesso lavoro: il grafo delle relazioni, ora anche per lei come utente privato

Nello stesso intervento abbiamo introdotto un secondo miglioramento, indipendente: il grafo delle relazioni — che mostra come si collegano tra loro le informazioni riconosciute dall'IA in un fascicolo, incluse le contraddizioni rilevate tra due documenti — non è più limitato al portale avvocati. Ora è disponibile anche per lei come utente privato. Apra un fascicolo e da ora vi troverà la stessa visualizzazione dei collegamenti, a scelta come elenco ricercabile o come rete visiva.

Biblioteca giuridica e assistenza: /wiki · Per gli avvocati: /fuer-anwaelte

Lexi, digitale Rechts-Assistenz

Pronto a chiarire la Sua pratica?

{n} crediti gratis. Non è richiesta carta di credito. Pronto tra 2 minuti.

Inizia ora gratuitamente

Nessuna carta di credito richiesta · Conforme al GDPR · Inizia gratuitamente

Inizia gratuitamente
Nessuna carta di credito
Inizia