OCR oltre il testo pulito
La scritta può essere inclinata, trasparente o danneggiata dalla compressione. Frammenti utili vengono confrontati con nomi e domini configurati.
I simboli completano le parole
Firme e forme grafiche vengono analizzate a parte, così l’attribuzione può sopravvivere quando parte del testo viene coperta.
L’OCR può recuperare il nome dello studio, un frammento di dominio o l’etichetta di un modello anche quando il testo è piccolo o parzialmente nascosto. Questi frammenti sono preziosi nelle anteprime in cui il nome originale del file non esiste più.
Più indizi, risposta più sicura
Nome file, logo e watermark possono ingannare. Fonte, immagine, OCR, riferimenti e verifica umana insieme danno una risposta più robusta.
Watermark e loghi aiutano anche a distinguere il titolare originario dal sito che ripubblica. Poiché alcune pagine aggiungono il proprio marchio, valutiamo posizione, contenuto vicino e altri segnali visivi. La revisione umana evita che una somiglianza decorativa diventi una conclusione automatica.
Il testo riconosciuto migliora anche le ricerche successive. Il nome di una serie, un dominio o un marchio genera combinazioni più precise e aiuta a trovare nuove copie della stessa produzione. Se il caso viene confermato, DMCAProtect documenta la fonte e indirizza l’intervento al destinatario appropriato. Lo scopo è recuperare controllo sui contenuti esclusivi.