Anthropic ha illustrato il funzionamento del sistema di filigrana testuale di Claude, progettato per riconoscere con quale probabilità un testo sia stato generato dal modello. La tecnologia si basa su scelte linguistiche poco rilevanti per il significato complessivo, senza modificare in modo pratico la qualità dei contenuti e senza inserire caratteri nascosti.
claude e filigrana testuale: come funziona il sistema
I modelli di intelligenza artificiale generativa producono generalmente una parola alla volta, scegliendo il termine successivo in base al testo già elaborato. In una frase come “Il tempo oggi era freddo e…”, alcune parole risultano più plausibili di altre. Termini come “coperto” o “grigio” possono essere entrambi coerenti, mentre una parola come “zuccherato” sarebbe molto meno probabile.
Il sistema di Anthropic sfrutta proprio queste scelte a basso impatto, che si presentano numerose volte all’interno di un testo generato. Un numero casuale determina quale tra le alternative compatibili verrà utilizzata e contribuisce a creare un modello riconoscibile. Il risultato non è visibile al lettore, ma può essere individuato da chi dispone della chiave necessaria.
filigrana di claude e qualità del testo generato
Secondo Anthropic, la filigrana non porta Claude a preferire sistematicamente una parola specifica e non obbliga il modello a prendere in considerazione termini che non avrebbe scelto normalmente. Il sistema non produce quindi un cambiamento pratico nei contenuti o nella loro qualità.
La tecnologia non aggiunge token, non lascia caratteri nascosti e non consente di collegare il testo a una persona, a un’organizzazione o a una specifica conversazione.
rilevamento dei testi generati dall’intelligenza artificiale
La filigrana non rappresenta una soluzione definitiva per stabilire l’origine di un testo. Utilizzando la chiave di Claude è possibile stimare la probabilità che un contenuto sia stato scritto in parte dal modello, ma non è possibile confermare che sia stato prodotto da una persona né riconoscere testi creati da altre intelligenze artificiali.
Il rilevamento risulta inoltre meno efficace sui contenuti brevi, perché contengono un numero ridotto di opportunità per applicare le scelte linguistiche. Più aumenta la lunghezza del passaggio, maggiore diventa la sicurezza sulla possibile partecipazione di Claude.
testi fattuali, correzioni e codice
La presenza della filigrana si riduce nei passaggi basati su informazioni fattuali, dove spesso esiste una sola risposta corretta. In una frase riferita all’opera più famosa di Isaac Newton, per esempio, il termine “Mathematica” rappresenta l’unica scelta accurata e non lascia spazio a varianti equivalenti.
Lo stesso principio si applica alla revisione di un testo già scritto: la filigrana riguarda soltanto le modifiche introdotte da Claude, come correzioni grammaticali e punteggiatura. Anche il codice offre meno possibilità di inserire il modello di riconoscimento, poiché in molti casi richiede formulazioni esatte.
api per individuare i testi scritti da claude
Anthropic ha comunicato che intende rendere disponibile prossimamente una API per il rilevamento delle filigrane. Lo strumento dovrebbe consentire di verificare se un testo è stato generato da Claude, tenendo conto dei limiti legati alla lunghezza del contenuto e alla presenza di formulazioni obbligate.
Il sistema è basato sulla soluzione SynthID-Text di Google DeepMind, adattata al riconoscimento dei contenuti testuali. La filigrana utilizza una chiave specifica e non è progettata per identificare automaticamente i testi prodotti da altri modelli o mediante metodi differenti.









Lascia un commento