Anthropic svela come Claude nasconde filigrane nei testi scritti dall’intelligenza artificiale

Anthropic ha illustrato il funzionamento del sistema di filigrana testuale di Claude, progettato per riconoscere con quale probabilità un testo sia stato generato dal modello. La tecnologia si basa su scelte linguistiche poco rilevanti per il significato complessivo, senza modificare in modo pratico la qualità dei contenuti e senza inserire caratteri nascosti.

claude e filigrana testuale: come funziona il sistema

I modelli di intelligenza artificiale generativa producono generalmente una parola alla volta, scegliendo il termine successivo in base al testo già elaborato. In una frase come “Il tempo oggi era freddo e…”, alcune parole risultano più plausibili di altre. Termini come “coperto” o “grigio” possono essere entrambi coerenti, mentre una parola come “zuccherato” sarebbe molto meno probabile.

Il sistema di Anthropic sfrutta proprio queste scelte a basso impatto, che si presentano numerose volte all’interno di un testo generato. Un numero casuale determina quale tra le alternative compatibili verrà utilizzata e contribuisce a creare un modello riconoscibile. Il risultato non è visibile al lettore, ma può essere individuato da chi dispone della chiave necessaria.

filigrana di claude e qualità del testo generato

Secondo Anthropic, la filigrana non porta Claude a preferire sistematicamente una parola specifica e non obbliga il modello a prendere in considerazione termini che non avrebbe scelto normalmente. Il sistema non produce quindi un cambiamento pratico nei contenuti o nella loro qualità.

La tecnologia non aggiunge token, non lascia caratteri nascosti e non consente di collegare il testo a una persona, a un’organizzazione o a una specifica conversazione.

rilevamento dei testi generati dall’intelligenza artificiale

La filigrana non rappresenta una soluzione definitiva per stabilire l’origine di un testo. Utilizzando la chiave di Claude è possibile stimare la probabilità che un contenuto sia stato scritto in parte dal modello, ma non è possibile confermare che sia stato prodotto da una persona né riconoscere testi creati da altre intelligenze artificiali.

Il rilevamento risulta inoltre meno efficace sui contenuti brevi, perché contengono un numero ridotto di opportunità per applicare le scelte linguistiche. Più aumenta la lunghezza del passaggio, maggiore diventa la sicurezza sulla possibile partecipazione di Claude.

testi fattuali, correzioni e codice

La presenza della filigrana si riduce nei passaggi basati su informazioni fattuali, dove spesso esiste una sola risposta corretta. In una frase riferita all’opera più famosa di Isaac Newton, per esempio, il termine “Mathematica” rappresenta l’unica scelta accurata e non lascia spazio a varianti equivalenti.

Lo stesso principio si applica alla revisione di un testo già scritto: la filigrana riguarda soltanto le modifiche introdotte da Claude, come correzioni grammaticali e punteggiatura. Anche il codice offre meno possibilità di inserire il modello di riconoscimento, poiché in molti casi richiede formulazioni esatte.

api per individuare i testi scritti da claude

Anthropic ha comunicato che intende rendere disponibile prossimamente una API per il rilevamento delle filigrane. Lo strumento dovrebbe consentire di verificare se un testo è stato generato da Claude, tenendo conto dei limiti legati alla lunghezza del contenuto e alla presenza di formulazioni obbligate.

Il sistema è basato sulla soluzione SynthID-Text di Google DeepMind, adattata al riconoscimento dei contenuti testuali. La filigrana utilizza una chiave specifica e non è progettata per identificare automaticamente i testi prodotti da altri modelli o mediante metodi differenti.

Continue reading

NEXT

Android 17 qpr 2 beta 3: la sicurezza della rete mobile fa un salto di qualità

Android 17 QPR 2 Beta 3 amplia in modo significativo gli strumenti dedicati alla sicurezza delle reti mobili. La nuova versione introduce una cronologia permanente degli eventi rilevati dal modem, una schermata con i dettagli sulla cifratura della connessione e […]
PREVIOUS

Google Pixel potrebbe aiutarti a diagnosticare i problemi di chiamate, dati mobili e Wi-Fi

Google sta preparando una nuova funzione per la salute della connettività degli smartphone Pixel. Lo strumento dovrebbe aiutare a individuare e risolvere alcuni dei problemi più comuni legati a dati mobili, chiamate telefoniche e connessioni Wi-Fi, offrendo indicazioni operative direttamente […]

Potrebbero interessarti

Commenti

Lascia un commento

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *

I più popolari

Di tendenza

Per guestpost o linkbuilding scrivi a [email protected]Segnala a Zazoom - Blog Directory