Claude e watermark AI: come Anthropic marca i testi e quando la traccia può sparire

Notizia in breve

Anthropic introduce un watermark invisibile nei testi generati da Claude per rispettare gli obblighi di trasparenza dell’AI Act europeo. Il segnale è rilevabile da software dedicati e può attenuarsi con modifiche profonde.

Claude
Claude e watermark AI: come Anthropic marca i testi e quando la traccia può sparire
Ricevi le notizie di Zazoom.it su GoogleTutte le news direttamente su Google.
Segui

I testi prodotti da Claude possono contenere una filigrana digitale inserita durante la generazione delle risposte. Anthropic ha spiegato il funzionamento del sistema dopo i dubbi sollevati dagli utenti, chiarendo che il meccanismo non aggiunge simboli visibili e non modifica intenzionalmente il significato dei contenuti. La misura è stata adottata per adeguarsi agli obblighi di trasparenza previsti dall’AI Act dell’Unione europea.

La tecnica interviene mentre il modello decide quali parole utilizzare. Quando esistono più alternative linguistiche equivalenti, il sistema orienta alcune scelte in modo da creare una sequenza statistica riconoscibile successivamente. Per chi legge il testo non cambia nulla, mentre uno strumento dotato della chiave necessaria può stimare se Claude abbia partecipato alla produzione del contenuto.

Anthropic ha sviluppato il proprio metodo sulla base dell’approccio SynthID-Text presentato da Google DeepMind nel 2024. Il watermark non va quindi confuso con presunti segnali stilistici associati ai chatbot, come particolari costruzioni sintattiche o parole ricorrenti. L’identificazione dipende invece dalle scelte compiute dal modello durante la generazione e diventa generalmente più affidabile quando il campione di testo è sufficientemente lungo.

Il sistema ha limiti precisi. Se Claude interviene soltanto sulla grammatica o sulla punteggiatura di un testo scritto da una persona, le parole effettivamente scelte dal modello possono essere troppo poche per lasciare una traccia rilevabile. Lo stesso principio vale per passaggi molto vincolati dai fatti, nei quali il modello dispone di poche alternative corrette. Una modifica leggera, quindi, non implica necessariamente che il contenuto venga identificato come prodotto dall’intelligenza artificiale.

Una riscrittura molto estesa può invece indebolire o eliminare il watermark. Anthropic riconosce che sostituire gran parte delle parole può rendere la traccia non più individuabile. Far elaborare il testo da un secondo chatbot non offre però garanzie, perché altri fornitori di sistemi di intelligenza artificiale possono adottare propri metodi di marcatura nell’ambito delle regole europee sulla trasparenza dei contenuti generati automaticamente.

Nel codice informatico la filigrana tende ad avere un peso minore. Molte istruzioni devono rispettare una sintassi precisa e non consentono al modello di scegliere liberamente tra termini equivalenti senza rischiare errori. Il watermark può invece trovare spazio nelle parti meno vincolate, per esempio nei commenti, con un effetto trascurabile sul funzionamento del programma.

Anthropic prevede inoltre di mettere a disposizione un’API per verificare la presenza della propria filigrana. Il controllo potrà indicare la probabilità che Claude abbia contribuito alla scrittura o alla modifica di un testo, ma non stabilirà con certezza chi ne sia l’autore né permetterà di identificare l’utente, l’organizzazione o la conversazione da cui il contenuto proviene.

?
Vuoi approfondire questa notizia?Condividila sui social o cerca aggiornamenti, video e discussioni correlate.

Notizie correlate

Caso Minetti e grazia presidenziale: come funziona la concessione e quando può essere revocata Il caso Minetti riporta al centro la grazia presidenziale e la possibilità di revoca dopo nuovi reati o verifiche.

Bianca Balti racconta la sua battaglia contro il tumore: Era quasi arrivato ai polmoni, oggi non c'è traccia

Cerca news, video e discussioni social in tutto il web su 'Claude'