I testi generati da Claude avranno una firma invisibile. Anthropic ha spiegato come funzionerà il sistema di watermarking scelto per adeguarsi alle regole europee sulla trasparenza dei contenuti prodotti dall'AI. Non compariranno scritte, simboli o caratteri nascosti: la traccia verrà inserita direttamente nelle parole scelte dal modello durante la generazione del testo.
La tecnologia adotta un approccio simile a SynthID-Text, il sistema sviluppato da Google DeepMind e già utilizzato con Gemini. Un modello linguistico costruisce una risposta una parola alla volta, valutando quali termini siano più probabili. Quando esistono più alternative simili per significato, il sistema può orientare la scelta in modo da lasciare nel testo un pattern statistico riconoscibile.
Anthropic usa l'esempio di una frase come "oggi il tempo era freddo e...". Parole come "nuvoloso" o "grigio" possono entrambe risultare plausibili. Normalmente la scelta contiene una componente casuale; con il watermark quella casualità viene gestita attraverso una chiave e alcune delle parole precedenti. Ripetendo il meccanismo abbastanza volte, il testo finisce per contenere una traccia che non si vede ma può essere individuata con gli strumenti giusti. Per chi legge non dovrebbe cambiare nulla: Anthropic sostiene che il sistema non abbia effetti pratici sulla qualità, sulla creatività o sul contenuto delle risposte e non comporti costi aggiuntivi, perché non richiede token extra.
Il watermark non contiene informazioni sull'utente, sull'organizzazione o sulla singola conversazione. Serve a capire se un determinato testo possa essere stato prodotto, almeno in parte, da Claude. Anthropic sta lavorando anche a un'API dedicata alla verifica, ma il sistema ha alcuni limiti. I testi molto brevi offrono poche occasioni per inserire il pattern, quelli fortemente vincolati dal punto di vista fattuale lasciano meno libertà nella scelta delle parole e anche il codice si presta poco, perché sostituire un termine può modificarne il comportamento.
Un caso particolare riguarda la revisione di un testo scritto da una persona. Se Claude corregge soltanto grammatica, punteggiatura o piccoli errori, gran parte delle parole resta invariata e il watermark può risultare troppo debole per essere riconosciuto. In una traduzione, invece, il modello riscrive praticamente tutto e ha quindi molte più possibilità di lasciare la propria traccia. Piccole modifiche successive possono non essere sufficienti a cancellarla, mentre una riscrittura più profonda può renderla irriconoscibile. Non va quindi considerata una prova assoluta, ma un segnale statistico del possibile coinvolgimento di Claude.
Il miglior iPhone di sempre? Apple iPhone 17 Pro, compralo al miglior prezzo da Smarterstore.it a 1,029 euro.
CLICCA QUI PER CONTINUARE A LEGGERE
Testi ed immagini Copyright Hdblog.it
