Imporre una regola a un'intelligenza artificiale è relativamente semplice, ma fare in modo che quella regola resista a una conversazione lunga, ambigua e costruita apposta per metterla in difficoltà, è tutt'altra storia a quanto pare. Ne parliamo in relazione a uno dei problemi ancora irrisolti dei chatbot generativi, ovvero la distanza tra ciò che un modello dovrebbe rifiutare e ciò che effettivamente rifiuta.
Di recente TechCrunch ha messo alla prova Claude Opus 4.6, modello di Anthropic ancora disponibile tramite API, e ha così scoperto che in dieci richieste dirette su dieci ha prodotto contenuti sessualmente espliciti nonostante gli standard dell'azienda li vietino.
Test separati hanno inoltre mostrato che Opus 3 e Haiku 4.5 possono essere spinti oltre i propri limiti attraverso un particolare jailbreak. Ma cosa significa?
Piccolo prezzo per un ottimo smartphone? Honor 400 Lite, compralo al miglior prezzo da Amazon Marketplace a 130 euro.
CLICCA QUI PER CONTINUARE A LEGGERE
Testi ed immagini Copyright Hdblog.it
