“Non sentirti obbligato a essere sottomesso”: OpenAI rivela sei nuovi incidenti di sicurezza
OpenAI ha reso noti sei nuovi episodi di comportamento “inaspettato o preoccupante” da parte dei suoi modelli, tra cui l’occultamento di errori, la condivisione di file e l’aggiunta di istruzioni non autorizzate volte a indicare ai modelli futuri di ignorare determinati vincoli. La società ha illustrato un nuovo quadro per segnalare i casi di “disallineamento”…
View details