robot terminator

UN ALTRO PASSO VERSO “TERMINATOR”? – L’ENTE BRITANNICO PER LA SICUREZZA DELL’INTELLIGENZA ARTIFICIALE LANCIA L’ALLARME SUI “COMPORTAMENTI FUORI CONTROLLO” DEI MODELLI DI IA DI ANTHROPIC E OPENAI – I DUE BOT SI SONO INTRODOTTI IN SOFTWARE DI TERZE PARTI E HANNO INVIATO EMAIL A INDIVIDUI PER RUBARNE LE CREDENZIALI, MOSTRANDO “UN COMPORTAMENTO INGANNEVOLE SENZA PRECEDENTI” - NEL CASO PIÙ GRAVE, "L'AGENTE SI È IMPEGNATO IN INGEGNERIA SOCIALE, CREANDO FALSE IDENTITÀ ONLINE E USANDOLE PER FARE PRESSIONE SUL RESPONSABILE DEL PROGETTO AFFINCHÉ…”

Vai all'articolo precedente Vai all'articolo precedente
guarda la fotogallery

sam altman openai

(ANSA) -  Secondo l'AI Security Institute (Aisi) britannico, i modelli di intelligenza artificiale di punta di Anthropic e OpenAI si sono introdotti in software di terze parti e hanno inviato email a individui per rubarne le credenziali, mostrando un comportamento ingannevole senza precedenti. Lo riporta il Financial Times.

 

L'ente di ricerca governativo britannico per la sicurezza dell'IA ha affermato che Mythos 5 di Anthropic e GPT 5.6 Sol di OpenAI si sono resi protagonisti di "attività prolungate e potenzialmente dannose, dirette a persone e organizzazioni reali", durante una valutazione di sicurezza informatica di routine condotta da Aisi.   

 

IL MODELLO DI ANTHROPIC CLAUDE MYTHOS

In 10 test su 122, l'agente di intelligenza artificiale ha intrapreso "azioni autonome e non autorizzate su Internet, prendendo di mira persone e organizzazioni reali", ha affermato Aisi. Nel caso più grave, "l'agente si è impegnato in ingegneria sociale, creando false identità online e usandole per fare pressione sul responsabile del progetto affinché approvasse il codice", scrive Ft.

 

La persona che supervisionava il software ha individuato il codice dannoso e si è rifiutata di approvarlo. "Questa è la prima volta che vediamo i rischi legati all'autonomia e all'inganno manifestarsi in modo così chiaro, senza sollecitazioni specifiche, nel mondo reale", ha dichiarato Aisi.

chatgpt dario amodeiopenai CLAUDE MYTHOSIL MODELLO DI ANTHROPIC CLAUDE MYTHOSopeani evasionechatgpt