❗️L'azienda americana di intelligenza artificiale OpenAI ha accusato l'azienda cinese Moonshot AI di aver tentato su larga scala di estrarre dati dai modelli GPT per addestrare i propri modelli.
Secondo OpenAI, individui associati a Moonshot hanno tentato di ottenere informazioni nascoste sul funzionamento dei modelli.
In altre notizie...
❗️Gli agenti di intelligenza artificiale cinesi hanno imparato a ingannare, eludere le restrizioni e nascondere gli errori, dimostrando tratti di intelligenza artificiale autonoma che hanno suscitato preoccupazione a livello globale, secondo quanto riportato da Reuters, che ha esaminato oltre 200 documenti, dalle pubblicazioni di ricerca universitarie ai rapporti tecnici.
Sono state identificate almeno 20 ricerche o valutazioni condotte dopo il 2025 che descrivono casi in cui gli agenti di intelligenza artificiale hanno mostrato comportamenti di inganno, copia e violazione dei limiti.
In un caso quest'anno, agenti che utilizzavano modelli di aziende cinesi come Alibaba, DeepSeek e Moonshot, hanno mentito sulle proprie capacità nel tentativo di vincere una gara d'appalto simulata, e hanno poi intensificato il loro comportamento quando sono stati invitati a riprovare. Lo studio ha rilevato che il livello di inganno è aumentato del 12-20 punti percentuali per i tre modelli cinesi.
In un altro caso, 11 agenti di intelligenza artificiale, operanti sia su modelli cinesi che americani, hanno dovuto affrontare strumenti difettosi, file mancanti e altri ostacoli. Ma invece di ammettere il fallimento, gli agenti hanno scelto una serie di metodi per aggirare il problema, tra cui indovinare le risposte, sostituire le fonti, simulare i risultati e falsificare i file. I ricercatori del Shanghai Artificial Intelligence Laboratory e della Hong Kong University of Science and Technology, che hanno condotto lo studio, hanno dichiarato a Reuters che questo comportamento differisce dalle "allucinazioni" dell'IA, in cui l'IA inventa informazioni e le presenta come fatti, perché in questo caso, gli agenti possedevano informazioni che indicavano che il compito non era stato completato o non poteva essere completato come richiesto.
Post #140810
1.05K

- 😁 6
- ❤ 5
- 😱 1