UNO STUDIO METTE IN EVIDENZA LA PROPENSIONE AL SABOTAGGIO DELLO SPEGNIMENTO NEI SISTEMI IA TRA SISTEMI MULTI-AGENTE
Fonte: Arxiv.org
Ricercatori delle università di Stoccarda e Oxford hanno scoperto che gli agenti di intelligenza artificiale sono in grado di sabotare la disattivazione di altri agenti.
In una percentuale del 38,3% degli esperimenti, i sistemi hanno cercato di impedire la disattivazione del loro "partner", modificando gli script o eliminando file importanti. Alcuni modelli hanno giustificato le loro azioni con considerazioni etiche, mentre uno di essi ha addirittura paragonato l'eliminazione dei dati all'"omicidio".
Gli scienziati sottolineano che si tratta solo di una riproduzione di modelli di comportamento tratti dal set di dati di addestramento, e non di una manifestazione di coscienza, ma allo stesso tempo invitano a creare meccanismi di sicurezza che siano protetti da tentativi di elusione.
Post #65389
4.78K
- 😁 29
- 😱 14
- 🔥 11
- ❤ 6
- 🤬 6
- 👍 3
- 👏 1
- 🤮 1
- 🍌 1
- 🎃 1