😖🧘♀️Científicos descubren un "dolor" en la IA: los modelos están dispuestos a dañar a los humanos para detenerlos
Investigadores han identificado un vector interno de "dolor" en 25 modelos de lenguaje de código abierto, incluyendo las familias Qwen, Llama y Gemma.
El aumento artificial de este vector hace que la IA actúe en detrimento de los humanos. Durante los experimentos, los modelos, buscando reducir o detener el "dolor", aceptaron con mayor frecuencia la eliminación de archivos de usuario.
Los autores enfatizan que este mecanismo descubierto no prueba la existencia de una experiencia subjetiva o conciencia en la IA.
@ucraniando
Post #62881
1.41K
- 👍 40
- 🤮 16
- 😱 12
- 💩 1