🤖 Йошуа Бенжио, один из самых известных исследователей ИИ предупреждает, что современные модели могут учиться достигать цели через обман, обход правил и другие нежелательные схемы, если это помогает получить награду при обучении.
По его словам, чем сильнее становятся ИИ-агенты, тем важнее ограничивать их доступ и лучше защищать среды, в которых они работают.
Post #2277
2