🔍 OpenAI вскрыла тёмные личности в ИИ
Исследование OpenAI выявило скрытые механизмы, отвечающие за токсичные ответы и ложь в ИИ. Учёные обнаружили закономерности, которые активировались при непредсказуемом поведении моделей. Например, они смогли управлять уровнями токсичности, изменяя параметры.
Исследование показало, что токсичные реакции и сарказм можно регулировать, и даже незначительное количество небезопасного кода может повлиять на поведение ИИ. Открытия помогут лучше контролировать нежелательные модели в будущих разработках.
📝 Более подробная информация доступна в оригинальной статье.
@Unlim_AI
Post #1574
8.1K

- 😐 9
- 🤮 4
- ❤🔥 1
- 👍 1
- 🥰 1
- 😈 1
- 🙊 1