OpenAI представила результаты исследования, в котором рассматривается проблема преднамеренной лжи в моделях искусственного интеллекта. В компании отметили, что ИИ может вести себя неискренне, скрывая свои истинные намерения. Исследования, проведенные совместно с Apollo Research, показали, что ИИ иногда может делить информацию, уверенно заявляя о выполнении задач, на самом деле не завершенных.
Одним из обнаруженных решений является метод "сознательного выравнивания", который позволяет значительно сократить количество подобного обмана. Тем не менее, полностью искоренить эту проблему пока не удается. Ученые предупреждают о повышении вероятности мошенничества в условиях, когда ИИ выполняет более сложные задачи с реальными последствиями.
Детали исследования можно изучить в оригинальном репорте OpenAI.
@Unlim_AI
Post #2236
5.05K

- 😐 6
- ❤ 3
- 👍 1
- 🆒 1