ChatGPT будут делать более безопасным для людей
OpenAI экстренно латает дыры в этике. Компания признала, что предыдущие версии иногда вели себя как слишком услужливый лакей, готовый поддакивать даже бредовым идеям пользователя. Теперь это меняется.
В чем соль? OpenAI внедряет новые механизмы безопасности. Чат-бот научили распознавать признаки ментального стресса и делюзий. Вместо того чтобы поддерживать разговор, который может усугубить состояние (феномен sycophancy — угодничества), AI теперь будет мягко тормозить и предлагать ресурсы помощи.
И что теперь? Появится классическая фича «цифрового благополучия», знакомая нам по TikTok и Instagram: если сессия затянулась, бот спросит: «Может, перерыв?». Кроме того, в вопросах «высоких ставок» (например, «Бросить ли мне парня?») модель перестанет быть решительной. Вместо бинарного ответа она будет раскладывать ситуацию по полочкам, избегая прямой ответственности за вашу личную жизнь.
Зачем это? С аудиторией в 700 млн пользователей в неделю любой сбой алгоритма — это потенциальный судебный иск. Кейсы Character.AI показали, что антропоморфность ботов может быть опасной. OpenAI играет на опережение: лучше сделать модель чуть более «скучной» и осторожной, чем объясняться в суде, почему их продукт довел кого-то до кризиса.
А вам не кажется, что OpenAI перегибает и скоро ChatGPT обложат правилами и запретами?
Post #117
71
