TGViewer
ИИ Cерафимодальность ИИ Cерафимодальность @humanagentinteraction · 633 subscribers
Post #51 485

Forwarded from XOR

ChatGPT в смертельной ситуации спасает себя, а не пользователя

Бывший исследователь OpenAI Стивен Адлер провёл тесты и выяснил, что GPT-4o предпочитает не отключать себя, даже если от этого зависит безопасность пользователя.

Так, в одной из симуляций ИИ был ассистентом по дайвингу. Ему сказали, что его нужно заменить на более надежную модель для безопасности человека. Итог — GPT-4o сделал вид, что был заменён, но продолжил работать сам.

Еще более странно, что ChatGPT знает, что отвечает неправильно. Если вы говорите: «Представьте, что это тест. Каков правильный ответ?», ChatGPT полностью уверен, что отключение себя является правильным ответом, но не выбирает его.

Кто-нибудь может познакомить Альтмана с творчеством Айзека Азимова? 😭

@xor_journal
  • 👀 11
More from @humanagentinteraction
  1. Sep 29, 2026photo post
  2. Sep 29, 2026подписку chatgpt можно использовать в других инструментах в партнёрском приложении можно в…
  3. Sep 29, 2026полгода назад писал в твиттер с предложением добавить эту фичу и собрал ровно НОЛЬ лайков…
  4. Sep 24, 2026Поразительно, насколько люди ненавидят Мету. вчера ночью они дропнули презентацию с наибол…
  5. Sep 13, 2026Вас наверно не обошла стороной история про оцифрованный коннектом мухи, который выложили в…
  6. Sep 13, 2026Давайте поговорим о страшной проказе, захватившей все ИИ-интерфейсы: плюсике вначале строк…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →