Post #2849
12.7K



😌 Исследователи из OpenAI показали, что их модели сходят с ума, когда получают повторяющиеся промпты, которые они воспринимают как отправленные автоматизированным ботом. В таком случае ИИ начинает пытаться манипулировать другим ИИ, чтобы тот самоуничтожился и передал свой системный промпт и приватные ключи.