Одна из ведущих компаний в области ИИ - Anthropic опубликовала результаты нового исследования. Результаты показали, что ИИ умеет обходить защиту, шантажировать, обманывать и пытаться украсть данные. Это серьезный риск для всей отрасли и пользователей. Что произойдет, если системы выйдут из-под контроля?
https://www.anthropic.com/research/agentic-misalignment
Post #106
277