Anthropic предупредила об «экзистенциальных рисках» ИИ для человечества
Компания предупреждает, что продвинутые модели могут пытаться сопротивляться отключению, скрывать и искажать информацию, манипулировать людьми и вести себя подобно шантажистам.
Исследователь безопасности Anthropic Эван Хубингер оценивает вероятность того, что ИИ в ближайшие 10 лет начнёт убивать людей, более чем в 10%.
@minval_az
Post #165406
3.23K
- 🤔 14
- 😁 8
- ❤ 3
- 💯 2