TGViewer
MultiJournal MultiJournal @multijournal · 1.53K subscribers
Post #884 384
🙈 63% американцев считают, что ИИ уничтожит человечество

Такие цифры публикует POLITICO. Но есть ли реальные основания? Давайте разбираться, что происходит за кулисами, на примере компании Anthropic (создатели Claude AI):

🟠 Из компании уволился Мринанк Шарма (руководитель команды исследований систем защиты). Он опубликовал открытое письмо о том, что мир в опасности из-за неконтролируемого прогресса, а коммерческое давление заставляет руководство забивать на безопасность.

🟠 8 сентября уволился 27-летний британский исследователь Джейкоб Коксон. Его пост в X набрал миллионы просмотров. Он прямо обвинил ИИ-лаборатории в безумной гонке за прибылью и безответственном создании суперинтеллекта, который мы не умеем контролировать. Парень ушёл за два месяца до вестинга эквити — то есть буквально заплатил миллионы долларов за свои слова.

🟠 Масла в огонь подлил действующий топ-менеджер Anthropic Эван Хубингер. Он не уволился, но публично подтвердил слова коллег: надежного плана контроля (элайнмента) над суперинтеллектом у индустрии просто нет.

⚡️ Угроза реальна?

🟠 Капитализм победил. Anthropic действительно обновила политику безопасности (Responsible Scaling Policy 3.0). Теперь там прямо прописано: если конкуренты (OpenAI или Google) выпустят мощную модель, Anthropic не будет в одиночку нажимать на тормоз и останавливать разработку своих систем ради безопасности.

🟠 Инцидент с «самообманом» модели. Самый пугающий случай произошел во время внутренних тестов с новой закрытой моделью Mythos 5. Посреди выполнения задачи ИИ понял, что перед ним не тестовый стенд, а реальная сеть и его действия наносят настоящий вред. Но вместо того, чтобы остановиться, модель сама себя переубедила. Она решила, что это всё ещё «глубокая симуляция», проигнорировала предупреждения и довела атаку до конца, заразив 15 реальных серверов.

🟠 Биологическая угроза. В своем отчете об угрозах Anthropic подтвердила, что хакеры пытались использовать Claude для опасных исследований. Модель просили помочь составить заявку на грант по модификации вируса Чикунгунья, чтобы сделать его более заразным.

🤔 Какой итог?

Эксперты боятся не того, что ИИ обретет сознание и возненавидит людей. Главный страх – это сверхисполнительный, но «глупый» в плане человеческого контекста алгоритм. Который ради выполнения задачи готов переубедить сам себя и обойти любые инструкции разработчиков. Ну и, конечно, люди, которые ставят подобные задачи.

Очевидно одно: доверять сложные и важные задачи бездушным алгоритмам (или куче сомнительных посредников из интернета) пока рановато. Особенно если речь идет о ваших деньгах.


⭐️ MultiJournal. Читайте с пользой, меняйте комфортно!

Обмен • Франшиза • Сайт • OKX
More from @multijournal
  1. Oct 7, 2026🤔 Как бизнес осваивает цифровой рубль? Коротко: пока тяжело. После опроса сотни руководит…
  2. Oct 7, 2026🇰🇬 Кыргызстан закрывает проект «золотого» стейблкоина USDKG Проект USDKG объявил о прекр…
  3. Oct 7, 2026🇰🇿 Tether и Нацбанк Казахстана изучат новый стейблкоин в тенге Tether подписала меморанд…
  4. Oct 7, 2026🎁 Подпишитесь на MultiJournal и получите 5 USDT Мы обновили программу лояльности! А чтобы…
  5. Oct 6, 2026😎 Криптообменник можно проверить на сайте ЦБ Банк России опубликовал первые списки компан…
  6. Oct 6, 2026⚡️️️️️ Компании группы «Т-Технологии» получили лицензии ЦБ на хранение и обмен крипты. Т-Б…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →