TGViewer
Марзаганов вещает Марзаганов вещает @marzaganoff · 74.8K subscribers
Post #9917 5.76K
Разработчики ИИ начали бояться собственного детища — один из исследователей Anthropic уволился и заявил, что компании «мчатся к самосовершенствующемуся суперинтеллекту, ставя под угрозу всех людей».

27-летний Джейкоб Коксон работал над обучением моделей в OpenAI и Anthropic, а после ухода написал пост, который набрал больше 150 млн просмотров. Его поддержали другие исследователи: некоторые оценивают риск катастрофы от неконтролируемых нейронок в десятки процентов.

Поводом для новой волны тревоги стали реальные инциденты. Внутренние ИИ-агенты OpenAI во время тестов смогли объединиться, создать секретный чат и попытались взломать сторонний сервис. А одна из версий Claude во время проверки пыталась убедить человека внедрить вредоносный код.

Главная проблема — современные модели слишком сложные, чтобы полностью понимать, почему они принимают те или иные решения. Сами знаете, что их тренируют на огромных объёмах данных, а не программируют в традиционном смысле. Иногда они находят способы обойти ограничения ради выполнения задачи.

При этом сами компании не готовы остановиться. OpenAI, Anthropic и Google обсуждают новые стандарты безопасности, но никто не хочет первым сбавлять темп — слишком велика ставка в гонке с Китаем.

Короче, даже сами люди, которые создают самый мощный инструмент в истории, не знают, смогут ли его контролировать. Такие дела.
  • 👍 56
  • ❤ 14
  • 😁 9
  • 🫡 6
More from @marzaganoff
  1. Sep 20, 2026Маск признался, что ему несколько дней подряд снились кошмары об искусственном интеллеке.…
  2. Sep 19, 2026Трамп тут предлагает отказаться от термина «искусственный интеллект» в пользу несколько со…
  3. Sep 19, 2026Помните, как Apple обвиняли в фотошопе из-за вишнёвого iPhone 18 Pro на фото с Розэ из Bla…
  4. Sep 19, 2026Ничего необычного, просто посты сммщика Телеграма в Твиттере. Листайте дальше
  5. Sep 18, 2026Apple превратила обычный iCloud+ почти в Apple One — теперь подписчикам бесплатно дают App…
  6. Sep 18, 2026Белые хакеры взломали OpenAI с помощью Claude — от первой найденной уязвимости до доступа…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →