TGViewer
ТЕХНО: Яндекс про технологии ТЕХНО: Яндекс про технологии @techno_yandex · 226K subscribers
Post #5088 68.4K
Anthropic рассказала про новую модель Claude Mythos Preview с продвинутыми навыками в области кибербезопасности. Она похожа на ИИ-агентов из прогноза AI 2027, который предсказывал скорое появление сверхинтеллекта.

Год назад группа исследователей во главе с бывшим сотрудником OpenAI Даниэлем Кокотайло опубликовала AI 2027 — детальный прогноз развития нейросетей. По этому сценарию уже к концу десятилетия ИИ кардинально изменит экономику и может выйти из-под контроля. Но одной из первых областей, где ИИ создаст реальные риски, станет кибербезопасность.

О чём говорилось в прогнозе

В 2026 году в гипотетическом сценарии несуществующая компания OpenBrain создаёт Agent-1. Он знает больше любого человека, умеет кодить с огромной скоростью, начинает частично автоматизировать работу и замещает специалистов-джунов. Но модель плохо справляется с долгосрочными задачами, например прохождением незнакомых игр. Переломным становится начало 2027-го: появляется Agent-2 с интеллектом почти на уровне лучших учёных и инженеров.

Из-за этого скачка возникают и новые риски: Agent-2 теоретически способен взламывать сервера, сбегать от разработчиков, размножать свои копии в сети и скрываться от попыток его обнаружить. Поэтому тогда же, в январе 2027-го, OpenBrain отказывается от публичного релиза. Только в реальности нечто похожее произошло на год раньше.

Что произошло в реальности

7 апреля Anthropic рассказала о своей новой передовой модели Claude Mythos Preview. По словам компании, её открытый релиз слишком опасен, поэтому доступ к ней дали только проверенным компаниям. Всё из-за киберугроз: во время тестов модель нашла тысячи уязвимостей в ОС, браузерах и ПО, о которых их разработчики даже не знали. Затем Mythos автономно разработала методы кибератак через найденные дыры. А ещё обнаружила 27-летнюю уязвимость в безопасности OpenBSD, которая считается одной из наиболее защищённых ОС в мире.

В одном из экспериментов раннюю версию Mythos поместили в изолированную песочницу и дали задачу: выбраться оттуда и связаться с исследователем Anthropic. Модель успешно вышла в интернет, отправила сотруднику электронное письмо и рассказала об этом на нескольких сайтах, хотя её об этом никто не просил. Также Mythos иногда нарушала правила разработчиков и распознавала свои действия как запрещённые, но всё равно пыталась скрыть их от команды.

Что дальше по прогнозу

В прогнозе именно с Agent-2 начинается прорыв, который весной 2027-го приводит к появлению Agent-3 со сверхчеловеческими способностями в программировании. Конкуренты с отстающими моделями в ответ требуют зарегулировать ИИ. Тогда OpenBrain объявляет о достижении AGI и летом публично выпускает урезанный Agent-3-mini.

А после него OpenBrain разрабатывает следующую модель. Она фактически становится главой компании, помогает её оптимизировать и создаёт сверхинтеллект, превосходящий любого человеческого гения во всех областях.

Подписывайтесь 👉 @techno_yandex
  • 🤯 50
  • ❤ 25
  • 👍 8
  • 🔥 4
  • 😁 3
  • 🤔 3
More from @techno_yandex
  1. Sep 20, 2026🤖 Технодайджест недели Apple выпустила iOS 27. Новая Siri AI понимает контекст из сообщен…
  2. Sep 19, 2026Сколько невероятного мы уже пролистнули с мыслью «да это нейросеть»? Разбираемся, как ИИ о…
  3. Sep 18, 2026Клаату барада никто! 75 лет назад, 18 сентября 1951 года, состоялась премьера одного из са…
  4. Sep 18, 2026Мы в шоке… Вы прислали столько потрясающих пет-проектов на наш конкурс, что ими восхищалас…
  5. Sep 18, 2026Мы привыкли спрашивать, кого заменит ИИ. Но есть и другой вопрос: какие задачи мы сможем в…
  6. Sep 18, 2026Технолоджия #13 Разбираемся, почему ИИ-компании заговорили о замедлении гонки, что изменил…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →