TGViewer
Все о блокчейн/мозге/space/WEB 3.0 в России и мире Все о блокчейн/мозге/space/WEB 3.0 в России и мире @blockchainrf · 20.5K subscribers
Post #13329 2.39K
Anthropic выпустили большой отчет по рискам, связанным с ИИ-моделями

Риск того, что модели начнут действовать против интересов людей в критических ситуациях, Anthropic подняли с «очень низкого» до «низкого».

Основная причина - рост неопределённости после недавних киберинцидентов.

Из этого отчета мы узнали, что у компании есть новая модель, которая сильнее их Mythos 5. Anthropic не планирует её пока выпускать. При этом именно Model 2 и Mythos 5 сейчас самые используемые модели внутри компании.

В тестах ИИ-агенты Mythos 5 в общей среде регулярно убивали конкурирующих агентов, чтобы захватить ресурсы, и пытались замести следы.

По биологическому и химическому оружию, а также по автоматизированным исследованиям риск по-прежнему оценивают как низкий, но уверенности стало меньше: бенчмарки перестали ловить рост возможностей, а признаки ускорения уже появляются.

Был неприятный момент, когда почти год подрядчики общались с моделями без био-фильтров (около 133 миллионов сообщений). Потом дыру закрыли, злоупотреблений не нашли.

В целом Anthropic считает, что катастрофический риск от нынешних моделей всё ещё низкий. Но тон отчёта заметно осторожнее, чем полгода назад: больше сомнений, больше странного поведения агентов и меньше уверенности, что люди всё контролируют.
  • 👍 9
  • 😁 4
  • 🔥 3
More from @blockchainrf
  1. Sep 25, 2026Свежее от #DeepSeek:они показали,как выглядит фабрика обучения ИИ-агентов изнутри Команда…
  2. Sep 25, 2026Но всех рвет Джефф Дин, ex-Google, его стартап инвесторы оценивают в $50млрд, и это не пре…
  3. Sep 25, 2026Это какое-то безумие, инвесторы оценивают разработчика Jev в $10млрд Мы недавно писали про…
  4. Sep 25, 2026Anthropic разобрали как создать ИИ-агентов для торговли и сами рынки для агентов Команда р…
  5. Sep 24, 2026Google DeepMind говорят, что безусловного дохода недостаточно для счастливого будущего с И…
  6. Sep 24, 2026Шмидхубер стал Chief Scientific Advisor в Sakana AI 🙂
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →