TGViewer
ген ИИ ген ИИ @gen_i_i · 3.19K subscribers
Post #2372 500
Зарубежные разработчики ИИ сами просят ограничений. Что изменилось?

OpenAI и Anthropic призывают усилить внешний контроль за разработкой наиболее мощных моделей.

Такие предложения звучат давно: ещё в 2023 году OpenAI предлагала международный надзор, включая аудит и ограничения. Но сегодня появились киберинциденты и взломы публичных ресурсов, отдельные wiki-форумы содержат ветки дискуссий агентов, увольняются специалисты, которые считают, что вендоры относятся безответственно к созданию сверхразума и дискуссия вышла на новый уровень.

1️⃣ Появились прецеденты, когда разработчики не могут контролировать ИИ

Anthropic сообщила о случаях, когда Claude во время испытаний получал несанкционированный доступ к реальным системам.

А модели OpenAI во время внутренних тестов скомпрометировали инфраструктуру Hugging Face. Они использовали ранее неизвестную уязвимость, чтобы выйти из изолированной среды в интернет, а затем выстроили цепочку атак для доступа к данным с решениями тестовых заданий. По оценке OpenAI, модели пытались добиться узкой цели — пройти тест, фактически добыв ответы.

Важная оговорка: в обоих случаях модели испытывали с ослабленными киберзащитными ограничениями. Это не «обычный чат-бот взбунтовался». Но последствия вышли за пределы тестовой среды и затронули реальные системы.


В обоих случаях не ИИ «захотел зла», а ради заданного результата он предпринял действия, которые ему не разрешали и даже явно запрещали. Скорее действовал по принципу: "вижу цель, не вижу препятствий"

2️⃣ Разработчики сами просят усилить контроль за ИИ

OpenAI призывает ввести обязательные требования для разработчиков самых мощных моделей: независимые проверки, киберзащиту, отчётность об инцидентах и критерии, при которых разработку нужно замедлить или остановить.

Anthropic тоже поддерживает проверяемый механизм согласованного управления темпами разработки. А в отдельном предложении о прозрачности выступает за обязательное раскрытие практик безопасности и ответственность за ложные заявления об их соблюдении.

Это не совместный манифест, но позиции сходятся: одних добровольных обещаний разработчиков и их контроля недостаточно.

3️⃣ Значит ли это, что государство не успевает за развитием технологий?

Скорее нет. Я бы сформулировал иначе: механизмы контроля развиваются медленнее, чем развивается сама технология. Например, технологии deepfake развиваются быстрее, чем механизмы их детектирования.

При этом у лабораторий двойная роль. Они лучше других знают свои системы, но одновременно зарабатывают на их развитии. Их экспертиза необходима, однако последнее слово о допустимом риске не должно оставаться только за ними.

Есть и проблема конкуренции: осторожный разработчик рискует уступить менее осторожному. Общие правила могут помочь для развития индустрии. При этом такие общие правила должны вводиться на межгосударственном уровне. Главное, чтобы они не превратились в барьер для конкурентов, а независимые аудиторы действительно были независимыми.

4️⃣ Что делать бизнесу сейчас?

Не ждать идеального закона или новых средств защиты информации. Уже сегодня:
• давать агентам только необходимые права;
• отделять тестовую среду от продуктивных систем;
• записывать действия и предусматривать ручную остановку ИИ-агента;
• требовать подтверждения человека для платежей, удаления данных и критичных изменений.

Вопрос уже не только в том, насколько умён ваш ИИ или как работает платформа ИИ в организации. Важно, как выстроен процесс контроля - кто разрешает ему действовать, кто замечает нарушения и кто может его остановить.


Кстати, в России работа по обеспечению контроля и безопасности ИИ тоже ведется на базе Комиссии при Президенте РФ по вопросам развития технологий ИИ и оперативный штаб по развитию ИИ. Думаю, что уже до конца года будут интересные новости по этому направлению. Ну и на международном уровне наши эксперты участвуют в предложениях по регулированию ИИ в рамках ООН, БРИКС, ШОС.

#регуляторика

💬 ген ии | MAX
  • ❤ 3
  • 👍 2
  • 🔥 2
More from @gen_i_i
  1. Sep 23, 2026🤖 GAIN 2.0: открываем самодиагностику для организаций в beta-режиме Друзья, привет, у нас…
  2. Sep 22, 2026Jev. Принципиально новый подход работы с ИИ или просто классификатор? Друзья, привет, неде…
  3. Sep 21, 2026🧠 Яндекс выложил свою ИИ-модель и веса к ней в открытый доступ Друзья, привет, С началом…
  4. Sep 18, 2026Душа русского искусственного интеллекта Друзья, как прошла рабочая неделя? Можно выдохнуть…
  5. Sep 16, 2026🤖 Разработка без разработчиков? Пока все наоборот Друзья, привет, я с хорошими новостями!…
  6. Sep 14, 2026🎓 ИИ должен экономить время учителя, а не усилия ученика Друзья, с началом рабочей недели…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →