TGViewer
Анализ данных (Data analysis) Анализ данных (Data analysis) @data_analysis_ml · 51.4K subscribers
Post #5929 2.9K
🔐 Проектируйте ИИ-систему так, будто модель уже скомпрометирована.

Такой подход предлагает глава Microsoft Сатья Наделла: рассматривать модели как потенциальный внутренний риск, особенно когда им доступны данные, инструменты и выполнение действий.

Поставить второго ИИ следить за первым недостаточно: можно получить один чёрный ящик, проверяющий другой. Контроль должен существовать и за пределами моделей.

Что это означает на практике:

• Права задаёт система. Модель не определяет сама, какие ресурсы ей доступны.
• Действия оставляют проверяемый след. Логи должны быть защищены от изменения агентом.
• Аудит независим. Агент не должен одновременно действовать и контролировать доказательства корректности своих действий.
• Есть аварийная остановка. Уполномоченный человек может прервать работу посреди задачи.
• Тестируются и провалы: атаки, ошибки, пограничные случаи и изменения окружения.


https://x.com/satyanadella/status/2108931348857827686
  • 🔥 15
  • 👍 9
  • ❤ 8
  • 😁 6
  • 👏 4
  • 🤔 4
  • 🎉 3
  • 💯 3
More from @data_analysis_ml
  1. Oct 11, 2026Anthropic втихую арендует мощности у бывшего биткоин-майнера IREN, а инференс может принос…
  2. Oct 11, 2026🦀 Альтернатива Word на Rust, которой могут управлять ИИ-агенты WordCraft повторяет знаком…
  3. Oct 10, 2026🧠 Xiaomi потратила около $2,6 млн на этап обучения MiMo через попытки, ошибки и обратную…
  4. Oct 10, 2026🤖 Claude отправил в полицию выдуманную наводку по делу об убийстве. Во время тестирования…
  5. Oct 9, 2026✔️ Qwen выложили Turbo-версию своей картиночной модели: 2K-изображение и редактирование те…
  6. Oct 9, 2026🔎 Perplexity открыла компактную модель для поиска по текстам и изображениям pplx-embed-v2…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →