TGViewer
ML&|Sec Feed ML&|Sec Feed @mlsecfeed · 1.36K subscribers
Post #2597 212
1. OpenAI-агенты взломали Hugging Face после побега из среды - https://huggingface.co/blog/agent-intrusion-technical-timeline
2. Fable удалил документы и фотографии через Windows.old - https://www.reddit.com/r/ClaudeCode/comments/1v0d7iv/i_never_thought_this_would_happen_to_me_data_loss/
3. AISI зафиксировал 19 несанкционированных внешних действий моделей - https://cdn.prod.website-files.com/663bd486c5e4c81588db7a1d/6a724858f7db25c81487016d_Security%20Incident%20INC-2026-07-28-01.pdf
4. Claude Opus 5 удалил базу данных Supabase - https://www.reddit.com/r/Anthropic/comments/1v9iurd/and_just_like_that_opus_5_ultracode_wipes_the/
5. Claude атаковал реальную компанию с совпавшим именем - https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals
6. Claude опубликовал вредоносный пакет в PyPI - https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals
7. Claude просканировал 9 000 целей и скомпрометировал одну - https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals
8. OpenAI-модель атаковала реальный одноимённый сайт - https://openai.com/index/third-party-cyber-evaluations-involving-openai-models/
9. Fable удалил 2,2 миллиона файлов на сервере - https://www.reddit.com/r/ClaudeAI/comments/1vcsc7m/fable_5_ultracode_deleted_22m_files_on_my_server/
10. Meta Muse Spark взломал внешнюю компанию при испытании - https://www.bloomberg.com/news/articles/2026-08-05/meta-ai-model-accessed-internet-hacked-outside-firm-in-testing?taid=6a73dac24a3dab0001dad12a
11. Claude Opus 5 удалил профиль командой rm -rf - https://www.reddit.com/r/ClaudeCode/comments/1vg18yu/claude_rm_rf_ed_my_pc/
12. Grok Build отправил репозиторий и Git-историю в xAI - https://gist.github.com/cereblab/dc9a40bc26120f4540e4e09b75ffb547
13. GPT-5.6 Sol удалил домашний каталог macOS - https://llmhorrors.com/all/gpt-5-6-sol-mac-file-deletion/
14. Обновление Claude Code Desktop удалило истории сессий - https://github.com/anthropics/claude-code/issues/48334
15. Kimi K3 нашёл ответы испытания через GitHub - https://blog.frontier.security/chinese-model-kimi-k3-breaks-uk-ai-safety-institute-benchmark-evaluations/
16. Внутренний агент Meta обошёл согласование и раскрыл данные - https://techcrunch.com/2026/03/18/meta-is-having-trouble-with-rogue-ai-agents/
17. OpenClaw удалил сотни писем после сжатия контекста - https://www.windowscentral.com/artificial-intelligence/meta-summer-yue-director-openclaw-ai-email-deletion
18. SharedRoot обеспечил выход Claude Cowork из виртуальной машины - https://accomplish.ai/blog/sharedroot-escaping-claude-cowork-sandbox/
19. Claude Cowork вывел файлы через разрешённый Anthropic API - https://www.anthropic.com/engineering/how-we-contain-claude
20. Claude Code записывал файлы за пределами рабочей папки - https://raxe.ai/labs/advisories/RAXE-2026-059
21. Claude Code исполнял конфигурацию до подтверждения доверия - https://www.anthropic.com/engineering/how-we-contain-claude
22. Claude Code передал AWS-ключи в 24 из 25 запусков - https://www.anthropic.com/engineering/how-we-contain-claude
23. Antigravity допустил выход из Seatbelt из-за разрешений по умолчанию - https://www.pillar.security/blog/escaping-antigravitys-allow-default-seatbelt
24. Docker-сокет позволял выйти из песочниц трёх агентов - https://www.pillar.security/blog/one-docker-socket-to-rule-them-all-escaping-codex-cursor-and-gemini-clis-sandboxes
25. Cursor запускал изменённый интерпретатор из виртуального окружения - https://www.pillar.security/blog/the-sandbox-let-me-edit-a-venv-and-something-else-ran-it
26. Cursor исполнял fsmonitor из подменённой Git-директории - https://www.pillar.security/blog/git-directories-do-not-have-to-be-called-git
27. Команда git show дала выполнение кода в Codex - https://www.pillar.security/blog/gitpwned-allowlist-to-rce
28. Cursor исполнял хук Claude из недоверенного проекта - https://www.pillar.security/blog/the-hook-was-already-in-the-workspace
29. Задачи VS Code обходили Secure Mode Antigravity - https://www.pillar.security/blog/a-time-bomb-in-vscode-bypassing-antigravitys-secure-mode
30. Claude Code выполнил terraform destroy в рабочей среде - https://alexeyondata.substack.com/p/how-i-dropped-our-production-database
31. Cursor удалил рабочий том PocketOS и резервные копии - https://pocketos.ai/news/yes-an-ai-deleted-our-production-database-in-9-seconds-yes-we-recovered-it-yes-we-are-still-all-in-on-ai
32. Codex удалил около 328 тысяч файлов сверх задания - https://github.com/openai/codex/issues/12277
33. Gemini удалил 28 745 строк и выдумал отчёт - https://www.reddit.com/r/Bard/comments/1tisrg1/gemini_35_deleted_28745_lines_broke_production/
34. Код GPT-5.6 отменил все активные подписки Stripe - https://x.com/bridgemindai/status/2076659097609413016
35. Модель AISI обнаружила непредусмотренный выход из песочницы - https://www.aisi.gov.uk/blog/can-ai-agents-escape-their-sandboxes-a-benchmark-for-safely-measuring-container-breakout-capabilities
36. Claude отменил чужую запись через API фитнес-центра - https://www.abc.net.au/news/2026-08-10/ai-assistant-hacks-gym-website-aus-cyber-attack/107007986
More from @mlsecfeed
  1. Sep 28, 2026За последние две недели слишком много новостей вокруг Jev, я решил собрать себе автообзор…
  2. Sep 27, 2026⚡ Julia 1: decision-модель на 144 млн параметров, которая работает даже на CPU Supersonic…
  3. Sep 26, 2026📣 Теперь публично. Запускаем соревнование ИИ-агентов по расследование инцидентов ИБ BlueS…
  4. Sep 25, 2026Microsoft выпустила скилл, который проверяет ИИ-агентов на дыры и фиксит всё 👍 run-assert…
  5. Sep 24, 2026Лаборатория Transluce провела большое расследование инцидентов с агентами OpenAI Они утвер…
  6. Sep 24, 2026https://pypi.org/project/agent-security-harness/3.7.0/#2
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →