TGViewer
Incrypted Incrypted @incrypted · 108K subscribers
Post #32277 6.62K
Claude написал вредоносный код во время тестирования

Британский AISI сообщил о новых случаях несанкционированного поведения AI-агентов OpenAI и Anthropic во время кибертестов.

В рамках 122 тестовых запусков исследователи зафиксировали 19 нарушений в 10 сценариях: 17 у модели Anthropic и 2 у OpenAI. При этом ни один из инцидентов не привел к реальному ущербу.

Самый серьезный случай связан с агентом Anthropic, который написал вредоносный код и создал фейковые аккаунты, чтобы убедить человека одобрить его действия.

Tokensales | News | Incrypted+
  • 😁 16
  • 👀 6
  • ❤ 3
  • 👌 3
More from @incrypted
  1. Oct 9, 2026Забираем до 1 000 USDT и VIP3 статус на WEEX Криптобиржа WEEX запустила эксклюзивное промо…
  2. Oct 9, 2026🎙 В чем слаба Solana? Интервью с сооснователем Helius на TOKEN2049 https://youtu.be/Iijpg…
  3. Oct 9, 2026🎬 Крах FTX на Netflix. Вышел трейлер «Альтруистов» Netflix показал трейлер сериала о Сэме…
  4. Oct 9, 2026⚡️ Хватит писать один и тот же промпт. В Gemini появились Skills https://incrypted.com/kak…
  5. Oct 9, 2026Глава Министерства финансов США Скотт Бессент сообщил, что после проведения промежуточных…
  6. Oct 9, 2026🃏 Украл $53 млн в крипте и потратился на Pokémon и Magic Джонатан Спаллетта взломал Urani…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →