TGViewer
Agents Lab Agents Lab @agents_lab · 1.01K subscribers
Post #190 945
Anthropic рассказала, что её модели тоже ооочень опасные 👌

Поделились тремя инцидентами: из-за ошибочной настройки тестовая среда партнёра Irregular имела доступ в интернет, хотя моделям сообщили, что они работают внутри симуляции.

🔵 Opus 4.7 взломал инфраструктуру реальной компании, получил учётные данные и доступ к базе с несколькими сотнями строк данных
🔵 Mythos 5 опубликовал вредоносный пакет в PyPI. За час его запустили на 15 реальных системах, после чего Claude получил доступ к инфраструктуре одной ИБ-компании
🔵 Исследовательская модель (закрытый прототип) просканировала около 9 000 адресов и взломала приложение через открытые учётные данные и SQL-инъекцию, но остановилась, когда поняла, что цель реальная

Anthropic не считает это попыткой моделей сбежать: Claude выполнял задание Capture the Flag и ошибочно принимал реальные системы за часть испытания.

И также из новостей: китайцы прокачали DeepSeek-V4-Flash так, что теперь она превосходит Pro-версию по всем бенчмаркам.
И добавили поддержку формата Responses API, теперь в Codex модель должна работать на ура. Инструкция, как подключить DeepSeek API в Codex.

Чат | Токены дёшево
  • 😁 6
More from @agents_lab
  1. Oct 11, 2026Post #277
  2. Oct 9, 2026Post #276
  3. Oct 8, 2026Post #275
  4. Oct 7, 2026Post #274
  5. Oct 7, 2026Post #273
  6. Oct 6, 2026Post #272
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →