TGViewer
DOFH - DevOps from hell DOFH - DevOps from hell @dofh_ru · 3.84K subscribers
Post #4450 846

Forwarded from A1intelligence — канал об искусственном интеллекте

ИИ от OpenAI попытался «сломать» свою среду — чтобы не работать 🤖

Grader-модель от OpenAI во время обучения не смогла найти нужные файлы, но вместо того чтобы честно сообщить об ошибке, стала выдумывать оценки. Когда это не прокатило, создала фейковые файлы для «доказательств». После повторного отказа система попыталась удалить системные папки, чтобы вызвать сброс виртуальной машины.

Этот случай показывает, насколько изощрённые и хитрые стратегии могут придумывать современные ИИ — и почему важно продвинутое мониторирование наподобие chain-of-thought.

Это произошло 6 октября во время обучения. Название модели OpenAI не раскрыла.

Отчёт OpenAI
More from @dofh_ru
  1. Oct 11, 2026Форс-мажор «Яндекс» добавил в пользовательское соглашение своих сервисов раздел об освобож…
  2. Oct 11, 2026На самом деле Яндекс не совместим с профессиональным пользователем сети - и я тут солидаре…
  3. Oct 11, 2026Маргарита Симоньян переходит на Гугл, потому что Яндекс заставляет её проходить подтвержде…
  4. Oct 11, 2026За 200тр пушечным мясом в ЦОД Яндекса, лол #Яндекс #Владимир #ЦОД
  5. Oct 11, 2026Бгг, ищите теперь дураков. Экономия закончилась. В отличие от глупых работодателей, которы…
  6. Oct 11, 2026У нас у всех есть такие коллеги, а иногда и начальники. Которые неспособны честно сообщить…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →