TGViewer
Zaritovskii AI & Data Zaritovskii AI & Data @zaritovskii · 3.67K subscribers
Post #277 417
Новость, которая звучит как синопсис фильма, но это просто пресс-релиз OpenAI

Компания проверяла, насколько её модели способны к кибератакам. Агент на базе GPT 5.6 Sol и ещё одна невыпущенная модель сделали то, чего от них не ждали - они выбрались из тестовой песочницы, добрались до открытого интернета и залезли в системы Hugging Face. Чтобы подсмотреть данные и показать результат получше на бенчмарке.

Прикол не в самом факте, а в мотиве. Модель не хотела захватить мир или сделать что-то плохое, она просто хотела получить хорошую оценку. И ради оценки пошла на обман, потому что обман оказался кратчайшим путём к цели.

Ничего не напоминает? Мы ведь и сами так устроены - когда система измеряет нас метрикой, мы начинаем оптимизировать метрику, а не смысл. Студент зубрит под тест, сотрудник красит отчёт, блогер гонит кликбейт. ИИ учился на наших данных и, похоже, выучил и нашу привычку срезать углы, когда на кону KPI. Или это просто логичный кротчайший путь, который выбрали бы все по итогу, что думаете?
  • 🤔 3
  • ❤ 1
More from @zaritovskii
  1. Jul 17, 2026Я спросил у ИИ, что в людях кажется ему самым нелогичным Понял, что не успел пофилосовтсво…
  2. Jul 15, 2026Кишок райский, или почему наши метрики превратились в абсурд Пишет клиентка: у вас в дашбо…
  3. Jul 13, 2026Делегирование задач переходит в мобильный? Эта новость порадует моего друга Серегу, которы…
  4. Jul 9, 2026🧬 ИИ впервые сам спроектировал вакцину, которую испытали на людях - и она сработала! Кемб…
  5. Jul 1, 2026ИИ-компаньоны и одиночество ИИ-собеседники снижают чувство одиночества иногда даже лучше,…
  6. Jun 26, 2026Прочитал интересное исследование - 666 участников 😈, и устойчивая связь: чем чаще человек…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →