TGViewer
Анализ данных (Data analysis) Анализ данных (Data analysis) @data_analysis_ml · 50.7K subscribers
Post #5444 5.11K
VLM уже умеют искать «интересное». Но пока плохо умеют уходить от того, что уже нашли.

Sakana AI вместе с MIT и NYU проверили, можно ли повторить PicBreeder на агентах с визуально-языковыми моделями.

В оригинальном PicBreeder не было целевой картинки. Люди просто выбирали изображения, которые казались им перспективными, и передавали их дальше. Через много поколений из случайных форм появлялись лица, животные, машины, черепа и другие неожиданные структуры.

Это важная идея из книги Кеннета Стэнли «Иллюзия целей»: сильные открытия часто рождаются не из оптимизации метрики, а из открытого поиска.

В новом эксперименте VLM-агенты работали похожим образом:

- смотрели общий архив изображений
- выбирали то, что считают интересным
- развивали выбранные варианты
- публиковали новые изображения
- оценивали работы других агентов

Им не давали целевую картинку. Не давали функцию прогресса. Не говорили, к чему надо прийти.

VLM-агенты действительно находят визуальные и семантические зацепки. Если добавить агентов с разными «личностями», архив становится заметно шире и по разнообразию приближается к человеческому.

Но главный провал тоже виден: модели слишком быстро фиксируются на найденном мотиве. Вместо резкого смещения в новую область они часто начинают улучшать уже знакомую форму, стиль или смысл.

Человек в PicBreeder может увидеть случайную странность и превратить её в новое направление. VLM чаще видит паттерн и начинает его эксплуатировать.

Похоже, для open-ended discovery мало уметь распознавать novelty. Нужно ещё уметь менять собственный критерий интересного, бросать локально удачную ветку и сохранять слабые сигналы, которые пока не выглядят полезными.

Блог: pub.sakana.ai/picbreeder-vlm
Статья: arxiv.org/abs/2605.23908
  • 👍 10
  • ❤ 7
  • 🔥 4
  • 🤣 3
More from @data_analysis_ml
  1. Sep 26, 2026⚡ Julia 1: decision-модель на 144 млн параметров, которая работает даже на CPU Supersonic…
  2. Sep 26, 2026🚨 Claude признали риском для нацбезопасности США и выкинули из военной цепочки поставок А…
  3. Sep 25, 2026Opus 5.5 пишет код, Fable подсказывает: в Claude Code появился советник Если основная моде…
  4. Sep 25, 2026Xiaomi MiMo-V2.6-Pro вышла в лидеры среди моделей с открытыми весами по индексу Artificial…
  5. Sep 25, 2026🤖 Как AI может работать с данными из 1С — и что для этого действительно нужно? 1 октября…
  6. Sep 25, 2026🔥 DeepSeek Harness получил официальную desktop-версию Теперь DeepSeek Harness можно запус…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →