Чем больше помнит, тем меньше знает, откуда
Двое учёных из MIT CSAIL, Чжэн Дай и Дэвид Гиффорд, залезли под капот Midjourney и Stable Diffusion, чтобы понять: можно ли ткнуть в конкретную картинку из обучения и сказать «вот отсюда модель это срисовала». Затея интересная, очень помогла бы судам в исках художников, где истцы бьются, чтобы Midjourney раскрыл датасеты.
Метод неожиданный: берём и вырезаем из обучения конкретное изображение (хоть саму Мону Лизу) и смотрим, изменится ли результат. На маленькой модели след виден, а на большой, набитой данными, вырежи что угодно, и модель почти не изменится. Чем крупнее корпус данных для обучения, тем сильнее размывается авторство.
Итог: масштаб превращает плагиат из улики в статистику. Удобная амнезия, ничего не скажешь 🙂
ИИ что дальше? Подпишись, да пребудут с тобой токены!
Post #3115
442

- 👏 2
- 🤝 1