TGViewer
Mourning Espresso Mourning Espresso @mourning_espresso · 48 subscribers
Post #11 217
Аарон Шварц
YouTube | Подкаст | Слушать

25 сентября 2010 года Аарон Шварц, уже на тот момент великая интернет-личность, вошел в кампус MIT c новеньким ноутбуком. Он зарегистрировался в университетской сети под ником Gray Host и подключился к JSTOR — глобальному закрытому репозиторию научных статей. Аарону нужны были эти статьи: он хотел сделать содержимое JSTOR, гигантский массив данных, публичным. Зная слабые места в системе и пользуясь наплевательским отношением университета к защите данных, он начал выкачивать данные. Это было нелегко. В первую очередь потому, что JSTOR сам по себе с трудом выдерживал нагрузку. В процессе Шварцу блокировался доступ в сеть, потом JSTOR блокировал все подсети MIT, но шатко-валко, удалось выкачать около 80% всей базы данных. Почти 5 миллионов документов.

Шварца обвинили по 13 статьям, но отсидеть он не успел — покончил жизнь самоубийством 11 января 2013 года.

6 февраля 2025 года компанию Meta уличили с скачивании 82 терабайт данных с пиратских сайтов. Это более, чем на порядок больше того, что скачал Шварц. Это почти весь объем информации с SciHub, Libgen, Anna Archive и кучи других пиратских сайтов. Компания потратила почти 4 недели на постоянное скачивание из сети на максимально широких каналах.

Кажется, сами ИИ-компании и не спорят с тем, что скачивали все эти документы. Как не спорят с тем, что обучались на характерных аниме, дабы генерировать удивительно похожие картинки. Что удивительно — кажется, это действительно все законно, но только в очень узких рамках, из которых компании начинают выпадать.

Весь мировой копирайт держится на Бернской конвенции 1886 года, которая провозглашает интернациональную защиту авторских прав. По этой конвенции, автор может сам диктовать условия распространения своего произведения. Бернскую конвенцию ратифицировали почти все страны мира, так что ее положения можно назвать универсальными правилами.

Однако эта конвенция допускает ряд исключений, когда разрешением автора на использование произведения можно пренебречь, но только в очень узких рамках. В каждой стране эти рамки различны, но так как почти все ИИ-компании работают по законам США, то нам интересно, что у них. Их свод исключений называется Fair Use, добросовестное использование. Он большой, но в целом разрешает копирование в том случае, если автор не ущемляется в правах и, главное, ему не наносится прямой материальный ущерб.

Есть такой интересный пример: Гильдия Авторов против Гугла, которая судилась с корпорацией за то, что те показывали те самые сниппеты с ответами, цитируя материалы под копирайтом. Суд оправдал Гугл тем, что компания особым образом отмечала цитируемые произведения в сниппетах, тем самым создавая им дополнительную рекламу, как визуальную, так и продвигая их своей репутацией как более авторитетные источники. Ни один автор не смог доказать падения продаж, но были курьезные улучшения.

Такова позиция ИИ-компаний в суде: они говорят, что это Fair Use, поскольку ИИ не цитирует документы напрямую, и даже не создает очевидные деривативные произведения. Нельзя однозначно сказать, на основе каких данных модель решила ответить именно так. Даже в случае с Гибли, возможность генерировать картинки в стиле студии не приводит к падению продаж их произведений.

Чтобы понять шаткость Fair Use, приведу другой пример. Повсеместной практикой ИИ-компаний стали предложения по поводу лицензирования контента для обучения моделей. Пишет OpenAI какому-нибудь блогеру, мол, запили нам 10 роликов за 10000 долларов. Кажется, отличная идея, однако само существование такого предложения разрушает аргумент Fair Use, и вот каким образом: так как компании предлагают деньги за материал для обучения, то это предполагает существование рынка платного контента. И использование материалов под копирайтом является уже не обучением, а незаконным втягиванием материалов в этот самый рынок, что карается законом.

Если посмотреть на существующие дела, то это основная позиция суда: даем грабить награбленное, пока вы никому не платите.

Наверное, не так плохо, что Аарон весь этот дурдом не застал.
More from @mourning_espresso
  1. Dec 31, 2025Между прочим, гражданин Огурец занят. Занят гражданин огурец важным делом: у него садик, с…
  2. Sep 5, 2025Алгорейв. Нет, не про собеседования YouTube | Подкаст | Слушать Вечеринка как вечеринка. Д…
  3. Aug 31, 2025Проект Stargate: бизнес как прыжок веры YouTube | Подкаст | Слушать Этот выпуск несколько…
  4. Aug 20, 2025Спроектируйте Твиттер: полифония наших голосов YouTube | Подкаст | Слушать Спроектируйте т…
  5. Jul 14, 2025Дартмутская конференция: мы забыли испугаться YouTube | Подкаст | Слушать Давайте представ…
  6. Jul 10, 2025Первый прецедент: Anthropic виновен YouTube | Подкаст | Слушать Некоторое время назад мы с…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →