Бурное развитие ИИ стало возможно благодаря накоплению огромных массивов данных, на которых и обучаются различные нейросети, по типу ChatGPT или YandexGPT. И это при том, что текущие технические возможности ограничивают размеры хранилищ данных, так и скорость доступа к ним. Вот тут писал, как эти ограничения пробуют преодолеть
https://t.me/aipolitics/22
Однако чтобы обработать данные, их нужно как-то получить. С одной стороны эпоха оцифровывания всего и вся сама по себе генерирует бесконечное число данных. С другой стороны, эти данные могут носить конфиденциальный характер.
Не секрет, что многие технологические компании собирают данные для своих целей. Мы уже привыкли, что после одного поискового запроса какого-то товара нас начинают преследовать рекламные баннеры.
Но что если наши персональные данные будут использованы для обучения ИИ? К примеру, Google объявила, что собирается обучать ИИ на любых общедоступных данных пользователей, т.е. на всем, что каждый из нас оставит в сети, пусть это будет пост с философскими мыслями или же фото.
Гугловская языковая модель Bard теперь имеет доступ к Gmail, Drive и YouTube. Как заверяет компания, чат-бот будет искать в сервисах Google ответы на вопросы с разрешения пользователя, которое при желании можно отозвать. Данные обещают не использовать для обучения ИИ.
Однако, я бы не стал сильно верить в такие заверения. Разработчики ChatGPT тоже заверяли, что обучали свою модель только на публичных данных, что не спасло их от исков за использование чужих данных.
Бывший Твиттер, став сетью X объявил, что начнет собирать информацию о работе, образовании и иных данных пользователей, не скрывает, что эти данные будут использованы для обучения ИИ.
Интересное время — информация о человеке становится более ценной, чем сам человек.
Post #42
168

- ❤ 2