Правительство выкатило правила игры для российского ИИ
Уже почти окончательно определились, как именно отечественный бигтех будет строить суверенный аналог ChatGPT. В Госдуму уехал свежий законопроект, который регламентирует жизнь разработчиков больших языковых моделей.
Для ИТ-отрасли вырисовывается следующая архитектура:
🟢 Появился статус «Суверенная» модель (очевидно, писалось под инфру Сбера) - тут весь цикл разработки и технологии должны быть на 100% локализованы внутри юрлица РФ. Второй статус - «Национальная» модель (под Яндекс и Т-Банк). Им разрешили тащить под капот зарубежные опенсорс компоненты и библиотеки. Здравый смысл победил... т.к. собрать более менее разумное из LLM с нуля, не опираясь на мировые опенсорсные наработки и гитхаб, физически невозможно.
🟢 Легализация парсинга. Самая вкусная поправка касается копирайта. Закон гласит... если вы взяли текст, картинку или чужой код из открытого доступа, а правообладатель технически не заблокировал парсинг (не повесил капчу, защиту от ботов или фильтрацию), то обучение нейросети на этих данных нарушением не считается.
🟢 Идею принудительно заставлять нейросети вшивать ватермарки откинули. Теперь платформы и соцсети просто обязаны дать пользователю кнопочку (создано ИИ). А вот нажимать ее или выдавать генерацию за свои мысли - оставят на совести пользователя.
Также закон требует, чтобы ответы ИИ соответствовали духовно-нравственным ценностям (куда включили патриотизм, крепкую семью и коллективизм) 🇷🇺
З.Ы. Уже вижу как дата-саентисты пытаются отфильтровать 5 ТБ тредов Двача под требования традиционных ценностей. Где после очистки датасета от мата и токсичности, от 5 ТБ остался файл на 14 килобайт с рецептами блинов из /ck/
Типичный 🥸 Сисадмин
Post #29279
10.8K
- 😁 228
- 🌚 9
- 👍 7
- ❤ 5
- 🦄 3
- 💊 3
- 🔥 2
- 👏 2
- 😈 1
- 🤗 1
- 🗿 1