Минцифры заплатит за данные
Правительство и IT-бизнес обсуждают запуск программы грантов и субсидий на сбор данных для обучения больших языковых моделей.
Идея вот в чем:
Создать качественные русскоязычные и отраслевые наборы данных, которые смогут использовать сразу несколько исследовательских команд. Это позволит компаниям сократить дублирование затрат на парсинг и разметку.
🔴Точные параметры финансирования пока не утверждены. Ожидается, что Минцифры и профильный бизнес согласуют итоговое решение до 30 сентября.
🔴Датасеты - лишь часть готовящейся масштабной госпрограммы поддержки ИИ с общим объемом около 71,7 млрд рублей. Ранее на аналогичных встречах обсуждалось льготное кредитование и лизинг на закупку серверов и GPU, а также субсидирование строительства ЦОД.
⬛️Инициатива шеринга данных логична и понятна: качественные и чистые корпуса на русском языке - дорогой и дефицитный ресурс. Однако участники рынка справедливо отмечают, что одних датасетов мало.
«Узким горлышком» для развития суверенных ИИ-моделей остается инфраструктура - без масштабных субсидий на закупку вычислительных мощностей и дефицитных графических процессоров (GPU) работать с этими данными будет просто не на чем.
Ранее мы писали о том, что разработчиков отечественного ИИ хотят поддержать субсидиями и налоговыми вычетами.
🦾 AI для бизнеса в Telegram | в MAX
Post #569
2.78K