⛔ Разработка собственных языковых моделей в России сталкивается с препятствиями – эксперт
Создание конкурентных языковых моделей в части генеративного искусственного интеллекта в ТЭК осложнено несколькими факторами, рассказали эксперты на Евразийском нефтегазовом форуме.
Недостаток видеокарт. На всю Россию их порядка 10 тысяч. У ключевых производителей больших языковых моделей в разы больше карт.
Низкое качество данных в нефтегазе. Сделать на их базе хорошую языковую модель, которая понимает отраслевой язык, проблематично.
Финансирование разработок. Вход в создание решений на базе языковых моделей высокий. Даже небольшая команда стоит очень дорого, а деньги получить сложно.
Вопрос компетенций. Для подготовки специалистов нужен междисциплинарный подход. Чтобы построить датасет, на котором языковая модель будет обучаться, недостаточно быть дата-сайентистом или специалистом в определенном домене. Нужно понимать оба языка и обладать естественным материалом.
Две крайности со стороны нефтегазовых компаний: игроки хотят сделать все сами, нанимают инженеров и покупают видеокарты, но масштаб не позволяет сделать конкурентоспособное решение, либо компании принципиально отрицают пользу генИИ.
Для преодоления этих препятствий необходима общая консолидация усилий в отрасли, заключили эксперты
220 технологий х АТК+ – прямо с ЕНФ-2025
Post #668
4.65K

- 👍 10
- ⚡ 4
- 🤔 4