Китай упёрся в собственный язык
Весь спор про китайский ИИ крутился вокруг санкций на процессоры, а вылезла куда более неловкая штука: китайцам банально не хватает текстов на китайском. По данным W3Techs, китайский это всего 1,3% контента в вебе, а английский - почти половина. Модели вынуждены пахать на скудном родном материале и платить больше за каждый полезный токен.
Пекин объявил данные стратегической инфраструктурой и к 2028-му строит национальные датасеты по медицине, финансам, энергетике. Учёный из Цинхуа Сунь Маосун предлагает оцифровать древние рукописи и региональные диалекты.
Дальше нетрудно угадать, скоро иероглифы прошлого тысячелетия объявят национальным достоянием, а бабушкин рецепт на диалекте будет обучать нейросеть. Культура внезапно оказалась сырьём. 📜
ИИ что дальше? Подпишись, да пребудут с тобой токены!
Post #3101
465

- 👍 1
- 🤯 1
- 🙈 1