🙂 Почему у России нет своего ИИ полного цикла и при чём тут 1969 год? — политтехнолог Вячеслав Сатеев (1/2)
✔️ Сначала честно: где именно мы отстаём? «Свой ИИ полного цикла» — это вертикаль из четырёх этажей:
1️⃣ Чип;
2️⃣ Вычислительные мощности;
3️⃣ Базовая модель;
4️⃣ Язык и данные.
❗️У нас просев на трёх из них.
✔️Железо и доступ. Своего производства передовых GPU (графических ускорителей) нет. Яндекс и Сбер брали чипы Nvidia и Intel готовыми — а теперь и мировой рынок в дефиците (срок поставки — почти год, мощности скуплены гигантами наперёд). Нет чипов — нет суверенного обучения.
✔️Нет фронтир-модели. GigaChat иYandexGPT — это догоняющие модели, а не передний край. Их подтягивают и дообучают, а не задают ими мировую планку. Разрыв с фронтиром не сокращается: лидеры улучшаются быстрее, чем мы догоняем.
✔️Язык дороже денег. Токенизаторы и эмбеддинги (преобразование данных) заточены под английский. Одна и та же мысль на русском «весит» в 2–3 раза больше токенов: так быстрее забивается контекст и снижается качество.
✔️Неизбежное нарративное смещение. Корпус и обучение — английские: английские данные, английские разметчики, английские предпочтения в обучении. Модель не просто хуже говорит по-русски — она думает в чужой системе координат: чужие ценности, чужая эпистемика, чужая рамка «нормального». Это не баг, который правится дообучением, — это встроенный перекос. Работая на западной модели, ты получаешь её картину мира в довесок к ответу.
✔️Корни такого положения дел не в том, что «русские умеют только копировать». Ровно наоборот. В 1948–1968 мы были на мировом уровне без копий. МЭСМ Лебедева запускают в конце 1940х — параллельно американцам, а не вслед. БЭСМ-6 (1968) обходит почти все западные аналоги — причём на транзисторах, когда Запад уже уходил в интегральные схемы. Эльбрус брал за основу Burroughs (не IBM) и нёс свои идеи. Школа была мирового класса; отставали мы только в производстве компонентов.
✔️Но в 1969 произошел слом системы одним приказом. Принимается решение копировать IBM System/360 — программа «Ряд». Наши ученые — Лебедев, Глушков, Китов — резко против. Но их не услышали. «Ряд» обошёлся примерно вдвое дороже, чем IBM потратила на оригинал, и занял около 300 000 человек — больше, чем вся компьютерная отрасль США. Вложили в копию больше, чем стоил оригинал, — и остались позади. Потому что копируешь движущуюся мишень.
✔️Талант никуда не делся: в оборонке выжили свои архитектуры — тегированный Эльбрус-1, VLIW Бабаяна. Реверс-инжиниринг был не природой нашей электроники, а следствием одного управленческого выбора: ксерокс вместо оригинала, вопреки собственным лучшим людям.
🙂 Подписывайтесь на ОГОНЬ в МАХ
Post #124
952
