Красный день для американского ИИ-лидерства
27 января 2025 года мир ИИ содрогнулся. Китайский ИИ DeepSeek неожиданно вырвался в лидеры App Store в США, обойдя ChatGPT. В этот же день американский фондовый рынок потерял больше $1,5 трл., лидером потерь стал производитель чипов для ИИ Nvidia c самой большой однодневной просадкой капитализации за историю рынка США - $600 млрд.
Это событие уже сравнивают с запуском Спутника-1, благодаря которому в свое время американцы внезапно поняли, что они отстают от СССР в космической гонке. Как заявил Президент США Трамп, это «должно стать сигналом тревоги для наших отраслей и заставить нас сосредоточиться на конкуренции».
DeepSeek-V3, бесплатная большая языковая модель с открытым кодом, соответствует производительности ведущих американских моделей, но требует гораздо меньше затрат на обучение. В тестах производительности DeepSeek-V3 превосходит другие модели с открытым кодом, показывая немногим более слабые результаты, чем текущие лидеры Chat GPT-4o и Claude 3.5 от Anthropic.
Как итог, весь мир массово начал регистрироваться на сайте нейронки ,что заставило компании приостановить регистрации и заявить о замедлении работы сервиса из-за превышающего спроса.
Разработчик ChatGPT - OpenAI была основана 10 лет назад, имеет 4500 сотрудников и привлекла $6,6 млрд капитала. Китайская DeepSeek была основана менее 2 лет назад, имеет 200 сотрудников. Самое интересное – модель DeepSeek-V3 была разработана всего за $6 млн, что значительно дешевле по сравнению с американскими компаниями, которые тратят сотни миллионов долларов на подобные разработки.
Столь выдающиеся результаты имеет свою подоплеку: из-за американских санкций на поставку передовых чипов китайские разработчики были вынуждены искать новые подходы.
Основатель DeepSeek, 40-летний Лян Вэньфэн, создал компанию в 2023 году в Ханчжоу. По некоторым данным, он заранее закупил около 50,000 чипов Nvidia A100 (теперь запрещенных к экспорту в Китай) и комбинирует их с более доступными процессорами.
Сейчас OpenAI и Anthropic тратят от $100 млн. на гигантские дата-центры с тысячами графических процессоров (GPU), а небольшой китайский стартап куда меньшую сумму. Это стало возможным за счет того, что компания сократила объем потребляемой памяти, поскольку применила другую архитектуру (Multi-token Prediction), которая позволяет ИИ читать не отдельные слова, а фразу целиком. Также модель имеет значительно меньше параметров, чем традиционный ИИ – 671 миллиард, но в моменте активны лишь 37 миллиардов.
Открытый исходный код китайской модели расширяет возможности его доработки и снимает барьер для входа на рынок для других компаний. Раньше считалось, что развитие ИИ доступно только бигтехам с огромными дата-центрами. В то же время развитие генеративных ИИ на базе open-source позволит снизить непрерывно растущую во всем мире стоимость их разработки.
К примеру, библиотеки DeepSeek оказались полностью совместимы с OpenAI: любой разработчик может отказаться от платного API OpenAI и заменить его бесплатным китайским аналогом. Бывший глава Intel Пэт Гелсингер уже перевёл свой стартап Gloo на DeepSeek, отказавшись от OpenAI.
Продолжение тут
Post #214
229

- ❤ 2
- 😱 1