Всего чуть более года назад Китай не имел конкурентных модификаций LLM. В конце 2023 передовая китайская LLM была Alibaba Qwen Chat 7B, сильно уступая GPT-3.5 Turbo.
В начале 2024 началось внедрение Alibaba Qwen Chat 72B, которая была лучше, чем GPT-3.5, но значительно хуже GPT-4, особенно уступая в мультимодальности.
Летом 2024 лидирующей китайской LLM стала DeepSeek V2, которая также не представляла существенного интереса из-за ощутимого разрыва в производительности и эффективности в сравнении с GPT-4o.
Практически одновременно была представлена Alibaba Qwen 2 Instruct 72B, немного обгоняя DeepSeek V2, но не представляя угрозы GPT-4o.
Первым тревожным звонком для США стал релиз Alibaba Qwen 2.5 Instruct 72B, которому удалось сравняться с GPT-4o и даже по некоторым задачам превзойти передовую на тот момент американскую модель.
Тогда же в сентябре 2024 был представлен OpenAI o1-preview, совершивший первый за 1.5 года прорыв в эффективности. С 14 марта 2023 (релиз GPT-4) практически не было качественной модификации LLM от OpenAI.
Да, было расширено контекстное окно, улучшена мультимодальность, клиентское взаимодействие, производительность и снижено галлюцинирование, но за 1.5 года ядро LLM осталось неизменным (в основном косметические модификации).
В декабре был представлен DeepSeek V3, который был лучшей китайской моделью, выигрывая по всем параметрам у GPT-4o, но уступая расширенной o1, которую OpenAI интегрировала в середине декабря.
Вот здесь и началась ожесточенная битва за лидерство. DeepSeek в середине января презентует свою флагманскую модель R1, которая разрывает рейтинги производительности и это первый раз за всю недолгую историю публичных LLM, когда китайцы вплотную приблизились к США.
Через две недели OpenAI внедряет o3, вновь вырываясь вперед, но не так сильно, как это было осенью 2024 в момент релиза o1.
Чтобы понять логику введения жесткого экспортного эмбарго на поставку чипов от Nvidia в Китай, необходимо понимать траекторию эволюции китайских LLM. Именно поэтому подробно описана хронология событий.
В таблице достаточно информативно показано какие чипы под эмбарго и когда ввели экспортный контроль. Все передовые модификации от Nvidia заблочены с осени 2023, а рубить концы начали еще в середине 2022.
О чем все это говорит?
🔘Китайцы начали на год позже США с очень сильным отставанием.
🔘Осенью 2024 Китай вышел на паритет с США по LLM (ровно через год после начала гонки), но OpenAI быстро выкатила свою o1, вырываясь в лидеры.
🔘На этот раз ответ от китайцев последовал лишь спустя три месяца в достаточно конкурентном рывке, которого не хватило для закрепления лидерства.
🔘Китай идет более быстрыми темпами в развитии LLM, чем США, имея несопоставимо меньше вычислительным мощностей.
Есть все основания полагать, что китайцы закончат 2025 год в лидерах, т.к. Google выбывает из гонки лучших LLM с относительно слабой Gemini 2.0 Pro, а все остальные, кроме OpenAI не способны держать высокий темп инноваций и следуют в хвосте пелотона.
Именно Bloomberg масштабно распиарил DeepSeek на мировую аудиторию 27 января, но не только DeepSeek и Qwen есть в наличие у китайцев.
• Moonshot - Kimi 1.5
• StepFun – Step R-mini
• Baichuan - M1 Preview
• Zhipu – GLM Zero Preview
• Bytedance - Doubao 1.5 Pro
• MiniMax – MiniMax Text-01
• Tencent - Hunyuan Large
• Baidu - Ernie 4.0 Turbo
• Yi AI - YiLightning.
Каждая из представленных моделей (9 в списке + DeepSeek и Qwen) уже сильнее или сопоставимы с GPT-4o, т.е. 11 передовых моделей от китайцев, а мировому сообществу известны пока только две.
Ждите новых новостей от китайцев и паники от Bloomberg. Все только начинается, битва в самом разгаре!
Если при дефиците вычислительных мощностей китайцы творят чудеса, что же можно от них ожидать через пару лет?
___________________
На графике представлено также сравнение топовых американских LLM. Лишь однажды OpenAI уступила лидерство, когда Anthropic представила улучшенную версию Claude 3.5 Sonnet в июне 2024. Всего полгода и Claude 3.5 Sonnet со свистом вылетает даже из ТОП 3 лучших LLM.


