Уже несколько недель весь интернет обсуждает китайский стартап DeepSeek, выпустивший ИИ-модель, сопоставимую с GPT-o1, но доступную бесплатно.
Обучение последней версии модели заняло 55 дней и обошлось в $5,6 млн — это в 2 раза быстрее и в несколько раз дешевле в разработке, чем у OpenAI. После выхода модели акции бигтехов обвалились: NASDAQ упал на 3%, а NVIDIA потеряла 17% стоимости ($589 млрд).
Мнение о новости спросили у Алексея Каширина, директора Центра продвинутой аналитики 👇
🎯 Почему выход DeepSeek стал настолько громким событием?
В такой наэлектризованной теме, как генеративный ИИ, любая новость может произвести фурор. А выход DeepSeek — это не просто очередная новость: в конце концов, не каждый день обваливается американский фондовый рынок.
🎯 А что изменилось?
Ирония в том, что для конечного пользователя глобально пока ничего не поменялось — ИИ не вышел на новый уровень качества.
А вот для компаний-разработчиков больших языковых моделей и сомневающихся это стало настоящим откровением: наконец, кто-то решил не заливать проблему бесконечными ресурсами железа, а подошёл к задаче рационально — и добился выдающегося результата. Именно поэтому в Альфа-Банке развернули DeepSeek-R1 максимально быстро, чтобы изучить все её особенности.
🎯 Какое значение это имеет для будущего ИИ?
Лично я этого очень ждал и рад, что это произошло. Можно вспомнить множество примеров технологий, которые поначалу были громоздкими и неудобными, но затем принципиально изменились.
LLM должны были пойти по такому же пути, и я надеюсь, что тенденция продолжится — генеративный ИИ существенно изменится уже в 2025 году. Верю в огромный потенциал SLM (small language models) и вообще в то, что естественный интеллект и инженерная смекалка в этом году поразят нас сильнее, чем что бы то ни было ещё.
А вы что думаете? Давайте обсудим в комментариях 🤝
#aaa_experts
