Все, наверное, уже слышали про DeepSeek, китайскую LLM, которая не уступает в бенчмарках OpenAI и LLAMA. Мы сами тестировали, по ощущениям это минимум уровень GPT-4. Уже реализован весь reasoning и поиск по интернету.
Самое интересное, что модель разрабатывает крупнейший хедж-фонд в Китае. По городской легенде у ребят просто простаивали GPU-кластеры и была сильная команда математиков и разработчиков уровня PhD лучших вузов.
Взято у Кримсона
[Reuters]: Затем в 2015 году Лян стал соучредителем квантового хедж-фонда, который использует сложные математические алгоритмы для [биржевой] торговли, а не человеческий анализ.
К концу 2021 года портфель фонда составил более 100 млрд юаней (13,79 млрд долларов США), но в апреле 2023 года он объявил в своём аккаунте WeChat, что расширит свою сферу деятельности за пределы инвестиционной отрасли и сосредоточит ресурсы на «исследовании сути AGI [Сильного ИИ]». DeepSeek был создан месяц спустя.
OpenAI определяет AGI [Сильный ИИ] как автономные системы, которые превосходят людей в большинстве экономически ценных задач.
Сотрудники DeepSeek в основном являются выпускниками и аспирантами ведущих университетов Китая, которые, по мнению Ляна, предпочитают работать в DeepSeek, потому что компания решает самые серьёзные задачи в области ИИ.
«Очевидно, что лучшие таланты привлекают решения самых сложных проблем мира», – заявил он в июле.
Meta уже анонсировала запуск специальных команд, чтобы зареверсинженирить, как китайцам удалось кратно снизить стоимость тренировки модели.
Отличная ролевая модель для кванта, на наш взгляд! Сначала поднять 100 млрд AUM, затем расширить декларацию фонда на инвестирование в ИИ и запустить конкурентную LLM в, казалось бы, алом океане.
Quant Researcher