Post #231
752
итак, новости ИИ к этому часу:
— DeepSeek (разработчик той самой китайской LLMки с революционной архитектурой) начал занимать первую строчку в американском App Store, сместив ChatGPT
это означает, что миллионы американцев пошли загружать свои файлы и данные в китайскую LLMку… что вы там говорили про бан тиктока?
— акции американских технологических компаний упали на триллион долларов после успешного запуска DeepSeek-R1, которая по аналогии с o1 и другими, умеет в reasoning
модель от DeepSeek никак не уступает по бенчмаркам этой самой o1 от OpenAI и была обучена, по слухам, за 5 миллионов долларов, тогда как на обучение другим моделям типа той же llama требуются сотни миллионов долларов
— кстати, о llama — в Мете, тоже по слухам, организовали аж целых 4 war room’а, чтобы обсудить какие техники и детали архитектуры R1 можно применить в их моделях, чтобы тоже увеличить перфоманс и снизить косты на обучение
— капитализация одной только NVIDIA упала на 500 миллиардов долларов и побила рекорд по падению стоимости компаний за всю историю, а CEO обеднел на 17 миллиардов долларов, владея 3% акций
— на DeepSeek устроили массовую кибератаку, им пришлось закрыть регистрацию новых пользователей
совпадение?..
и знаете что самое крутое в этой истории?
во-первых, DeepSeek был всего лишь side-проектом кванта, основателя трейдинговой компании, который заработав деньги на трейдинге, скупал GPUшки и дизраптнул every single AI компанию)
во-вторых, модель R1 полностью с открытым исходным кодом!
это значит, что большинству компаний придется применить те же техники и значительно снизить цены на свои модели, чтобы выжить в ценовой конкуренции — настоящий черный лебедь 🦢
m a s s i v e
(мем прилагается)
— DeepSeek (разработчик той самой китайской LLMки с революционной архитектурой) начал занимать первую строчку в американском App Store, сместив ChatGPT
это означает, что миллионы американцев пошли загружать свои файлы и данные в китайскую LLMку… что вы там говорили про бан тиктока?
— акции американских технологических компаний упали на триллион долларов после успешного запуска DeepSeek-R1, которая по аналогии с o1 и другими, умеет в reasoning
модель от DeepSeek никак не уступает по бенчмаркам этой самой o1 от OpenAI и была обучена, по слухам, за 5 миллионов долларов, тогда как на обучение другим моделям типа той же llama требуются сотни миллионов долларов
— кстати, о llama — в Мете, тоже по слухам, организовали аж целых 4 war room’а, чтобы обсудить какие техники и детали архитектуры R1 можно применить в их моделях, чтобы тоже увеличить перфоманс и снизить косты на обучение
— капитализация одной только NVIDIA упала на 500 миллиардов долларов и побила рекорд по падению стоимости компаний за всю историю, а CEO обеднел на 17 миллиардов долларов, владея 3% акций
— на DeepSeek устроили массовую кибератаку, им пришлось закрыть регистрацию новых пользователей
совпадение?..
и знаете что самое крутое в этой истории?
во-первых, DeepSeek был всего лишь side-проектом кванта, основателя трейдинговой компании, который заработав деньги на трейдинге, скупал GPUшки и дизраптнул every single AI компанию)
во-вторых, модель R1 полностью с открытым исходным кодом!
это значит, что большинству компаний придется применить те же техники и значительно снизить цены на свои модели, чтобы выжить в ценовой конкуренции — настоящий черный лебедь 🦢
m a s s i v e
(мем прилагается)
- ❤ 9
- 🔥 5
















