В начале этого года я здесь описывал исключительно успешный китайский ИИ-инструмент DeepSeek. Так же, как и ChatGPT он основан на большой языковой модели, при этом на его обучение были затрачены на порядок меньшие финансовые ресурсы, а качество оказалось ничуть не ниже:
https://t.me/khokhlovAR/901
https://t.me/khokhlovAR/909
С тех пор, когда мне нужно обратиться к ИИ (обычно это случается, когда мне надо получить информацию по научному вопросу вне сферы моей специальности), я, как правило, использую именно DeepSeek. Мне нравятся четкие, полные и структурированные ответы, которые выдает эта модель. При этом я полностью отдаю себе отчет, что возможны «галлюцинации», поэтому перепроверяю полученные ответы. Практически всегда они вполне адекватны, хотя и не отклоняются от «научного мейнстрима».
После появления DeepSeek в различных СМИ стали распространяться мнения, что не может быть, чтобы китайская разработка была лучше американской, да при этом стоила намного дешевле. Наверное, мол, они чего-нибудь украли у компании Open AI, которая разработала ChatGPT. Более того, DeepSeek был оперативно запрещен для использования в государственных учреждениях США и ряда других стран, «чтобы секреты не утекли».
Но сильная сторона DeepSeek в том, что этот инструмент относится к категории Open Source. Там нет коммерческих составляющих, которые надо скрывать. Поэтому китайская компания пошла на необычный шаг: они написали научную статью о своей модели, в которой объяснили суть нововведений, которые позволили получить тот же результат, что и у ChatGPT, но с гораздо меньшими затратами, и послали ее в Nature. Эта статья прошла строгую процедуру рецензирования в Nature, и позавчера она была опубликована:
https://www.nature.com/articles/s41586-025-09422-z
Полученные результаты на русском языке коротко изложены здесь:
https://naukatv.ru/news/sekrety_modeli_iskusstvennogo_intellekta_deepseek_raskryty_v_epokhalnoj_state
https://tass.ru/ekonomika/25085633
Эти материалы я бы рекомендовал прочитать, не буду их здесь пересказывать. Мне понравилась метафора, что подход DeepSeek позволяет искусственному интеллекту осваивать новые навыки и знания без подсказок со стороны человека подобно тому, как маленькие дети учатся играть в незнакомые им игры. И то, на что многие обращают внимание: это первый случай, когда разработавшая инструмент ИИ компания «открыла все карты» и прошла процедуру независимого рецензирования в ведущем научном журнале.
Post #865
67
Forwarded from Алексей Хохлов