OpenAI возвращается к open-source: обзор моделей GPT-OSS-120b и GPT-OSS-20b
#статья #openai #gpt
Компания OpenAI, известная разработкой топовых языковых моделей, сделала важный шаг навстречу открытому сообществу, представив две передовые open-source модели — GPT-OSS-120b и GPT-OSS-20b. Этот релиз знаменует возвращение компании к изначальной идее открытого распространения своих технологий (или, скорее, является пиар-ходом компании в ответ на упреки в закрытости). Событие действительно знаковое, ведь впервые с момента выпуска GPT-2 в 2019 году компания делает веса своих крупных языковых моделей полностью доступными сообществу.
GPT-OSS-120b и GPT-OSS-20b — это продвинутые генеративные модели, сочетающие лучшие практики OpenAI последних лет: архитектуру Transformer с MoE, расширенное контекстное окно на 128 000 токенов, инновационные механизмы квантования MXFP4 и масштабируемую глубину рассуждений. Благодаря этим возможностям модели достигают производительности, сравнимой с закрытыми моделями OpenAI (например, o3-mini и o4-mini), при этом оставаясь доступными даже для локального запуска.
В статье мы подробно рассмотрим технические особенности этих моделей, их архитектуру и механизмы работы, результаты на основных бенчмарках, аспекты безопасности и лицензионную политику. Материал основан на официальной документации OpenAI, а также на подробной информации из репозитория на GitHub и публикациях на платформе Hugging Face.
Ссылка на статью
Life-Hack - AI
Post #260
406

- ❤ 4
- 👍 3