Простыми словами. Как создали ChatGPT
Несомненно, ChatGPT — одна из самых популярных вещей в сфере AI. Но с точки зрения технической в нём не было революции. Хотя была проделана огромная работа, использованные подходы существовали и до этого. Как же у OpenAI всё получилось?
Широкий кругозор
Умение «говорить» на разные темы, начиная от моды и заканчивая наукой. Всё это достигается благодаря невероятно большому объёму разнообразных текстов, которые использовались для обучения. Книги, статьи, форумы, комментарии, тексты фильмов и ещё много всего, о чём разработчики умалчивают.
Фильтрация нежелательного контента
Конечно, нужно исключить нецензурную брань, политические, религиозные и другие мнения, шок-контент. Для этого было потрачено значительное количество ресурсов на отбор и фильтрацию таких нежелательных текстов, чтобы нейросеть не могла поддерживать разговоры на «щекотливые» темы.
Умение вести формат диалога
Так как ChatGPT — это всё-таки бот, ему необходима способность вести формат беседы, а не просто выдавать сухие факты из учебников. Это опять же достигается путём задействования данных диалогового формата (форумов, комментариев, возможно, даже переписок).
А что под капотом?
Под капотом ChatGPT находится языковая модель из семейства GPT. Это модели, умеющие предсказывать следующее по контексту слово. Например, «мороз и солнце, день...»? Нейросеть скорее всего скажет «чудесный». Так и будет, если для обучения использовали сборники стихов. И вот так, как снежный ком, слово за словом собираются ответы чат-бота. Кстати, некоторые пользовательские интерфейсы показывают именно так — слово за словом, а не весь текст сразу. Теперь вы знаете, что это не придуманная анимация, а нейросеть действительно так работает.
Человек помог выбрать лучшие ответы
Помимо разработчиков и аналитиков данных были привлечены человеческие силы для оценки лучших ответов. На самом деле нейросеть может выдавать разные ответы на один и тот же вопрос, поэтому была разработана специальная модель-оценщик. Ее задача — среди множества ответов нейросети отдать пользователю самый лучший. А какой ответ лучший, решали реальные люди, когда обучали эту модель-оценщик.
Подробнее
Post #41
51