ГПТ-инфляция
Этим постом я выражаю профессиональную солидарность разработчикам Алисы от Яндекса.
Последнее время я регулярно натыкаюсь на рилсы, где пользователи смеются над «низким интеллектом» Алисы, проверяя её различные способами: просят запомнить информацию, а потом достать заново, спрашивают какие-то факты и числа. И показывают, как она не может ответить на самые «базовые» вопросы.
В итоге в обществе закрепилось мнение, что Алиса от Яндекса тупая. А вот что произошло на самом деле (далее всё моя теория, не знаю, как в реальности).
Яндекс много лет разрабатывал нейронку, которая выполняет две задачи:
— отвечать на каждое входящее сообщение в отдельности, создавая имитацию настоящей коммуникации;
— уметь вызывать сторонние тулзы (типа «поставить будильник» или «перемотать на следующий трек»).
Алиса никогда не обладала контекстом. Начиная с релиза в 2017 году, по сути вся разработка сводилась к файн-тюнингу, чтобы делать ответы на каждое сообщение более правдоподобными и похожими на живой разговор.
Если сказать Алисе «запомни, что у меня три кошки», она ответит «хорошо, запомнила!» просто потому что это самый ожидаемый ответ на это сообщение. Когда пользователь спросит «сколько у меня кошек», она вытащит другой ожидаемый ответ — «не знаю, две, что ли?».
Для пользователя в современном ИИ-мире это выглядит как максимальная тупость. Но проблема не в тупости Алисы, а в том, что у неё нет мозгов. И это долгое время считалось нормальным — много людей пользовались Станцией и особо много от неё не ждали.
А потом наступает 2023 год и OpenAI публикует нейросеть, которую обучал несколько лет за много триллионов миллионов миллиардов долларов, и которая умеет хранить окно контекста и постоянно его расширяет.
Все начинают пользоваться ЧатГПТ, и планка ожиданий от типичной нейронки растёт с невероятной скоростью (хотя ещё недавно такие помощники казались какой-то недостижимой магией). Больше нельзя просто быть «полезным функциональным помощником» — нужно помнить историю разговора, отвечать на вопрос «сколько вторников в ноябре», уметь хранить и выдавать пользовательскую информацию.
Конечно же, в этот момент Алиса начинает казаться тупой. Пользователь не знает, как устроена Алиса внутри; что запилить её стоит невероятно огромное количество усилий, а сделать свою ГПТ — ещё в десять раз более огромное количество усилий и необходимость снести всё и построить заново.
Начиная с прошлого года Алису перевели на ЯндексГПТ, но ясно, что этот процесс занимает не один месяц. И ещё неизвестно, догонит ли Яндекс модели Опен-эй-ай или Антропика.
Но самое грустное, что даже если допилить ЯндексГПТ до классного конкурентного уровня, это не будет ощущаться всеми как инновация. Нужно приложить огромные усилия, чтобы Алиса в глазах пользователя выглядела «ну нормальной». Представляю, как сложно разрабатывать что-то с такой мотивацией.
Держитесь, короч.
Post #889
826
- ❤ 30
- ❤🔥 3
- 🥱 2
- 🙉 2
- 😁 1