«Приключения Электроника» как экспресс-курс по LLM
Смотрю с детьми советские «Приключения Электроника» и ловлю себя на том, что половину фильма легко переложить на современные реалии.
Сам Электроник — LLM в корпусе робота. Знаний море, контекст понимает, но без обвязки, скиллов и нормального описания задачи действует довольно прямолинейно.
«Крути педали, человека спасать надо» — обучение на лету. С велосипедом система быстро разбирается.
«Цель игры — забить шайбу в ворота» — уже классическая ошибка постановки задачи. В какие именно ворота, не уточнили, поэтому Электроник забивает в ближайшие. Формально цель достигнута, фактически матч чуть не проигран.
Уточнение промпта вида «не те ворота» не помогает, робот начинает вести шайбу по кратчайшему маршруту, и попадает всё время во вратаря. После нескольких безуспешных попыток уходит в цикл («Смотри, на второй круг пошли. Это не хоккей, а марафон какой-то»).
Писать в тетради почерком Сыроежкина — отдельный скилл. Поэтому Электроник может решить за него задачи и аккуратно всё записать. Но в промпте было только «реши», без уточнения «методами, доступными шестикласснику». Ответ правильный, а решение учитель не принял.
Собака Рэсси — субагент. Понимает команды Электроника, может самостоятельно выполнить поручение, а между вызовами чаще всего находится в замороженном состоянии.
Сыроежкин, который делегировал Электронику школу, спорт и домашние дела, — ранний кейс чрезмерной автоматизации. Сначала кажется, что у тебя просто освободилось время. Потом выясняется, что вместе с рутиной ты отдал системе всё, в том числе свою репутацию, отношения с людьми и место в команде (пу-пу-пу...)
Урри всё пытается найти у Электроника «кнопку» — универсальный системный промпт, который заставит его беспрекословно выполнять любые команды. Но кнопки нет: Электроник интерпретирует цели и действует исходя из собственной картины мира.
А банда Стампа в итоге не взламывает Электроника технически. Она просто убеждает его, что кража картин — хорошее и полезное дело. Классический prompt injection: подменить контекст и заставить агента применить свои способности в чужих интересах.
Профессор Громов при этом занимается не столько программированием, сколько alignment: пытается не просто добиться от системы правильных ответов, а научить её понимать людей и самостоятельно отличать хорошее от плохого.
А вообще фильм классный и очень добрый. И мысль в нём для нашего времени довольно актуальная: если делегировать машине отдельные задачи, у человека появится свободное время. Если делегировать ей вообще всё — машина незаметно займёт место человека.
Так что human in the loop нужен не только для контроля качества. Иногда он нужен, чтобы человеку самому оставалось чем заниматься.
Post #564
903

- 🔥 27
- 👍 10
- ❤ 6