Выходцы из Apple запустили AI Pin — новое устройство, представляющее собой небольшой значок с камерой, микрофоном, динамиком и мини-проектором. С интересом наблюдаю крайне противоречивые реакции — почему-то очень много скепсиса и придирок вроде «А какую задачу это решает?» или «Я всё то же самое могу с телефоном или часами делать».
Вообще удивлён, что их так затроллили в твиттере. Мне AI Pin показался крайне любопытным. На мгновение даже почувствовал себя в 2014, на пике моего техно-оптимизма. Попробую рассказать, почему. Но начать придётся чуть издалека, уж простите.
Смартфон — устройство с экраном, мультитачем и экранной клавиатурой как основными способами ввода. Это было супер-круто в 2007, определило развитие индустрии и позволило появиться новым категориям приложений (и вообще идее приложений и апп стора): Maps, Instagram, Uber, Airbnb, Spotify, Messengers и вот это всё.
У меня сложные отношения с моим телефоном — его в моей жизни больше, чем мне бы хотелось. Периодически залипаю, и не рад этому. Это при том, что моё среднее время с телефоном — где-то 2.5 часа в сутки. У тинейджеров в среднем 8 часов в день. У меня правда ещё есть комп, хотя за компом большую часть времени работаю. Так или иначе, я не рад.
У AI есть потенциал к тому, чтобы поменять парадигму взаимодействия с устройствами. Например, сделать дефолтным голосовой ввод (это быстрее, чем набирать + там есть целый слой эмоций и всего такого, что не передаётся текстом) и/или ввод камерой, когда твой AI-ассистент буквально видит то же, что и ты.
// Заметка на полях: вы уже попробовали поиграть с GPT-4V? Офигенно распознаёт и описывает картинки. Я фоткал просто предметы вокруг на камеру и получал супер-точные классные описания. Пугающе хорошо видит всё, да ещё и распознаёт текст, включая рукописный.
Именно сейчас технологии (мультимодальные LLM, speech recognition & synthesis и т. д.) наконец дошли до того состояния, когда действительно стало возможным сделать AI-ассистента, который по-настоящему всё понимает, видит и может тебе помогать и отвечать на уровне смышлёного живого человека-ассистента. (С этой идеей персонального ассистента, который решит все проблемы с календарём, все носятся с 2010-х, но пока его не получалось сделать. Та же Siri. Но вот теперь наконец получится.)
Это значит, что вообще говоря, есть место для устройств совершенно нового форм-фактора, с которыми можно было бы общаться в основном голосом, и которые могли бы всё видеть и понимать. Дальше можно пофантазировать, какие форм-факторы могли бы сработать:
- очки со встроенной камерой;
- просто наушник — может там тоже можно камеру аккуратно поставить?
- или вот значок на груди или брошка для галстука или что-то такое;
- кулон на шее
и т. д.
// Ещё заметка на полях: вроде Джони Айв и Сэм Альтман что-то замышляют — мне кажется, это тоже может быть устройство вот такого рода.
Какие юзкейсы это устройство сможет закрывать — да практически все те же, что и телефон, плюс наверняка какие-то новые, про которые мы мало что понимаем.
Вот простейший пример юзкейса: мне часто бывает надо на бегу написать кому-то что-то. Но некогда / неудобно открывать телефон и формулировать буквами. Плюс, открывая, я сразу же отвлекаюсь, и иногда вообще забываю, что и кому хотел сказать. А тут просто говоришь устройству: «напиши в школу, что мой ребёнок сегодня пропустит» — и оно находит нужный канал и нужные слова и пишет. Ну кайф же.
Или живой перевод в реальном времени — мне кажется, что лет через 10 учить иностранные языки будут только гики и фанаты ради развлечения и в качестве хобби. Как сейчас музыку на виниле можно слушать. Но для утилитарных целей это никому не будет нужно. У каждого будет просто наушник в ухе, который будет в реальном времени переводить и озвучивать с любого языка на твой, да ещё сохраняя голос и интонации твоего собеседника. С людьми из всех стран мира мы просто будем по-русски говорить и слышать их ответы на русском. Кажется, мы вообще последнее поколение, которому ещё нужно было учить языки и работать над акцентами.
Post #685
13.7K
- ❤ 104
- 🤔 29
- 👍 19
- 🔥 4
- 👎 3
- 😢 2