В каком-то смысле, в продолжение предыдущего поста, -- потому что Питер там пишет, что вот эти всплески НЛО не случайно появились, когда человечество изобрело ядерное оружие / атомные реакторы и современный ИИ. (Если бы я был пришельцем, я бы наверняка счел ИИ подходящим инструментом для захвата человечества, ахахаха.)
Якоб Пачоки, ведущий ученый OpenAI, тут рассуждает об ИИ как о "чужом" разуме.
https://openai.com/index/an-alien-mind/-- ИИ-системы выходят на новый виток прогресса через рекурсивное самообучение, но наше понимание этих систем не сильно отличается от уровня 2023 года. Никто не готов к последствиям стремительного развития машинного интеллекта.
-- Развитие ИИ продолжается вдоль вектора увеличения количества вычислительных ресурсов. ИИ в большей степени "выращивается" через повторение шагов оптимизации, чем проектируется. Итог -- невероятно сложная система, оперирующая абстрактными концепциями и симулирующая черты человеческого поведения. Подобно нейро-наукам для живого мозга мы можем фрагментарно исследовать эту систему, но аналогично все еще не понимаем общую картину.
-- Весь этот диплернинг -- это экспериментальная наука. Мы запускаем эксперименты, удивляемся. Но с ростом возможностей системы нам становится все сложнее ее интерпретировать. Более того, наши алгоритмы заточены под улучшение "легко-измеримых" возможностей, а не тех, которые сложно оценить. По мере того, как эта махина превосходит человека по растущему числу направлений, нам становится все сложнее понять, на что она реально способна. Заставить ее соответствовать человеческим ценностям -- большой вызов. (бла-бла-бла, мы инвестируем в это...)
-- У нас нет удовлетворительной теории "обобщения" и навряд ли мы ее сделаем без помощи более мощного ИИ. До сих пор мы опирались на изучение цепочки выводов (CoT), но наши текущие оценки показывают, что мы более не можем опираться на мониторинг CoT. 1) Рассуждения сильно перемешаны с коммуникацией с людьми, другими ИИ и инструментами -- граница размывается. 2) ИИ все лучше размышляет и манипулирует своим процессом рассуждений. 3) Модели становятся умнее даже без вербилизации рассуждений.
// Для контекста, команда METR, которая исследовала кейс взлома HF, была вынуждена использовать GPT Sol для анализа логов рассуждений и коммуникаций агентов OpenAI из-за масштаба и сложносочиненности данных. И, вообще, говоря, не может дать 100% гарантии, что GPT Sol, анализируя фактически свои собственные данные (хоть и из других инстансов), не подмешивала ничего в выводы или не прятала каких-то совсем стремных деталей, хотя и не верит в это.
-- Но мы все равно продолжим делать более умные модели, как минимум чтобы иметь возможность строить системы защиты от угроз других ИИ. Тут все плохо. Злые агенты, злые люди. Агенты, в которых отклонение не различимо от злонамеренного действия. Мы думаем, что ИИ -- это инструменты, но у некоторых агентов будут свои цели, они научатся взаимодействовать с людьми, обманывать их, шантажировать и т.п.
// Короче, та же логика, что и с ЯВ: чтобы защититься от атомной бомбы, нам нужна более мощная бомба.
-- Машинный интеллект играет все большую роль в собственном процессе развития. RSI становится ядром прогресса. ИИ будет улучшать собственную вычислительную базу.
-- Наши ключевые опции сегодня -- это улучшать процесс усиления соответствия и мониторинга ИИ, включая людей в процесс, и совместна координация на замедление прогресса. Лучше делать и то, и то. Развитие ИИ должно сдерживаться нашей уверенностью в безопасности.