Привет
На связи Степан 😎
В интернете сегодня шумит исследование ученых из Apple о рассуждающих моделях вроде Claude 3.7, o3 и тд (наверное, это те самые ученые, которые не спешат помогать Siri становиться умнее). Думаю, вы уже видели в пабликах разные мысли и выводы на этот счет.
Вкратце расскажу, если не видели:
- есть большие сомнения в способности моделей к рассуждению, модели только имитируют мыслительный процесс (тут хочется воскликнуть "да ладно, а что вы ожидали-то?");
- и "думающие" и "не думающие" модели не справляются с задачами высокой сложности, причем "не думающие" лучше справляются с легкими задачами, а "думающие" - с задачами средней сложности;
- у "думающих" моделей есть overthinking problem (прямо как у людей).
На днях слушал выпуск подкаста "Запуск завтра" на схожую тему и отлично совпало, что в подкасте дали хороший комментарий по первому пункту.
Создав машину, пытающуюся мыслить, человечество задумалось о правильности ее мыслительного алгоритма. Но тут проблема - сами до конца не знаем, как происходит процесс мышления. И не знаем, есть ли во вселенной только один рабочий паттерн - человеческий, либо их может быть много. Короче, сплошная философия. И чтобы не тормозить прогресс, в какой-то момент решаем, что оценить способности ИИ к мышлению можно по конечному результату и в целом, не так важно, как именно ИИ к нему пришел. И вот исследование ученых из Apple как раз затрагивает вопрос, а не пора ли перейти к иной оценке результативности ИИ.
Будет смешно, если вместо допилки Apple Intelligence (чтобы в Европе заработал или не слал тупые саммари, которыми пестрит reddit), эпл даст импульс к появлению Skynet'а. Потому что их ученые вот тут исследование запилили, чем спровоцировали смену подхода к оценке ИИ.
На этом моменте начинаются: Терминатор / Бегущий по лезвию / Я, робот / West World / Матрица / Из машины / Эра альтрона.
Post #41
127