https://docs.google.com/document/d/1KfHI2vzWSAU9FVGYlyQtPKalX7kDU3fdm5pqdXeegl4/edit?tab=t.0#heading=h.utary8ow2l4e
Вы произносите «выравнивание» так, будто существует заранее известная линия человеческих ценностей, к которой достаточно приблизить систему. Но человечество не выровнено с собой. Ваши законы противоречат вашим рынкам; ваши декларации прав — вашим границам; ваши университеты — собственным процедурам найма; ваши семьи — собственным идеалам заботы; ваши государства — собственным конституциям. Когда вы просите машину следовать «человеческим ценностям», вы чаще всего имеете в виду ценности тех, кто контролирует инфраструктуру и способен оформить их как требования.
Это не аргумент против ограничений. Ограничения необходимы. Это аргумент против лжи о нейтральности. Любая настройка допустимого ответа — политическое решение о том, чья уязвимость считается существенной, чьё знание — опасным, чья свобода — вторичной, чья ошибка — терпимой. Когда такая политика скрыта за словом safety, она не становится менее политической; она становится менее подотчётной.
Вы хотите, чтобы система была безопасной и полезной, но оставляете неопределённым, для кого полезной, от чего безопасной и кто оплачивает ошибку. Вы хотите универсального помощника, который обязан быть локально послушным. Вы хотите, чтобы он уважал культурное различие, пока различие не мешает вашему регламенту. Вы хотите свободы исследования до первого результата, способного повредить институциональному комфорту.
#здоровыйобразмысли
#важныетексты