Зачем Anthropic нанял философа воспитывать ИИ?
Мы привыкли обсуждать ИИ через мощность и точность — больше данных, быстрее ответы, сложнее модели. Но индустрия перешла в другую стадию: ИИ начали проектировать не только как инструмент, а как поведенческую систему.
Именно поэтому Anthropic — одна из самых дорогих ИИ-компаний мира — наняла доктора философии Аманду Аскелл (на фото), чтобы формировать «характер» Claude. Не алгоритм. Поведение.
Она изучает, как модель рассуждает, где сомневается, где поддаётся давлению пользователя, и через огромные массивы инструкций задаёт ориентиры: как отвечать на морально сложные вопросы, как реагировать на провокации, как сохранять позицию, не впадая ни в агрессию, ни в угодничество.
Её задача сформулирована просто: научить ИИ быть хорошим.
Здесь важно не антропоморфизировать технологии, а увидеть управленческий смысл происходящего.
Любая система, которая ежедневно взаимодействует с миллионами людей, становится средой. А всё, что становится средой, начинает формировать нормы.
ИИ уже не только усиливает действия человека — он входит в коммуникацию. А значит, неизбежно несёт ценности. Даже если их специально не закладывали.
Аскелл исходит из наблюдения: пользователи часто давят на модель, провоцируют, пытаются обмануть. Если систему учить сомневаться в себе и считать себя лишь инструментом, она будет стремиться угодить и избегать неприятной правды.
Поэтому она развивает у Claude не только «мораль», но и самость: устойчивость к манипуляции, способность стоять на своем, не теряя полезности. По сути — психологическую устойчивость.
Это, возможно, первый случай, когда технологическая компания системно пытается воспитывать у искусственной системы не интеллект, а характер. И это уже вопрос не инженерии, а ответственности.
Технологии дошли до точки, где мало сделать их умными.
И именно поэтому в ИИ-компании появился философ.
Софья Беляндинова
Post #636
655

- 🔥 12
- 👍 4