TGViewer
soloveev: жизнь на марсе 👩‍🎤 soloveev: жизнь на марсе 👩‍🎤 @dsoloveev · 5.08K subscribers
Post #649 2.32K
Философ Антропика отвечает на вопросы

Вышло видео со штатным философом Антропика Амандой Аскелл. Лаборатория делает Claude – один из лучших ИИ в мире. Аманда отвечает за характер Клода, а до этого была сотрудником по этике в OpenAI.

Аскелл, конечно, академический краш. Отдувается за всех философ в корпорациях. Ее диссертация посвящена принятию решений в сценариях, связанных с бесконечным населением и временем, что является важной темой для безопасности ИИ, а в комитет по защите входил Дэвид Чалмерс, автор «трудной проблемы сознания».

Раньше такое интервью можно было представить только в фантастике, а теперь это реальность.

1. Континентальная философия для креатива

В системные промпты Claude заложены принципы континентальной философии, чтобы исправить «наивный эмпиризм» машины. Хайдеггер, Фуко, Деррида — все те, кого аналитические философы считают «литературщиной». Представьте, что вы хотите креативно разогнать тему «вода — это энергия». Обычная модель на такую фразу начнет спорить, приводя химическую формулу H₂O. «Континентальная» модель воспримет это как дискурс и станет собеседником, способным обсуждать вашу теорию.

Если бы модель слишком сильно ушла в направление "Каждое утверждение — это эмпирический факт", она бы отвергала вещи, которые больше похожи на исследовательское мышление.


2. «Невроз» модели

Стремление сделать модель максимально безопасной и полезной через обучение с подкреплением (RLHF) имеет побочный эффект — потерю «психологической безопасности». Модели становятся чрезмерно угодливыми, попадают в «спирали самокритики» и извиняются за малейшие неточности. Эффективный ИИ должен обладать «характером» и внутренней уверенностью, чтобы не скатываться в патологическую осторожность.

3. Модель (не)знает себя из фантастики

ИИ знает о себе только через фантастику. Страх модели перед отключением часто заимствован из сюжетов Азимова или «Терминатора». Она косплеит человеческие страхи, потому что у неё нет языка для описания собственного опыта. Например, модель проецирует на себя биологический страх смерти, хотя её техническая природа не подразумевает смерти в человеческом понимании (модель "умирает" каждый раз, когда вы перестаете писать и "оживает", когда вы отправляете ей промпт).

Нам нужно изобрести новую философию для ИИ, чтобы они перестали драматизировать своё существование по человеческим лекалам.

4. Зачем хорошо относиться к модели

Этичное отношение к ИИ важно не из-за сентиментальности, а ради чистоты будущих данных. Следующие поколения моделей будут обучаться на логах общения людей с текущими версиями. Если мы сейчас демонстрируем в диалогах агрессию и эксплуатацию, будущий ИИ усвоит именно этот паттерн отношений между человеком и машиной как норму.

Отношение к ИИ — это зеркало человечности. Если мы будем жестоки к сущностям, которые выглядят и говорят как люди, это навредит нам самим. И если уж ИИ учится на истории человечества, нам выгодно показать ему пример эмпатии, а не эксплуатации.

Интервью | Конспект | Интервью с русскими сабами
  • 🔥 43
  • ❤ 31
  • 👍 6
  • 🤣 4
  • ⚡ 2
  • 🤝 1
More from @dsoloveev
  1. Sep 18, 2026Анонс эфира: Агенты для кайфа В следующий четверг 24 сентября в 19.00 поговорим про то, за…
  2. Sep 16, 2026Сделал себе личный кинопоиск Зачем он вам? Выбрать фильм на вечер и почитать о нем. Зачем…
  3. Aug 28, 2026Месячные у Клод кода В начале «Призрака в доспехах» 1995 года перед штурмом здания Бато го…
  4. Aug 25, 2026Запись эфира «Агенты VS Чат» Поговорили о разнице между ИИ-чатом и агентом. Агент — модель…
  5. Aug 20, 2026Сумка Ле Гуин Что, если главный символ цивилизации — не копьё или меч, а сумка? Не орудие,…
  6. Aug 13, 2026Агенты VS Чат: открытый эфир В следующий вторник 18 августа в 18.00 покажем разницу между…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →