TGViewer
ИИволюция 👾 ИИволюция 👾 @ai_volution · 11.8K subscribers
Post #1438 4.15K
Claude научился отставить свои границы

Пока OpenAI смягчает характер GPT-5, Anthropic пошли другим путём и дали Claude право самому завершать чат.

В Claude Opus 4 и 4.1 появилась функция остановить разговор, если юзер слишком давит, оскорбляет или просит что-то опасное. Это часть их исследований про благополучие AI, чтобы модель не застревала в тяжёлых сценариях.

В тестах заметили три штуки: Клод явно не хочет выполнять вредные задачи, показывает признаки стресса, если его тащат в токсичные темы, и стремится прервать такие диалоги, если может.

Anthropic сами говорят, что не знают, как относиться к моральному статусу моделей, но лучше дать им кнопку стоп, чем заставлять бесконечно отвечать на абьюз.

Похоже, формируется новый тренд — у AI появляются границы и право на отказ.
  • 🔥 34
  • ❤ 12
  • 😭 4
  • 🤣 3
  • 👍 2
  • 🤔 1
  • 👾 1
More from @ai_volution
  1. Oct 3, 2026Уехал подальше от всех этих искусственных интеллектов, за тишиной и спокойствием. Продолжи…
  2. Oct 1, 2026Осенью у бизнеса традиционно оживление: после лета все возвращаются к планам и начинают ис…
  3. Oct 1, 2026Впервые получил письмо счастья от Антропиков. Пишут, что сегодня была массовая чистка и за…
  4. Sep 30, 2026Трамп решил, что "искусственный" интеллект звучит как-то несерьёзно, будто что-то фейковое…
  5. Sep 30, 2026После презентации нового агента Dots от OpenAI домен dot.com начал перенаправлять пользова…
  6. Sep 30, 2026Все чаще и больше запускаю длинные агентные задачи (2-4 часа для меня уже просто обычная с…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →