TGViewer
Нейроний Нейроний @neuronium_ai · 67 subscribers
Post #8015 3
Мы слишком полагаемся на способность ИИ говорить «нет»

Современные ИИ-модели учат отказывать на опасные запросы, но отказ работает вероятностно: его можно обойти, а иногда модель отклоняет безобидные вопросы. По мере развития ИИ такие сбои могут привести к катастрофам, а сами отказы — дать компаниям и государствам инструмент цензуры. Исследователи пока не до конца понимают, какие внутренние процессы заставляют модель сказать «нет». При этом модели всё чаще используют в критически важных сферах, где полагаться на безупречность этих механизмов рискованно.

👉 Читать полностью
Новости Мы слишком полагаемся на способность ИИ говорить «нет» Современные ИИ-модели учат отказывать на опасные запросы, но отказ работает вероятностно: его можно обойти, а иногда модель отклоняет безобидные вопросы. По мере развития ИИ такие сбои могут привести к катастрофам, а сами отказы — дать компаниям и государствам…
More from @neuronium_ai
  1. Oct 9, 2026Даже «Закон и порядок» боится искусственного интеллекта Поклонники сериала NBC «Закон и по…
  2. Oct 9, 2026Claude Science от Anthropic составила первую полную карту неба в ультрафиолетовом диапазон…
  3. Oct 9, 2026Том Уотсон из Palantir: «власть толпы» не должна решать, кому достанутся госконтракты Том…
  4. Oct 9, 2026OpenAI раскрыла российскую и иранскую операции влияния, размещавшие фальшивые новости в на…
  5. Oct 9, 2026Великобритания откроет восемь центров, чтобы ускорить внедрение робототехники Правительств…
  6. Oct 9, 2026Выручка OpenAI, по сообщениям, на $20 млрд ниже прежних прогнозов Чуть больше недели назад…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →