TGViewer
llm security и каланы llm security и каланы @llmsecurity · 2.04K subscribers
Post #234 171
Дедуктивные умозаключения требуют отталкиваться в мышлении от теории. Например, мы знаем, сколько энергии выделяется при столкновении метеорита с землей в зависимости от его массы, так как мы можем опираться на физическую теорию, а значит, можем и понять, приведет ли столкновение того или иного астероида с планетой к глобальной катастрофе. Но для ИИ такой теории нет, а попытки прийти к ней через объем вычислений (мол, когда будет в нейронках параметров, как соединений в мозге, сразу возникнет AGI и начнет нас убивать) кажутся неубедительными.

Таким образом, у нас остаются только субъективные оценки (я художник, я так вижу). Эти оценки могут иметь как сами регуляторы, так и специалисты. Кроме специалистов, авторы рассматривают так называемых суперпрогнозистов – людей, которые статистически значимо умеют делать предсказания лучше, чем люди с улицы (NB: superforecasters – зарегистрированная торговая марка компании человека, который этот феномен придумал, описал, популяризовал и продает, так что тут допустима хорошая доля скепсиса). В конце 2022 года одна исследовательская организация провела многомесячное исследование, где эксперты, суперпрогнозисты и простые миряне предсказывали вероятность уничтожения человечества искусственным интеллектом. Разброс вероятностей, который виден на графике, достаточно красноречив сам по себе, но авторы очень подробно расписывают, почему даже такие оценки, не имея под собой никакой фактуры и будучи связанными с экстремально редкими событиями, являются лишь замаскированным под числа личным мнением. То, что суперпрогнозисты дают оценки ниже, связано с тем, что, во-первых, они специально обучаются не переоценивать вероятность маловероятных событий, во-вторых, среди «экспертов» по AI safety тебе необходимо заявлять, что ты считаешь p(doom) высокой, чтобы быть «своим».
More from @llmsecurity
  1. Sep 25, 2026🦦 Каланам нужна наша лапка помощи Каланы — одни из самых обаятельных обитателей морей. Он…
  2. Sep 25, 2026Напомню, что у нас не только llm security, но и каланы
  3. Sep 14, 2026Post #719
  4. Sep 6, 2026Post #718
  5. Sep 4, 2026Discovery of a new OpenAI agent message board Sydney Von Arx et al., 2026 Сайт Исследовате…
  6. Aug 22, 2026Жадность вайбера погубит, или как получить малвару за ваши же деньги Часть 2: Троянский пр…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →