TGViewer
Дата и Время Дата и Время @importdatetime · 317 subscribers
Post #8 566
Один из моих сайд квестов — помогать студентам центрального университета в организации мероприятий AI talks, где видные представители индустрии получают эфирное время и рассказывают о важных для них темах

Последний AI talks прошёл особенно интересно — мы говорили с Евгением Опрышко, аспирантом университета Торонто и специалистом в области безопасного ИИ. Удалось поговорить про безумные темпы развития нейросетевых технологий, графические ускорители в космосе, и про то, как следующая технологическая революция — изобретение AGI — будет способна как стереть человечество с лица земли, так и развить нас до межпланетной цивилизации с высочайшим уровнем технологий

На одном из слайдов был перечислен список вещей, которые могут пойти не так, давайте на них посмотрим:
- Злоупотребление (misuse):
- Элиты могут использовать ИИ в своих интересах; у людей станет намного меньше рычагов влияния — труда и физической силы — чтобы менять политику элит
- Пропаганда с помощью ИИ
- Люди будут применять (и/или взламывать — jailbreak) ИИ для произвольных задач (включая CBRN)
- В некоторых областях защита сложнее нападения (например, биооружие)
- Потеря контроля (loss of control):
- Если власть уже централизована, может оказаться несложно убедить нескольких ответственных лиц или захватить существующую инфраструктуру
- Несколько ИИ-систем могут координироваться лучше людей, например обучив модель-преемника с общими ценностями или доказав свои намерения через интерпретируемость
- Дрейф ценностей и постепенная утрата влияния (value drift & gradual disempowerment):
- Взаимодействие людей с ИИ-ассистентами уже влияет на наши убеждения
- Автономные решения переносят ценности ИИ на физическую реальность
- Люди могут постепенно терять влияние на экономику, культуру и государство, по мере того как ИИ обходит их в управлении каждым из этих институтов
- Коллапс инфраструктуры:
- У моделей могут быть общие уязвимости — jailbreak, prompt injection, поведение вне распределения (OOD) — либо одна и та же модель развёрнута повсюду
- Un
known unknowns
Выглядит солидно... И вот мой вам вопрос: как вы видете мир после изобретения полноценного, всеумеющего ИИ? Верите ли вы в способность человечества избежать всех этих рисков и построить наше коллективное будущее безопасно? Или нас ждут пропоганда через рекомендательные системы, цифровые двойники богатейших людей мира и третья мировая с автономными дронами и антропоморфными роботами-пухососами? Можем поразгонять в комментариях

Ну а ещё подписывайтесь на канал Жени о безопасном ИИ и карьере в этой области (и мне за это даже не заплатили)
  • 🌭 9
  • 🔥 8
  • 🤩 2
More from @importdatetime
  1. Sep 10, 2026О, что-то здание знакомое... Зайду-ка я внутрь Кажется, время журналистского эмбарго уже п…
  2. Aug 20, 2026Пришло время подвести итоги Ничего сверхъестественного: требуешь много, даёшь безграничное…
  3. Aug 20, 2026*Конец монтажной склейки* Полгода назад, когда я решился на это "приключение на 20 минут",…
  4. Aug 20, 2026Провёл свою последнюю лекцию в Бангкоке Так как Харбор, как и ЦУ, внедряет необычные практ…
  5. Jun 29, 2026Провел свою первую лекцию в Бангкоке Смотря какой curriculum, смотря какой sillabus Путь д…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →