TGViewer
BeerPanda. Органично недоразвитый DevOps BeerPanda. Органично недоразвитый DevOps @beerpanda · 1.73K subscribers
Post #459 3.05K
Аптайм - это важно?

Наткнулся на рекламу прямо из 90х. Винтажную, практически.

15 лет аптайма в масштабах Галактики

474 359 400 секунд системы *** работают без остановки!

P.S. Пока вы читаете этот пост, аптайм увеличился на 52 секунды, а Земля улетела еще на 12 480 км.


Умение проектировать и строить системы, способные выдать аптайм 15 лет - это умение без всяких шуточек важное и попросту отличное. Но надо понимать что это и зачем мы это делаем.
Аптайм - время непрерывной работы *единичной* системы. Той, которую можно рассматривать как квант масштабирования. До массового внедрения систем виртуализации (системных виртуальных машин) аптайм был важнейшим показателем в мире больших серверов. Сдвоенное всё, аппаратная устойчивость, проверки всего, добавление и удаление аппаратных компонентов на-горячую (hot plug). Только бы сервер не надо было выключать. Кластерные системы в те времена были уделом совсем уж небожителей.

Пришла VMware и сказала - а давайте вообще то выключать серверы. Причем не просто выключать, а прямо в рабочее время. Потому что мы придумали Live Migration - виртуальная машина с нагрузкой прямо на-горячую, без остановки и разрывов соединений, меняет точку исполнения и переезжает на другой физический сервер (квант масштабируемости). А мы прямо в рабочее время, без овертаймов и ночных работ, получили возможность поставить патчи на системное ПО, прошить свежий биос, и вообще делать все то, что раньше приводило к недоступности сервиса.

Пришло время свернизкого входа в кластерные системы.

Дальнейшее появление контейнерной виртуализации и концепции "pet vs cattle" добило аппаратный и программный "design to last". Современные ИТ - это "design to fail", когда мы проектируем систему (кластерную прежде всего) на быструю обработку отказов и на поддержание доступности сервиса, а не на аптаймы железа и квантов масштабируемости.

Всё, аптайм с 2003 года (время выхода Live Migration) - очень нишевый показатель, он лишен практического применения в массовом ИТ.

Инфраструктура ИТ и вовсе с незапамятных времен почти не интересуется аптаймами. Питание по двум лучам, кондиционеры все с избыточностью, сети тоже все дублированы.

Не, коллеги из *** на самом деле молодцы, что у них 15 лет без простоев работает ЦОД и услуги.
Просто термин для этого другой нужен, не аптайм. И да, это душноты псот. Но раз мы осмеливаемся называться инженерами, то должна быть и инженерная культура. А она прежде всего начинается с терминологии.
  • 👍 35
  • 👏 4
  • ❤ 2
More from @beerpanda
  1. Jul 22, 2026Интересно, давно ли гипервизоры потребляют GPU для собственных нужд?
  2. Jul 17, 20266-го августа 2026 тряхнем стариной виртуализацией! Встреча сообщества (юзер групп) инженер…
  3. Jun 19, 2026VK и макбуки. Анализ на коленке. Прокатилась волна про VK и супермодные макбуки по 300к дл…
  4. May 7, 2026Сервер выключается Есть в одной организации сервер большой тяжелый и с ускорителями. И нач…
  5. Apr 2, 2026Очень интересный взгляд на проблему "галлюцинирующих" ИИ и почему избавиться от галлюцинац…
  6. Mar 31, 2026Найм в ИТ сломан? Недавно была большая битва HR против накрутчиков под лозунгом "найм слом…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →