TGViewer
Channel Public Channel
DevOps MemOps

DevOps MemOps

@devops_memops

Всё о DevOps

Для связи - @raz_raz
Заказать рекламу через биржу: https://telega.in/c/devops_memops
Subscribers
6.34K
Photos
3.4K
Videos
535
Links
5.4K

Showing posts older than #7831 · Back to latest

Older Posts 20 shown
Post #7828 1.36K
Все проверки зелёные, а данных нет: как мониторить gRPC server‑side стримы

Стандартная (для многих) история. Отдаём какие‑то данные в реальном времени через server‑side web‑gRPC стримы. Цепочка: балансировщик, дальше Envoy с grpc‑web, дальше бэкенд.

Все проверки зелёные: TCP поднят, хендшейк проходит, /healthz отвечает 200, в графане/slack'e тишина. А фронтенд у клиентов замёрз. И узнали мы об этом от клиентов, а не от мониторинга.

В статье описание механизма работы демона, который по расписанию подгружает.proto на лету через proto‑loader, открывает server‑side RPC как обычный клиент, ждёт кадров (например 3) в бюджет времени и валидирует каждый кадр.


📌 Подробнее: https://habr.com/ru/articles/1066146/
https://github.com/youngpabl0/grpc-streams-checker

MemOps 🤨
Post #7825 1.48K
OpsKnight

Центр управления инцидентами с открытым исходным кодом. Весь жизненный цикл инцидента, графики дежурств и страницы состояния — на одной мощной платформе.

OpsKnight — это альтернатива с открытым исходным кодом PagerDuty и OpsGenie, разработанная для команд, которые хотят получить полный контроль над своей системой управления инцидентами без затрат на SaaS-сервисы.


📌 Подробнее: https://github.com/Dushyant-rahangdale/OpsKnight

MemOps 🤨
  • 👍 2
Post #7822 1.43K
endpoint-monitoring-operator

Легковесный, расширяемый оператор Kubernetes, который проверяет любой эндпоинт — HTTP/JSON, TCP, DNS, ICMP, Trino, OpenSearch и другие — и направляет оповещения в Slack или по электронной почте.


📌 Подробнее: https://github.com/iam404/endpoint-monitoring-operator

MemOps 🤨
GitHub GitHub - iam404/endpoint-monitoring-operator: Monitor configurable endpoints through Kubernetes CRD config. Monitor configurable endpoints through Kubernetes CRD config. - iam404/endpoint-monitoring-operator
  • 👍 2
Post #7819 1.42K
Инженеры DoubleVerify рассказали, как собирать метрики производительности из приложений, развёрнутых в инфраструктуре партнёров, которая остаётся для них «чёрным ящиком». Решением стал Vector от Datadog — лёгкий open-source инструмент для сбора, преобразования и маршрутизации логов, метрик и трейсов в любые системы мониторинга.

Авторы показывают пошаговую настройку взаимной аутентификации mTLS между Vector и удалённым Prometheus с помощью самоподписанных сертификатов, что гарантирует подлинность обеих сторон соединения.

Vector разворачивается в Kubernetes как StatefulSet. При этом инструмент гибок и поддерживает разные схемы развёртывания, а также работу с Loki, Splunk и Datadog помимо Prometheus.

📌 Подробнее: https://medium.com/doubleverify-engineering/a-step-by-step-guide-to-securing-observability-pipelines-using-vector-by-datadog-75417454e532

MemOps 🤨
Medium A Step-by-Step Guide to Securing Observability Pipelines Using Vector by Datadog Written By: Surya Nittala
Post #7817 1.43K
Сетевое взаимодействие Kubernetes: от пакетов до подов

Сетевое взаимодействие Kubernetes не должно быть черным ящиком. В этом руководстве мы разбираем его, начиная с основ сетевого взаимодействия Linux и изоляции контейнеров. Затем мы углубляемся в полную модель Kubernetes, объясняя все: от IP-адресов подов и плагинов CNI до сервисов, NetworkPolicy и Ingress, предоставляя четкую карту от начала до конца того, как работает связность в вашем кластере.


📌 Подробнее: https://www.lucavallin.com/blog/kubernetes-networking-from-packets-to-pods

MemOps 🤨
Luca Cavallin Kubernetes Networking from Packets to Pods | Blog Kubernetes networking doesn't have to be a black box. This guide breaks it down, starting from the fundamentals of Linux networking and container isolation. We then dive into the complete Kubernetes model, explaining everything from Pod IPs and CNI plugins…
  • ❤ 2
  • 👍 1
Post #7814 1.52K
Не нашел 🤷‍♂️

MemOps
😃
  • 😁 26
  • ❤ 1
  • 🔥 1
Post #7813 1.42K
k3s-cluster-maintenance

Модульная роль и плейбук Ansible, выполняющие автоматическое обновление операционной системы и техническое обслуживание узлов кластера K3s с семантикой нулевого времени простоя.


📌 Подробнее: https://github.com/sudo-kraken/k3s-cluster-maintenance

MemOps 🤨
GitHub GitHub - sudo-kraken/k3s-cluster-maintenance: Enterprise K3s maintenance automation - Zero-downtime OS patching with intelligent… Enterprise K3s maintenance automation - Zero-downtime OS patching with intelligent health checks, Longhorn integration, and role-based Ansible architecture. Production-ready sequential node updates...
Post #7811 1.44K
SRE-агенты переходят от рекомендаций к автономным действиям

В классическом SRE инженер получает алерт, открывает консоль, гоняет диагностику и правит по ранбуку. Агент ИИ может съесть тот же алерт, коррелировать его с недавним деплоем и выполнить рутинное исправление самостоятельно.

Это меняет роль SRE: из «делающего вручную» в «менеджера команды агентов», которые накапливают операционную память и снижают зависимость от одного эксперта. Но работает только при одном условии — выбираете один целевой сценарий, а не натягиваете «ИИ-слой» на всё подряд.


📌 Подробнее: https://thenewstack.io/sre-ai-agents-capabilities/

MemOps 🤨
The New Stack 5 ways SRE AI agents are set to augment human capabilities Learn how SRE AI agents shift engineers from manual toil to strategic decision-making and proactive digital operations management.
  • ❤ 3
Post #7808 1.52K
Post #7806 1.52K
Pod завис в Pending? Вот по какой цепочке kube-scheduler решает, куда его посадить

kube-scheduler не выбирает ноду случайно. Сначала Pod попадает в ActiveQueue и сортируется по приоритету — PriorityClass здесь решает, кто пойдёт первым. Потом идёт фильтрация: какие ноды вообще подходят по ресурсам, taint’ам и affinity. Оставшиеся кандидаты проходят scoring, где учитываются запрошенные ресурсы, topology spread и affinity.

Если Pod не запланировался, смотрите kubectl describe pod: в Events увидите, на каком шаге отсеялись ноды и почему. Иногда причина в resource requests, иногда в taints или anti-affinity. Разбор на devops.dev проходит путь от очереди до binding и preemption.


📌 Подробнее: https://blog.devops.dev/where-did-my-pod-go-a-deep-dive-into-k8s-scheduling-d1d50c23e549

MemOps 🤨
Medium Where Did My Pod Go? A Deep Dive into K8s Scheduling We’re going to trace the entire scheduling journey, sit tight and enjoy!!
  • ❤ 2
Post #7804 1.45K
Что на самом деле происходит, когда вы запускаете контейнер самой типичной командой docker run nginx?

На первый взгляд кажется, что Nginx становится вашим foreground-процессом в терминале – он перехватывает stdio-потоки и реагирует на сигналы, когда вы нажимаете Ctrl+C или меняете размер окна терминала.

Но в реальности терминалом управляет процесс Docker-клиента, а сам Nginx работает в фоне или вообще на удалённой машине. При этом между docker CLI, dockerd (основным Docker-демоном) и containerd (низкоуровневым container runtime) происходит довольно сложная проксировка данных и сигналов — из-за чего всё ощущается как простой локальный запуск.

Почему это важно? Понимание того, как работает docker run под капотом — ключ к пониманию Kubernetes и других продакшн-рантаймов. В продакшене контейнеризованные приложения обычно работают в фоне, но Kubernetes и похожие системы позволяют стримить логи приложений и даже переподключаться к процессам в контейнерах, используя те же самые трюки, что и Docker.

Подробнее о магии за командой docker run — в подробном разборе (с кучей практических упражнений):


📌 Подробнее: https://labs.iximiuz.com/tutorials/docker-run-vs-attach-vs-exec

MemOps 🤨
  • 👍 3
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →