TGViewer
Channel Public Channel
DevOps MemOps

DevOps MemOps

@devops_memops

Всё о DevOps

Для связи - @raz_raz
Заказать рекламу через биржу: https://telega.in/c/devops_memops
Subscribers
6.34K
Photos
3.4K
Videos
535
Links
5.4K

Showing posts older than #7916 · Back to latest

Older Posts 20 shown
Post #7915 1.41K
Как мониторить Java-приложения: метрики, алерты и правило 80/20

Хороший мониторинг помогает быстро понять, что происходит с приложением и куда смотреть в первую очередь. Для этого не нужно пытаться измерить всё: базовый набор технических метрик покрывает большинство типовых проблем, а бизнес-метрики, SLO и анализ аномалий помогают заранее замечать нетипичные отклонения. В Календаре мы называем этот подход правилом 80/20.
Всем привет! Меня зовут Настя, я бэкенд-разработчик в Яндекс 360 и отвечаю за надёжность Календаря. В этой статье я покажу, какие метрики стоит взять за основу, как выбирать полезные алерты и чем дополнять базовый набор для оставшихся 20%.

В статье хороший разбор подхода 80/20: какие метрики реально ловят большую часть проблем, зачем следить за RED, лагами очередей, connection pool и JVM, когда нужны бизнес-метрики и SLO, и почему аномалии иногда полезнее очередного статического порога.

Отдельно плюсую за onepager, drill-down и ранбуки. Потому что хороший мониторинг — это не «у нас есть график на всё», а «мы быстро поняли, что сломалось и что делать дальше».


📌 Подробнее: https://habr.com/ru/companies/yandex/articles/1068874/

MemOps 🤨
  • 👍 2
Post #7912 1.43K
Как мы перестроили архитектуру нашего Vault с использованием Raft, снимков и аварийного восстановления

Управление секретами в масштабе — это не просто безопасность, это доступность, отказоустойчивость и экономическая эффективность. В BioCatch мы используем HashiCorp Vault для управления секретами в нашей среде Kubernetes, но наша начальная конфигурация оставляла место для улучшений.

Вот как мы перепроектировали архитектуру Vault, используя хранилище Raft, автоматизацию Kubernetes и аварийное восстановление на основе снимков, в результате чего получилась система, которая обладает высокой доступностью, экономически эффективна и готова к работе в производственной среде.


📌 Подробнее: https://medium.com/@BioCatchTechBlog/how-we-rebuilt-our-vault-architecture-with-raft-snapshots-and-dr-b6789ea5fa28

MemOps 🤨
Medium How We Rebuilt Our Vault Architecture with Raft, Snapshots, and DR Author: Moshe Levine, DevOps Team Lead, BioCatch. Follow Moshe on Medium at https://medium.com/@moshlevine.
  • ❤ 1
Post #7910 1.46K
Mastering Log Rotation in Linux with Logrotate

Logrotate — тот самый компонент, про который обычно вспоминают в двух случаях:

— когда закончилось место на диске;

— когда после ротации внезапно выяснилось, что приложение продолжало писать не туда

Статья разбирает, что происходит под капотом утилиты: когда использовать size, чем minsize отличается от maxsize, почему create обычно безопаснее и за что можно не любить copytruncate — у него есть небольшое окно, в котором часть логов действительно может потеряться.


📌 Подробнее: https://www.dash0.com/guides/log-rotation-linux-logrotate

MemOps 🤨
Dash0 Mastering Log Rotation in Linux with Logrotate · Dash0 Logrotate is the standard utility in Linux for managing log file rotation This guide will explain its operation and how to customize it for your specific logging requirements
  • 👍 3
Post #7907 1.42K
Metric cardinality limits in OpenTelemetry: a practical guide

Метрики OpenTelemetry разработаны таким образом, чтобы их было безопасно использовать в проде. Одним из элементов этой безопасности является ограничение кардинальности в SDK метрик. Это ограничение защищает от неограниченного роста объема памяти, когда метрика получает слишком много уникальных комбинаций атрибутов.

Такая защита полезна, но у неё есть последствие, которого многие пользователи не ожидают: при переполнении потока метрик общее значение остаётся корректным, в то время как запросы, фильтрующие или группирующие данные по атрибутам, могут занижать его. Это может повлиять на панели мониторинга, цели уровня обслуживания (SLO) и оповещения, которые выглядели корректно до начала переполнения.

В документации теперь есть раздел Ограничения кардинальности, который объясняет поведение SDK.

Эта статья в блоге OpenTelemetry — оперативное дополнение к этой части документации. В ней объясняется, что означает ограничение на практике, почему это влияет на каждый атрибут измерения, в котором произошло переполнение, как выбрать разумное ограничение, как проверить, достигнуто ли оно уже, и как отслеживать его в проде.

📌 Подробнее: https://opentelemetry.io/blog/2026/cardinality-limits-in-opentelemetry/

MemOps 🤨
OpenTelemetry Metrics A measurement captured at runtime.
  • 👍 3
Post #7904 1.44K
Из статьи "Automating Penetration Testing with SecureCodeBox on Kubernetes Kind Clusters Using GitHub Actions" вы узнаете как можно автоматизировать пентест с помощью проекта SecureCodeBox, который работает как Kubernetes оператор.

📌 Подробнее: https://medium.com/@gyasmine29/automating-penetration-testing-with-securecodebox-on-kubernetes-kind-clusters-using-github-actions-27230b8b087c

MemOps 🤨
Medium Automating Penetration Testing with SecureCodeBox on Kubernetes Kind Clusters Using GitHub Actions Introduction
Post #7902 1.49K
VictoriaLogs Deployment: Single Node vs Cluster Mode — A Comprehensive Guide

В статье разбираются оба варианта: single-node и cluster mode, с практическими примерами установки, настройкой Filebeat, подключением Grafana и базовым алертингом.

Ключевая мысль простая: single-node хорошо подходит для небольших и средних нагрузок, а кластер имеет смысл разворачивать, когда появляются требования к горизонтальному масштабированию, высокой доступности и устойчивости при больших объёмах логов.

Автор показывает архитектуру кластера VictoriaLogs: vlinsert принимает данные, vlstorage отвечает за хранение, а vlselect — за запросы. Также есть понятный сценарий миграции с одной ноды на кластер без полной перестройки ingestion-пайплайна.

В статье разбираются оба варианта: single-node и cluster mode, с практическими примерами установки, настройкой Filebeat, подключением Grafana и базовым алертингом.

Ключевая мысль простая: single-node хорошо подходит для небольших и средних нагрузок, где важны простота и экономия ресурсов. Кластер имеет смысл, когда появляются требования к горизонтальному масштабированию, высокой доступности и устойчивости при больших объёмах логов.

Автор показывает саму архитектуру кластера VictoriaLogs: vlinsert принимает данные, vlstorage отвечает за хранение, а vlselect — за запросы. Плюс есть понятный сценарий миграции с одной ноды на кластер без полной перестройки ingestion-пайплайна.


📌 Подробнее: https://medium.com/@btech-engineering/victorialogs-deployment-single-node-vs-cluster-mode-a-comprehensive-guide-24284c0d1134

MemOps 🤨
Post #7899 1.44K
Эх, если бы данные можно было просто переносить портальной пушкой — они бы мгновенно оказывались в безопасном месте.
Но вам это не нужно!

Облачное хранилище S3 от Selectel в новом катастрофоустойчивом регионе изначально держит три копии на трех разных площадках в Москве.
Это значит, что ваши данные останутся в полной сохранности и сервисы продолжат работать без паузы, даже если произойдет сбой на одной из площадок.

Почему выбирают S3 в регионе ru-6 от Selectel:

🔹 Надежность. Зоны доступности находятся на расстоянии ~15 км и не зависят друг от друга.

🔹 Удобство. Архитектура готова «из коробки», не нужно вручную распределять реплики между зонами доступности.

🔹 Экономия. Решение обходится дешевле классического аварийного восстановления. При этом распределение по трем площадкам — по цене хранилища без георезервирования.

Узнайте больше о катастрофоустойчивом хранилище в новом регионе ru-6: 👉 https://slc.tl/zy19x

Реклама. АО "Селектел". erid:2W5zFGRtrKs
  • ❤ 1
  • 🤯 1
Post #7898 1.47K
NetWatch — узнайте, что на самом деле делает ваша сеть - в режиме реального времени, прямо в вашем терминале.

Сетевой монитор, который считывает зашифрованный трафик, присваивает имя процессу, стоящему за каждым соединением, и перехватывает вредоносные программы, отправляющие запросы на удаленный сервер. Один исполняемый файл. Не требует настроек.

Большинство сетевых инструментов отвечают на один вопрос - «что использует мою пропускную способность?» и останавливаются. NetWatch же продолжает работу. Он декодирует протоколы, передаваемые по сети, сообщает, какая программа открыла каждое соединение, и отслеживает признаки проблем - сканирование портов, отправка вредоносных программ на командный сервер, утечка данных через DNS. Когда что-то кажется подозрительным, одно нажатие клавиши блокирует портативный пакет доказательств, который можно прикрепить к отчету об ошибке.

Представьте себе, что это один бинарный файл без конфигурации, который выполняет функции измерителя пропускной способности, средства анализа угроз, как в Wireshark, и легковесного детектора вторжений — и всё это без необходимости покидать терминал.

Создано для специалистов по обеспечению безопасности, реагирования на инциденты, SRE-инженеров и разработчиков домашних лабораторий, которым необходимо видеть, что происходит прямо сейчас, а не анализировать файл захвата через час.


📌 Подробнее: https://github.com/matthart1983/netwatch

MemOps 🤨
GitHub GitHub - matthart1983/netwatch: Real-time network diagnostics in your terminal. One command, zero config, instant visibility. Real-time network diagnostics in your terminal. One command, zero config, instant visibility. - matthart1983/netwatch
  • ❤ 1
Post #7895 1.43K
netscan — непрерывный мониторинг поверхности для атаки - рабочий процесс TUI для nmap.

netscan использует движок nmap в качестве основы для полноценного рабочего процесса: инвентаризация целевых объектов, сохраненные профили сканирования, потоковая передача результатов в реальном времени по мере поступления данных от каждого хоста и история сканирования с дифференциальным сканированием. Один исполняемый файл. При первом запуске настройка не требуется. Может работать в headless режиме как демон.


📌 Подробнее: https://github.com/matthart1983/netscan

MemOps 🤨
GitHub GitHub - matthart1983/netscan: The continuous attack surface monitor — a TUI workflow for nmap with scan history, differential… The continuous attack surface monitor — a TUI workflow for nmap with scan history, differential scanning, and opt-in AI triage - matthart1983/netscan
  • 💯 1
Post #7893 1.49K
Epiq — cелфхостед система отслеживания задач, вдохновленная Vim, которая расширяет возможности управления проектами для разработчиков. Она отображается либо в формате ASCII, либо в виде веб-интерфейса и сохраняет состояние в виде неизменяемого распределенного журнала событий, версионируемого и синхронизируемого через Git.

📌 Подробнее: https://github.com/ljtn/epiq

MemOps 🤨
GitHub GitHub - ljtn/epiq: Distributed, code-native issue tracker - audit workflows via time-travel Distributed, code-native issue tracker - audit workflows via time-travel - ljtn/epiq
  • 👍 1
Post #7890 1.54K
Как настроить Docker для автоматизированного тестирования

Docker позволяет эффективно автоматизировать тестирование программного обеспечения, создавая виртуализированные среды с помощью контейнеров и интегрируя их с Selenium для параллельного выполнения тестов в разных браузерах.

📌 Подробнее: https://qarocks.ru/docker-for-automation-testing/

MemOps 🤨
  • 🦄 3
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →