TGViewer
Channel Public Channel
DevOps MemOps

DevOps MemOps

@devops_memops

Всё о DevOps

Для связи - @raz_raz
Заказать рекламу через биржу: https://telega.in/c/devops_memops
Subscribers
6.34K
Photos
3.4K
Videos
535
Links
5.4K

Showing posts older than #7717 · Back to latest

Older Posts 19 shown
Post #7714 1.49K
Новая конвертация из CPU Shares cgroup v1 в CPU Weight v2

Я рад объявить о реализации улучшенной формулы конвертации из CPU shares cgroup v1 в CPU weight cgroup v2. Это улучшение решает критические проблемы с распределением приоритетов CPU для рабочих нагрузок Kubernetes при запуске на системах с cgroup v2.


📌 Подробнее: https://kubernetes.io/blog/2026/01/30/new-cgroup-v1-to-v2-cpu-conversion-formula

MemOps 🤨
Kubernetes New Conversion from cgroup v1 CPU Shares to v2 CPU Weight I'm excited to announce the implementation of an improved conversion formula from cgroup v1 CPU shares to cgroup v2 CPU weight. This enhancement addresses critical issues with CPU priority allocation for Kubernetes workloads when running on systems with cgroup…
  • 👍 3
  • ❤ 1
Post #7711 1.44K
Кто работает, когда ничего не работает: от алерта до постмортема

Четыре года мы были уверены, что во время инцидента с клиентом должна общаться первая линия поддержки. Потом решили, что это должен делать сам исполнитель тикета. Оба подхода не работали — по разным причинам. Этот текст — о том, к чему мы пришли, и о реальном инциденте, который проверил итоговую схему на прочность.

Когда 20 ноября 2025 года из-за ошибки в конфигурации одного коммутатора отказала дисковая подсистема всей платформы, пятьдесят наших клиентов одновременно открыли тикеты. В этот момент выяснилось главное: техническая проблема была одна, а коммуникационных — десятки. Инцидент в инфраструктуре можно устранить за часы; инцидент доверия, если им не управлять, длится гораздо дольше. Именно поэтому зрелая поддержка — это не инженер за терминалом, а параллельно работающая система: одни чинят, другие в этот момент разговаривают с бизнесом клиента.


📌 Подробнее: https://habr.com/ru/companies/k2tech/articles/1054620/

MemOps 🤨
  • ❤ 2
Post #7709 1.64K
4 MCP-сервера, о которых стоит знать каждому DevOps-инженеру

1. Kubernetes MCP
- расследовать pod’ы в CrashLoopBackOff;
- дебажить неудачные деплои;
- анализировать состояние кластера.

https://github.com/Flux159/mcp-server-kubernetes

2. AWS MCP
- разбирать резкие скачки расходов в AWS;
- находить неиспользуемые ресурсы;
- troubleshooting облачной инфраструктуры.

https://github.com/awslabs/mcp

3. Terraform MCP
- проверять Terraform-планы;
- находить drift в инфраструктуре;
- объяснять изменения в инфраструктуре.

https://github.com/hashicorp/terraform-mcp-server

4. Grafana + Prometheus MCP
- расследовать скачки latency;
- анализировать production-инциденты;
- объяснять alert storms.

https://github.com/grafana/mcp-grafana
https://github.com/pab1it0/prometheus-mcp-server

MemOps 🤨
  • ❤ 4
  • 👍 2
  • 🔥 2
Post #7704 1.39K
SnapScheduler — контроллер Kubernetes, который автоматически создает снапшоты PVC (PersistentVolumeClaim) по расписанию, используя встроенный механизм VolumeSnapshot. Он не зависит от CSI-драйвера, пока тот поддерживает VolumeSnapshot, и работает с любым сторедж-классом, поддерживающим снапшоты.

Основные возможности:
- Создание снапшотов PVC по расписанию (cron).
- Поддержка нескольких расписаний для одного PVC.
- Возможность настройки политики хранения (retention policy).
- Не требует изменений в приложении или манифестах PVC.

Как это работает:
Вы создаете ресурс SnapshotSchedule, в котором указываете:
- Селектор PVC.
- Cron-расписание.
- Максимальное количество снапшотов для хранения.
Контроллер следит за расписанием и создает VolumeSnapshot объекты автоматически.

Такой манифест будет создавать снапшоты каждые 6 часов для всех PVC с лейблом snapshot=true, и хранить максимум 5 последних.


📌 Подробнее: https://github.com/backube/snapscheduler

MemOps 🤨
GitHub GitHub - backube/snapscheduler: Scheduled snapshots for Kubernetes persistent volumes Scheduled snapshots for Kubernetes persistent volumes - backube/snapscheduler
  • 👍 2
  • ❤ 1
Post #7701 2.58K
ownCloud Infinite Scale (oCIS) — новая платформа для синхронизации и обмена файлами, которая станет основой вашей платформы управления данными.

Infinite Scale - это облачная микросервисная архитектура и серверные приложения последнего поколения. Она не зависит от внешних программных пакетов, таких как PHP или базы данных, что устраняет все сложности, связанные с их использованием. Благодаря своей современной архитектуре, Infinite Scale предоставляет все модели развертывания для облачной инфраструктуры и оптимизированные настройки масштабирования для достижения наилучших результатов при минимальных затратах. Концепция единого бинарного файла значительно упрощает управление сервером по сравнению с любыми другими методами развертывания.

Infinite Scale поддерживает следующие клиенты ownCloud:
- веб
- Android
- iOS
- Рабочий стол

Для синхронизации и совместного использования файловых пространств с масштабируемой серверной частью на базе Reva с использованием открытых и хорошо определенных API, таких как WebDAV и CS3.

Infinite Scale ориентирован на простоту установки и эксплуатации и поставляется в виде единого исполняемого файла или контейнера, позволяющего масштабировать систему от Raspberry Pi до кластера Kubernetes путем изменения конфигурации и запуска нескольких сервисов по мере необходимости. Мультисервисная архитектура позволяет адаптировать функциональность под ваши потребности и повторно использовать уже существующие сервисы, например, при использовании Keycloak.


📌 Подробнее: https://github.com/owncloud/ocis

MemOps 🤨
GitHub GitHub - owncloud/ocis: :atom_symbol: ownCloud Infinite Scale :atom_symbol: ownCloud Infinite Scale. Contribute to owncloud/ocis development by creating an account on GitHub.
  • 👍 2
Post #7699 1.45K
MemOps 😃
  • 😁 33
  • ❤ 6
  • 💯 3
  • 😈 1
Post #7698 2.31K
crowdsec_manager — веб-интерфейс управления CrowdSec. Принятие решений, оповещения, списки разрешенных пользователей, сценарии, центр управления, журналы, резервное копирование и интеграция с Traefik.

Плюс нативное iOS и Android приложение. Поддерживает режимы подключения Pangolin (удаленный доступ на основе токенов) и Basis (прямой URL).

📌 Подробнее: https://github.com/hhftechnology/crowdsec_manager

MemOps 🤨
  • ❤ 4
Post #7694 1.32K
Проектирование для отказа: лучшие практики инженерии хаоса

Если вы сегодня возглавляете инженерную команду, ваша задача — не предотвращать отказы. Ваша задача — создавать системы, которые процветают в условиях сбоев. Это дисциплина инженерии хаоса. Речь идет не просто о поломке вещей в продакшене; это научный метод проверки отказоустойчивости.


📌 Подробнее: https://pulse.rajatgupta.work/designing-for-failure-chaos-engineering-best-practices-68503eb1b27b

MemOps 🤨
Medium Designing for Failure: Chaos Engineering Best Practices Reliability isn’t about avoiding failure. It’s about surviving it. Here is the technical blueprint for breaking your own systems safely.
Post #7691 1.37K
Автоматизированный GitOps: от пуша в ECR до деплоя в EKS

В этой статье мы рассмотрим, как создать полностью автоматизированный рабочий процесс CI/CD с использованием Argo CD, Argo CD Image Updater, GitHub, Amazon Elastic Container Registry и Amazon Elastic Kubernetes Service. Эта настройка обеспечивает автоматическое развертывание всякий раз, когда новый образ контейнера загружается в реестр без какого-либо ручного вмешательства.


📌 Подробнее: https://medium.com/@alex.ivenin/automated-gitops-from-ecr-push-to-eks-deploy-a210cee0600c

MemOps 🤨
Medium Automated GitOps: from ECR push to EKS deploy Modern cloud-native applications benefit greatly from automated, declarative deployment pipelines. One powerful approach is GitOps, where…
  • ❤ 1
Post #7688 2.47K
Оптимизация Kubernetes за пределами запросов и лимитов — блокираторы масштабирования узлов

Перестаньте платить за простаивающие ресурсы. Узнайте, как выявлять и устранять скрытые блокираторы, препятствующие масштабированию вашего кластера вниз.


📌 Подробнее: https://medium.com/@david.b.chase/kubernetes-optimization-beyond-requests-and-limits-node-scaling-blockers-649ae187f54a

MemOps 🤨
Medium Kubernetes Optimization Beyond Requests and Limits — Node Scaling Blockers Stop paying for idle resources. Learn to identify and eliminate the hidden blockers preventing your cluster from scaling down.
  • 👍 2
Post #7687 1.43K
MemOps 😃
  • 💯 25
  • ❤ 7
  • 😁 7
  • 👍 1
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →