TGViewer
Channel Public Channel
sysadmin.su

sysadmin.su

@sysadminsu

Админам/sre/devops’ам будет интересно!
Subscribers
329
Photos
325
Videos
32
Links
2.2K

Showing posts older than #2502 · Back to latest

Older Posts 19 shown
Post #2500 281

Forwarded from about:performance

На Hacker News происходит множество обсуждений разной степени интересности и иногда попадаются настоящие самородки, где умные дядьки делятся с общественностью своими знаниями.

Одно из таких - Ask HN: How can I learn about performance optimization?

Народ из разных сфер разработки — обработки видео, геймдева, HFT и классической продуктовой — делится опытом и помогает выработать правильный майндсет: о чем думать и куда смотреть, когда речь заходит о производительности.

Отдельно стоит выделить совет:
cамый простой способ ускорить работу — делать меньше работы или не делать вовсе


Проще некуда, да? 🙂

Интересно, что в книге Systems Performance: Enterprise and the Cloud Брэндан Грегг, формулируя свои "мантры о производительности", начинает именно с этого принципа:
1. Don’t do it.
2. Do it, but don’t do it again.
3. Do it less.
4. Do it later.
5. Do it when they’re not looking.
6. Do it concurrently.
7. Do it more cheaply
Amazon Systems Performance: Enterprise and the Cloud (Addison-Wesley Professional Computing Series) covers concepts, strategy, tools, and tuning for operating systems and applications, using Linux-based operating systems as the primary example. A deep understanding of these tools and techniques is critical for developers today. Implementing the strategies…
Post #2499 247

Forwarded from Владислав Князев

К. Вигерс - Выжимка.pdf5.9 MB
Карл Вигерс. Краткая выжимка книги "Разработка требований к программному обеспечению".

📘 Репосты в Избранное приготовили?

Нашел классную структурированную версию труда старины Карла. Какой-то герой сократил книгу в 10 (!) раз — с 736 страниц до 72. И сделал это прям качественно!

Забирайте.

@godnolytika
Post #2497 327

Forwarded from Enabling.team Insights

В начале 2024 года вышел отчет по состоянию Site Reliability Engineering в индустрии — The SRE Report 2024. Это уже 6-е издание отчета, исследования проводятся с 2018 года рабочей группой, состоящей из сотрудников Catchpoint и приглашенных экспертов. В подготовке текущего отчета участвовали: Niall Murphy (автор книг Site Reliability Engineering и The Site Reliability Workbook), Alex Hidalgo (автор книги Implementing SLO), Alex Elman (Indeed), Sarah Butt (SentinelOne), Kurt Andersen (Clari, SREcon) и др. Про компанию Catchpoint известно, что они разрабатывают SaaS платформу для Digital Experience Monitoring, аналогами которой являются платформы от Datadog, Dynatrace и New Relic. Исследование проводилось в форме опроса, в котором в этом году приняло участие 433 представителя индустрии, большинство из Америки и крупных компаний (больше 1000 сотрудников) из следующих индустрий: Technology, Financial, Healthcare, Government и Professional services.

Что интересного мы отметили в отчете:
1. В небольших компаниях (до 100 инженеров) функция SRE централизована в одной команде, поддерживающей несколько сервисов. С ростом компании происходит разделение на продуктовые и платформенные команды, что приводит к изменению топологий и структуры SRE команды;
2. Основные трудности с которыми сталкиваются SRE команды: планирование бюджета и ресурсов, приоритизация и архитектура. При этом найм, взаимодействие с командами и прозрачность работы отмечают реже;
3. С точки зрения влияния SRE на бизнес (Business Value) отмечают следующие факторы: Операционная эффективность (Operational Efficiencies), Customer Satisfaction и Customer Experience, Repair Times и реже — соблюдение SLA и Velocity;
4. Наиболее сложными аспектами решения инцидентов выделяют диагностику и поиск проблем, эскалацию и координацию между участниками, извлечение уроков и обучение на инцидентах;
5. Основное внимание уделяется решению инцидентов, оказывающим значительное влияние на пользователей, инцидентам высокого уровня (High severity) и тем, которые видны публично;
6. В качестве областей для улучшения процессов надежности выделяют: смену фокуса с исправлений на обучение на инцидентах, установление связей между инцидентами, выполнение action items после разбора инцидентов;
7. Разбор инцидентов, проведение ретроспектив и подготовка постмортемов лидируются в основном представителями SRE команд и руководителями, отдельная выделенная incident team встречается редко и в больших компаниях. При этом половина участников отмечает что уделяют недостаточное время для разбора инцидентов;
8. Вне дежурств SRE команды тратят в среднем 50% времени на инженерную работу, 25% времени на операционную работу (Toil) и 15% на прерывания;
9. Большинство компаний используют от 2 до 5 различных инструментов и систем для мониторинга и наблюдаемости. Не только из-за разного функционала и сценариев использования, но часто в следствии дублирования. Количество инструментов увеличивается с ростом компании;
10. Кроме мониторинга внутренних сервисов подчеркивается важность мониторинга внешних сервисов, таких как BGP, CDN, SASE, SaaS, внешние DNS и API;
11. Наиболее часто используемые метрики для измерений: Uptime/Availability, Performance/Response time, Latency и Error rate. Saturation упоминается гораздо реже, а SLOs разделяют на два типа: Uptime SLOs и Performance SLOs.
Post #2496 247

Forwarded from Geeks (Shpak A.)

Распробовал на днях утилиту sq. Если jq - это инструмент для выборки и красивой визуализации данных из джейсонок, то sq - это все тоже самое (и даже чуть больше), но для баз данных. Выглядит прикольно, использовать (после jq) достаточно интуитивно, есть прикольные плюшки (например, просмотр диффа двух таблиц), умеет импортировать/экспортивароть данные. И, естественно, это опенсорсный проект. В общем, мне понравлось настолько, что не стыдно и вам показать https://sq.io/
sq sq data wrangler
Post #2495 228

Forwarded from Sysadmin Tools 🇺🇦

PerformanceAnalysisAndTuningOnModernCPUs_SecondEdition.pdf21.1 MB
The book "Performance Analysis and Tuning on Modern CPU"


My book is a 170+ page guide for optimizing the performance of applications that run on modern CPUs. It combines the knowledge of many experts from different industries, to whom I'm very thankful. Engineers from Google, Facebook, leading HFT, and game development firms helped me shape this book


https://github.com/dendibakh/perf-book

#book #perfomance
Post #2494 233

Forwarded from Yandex Cloud

🔓 Для нас в Yandex Cloud важно быть для каждого клиента надежным технологическим партнером.

Поэтому мы много работаем над тем, чтобы обеспечивать стабильность платформы. А если что-то идет не так, прозрачно и открыто рассказываем о том, что произошло и что мы делаем, чтобы избежать подобных ситуаций в будущем.

29 ноября 2024 года в работе облачной платформы произошел масштабный сбой, который повлиял на сервисы наших клиентов.

👉 По ссылке мы публикуем разбор этого инцидента и рассказываем, что уже предприняли для предотвращения повторных сбоев. В течение недели мы будем дополнять этот отчет деталями, а также поделимся дальнейшими планами по повышению надежности сети.

Мы приносим искренние извинения каждому, кого затронули перебои в работе платформы. А также благодарим коллег по индустрии, кто написал нам слова поддержки.

#yacloud_news
  • 👎 1
  • 😁 1
Post #2493 243

Forwarded from Мониторим ИТ

​Incident management at major sporting goods e-commerce

В этой статье техническая команда Декатлона рассказывает как у них устроена работа с инцидентами.

«Одним из главных препятствий, с которыми мы столкнулись, было отсутствие классификации инцидентов. Без четкого метода категоризации и квалификации инцидентов было сложно эффективно вовлекать соответствующие команды с правильным приоритетом, когда они не знали уровень серьезности. Каждая проблема казалась уникальной, что усложняло координацию и разрешение.»

Читать статью

❗️Статья в блоге на Medium
Post #2491 224

Forwarded from DevOps Deflope News

Red Hat объявила о передаче набора инструментов для работы с контейнерами, включая Podman, Buildah и Skopeo, под управление Cloud Native Computing Foundation: https://goo.su/nK98BDU

Это обеспечит повышение прозрачности разработки, поддержку открытых стандартов и активное участие сообщества в развитии инструментов.
Post #2490 246

Forwarded from Maxim Ivanov

Называется где взять время на все
SRE Day новый 2024 Q4 вышел - https://www.youtube.com/@sreday/videos
Observability Day и AI Day Вышли - https://www.youtube.com/@cncf/videos
SRE Unix Linux etc видео вышли - https://www.youtube.com/@UsenixOrg/videos

Я конечно рад, но не от всего сердца =)
YouTube SREday Share your videos with friends, family, and the world
Post #2489 277

Forwarded from DevOps&SRE Library

Understanding DNS in Kubernetes

In this post, we will cover the following:

- Overview of DNS Resolution and CoreDNS, the default DNS provider in Kubernetes.
- Kubernetes DNS policies, such as ClusterFirst, Default, and None, and their effects on pod DNS configurations.
- Differences between The GNU C Library (glibc) and musl libraries.


https://povilasv.me/understanding-dns-in-kubernetes
Post #2484 266

Forwarded from Кубертатный период (Pavel Klyuev)

Kubernetes Guru

Очень интересный сервис: выдает достаточно точные ответы с примерами на вопросы про Kubernetes с помощью AI.

Этот сервис работает на основе подхода RAG и по результатам тестирования иногда дает более точные ответы, чем другие популярные AI, например ChatGPT.

Подробнее -- https://medium.com/@PlanB./kubernetes-guru-a-new-ai-tool-for-mastering-k8s-challenges-69bab4e57c84
Post #2482 218

Forwarded from Владислав Князев

К. Вигерс - Выжимка.pdf5.9 MB
Карл Вигерс. Краткая выжимка книги "Разработка требований к программному обеспечению".

📘 Репосты в Избранное приготовили?

Нашел классную структурированную версию труда старины Карла. Какой-то герой сократил книгу в 10 (!) раз — с 736 страниц до 72. И сделал это прям качественно!

Забирайте.

@godnolytika
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →