Статьи по Kubernetes, мониторингу и релизам
Статьи и чеклисты для команд, которые отвечают за production-инфраструктуру: аудит, мониторинг, релизы, поддержка и снижение операционных рисков.
Чеклист аудита Kubernetes-кластера перед production
Что проверить в Kubernetes перед production: права доступа, ресурсы, ingress, storage, мониторинг, backup, обновления и rollback.
Deckhouse Kubernetes: когда платформа помогает, а когда усложняет контур
Разбор Deckhouse Kubernetes для production: когда платформа снижает операционную нагрузку, какие риски проверить и что подготовить до внедрения.
Prometheus и Grafana в production: что проверить до доверия алертам
Чеклист production-мониторинга на Prometheus и Grafana: метрики, алерты, дашборды, Alertmanager, SLO, инструкции реагирования и проверки после релиза.
Что входит в DevOps-аудит инфраструктуры
Практический разбор DevOps-аудита: доступы, CI/CD, Kubernetes, мониторинг, backup, безопасность, IaC и план исправлений.
Zabbix, Prometheus и Grafana для Kubernetes: что выбрать для production-мониторинга
Когда использовать Zabbix, Prometheus и Grafana для Kubernetes и production-инфраструктуры: роли инструментов, алерты, логи, SLO и план внедрения.
GitLab CI/CD для Kubernetes: как настроить pipeline без ручного деплоя
Как настроить GitLab CI/CD pipeline для Kubernetes: runners, Docker registry, Helm/Argo CD, variables, secrets, approvals, rollback и post-release проверки.
Terraform, IaC и GitOps: как держать infrastructure drift под контролем
Как настроить Terraform, Infrastructure as Code и GitOps с безопасным plan/apply: state, modules, environments, drift control, Argo CD, review и сопровождение IaC.
Аудит ИТ-инфраструктуры: что проверить в серверах, облаке и отказоустойчивости
Чеклист аудита ИТ-инфраструктуры: серверы, облако, отказоустойчивость, резервное копирование, мониторинг, доступы, CI/CD, Kubernetes и план 30/60/90.
Поддержка Kubernetes для малого бизнеса: когда нужен внешний DevOps/SRE
Когда малому бизнесу нужна поддержка Kubernetes: релизы, резервное копирование, мониторинг, доступы, обновления, инциденты и внешний DevOps/SRE без найма в штат.