Edocti Training
DevOps Avansat & SRE: Arhitecturi Cloud-Native
Sesiuni programate
Nu există sesiuni disponibile în acest moment.
Abilități dobândite
Advanced IaC State Management
GitOps cu ArgoCD
Software Supply Chain Security
Guvernanță Kubernetes (OPA)
Progressive Delivery (Canary/Blue-Green)
KEDA Autoscaling
Fundamente SRE (SLI/SLO)
Cloud-Native Observability
Curriculum
Infrastructure as Code (IaC) Avansat
- Gestionarea stării la scară largă: Terraform State Management, Workspaces și concurrency locks
- Crearea și publicarea de module (Terraform Modules / Bicep Registries) pentru standardizarea infrastructurii la nivel enterprise
- Lab: Refactorizarea codului IaC monolitic în module reutilizabile și versionate
Paradigma GitOps
- Deployments Push-based vs. Pull-based: înțelegerea schimbării arhitecturale
- Introducere în ArgoCD (sau Flux): sincronizarea automată a stării clusterului direct din repository-urile Git
- Lab: Implementarea unei arhitecturi GitOps cu ArgoCD pentru un deployment de aplicație multi-environment
DevSecOps Avansat & Supply Chain Security
- Generarea și validarea unui SBOM (Software Bill of Materials)
- Semnarea imaginilor Docker (Sigstore/Cosign) pentru a preveni injectarea de cod malițios în producție
- Lab: Setarea unui pipeline de imagini securizat care blochează implementarea containerelor nesemnate
Guvernanță & Securitate Kubernetes (AKS/EKS)
- Dincolo de containere de bază: Network Policies pentru implementarea Zero Trust în interiorul clusterului
- Policy-as-Code: impunerea de reguli la nivel de cluster folosind OPA Gatekeeper sau Kyverno (ex: respingerea containerelor cu privilegii de root)
- Lab: Scrierea și aplicarea de politici OPA customizate pentru a audita și bloca manifestele Kubernetes neconforme
Strategii de Lansare Avansate (Progressive Delivery)
- Trecerea de la Rolling Updates la Blue/Green Deployments și Canary Releases
- Integrarea analizei automate de metrici pentru a determina starea de sănătate a lansării
- Lab: Automatizarea unei lansări Canary, direcționând inițial doar 10% din traficul live către noua versiune și monitorizând ratele de eroare
Autoscaling Kubernetes Avansat
- Depășirea limitelor standard de CPU/Memorie cu Kubernetes Event-driven Autoscaling (KEDA)
- Lab: Scalarea workload-urilor pe baza evenimentelor externe (ex: scalarea pod-urilor în funcție de lungimea unei cozi de mesaje Azure Service Bus/RabbitMQ)
Fundamente Site Reliability Engineering (SRE)
- Definirea și măsurarea SLI-urilor (Service Level Indicators) și SLO-urilor (Service Level Objectives)
- Gestionarea "Error Budgets": calcularea momentului în care trebuie oprite lansările de noi funcționalități pentru a stabiliza sistemul
- Workshop: Definirea unor SLO-uri și Error Budgets realiste pentru o arhitectură e-commerce de test
Cloud-Native Observability
- Tranziția de la monitorizarea tradițională la observabilitate cu stiva Prometheus & Grafana
- Distributed Tracing (OpenTelemetry): urmărirea unui singur request prin zeci de microservicii pentru a identifica sursele latenței
- Lab: Instrumentarea unei aplicații microserviciu cu OpenTelemetry și vizualizarea trace-urilor pentru a depana un blocaj de performanță
Chaos Engineering & Game Days
- Introducere în Chaos Engineering: injectarea controlată de defecte pentru a testa reziliența sistemului înainte să apară întreruperi în producție
- Conducerea "Game Days": pregătirea echipei de engineering pentru scenarii reale de disaster recovery
- Lab: Simularea terminării pod-urilor și a latenței de rețea pentru a observa capacitățile de auto-reparare (self-healing) ale sistemului
Module opționale
Opțional — Cloud FinOps Avansat pentru Kubernetes
- Înțelegerea alocării costurilor Kubernetes folosind tool-uri precum Kubecost sau OpenCost
- Dimensionarea corectă (Right-sizing) a workload-urilor și optimizarea node pool-urilor pentru eficiență maximă a costurilor
Structura zilei de curs
- Partea 1: 09:00–10:30
- Pauză: 10:30–10:45
- Partea 2: 10:45–12:45
- Pauză de masă: 12:15–13:15
- Partea 3: 13:15–15:15
- Pauză: 15:15–15:30
- Partea 4: 15:30–17:30