Edocti
Training tehnic avansat pentru inginerul software de mâine
Edocti Training

DevOps Avansat & SRE: Arhitecturi Cloud-Native

Avansat
21 h
5.0 (0 recenzii)

Sesiuni programate

Nu există sesiuni disponibile în acest moment.
DevOps Avansat & SRE: Arhitecturi Cloud-Native

DevOps Avansat & SRE: Arhitecturi Cloud-Native. Un curs tehnic intensiv de 3 zile conceput pentru inginerii seniori care doresc să stăpânească sistemele distribuite la scară largă, reziliența și practicile cloud-native.

Treci dincolo de CI/CD de bază și Infrastructure as Code pentru a explora provocările de Platform Engineering la nivel enterprise. Vei învăța cum să implementezi GitOps, să aplici policy-as-code în Kubernetes și să stabilești baze solide de Site Reliability Engineering (SRE).

Abordăm provocări arhitecturale moderne: de la securizarea software supply chain-ului și realizarea de lansări Canary cu zero-downtime, până la urmărirea performanței microserviciilor folosind distributed tracing.

Câștigă experiență practică: Curriculumul conține laboratoare intensive, bazate pe scenarii reale, axate pe tool-uri de ultimă generație precum ArgoCD, OPA Gatekeeper, KEDA și stiva Prometheus/OpenTelemetry.

Abilități dobândite

Advanced IaC State Management GitOps cu ArgoCD Software Supply Chain Security Guvernanță Kubernetes (OPA) Progressive Delivery (Canary/Blue-Green) KEDA Autoscaling Fundamente SRE (SLI/SLO) Cloud-Native Observability

Curriculum

Infrastructure as Code (IaC) Avansat

  • Gestionarea stării la scară largă: Terraform State Management, Workspaces și concurrency locks
  • Crearea și publicarea de module (Terraform Modules / Bicep Registries) pentru standardizarea infrastructurii la nivel enterprise
  • Lab: Refactorizarea codului IaC monolitic în module reutilizabile și versionate

Paradigma GitOps

  • Deployments Push-based vs. Pull-based: înțelegerea schimbării arhitecturale
  • Introducere în ArgoCD (sau Flux): sincronizarea automată a stării clusterului direct din repository-urile Git
  • Lab: Implementarea unei arhitecturi GitOps cu ArgoCD pentru un deployment de aplicație multi-environment

DevSecOps Avansat & Supply Chain Security

  • Generarea și validarea unui SBOM (Software Bill of Materials)
  • Semnarea imaginilor Docker (Sigstore/Cosign) pentru a preveni injectarea de cod malițios în producție
  • Lab: Setarea unui pipeline de imagini securizat care blochează implementarea containerelor nesemnate

Guvernanță & Securitate Kubernetes (AKS/EKS)

  • Dincolo de containere de bază: Network Policies pentru implementarea Zero Trust în interiorul clusterului
  • Policy-as-Code: impunerea de reguli la nivel de cluster folosind OPA Gatekeeper sau Kyverno (ex: respingerea containerelor cu privilegii de root)
  • Lab: Scrierea și aplicarea de politici OPA customizate pentru a audita și bloca manifestele Kubernetes neconforme

Strategii de Lansare Avansate (Progressive Delivery)

  • Trecerea de la Rolling Updates la Blue/Green Deployments și Canary Releases
  • Integrarea analizei automate de metrici pentru a determina starea de sănătate a lansării
  • Lab: Automatizarea unei lansări Canary, direcționând inițial doar 10% din traficul live către noua versiune și monitorizând ratele de eroare

Autoscaling Kubernetes Avansat

  • Depășirea limitelor standard de CPU/Memorie cu Kubernetes Event-driven Autoscaling (KEDA)
  • Lab: Scalarea workload-urilor pe baza evenimentelor externe (ex: scalarea pod-urilor în funcție de lungimea unei cozi de mesaje Azure Service Bus/RabbitMQ)

Fundamente Site Reliability Engineering (SRE)

  • Definirea și măsurarea SLI-urilor (Service Level Indicators) și SLO-urilor (Service Level Objectives)
  • Gestionarea "Error Budgets": calcularea momentului în care trebuie oprite lansările de noi funcționalități pentru a stabiliza sistemul
  • Workshop: Definirea unor SLO-uri și Error Budgets realiste pentru o arhitectură e-commerce de test

Cloud-Native Observability

  • Tranziția de la monitorizarea tradițională la observabilitate cu stiva Prometheus & Grafana
  • Distributed Tracing (OpenTelemetry): urmărirea unui singur request prin zeci de microservicii pentru a identifica sursele latenței
  • Lab: Instrumentarea unei aplicații microserviciu cu OpenTelemetry și vizualizarea trace-urilor pentru a depana un blocaj de performanță

Chaos Engineering & Game Days

  • Introducere în Chaos Engineering: injectarea controlată de defecte pentru a testa reziliența sistemului înainte să apară întreruperi în producție
  • Conducerea "Game Days": pregătirea echipei de engineering pentru scenarii reale de disaster recovery
  • Lab: Simularea terminării pod-urilor și a latenței de rețea pentru a observa capacitățile de auto-reparare (self-healing) ale sistemului

Module opționale

Opțional — Cloud FinOps Avansat pentru Kubernetes

  • Înțelegerea alocării costurilor Kubernetes folosind tool-uri precum Kubecost sau OpenCost
  • Dimensionarea corectă (Right-sizing) a workload-urilor și optimizarea node pool-urilor pentru eficiență maximă a costurilor

Structura zilei de curs

  • Partea 1: 09:00–10:30
  • Pauză: 10:30–10:45
  • Partea 2: 10:45–12:45
  • Pauză de masă: 12:15–13:15
  • Partea 3: 13:15–15:15
  • Pauză: 15:15–15:30
  • Partea 4: 15:30–17:30

Ai participat la acest curs?

Opinia ta este foarte importantă pentru noi. Spune-ne cum a fost experiența ta și ajută-ne să îmbunătățim acest curs pentru viitorii participanți.

Ofera feedback

Vrei să afli mai multe? Suntem aici să te ajutăm!

Sau scrie-ne direct la training@edocti.com.