Kontakt aufnehmen

Schulungsübersicht

Grundlagen der Cloud Operations auf AWS

  • Operationale Rollen und Verantwortlichkeiten in der Cloud
  • AWS-Account-Struktur, Organizations und Multi-Account-Strategie
  • Zentrale Operational Services: CloudWatch, CloudTrail, AWS Config

Infrastructure as Code und Provisioning

  • Prinzipien von IaC und unveränderlicher Infrastruktur (Immutable Infrastructure)
  • Provisioning mit Terraform und AWS CloudFormation
  • Verwaltung von State, Modulen und Environment Promotion

CI/CD und Deployment-Strategien

  • Entwurf von CI/CD-Pipelines für Cloud-native Anwendungen
  • Blue/Green-, Canary- und Rolling Deployments
  • Automatisierung von Rollback, Health Checks und Release Validierung

Monitoring, Observability und Alerting

  • Metriken, Logs und Traces: Senden, Speichern und Analysieren
  • Einsatz von CloudWatch, X-Ray und Drittanbieter-Observability-Tools
  • Definition von SLOs/SLIs, Alerting-Richtlinien und On-Call-Praktiken

Security Operations und Identity Management

  • IAM Best Practices, Least Privilege und Cross-Account-Zugriff
  • Secrets Management, KMS und sichere Parameter Stores
  • Operationale Sicherheit: Patching-Strategien, Vulnerability Scanning und Audit Trails

Resilienz, Backup und Disaster Recovery

  • Design für Fault Tolerance und High Availability
  • Backup-Strategien, Snapshot-Automatisierung und Restore-Prozeduren
  • Disaster-Recovery-Planung und Erstellung von Runbooks

Kostenoptimierung und Governance

  • Kostenübersicht: Billing, Tagging und Cost Allocation Strategien
  • Rightsizing, Reserved Instances/Savings Plans und Budgeting Controls
  • Governance: Richtlinien, Guardrails und Automatisierung für Compliance

Container, Serverless und Runtime Operations

  • Operationale Aspekte für ECS, EKS und Lambda
  • Service Discovery, Autoscaling und Resource Limits
  • Logging, Tracing und Debugging von Containerized Workloads

Incident Response, Playbooks und Chaos Engineering

  • Runbook-basierter Incident Response und Postmortem-Praktiken
  • Automatisierung von Remediation und Self-Healing Patterns
  • Einführung in Chaos Experiments zur Validierung der Resilienz

Praxisworkshop: Betrieb einer Beispiel-Workload

  • Bereitstellung einer Beispielanwendung mit IaC und einer CI/CD-Pipeline
  • Implementierung von Monitoring, Alerts und einem automatisierten Remediation-Skript
  • Simulation von Incidents und Einübung des runbook-basierten Responses

Zusammenfassung und nächste Schritte

Voraussetzungen

  • Grundlegende Kenntnisse in Cloud-Konzepten und Networking
  • Vertrautheit mit der Linux-Befehlszeile und Scripting
  • Erfahrung mit Source Control (Git) und grundlegenden CI/CD-Konzepten

Zielgruppe

  • Cloud Operations Engineers
  • SREs (Site Reliability Engineers) und Platform Engineers
  • DevOps Engineers und technische Teamleitungen
 21 Stunden

Teilnehmerzahl


Preis je Teilnehmer (exkl. USt)

Erfahrungsberichte (1)

Kommende Kurse

Verwandte Kategorien