Cloudarchitektur
- Servicemodelle IaaS, PaaS, SaaS und FaaS, Modell der geteilten Verantwortung
- Verfügbarkeit: Regionen, Verfügbarkeitszonen, Cloud Bursting, Edge Computing, Verfügbarkeitsüberwachung; Disaster Recovery mit RTO und RPO, Hot, Warm und Cold Site; Multicloud
- Cloudnetzwerke: VPN und dedizierte Verbindungen, Load Balancer, Application Gateway, CDN, Firewalls, VPC mit Peering und Transit Gateway, Subnetze, VLAN, SDN, BGP, statische Routen und Routingtabellen
- Speicher: Speicherstufen Hot, Warm, Cold und Archive, SSD und HDD, Objekt-, Block- und Dateispeicher mit ihren Auswirkungen auf Leistung und Kosten
- Cloud-native Designkonzepte: verwaltete Dienste, Microservices, lose gekoppelte Architektur, Fan-out, Service Discovery
- Container (Orchestrierung, Port-Mapping, persistente und flüchtige Speicher, Image-Registries) und Virtualisierung (Clustering, Klonen, Host-Affinität, Hardware-Passthrough, Overlay- und VM-Netzwerke, lokaler Speicher, SAN und NAS)
- Kosten: Abrechnungsmodelle mit Dedicated Hosts, reservierten Ressourcen, Pay-as-you-go und Spot-Instanzen, Ressourcenmessung, Tagging, Rightsizing
- Datenbanken relational und nicht relational, selbst oder vom Anbieter verwaltet; Workloads optimieren bei Compute, Netzwerk (Latenz, Durchsatz) und Speicher (IOPS, Durchsatz)
- Neue Technologien: maschinelles Lernen und KI inklusive generativer KI, Internet of Things (IoT)
Bereitstellung
- Bereitstellungsmodelle: Public, Private, Hybrid und Community Cloud
- Bereitstellungsstrategien: Blue-Green, Canary, Rolling und In-Place
- Migration von On-Premises in die Cloud, zurück und zwischen Clouds; Kriterien wie Plattformkompatibilität, Kosten, Verwaltungsaufwand, Verfügbarkeit, Vendor Lock-in, Umwelt- und Compliance-Anforderungen; Strategien Rehost, Replatform, Refactor, Re-architect, Retain und Retire
- Ressourcen per Code bereitstellen: Infrastructure as Code und Configuration as Code, Skriptlogik, Wiederholbarkeit, Drift-Erkennung, Versionierung, Tests und Dokumentation, Formate JSON und YAML
- Cloudressourcen passend zu Anforderungen an Speicher, Leistung, Sicherheit, Kosten, Verfügbarkeit, Compliance, Netzwerk und Compute bereitstellen
Betrieb
- Observability: Logging mit Sammlung, Aggregation und Aufbewahrung, Tracing, Monitoring mit Metriken, Alarmierung mit Triage und Reaktion
- Skalierung: ausgelöst durch Trends, Last oder Ereignisse, geplant oder manuell; horizontal und vertikal
- Backup und Recovery: vollständige, inkrementelle und differenzielle Sicherungen, Speicherorte, Zeitplan, Aufbewahrung, Replikation, Verschlüsselung, Wiederherstellungstests, In-Place- und parallele sowie vollständige oder granulare Wiederherstellung
- Lebenszyklus von Cloudressourcen: Patches, Haupt- und Nebenversionen, Tests, flüchtige und persistente Daten, Ausserbetriebnahme bei End of Life und End of Support
Sicherheit
- Schwachstellenmanagement: Scan-Umfang, Identifikation, Bewertung und Behebung, CVEs
- Compliance und Regulierung: Datenhoheit, Dateneigentum, Datenlokalität, Datenklassifizierung, Aufbewahrung inklusive Litigation Hold; Standards wie SOC 2, PCI DSS, ISO 27001 und Cloud Security Alliance
- Identitäts- und Zugriffsverwaltung: sicherer Zugang zu Verwaltungsumgebung und Ressourcen über API, SDK, CLI, Webportal, SSH, RDP und Bastion Host; Föderation mit SAML, token- und verzeichnisbasierte Authentifizierung, MFA, OpenID Connect; RBAC, gruppenbasierte Zugriffssteuerung, OAuth 2.0; Audit Trail
- Best Practices: Zero Trust, CIS- und herstellerspezifische Benchmarks, Härtung, Patching, Verschlüsselung von Daten bei Übertragung und Speicherung, Secrets Management, API-Sicherheit, Least Privilege, Container- und Speichersicherheit
- Sicherheitskontrollen: Endpunktschutz, DLP, IDS/IPS, DDoS-Schutz, IAM-Richtlinien, Netzwerk-ACL, WAF und Netzwerksicherheitsgruppen
- Verdächtige Aktivitäten erkennen: Ereignisüberwachung, Abweichungen von der Baseline, unnötig offene Ports; Angriffe wie Ausnutzung von Schwachstellen, Social Engineering, Malware und Ransomware, DDoS, Cryptojacking und Zombie-Instanzen
DevOps-Grundlagen
- Quellcodeverwaltung: Versionsverwaltung, Code Review, Pull Requests, Commit, Push, Merge und Branch-Management
- CI/CD-Pipelines: Automatisierung, Build, Tests, Sicherheit, Artefakte wie VM- und Container-Images oder Pakete (RPM, Debian, ZIP, tar), öffentliche und private Repositories
- Systemintegration: ereignisgesteuerte Architekturen, REST, SOAP, RPC, WebSockets und GraphQL
- Werkzeuge: Ansible, Docker, ELK-Stack, Git, GitHub Actions, Grafana, Jenkins, Kubernetes und Terraform
Troubleshooting
- Bereitstellungsprobleme: Inkompatibilitäten, Fehlkonfigurationen bei Ressourcenzuweisung, Berechtigungen, Überbuchung und Dimensionierung, veraltete Komponenten und abgekündigte Funktionen, Ausfälle, Ressourcenlimits wie API-Drosselung und Kontingente, regionale Verfügbarkeit von Diensten
- Netzwerkprobleme: nicht verfügbare Dienste wie DHCP, DNS, NTP, NAT und HTTP, Latenz und Bandbreite, fehlkonfigurierte Geräte, Protokollinkompatibilitäten, IP-Adressierung, Routing sowie VLAN-Tags und Access- oder Trunk-Ports
- Sicherheitsprobleme: veraltete Cipher Suites, Autorisierungs- und Authentifizierungsprobleme wie Rechteausweitung, unbefugter Zugriff und geleakte Zugangsdaten, Softwareschwachstellen und nicht autorisierte Software