Zum Hauptinhalt springen

Ephemere AWS-Sandboxes: 80+ isolierte Umgebungen zum halben Preis

· 3 Minuten Lesezeit
Pascal Nehlsen
Platform & Security Engineering

Allen Lernenden eine gemeinsame Umgebung zu geben ist billig und elend. Eine Person zerlegt sie, und alle stehen. Allen eine feste, immer laufende Instanz zu geben ist sauber und teuer. Dieser Beitrag handelt von einer dritten Möglichkeit: produktionsnahen Sandboxes pro Person auf AWS, die auf Abruf hochkommen, sich selbst aufräumen und etwa die Hälfte dessen kosten, was fest dimensionierte Instanzen kosten würden.

SLO-gesteuertes automatisches Rollback: die Metrik zieht die Reißleine

· 3 Minuten Lesezeit
Pascal Nehlsen
Platform & Security Engineering

Ein Deploy, der um 02:00 die Produktion zerlegt, sollte nicht darauf warten, dass ein Mensch aufwacht, ein Dashboard liest und sich für ein Rollback entscheidet. Wenn du definieren kannst, was "kaputt" bedeutet, und zwar so, dass dein Monitoring es messen kann, dann kann die Pipeline die Reißleine selbst ziehen. Dieser Beitrag zeigt Schritt für Schritt, wie Observability so in das Deployment verdrahtet wird, dass eine SLO-Verletzung ein automatisches Rollback auslöst.

Agentische DevOps-Runbooks mit menschlicher Freigabe

· 3 Minuten Lesezeit
Pascal Nehlsen
Platform & Security Engineering

"Lass die KI das reparieren" ist ein guter Weg, aus einem kleinen Vorfall einen großen zu machen. Der Aufwand in der Incident-Bearbeitung liegt aber meist nicht in der Behebung. Er liegt im Zusammentragen: Logs ziehen, Deploy-Historie prüfen, Metriken korrelieren, rekonstruieren, was sich geändert hat. Dieser Teil lässt sich gefahrlos automatisieren. Dieser Beitrag beschreibt einen Runbook-Executor, der das Zusammentragen und das Vorschlagen automatisiert und bei allem Destruktiven einen Menschen davorstellt.

Golden Paths auf GCP: 80 % weniger Provisioning-Zeit mit Terraform

· 3 Minuten Lesezeit
Pascal Nehlsen
Platform & Security Engineering

Am schnellsten bremst man ein Team aus, indem man es auf Infrastruktur warten lässt. Wenn jeder neue Service vier Stunden Handarbeit in der GCP-Konsole bedeutet, sammeln Engineers ihre Anfragen, wechseln währenddessen den Kontext und bauen still und leise Sonderfälle. Dieser Beitrag handelt davon, dieses Ritual durch einen Golden Path zu ersetzen: einen geebneten, meinungsstarken Weg, der eine produktionsnahe Umgebung in unter 45 Minuten bereitstellt, im Self-Service.