Zum Hauptinhalt springen
~/platform

Ich baue den geebneten Weg: Self-Service-Infrastruktur und die Guardrails, mit denen Teams schnell ausliefern, ohne dabei Lücken mitzuliefern.

Arbeit

Ausgewählte Arbeit

Drei Probleme, die ich von vorne bis hinten verantwortet habe: die Randbedingung, was ich geändert habe, und die Zahl, die sich bewegt hat.

Terraform Golden Paths on GCP

Bereitstellung 4 h → 45 min

Jede neue Service-Umgebung war ein Vier-Stunden-Ticket: jemand klickte Cloud Run, Cloud SQL, einen Bucket und sechs IAM-Bindings von Hand zusammen und lag dabei in etwa einem Drittel der Fälle unauffällig daneben. Ich habe die GCP-Landschaft um je einen meinungsstarken Golden Path pro Service-Form modularisiert, die Guardrails in das Modul gelegt statt in ein Wiki, und jeden Plan hinter automatische Policy-Prüfungen gehängt. Ein Team stellt seine Umgebung jetzt in unter 45 Minuten selbst bereit, ohne Ticket, und der Drift, der früher in Produktion auffiel, fällt in terraform plan auf.

TerraformGCPCloud RunIAMGitOps

Agentic Runbooks with a Human-Approval Gate

Reaktionszeit −60 %

Bekannte Fehlerklassen haben On-Call-Zeit gefressen, nicht weil die Behebung schwer war, sondern weil das Zusammentragen des Kontexts (Logs, Terraform-State, letzte Deploys) um 3 Uhr nachts zwanzig Minuten dauerte. Ich habe einen MCP-Server gebaut, der genau dieses Zusammentragen übernimmt, eine Behebung vorschlägt und dann stehen bleibt. Ein Mensch gibt jede zustandsändernde Aktion frei oder lehnt sie ab, jede wird mit der Begründung protokolliert, die zu ihr geführt hat, und jede ist umkehrbar. Der Agent darf falsch liegen; er darf nicht unbeaufsichtigt falsch liegen.

GoMCPGCPTerraformOn-Call

Ephemeral Per-User Sandboxes on AWS

80+ Umgebungen, Kosten −50 %

80+ Trainees brauchten je eine produktionsnahe n8n-Umgebung, und eine fest zugewiesene t3.medium pro Person war verschwenderisch und, auf Kohortengröße gerechnet, teuer. Diese Workloads sind von Natur aus stoßweise: Stunden im Leerlauf, dann eine Spitze. Also laufen sie auf burstable Instanzen, dimensioniert nach dem Median statt nach der Spitze, plus Lifecycle-Automatisierung, die alles stoppt und zurückholt, was länger als einen Schwellwert im Leerlauf steht. Jeder bekommt eine echte isolierte Umgebung; Compute kostet etwa die Hälfte der fest dimensionierten Variante.

AWSEC2Terraformn8nCost

Außerdem: eine Security-Pipeline, die SAST und DAST in GitHub Actions als Gate schaltet, zwei SaaS-Produkte und eine Reihe kleinerer Projekte. alles davon ist dokumentiert.

Stack

Was ich betreibe

Gruppiert danach, wo sie im Delivery-Pfad sitzen. Alles hier habe ich in Produktion betrieben, nicht nur evaluiert.

Cloud & Platform

GCPCloud RunCloud SQLAWS EC2TerraformAnsible

DevSecOps & CI/CD

GitHub ActionsArgo CDBanditTrivySemgrepOWASP ZAP

Observability

PrometheusGrafanaOpenTelemetrySLOsStructured Logging

Entwicklung

GoPythonDjangoTypeScriptReactNext.js

Fachsimpeln

Ich tausche mich gern über Platform-Arbeit aus: Golden Paths, Approval-Gates für Agents, was deine Rollback-Kriterien wirklich sind.

mail@pascal-nehlsen.de