Produktionsreife

Sie haben schnell ausgeliefert, Nutzer sind gekommen, und jetzt zeigen sich die Risse: Deploys machen Angst, nichts ist getestet, und niemand weiß, was passiert, wenn die Datenbank ausfällt. In ein bis zwei Wochen mache ich Ihr System langweilig. Echte Tests, Migrationen, Monitoring, Backups, aus denen tatsächlich wiederhergestellt wurde, und eine schriftliche Übergabe, damit Ihr Team es ohne mich betreiben kann.

Leistungsübersicht
Preis
Auf Anfrage
Dauer
1–2 Wochen
Kategorie
Kern
Leistungen
8

Ihr Produkt funktioniert. Jetzt muss es überleben.

Ein funktionierendes Produkt zu bauen ist heute billig. Es am Leben zu halten nicht. Die meisten Systeme, die im Produktivbetrieb ausfallen, waren nie falsch, sie wurden nur nie fertiggestellt: kein Test, der die Regression abfängt, kein Migrationspfad, kein Alarm, wenn sich die Queue staut, keine Wiederherstellungsprobe für das Backup, das nie jemand verifiziert hat. Diese Lücke ist unsichtbar, bis echte Nutzer da sind, und dann wird es teuer und stressig. Das ist die unglamouröse Arbeit, die darüber entscheidet, ob Sie im dritten Jahr noch ein Produkt haben, und genau das habe ich bei fünf eigenen Produktivsystemen gemacht.

Der volle Umfang.

01

Produktionsaudit: was tatsächlich ausfällt, priorisiert nach Wahrscheinlichkeit und Schweregrad

02

Eine echte Testsuite gegen eine echte Datenbank, keine gemockte Persistenz

03

Datenbankmigrationen mit Rollback-Pfad, keine von Hand editierten Schemata

04

Monitoring und Alerting, das nur dann einen Menschen alarmiert, wenn es nötig ist

05

Backups plus eine Wiederherstellung, die Sie Ende-zu-Ende funktionieren gesehen haben

06

CI/CD bei jedem Push: Lint, Type-Check, Test, Build, Deploy

07

Secrets raus aus dem Repo, hinein in etwas, das Sie rotieren können

08

Schriftliche Übergabe, damit Ihr Team die Verantwortung trägt, ohne Abhängigkeit von mir

Vom Kickoff bis zum Go-Live.

01Schritt 1

Tage 1–3, Triage: Ich lese den Code, führe ihn aus, breche ihn absichtlich, und übergebe Ihnen eine priorisierte Liste dessen, was zuerst ausfallen wird. Die bekommen Sie auch, wenn wir hier aufhören.

02Schritt 2

Tage 4–8, Fix: die risikoreichsten Punkte zuerst. Tests, Migrationen, Monitoring, Backups, Pipeline. Sie sehen jeden einzelnen Schritt in einer Staging-Umgebung landen.

03Schritt 3

Tage 9–10, Übergabe: Runbook, Architekturnotizen und eine aufgezeichnete Durchsprache. Ihr Team kann das System betreiben, ohne mich anzurufen.

Sie sollten das buchen, wenn…

01

Gründer, deren KI-unterstützt gebautes Produkt echte Nutzer gefunden hat und jetzt zusammenbricht

02

Teams in der Seed-Phase, deren Prototyp bereits Produktivtraffic bedient

03

Unternehmen, die ein System geerbt haben, das niemand im aktuellen Team geschrieben hat

Bereit anzufangen?

Auf Anfrage · 1–2 Wochen

Deutsche KMU können dies oft teilweise fördern lassen

Diese Art von Engagement ist häufig für die BAFA-Beratungsförderung (bis zu 50 %) und, in NRW, das MID-Programm förderfähig. Die öffentliche Förderung läuft bis 2026. Sie stellen den Antrag, die Förderfähigkeit hängt von Ihrem Unternehmen ab; im Gespräch weise ich Sie auf das passende Programm hin.

01Mein Produkt wurde schnell mit KI-Unterstützung gebaut und bricht jetzt ständig zusammen. Können Sie das reparieren?

Ja, das ist der häufigste Grund, warum Leute das buchen. Ein funktionierendes Produkt zu generieren ist einfach geworden, es unter echtem Traffic am Laufen zu halten nicht. Ich urteile nicht darüber, wie der Code entstanden ist, mich interessiert, was nötig ist, damit er überlebt. Das Audit in den ersten drei Tagen sagt Ihnen ehrlich, ob eine Härtung reicht oder ein tieferer Umbau nötig ist, und diese Einschätzung behalten Sie in jedem Fall.

02Was bedeutet produktionsreif eigentlich konkret?

Konkret: Sie können freitags ohne Angst deployen, ein Test schlägt fehl, bevor Ihre Nutzer es merken, die Datenbank lässt sich migrieren und zurückrollen, ein Alarm erreicht einen Menschen, wenn wirklich etwas nicht stimmt, und Sie haben mindestens einmal aus einem Backup wiederhergestellt, um zu beweisen, dass es funktioniert. Fehlt eines davon, läuft das System auf Glück.

03Schreiben Sie meinen Code neu?

Fast nie. Rewrites sind langsam, riskant und meist unnötig. Ich ergänze die fehlenden Sicherheitsebenen um das, was Sie haben, behebe gezielt das, was am wahrscheinlichsten ausfällt, und lasse das Produkt für die Menschen, die es gebaut haben, wiedererkennbar. Wenn ein Rewrite tatsächlich die richtige Entscheidung ist, sage ich Ihnen das im Audit, statt einen still und heimlich abzurechnen.

04Wie lange dauert es und was kostet es?

Ein bis zwei Wochen. Die Triage-Phase sind die ersten drei Tage, damit Sie die priorisierte Risikoliste früh bekommen. Größere oder verworrenere Systeme werden nach dem Audit geschätzt, und ich nenne Ihnen die Zahl, bevor die Arbeit weitergeht.

05Arbeiten Sie mit meinem bestehenden Stack?

Ja. Ich arbeite täglich mit Kotlin/Spring Boot, TypeScript/Next.js, PostgreSQL, Docker und Kubernetes und habe auf allen davon Produktivsysteme ausgeliefert. Die Zuverlässigkeitsarbeit selbst ist stack-unabhängig: Tests, Migrationen, Monitoring, Backups und Deployment-Disziplin sehen überall gleich aus.

Noch unsicher, ob das die richtige Art der Zusammenarbeit ist?

Gespräch buchen