Produktionsreife
Sie haben schnell ausgeliefert, Nutzer sind gekommen, und jetzt zeigen sich die Risse: Deploys machen Angst, nichts ist getestet, und niemand weiß, was passiert, wenn die Datenbank ausfällt. In ein bis zwei Wochen mache ich Ihr System langweilig. Echte Tests, Migrationen, Monitoring, Backups, aus denen tatsächlich wiederhergestellt wurde, und eine schriftliche Übergabe, damit Ihr Team es ohne mich betreiben kann.
- Preis
- Auf Anfrage
- Dauer
- 1–2 Wochen
- Kategorie
- Kern
- Leistungen
- 8
Ihr Produkt funktioniert. Jetzt muss es überleben.
Ein funktionierendes Produkt zu bauen ist heute billig. Es am Leben zu halten nicht. Die meisten Systeme, die im Produktivbetrieb ausfallen, waren nie falsch, sie wurden nur nie fertiggestellt: kein Test, der die Regression abfängt, kein Migrationspfad, kein Alarm, wenn sich die Queue staut, keine Wiederherstellungsprobe für das Backup, das nie jemand verifiziert hat. Diese Lücke ist unsichtbar, bis echte Nutzer da sind, und dann wird es teuer und stressig. Das ist die unglamouröse Arbeit, die darüber entscheidet, ob Sie im dritten Jahr noch ein Produkt haben, und genau das habe ich bei fünf eigenen Produktivsystemen gemacht.
Der volle Umfang.
Produktionsaudit: was tatsächlich ausfällt, priorisiert nach Wahrscheinlichkeit und Schweregrad
Eine echte Testsuite gegen eine echte Datenbank, keine gemockte Persistenz
Datenbankmigrationen mit Rollback-Pfad, keine von Hand editierten Schemata
Monitoring und Alerting, das nur dann einen Menschen alarmiert, wenn es nötig ist
Backups plus eine Wiederherstellung, die Sie Ende-zu-Ende funktionieren gesehen haben
CI/CD bei jedem Push: Lint, Type-Check, Test, Build, Deploy
Secrets raus aus dem Repo, hinein in etwas, das Sie rotieren können
Schriftliche Übergabe, damit Ihr Team die Verantwortung trägt, ohne Abhängigkeit von mir
Vom Kickoff bis zum Go-Live.
Tage 1–3, Triage: Ich lese den Code, führe ihn aus, breche ihn absichtlich, und übergebe Ihnen eine priorisierte Liste dessen, was zuerst ausfallen wird. Die bekommen Sie auch, wenn wir hier aufhören.
Tage 4–8, Fix: die risikoreichsten Punkte zuerst. Tests, Migrationen, Monitoring, Backups, Pipeline. Sie sehen jeden einzelnen Schritt in einer Staging-Umgebung landen.
Tage 9–10, Übergabe: Runbook, Architekturnotizen und eine aufgezeichnete Durchsprache. Ihr Team kann das System betreiben, ohne mich anzurufen.
Sie sollten das buchen, wenn…
Gründer, deren KI-unterstützt gebautes Produkt echte Nutzer gefunden hat und jetzt zusammenbricht
Teams in der Seed-Phase, deren Prototyp bereits Produktivtraffic bedient
Unternehmen, die ein System geerbt haben, das niemand im aktuellen Team geschrieben hat
Deutsche KMU können dies oft teilweise fördern lassen
Diese Art von Engagement ist häufig für die BAFA-Beratungsförderung (bis zu 50 %) und, in NRW, das MID-Programm förderfähig. Die öffentliche Förderung läuft bis 2026. Sie stellen den Antrag, die Förderfähigkeit hängt von Ihrem Unternehmen ab; im Gespräch weise ich Sie auf das passende Programm hin.
01Mein Produkt wurde schnell mit KI-Unterstützung gebaut und bricht jetzt ständig zusammen. Können Sie das reparieren?
Ja, das ist der häufigste Grund, warum Leute das buchen. Ein funktionierendes Produkt zu generieren ist einfach geworden, es unter echtem Traffic am Laufen zu halten nicht. Ich urteile nicht darüber, wie der Code entstanden ist, mich interessiert, was nötig ist, damit er überlebt. Das Audit in den ersten drei Tagen sagt Ihnen ehrlich, ob eine Härtung reicht oder ein tieferer Umbau nötig ist, und diese Einschätzung behalten Sie in jedem Fall.
02Was bedeutet produktionsreif eigentlich konkret?
Konkret: Sie können freitags ohne Angst deployen, ein Test schlägt fehl, bevor Ihre Nutzer es merken, die Datenbank lässt sich migrieren und zurückrollen, ein Alarm erreicht einen Menschen, wenn wirklich etwas nicht stimmt, und Sie haben mindestens einmal aus einem Backup wiederhergestellt, um zu beweisen, dass es funktioniert. Fehlt eines davon, läuft das System auf Glück.
03Schreiben Sie meinen Code neu?
Fast nie. Rewrites sind langsam, riskant und meist unnötig. Ich ergänze die fehlenden Sicherheitsebenen um das, was Sie haben, behebe gezielt das, was am wahrscheinlichsten ausfällt, und lasse das Produkt für die Menschen, die es gebaut haben, wiedererkennbar. Wenn ein Rewrite tatsächlich die richtige Entscheidung ist, sage ich Ihnen das im Audit, statt einen still und heimlich abzurechnen.
04Wie lange dauert es und was kostet es?
Ein bis zwei Wochen. Die Triage-Phase sind die ersten drei Tage, damit Sie die priorisierte Risikoliste früh bekommen. Größere oder verworrenere Systeme werden nach dem Audit geschätzt, und ich nenne Ihnen die Zahl, bevor die Arbeit weitergeht.
05Arbeiten Sie mit meinem bestehenden Stack?
Ja. Ich arbeite täglich mit Kotlin/Spring Boot, TypeScript/Next.js, PostgreSQL, Docker und Kubernetes und habe auf allen davon Produktivsysteme ausgeliefert. Die Zuverlässigkeitsarbeit selbst ist stack-unabhängig: Tests, Migrationen, Monitoring, Backups und Deployment-Disziplin sehen überall gleich aus.
Noch unsicher, ob das die richtige Art der Zusammenarbeit ist?
Gespräch buchen