Warum es diese Rolle gibt
Wir betreiben Dokumenten-Pipelines mit hohem Volumen für Unternehmen aus Energie, Logistik und Beschaffung. In diesen Umgebungen ist ein verpasster Batch keine Unannehmlichkeit, sondern ein Abrechnungszyklus oder eine Compliance-Frist.
Mit wachsenden Verpflichtungen hört Zuverlässigkeit auf, etwas zu sein, das das Gründungsteam im Kopf behält, und wird zu einer Funktion mit einer einzigen, benannten verantwortlichen Person. Sie sind diese verantwortliche Person: die erste dedizierte Neueinstellung, deren Mandat es ist, dass die Plattform verfügbar, schnell und unter Last korrekt bleibt. Sie starten als Individual Contributor mit echter Autonomie und bauen die Reliability-Funktion auf, in die das Unternehmen hineinwächst.
Das Mandat
Reliability definieren
SLOs, SLIs und ein Error-Budget, gegen das das gesamte Team deployt. Machen Sie „99,9%” von einem Anspruch zu einem Instrument mit veröffentlichter Policy.
Alles sehen
Observability, Alerting und Bereitschaftsdienst, die Probleme erkennen, bevor ein Kunde es tut, und das System für alle nachvollziehbar machen, die darauf aufbauen.
Incidents wie ein Ingenieur führen, nicht wie ein Feuerwehrmann
Leiten Sie die Reaktion unter Druck und führen Sie anschließend blameless Post-Mortems durch, die die Architektur ändern, nicht nur das Runbook.
Deploys langweilig machen
Sichere Rollouts, schnelles Rollback, eine Release-Pipeline, über die niemand nachdenken muss. Freitagnachmittage eingeschlossen.
Durchsatz skalieren
Kapazitätsplanung und Performance für hochvolumige Ingestion und die API-Oberfläche, auf der Kunden aufbauen, konzipiert, um bei steigendem Volumen konstant zu bleiben.
Die Linie halten, wo Reliability auf Compliance trifft
Arbeiten Sie eng mit unserer Sicherheits- und Datenschutzhaltung (DSGVO, ISO 27001 / 42001, HIPAA wo anwendbar), damit Verfügbarkeit und Auditierbarkeit gemeinsam voranschreiten.
Wie gut aussieht
Reliability, kartiert
SLIs definiert, aktuelle Verfügbarkeit ehrlich gemessen, die wichtigsten Fehlermodi benannt und priorisiert.
Das Budget ist live
Ein Error-Budget veröffentlicht und übernommen. Bereitschaftsdienst und Incident Response existieren und wurden real erprobt. Deploy-Sicherheit hat einen Boden.
Eine Funktion, keine Heldentaten
99,9% werden gemessen und entwickeln sich stetig. Die Reliability-Funktion hat eine Form, in die andere Ingenieure hineinwachsen können.
Das Profil
- Sie haben Verantwortung für Produktivsysteme getragenSie standen für ein reales System gerade, auf das echte Nutzer angewiesen waren. Sie wurden um 3 Uhr nachts alarmiert und haben richtig entschieden. Das ist Erfahrung, kein Zertifikat.
- Sie bleiben ruhig, wenn es brenntWenig Ego, klarer Kopf, entscheidungsfähig unter einem Sev1. Darauf prüfen wir am strengsten, denn diese Eigenschaft lässt sich nicht lehren.
- Sie sind diszipliniert und sorgfältigPräzise Post-Mortems, ehrliche Fehlerbudgets, keine Cowboy-Deployments. Reliability ist die Kunst, das Unspektakuläre jedes einzelne Mal zu tun.
- Sie bauen agentischSie dulden KI-natives Engineering nicht nur, Sie greifen zuerst danach. Unsere Ingenieure entwickeln mit Claude Code. Wenn Sie das begeistert statt bedroht, sollten wir sprechen.
- Sie sind ehrgeizig bei den unscheinbaren DingenIhr Ehrgeiz zielt darauf ab, Reliability zu einem Burggraben zu machen, dem Grund, warum Kunden uns vertrauen, statt dem nächsten Greenfield-Projekt hinterherzujagen. Mission vor Status.
Das Betriebsmodell
Kleines Team, hohes Vertrauen, Kontext statt Kontrolle. Echte Verantwortung ab der ersten Woche und ein wöchentlicher Takt, an den sich alle halten.
Claude Code ist die Art, wie wir ausliefern, kein Experiment. Wir entwickeln standardmäßig agentisch und erwarten, dass die Zuverlässigkeit einer agentischen Codebasis von Anfang an eingeplant wird, nicht nachträglich angeflanscht.
Wir helfen, die Regeln dieser Kategorie zu schreiben
- Wir waren Mitautoren der DIN SPEC 91491, dem deutschen Standard für KI-basierte Dokumentendatenextraktion, gemeinsam mit Fraunhofer IIS, Humboldt-Innovation und DIN e.V. Wir folgen nicht den Regeln dieser Kategorie, wir helfen, sie zu definieren.
- Mitglied von NVIDIA Inception, mit Wurzeln in Forschung an der Humboldt-Universität zu Berlin, unterstützt von führenden europäischen Deep-Tech-Investoren.
- Zugkraft bei Unternehmenskunden, am Wendepunkt an dem die Plattform hinter dem Versprechen wirklich unzerstörbar sein muss. Das ist die Position, die Sie einnehmen würden.
Was wir bieten
- StandortBerlin, hybrid. MEZ ±2 für Bereitschaftsabdeckung.
- VergütungSenior-Grundgehalt von €80,000–€90,000, zuzüglich spürbarer VSOP-Beteiligung, die widerspiegelt, wie früh Sie im Team einsteigen würden.
- UmfangDie Zuverlässigkeits-Charta für ein Unternehmen, dessen gesamtes Versprechen Beständigkeit: Ihre Aufgabe, sie zu definieren, zu instrumentieren und auszubauen.
Der Prozess
- Kennenlernen mit den Gründern. Lernen Sie CEO und CTO kennen: die Mission, die Rolle, Ihre Fragen. Bringen Sie einen echten Sev1-Vorfall mit, für den Sie verantwortlich waren, und führen Sie uns hindurch: die ersten zehn Minuten, das Post-Mortem und was sich strukturell danach geändert hat.
- Bezahlte Co-Working-Session. Verbringen Sie einen bezahlten Tag damit, gemeinsam mit dem Team an einem echten Problem aus unserer Roadmap zu arbeiten, mit unserem Stack und der Art, wie wir tatsächlich arbeiten.
- Culture-Fit-Gespräch mit dem Team. Lernen Sie die Menschen kennen, mit denen Sie bauen würden. Beidseitige Passung, keine Fangfragen.
- Referenzen. Auch die, die Sie nicht auf die Liste gesetzt haben.