Du baust das Fundament, auf dem unsere KI-Anwendungen wachsen, und verantwortest die Infrastruktur, Frameworks sowie die Effizienz unserer KI-Systeme. In dieser Rolle gestaltest du aktiv die technische Architektur und entscheidest maßgeblich über den Einsatz von Technologien, um unsere Entwicklung schneller und sicherer zu machen.
Tätigkeiten
- Die technische Plattform für unsere KI-Anwendungen konzipieren, aufbauen und betreiben: Modell-Hosting, Inferenz, API-Gateways/Routing, wiederverwendbare Bausteine
- Lokale / self-hosted LLMs evaluieren, einrichten und betreiben – inklusive Quantisierung, GPU-Dimensionierung und Performance
- KI-Consumption und -Kosten transparent machen und aktiv steuern; fundierte Make-or-Buy- und Lokal-vs.-Cloud-Entscheidungen treffen und begründen
- Frameworks, Tools und Standards für das Team auswählen und etablieren
- Guardrails, die KI-Entwicklung schneller und sicherer machen
- CI/CD, Monitoring und Betriebsthemen für KI-Lösungen verantworten
Anforderungen
- Tiefes Verständnis und praktische Erfahrung im Betrieb von KI-/LLM-Anwendungen (Inferenz-Frameworks, API-Gateways, RAG- und Embedding-Infrastruktur)
- Operative Erfahrung mit lokalen Modellen / Self-Hosting von LLMs inklusive Quantisierung und Ressourcendimensionierung
- Mehrjährige, fundierte praktische Erfahrung in der Softwareentwicklung, davon ein solider Teil in C# / .NET
- Erfahrung mit Containerisierung (Docker), CI/CD und Betriebsthemen
- Sehr gute Deutschkenntnisse und gute Englischkenntnisse
Team
Unser Team ist bewusst interdisziplinär aufgestellt, mit kaum Überlappungen zwischen den Disziplinen. Du arbeitest eng mit Spezialisten für Frontend, Backend, UX und KI-Anwendungen zusammen, während du die Plattform, den Betrieb und die Effizienz fachlich eigenverantwortlich leitest.
Bewerbungsprozess
- HR MSTeams Interview
- Hiring Manager MSTeams Interview
- Case Study
- In person Interview at our office
- Offer