Als AI Inference Engineer bauen Sie die technische Basis für produktive KI-Systeme in regulierten Umgebungen. Sie betreiben LLM-Inferenzplattformen vor Ort, in privaten Clouds oder souveränen europäischen Cloud-Setups und optimieren Leistung, Kosten und Beobachtbarkeit. Im Team integrieren Sie moderne Inferenz-Engines und Open-Weights-Modelle in Kubernetes-Umgebungen und entwickeln Referenzarchitekturen sowie Deployment-Templates für wiederverwendbare Lösungen.
VerantwortungsbereicheVeröffentlichungsdatum:
14 Sep 2026Standort:
Frankfurt am MainEinsatzort:
GermanyTyp:
VollzeitArbeitsmodell:
Vor OrtKategorie:
Erfahrung:
2+ yearsArbeitsverhältnis:
Angestellt
Möchtest über ähnliche Jobs informiert werden? Dann beauftrage jetzt den Fuchsjobs KI Suchagenten!