Du entwickelst und betreibst unsere souveräne LLM-Plattform inklusive OpenAI-kompatiblem Gateway, Modell-Serving und GPU-Infrastruktur Du implementierst kundenspezifische Wissensanbindungen (RAG) mit Vector-Datenbanken, Embeddings und Reranking Du stellst Kostenkontrolle, Mandantentrennung, Datenschutz und Guardrails sicher Du etablierst Monitoring und Observability für Performance, Qualität und Nutzung der KI-Dienste Du betreibst und entwickelst unsere containerbasierte Plattform auf Basis von…