System Engineer - AI Engineer
- Anstellung
- Vollzeit
- Pensum
- 100%
- Ort
- Prilly
- Unternehmen
- Salt Mobile SA, Avenue de Malley 2, 1008 Prilly
- Erstmals ausgeschrieben
Ref 2581831 | Datum: 29 Sept 2026
Salt Mobile SA
Wir suchen einen System Engineer — AI Engineer, um Open-Source-Modelle und das umliegende Ökosystem in Produktionsdienste zu integrieren, die On-Premise in unseren Datacentern laufen.
Sie werden Teil eines erfahrenen und enthusiastischen Teams mit großartigem Teamgeist, in dem Wissen geteilt statt gehortet wird. Die Dienste sind geschäftskritisch, daher teilt sich das Team eine 24/7-Rufbereitschaft.
System Engineer - AI Engineer (100%)
Was Sie tun werden
Sie verantworten Ihre Lösungen von Ende zu Ende — vom Verständnis des geschäftlichen Bedarfs bis zum Betrieb in der Produktion:
- Analysieren Sie den Bedarf mit Stakeholdern, hinterfragen Sie ihn und überführen Sie ihn in ein Design, das unseren Rahmenbedingungen entspricht — dann implementieren, testen, dokumentieren und liefern Sie.
- Übernehmen Sie Verantwortung über den Code hinaus: Zeitpläne, Abhängigkeiten, Kommunikation mit Stakeholdern und die damit verbundenen Entscheidungen.
- Evaluieren, selektieren und deployen Sie Open-Source-Modelle (LLMs, Embeddings, Reranker, Speech) und betreiben Sie die selbst gehosteten Inference-Stacks dahinter (vLLM, Ollama) mit vernünftiger Quantisierung, Batching und Model Routing.
- Bauen Sie die Anwendungsschicht — RAG-Pipelines, Agents, Tool Calling, Structured Output — und verantworten Sie den dahinterliegenden Datenpfad: Ingestion, Chunking, Embeddings, Vector Stores, Retrieval Quality.
- Bauen Sie Evaluations-Harnesses und Benchmarks, damit Modellentscheidungen gemessen und nicht geraten werden.
- Integrieren Sie das Ökosystem um die Modelle: Gateways, Orchestrierungs-Frameworks, Model Registries, Observability und Tracing.
- Optimieren Sie auf Latenz, Durchsatz und GPU-Auslastung; übernehmen Sie Kapazitätsplanung, Scheduling und Produktionsmonitoring — und debuggen Sie Regressionen, wenn sich ein Modell oder eine Version ändert.
- Nehmen Sie an der 24/7-Rufbereitschaft (Piquet) des Teams teil, mit Entschädigung und Freizeit im Ersatz — und verbessern Sie die Runbooks, das Alerting und die Automatisierung, damit ruhige Abende die Norm und nicht die Ausnahme sind.
Was Sie mitbringen
- Master-Abschluss in Informatik oder gleichwertig, mit praktischer Erfahrung in der Arbeit mit LLM-basierten Systemen.
- System-Engineering-Erfahrung mit Linux und Kubernetes.
- Starkes Python; sicher in Produktionspraktiken (Testing, CI/CD, Code Review).
- Starke SQL-Kenntnisse.
- Erfahrung im Self-Hosting und Serving von Open-Source-Modellen.
- Fundierte Kenntnisse in Retrieval, Embeddings und Vektordatenbanken.
- Hands-on: keine Angst davor, ein Serverkabel zu verlegen oder eine GPU auszutauschen.
- Autonomie und ein Sinn für Eigenverantwortung — Sie verfolgen ein Thema bis zur Auslieferung, anstatt es abzugeben.
- Bereitschaft zur Teilnahme an einer 24/7-Rufbereitschaft und das Temperament, unter Incident-Druck methodisch zu bleiben.
- Pragmatismus in Bezug auf Open-Source-Tooling — fähig, ein solides Projekt von einem Hype-Projekt zu unterscheiden.
Nice to have
- GPU-Operations: Treiber, CUDA, MIG, Device Plugins, Scheduling auf Kubernetes.
- Inference-Optimierung (TensorRT-LLM, ONNX, Speculative Decoding, KV-Cache Tuning).
- Leichtgewichtige Adaptionstechniken (LoRA/QLoRA Adapter auf bestehenden Open-Source-Modellen).
- Storage- und Netzwerkdesign für AI-Workloads.
- Erfahrung mit AI Safety, Guardrails und verantwortungsvollen Deployment-Praktiken.
- Beiträge zu Open-Source-AI-Projekten.
Was wir bieten
- Ein freundliches und dynamisches Umfeld, in dem Proaktivität und persönliches Engagement hoch geschätzt werden.
- Kompetitives Gehalts- und Benefit-System, sehr attraktive Pensionskassenbedingungen.
- Flexible Arbeitszeiten mit 6 Wochen Urlaub.
- Moderner und ergonomischer Arbeitsplatz.
- Verschiedene Zusatzleistungen (Fringe Benefits).
- Kostenloses Mobilfunkabonnement und Rabatte auf unsere Produkte.
- Möglichkeit, Ihre Fähigkeiten und Erfahrungen in einem schnelllebigen und komplexen Telco-Umfeld zu erweitern.
- Ein vollständiger Open-Source-AI-Stack, der On-Prem in unseren Datacentern läuft — Sie besitzen die Hardware, nicht die Abstraktion von jemand anderem.
Schon immer davon geträumt, einen Job in einem vielfältigen und erfrischenden Umfeld zu haben? Dann müssen wir uns wirklich kennenlernen. Bitte bewerben Sie sich online (wir akzeptieren nur Online-Bewerbungen mit Lebenslauf, Arbeitszeugnissen und Diplomen).
jpid617d480jm jpit0940jm jpiy26jm
Automatisch aus dem Original übersetzt.
Ausgeschrieben heute