System Engineer - AI Engineer
- Tipo di contratto
- Tempo pieno
- Percentuale
- 100%
- Luogo
- Prilly
- Azienda
- Salt Mobile SA, Avenue de Malley 2, 1008 Prilly
- Prima pubblicazione
Ref 2581831 | Data: 29 Sept 2026
Salt Mobile SA
Cerchiamo un System Engineer — AI Engineer per integrare modelli open-source e il relativo ecosistema in servizi di produzione eseguiti on-prem nei nostri datacenter.
Ti unirai a un team esperto ed entusiasta con un grande spirito di squadra, dove la conoscenza viene condivisa piuttosto che accumulata. I servizi sono critici per il business, quindi il team condivide una rotazione di reperibilità 24/7.
System Engineer - AI Engineer (100%)
Cosa farai
Ti occuperai delle tue soluzioni end to end — dalla comprensione del bisogno di business alla loro esecuzione in produzione:
- Analizzare il bisogno con gli stakeholder, metterlo in discussione e trasformarlo in un progetto che rispetti i nostri vincoli — quindi implementare, testare, documentare e consegnare.
- Assumerti la responsabilità oltre il codice: scadenze, dipendenze, comunicazione con gli stakeholder e le decisioni che ne derivano.
- Valutare, selezionare e distribuire modelli open-source (LLM, embeddings, rerankers, speech) ed eseguire gli stack di inferenza self-hosted che li supportano (vLLM, Ollama) con quantizzazione, batching e model routing adeguati.
- Costruire lo strato applicativo — pipeline RAG, agenti, tool calling, output strutturati — e gestire il percorso dei dati sottostante: ingestione, chunking, embeddings, vector stores, qualità del retrieval.
- Costruire harness di valutazione e benchmark in modo che le scelte dei modelli siano misurate e non indovinate.
- Integrare l'ecosistema attorno ai modelli: gateway, framework di orchestrazione, model registries, osservabilità e tracing.
- Ottimizzare per latenza, throughput e utilizzo della GPU; gestire la pianificazione della capacità, lo scheduling e il monitoraggio della produzione — e risolvere regressioni quando un modello o una versione cambia.
- Partecipare alla rotazione di reperibilità 24/7 del team (piquet), con compensazione e recupero ore — e migliorare i runbook, l'alerting e l'automazione affinché le sere tranquille siano la norma, non l'eccezione.
Cosa porti
- Laurea magistrale in Informatica o equivalente, con esperienza pratica di lavoro con sistemi basati su LLM.
- Esperienza di system engineering su Linux e Kubernetes.
- Ottima conoscenza di Python; dimestichezza con le pratiche di produzione (testing, CI/CD, code review).
- Forti competenze SQL.
- Esperienza nell'auto-hosting e nel serving di modelli open-source.
- Conoscenza operativa di retrieval, embeddings e database vettoriali.
- Approccio pratico: non hai paura di cablare un server o sostituire una GPU.
- Autonomia e senso di responsabilità — segui un argomento fino alla consegna invece di passarlo a qualcun altro.
- Volontà di unirsi a una rotazione di reperibilità 24/7 e il temperamento per rimanere metodici sotto la pressione degli incidenti.
- Pragmatismo riguardo agli strumenti open-source — capace di distinguere un progetto solido da uno di moda.
Plus
- Operazioni GPU: driver, CUDA, MIG, device plugins, scheduling su Kubernetes.
- Ottimizzazione dell'inferenza (TensorRT-LLM, ONNX, speculative decoding, KV-cache tuning).
- Tecniche di adattamento leggero (adapter LoRA/QLoRA su modelli open-source esistenti).
- Progettazione di storage e networking per carichi di lavoro AI.
- Esperienza con la sicurezza dell'AI, guardrails e pratiche di deployment responsabile.
- Contributi a progetti AI open-source.
Cosa offriamo
- Ambiente amichevole e dinamico in cui la proattività e l'impegno personale sono altamente valorizzati.
- Stipendio competitivo e sistema di benefit, condizioni del fondo pensione molto vantaggiose.
- Orari di lavoro flessibili con 6 settimane di vacanza.
- Posto di lavoro moderno ed ergonomico.
- Vari benefit aziendali.
- Abbonamento mobile gratuito e sconti sui nostri prodotti.
- Possibilità di ampliare le proprie competenze e l'esperienza grazie a un ambiente telco complesso e in rapida evoluzione.
- Un intero stack AI open-source eseguito on-prem nei nostri datacenter — possiedi l'hardware, non l'astrazione di qualcun altro.
Hai sempre sognato un lavoro in un ambiente diversificato e stimolante? Allora dobbiamo incontrarci. Si prega di candidarsi online (accettiamo solo candidature online con CV, referenze lavorative, diplomi).
jpid617d480jm jpit0940jm jpiy26jm
Tradotto automaticamente dall’originale.
Pubblicato oggi