Offres d'emploi Suisse
← Tutte le offerte

System Engineer - AI Engineer

Salt Mobile SA

Tipo di contratto
Tempo pieno
Percentuale
100%
Luogo
Prilly
Azienda
Salt Mobile SA, Avenue de Malley 2, 1008 Prilly
Prima pubblicazione
Candidati ora

Ref 2581831 | Data: 29 Sept 2026

Salt Mobile SA

Cerchiamo un System Engineer — AI Engineer per integrare modelli open-source e il relativo ecosistema in servizi di produzione eseguiti on-prem nei nostri datacenter.

Ti unirai a un team esperto ed entusiasta con un grande spirito di squadra, dove la conoscenza viene condivisa piuttosto che accumulata. I servizi sono critici per il business, quindi il team condivide una rotazione di reperibilità 24/7.

System Engineer - AI Engineer (100%)

Cosa farai

Ti occuperai delle tue soluzioni end to end — dalla comprensione del bisogno di business alla loro esecuzione in produzione:

  • Analizzare il bisogno con gli stakeholder, metterlo in discussione e trasformarlo in un progetto che rispetti i nostri vincoli — quindi implementare, testare, documentare e consegnare.
  • Assumerti la responsabilità oltre il codice: scadenze, dipendenze, comunicazione con gli stakeholder e le decisioni che ne derivano.
  • Valutare, selezionare e distribuire modelli open-source (LLM, embeddings, rerankers, speech) ed eseguire gli stack di inferenza self-hosted che li supportano (vLLM, Ollama) con quantizzazione, batching e model routing adeguati.
  • Costruire lo strato applicativo — pipeline RAG, agenti, tool calling, output strutturati — e gestire il percorso dei dati sottostante: ingestione, chunking, embeddings, vector stores, qualità del retrieval.
  • Costruire harness di valutazione e benchmark in modo che le scelte dei modelli siano misurate e non indovinate.
  • Integrare l'ecosistema attorno ai modelli: gateway, framework di orchestrazione, model registries, osservabilità e tracing.
  • Ottimizzare per latenza, throughput e utilizzo della GPU; gestire la pianificazione della capacità, lo scheduling e il monitoraggio della produzione — e risolvere regressioni quando un modello o una versione cambia.
  • Partecipare alla rotazione di reperibilità 24/7 del team (piquet), con compensazione e recupero ore — e migliorare i runbook, l'alerting e l'automazione affinché le sere tranquille siano la norma, non l'eccezione.

Cosa porti

  • Laurea magistrale in Informatica o equivalente, con esperienza pratica di lavoro con sistemi basati su LLM.
  • Esperienza di system engineering su Linux e Kubernetes.
  • Ottima conoscenza di Python; dimestichezza con le pratiche di produzione (testing, CI/CD, code review).
  • Forti competenze SQL.
  • Esperienza nell'auto-hosting e nel serving di modelli open-source.
  • Conoscenza operativa di retrieval, embeddings e database vettoriali.
  • Approccio pratico: non hai paura di cablare un server o sostituire una GPU.
  • Autonomia e senso di responsabilità — segui un argomento fino alla consegna invece di passarlo a qualcun altro.
  • Volontà di unirsi a una rotazione di reperibilità 24/7 e il temperamento per rimanere metodici sotto la pressione degli incidenti.
  • Pragmatismo riguardo agli strumenti open-source — capace di distinguere un progetto solido da uno di moda.

Plus

  • Operazioni GPU: driver, CUDA, MIG, device plugins, scheduling su Kubernetes.
  • Ottimizzazione dell'inferenza (TensorRT-LLM, ONNX, speculative decoding, KV-cache tuning).
  • Tecniche di adattamento leggero (adapter LoRA/QLoRA su modelli open-source esistenti).
  • Progettazione di storage e networking per carichi di lavoro AI.
  • Esperienza con la sicurezza dell'AI, guardrails e pratiche di deployment responsabile.
  • Contributi a progetti AI open-source.

Cosa offriamo

  • Ambiente amichevole e dinamico in cui la proattività e l'impegno personale sono altamente valorizzati.
  • Stipendio competitivo e sistema di benefit, condizioni del fondo pensione molto vantaggiose.
  • Orari di lavoro flessibili con 6 settimane di vacanza.
  • Posto di lavoro moderno ed ergonomico.
  • Vari benefit aziendali.
  • Abbonamento mobile gratuito e sconti sui nostri prodotti.
  • Possibilità di ampliare le proprie competenze e l'esperienza grazie a un ambiente telco complesso e in rapida evoluzione.
  • Un intero stack AI open-source eseguito on-prem nei nostri datacenter — possiedi l'hardware, non l'astrazione di qualcun altro.

Hai sempre sognato un lavoro in un ambiente diversificato e stimolante? Allora dobbiamo incontrarci. Si prega di candidarsi online (accettiamo solo candidature online con CV, referenze lavorative, diplomi).

jpid617d480jm jpit0940jm jpiy26jm

Tradotto automaticamente dall’originale.

Pubblicato oggi

Luogo

Vedi su Google Maps