System Engineer - AI Engineer (100%)
- Tipo di contratto
- Tempo pieno
- Percentuale
- 100%
- Luogo
- Prilly
- Azienda
- Salt Mobile SA, 1008 Prilly
- Prima pubblicazione
Siamo alla ricerca di un System Engineer — AI Engineer per integrare modelli open-source e l'ecosistema circostante in servizi di produzione in esecuzione on-prem nei nostri datacenters.
Ti unirai a un team esperto ed entusiasta con un grande spirito di squadra, dove la conoscenza viene condivisa piuttosto che accumulata. I servizi sono business-critical, quindi il team condivide una rotazione di reperibilità 24/7.
System Engineer - AI Engineer (100%)
Cosa farai
Ti occuperai delle tue soluzioni end to end — dalla comprensione della necessità aziendale all'esecuzione in produzione:
- Analizzerai le necessità con gli stakeholder, le metterai in discussione e le trasformerai in un progetto che rispetti i nostri vincoli — per poi implementare, testare, documentare e consegnare.
- Assumerai la responsabilità oltre il codice: tempistiche, dipendenze, comunicazione con gli stakeholder e le decisioni che ne derivano.
- Valuterai, selezionerai e distribuirai modelli open-source (LLMs, embeddings, rerankers, speech) e gestirai gli stack di inferenza self-hosted sottostanti (vLLM, Ollama) con quantizzazione, batching e model routing appropriati.
- Costruirai lo strato applicativo — pipeline RAG, agenti, tool calling, output strutturato — e gestirai il percorso dei dati sottostante: ingestion, chunking, embeddings, vector stores, qualità del recupero.
- Costruirai harness di valutazione e benchmark in modo che le scelte dei modelli siano misurate, non ipotizzate.
- Integrerai l'ecosistema intorno ai modelli: gateway, framework di orchestrazione, model registries, osservabilità e tracing.
- Ottimizzerai per latenza, throughput e utilizzo della GPU; gestirai la pianificazione della capacità, lo scheduling e il monitoraggio della produzione — e correggerai i bug delle regressioni quando un modello o una versione cambia.
- Parteciperai alla rotazione di reperibilità 24/7 (piquet) del team, con compensazione e recupero ore — e migliorerai i runbook, l'alerting e l'automazione in modo che le serate tranquille siano la norma, non l'eccezione.
Cosa porti
- Laurea magistrale in Computer Science o equivalente, con esperienza pratica di lavoro con sistemi basati su LLM.
- Esperienza di system engineering su Linux e Kubernetes.
- Ottima conoscenza di Python; dimestichezza con le pratiche di produzione (testing, CI/CD, code review).
- Forti competenze SQL.
- Esperienza nel self-hosting e nel serving di modelli open-source.
- Conoscenza operativa di retrieval, embeddings e database vettoriali.
- Approccio pratico: non hai paura di cablare un server o sostituire una GPU.
- Autonomia e senso di responsabilità — segui un argomento fino alla consegna invece di passarlo a qualcun altro.
- Volontà di unirsi a una rotazione di reperibilità 24/7 e il temperamento per rimanere metodici sotto la pressione di un incidente.
- Pragmatismo riguardo agli strumenti open-source — capace di distinguere un progetto solido da uno basato sull'hype.
Nice to have
- Operazioni GPU: driver, CUDA, MIG, device plugins, scheduling su Kubernetes.
- Ottimizzazione dell'inferenza (TensorRT-LLM, ONNX, speculative decoding, KV-cache tuning).
- Tecniche di adattamento leggero (adapter LoRA/QLoRA su modelli open-source esistenti).
- Progettazione di storage e networking per carichi di lavoro AI.
- Esperienza con la sicurezza dell'IA, guardrails e pratiche di distribuzione responsabile.
- Contributi a progetti di IA open-source.
Cosa offriamo
- Ambiente amichevole e dinamico dove la proattività e l'impegno personale sono altamente valorizzati.
- Stipendio competitivo e sistema di benefit, condizioni del fondo pensione molto attraenti.
- Orari di lavoro flessibili con 6 settimane di vacanza.
- Posto di lavoro moderno ed ergonomico.
- Vari fringe benefit.
- Abbonamento mobile gratuito e sconti sui nostri prodotti.
- Possibilità di ampliare le tue competenze e la tua esperienza grazie a un ambiente telco complesso e in rapida evoluzione.
- Un intero stack di IA open-source in esecuzione on-prem nei nostri datacenters — possiedi l'hardware, non l'astrazione di qualcun altro.
Hai sempre sognato di avere un lavoro in un ambiente diversificato e stimolante? Allora dobbiamo assolutamente incontrarci. Per favore, candidati online (accettiamo solo candidature online con CV, referenze lavorative, diplomi).
j4id10417507a j4it0940a j4iy26a
Tradotto automaticamente dall’originale.
Pubblicato 5 giorni fa