Senior Machine Learning Site Reliability Engineer
Ruolo focalizzato sull'affidabilità e l'operatività di sistemi ML all'interno del team Infrastructure. Collaborerai con ingegneria per progettare, automatizzare e mantenere infrastrutture scalabili e sicure.
Cosa farai
- Progettare e operare sistemi affidabili definendo SLO e SLI
- Sviluppare automazioni per infrastruttura e workflow operativi
- Partecipare e guidare la risposta agli incidenti e i post-incident review
- Analizzare performance, costi e supportare capacity planning
Cosa cercano
- Esperienza hands-on con pratiche SRE e cloud AWS
- Conoscenza di Kubernetes, networking, DNS e IaC (Pulumi preferito)
- Competenze solide in Python e PySpark
- Familiarità con pratiche MLOps e gestione del ciclo di vita dei modelli
Competenze
Riassunto a cura di StartupJobs dall'annuncio dell'azienda. L'annuncio completo è sul sito dell'azienda.
Questa offerta viene dalla pagina lavora-con-noi di Prima Assicurazioni. Rimandiamo direttamente alla fonte.