Offerta di lavoro
Responsabile, SRE
Navantia è alla ricerca di un Principal SRE con oltre 5 anni di esperienza in DevOps e gestione delle infrastrutture (Kubernetes, Terraform, AWS), responsabile del monitoraggio, dell’automazione e della sicurezza delle piattaforme digitali. La sede di lavoro è in Svezia (Stoccolma/Göteborg) e offre un modello di lavoro ibrido.
Compiti
- Responsabile dello stato e della manutenzione dei servizi
- Automazione del ripristino (del sito) e del monitoraggio degli eventi, comprese le attività di aggiornamento e la gestione dei servizi
- Miglioramento della prontezza, della resilienza e della ridondanza nel recupero in caso di catastrofi
- Garantire il rispetto degli SLA e dei requisiti della piattaforma attuale o futura in ambiti quali disponibilità, livello di servizio, pianificazione della capacità, ecc.
- Partecipazione alla progettazione e alla documentazione delle soluzioni
- Responsabile dello stato delle consegne nelle aree di interesse per il team applicativo (SRE)
- Contributo alla progettazione e all'implementazione di software per la sicurezza delle piattaforme navali, compresa la sicurezza delle reti
- Gestione e monitoraggio di sistemi, script e infrastruttura applicativa, comprese le pipeline di integrazione continua/distribuzione continua (CI/CD) e le configurazioni relative alla sicurezza
- Coordinamento della collaborazione tra i team in materia di best practice, individuazione di soluzioni e fornitura di indicazioni tecniche
- Lavoro su progetti infrastrutturali (ad es. Kubernetes, Terraform, AWS e sicurezza)
- Monitoraggio dello stato delle applicazioni e analisi dei log (Elastic, Datadog)
- Garantire che gli indicatori relativi agli SLA e all’uptime siano rispettati e considerati prioritari
- Mentoring per SRE junior
- Realizzazione e manutenzione dell'infrastruttura (ad es. Kubernetes, Terraform, AWS)
- Sviluppo e miglioramento delle pipeline CI/CD
- Monitoraggio e risoluzione dei problemi del sistema
- Sicurezza e conformità
Requisiti
- Laurea triennale in un settore tecnico (ad es. informatica, ingegneria del software o sicurezza informatica); la laurea magistrale o un titolo equivalente costituisce titolo preferenziale
- Almeno 5 anni di esperienza in DevOps, SRE, Site Reliability Engineering o in un settore strettamente correlato
- Si richiede una solida esperienza pratica nel cloud (AWS, Azure, GCP), competenza in Linux/Unix nell’ambito dell’infrastruttura, della distribuzione delle applicazioni e della gestione della sicurezza (ad es. Zero-Trust, IAM, segmentazione della rete)
- Ottima conoscenza dei protocolli crittografici, della sicurezza della catena di approvvigionamento e della sicurezza delle applicazioni
- Conoscenza di almeno un linguaggio di programmazione (come Python, Jenkins o Python)
- Conoscenza degli strumenti DevOps e delle pipeline CI/CD, della gestione dei servizi (IaC ecc.), della scrittura di script (Python, Bash) e dell'automazione della sicurezza
- Concentrato, attento ai dettagli e in grado di tradurre complessi requisiti in materia di rischio e conformità in risultati di facile comprensione, roadmap tecniche e piani attuabili con procedure operative chiare
- Requisiti auspicabili: esperienza nell’implementazione di architetture Zero Trust (ad es. Sails, Istio, OPA) e con i concetti PKI, i moduli di sicurezza hardware (HSM) e i runtime sicuri per container
- Almeno 5 anni in ruoli operativi e di gestione della piattaforma
- DevOps, competenze in SRE e in materia di configurazione
- Capacità di collaborare con team interfunzionali
- Capacità di problem solving
- Ottima padronanza dell'inglese
- Competenze specialistiche nella gestione delle infrastrutture (ad es. esperienza con Kubernetes, Terraform)
- Esperienza con fornitori di servizi cloud (ad es. AWS, GCP, Azure) (AWS è preferibile, ma non costituisce un criterio di esclusione se si ha familiarità con altri)
- Esperienza con strumenti di osservabilità (ad es. Datadog o simili)
Dettagli sul lavoro