DevOps Engineer - SRE
Is this the right opportunity for you?
Explore more jobs, compare advertised salaries and see which skills employers want.
Explore this careerSearch for a different role
More DevOps Engineer jobs →Skills
Description
CHI SIAMO
Blazar è nata nel 2012 dalla passione per l'informatica e dalla volontà di creare un ecosistema lavorativo virtuoso, in cui fosse possibile \"vivere meglio\".
Oggi Blazar Group è una realtà internazionale, in continua espansione, che continua a far vivere quella missione.
\"È un grande sogno che non smette mai di realizzarsi.\"
Siamo affascinati dalla tecnologia, fautori della collaborazione proattiva e fermamente convinti che il successo di un gruppo derivi direttamente dalla qualità delle persone che ne fanno parte.
Per questa ragione tutti i Blazariani, fin dal primo giorno di lavoro, sono affiancati da un team di specialisti (psicologo, coach e trainer), dedicato alla costruzione delPiano Personale di Crescita (PPC®), un percorso costruito su misura e volto alla crescita personale, sviluppato mediante incontri individuali ed esperienze in team.
Ogni anno, per dare sostegno alle attività di People Engagement, Blazar Group riserva una quota almeno pari al 5% del proprio fatturato.
CHI CERCHIAMO
Cerchiamo una persona da inserire nel nostro team di Observability (monitoraggio) in qualità di Site Reliability Engineer (SRE), con esperienza nella gestione di sistemi e applicazioni distribuite e con una forte attenzione all'affidabilità, alle performance e all'automazione.
La persona contribuirà alla gestione e all'evoluzione degli ambienti di produzione, lavorando a stretto contatto con i team di sviluppo e infrastruttura per garantire alta disponibilità, performance, scalabilità e continuità operativa dei servizi.
Ma, prima ancora delle competenze tecniche, cerchiamo persone appassionate, curiose e con una forte predisposizione verso i dati: persone che davanti a un'anomalia vogliano capire cosa sta succedendo e perché, che amino analizzare informazioni, metriche e log e mettere insieme gli indizi per arrivare alla causa di un problema.
Non ci aspettiamo che tu sappia già tutto. Cerchiamo piuttosto qualcuno che abbia voglia di imparare continuamente: quello che non si sa, si impara!!
Cerchiamo quindi un profilo tecnico con un approccio proattivo, curioso e analitico, capace non solo di intervenire sui problemi, ma anche di individuarli e prevenirli attraverso monitoraggio, analisi dei dati, automazione e miglioramento continuo.
COSA FARAI
- Monitoring & Observability: Monitorerai disponibilità, performance e stato di salute complessivo degli ambienti di produzione, analizzando dati, metriche, log ed eventi per individuare anomalie, correlazioni, colli di bottiglia e possibili aree di miglioramento.
- Data Analysis & Troubleshooting: Utilizzerai Splunk per interrogare e analizzare i dati provenienti dai sistemi e dalle applicazioni, approfondendo anomalie e comportamenti inattesi e contribuendo alle attività di troubleshooting e Root Cause Analysis.
- Infrastructure & Automation: Svilupperai strumenti, automazioni e sistemi per la gestione dell'infrastruttura, delle piattaforme e delle applicazioni, utilizzando anche Terraform e principi Infrastructure as Code, riducendo le attività manuali e aumentando affidabilità e ripetibilità dei processi.
- Performance & Troubleshooting: Raccoglierai e analizzerai metriche provenienti da sistemi operativi e applicazioni per attività di performance tuning, troubleshooting e identificazione delle cause dei malfunzionamenti.
- Development & Release: Collaborerai con i team di sviluppo per migliorare l'affidabilità dei servizi attraverso procedure strutturate di testing, deployment e release.
- System Design & Capacity Planning: Parteciperai alla progettazione dei sistemi, alla gestione delle piattaforme e alle attività di capacity planning, contribuendo alla loro evoluzione e scalabilità.
- Service Level Management: Contribuirai alla definizione e al monitoraggio dei Service Level Objectives (SLO), bilanciando velocità di sviluppo, introduzione di nuove funzionalità e affidabilità dei servizi.
- Continuous Improvement: Contribuirai all'evoluzione continua delle piattaforme, anticipando criticità e necessità infrastrutturali e proponendo soluzioni tecniche orientate a performance, resilienza e scalabilità.
COSA TI CHIEDIAMO DI AVERE
- Formazione in ambito informatico (Bachelor of Science / Master of Science o formazione equivalente).
- Esperienza in ruoli tecnici legati a Site Reliability Engineering, DevOps, Platform Engineering, System Engineering o ambiti analoghi.
- Buona conoscenza di Splunk, con capacità di ricerca, interrogazione e analisi di log, metriche ed eventi.
- Buona conoscenza di Terraform e dei principi di Infrastructure as Code.
- Buone capacità di programmazione, sia strutturata sia Object-Oriented, utilizzando uno o più linguaggi quali Python, Java, C/C++, Ruby o JavaScript.
- Esperienza nella gestione e nel troubleshooting di sistemi e applicazioni distribuite.
- Conoscenza di tecnologie di storage distribuito quali NFS, HDFS, Ceph e Amazon S3 o tecnologie equivalenti.
- Esperienza con piattaforme di orchestrazione e gestione dinamica delle risorse, in particolare Kubernetes, oppure tecnologie quali Apache Mesos e YARN.
- Capacità di analizzare metriche applicative e infrastrutturali per identificare problemi, anomalie e colli di bottiglia prestazionali.
- Conoscenza dei principi di High Availability, Scalability, Reliability e Performance Management.
- Conoscenza dei processi GitOps.
- Passione per la tecnologia e per i dati e desiderio di comprendere davvero il significato.
- Curiosità: voglia di fare domande, approfondire e non fermarsi alla prima risposta.
- Forte predisposizione al problem solving e piacere nell'indagare le cause di un problema.
- Voglia di imparare: non cerchiamo qualcuno che sappia già tutto, ma qualcuno che abbia entusiasmo nell'imparare ciò che ancora non conosce.
- Approccio proattivo e capacità di identificare e prevenire i problemi, non soltanto di intervenire quando si verificano.
- Capacità di collaborare e confrontarsi con team di sviluppo, infrastruttura e altri stakeholder tecnici.
- Precisione e metodo nell'analisi, accompagnati della capacità di ragionare in modo critico e mettere in relazione informazioni differenti.
Costituiscono requisito preferenziale
- Esperienza significativa nello sviluppo software, oltre alla semplice realizzazione di script.
- Esperienza con strumenti e processi di Infrastructure as Code e automation.
- Esperienza con piattaforme Cloud e ambienti containerizzati.
- Esperienza con strumenti di monitoring, observability, logging e alerting.
- Esperienza nella definizione e gestione di SLA, SLO e indicatori di affidabilità dei servizi.
- Certificazioni in ambito Cloud, Kubernetes, DevOps, Splunk o Site Reliability Engineering.
COSA TI OFFRIAMO
PPC: Potrai beneficiare del Piano Personale di Crescita, di bonus aziendali monitorati durante gli incontri di Performance Review e di premi legati al compimento delle “Azioni di Valore”.
Un ambiente di lavoro inclusivo e stimolante, dove innovazione e crescita sono elementi imprescindibili.
Un equilibrio tra vita privata e lavoro che ti consenta di esprimere al massimo il tuo potenziale.
Eventi aziendali, team building e progetti che allieteranno la tua vita aziendale.
INQUADRAMENTO CONTRATTUALE
- Contratto: Tempo Indeterminato
RETRIBUZIONE ANNUA LORDA (RAL)
- 70/ 80.000 CHF e bonus a obiettivi
Modalità di lavoro: Full on site: 3 su 5 a Chiasso. 2 su 5 Lugano
Blazar: Together, Bigger.
Ai sensi del Regolamento UE 2016/679 (GDPR), i dati personali forniti saranno trattati esclusivamente ai fini della selezione del personale, nel rispetto dei principi di liceità, correttezza e trasparenza.
Get similar jobs in Switzerland by email
We'll email you when new jobs similar to this one appear.
Similar jobs
Explore more DevOps Engineer jobs in Switzerland.
Finding similar jobs…