← Back to jobs

DevOps Engineer - SRE

Skills

aiautomationcloudcppdevopsgdprgitopsinfrastructure as codejavajavascriptkubernetesobservabilityperformance managementpythonroot cause analysisrubys3splunkterraformRubyPythonJavaJavaScriptC++

Description

CHI SIAMO

Blazar è nata nel 2012 dalla passione per l'informatica e dalla volontà di creare un ecosistema lavorativo virtuoso, in cui fosse possibile \"vivere meglio\".

Oggi Blazar Group è una realtà internazionale, in continua espansione, che continua a far vivere quella missione.

\"È un grande sogno che non smette mai di realizzarsi.\"

Siamo affascinati dalla tecnologia, fautori della collaborazione proattiva e fermamente convinti che il successo di un gruppo derivi direttamente dalla qualità delle persone che ne fanno parte.

Per questa ragione tutti i Blazariani, fin dal primo giorno di lavoro, sono affiancati da un team di specialisti (psicologo, coach e trainer), dedicato alla costruzione delPiano Personale di Crescita (PPC®), un percorso costruito su misura e volto alla crescita personale, sviluppato mediante incontri individuali ed esperienze in team.

Ogni anno, per dare sostegno alle attività di People Engagement, Blazar Group riserva una quota almeno pari al 5% del proprio fatturato.

CHI CERCHIAMO

Cerchiamo una persona da inserire nel nostro team di Observability (monitoraggio) in qualità di Site Reliability Engineer (SRE), con esperienza nella gestione di sistemi e applicazioni distribuite e con una forte attenzione all'affidabilità, alle performance e all'automazione.

La persona contribuirà alla gestione e all'evoluzione degli ambienti di produzione, lavorando a stretto contatto con i team di sviluppo e infrastruttura per garantire alta disponibilità, performance, scalabilità e continuità operativa dei servizi.

Ma, prima ancora delle competenze tecniche, cerchiamo persone appassionate, curiose e con una forte predisposizione verso i dati: persone che davanti a un'anomalia vogliano capire cosa sta succedendo e perché, che amino analizzare informazioni, metriche e log e mettere insieme gli indizi per arrivare alla causa di un problema.

Non ci aspettiamo che tu sappia già tutto. Cerchiamo piuttosto qualcuno che abbia voglia di imparare continuamente: quello che non si sa, si impara!!

Cerchiamo quindi un profilo tecnico con un approccio proattivo, curioso e analitico, capace non solo di intervenire sui problemi, ma anche di individuarli e prevenirli attraverso monitoraggio, analisi dei dati, automazione e miglioramento continuo.

COSA FARAI

  • Monitoring & Observability: Monitorerai disponibilità, performance e stato di salute complessivo degli ambienti di produzione, analizzando dati, metriche, log ed eventi per individuare anomalie, correlazioni, colli di bottiglia e possibili aree di miglioramento.
  • Data Analysis & Troubleshooting: Utilizzerai Splunk per interrogare e analizzare i dati provenienti dai sistemi e dalle applicazioni, approfondendo anomalie e comportamenti inattesi e contribuendo alle attività di troubleshooting e Root Cause Analysis.
  • Infrastructure & Automation: Svilupperai strumenti, automazioni e sistemi per la gestione dell'infrastruttura, delle piattaforme e delle applicazioni, utilizzando anche Terraform e principi Infrastructure as Code, riducendo le attività manuali e aumentando affidabilità e ripetibilità dei processi.
  • Performance & Troubleshooting: Raccoglierai e analizzerai metriche provenienti da sistemi operativi e applicazioni per attività di performance tuning, troubleshooting e identificazione delle cause dei malfunzionamenti.
  • Development & Release: Collaborerai con i team di sviluppo per migliorare l'affidabilità dei servizi attraverso procedure strutturate di testing, deployment e release.
  • System Design & Capacity Planning: Parteciperai alla progettazione dei sistemi, alla gestione delle piattaforme e alle attività di capacity planning, contribuendo alla loro evoluzione e scalabilità.
  • Service Level Management: Contribuirai alla definizione e al monitoraggio dei Service Level Objectives (SLO), bilanciando velocità di sviluppo, introduzione di nuove funzionalità e affidabilità dei servizi.
  • Continuous Improvement: Contribuirai all'evoluzione continua delle piattaforme, anticipando criticità e necessità infrastrutturali e proponendo soluzioni tecniche orientate a performance, resilienza e scalabilità.

COSA TI CHIEDIAMO DI AVERE

  • Formazione in ambito informatico (Bachelor of Science / Master of Science o formazione equivalente).
  • Esperienza in ruoli tecnici legati a Site Reliability Engineering, DevOps, Platform Engineering, System Engineering o ambiti analoghi.
  • Buona conoscenza di Splunk, con capacità di ricerca, interrogazione e analisi di log, metriche ed eventi.
  • Buona conoscenza di Terraform e dei principi di Infrastructure as Code.
  • Buone capacità di programmazione, sia strutturata sia Object-Oriented, utilizzando uno o più linguaggi quali Python, Java, C/C++, Ruby o JavaScript.
  • Esperienza nella gestione e nel troubleshooting di sistemi e applicazioni distribuite.
  • Conoscenza di tecnologie di storage distribuito quali NFS, HDFS, Ceph e Amazon S3 o tecnologie equivalenti.
  • Esperienza con piattaforme di orchestrazione e gestione dinamica delle risorse, in particolare Kubernetes, oppure tecnologie quali Apache Mesos e YARN.
  • Capacità di analizzare metriche applicative e infrastrutturali per identificare problemi, anomalie e colli di bottiglia prestazionali.
  • Conoscenza dei principi di High Availability, Scalability, Reliability e Performance Management.
  • Conoscenza dei processi GitOps.
  • Passione per la tecnologia e per i dati e desiderio di comprendere davvero il significato.
  • Curiosità: voglia di fare domande, approfondire e non fermarsi alla prima risposta.
  • Forte predisposizione al problem solving e piacere nell'indagare le cause di un problema.
  • Voglia di imparare: non cerchiamo qualcuno che sappia già tutto, ma qualcuno che abbia entusiasmo nell'imparare ciò che ancora non conosce.
  • Approccio proattivo e capacità di identificare e prevenire i problemi, non soltanto di intervenire quando si verificano.
  • Capacità di collaborare e confrontarsi con team di sviluppo, infrastruttura e altri stakeholder tecnici.
  • Precisione e metodo nell'analisi, accompagnati della capacità di ragionare in modo critico e mettere in relazione informazioni differenti.

Costituiscono requisito preferenziale

  • Esperienza significativa nello sviluppo software, oltre alla semplice realizzazione di script.
  • Esperienza con strumenti e processi di Infrastructure as Code e automation.
  • Esperienza con piattaforme Cloud e ambienti containerizzati.
  • Esperienza con strumenti di monitoring, observability, logging e alerting.
  • Esperienza nella definizione e gestione di SLA, SLO e indicatori di affidabilità dei servizi.
  • Certificazioni in ambito Cloud, Kubernetes, DevOps, Splunk o Site Reliability Engineering.

COSA TI OFFRIAMO

PPC: Potrai beneficiare del Piano Personale di Crescita, di bonus aziendali monitorati durante gli incontri di Performance Review e di premi legati al compimento delle “Azioni di Valore”.

Un ambiente di lavoro inclusivo e stimolante, dove innovazione e crescita sono elementi imprescindibili.

Un equilibrio tra vita privata e lavoro che ti consenta di esprimere al massimo il tuo potenziale.

Eventi aziendali, team building e progetti che allieteranno la tua vita aziendale.

INQUADRAMENTO CONTRATTUALE

  • Contratto: Tempo Indeterminato

RETRIBUZIONE ANNUA LORDA (RAL)

  • 70/ 80.000 CHF e bonus a obiettivi

Modalità di lavoro: Full on site: 3 su 5 a Chiasso. 2 su 5 Lugano

Blazar: Together, Bigger.

Ai sensi del Regolamento UE 2016/679 (GDPR), i dati personali forniti saranno trattati esclusivamente ai fini della selezione del personale, nel rispetto dei principi di liceità, correttezza e trasparenza.

Get similar jobs in Switzerland by email

We'll email you when new jobs similar to this one appear.

Similar jobs

Explore more DevOps Engineer jobs in Switzerland.

Finding similar jobs…