Nuovo!

Site Reliability Engineer

Supabase

Supabase gestisce milioni di istanze Postgres e sta concentrando i propri sforzi sull'affidabilità in una pratica SRE dedicata, che tenga insieme la disciplina attraverso tutta la piattaforma. Il ruolo è inserito nelle Service Operations e ha come obiettivo rendere più affidabile ogni squadra di engineering, non possedendone l'infrastruttura ma costruendo pratiche, framework e cicli di feedback che permettano a ciascuna di possedere la propria affidabilità. Non sono richiesti viaggi frequenti, a parte il ritrovo aziendale annuale.

Ruolo
Lavorerai con le squadre di servizio per definire SLI e SLO significativi, radicati nell'esperienza reale dei clienti, e costruirai le politiche di error budget che li trasformano in decisioni di engineering. Possiederai e farai evolvere il processo di Operational Readiness Review, conducendo le revisioni per i nuovi servizi e per i cambiamenti importanti su osservabilità, alerting, runbook, capacità e degradazione controllata. Rafforzerai la catena che porta dall'incidente al miglioramento, collegando le conclusioni dei postmortem alle lacune di prontezza operativa, individuando gli schemi di guasto ricorrenti e spingendo le correzioni sistemiche. Sarai la persona esperta di affidabilità che le squadre coinvolgono nelle revisioni di architettura, nell'analisi delle modalità di guasto, nella mappatura delle dipendenze e nella progettazione resiliente, individuerai e quantificherai il lavoro ripetitivo costruendo o promuovendo l'automazione che lo elimina, e aiuterai a progettare pratiche di on-call sostenibili tra qualità degli alert, percorsi di escalation, copertura dei runbook e riduzione del rumore. Sono richiesti almeno 7 anni in ruoli SRE, production engineering o comunque orientati all'affidabilità, con esperienza nel dare forma alle pratiche SRE e nel farle adottare, un approccio da ingegnere del software che scrive codice e costruisce strumenti invece di limitarsi a configurarli, esperienza pratica nella definizione e messa in opera di SLO e SLI su larga scala, e una solida pratica di incident response e postmortem. Servono inoltre esperienza con sistemi multi-tenant di grandi dimensioni, dimestichezza con l'infrastruttura cloud, preferibilmente AWS, e con l'infrastructure as code, con Pulumi preferito ma anche Terraform o CDK, e la capacità di influenzare senza autorità in un'organizzazione distribuita. Sono graditi operazioni di piattaforma basate su Kubernetes e familiarità con OpenTelemetry, VictoriaMetrics o Grafana.

Tecnologie
AWS, Pulumi, Terraform e CDK, Kubernetes, OpenTelemetry, VictoriaMetrics e Grafana, SLO, SLI ed error budget, Postgres su larga scala.

Condividi annuncio

Informazioni su Supabase

Supabase è la piattaforma di sviluppo basata su Postgres, costruita da sviluppatori per sviluppatori. Offre una soluzione backend completa che comprende database, autenticazione, storage, Edge Functions, funzionalità Realtime e ricerca vettoriale, con servizi profondamente integrati e pensati per crescere insieme ai progetti. Oltre 7 milioni di sviluppatori, dai singoli creatori di progetti personali fino alle grandi aziende in settori regolamentati, costruiscono i propri prodotti sulla piattaforma, che si è affermata come uno dei principali strati dati per le applicazioni moderne e AI-native.

Supabase è nata come azienda remote-first e open-source-first: il suo team distribuito a livello globale è considerato il vero punto di forza nella costruzione di strumenti che gli sviluppatori amano. Conta oltre 280 persone in più di 55 paesi, ha raccolto 500 milioni di dollari di finanziamenti e una community di centinaia di migliaia di membri. La cultura aziendale è fondata sulla comunicazione asincrona, sulla trasparenza, sul lavoro in pubblico e su un forte impegno verso l'ecosistema open source, che l'azienda punta a sostenere anziché sostituire. Ogni persona del team riceve una quota di equity e opera con ampia autonomia, in un ambiente che valorizza velocità, qualità e responsabilità individuale.

Visita il sito web →