developerjobs.ch
← Tutte le offerte

Senior Staff Software Engineer, Site Reliability Engineering, Privacy, Security and Safety - Google Careers

Google

Tipo di contratto
Tempo pieno
Percentuale
100%
Luogo
Zürich
Lingue
Inglese, Inglese
Prima pubblicazione
Candidati ora

info_outline

X Nella maggior parte dei casi, questa posizione richiede colloqui di persona come parte del processo di assunzione.

Requisiti minimi: ###

  • Laurea triennale in Informatica, un campo correlato o esperienza pratica equivalente.
  • 8 anni di esperienza con lo sviluppo di software in uno o più linguaggi di programmazione.
  • 4 anni di esperienza nella guida di progetti e nel fornire leadership tecnica.
  • 3 anni di esperienza nella progettazione, analisi e risoluzione di problemi in sistemi distribuiti.

Requisiti preferenziali: ###

  • Laurea magistrale in Informatica o Ingegneria.
  • Esperienza con sistemi distribuiti su larga scala.
  • Esperienza in Generative AI Agent e Machine Learning.
  • Esperienza nelle operazioni di Trust and Safety.

Informazioni sul lavoro ###

Site Reliability Engineering (SRE) combina l'ingegneria del software e dei sistemi per costruire e gestire sistemi su larga scala, massicciamente distribuiti e tolleranti ai guasti. L'SRE garantisce che i servizi di Google Cloud — sia i nostri sistemi internamente critici che quelli visibili esternamente — abbiano affidabilità, uptime appropriato alle esigenze dei clienti e un rapido tasso di miglioramento. Inoltre, gli SRE terranno un occhio sempre vigile sulla capacità e sulle prestazioni dei nostri sistemi.

Gran parte del nostro sviluppo software si concentra sull'ottimizzazione dei sistemi esistenti, sulla costruzione di infrastrutture ed sull'eliminazione del lavoro attraverso l'automazione. Nel team SRE, avrai l'opportunità di gestire le complesse sfide di scala che sono uniche per Google Cloud, utilizzando la tua competenza in coding, algoritmi, analisi della complessità e progettazione di sistemi su larga scala. La cultura dell'SRE basata sulla curiosità intellettuale, la risoluzione dei problemi e l'apertura è fondamentale per il suo successo. La nostra organizzazione riunisce persone con una grande varietà di background, esperienze e prospettive. Li incoraggiamo a collaborare, a pensare in grande e a correre rischi in un ambiente privo di colpe (blame-free). Promuoviamo l'autonomia nel lavorare su progetti significativi, cercando al contempo di creare un ambiente che fornisca il supporto e il mentoring necessari per imparare e crescere.

PSS SRE fornisce la base indispensabile di sicurezza e conformità per l'infrastruttura di Google. Nell'era dell'IA, la leadership di PSS UTL è fondamentale per navigare nella frontiera tecnologica in evoluzione di Google: essere pionieri nelle linee guida di sicurezza della produzione per una rapida scalabilità agentica, contenere i raggi d'azione (blast-radii) per le pipeline di IA non deterministiche e scalare l'autorizzazione localizzata per sbloccare la prossima ondata di innovazione dell'IA e di crescita del business di Google. Il PSS UTL assicurerà inoltre che PSS SRE sia un team SRE nativo agentico.

Dietro tutto ciò che i nostri utenti vedono online c'è l'architettura costruita dal team Technical Infrastructure per mantenerlo in funzione. Dallo sviluppo e mantenimento dei nostri data center alla costruzione della prossima generazione di piattaforme Google, rendiamo possibile il portfolio prodotti di Google. Siamo orgogliosi di essere gli ingegneri degli ingegneri e amiamo invalidare le garanzie smontando le cose per poterle ricostruire. Manteniamo le nostre reti attive e funzionanti, garantendo ai nostri utenti l'esperienza migliore e più veloce possibile.

Responsabilità ###

  • Partecipare e migliorare l'intero ciclo di vita dei servizi, dalla concezione e progettazione, fino al deployment, all'operatività e al perfezionamento.
  • Supportare i servizi prima del rilascio attraverso attività quali la consulenza sulla progettazione del sistema, lo sviluppo di piattaforme e framework software, la pianificazione della capacità e le revisioni di lancio.
  • Mantenere i servizi una volta che sono online misurando e monitorando la disponibilità, la latenza e la salute complessiva del sistema.
  • Scalare i sistemi in modo sostenibile attraverso meccanismi come l'automazione, ed evolvere i sistemi spingendo per cambiamenti che migliorino l'affidabilità e la velocità.
  • Praticare una risposta agli incidenti sostenibile e post-mortem senza colpe (blameless).

Tradotto automaticamente dall’originale.

Pubblicato oggi

Luogo

Vedi su Google Maps

Questa pagina su softwareengineerjobszurich.ch