Software Engineering Manager, Site Reliability Engineering, Gmail SRE - Google Careers
- Anstellung
- Vollzeit
- Pensum
- 100%
- Ort
- Zürich
- Sprachen
- Englisch, Englisch
- Erstmals ausgeschrieben
Mindestqualifikationen: ###
- Bachelor-Abschluss in Informatik, einem verwandten Bereich oder gleichwertiger praktischer Erfahrung.
- 8 Jahre Erfahrung in der Softwareentwicklung in einer oder mehreren Programmiersprachen.
- 3 Jahre Erfahrung in der Leitung von Personen oder Teams.
- 3 Jahre Erfahrung in der Leitung von Projekten.
- 3 Jahre Erfahrung im Entwurf, in der Analyse und bei der Fehlersuche in verteilten Systemen.
Bevorzugte Qualifikationen: ###
- Master-Abschluss in Informatik oder Ingenieurwesen.
- Erfahrung im Stakeholder-Management und in der Zusammenarbeit mit Infrastruktur- und Entwicklungspartnern.
- Erfahrung in technischer Infrastruktur, einschließlich Netzwerk- oder Speichersystemen.
- Erfahrung in systematischer Problemlösung und der Behebung technischer oder betrieblicher Probleme.
Über den Job ###
Site Reliability Engineering (SRE) kombiniert Software- und Systemtechnik, um groß angelegte, massiv verteilte, fehlertolerante Systeme aufzubauen und zu betreiben. SRE stellt sicher, dass Googles Dienste – sowohl unsere intern kritischen als auch unsere extern sichtbaren Systeme – Zuverlässigkeit, eine den Nutzerbedürfnissen angemessene Verfügbarkeit und eine schnelle Verbesserungsrate aufweisen. Zusätzlich werden SREs die Kapazität und Leistung unserer Systeme stets wachsam im Auge behalten.
Ein Großteil unserer Softwareentwicklung konzentriert sich auf die Optimierung bestehender Systeme, den Aufbau von Infrastruktur und die Eliminierung von Arbeit durch Automatisierung. Im SRE-Team haben Sie die Möglichkeit, die komplexen Herausforderungen der Skalierung zu bewältigen, die für Google einzigartig sind, während Sie Ihr Fachwissen in den Bereichen Codierung, Algorithmen, Komplexitätsanalyse und groß angelegtes Systemdesign einsetzen.
Die SRE-Kultur der intellektuellen Neugier, Problemlösung und Offenheit ist der Schlüssel zu ihrem Erfolg. Unsere Organisation bringt Menschen mit einer Vielzahl von Hintergründen, Erfahrungen und Perspektiven zusammen. Wir ermutigen sie zur Zusammenarbeit, zum großen Denken und zum Eingehen von Risiken in einem schuldunabhängigen Umfeld. Wir fördern die Selbststeuerung bei der Arbeit an bedeutungsvollen Projekten, während wir gleichzeitig bestrebt sind, ein Umfeld zu schaffen, das die notwendige Unterstützung und Mentorenschaft zum Lernen und Wachsen bietet.
Um mehr zu erfahren: Schauen Sie sich unsere Bücher über Site Reliability Engineering an oder lesen Sie ein Karriereprofil darüber, warum sich ein Software Engineer für den Beitritt zum SRE entschieden hat.
Als Site Reliability Engineering (SRE) Manager für Gmail werden Sie ein Team hochqualifizierter Ingenieure leiten, das für die Zuverlässigkeit, Skalierbarkeit und Leistung einer der weltweit größten Kommunikationsplattformen verantwortlich ist. Gmail SRE verwaltet das produktive Gmail-System, einschließlich der Frontend-, Backend- und Speicherschichten, und unterstützt Milliarden von Nutzern weltweit.
Hinter allem, was unsere Nutzer online sehen, steht die Architektur, die vom Technical Infrastructure Team aufgebaut wurde, um den Betrieb aufrechtzuerhalten. Von der Entwicklung und Wartung unserer Rechenzentren bis hin zum Aufbau der nächsten Generation von Google-Plattformen ermöglichen wir das Produktportfolio von Google. Wir sind stolz darauf, die Ingenieure unserer Ingenieure zu sein, und lieben es, Garantien zu verletzen, indem wir Dinge auseinandernehmen, damit wir sie neu aufbauen können. Wir halten unsere Netzwerke am Laufen und stellen sicher, dass unsere Nutzer die bestmögliche und schnellste Erfahrung machen.
Verantwortlichkeiten ###
- Leitung eines Teams von Software/Systems Engineers bei Projekten für Nutzer und direkte Verantwortung für die Verfügbarkeit.
- Verantwortung für die End-to-End-Verfügbarkeit und Leistung wichtiger Dienste und Aufbau von Automatisierung, um ein erneutes Auftreten von Problemen zu verhindern. Automatisierung der Reaktion auf alle nicht außergewöhnlichen Servicebedingungen.
- Vorbildfunktion übernehmen, das Team mentorieren und Glaubwürdigkeit durch qualitativ hochwertige technische Ausführung etablieren.
- Verwaltung und Teilnahme an Rufbereitschaften.
- Entwurf, Schreiben und Bereitstellung von Software zur Verbesserung der Verfügbarkeit, Skalierbarkeit, Latenz und Effizienz der Dienste von Google.
Automatisch aus dem Original übersetzt.
Ausgeschrieben heute