softwareengineerjobszurich.ch
← Toutes les offres

Staff Software Engineer, Site Reliability Engineering Connections - Google Careers

Google

Type de contrat
Temps plein
Taux d’occupation
100%
Lieu
Zürich
Langues
Anglais, Anglais
Première publication
Postuler

info_outline

Dans la plupart des cas, ce poste nécessite des entretiens en personne dans le cadre du processus d'embauche.

Qualifications minimales : ###

  • Bachelor's degree en informatique, dans un domaine connexe, ou une expérience pratique équivalente.
  • 8 ans d'expérience en développement de logiciels dans un ou plusieurs langages de programmation.
  • 3 ans d'expérience dans la direction de projets.
  • 3 ans d'expérience dans la conception, l'analyse et le dépannage de systèmes distribués.

Qualifications préférentielles : ###

  • Master's degree en informatique ou en ingénierie.
  • Expérience avec les systèmes distribués et parallèles.
  • Forte préférence pour les solutions cohérentes et communes plutôt que pour les solutions personnalisées.
  • Approche systématique de la résolution de problèmes, couplée à des compétences en communication et un sens des responsabilités et de l'initiative.

A propos du poste ###

Le Site Reliability Engineering (SRE) combine l'ingénierie logicielle et l'ingénierie des systèmes pour construire et exploiter des systèmes à grande échelle, massivement distribués et tolérants aux pannes. Le SRE garantit que les services de Google Cloud — tant nos systèmes internes critiques que nos systèmes externes visibles — bénéficient d'une fiabilité, d'une disponibilité adaptée aux besoins des clients et d'un taux d'amélioration rapide. De plus, les SRE garderont un œil toujours vigilant sur la capacité et la performance de nos systèmes.

Une grande partie de notre développement logiciel se concentre sur l'optimisation des systèmes existants, la construction d'infrastructures et l'élimination du travail par l'automatisation. Au sein de l'équipe SRE, vous aurez l'opportunité de gérer les défis complexes de l'échelle qui sont uniques à Google Cloud, tout en utilisant votre expertise en codage, algorithmes, analyse de complexité et conception de systèmes à grande échelle. La culture du SRE, basée sur la curiosité intellectuelle, la résolution de problèmes et l'ouverture, est la clé de son succès. Notre organisation réunit des personnes ayant des parcours, des expériences et des perspectives très variés. Nous les encourageons à collaborer, à voir grand et à prendre des risques dans un environnement sans recherche de coupable. Nous promouvons l'autonomie pour travailler sur des projets significatifs, tout en nous efforçant de créer un environnement qui fournit le soutien et le mentorat nécessaires pour apprendre et grandir.

Dans ce rôle, vous ferez partie de l'équipe responsable de la recherche de moyens d'améliorer la fiabilité, l'évolutivité et l'efficacité de ces systèmes et d'autres systèmes que des milliards de personnes à travers le monde utilisent chaque jour et qui améliorent leur vie.

Derrière tout ce que nos utilisateurs voient en ligne se trouve l'architecture construite par l'équipe Technical Infrastructure pour assurer son fonctionnement. Du développement et de la maintenance de nos centres de données à la construction de la prochaine génération de plateformes Google, nous rendons possible le portefeuille de produits de Google. Nous sommes fiers d'être les ingénieurs de nos ingénieurs et adorons annuler les garanties en démontant les choses pour pouvoir les reconstruire. Nous maintenons nos réseaux opérationnels, garantissant à nos utilisateurs l'expérience la meilleure et la plus rapide possible.

Responsabilités ###

  • S'impliquer dans et améliorer l'ensemble du cycle de vie des services — de la conception et la création jusqu'au déploiement, l'exploitation et l'affinement.
  • Soutenir les services avant leur mise en service par des activités telles que le conseil en conception de systèmes, le développement de plateformes et de frameworks logiciels, la planification de la capacité et les revues de lancement.
  • Maintenir les services une fois qu'ils sont en ligne en mesurant et en surveillant la disponibilité, la latence et la santé globale du système.
  • Faire évoluer les systèmes de manière durable grâce à des mécanismes tels que l'automatisation, et faire évoluer les systèmes en poussant des changements qui améliorent la fiabilité et la vélocité.
  • Pratiquer une réponse aux incidents durable et des post-mortems sans recherche de coupable.

Traduit automatiquement depuis l’original.

Publié il y a 2 jours

Lieu

Voir sur Google Maps