softwareengineerjobszurich.ch
← Toutes les offres

Staff/Principal Software Engineer – AI Applications

Axelera

Type de contrat
Temps plein
Lieu
Zürich
Première publication
Postuler

À propos de nous

Axelera AI (https://www.axelera.ai) n'est pas une entreprise de deep-tech ordinaire. Nous créons la plateforme d'IA de nouvelle génération pour soutenir quiconque souhaite aider à faire progresser l'humanité et améliorer le monde qui nous entoure.

En seulement cinq ans, nous avons levé un total de 450 millions de dollars et avons constitué une équipe de classe mondiale de plus de 250 employés (dont plus de 60 doctorants avec plus de 40 000 citations), travaillant à la fois à distance depuis 20 pays différents et avec des bureaux en Belgique, France, Suisse, Italie, Royaume-Uni, avec un siège social au High Tech Campus à Eindhoven, Pays-Bas.

Nous avons également lancé notre plateforme d'IA Metis™, qui permet d'augmenter l'efficacité et les performances de 3 à 5 fois, et bénéficions d'un solide pipeline commercial dépassant les 100 millions de dollars.

Notre engagement indéfectible envers l'innovation nous a solidement établis comme un pionnier mondial de l'industrie.

Êtes-vous prêt pour le défi ?

Aperçu du poste

L'équipe Applications développe les composants orientés client du SDK Voyager d'Axelera AI, y compris le déploiement de modèles low-code, le développement de pipelines de bout en bout ainsi que l'intégration d'applications et l'analytique. Les clients utilisent ces outils pour évaluer, prototyper et construire rapidement des solutions d'IA de production complètes accélérées par les dispositifs Axelera AI. L'équipe Applications développe des outils de développement de pointe avec des API simples qui garantissent que les solutions déployées par nos clients atteignent les niveaux de performance et de précision les plus élevés disponibles sur le marché.

Nous recherchons un ingénieur logiciel expérimenté et techniquement exceptionnel pour prendre la responsabilité d'un domaine important de la pile Applications. Il s'agit d'un rôle de niveau Staff/Principal pour une personne capable d'identifier et d'exécuter des opportunités nécessitant un jugement technique fort et une hiérarchisation difficile, de repousser les limites de ce qui est techniquement réalisable et de créer des architectures réutilisables qui élèvent le niveau de l'ensemble de l'équipe. Vous opérerez avec une autonomie significative, naviguant dans l'ambiguïté là où des guides clairs n'existent pas encore – qu'il s'agisse de compiler des représentations graphiques de haut niveau de pipelines basés sur le ML, d'optimiser l'utilisation de la mémoire et la synchronisation sur des cibles matérielles hétérogènes, ou d'architecturer des implémentations de bas niveau d'opérateurs de vision par ordinateur pour des éléments de traitement spécialisés – et vous aiderez à façonner la feuille de route technique de l'équipe Applications en partenariat avec les parties prenantes commerciales et produit.

Responsabilités clés :

  • Assumer la stratégie technique de bout en bout pour un domaine majeur de la couche applicative du SDK Voyager – traduire des articles de recherche, des dépôts open-source et des exigences produit en une feuille de route cohérente pour le déploiement de modèles, le développement de pipelines et l'intégration d'applications
  • Définir la direction technique pour les opérateurs de pré/post-traitement d'images et les décodeurs, créer des architectures réutilisables qui élèvent le niveau du reste de l'équipe, et collaborer avec l'équipe compilateur pour résoudre les problèmes de compilation les plus difficiles
  • Piloter l'intégration de frameworks de modèles standards de l'industrie dans le SDK, définir des bibliothèques et une architecture réutilisables utilisées par l'équipe et par les clients pour le déploiement de modèles et de jeux de données en low-code et no-code
  • Définir des représentations de métadonnées à l'échelle de l'entreprise pour les types de modèles courants (tels que les boîtes englobantes et les points clés), et gérer les bibliothèques utilisées par toute l'équipe pour évaluer la précision des modèles déployés et rendre visuellement les résultats d'inférence sur le matériel Axelera AI
  • Assumer la responsabilité de la latence et du débit des pipelines de bout en bout sur les plateformes matérielles prises en charge, identifier les causes profondes des goulots d'étranglement les plus difficiles, et construire des outils et des frameworks de profilage qui élèvent le niveau de la façon dont l'équipe et les clients diagnostiquent les problèmes de performance
  • Représenter les capacités techniques de l'équipe Applications auprès des parties prenantes commerciales et, le cas échéant, des clients et de l'industrie ; mentorat et développement d'autres ingénieurs ; et piloter les normes de documentation et les meilleures pratiques au sein de l'équipe

Qualifications :

  • BS/MS en informatique, génie électrique ou équivalent, avec une expérience substantielle (typiquement 8+ ans) de pratique concrète dans l'industrie des semi-conducteurs et/ou de l'IA
  • Expertise pratique approfondie des frameworks de déploiement en périphérie (edge) tels qu'OpenVINO ou TensorRT, avec une capacité démontrée à résoudre des problèmes d'une difficulté technique significative dans ce domaine
  • Expérience avec les API de calcul GPU telles qu'OpenCL et Vulkan
  • Solide expérience dans l'application de techniques d'optimisation de modèles telles que la quantification, la compression et l'élagage (pruning)
  • Maîtrise de niveau expert en développement d'applications d'IA utilisant Python, avec une vaste expérience des bibliothèques ML telles que PyTorch et TensorFlow
  • Maîtrise de niveau expert en Python/C++
  • Capacité démontrée à architecturer, construire et déployer des pipelines de bout en bout avec des modèles quantifiés à grande échelle, et à créer des frameworks réutilisables sur lesquels d'autres peuvent s'appuyer
  • Expérience dans l'entraînement de modèles utilisant l'apprentissage par transfert (transfer learning) pour exploiter des modèles pré-entraînés pour de nouvelles tâches
  • Une expérience av

Traduit automatiquement depuis l’original.

Publié il y a 3 jours

Lieu

Voir sur Google Maps