Staff/Principal Software Engineer – AI Applications
- Tipo di contratto
- Tempo pieno
- Luogo
- Zürich
- Prima pubblicazione
About Us
Axelera AI (https://www.axelera.ai) non è la tua solita azienda deep-tech. Stiamo creando la piattaforma AI di prossima generazione per supportare chiunque voglia contribuire all'avanzamento dell'umanità e migliorare il mondo che ci circonda.
In soli cinque anni, abbiamo raccolto un totale di $450 milioni e costruito un team di livello mondiale composto da oltre 250 dipendenti (inclusi oltre 60 PhD con più di 40.000 citazioni), sia da remoto da 20 paesi diversi che con uffici in Belgio, Francia, Svizzera, Italia, UK, con sede principale presso l'High Tech Campus di Eindhoven, Paesi Bassi.
Abbiamo anche lanciato la nostra Metis™ AI Platform, che raggiunge un incremento di 3-5x in efficienza e prestazioni, e abbiamo visibilità su una forte pipeline commerciale che supera i $100 milioni.
Il nostro incrollabile impegno per l'innovazione ci ha affermato con decisione come pionieri globali del settore.
Sei pronto alla sfida?
Position Overview
Il team Applications sviluppa i componenti rivolti al cliente del Voyager SDK di Axelera AI, inclusi il deployment di modelli low-code, lo sviluppo di pipeline end-to-end e l'integrazione e l'analisi delle applicazioni. I clienti utilizzano questi strumenti per valutare rapidamente, prototipare e costruire complete soluzioni AI di produzione accelerate dai dispositivi Axelera AI. Il team Applications sviluppa strumenti di sviluppo all'avanguardia con API semplici che garantiscono che le soluzioni distribuite dai nostri clienti raggiungano i massimi livelli di prestazioni e accuratezza disponibili sul mercato.
Cerchiamo un software engineer esperto e tecnicamente eccezionale che si assuma la responsabilità di un'area significativa dello stack Applications. Questo è un ruolo di livello Staff/Principal per qualcuno che sappia identificare ed eseguire opportunità che richiedono un forte giudizio tecnico e difficili prioritizzazioni, spingere i confini di ciò che è tecnicamente realizzabile e creare architetture riutilizzabili che alzino l'asticella per l'intero team. Opererai con una significativa autonomia, navigando nell'ambiguità dove non esistono ancora playbook chiari – che si tratti di compilare rappresentazioni grafiche di alto livello di pipeline basate su ML, ottimizzare l'uso della memoria e la sincronizzazione su target hardware eterogenei, o progettare implementazioni di basso livello di operatori di computer vision per elementi di elaborazione specializzati – e aiuterai a dare forma alla roadmap tecnica per il team Applications in partnership con gli stakeholder commerciali e di prodotto.
Key responsibilities:
- Gestire la strategia tecnica end-to-end per una sezione principale dello strato applicativo del Voyager SDK – traducendo paper di ricerca, repository open-source e requisiti di prodotto in una roadmap coerente per il deployment dei modelli, lo sviluppo di pipeline e l'integrazione delle applicazioni
- Stabilire la direzione tecnica per gli operatori di pre/post-processing delle immagini e i decoder, creando architetture riutilizzabili che alzino l'asticella per il resto del team, e collaborare con il team compiler per risolvere i problemi di compilazione più difficili
- Guidare l'integrazione di framework di modelli standard del settore nel SDK, definendo librerie e architetture riutilizzabili utilizzate dal team e dai clienti per il deployment low-code e no-code di modelli e dataset
- Definire le rappresentazioni dei metadati a livello aziendale per tipi di modelli comuni (come bounding boxes e keypoints), e gestire le librerie utilizzate in tutto il team per valutare l'accuratezza dei modelli distribuiti e renderizzare visivamente i risultati dell'inferenza sull'hardware Axelera AI
- Assumersi la responsabilità della latenza e del throughput end-to-end della pipeline su tutte le piattaforme hardware supportate, individuando le cause principali dei colli di bottiglia più difficili e costruendo strumenti e framework di profiling che alzino l'asticella per il modo in cui il team e i clienti diagnosticano i problemi di prestazione
- Rappresentare le capacità tecniche del team Applications agli stakeholder aziendali e, dove pertinente, ai clienti e al settore; fare mentoring e sviluppare altri ingegneri; e guidare gli standard di documentazione e le best practice in tutto il team
Qualifications:
- BS/MS in Computer Science, Electrical Engineering o equivalente, con una solida esperienza (tipicamente 8+ anni) pratica nel settore dei semiconduttori e/o dell'AI
- Profonda esperienza pratica con framework di edge deployment come OpenVINO o TensorRT, con una dimostrata capacità di risolvere problemi di significativa difficoltà tecnica in questo ambito
- Esperienza con API di calcolo GPU come OpenCL e Vulkan
- Solida esperienza nell'applicazione di tecniche di ottimizzazione dei modelli come quantizzazione, compressione e pruning
- Competenza di livello esperto nello sviluppo di applicazioni AI utilizzando Python, con ampia esperienza in librerie ML come PyTorch e TensorFlow
- Competenza di livello esperto in Python/C++
- Dimostrata capacità di progettare, costruire e distribuire pipeline end-to-end con modelli quantizzati su larga scala, e di creare framework riutilizzabili su cui altri possano costruire
- Esperienza nell'addestramento di modelli utilizzando il transfer learning per sfruttare modelli pre-addestrati per nuovi task
- Esperienza con MLIR e ONNXRuntime è un plus
- Una comprovata capacità di navigare in situazioni di profonda ambiguità e fornire risultati senza playbook chiari, esercitando un sano giudizio tecnico sotto pressione su problemi complessi e multidimensionali
- Forti capacità di comunicazione e influenza, con esperienza nel gestire conversazioni ad alto rischio con stakeholder tecnici e aziendali senior, e nel rappresentare il lavoro tecnico esternamente ai clienti o al settore
- Esperienza nel fare mentoring e sviluppare altri ingegneri, e nell'alzare l'asticella tecnica per un team
- Competenze Lin
Tradotto automaticamente dall’originale.
Pubblicato 3 giorni fa