Senior Platform Architect
- Type de contrat
- Temps plein
- Lieu
- Zürich · Télétravail possible
- Première publication
À propos de nous
Axelera AI https://www.axelera.ai n'est pas une startup deep-tech ordinaire. Nous créons la plateforme d'IA de nouvelle génération pour soutenir tous ceux qui veulent aider à faire progresser l'humanité et améliorer le monde qui nous entoure.
En seulement quatre ans, nous avons levé un total de $370 million et avons constitué une équipe de classe mondiale de plus de 220 employés (dont plus de 49 PhD avec plus de 40,000 citations), à la fois à distance depuis 18 pays différents et avec des bureaux en Belgique, France, Suisse, Italie, UK, avec le siège social au High Tech Campus à Eindhoven, Netherlands.
Nous avons également lancé notre Metis™ AI Platform, qui permet d'augmenter l'efficacité et la performance de 3-5x, et nous avons une visibilité sur un solide pipeline commercial dépassant $100 million.
Notre engagement indéfectible envers l'innovation nous a fermement établis comme un pionnier mondial de l'industrie.
Êtes-vous prêt pour le défi ?
Aperçu du poste
Nous recherchons un Senior Platform Architect pour être responsable de l'architecture au niveau plateforme de nos systèmes d'accélérateurs d'IA pour centres de données — du serveur à l'intégration en rack et, finalement, au déploiement complet en centre de données.
Le rôle est au sein de l'équipe System Architecture, et marque notre expansion de l'IA edge vers le centre de données. Vous prendrez les exigences de calcul, de mémoire et de connectivité définies par l'équipe System Architecture élargie et les traduirez en exigences architecturales sur nos plateformes matérielles. Vous serez responsable de la manière dont les accélérateurs sont composés en systèmes pour exécuter efficacement les charges de travail, en définissant la topologie du système, l'intégration de l'hôte, l'organisation de la mémoire et les exigences au niveau de la plateforme pour atteindre la performance, l'évolutivité et l'opérabilité.
Le rôle se situe principalement en étroite collaboration avec la division AI Infrastructure Systems (AIIS) qui construit nos produits au niveau de la carte et du système, ainsi qu'avec les divisions silicium et logiciel. Enfin, vous serez engagé auprès de clients stratégiques et de partenaires de l'écosystème sur les exigences d'architecture et l'alignement technique.
Responsabilités clés :
- Définir l'architecture au niveau plateforme pour nos systèmes d'accélérateurs d'IA pour centres de données, couvrant la conception de cartes serveurs, l'intégration en rack et le déploiement au niveau du centre de données.
- Traduire les exigences de calcul, de mémoire et d'interconnexion au niveau système — définies en collaboration avec l'équipe System Architecture élargie et la division produit — en spécifications concrètes de plateforme matérielle.
- Spécifier l'infrastructure d'interconnexion physique — en définissant les exigences architecturales et les compromis sur lesquels la division AI Infrastructure Systems exécute, y compris l'impact des caractéristiques d'interconnexion sur la performance des charges de travail au niveau système.
- Définir l'intégration et l'organisation de l'hôte, du stockage et du réseau au niveau matériel, couvrant PCIe et CXL, ainsi que le budget de puissance au niveau système.
- Garantir que les conceptions scale-up et scale-out soutiennent les performances cibles à mesure que les systèmes passent de nœuds uniques à de grands clusters.
- Définir les exigences d'opérabilité et de RAS (fiabilité, disponibilité, maintenabilité) à travers l'architecture de redondance, la capacité hot-swap, la télémétrie et les interfaces de gestion (BMC/IPMI/Redfish), et le confinement des fautes pour garantir que les plateformes sont gérables et fiables en production.
- Assumer un rôle technique de premier plan dans l'équipe d'architecture système, en assurant l'interface directe avec les partenaires clés et les parties prenantes internes pour aligner les décisions d'architecture, incluant la division AI Infrastructure Systems, le silicium, la gestion de produit, le logiciel, ainsi que les clients, les intégrateurs de systèmes et les partenaires de l'écosystème sur les exigences d'architecture — l'engagement commercial et la propriété de la conception étant assurés par l'AIIS Director.
- Piloter la méthodologie et les meilleures pratiques pour la conception au niveau plateforme à mesure que l'équipe grandit.
Qualifications :
- Expérience : Expérience significative (5+ ans) en architecture de système, de plateforme ou de matériel, avec une solide expérience à l'échelle serveur et/ou rack.
- Connaissances de base : Conception de systèmes scale-up et scale-out, mapping de charges de travail distribuées, partitionnement fonctionnel et architecture d'interconnexion/fabric.
- Fabrics & interconnect : Compréhension approfondie et pratique d'Ethernet, UALink, des technologies optiques et de switched-fabric, et capacité à raisonner sur leurs compromis de performance au niveau système.
- Pensée systémique : Capacité à relier les caractéristiques des charges de travail à l'architecture matérielle et à quantifier l'impact des choix de conception sur la performance de bout en bout.
- Leadership et collaboration : Capacité démontrée à diriger et à collaborer au sein d'équipes multidisciplinaires et à assurer une interface efficace avec les partenaires et les parties prenantes de haut niveau.
- Bonus : Expérience dans l'architecture de systèmes d'accélérateurs AI/HPC, familiarité avec les charges de travail d'entraînement/inférence distribuées, et exposition au déploiement à l'échelle du centre de données.
- Fortes capacités de résolution de problèmes, un esprit collaboratif et une passion pour la construction de systèmes à grande échelle.
Lieu
Nous proposons un arrangement de travail flexible, avec des options pour :
- Travailler dans l'un de nos bureaux Axelera AI (Leuven en Belgique, Amsterdam et Eindhoven aux Netherlands, Zurich en Suisse, Florence et Milan en Itali
Traduit automatiquement depuis l’original.
Publié il y a 6 semaines