Senior Platform Architect
- Tipo di contratto
- Tempo pieno
- Luogo
- Zürich · Telelavoro possibile
- Prima pubblicazione
Chi siamo
Axelera AI https://www.axelera.ai non è la solita startup deep-tech. Stiamo creando la piattaforma AI di prossima generazione per supportare chiunque voglia contribuire al progresso dell'umanità e migliorare il mondo che ci circonda.
In soli quattro anni, abbiamo raccolto un totale di $370 milioni e costruito un team di livello mondiale di oltre 220 dipendenti (inclusi oltre 49 PhD con più di 40.000 citazioni), sia da remoto da 18 paesi diversi che con uffici in Belgio, Francia, Svizzera, Italia, UK, con sede presso l'High Tech Campus di Eindhoven, Paesi Bassi.
Haiamo anche lanciato la nostra Metis™ AI Platform, che raggiunge un aumento di efficienza e prestazioni di 3-5x, e abbiamo visibilità su una solida pipeline commerciale che supera i $100 milioni.
Il nostro incrollabile impegno per l'innovazione ci ha consolidati come pionieri globali del settore.
Sei pronto alla sfida?
Panoramica della posizione
Cerchiamo un Senior Platform Architect che si occupi dell'architettura a livello di piattaforma per i nostri sistemi acceleratori AI per datacenter — dal server all'integrazione del rack e, infine, al deployment completo nel datacenter.
Il ruolo si colloca all'interno del team System Architecture e segna la nostra espansione dall'edge AI al datacenter. Prenderai i requisiti di calcolo, memoria e connettività definiti dal team System Architecture più ampio e li tradurrai in requisiti architettonici sulle nostre piattaforme hardware. Ti occuperai di come gli acceleratori vengono composti in sistemi per eseguire i carichi di lavoro in modo efficace, definendo la topologia di sistema, l'integrazione dell'host, l'organizzazione della memoria e i requisiti a livello di piattaforma per ottenere prestazioni, scalabilità e operabilità.
Il ruolo è principalmente in stretta collaborazione con la divisione AI Infrastructure Systems (AIIS) che costruisce i nostri prodotti a livello di scheda e di sistema, nonché con le divisioni silicon e software. Infine, sarai impegnato con clienti strategici e partner dell'ecosistema sui requisiti di architettura e sull'allineamento tecnico.
Responsabilità chiave:
- Definire l'architettura a livello di piattaforma per i nostri sistemi acceleratori AI per datacenter, che comprenda la progettazione della scheda server, l'integrazione del rack e il deployment a livello di datacenter.
- Tradurre i requisiti di calcolo, memoria e interconnessione a livello di sistema — definiti in collaborazione con il team System Architecture più ampio e la divisione prodotto — in specifiche concrete per la piattaforma hardware.
- Specificare l'infrastruttura di interconnessione fisica — definendo i requisiti architettonici e i compromessi che la divisione AI Infrastructure Systems esegue, inclusi il modo in cui le caratteristiche dell'interconnessione influenzano le prestazioni del carico di lavoro a livello di sistema.
- Definire l'integrazione e l'organizzazione di host, storage e networking a livello hardware, coprendo PCIe e CXL, così come il budgeting energetico a livello di sistema.
- Garantire che i design scale-up e scale-out mantengano le prestazioni target man mano che i sistemi passano dai singoli nodi ai grandi cluster.
- Definire i requisiti di operabilità e RAS (affidabilità, disponibilità, manutenibilità) attraverso l'architettura di ridondanza, la capacità hot-swap, la telemetria e le interfacce di gestione (BMC/IPMI/Redfish), e il contenimento dei guasti per garantire che le piattaforme siano gestibili e affidabili in produzione.
- Assumere un ruolo tecnico di leadership nel team di architettura di sistema, interfacciandosi direttamente con partner chiave e stakeholder interni per allineare le decisioni architettoniche, inclusa la divisione AI Infrastructure Systems, il silicon, il product management, il software e i clienti, gli integratori di sistema e i partner dell'ecosistema sui requisiti di architettura — con l'impegno commerciale e la proprietà del design in capo al Direttore AIIS.
- Guidare la metodologia e le best practice per il design a livello di piattaforma man mano che il team cresce.
Qualifiche:
- Esperienza: Esperienza significativa (5+ anni) in architettura di sistema, piattaforma o hardware, con un solido track record su scala server e/o rack.
- Conoscenze fondamentali: Progettazione di sistemi scale-up e scale-out, mappatura dei carichi di lavoro distribuiti, partizionamento funzionale e architettura di interconnessione/fabric.
- Fabric e interconnessione: Profonda comprensione pratica di Ethernet, UALink, tecnologie ottiche e switched-fabric, e la capacità di ragionare sui relativi compromessi prestazionali a livello di sistema.
- Pensiero sistemico: Capacità di collegare le caratteristiche del carico di lavoro all'architettura hardware e di quantificare l'impatto delle scelte di design sulle prestazioni end-to-end.
- Leadership e collaborazione: Dimostrata capacità di guidare e collaborare in team multidisciplinari e di interfacciarsi efficacemente con partner e stakeholder senior.
- Bonus: Esperienza nell'architettura di sistemi acceleratori AI/HPC, familiarità con i carichi di lavoro di training/inference distribuiti ed esperienza con il deployment su scala data-center.
- Forti capacità di problem-solving, mentalità collaborativa e passione per la costruzione di sistemi su scala.
Sede
Offriamo una modalità di lavoro flessibile, con opzioni per:
- Lavorare in uno degli uffici di Axelera AI (Leuven in Belgio, Amsterdam ed Eindhoven nei Paesi Bassi, Zurigo in Svizzera, Firenze e Milano in Italia o Bristol nel Regno Unito) se ti trovi già nelle vicinanze.
- Lavorare interamente da remoto da qualsiasi paese europeo (incluso il Regno Unito) in cui ti trovi già.
- Trasferirti con noi e lavorare dall'Italia (Firenze o Milano) o dai Paesi Bassi (Amsterdam o Eindhoven).
Si prega di notare che la priorità sarà data ai candidati che [sono interessati a essere] basati in Belgio o in Italia.
Tradotto automaticamente dall’originale.
Pubblicato 6 settimane fa