Les missions du poste

Après la course à l'entraînement des modèles, un nouveau défi s'impose : exécuter l'intelligence artificielle rapidement, efficacement et à grande échelle. Pour répondre à cet enjeu, VSORA, entreprise française de semi-conducteurs fondée en 2015, développe des accélérateurs de calcul dédiés à l'inférence IA.

Basée à Meudon-la-Forêt, VSORA est déjà implantée à Taïwan, en Corée, au Japon et aux États-Unis, et représente aujourd'hui l'unique alternative européenne à NVIDIA et AMD avec une architecture visant des performances plus de 3 fois supérieures par rapport aux solutions existantes.

www.vsora.com
Nous recherchons un(e) Ingénieur HPC hautement qualifié(e) et motivé(e) pour prendre en charge le développement de la stack logicielle IA/HPC pour la famille de puces VSORA. Il s'agit d'un rôle de leadership opérationnel : vous rejoindrez une équipe d'ingénieurs talentueux, piloterez les décisions d'architecture et contribuerez directement à l'implémentation de nouveaux algorithmes pour le système multicoeur VSORA. Vous travaillerez à l'intersection de l'IA et des systèmes HPC, contribuant à façonner l'avenir des charges de travail IA haute performance sur le matériel VSORA.

Missions principales : - Participer à la conception et au développement de la stack d'inférence IA pour la famille de puces VSORA

- Concevoir et implémenter des techniques d'optimisation avancées pour les systèmes multicoeurs

- Collaborer avec les architectes matériel, les équipes frameworks ML et les ingénieurs runtime

- Piloter l'analyse de performance et l'optimisation sur des modèles et benchmarks ML

- Assurer une veille active sur les tendances du calcul IA/HPC, des frameworks ML et de l'accélération matérielle

Le profil recherché

Profil et compétences requis : - Solides compétences en programmation C/C++ et Python

- Maîtrise approfondie du calcul distribué et des pipelines d'implémentation/optimisation HPC

- Expérience pratique avec des bibliothèques mathématiques, d'algèbre linéaire et de traitement du signal (BLAS, LAPACK, FFTW, Eigen...) implémentées pour des systèmes distribués

- Expérience en optimisation des performances et en optimisation système bas niveau

- Bonne connaissance de PyTorch, TensorFlow, ONNX ou d'autres frameworks ML

- Excellentes capacités de communication et de collaboration

Atouts appréciés : - Doctorat en systèmes distribués, HPC ou calcul massivement parallèle

- Expérience avec des architectures NPU, GPU ou autres accélérateurs IA

- Expérience en apprentissage automatique ou en calcul numérique

- Maîtrise des outils de développement logiciel (Git, CI/CD, profileurs, débogueurs)

Ref: w2va7fobf1

Compétences requises

  • Python
  • C++
  • Optimisation des performances
  • Intelligence artificielle
  • Développement logiciel
  • Machine learning
  • Git
  • TensorFlow
  • Analyse de la performance de la promotion
Postuler sur le site du recruteur

Recherches similaires

L’emploi par métier dans le domaine Recherche à Meudon