AccueilOffres › Ingénieur Portage Modèles NN (H/F)

Ingénieur Portage Modèles NN (H/F)

Mercato de l'emploi — Meudon (92)

Publiée le 07/08/2026 · Offre active, sourcée auprès d'un partenaire officiel

CDI 💶 Annuel de 50000.0 Euros à 75000.0 Euros Débutant accepté

RESPONSABILITÉS :

Nous recherchons un Ingénieur Compilateur IA & Activation de Modèles pour assurer la qualification, la validation et l'amélioration continue de la toolchain de compilation de modèles Vsora. Le rôle porte sur la compilation et la validation d'une large gamme de modèles IA de référence et clients, garantissant la correction fonctionnelle, la précision numérique, la robustesse du compilateur et une exécution optimale sur le matériel Vsora.

Responsabilités principales :
- Compiler des modèles de référence et clients via la toolchain Vsora et vérifier leur déploiement réussi sur le matériel cible.
- Identifier, reproduire et déboguer les échecs de compilation, problèmes de conversion de graphes, opérateurs non supportés, divergences numériques et problèmes d'exécution runtime.
- Valider la précision numérique en comparant les outputs de modèles compilés aux résultats de frameworks de référence et aux datasets golden.
- Mesurer et analyser l'impact sur la précision résultant de la quantification et des optimisations du compilateur, en identifiant les couches, opérateurs ou architectures particulièrement sensibles à la précision réduite.
- Travailler en étroite collaboration avec les développeurs de l'équipe IA pour isoler les causes racines, prioriser les correctifs, valider les améliorations et élargir la couverture de modèles.
- Développer des frameworks de régression automatisés pour la validation continue de la fonctionnalité du compilateur, de la compatibilité des modèles, de la précision et des performances.

PROFIL RECHERCHÉ :

- Formation supérieure en informatique, mathématiques appliquées, data science ou domaine équivalent.
- Solides compétences en programmation avec Python et/ou C++
- Expérience significative dans l'écosystème de l'intelligence artificielle, notamment avec les frameworks de machine learning tels que PyTorch, TensorFlow, ONNX, JAX ou équivalents.
- Maîtrise des toolchains de déploiement de modèles, pipelines de conversion, frameworks d'optimisation de graphes ou compilateurs IA.
- Bonne connaissance des outils et environnements tels qu'ONNX Runtime, TensorRT, OpenVINO ou autres solutions similaires pour l'exécution et l'optimisation de modèles.
- Solide compréhension des concepts fondamentaux des réseaux de neurones (architectures, graphes de calcul, conception d'opérateurs, exécution d'inférence).
- Une expérience ou une familiarité avec les accélérateurs matériels spécialisés (NPU, GPU ou architectures sur-mesure) constitue un réel atout.
- Esprit d'analyse, rigueur scientifique, capacité à travailler sur des problématiques complexes et à s'adapter aux évolutions rapides du secteur de l'IA.
- Autonomie, sens du travail en équipe et bonne communication technique pour collaborer avec différents profils (développeurs, chercheurs, ingénieurs systèmes).

Ce profil s'adresse aux ingénieurs passionnés par l'optimisation, le déploiement et la portabilité des modèles de réseaux de neurones, souhaitant évoluer sur des projets à la pointe de la technologie.

Voir l'offre et postuler — entrez votre email. Gratuit pour les diplômé(e)s et étudiant(e)s du Groupe ECL, première offre débloquée pour tout le monde.

Entreprise ? Confiez-nous un mandat →

🔔 Ne ratez pas la prochaine. Recevez par email les nouvelles offres « Ingénieur » à Meudon dès leur publication — 1 email/jour max, désinscription en 1 clic, adresse jamais revendue.