Job description
Stellar Technologies, leader innovant dans les solutions d’intelligence artificielle pour les entreprises, recherche un(e) Ingénieur(e) Machine Learning spécialisé(e) en IA Générative. Vous intégrerez une équipe d’experts passionnés, travaillant à la pointe des technologies LLM, Retrieval‑Augmented Generation (RAG) et des cadres d’IA agentique (LangChain, LangGraph, Semantic Kernel). Votre mission principale sera de concevoir, développer et mettre en production des pipelines d’IA capables de répondre aux exigences de performance, de scalabilité et de sécurité des clients grands comptes.
**Ce que vous ferez au quotidien**
- Concevoir et optimiser des modèles de langage de grande taille (LLM) et des architectures RAG pour fournir des réponses précises et contextuelles.
- Développer des agents intelligents en s’appuyant sur des frameworks tels que LangChain, LangGraph ou Semantic Kernel, afin d’automatiser des processus métiers complexes.
- Construire des pipelines de données end‑to‑end (pré‑traitement, entraînement, évaluation, versionning) automatisés avec des outils CI/CD (GitHub Actions, Azure DevOps).
- Déployer les modèles en production via des conteneurs Docker orchestrés par Kubernetes et Azure Machine Learning, garantissant une latence d’inférence minimale et un coût maîtrisé.
- Concevoir et maintenir des API REST/GraphQL (FastAPI, Flask) et des services de streaming (Kafka, Azure Event Hubs) pour intégrer les modèles aux plateformes front‑end, aux outils d’analyse et aux workflows d’automatisation.
- Mettre en place des mécanismes de gouvernance, de conformité et de sécurité (RGPD, ISO‑27001) autour des charges de travail IA.
- Surveiller les systèmes en production grâce à des solutions d’observabilité (Prometheus, Grafana, OpenTelemetry) et intervenir rapidement en cas d’anomalies.
- Participer aux revues d’architecture, aux ateliers de design et aux sessions de partage de connaissances avec les data scientists, les ingénieurs cloud et les chefs de produit.
**Profil recherché**
Vous justifiez d’au moins 5 ans d’expérience en ingénierie ML, avec une expertise avérée sur les LLM, le RAG et les frameworks d’IA agentique. Vous maîtrisez Python et les bibliothèques PyTorch, TensorFlow, scikit‑learn ainsi que Hugging Face Transformers. Vous avez déjà déployé des modèles en production sur des environnements cloud (Azure, AWS ou GCP) et vous êtes à l’aise avec Docker, Kubernetes et les pipelines CI/CD. Vous avez une bonne connaissance des architectures micro‑services, des API FastAPI/Flask et des systèmes de streaming temps réel. Vous êtes rigoureux(se) sur les aspects sécurité, observabilité et optimisation des coûts.
**Ce que nous offrons**
- Un environnement de travail hybride (bureau à Casablanca + télétravail) dans des locaux modernes et collaboratifs.
- Un package salarial attractif avec bonus annuel lié aux performances.
- Des opportunités de formation continue (certifications Azure, cours spécialisés IA, conférences internationales).
- Un accès à des ressources de calcul de pointe (GPU, TPUs) pour vos expérimentations.
- Une culture d’entreprise basée sur l’innovation, la transparence et le partage des connaissances.
- Des tickets restaurant, une mutuelle santé premium et un programme de bien‑être au travail.
Rejoignez Stellar Technologies et participez à la construction de la prochaine génération d’applications IA qui transformeront les entreprises à l’échelle mondiale.