Décryptage du poste par Postule AI
Décryptage du poste par Postule AI
Généré automatiquement par Postule AI à partir de l’offre.
À propos du rôle
L'Ingénieur AI/ML transforme les modèles expérimentaux en services IA robustes, scalables et maintenables. Ce rôle couvre la conception des pipelines de données et d'entraînement, le déploiement des APIs d'inférence ainsi que la mise en place du monitoring. L'environnement technique repose principalement sur des infrastructures de type VMs (cloud souverain) et Azure, avec Docker, GitLab CI/CD, FastAPI et vLLM comme briques centrales.
Missions et responsabilités
- Conception et maintenance des pipelines CI/CD ML (entraînement, évaluation, déploiement)
- Déploiement des modèles en production via FastAPI, conteneurisés sous Docker
- Déploiement et exploitation de LLMs open-source via vLLM sur des infrastructures dédiées
- Mise en place du monitoring des modèles (drift des données et des performances, alerting)
- Optimisation des modèles afin de réduire la latence et les coûts (ONNX, quantisation, batching)
- Gestion des environnements cloud : VMs souveraines et Azure ML selon les projets
Outils et technologies
- Python
- Docker et Kubernetes
- GitLab CI/CD
- FastAPI et vLLM
- MLflow et Azure ML
- ONNX, Prometheus et Grafana
Cette description d'emploi a pu être reformatée par Postule pour améliorer sa lisibilité et sa présentation. Le contenu et les informations restent fidèles à l'offre d'emploi originale. .
