Responsabilités
- Concevoir, entraîner et déployer des modèles avancés d'apprentissage automatique et de deep learning, notamment en traitement du langage, modèles linguistiques de grande taille et intégrations vectorielles.
- Créer et assurer la maintenance de pipelines fiables pour l'entraînement, l'évaluation et le suivi des modèles, incluant l'intégration continue et la livraison automatisée.
- Concevoir des systèmes RAG complets, incluant l'ingestion de documents, la segmentation stratégique, les embeddings, les bases vectorielles et les mécanismes de récupération et de génération.
- Développer des applications basées sur des modèles linguistiques à grande échelle en utilisant des frameworks comme LangChain ou LangGraph, incluant agents, outils et flux personnalisés.
- Mettre en œuvre des microservices dédiés à l'intelligence artificielle via des API conçues avec FastAPI ou Flask, en assurant leur montée en charge en environnement productif.
- Améliorer les performances d'inférence en réduisant la latence, l'utilisation du GPU, et en optimisant le parallélisme et le traitement par lots.
- Travailler en étroite collaboration avec les équipes en charge des données, du développement et des produits pour industrialiser les solutions IA.
- Surveiller en continu les modèles déployés, notamment pour détecter les dérives de performance, les changements dans les données ou les écarts de fonctionnement.
Mode de travail
Télétravail possible dans 19 pays