Contexte client
Notre client est un grand groupe international du secteur de l'hospitality, engagé dans une transformation digitale d'ampleur au service de la personnalisation de l'expérience client, de la fidélisation et de l'excellence opérationnelle sur l'ensemble de son réseau. Dans ce cadre, l'organisation a fait le choix d'intégrer des briques d'intelligence artificielle générative au cœur de ses processus métier, de la relation client à la gestion des opérations, afin de gagner en réactivité et en efficacité opérationnelle.
L'entité interne en charge de la donnée et de l'intelligence artificielle porte depuis près de deux ans la construction des capacités d'IA générative du groupe. Après une première phase de preuve de concept centrée sur la recherche augmentée par le contexte documentaire, ces capacités sont désormais industrialisées et exploitées en production, sur la base d'une infrastructure éprouvée (pipelines, infrastructure as code, forte disponibilité de service) et d'une architecture volontairement modulaire et abstraite, pensée pour rester agnostique vis-à-vis des fournisseurs de modèles.
L'organisation ouvre aujourd'hui un périmètre porté sur AWS et souhaite renforcer son équipe pour en accélérer la construction et la mise en production. Les chantiers prioritaires portent sur le service de RAG mutualisé, sur le déploiement d'agents autonomes au service de l'automatisation des processus métier, et sur l'ensemble de la chaîne d'industrialisation qui en découle : déploiement continu, observabilité, évaluation de la qualité et maîtrise des coûts d'inférence.
Contexte de la mission
La plateforme cible centralise l'accès à l'information et aux capacités d'IA de l'entreprise autour d'un principe de source unique de vérité : quel que soit le point d'entrée, l'utilisateur retrouve le même niveau d'information et de fonctionnalité. Elle s'appuie sur une couche d'abstraction des modèles, un service de RAG mutualisé consommable par de multiples agents, un catalogue de connecteurs exposant les systèmes de l'entreprise, ainsi qu'une bibliothèque d'agents préconçus organisés par communautés métier.
Le consultant interviendra sur la conception, le développement et l'industrialisation de ces composants dans l'écosystème AWS. Trois chantiers structurent la mission : la construction et l'optimisation du service de RAG (ingestion et découpage documentaire, vectorisation, recherche hybride, reclassement, évaluation de la pertinence des réponses) ; la conception d'agents autonomes capables d'appeler des outils, de s'enchaîner et de s'exécuter en tâches planifiées, avec la gestion fine des accès et la propagation de l'identité de l'utilisateur jusqu'aux données ; et la mise en production de l'ensemble, avec tout ce qu'elle suppose en matière de déploiement continu, de supervision, de sécurité, de résilience et de maîtrise des coûts.
La mission s'inscrit résolument dans une logique de delivery : il ne s'agit pas de produire des démonstrateurs, mais de livrer des services exploités en production, mesurés et maintenus dans la durée. Le consultant sera donc attendu autant sur la qualité de la conception que sur la robustesse opérationnelle de ce qu'il déploie.
Au-delà de la dimension purement technique, la mission comporte une composante d'interface entre les équipes métier et la technologie. Le client recherche un profil capable non seulement de contribuer au code et à la plateforme, mais aussi de comprendre le besoin métier, de vulgariser les capacités de l'IA auprès d'interlocuteurs non techniques et de faire le lien entre les usages attendus et les solutions déployées.
Objectifs de mission
La mission vise à renforcer l'équipe plateforme afin d'accélérer la construction, l'industrialisation et l'adoption des solutions d'IA générative sur le périmètre AWS. Les principaux objectifs sont les suivants :
L'ensemble s'inscrit dans une logique de delivery, avec une exigence forte de qualité, de sécurité et de maintenabilité.
Périmètre de la mission et Responsabilité du Consultant
Périmètre de la mission
Le périmètre d'intervention couvre l'ensemble de la chaîne de développement et d'exploitation des services d'IA générative de la plateforme :
Responsabilité du Consultant
Le consultant sera responsable de la qualité, de la robustesse et de la bonne exploitation des composants qu'il conçoit et opère, dans le respect des standards de l'entreprise :
Profil du consultant recherché
Nous recherchons un ingénieur en IA générative confirmé, à la fois solide sur le plan technique et à l'aise dans la relation avec les métiers. Le profil idéal conjugue une véritable culture d'ingénierie logicielle (back end, industrialisation) et la capacité à faire le lien entre le besoin métier et la solution technique, dans un environnement AWS et un mode de fonctionnement autonome. L'expérience concrète de la mise en production de services d'IA générative constitue le critère discriminant de ce recrutement : le client attend un profil ayant déjà exploité, mesuré et fiabilisé ce type de service au-delà de la phase de prototypage.
Formation recherchée :
Expérience requise :
Compétences techniques :
Langues :
Certifications (pas obligatoire mais clairement un atout) :