Concierge RAG
- Problème
- Les opérations clients étaient le goulot d'étranglement. Chaque question entrante imposait une recherche manuelle dans des documents éparpillés, d'anciens tickets et des tableaux de bord. Latence élevée, débit stagnant, aucune marge pour passer à l'échelle par le recrutement.
- Réalisation
- Concierge RAG de bout en bout : pipeline d'ingestion de documents, récupération vectorielle sur la base de connaissances interne, réponses LLM ancrées dans les sources avec citations en ligne, garde-fous de coût et de sécurité, et un harnais d'évaluation suivant la fidélité des réponses, la couverture des citations et la dérive à mesure que le contenu changeait.
- Résultat
- Débit opérationnel doublé sans renfort d'effectifs. La latence des requêtes est passée de plusieurs minutes de recherche manuelle à une récupération en moins d'une seconde. Toujours en production, dans le budget, dans les SLO.