Module
Module 3 sur 6Leçon 2 sur 2~16 min

Comprendre les embeddings et la recherche sémantique

Comprendre la recherche sémantique aide le PM à prévoir quelles questions l'assistant réussira et lesquelles il ratera. Sans formule, la leçon explique comment les embeddings rapprochent des textes par le sens, quels réglages relèvent d'une décision produit et quelles faiblesses anticiper dans les specs.

Objectif de la leçon

À la fin de cette leçon, vous serez capable d'expliquer comment une recherche sémantique retrouve des passages, de lister les décisions produit qu'elle implique (modèle, nombre de passages, seuil de pertinence) et d'anticiper ses points faibles.

Thèmes abordés

  • embeddings
  • recherche sémantique
  • base vectorielle
  • seuil de pertinence

Dans quel module

Découper et indexer

Comment les documents deviennent-ils des passages que la recherche peut retrouver ?

Leçons du module

  1. Choisir une stratégie de découpage
  2. Comprendre les embeddings et la recherche sémantique (cette leçon)

Ce que vous apprendrez dans la formation

Cette leçon fait partie de la formation Concevoir une architecture RAG adaptée à son produit

  • Choisir, pour un besoin d'information, entre contexte long, données injectées par l'application, RAG et fine-tuning, et justifier le choix par le volume, la fréquence de mise à jour, les droits et le coût.
  • Spécifier l'inventaire des sources, les exclusions, les métadonnées à capturer et la stratégie de découpage des documents.
  • Concevoir la recherche : recherche sémantique, par mots-clés ou hybride, reranking, contextual retrieval, nombre de passages et seuil de pertinence.
  • Spécifier la réponse ancrée dans les sources, l'affichage des citations, la gestion des sources contradictoires et le comportement quand rien n'est trouvé.
  • Spécifier le filtrage par droits avant que le modèle ne lise un passage, et la fraîcheur de l'index (resynchronisation, suppressions, versions).
  • Construire un jeu de 30 questions de test couvrant les modes d'échec d'un RAG et diagnostiquer l'étape responsable d'une mauvaise réponse.
  • Estimer les postes de coût d'un RAG et arbitrer entre outil hébergé, base de connaissances gérée, base vectorielle et développement sur mesure.