Was ist ein Problem bei der reinen semantischen Suche in RAG-Pipelines?	Sie kann irrelevante Ergebnisse liefern, die oberflächlich ähnlich sind, aber den spezifischen Kontext nicht treffen.
Wie kann die Genauigkeit der RAG-Suche verbessert werden?	Durch die Kombination von semantischer Suche und lexikalischer Suche.
Was versteht man unter lexikalischer Suche?	Eine klassische Textsuche, die die Suchanfrage in einzelne Wörter (Tokens) zerlegt.
Welches Algorithmus wird zur Implementierung der lexikalen Suche in RAG-Pipelines häufig verwendet?	BM25 (Best Match 25).
Was ist der erste Schritt im BM25-Algorithmus?	Die Tokenisierung der Suchanfrage (Zerlegung in einzelne Wörter und Entfernen von Satzzeichen).
Wie wird die relative Wichtigkeit eines Terms im BM25-Algorithmus bestimmt?	Basierend auf der Häufigkeit (Frequenz) des Terms in den Dokumenten; seltene Begriffe erhalten eine höhere Gewichtung.
Was ist das Ziel des letzten Schrittes im BM25-Algorithmus?	Den Textabschnitt (Chunk) finden, der die am häufigsten vorkommenden hoch gewichteten Begriffe enthält.
Was ist der nächste Schritt nach der Implementierung beider Suchsysteme (semantisch und lexikal)?	Das Zusammenführen (Merging) der Ergebnisse beider Systeme.
