Wat zijn de basisstappen van een typische RAG-pipeline?	Documentbron, tekst in chunks verdelen, relevante chunk vinden, en deze in een prompt plaatsen.
Waarom is het proces van het verdelen van een document in chunks cruciaal in een RAG-pipeline?	De manier waarop je chunks maakt, heeft een enorme invloed op de kwaliteit van de RAG-pipeline.
Wat is een risico van het simpel verdelen van een document in chunks?	Het kan leiden tot contextverlies of het onjuist toevoegen van irrelevante context aan de prompt.
Wat houdt 'size-based chunking' in?	Het verdelen van een groot document in strings van ongeveer gelijke lengte.
Wat zijn de standaard instellingen voor chunking in de transcript?	Een chunk lengte van 150 met een overlap van 20.
Welke strategie wordt gebruikt om een tekst op basis van zinnen te splitsen?	Chunk by sentence, waarbij een reguliere expressie wordt gebruikt.
Hoe wordt 'chunk by sentence' standaard geconfigureerd?	Vijf zinnen per chunk met één zin overlap.
Wanneer is de strategie 'chunk by section' het meest effectief?	Bij documenten met een duidelijke en gegarandeerde structuur (bijv. secties, samenvattingen).
Wat is de 'fallback' of betrouwbare standaard strategie als andere methoden falen?	Chunk by character.
Wat is de belangrijkste factor bij het kiezen van een chunking-strategie?	De aard en de structurele garanties van het document.
Waarom kan 'chunk by section' niet werken voor alle documenten?	Als er geen garanties zijn over de opmaak van het document (bijv. door gebruikers).
Waarom kan 'chunk by sentence' problemen opleveren bij bepaalde content?	Bij content zoals code, waar punten op onverwachte plaatsen kunnen voorkomen.
