Chunking (RAG)
Att dela upp dokument i mindre bitar ("chunks") innan de embeddas och indexeras för RAG. Chunk-storleken är en av de mest avgörande — och kluriga — designvalen: för stora bitar utvattnar relevansen, för små tappar sammanhang.
Avvägning: en stor chunk ger mer kontext men en suddigare embedding (många ämnen i en vektor → sämre matchning); en liten chunk ger skarp matchning men kan sakna det omgivande sammanhang som behövs för att svara. Vanliga strategier: fast storlek med överlapp (enkelt), efter struktur (stycke/rubrik/Markdown-sektion), eller semantisk chunking (dela där ämnet skiftar). Överlapp mellan chunks gör att en mening på en gräns inte tappas. Avancerat: sentence-window och parent-document-retrieval hämtar en liten chunk men ger modellen ett större fönster runt den. Fel chunking är den vanligaste orsaken till dålig RAG-kvalitet. Hör ihop med semantic chunking och RAG.