MODULE 21
Retrieval-Augmented Generation
Chunking, embeddings, vector indexes, hybrid retrieval, reranking and evaluation, through to agentic and graph RAG.
28 lessons~13h reading
- 0124 min
Why RAG Exists
BeginnerComing soonKnowledge cut-offs, hallucination, attribution and cost — the four problems retrieval actually solves.
Assumes: Hallucination
- 0226 min
RAG Architecture
BeginnerComing soonThe full pipeline from query to grounded answer, with the indexing and serving paths separated.
Assumes: Why RAG Exists
- 0328 min
Document Ingestion and Parsing
IntermediateComing soonPDFs, HTML, tables and scanned documents; layout-aware extraction and metadata capture.
Assumes: RAG Architecture
- 0432 min
Chunking Strategies
IntermediateComing soonFixed, recursive, semantic, structural and late chunking; overlap, size selection and the trade-offs.
Assumes: Document Ingestion and Parsing
- 0530 min
Embedding Models
IntermediateComing soonBi-encoders, dimensionality, Matryoshka embeddings, domain fit, and how to benchmark a choice.
Assumes: Chunking Strategies · word2vec: CBOW and Skip-Gram
- 0624 min
Similarity Metrics for Retrieval
IntermediateComing soonCosine, dot product and Euclidean; normalisation effects and metric/model compatibility.
Assumes: Embedding Models
- 0730 min
Vector Index Structures
AdvancedComing soonExact flat search, IVF partitioning, tree and LSH approaches, and the recall/latency frontier.
Assumes: Similarity Metrics for Retrieval
- 0830 min
HNSW
AdvancedComing soonNavigable small-world graphs, the layered skip-list structure, and the M and efSearch parameters.
Assumes: Vector Index Structures
- 0926 min
Product Quantisation
AdvancedComing soonCompressing vectors into codebooks, asymmetric distance computation, and memory/recall trade-offs.
Assumes: HNSW
- 1028 min
Vector Databases
IntermediateComing soonMetadata filtering, hybrid storage, upserts and deletes, multi-tenancy and access control.
Assumes: HNSW
- 1130 min
BM25 and Sparse Retrieval
IntermediateComing soonThe BM25 formula derived and computed by hand, inverted indexes, and where lexical beats semantic.
Assumes: TF-IDF
- 1228 min
Hybrid Search and Fusion
AdvancedComing soonCombining dense and sparse results, reciprocal rank fusion, score normalisation and weighting.
Assumes: BM25 and Sparse Retrieval · Vector Databases
- 1328 min
Query Transformation
AdvancedComing soonRewriting, expansion, decomposition of multi-hop questions, and routing across sources.
Assumes: Hybrid Search and Fusion
- 1424 min
HyDE and Multi-Query Retrieval
AdvancedComing soonHypothetical document embeddings, multi-query generation, and step-back prompting.
Assumes: Query Transformation
- 1528 min
Reranking with Cross-Encoders
AdvancedComing soonWhy bi-encoders lose precision, cross-encoder scoring, the retrieve-then-rerank budget and latency cost.
Assumes: Hybrid Search and Fusion
- 1626 min
Late Interaction and ColBERT
AdvancedComing soonToken-level matching with MaxSim, the storage cost, and PLAID-style optimisations.
Assumes: Reranking with Cross-Encoders
- 1728 min
Context Assembly and Compression
IntermediateComing soonOrdering retrieved chunks, deduplication, contextual compression and budgeting the window.
Assumes: Reranking with Cross-Encoders
- 1822 min
Lost in the Middle
IntermediateComing soonPositional bias in long contexts, the empirical U-curve, and reordering to exploit it.
Assumes: Context Assembly and Compression
- 1928 min
Grounding Prompts and Citations
IntermediateComing soonPrompt patterns that force reliance on context, span-level citation, and refusal when evidence is absent.
Assumes: Lost in the Middle
- 2032 min
Evaluating Retrieval
AdvancedComing soonRecall@k, precision@k, MRR, NDCG and MAP, each computed by hand, plus building a golden set.
Assumes: Grounding Prompts and Citations
- 2128 min
Evaluating Generation: Faithfulness
AdvancedComing soonFaithfulness, answer relevance, context precision and recall, and detecting unsupported claims.
Assumes: Evaluating Retrieval
- 2224 min
RAGAS and Evaluation Frameworks
AdvancedComing soonAutomated RAG evaluation, the metric definitions, and calibrating automated scores against human judgement.
Assumes: Evaluating Generation: Faithfulness
- 2324 min
Parent Document and Hierarchical Retrieval
AdvancedComing soonSearching small chunks but returning larger context, sentence windows and summary indexes.
Assumes: Context Assembly and Compression
- 2426 min
Self-RAG and Corrective RAG
AdvancedComing soonModels deciding when to retrieve, grading their own retrievals, and fallback to web search.
Assumes: RAGAS and Evaluation Frameworks
- 2530 min
Agentic RAG
AdvancedComing soonMulti-step retrieval loops, tool selection, query planning, and termination conditions.
Assumes: Self-RAG and Corrective RAG · LLM Agents
- 2630 min
GraphRAG
AdvancedComing soonExtracting entities and relations into a knowledge graph, community summarisation, and global questions.
Assumes: Agentic RAG · Knowledge Graphs and Embeddings
- 2726 min
Multimodal RAG
AdvancedComing soonRetrieving over images, tables and charts; unified versus separate embedding spaces.
Assumes: GraphRAG · Multimodal LLMs
- 2832 min
RAG in Production
AdvancedComing soonIndex freshness and incremental updates, caching, cost control, monitoring and access control.
Assumes: Multimodal RAG