Bỏ qua để đến nội dung
Search & RAG

Phần 6 — Vector index: quantization và ANN đồ thị

Tầng 5 ở Phần 4 nêu vấn đề: giữ vector ở dạng thô thì không đủ RAM, và quét tuyến tính thì không đủ nhanh. Phần này đào sâu hai cơ chế trả lời vấn đề đó. Phần 7 là bản hiện thực cụ thể của cả hai trong một database thật.

MụcNội dung
6.1 Quantization cho vectorscalar / product / binary quantization (lượng tử hoá) — nén vector xuống bao nhiêu lần, mất gì
6.2 ANN đồ thị: HNSWIVF, k-means, HNSW nhiều tầng — vì sao tìm gần đúng lại nhanh hơn hẳn