Phần 6 — Vector index: quantization và ANN đồ thị
Tầng 5 ở Phần 4 nêu vấn đề: giữ vector ở dạng thô thì không đủ RAM, và quét tuyến tính thì không đủ nhanh. Phần này đào sâu hai cơ chế trả lời vấn đề đó. Phần 7 là bản hiện thực cụ thể của cả hai trong một database thật.
| Mục | Nội dung |
|---|---|
| 6.1 Quantization cho vector | scalar / product / binary quantization (lượng tử hoá) — nén vector xuống bao nhiêu lần, mất gì |
| 6.2 ANN đồ thị: HNSW | IVF, k-means, HNSW nhiều tầng — vì sao tìm gần đúng lại nhanh hơn hẳn |