Семейство алгоритмов, которые находят почти ближайшие векторы без полного перебора, обменивая часть точности на скорость и экономию памяти.
Точный поиск соседей требует сравнить запрос с каждым вектором коллекции. На миллионе документов это миллион операций на один запрос, на ста миллионах задача становится невыполнимой в реальном времени. Приближенные методы строят вспомогательную структуру: многослойный граф близости в HNSW или разбиение пространства на области в IVF.
Читать: HNSW, оригинальная статья; Faiss: библиотека и вики; ANN Benchmarks: сравнение реализаций