Запуск pgvector в продакшене н... Заметка

Запуск pgvector в продакшене на Amazon Aurora PostgreSQL

Запуск pgvector на Amazon Aurora PostgreSQL дает вам хранилище векторов уровня производства на базе данных, с которой вы уже знакомы, поддерживаемое инструментами эксплуатации, высокой доступностью и масштабируемостью Amazon Aurora. Производственный трафик вводит предсказуемый набор операционных соображений: задержку запросов по мере роста корпуса, воспоминание при фильтрованных поисках вектором, запас памяти во время построения индексов и поведение подключения под нагрузкой. Этот пост посвящен операциям с базой данных, которые поддерживают здоровье слоя извлечения RAG. В этом посте мы рассматриваем операционные практики, которые поддерживают здоровье рабочей нагрузки pgvector, когда вы от нее зависит: выбор правильного индекса и функции расстояния, масштабирование с помощью квантования и разделения, управление перемещением иерархического навигируемого небольшого мира (HNSW), выбор размера для операции в памяти и сигналы наблюдаемости, которые обнаруживают проблемы на ранней стадии.
CdXz5zHNQW_uSjQyYk2Tq.png