Amazon Aurora PostgreSQL에서 pgv... 노트

Amazon Aurora PostgreSQL에서 pgvector를 프로덕션에서 실행 중입니다

Amazon Aurora PostgreSQL에서 pgvector를 실행하면 이미 익숙한 데이터베이스에서 프로덕션 등급의 벡터 스토어를 사용할 수 있으며, 이는 Amazon Aurora의 운영 도구, 고가용성 및 확장 동작에 의해 지원됩니다. 프로덕션 트래픽은 예측 가능한 일련의 운영 고려 사항을 발생시킵니다. 즉, 코퍼스가 증가함에 따른 쿼리 지연 시간, 필터링된 벡터 검색 시 리콜, 인덱스 빌드 중 메모리 헤드룸, 부하 시 연결 동작입니다. 이 게시물은 RAG 검색 계층을 건강하게 유지하는 데이터베이스 운영에 국한됩니다. 이 게시물에서는 pgvector 워크로드가 의존하게 된 후 이를 건강하게 유지하는 운영 관행을 다룹니다. 즉, 올바른 인덱스 및 거리 함수 선택, 양자화 및 파티셔닝을 통한 확장, Hierarchical Navigable Small World(HNSW) 변경 관리, 메모리 상주 운영을 위한 크기 조정, 문제를 조기에 감지하는 관찰 가능성 신호입니다.
CdXz5zHNQW_uSjQyYk2Tq.png