Amazon Aurora PostgreSQLでの本番環境でのpgvectorの実行
Amazon Aurora PostgreSQL 上で pgvector を実行することで、使い慣れたデータベース上で本番環境対応のベクトルストアを利用できます。これは、Amazon Aurora の運用ツール、高可用性、スケーリング動作に裏打ちされています。本番トラフィックは、コーパスの増加に伴うクエリレイテンシ、フィルタリングされたベクトル検索におけるリコール、インデックス構築中のメモリヘッドルーム、負荷下での接続動作といった、予測可能な一連の運用上の考慮事項をもたらします。本稿では、RAG 検索レイヤーを健全に保つデータベース運用に焦点を当てます。本稿では、pgvector ワークロードに依存するようになった際に、それを健全に保つための運用プラクティスについて説明します。具体的には、適切なインデックスと距離関数の選択、量子化とパーティショニングによるスケーリング、Hierarchical Navigable Small World (HNSW) のチャーン管理、メモリ常駐運用に向けたサイジング、そして問題を早期に検出するためのオブザーバビリティシグナルについて解説します。