Amazon ElastiCache でのベクトル検索のご紹... ノート

Amazon ElastiCache でのベクトル検索のご紹介

Amazon ElastiCache のベクトル検索が一般公開されました。お客様は、ElastiCache を使用して、Amazon Bedrock、Amazon SageMaker、Anthropic、OpenAI などの人気プロバイダーからの数十億の高次元ベクトル埋め込みをインデックス化、検索、更新できるようになりました。これにより、マイクロ秒という低レイテンシと最大 99% のリコールを実現します。主なユースケースには、大規模言語モデル (LLM) やマルチターン会話エージェントのセマンティックキャッシングがあり、セマンティック的に類似したクエリをキャッシュすることで、レイテンシとコストを大幅に削減します。ElastiCache のベクトル検索は、Retrieval Augmented Generation (RAG) を備えたエージェント AI システムにも対応し、非常に関連性の高い結果と、複数の検索ステップにわたる一貫して低いレイテンシを保証します。その他のユースケースには、レコメンデーションエンジン、異常検知、および複数のデータモダリティにわたる効率的な検索を必要とするその他のアプリケーションが含まれます。ElastiCache のベクトル検索は、すべての AWS リージョンでノードベースのクラスターで Valkey バージョン 8.2 で利用でき、追加費用はかかりません。開始するには、AWS マネジメントコンソール、AWS ソフトウェア開発キット (SDK)、または AWS コマンドラインインターフェース (CLI) を使用して、Valkey 8.2 クラスターを作成します。また、Valkey または Redis OSS の任意のバージョンから Valkey 8.2 に数回クリックするだけで、ダウンタイムなしでアップグレードすることで、既存のクラスターでベクトル検索を使用することもできます。ElastiCache for Valkey のベクトル検索の詳細については、このブログをお読みください。サポートされているコマンドの一覧については、ElastiCache のドキュメントを参照してください。