Amazon ElastiCache에 대한 벡터 검색 발표
Amazon ElastiCache의 벡터 검색이 이제 정식 출시되었습니다. 고객은 이제 ElastiCache를 사용하여 Amazon Bedrock, Amazon SageMaker, Anthropic, OpenAI와 같은 인기 제공업체의 수십억 개의 고차원 벡터 임베딩을 마이크로초 수준의 낮은 지연 시간과 최대 99%의 검색 정확도로 인덱싱, 검색 및 업데이트할 수 있습니다. 주요 사용 사례에는 대규모 언어 모델(LLM) 및 다중 턴 대화 에이전트의 의미론적 캐싱이 포함되며, 이는 의미론적으로 유사한 쿼리를 캐싱하여 지연 시간과 비용을 크게 줄입니다. ElastiCache의 벡터 검색은 또한 검색 증강 생성(RAG)을 통해 에이전트 AI 시스템을 지원하여 여러 검색 단계에 걸쳐 매우 관련성 높은 결과와 일관되게 낮은 지연 시간을 보장합니다. 추가 사용 사례에는 추천 엔진, 이상 탐지 및 여러 데이터 모달리티에 걸쳐 효율적인 검색이 필요한 기타 애플리케이션이 포함됩니다. ElastiCache의 벡터 검색은 모든 AWS 리전의 노드 기반 클러스터에서 추가 비용 없이 Valkey 버전 8.2와 함께 사용할 수 있습니다. 시작하려면 AWS Management Console, AWS Software Development Kit(SDK) 또는 AWS Command Line Interface(CLI)를 사용하여 Valkey 8.2 클러스터를 생성하십시오. 또한 몇 번의 클릭으로 다운타임 없이 Valkey 또는 Redis OSS의 모든 버전에서 Valkey 8.2로 업그레이드하여 기존 클러스터에서 벡터 검색을 사용할 수 있습니다. Valkey용 ElastiCache의 벡터 검색에 대해 자세히 알아보려면 이 블로그를 읽고 지원되는 명령 목록은 ElastiCache 설명서를 참조하십시오.