Annonce de la recherche vector... Note

Annonce de la recherche vectorielle pour Amazon ElastiCache

La recherche vectorielle pour Amazon ElastiCache est désormais généralement disponible. Les clients peuvent désormais utiliser ElastiCache pour indexer, rechercher et mettre à jour des milliards d'intégrations vectorielles de haute dimension provenant de fournisseurs populaires tels qu'Amazon Bedrock, Amazon SageMaker, Anthropic et OpenAI, avec une latence aussi faible que quelques microsecondes et un rappel allant jusqu'à 99 %. Les principaux cas d'utilisation incluent la mise en cache sémantique pour les grands modèles de langage (LLM) et les agents conversationnels multi-tours, ce qui réduit considérablement la latence et les coûts en mettant en cache les requêtes sémantiquement similaires. La recherche vectorielle pour ElastiCache alimente également les systèmes d'IA agentiques avec la génération augmentée par récupération (RAG) pour garantir des résultats très pertinents et une faible latence constante sur plusieurs étapes de récupération. D'autres cas d'utilisation incluent les moteurs de recommandation, la détection d'anomalies et d'autres applications qui nécessitent une recherche efficace sur plusieurs modalités de données. La recherche vectorielle pour ElastiCache est disponible avec Valkey version 8.2 sur les clusters basés sur des nœuds dans toutes les régions AWS, sans frais supplémentaires. Pour commencer, créez un cluster Valkey 8.2 à l'aide de la console de gestion AWS, du kit de développement logiciel (SDK) AWS ou de l'interface de ligne de commande (CLI) AWS. Vous pouvez également utiliser la recherche vectorielle sur vos clusters existants en effectuant une mise à niveau de n'importe quelle version de Valkey ou Redis OSS vers Valkey 8.2 en quelques clics, sans interruption. Pour en savoir plus sur la recherche vectorielle pour ElastiCache pour Valkey, lisez ce blog et pour une liste des commandes prises en charge, consultez la documentation ElastiCache.