Ankündigung der Vektor-Suche f... Notiz

Ankündigung der Vektor-Suche für Amazon ElastiCache

Vektorsuche für Amazon ElastiCache ist jetzt allgemein verfügbar. Kunden können ElastiCache jetzt verwenden, um Milliarden von hochdimensionalen Vektoreinbettungen von beliebten Anbietern wie Amazon Bedrock, Amazon SageMaker, Anthropic und OpenAI mit einer Latenz von bis zu Mikrosekunden und bis zu 99 % Recall zu indizieren, zu suchen und zu aktualisieren. Zu den wichtigsten Anwendungsfällen gehören semantisches Caching für Large Language Models (LLMs) und mehrstufige Konversationsagenten, wodurch die Latenz und die Kosten durch das Caching semantisch ähnlicher Abfragen erheblich reduziert werden. Die Vektorsuche für ElastiCache unterstützt auch agentenbasierte KI-Systeme mit Retrieval Augmented Generation (RAG), um hochrelevante Ergebnisse und eine konstant niedrige Latenz über mehrere Abrufs Schritte hinweg sicherzustellen. Weitere Anwendungsfälle sind Empfehlungsmaschinen, Anomalieerkennung und andere Anwendungen, die eine effiziente Suche über mehrere Datenmodalitäten erfordern. Die Vektorsuche für ElastiCache ist mit Valkey Version 8.2 auf node-basierten Clustern in allen AWS-Regionen ohne zusätzliche Kosten verfügbar. Um zu beginnen, erstellen Sie einen Valkey 8.2-Cluster über die AWS Management Console, das AWS Software Development Kit (SDK) oder die AWS Command Line Interface (CLI). Sie können die Vektorsuche auch auf Ihren bestehenden Clustern verwenden, indem Sie mit wenigen Klicks von jeder Version von Valkey oder Redis OSS auf Valkey 8.2 upgraden, ohne Ausfallzeiten. Um mehr über die Vektorsuche für ElastiCache für Valkey zu erfahren, lesen Sie diesen Blog und für eine Liste der unterstützten Befehle die ElastiCache-Dokumentation.