Construire un assistant de conversation RAG sur Amazon EKS en mode automatique et NVIDIA NIMs
Dans cet article, nous démontrons la mise en œuvre d'un assistant conversationnel RAG pratique en utilisant une pile complète de technologies modernes. La solution utilise les NIMs de NVIDIA pour les services d'inférence LLM et d'intégration de texte, avec le NIM Operator gérant leur déploiement et leur gestion. L'architecture intègre Amazon OpenSearch Serverless pour stocker et interroger des plongements vectoriels de haute dimension pour la recherche de similarité.