AWS Machine Learning Blog на русском
Подписаться
Создание чат-ассистента RAG на основе Amazon EKS в автономном режиме и NVIDIA NIMs
В этом посте мы демонстрируем реализацию практического чат-ассистента на основе RAG, использующего современный стек технологий. Решение использует NIM от NVIDIA для инференса языковой модели и сервисов векторного представления текста, а оператор NIM отвечает за их развертывание и управление. Архитектура включает в себя серверное приложение Amazon OpenSearch для хранения и запроса высокомерных векторных представлений для поиска по сходству.