Towards Data Science | Medium на русском
Подписаться
Сократите задержку и стоимость корпоративного RAG-конвейера, вызывая LLM реже, а не покупая более быструю модель.
Enterprise Document Intelligence [Vol.1 #9ter] - Конвейер статьи 9 на нескольких этапах вызывает модель, чтобы убедиться в ее правильности. Для простых вопросов это ненужная задержка. Сигнал для каждого вопроса направляет их в обход модели, экономя около двух секунд при совпадении ключевых слов.