AWS Machine Learning Blog на русском
Подписаться
За пределами RAG: сжатие знаний, ориентированное на задачи, для корпоративного ИИ на AWS
Традиционный RAG упирается в потолок при выполнении аналитических задач, охватывающих сотни документов. В этой статье показано, как использовать task-aware knowledge compression (TAKC) на AWS для предварительного сжатия целых баз знаний в представления, специфичные для задач, кэшировать их на нескольких уровнях детализации и направлять каждый запрос на нужный уровень, с открытой реализацией, которую вы можете развернуть.