AWS Machine Learning Blog на русском
Подписаться
Метрика оценки агента для многоходовых диалогов
Многоходовые агенты терпят неудачу способами, которые упускает одноходовая оценка: одна ранняя ошибка портит каждый последующий ход. В этой статье представлена метрика оценки агента (AEM) — разложимый, пошаговый способ измерения качества агента, примененный к его первому измерению, правильности, чтобы точно определить ход, вызвавший сбой, и отделить его от ходов, которые его унаследовали.