Analytics Vidhya на русском
Подписаться
Почему не всегда стоит доверять большим языковым моделям в качестве судей: Понимание предвзятости в автоматической оценке
В спешке автоматизировать оценку, от выставления оценок за код студентов до ранжирования научных статей, мы приняли большие языковые модели в качестве судей. Они быстры. Эти системы дешевы. Они масштабируются. Однако на семинаре в DHS 2026 Бхаскарджит Сарма высказал мысль, которая мне запомнилась: «вы не можете доверять большим языковым моделям в качестве судей. Я […]