Почему не всегда стоит доверят... Заметка
Analytics Vidhya на русском

Почему не всегда стоит доверять большим языковым моделям в качестве судей: Понимание предвзятости в автоматической оценке

В спешке автоматизировать оценку, от выставления оценок за код студентов до ранжирования научных статей, мы приняли большие языковые модели в качестве судей. Они быстры. Эти системы дешевы. Они масштабируются. Однако на семинаре в DHS 2026 Бхаскарджит Сарма высказал мысль, которая мне запомнилась: «вы не можете доверять большим языковым моделям в качестве судей. Я […]