Analytics Vidhya 日本語
フォロー
常にLLMを審査員として信頼すべきではない理由:自動評価におけるバイアスの理解
評価の自動化、学生のコードの採点から研究論文のランキングに至るまで、私たちは大規模言語モデルを審査員として受け入れてきました。それらは高速です。これらのユニットは安価です。それらはスケールします。しかし、DHS 2026のワークショップで、Bhaskarjit Sarmahは私の心に残る指摘をしました。「LLMを審査員として信頼することはできない。私は […]」