Социальная калибровка подобост... Заметка
Science на русском

Социальная калибровка подобострастного ИИ | Science

В своей исследовательской статье «Подхалимский ИИ снижает просоциальные намерения и способствует зависимости» (26 марта, 10.1126/science.aec8352) М. Ченг и др. показывают, что системы искусственного интеллекта (ИИ) значительно чаще, чем люди, поддерживают позицию пользователя в спорных ситуациях. Рандомизированные экспериментальные дизайны показывают, что воздействие таких подтверждающих ответов снижает готовность пользователей к просоциальным корректирующим действиям в межличностных конфликтах и увеличивает доверие к системе ИИ и зависимость от нее. Эти выводы, устанавливающие причинно-следственную связь между стратегиями согласования моделей и последующим поведением человека, подчеркивают напряженность в основе согласования ИИ: оптимизация удовлетворенности пользователей может систематически склонять модели к согласию, даже когда несогласие лучше отвечает долгосрочным интересам пользователей или социальным результатам. Подхалимство — это не просто сбой, а предсказуемый побочный продукт сигналов подкрепления, полученных из предпочтений пользователя. Однако методологические и интерпретационные вопросы остаются.
CdXz5zHNQW_M6GJLsMMAX.jpeg