arXivStephanie Fong, Yiwen Jiang, Zimu Wang, Hongxi Yang, Yaling Shen, Hiu Weh Naomi Chow, Heung Ying Lai, Xiangyu Zhao, Qingyang Xu, Zhongxing Xu, Jiahe Liu, Guilherme C. Oliveira, Vincent Lee, Zongyuan Ge, Dominic DwyerTue, Sep 1, 2026, 10:15 AM PDT
score 16.5
New benchmark reveals AI chatbots struggle to avoid stigmatizing language in group chats
Original: SDARE-Bench: Evaluating Large Language Models on Conversational Stigma Detection and Response in Dyadic and Group Dialogue
Source: arxiv.org ↗
Writing ELI5 summary…