← back
arXivStephanie Fong, Yiwen Jiang, Zimu Wang, Hongxi Yang, Yaling Shen, Hiu Weh Naomi Chow, Heung Ying Lai, Xiangyu Zhao, Qingyang Xu, Zhongxing Xu, Jiahe Liu, Guilherme C. Oliveira, Vincent Lee, Zongyuan Ge, Dominic DwyerTue, Sep 1, 2026, 10:15 AM PDT
score 16.5

New benchmark reveals AI chatbots struggle to avoid stigmatizing language in group chats

Original: SDARE-Bench: Evaluating Large Language Models on Conversational Stigma Detection and Response in Dyadic and Group Dialogue

Source: arxiv.org

Writing ELI5 summary…

New benchmark reveals AI chatbots struggle to avoid stigmatizing language in group chats · TinyNews · TinyNews