arXivSaikat Mondal, Mamta, Deeksha Varshney, Oana Cocarascu, Asif EkbalThu, Sep 3, 2026, 5:54 AM PDT
score 16.6
New benchmark tests AI safety in Indian languages under persuasive attack
Original: IndicSafeEval: Safety Robustness of Large Language Models under Multilingual Persuasive Jailbreak Attacks
Source: arxiv.org ↗
Writing ELI5 summary…