← back
arXivSaikat Mondal, Mamta, Deeksha Varshney, Oana Cocarascu, Asif EkbalThu, Sep 3, 2026, 5:54 AM PDT
score 16.6

New benchmark tests AI safety in Indian languages under persuasive attack

Original: IndicSafeEval: Safety Robustness of Large Language Models under Multilingual Persuasive Jailbreak Attacks

Source: arxiv.org

Writing ELI5 summary…