SurakshaEval: Um Benchmark de Segurança Índico para LLMs Multilíngues

arXiv:2608.07862v1 Tipo de anúncio: novo Resumo: Os conjuntos de dados existentes para avaliação de segurança de grandes modelos de linguagem (LLMs) focam predominantemente em contextos ingleses e ocidentais, muitas vezes ignorando a diversidade linguística e os riscos de segurança culturalmente enraizados presentes em outros idiomas. Para preencher essa lacuna, apresentamos o SurakshaEval, um novo benchmark de segurança composto por prompts escritos por humanos que abrangem cenários do mundo real, explicitamente projetado para dez importantes idiomas indianos - assamês, bengali, guzerate, hi...

arXiv cs.CL ·Debopriyo Banerjee, Kapil Rajesh Kavitha, Angana Borah, Xudong Han, Yuxia Wang, Parameswari Krishnamurthy, Utkarsh Agarwal, Atharva Kulkarni, Swaran Lata, Ayush Munot, Dhruv Sahnan, Aaryamonvikram Singh, Preslav Nakov, Monojit Choudhury ·
compartilhar: