SurakshaEval: Um Benchmark de Segurança Índico para LLMs Multilíngues
arXiv:2608.07862v1 Tipo de anúncio: novo Resumo: Os conjuntos de dados existentes para avaliação de segurança de grandes modelos de linguagem (LLMs) focam predominantemente em contextos ingleses e ocidentais, muitas vezes ignorando a diversidade linguística e os riscos de segurança culturalmente enraizados presentes em outros idiomas. Para preencher essa lacuna, apresentamos o SurakshaEval, um novo benchmark de segurança composto por prompts escritos por humanos que abrangem cenários do mundo real, explicitamente projetado para dez importantes idiomas indianos - assamês, bengali, guzerate, hi...
arXiv cs.CL
·Debopriyo Banerjee, Kapil Rajesh Kavitha, Angana Borah, Xudong Han, Yuxia Wang, Parameswari Krishnamurthy, Utkarsh Agarwal, Atharva Kulkarni, Swaran Lata, Ayush Munot, Dhruv Sahnan, Aaryamonvikram Singh, Preslav Nakov, Monojit Choudhury
·
// relacionados
Leia também
Editorial
O modelo que continua aprendendo depois de entregue: dentro do Macaron-V1
Blog
Novo Nordisk e AWS levam IA agêntica à descoberta de medicamentos
Blog
Nvidia garante o valor de seus próprios chips para destravar US$ 500 bilhões em financiamento de infraestrutura de IA
Modelo