SkillConsist: Detectando Inconsistências em Habilidades de Agentes via Alinhamento Bidirecional de Grafos

arXiv:2608.07639v1 Tipo de Anúncio: novo Resumo: As Habilidades de Agentes (Agent Skills) fornecem capacidades reutilizáveis a agentes de LLM. Inconsistências nas Habilidades de Agentes podem expor comportamentos perigosos não divulgados ou causar a seleção errada de Habilidades. Pesquisas recentes sobre Habilidades de Agentes têm examinado cada vez mais a detecção de consistência de Habilidades de Agentes. Os métodos existentes avaliam comportamentos ou grafos de propriedades de segurança em relação a categorias predefinidas ou escopos declarados. Mais recentemente, o PL-HCL usa um modelo baseado em LLM para aprender a consistência entre metadados, instr...

arXiv cs.LG ·Chaofan Meng, Yuhang Zheng, Yingnan Zhou, Sihan Xu ·
compartilhar: