Alinhamento Contextual de Valores via Fusão Combinatória Multicamada

arXiv:2608.07642v1 Tipo de Anúncio: novo Resumo: Alinhar grandes modelos de linguagem (LLMs) com valores humanos continua sendo um grande desafio, especialmente para uma IA confiável. Embora abordagens existentes como RLHF, CAI e suas variantes tenham alcançado resultados promissores, elas frequentemente dependem de um framework de agente único e de um sistema de recompensa unificado. Isso limita sua capacidade de capturar o pluralismo ético, adaptar-se a diversos contextos morais e refletir a dinâmica do raciocínio moral multiagente. Neste trabalho, nós propo...

arXiv cs.AI ·Yuanhong Wu, Djallel Bouneffouf, D. Frank Hsu ·
compartilhar: