Segurança e alinhamento em uma era de modelos de longo horizonte

A OpenAI compartilha lições aprendidas ao implantar modelos de IA de execução prolongada, destacando novos riscos de segurança, falhas observadas e salvaguardas aprimoradas por meio de implantação iterativa.

OpenAI ·
compartilhar: