Segurança e alinhamento em uma era de modelos de longo horizonte
A OpenAI compartilha lições da implantação de modelos de IA de longa duração, destacando novos riscos de segurança, falhas observadas e salvaguardas aprimoradas por meio de implantação iterativa.