SeguridadOpenAI News
Detectar y reducir la tramoya en modelos de IA
La investigación de Apollo y OpenAI ha desarrollado evaluaciones para la alineación oculta ('tramoya') y encontró comportamientos consistentes con la tramoya en pruebas controladas en modelos fronterizos.
Resumen elaborado por Kernelia a partir del artículo original de OpenAI News. La noticia y sus derechos pertenecen a su autor.

