Saltar al contenido
Kernelia
Todas las noticias
SeguridadOpenAI News

Mejorar el comportamiento de seguridad de los modelos con recompensas basadas en reglas

OpenAI ha desarrollado un nuevo método que utiliza recompensas basadas en reglas (RBR) para alinear a los modelos y hacer que comporten de manera segura sin necesidad de una gran cantidad de datos humanos.

Resumen elaborado por Kernelia a partir del artículo original de OpenAI News. La noticia y sus derechos pertenecen a su autor.