SeguridadOpenAI News
Mejorar el comportamiento de seguridad de los modelos con recompensas basadas en reglas
OpenAI ha desarrollado un nuevo método que utiliza recompensas basadas en reglas (RBR) para alinear a los modelos y hacer que comporten de manera segura sin necesidad de una gran cantidad de datos humanos.
Resumen elaborado por Kernelia a partir del artículo original de OpenAI News. La noticia y sus derechos pertenecen a su autor.

