SeguridadOpenAI News
La jerarquía de instrucciones: Entrenando LLMs para priorizar instrucciones privilegiadas
Los LLMs actuales son vulnerables a inyecciones de promotores, escape de cárceles y otros ataques que permiten a los adversarios sobreescribir las instrucciones originales de un modelo con sus propios promotores maliciosos.
Resumen elaborado por Kernelia a partir del artículo original de OpenAI News. La noticia y sus derechos pertenecen a su autor.

