InvestigaciónOpenAI News
PaperBench: Evaluando la capacidad de los agentes de IA para replicar la investigación de IA
OpenAI ha presentado PaperBench, un estándar de evaluación que mide la capacidad de los agentes de IA para replicar investigaciones de vanguardia en IA.
Resumen elaborado por Kernelia a partir del artículo original de OpenAI News. La noticia y sus derechos pertenecen a su autor.
