Saltar al contenido
Kernelia
Todas las noticias
AgentesOpenAI News

MLE-bench: Evaluando Agentes de Inteligencia Artificial en Ingeniería de Aprendizaje de Máquina

MLE-bench es un conjunto de pruebas para evaluar el desempeño de agentes de inteligencia artificial en la ingeniería de aprendizaje de máquina. Se trata de una herramienta para medir la capacidad de estos agentes en tareas de ingeniería de aprendizaje de máquina.

Resumen elaborado por Kernelia a partir del artículo original de OpenAI News. La noticia y sus derechos pertenecen a su autor.