Saltar al contenido
Kernelia
Todas las noticias
InvestigaciónHugging Face Blog

ITBench-AA: Los modelos de frontera obtienen menos del 50% en el primer benchmark de tareas empresariales de TI con agentes — por Artificial Analysis e IBM

El blog presenta ITBench-AA, el primer conjunto de pruebas diseñado para evaluar el desempeño de modelos de IA en tareas de TI empresariales que requieren capacidades agenticas. Los resultados indican que los modelos de última generación lograron menos del 50 % de puntuación, lo que sugiere que aún quedan importantes desafíos.

Resumen elaborado por Kernelia a partir del artículo original de Hugging Face Blog. La noticia y sus derechos pertenecen a su autor.