Saltar al contenido
Kernelia
Todas las noticias
InvestigaciónHugging Face Blog

SmolVLA: Modelo de visión-lenguaje-acción eficiente entrenado en datos de la comunidad Lerobot

El equipo de Hugging Face ha presentado SmolVLA, un modelo de visión-lenguaje-acción eficiente entrenado en datos de la comunidad Lerobot. Este modelo combina la capacidad de comprender texto y visión para realizar acciones.

Resumen elaborado por Kernelia a partir del artículo original de Hugging Face Blog. La noticia y sus derechos pertenecen a su autor.