InvestigaciónHugging Face Blog
SmolVLA: Modelo de visión-lenguaje-acción eficiente entrenado en datos de la comunidad Lerobot
El equipo de Hugging Face ha presentado SmolVLA, un modelo de visión-lenguaje-acción eficiente entrenado en datos de la comunidad Lerobot. Este modelo combina la capacidad de comprender texto y visión para realizar acciones.
Resumen elaborado por Kernelia a partir del artículo original de Hugging Face Blog. La noticia y sus derechos pertenecen a su autor.
