Saltar al contenido
Kernelia
Todas las noticias
MultimodalGoogle DeepMind Blog

Presentamos Gemma 4 12B: un modelo multimodal unificado y sin codificador

DeepMind ha anunciado Gemma 4 12B, un modelo multimodal que integra texto, imágenes y otros tipos de datos sin necesidad de codificadores separados. Con 12 mil millones de parámetros, el modelo busca simplificar la arquitectura y mejorar la eficiencia en tareas que combinan diferentes modalidades.

Resumen elaborado por Kernelia a partir del artículo original de Google DeepMind Blog. La noticia y sus derechos pertenecen a su autor.