Google lanzó Gemma 4 12B, un modelo de inteligencia artificial multimodal que se ejecuta en laptops con 16 GB de RAM. El modelo ofrece una paridad cercana con la variante de 26 mil millones de parámetros en tareas de razonamiento.

El modelo Gemma 4 12B viene con predictores de predicción de tokens múltiples (MTP) integrados, lo que mejora la velocidad y la eficiencia. El procesamiento de visión utiliza una multiplicación de matriz única y un embbeding posicional, eliminando codificadores voluminosos.

Las entradas de audio se proyectan directamente en el espacio vectorial utilizado para tokens de texto, evitando la codificación por completo. Los pesos del modelo —justo por debajo de 18 GB— están disponibles en Kaggle y Hugging Face, y el modelo se puede acceder a través de LM Studio y Google AI Edge Gallery.

Este artículo fue escrito con la asistencia de IA.
News Factory APP - noticias agénticas para impulsar tu SEO y AEO.