Google presentó Gemma 4 12B el 3 de junio como un modelo multimodal de 12.000 millones de parámetros capaz de recibir audio de forma nativa. El lanzamiento llevó un nuevo modelo de Google a una categoría de hardware que incluye algunos ordenadores personales de gama alta. Esto facilita los proyectos locales de voz y contenido multimodal para desarrolladores que no quieren enviar cada solicitud a un servicio remoto.

La compañía aseguró que el modelo puede ejecutarse localmente con 16 GB de VRAM o memoria unificada. Es una afirmación sobre el espacio que ocupa en memoria, no una promesa de que todos los equipos con 16 GB ofrecerán la misma velocidad ni admitirán la misma configuración. La compatibilidad del acelerador, la cuantización, el sistema operativo y el software de inferencia influyen en la utilidad real de una instalación local.

Google publicó los pesos bajo la licencia Apache 2.0 y documentó vías para herramientas habituales de desarrollo local y en la nube. También indicó que la familia Gemma había superado los 150 millones de descargas antes del lanzamiento. La cifra procede de Google y no mide instalaciones activas ni el rendimiento específico de Gemma 4.

El atractivo práctico está en el control. Un modelo que cabe en un solo equipo permite experimentar sin conexión y desarrollar flujos en los que los datos permanecen más cerca del usuario. Esas ventajas siguen dependiendo de la aplicación, el hardware y las medidas de seguridad. Disponer de pesos descargables no elimina el mantenimiento, y un consumo de memoria propio de un portátil no resuelve las dudas sobre latencia o calidad de respuesta.

Quienes comparen Gemma con sistemas alojados deberían probar la carga de trabajo completa, no una sola especificación. Conviene medir la memoria después de cargar el modelo, el tiempo de respuesta, el tratamiento del audio, los aceleradores admitidos y el efecto de la cuantización. El anuncio de Google fija un punto de partida alcanzable, pero las pruebas en equipos reales determinarán el alcance de esa afirmación.

Qué viene ahora

Pruebas independientes en portátiles, GPU y distintos motores de inferencia deberán mostrar en qué casos los 16 GB ofrecen una experiencia local realmente útil.

Fuentes

Este archivo retrospectivo sobre el lanzamiento se preparó el 3 de agosto de 2026 a partir del anuncio, la guía para desarrolladores y la descripción de Gemma publicados por Google. Las afirmaciones sobre el producto y su adopción siguen atribuidas a Google. AI News of Today no probó el modelo para este artículo.

Siempre que es posible, enlazamos documentos originales y reportes de primera mano.

  1. Google announcementFuente primaria · 3 de junio de 2026
  2. Google Developers guideFuente primaria · 3 de junio de 2026
  3. Google DeepMind Gemma overviewContexto · 3 de junio de 2026