Google introduceerde Gemma 4 12B op 3 juni als een multimodaal model met 12 miljard parameters en native audio-invoer. De release brengt een nieuw Google-model binnen het bereik van hardware waar ook sommige duurdere pc's onder vallen. Daardoor worden lokale spraak- en multimodale projecten toegankelijker voor ontwikkelaars die niet ieder verzoek naar een externe dienst willen sturen.

Het bedrijf zegt dat het model lokaal kan draaien met 16 GB VRAM of unified memory. Dat is een uitspraak over de vraag of het model in het geheugen past, niet de belofte dat iedere computer met 16 GB dezelfde snelheid haalt of dezelfde configuratie ondersteunt. Compatibiliteit van versnellers, quantisatie, besturingssysteem en inferentiesoftware bepalen of een lokale installatie in de praktijk nuttig is.

Google stelde de gewichten beschikbaar onder Apache 2.0 en documenteerde routes voor gangbare lokale en cloudtools. Het bedrijf zei ook dat de bredere Gemma-familie bij de lancering meer dan 150 miljoen keer was gedownload. Dat cijfer komt van Google en meet geen actieve implementaties of prestaties van Gemma 4 zelf.

De praktische aantrekkingskracht ligt in controle. Een model dat op één machine past, kan offline experimenten en werkstromen ondersteunen waarbij gegevens dichter bij de gebruiker blijven. Die voordelen hangen nog altijd af van toepassing, hardware en beveiliging. Downloadbare gewichten maken onderhoud niet overbodig, en een geheugenbeslag op laptopniveau beantwoordt geen vragen over latentie of uitvoerkwaliteit.

Ontwikkelaars die Gemma met gehoste systemen vergelijken, moeten de volledige werklast testen in plaats van één specificatie. Geheugengebruik na laden, reactietijd, audioverwerking, ondersteunde versnellers en het effect van quantisatie zijn bruikbare controles. De release van Google geeft een haalbaar vertrekpunt, maar tests op echte machines bepalen hoe breed de claim geldt.

Wat nu volgt

Externe tests op laptops, GPU's en inferentie-engines moeten laten zien wanneer 16 GB werkelijk een bruikbare lokale ervaring oplevert.

Bronnen

Dit terugblikdossier over de lancering is op 3 augustus 2026 samengesteld uit de aankondiging, ontwikkelaarsgids en het Gemma-overzicht van Google. Claims over product en gebruik blijven aan Google toegeschreven. AI News of Today heeft het model voor dit artikel niet getest.

Waar mogelijk verwijzen we naar originele documenten en verslaggeving uit de eerste hand.

  1. Google announcementPrimaire bron · 3 juni 2026
  2. Google Developers guidePrimaire bron · 3 juni 2026
  3. Google DeepMind Gemma overviewAchtergrond · 3 juni 2026