Gemma 3 1B in je browser draaien
Google’s compact instruction-tuned model; needs very little GPU memory.
Gemma 3 1B in de browser gebruiken Alle modellen Eén keer downloaden · daarna offline
- Familie
- Gemma
- Uitgegeven door
- Parameters
- 1B
- Kwantisatie
- q4f16_1 · 4-bit
- Download
- 537 MB · 15 bestanden
- GPU-geheugen
- 711 MB
- Contextvenster
- 4k tokens
- Redeneren
- —
- Licentie
- Gemma Terms of Use
- Basismodel
- google/gemma-3-1b-it
- Gewichten
- mlc-ai/gemma3-1b-it-q4f16_1-MLC
- Goed in
- Chat · Meertalig
| # | Variant | Download | |
|---|---|---|---|
| 01 | q4f16_1 | 537 MB | Aanbevolen |
Hoe groot is de download van Gemma 3 1B?
537 MB voor de q4f16_1-variant, verdeeld over 15 bestanden. Het wordt één keer gedownload en blijft in de cache van je browser, zodat elk later bezoek meteen begint en offline werkt.
Wat heeft mijn apparaat nodig om Gemma 3 1B te draaien?
Een browser met WebGPU — een recente Chrome, Edge, Firefox of Safari — en ongeveer 711 MB GPU-geheugen. Het hulpmiddel controleert je GPU, geheugen en vrije ruimte en zegt of Gemma 3 1B past voordat er iets wordt gedownload.
Wordt er iets van wat ik typ naar een server gestuurd?
Nee. Gemma 3 1B draait op je eigen GPU in het browsertabblad. Het enige netwerkverkeer is de eenmalige download van de modelbestanden vanaf Hugging Face; je prompts en de antwoorden verlaten het apparaat nooit, en de chats staan in deze browser.
Hoe lang kan een gesprek met Gemma 3 1B worden?
Het contextvenster is 4k tokens. Langere gesprekken blijven werken — de oudste beurten vallen met een melding weg zodra het gesprek niet meer past.
Onder welke licentie is Gemma 3 1B uitgebracht?
De gewichten vallen onder Gemma Terms of Use, overgenomen van de modelkaart van google/gemma-3-1b-it. Controleer de licentie zelf voordat je het commercieel gebruikt.
Cijfers afgelezen uit de WebLLM 0.2.84-catalogus en de modelkaart op 2026-09-03.