Qwen3.5 2B in je browser draaien
The newest Qwen at this size. Good general chat with an optional reasoning mode.
Qwen3.5 2B in de browser gebruiken Alle modellen Eén keer downloaden · daarna offline
- Familie
- Qwen
- Uitgegeven door
- Alibaba Cloud
- Parameters
- 2B
- Kwantisatie
- q4f16_1 · 4-bit
- Download
- 1010 MB · 31 bestanden
- GPU-geheugen
- 2.2 GB
- Contextvenster
- 4k tokens
- Redeneren
- Optioneel
- Licentie
- Apache 2.0
- Basismodel
- Qwen/Qwen3.5-2B
- Gewichten
- mlc-ai/Qwen3.5-2B-q4f16_1-MLC
- Goed in
- Chat · Redeneren · Meertalig
Hoe groot is de download van Qwen3.5 2B?
1010 MB voor de q4f16_1-variant, verdeeld over 31 bestanden. Het wordt één keer gedownload en blijft in de cache van je browser, zodat elk later bezoek meteen begint en offline werkt.
Wat heeft mijn apparaat nodig om Qwen3.5 2B te draaien?
Een browser met WebGPU — een recente Chrome, Edge, Firefox of Safari — en ongeveer 2.2 GB GPU-geheugen. Het hulpmiddel controleert je GPU, geheugen en vrije ruimte en zegt of Qwen3.5 2B past voordat er iets wordt gedownload.
Wordt er iets van wat ik typ naar een server gestuurd?
Nee. Qwen3.5 2B draait op je eigen GPU in het browsertabblad. Het enige netwerkverkeer is de eenmalige download van de modelbestanden vanaf Hugging Face; je prompts en de antwoorden verlaten het apparaat nooit, en de chats staan in deze browser.
Welke variant van Qwen3.5 2B kan ik het beste kiezen?
Begin met q4f16_1 — dat is de kleinste download en draait het snelst. De f32-varianten zijn groter en gebruiken meer geheugen, maar werken op GPU's zonder ondersteuning voor 16-bits shaders. Varianten met 1k houden een korter gesprek vast in ruil voor minder geheugen.
Hoe lang kan een gesprek met Qwen3.5 2B worden?
Het contextvenster is 4k tokens. Langere gesprekken blijven werken — de oudste beurten vallen met een melding weg zodra het gesprek niet meer past.
Laat Qwen3.5 2B zijn redenering zien?
Qwen3.5 2B kan nadenken voordat het antwoordt. Zet de redeneermodus aan in de chatinstellingen; het denken verschijnt in een inklapbaar blok boven het antwoord en wordt nooit als onderdeel van het gesprek teruggestuurd.
Onder welke licentie is Qwen3.5 2B uitgebracht?
De gewichten vallen onder Apache 2.0, overgenomen van de modelkaart van Qwen/Qwen3.5-2B. Controleer de licentie zelf voordat je het commercieel gebruikt.
Cijfers afgelezen uit de WebLLM 0.2.84-catalogus en de modelkaart op 2026-09-03.