SmolLM2 135M Instruct in je browser draaien
SmolLM2 135M Instruct is een 135M Hugging Face-model. In de browser downloadt het 257 MB en heeft het ongeveer 360 MB GPU-geheugen nodig.
SmolLM2 135M Instruct in de browser gebruiken Alle modellen Eén keer downloaden · daarna offline
- Familie
- SmolLM
- Uitgegeven door
- Hugging Face
- Parameters
- 135M
- Kwantisatie
- q0f16 · 16-bit
- Download
- 257 MB · 8 bestanden
- GPU-geheugen
- 360 MB
- Contextvenster
- 4k tokens
- Redeneren
- —
- Licentie
- Apache 2.0
- Basismodel
- HuggingFaceTB/SmolLM2-135M-Instruct
- Gewichten
- mlc-ai/SmolLM2-135M-Instruct-q0f16-MLC
- Goed in
- Chat
Hoe groot is de download van SmolLM2 135M Instruct?
257 MB voor de q0f16-variant, verdeeld over 8 bestanden. Het wordt één keer gedownload en blijft in de cache van je browser, zodat elk later bezoek meteen begint en offline werkt.
Wat heeft mijn apparaat nodig om SmolLM2 135M Instruct te draaien?
Een browser met WebGPU — een recente Chrome, Edge, Firefox of Safari — en ongeveer 360 MB GPU-geheugen. Het hulpmiddel controleert je GPU, geheugen en vrije ruimte en zegt of SmolLM2 135M Instruct past voordat er iets wordt gedownload.
Wordt er iets van wat ik typ naar een server gestuurd?
Nee. SmolLM2 135M Instruct draait op je eigen GPU in het browsertabblad. Het enige netwerkverkeer is de eenmalige download van de modelbestanden vanaf Hugging Face; je prompts en de antwoorden verlaten het apparaat nooit, en de chats staan in deze browser.
Welke variant van SmolLM2 135M Instruct kan ik het beste kiezen?
Begin met q0f16 — dat is de kleinste download en draait het snelst. De f32-varianten zijn groter en gebruiken meer geheugen, maar werken op GPU's zonder ondersteuning voor 16-bits shaders. Varianten met 1k houden een korter gesprek vast in ruil voor minder geheugen.
Hoe lang kan een gesprek met SmolLM2 135M Instruct worden?
Het contextvenster is 4k tokens. Langere gesprekken blijven werken — de oudste beurten vallen met een melding weg zodra het gesprek niet meer past.
Onder welke licentie is SmolLM2 135M Instruct uitgebracht?
De gewichten vallen onder Apache 2.0, overgenomen van de modelkaart van HuggingFaceTB/SmolLM2-135M-Instruct. Controleer de licentie zelf voordat je het commercieel gebruikt.
Cijfers afgelezen uit de WebLLM 0.2.84-catalogus en de modelkaart op 2026-09-03.