Skip to the tool workspace
Browser 106
no file limit
Meta Draait op je GPU

Llama 3.1 70B Instruct in je browser draaien

Llama 3.1 70B Instruct is een 70B Meta-model. In de browser downloadt het 30 GB en heeft het ongeveer 30 GB GPU-geheugen nodig.

modelLlama-3.1-70B-Instruct-q3f16_1-MLC engineWebLLM 0.2.84 netwerkhet model wordt één keer gedownload
Download30 GB
GPU-geheugen30 GB
Context4k tokens
Parameters70B
Varianten1

Llama 3.1 70B Instruct in de browser gebruiken Alle modellen Eén keer downloaden · daarna offline

Open deze pagina in een browser met JavaScript om te controleren of Llama 3.1 70B Instruct op dit apparaat past. Het heeft ongeveer 30 GB GPU-geheugen en een download van 30 GB nodig.
Specificaties Overgenomen van de modelkaart
Familie
Llama
Uitgegeven door
Meta
Parameters
70B
Kwantisatie
q3f16_1 · 3-bit
Download
30 GB · 456 bestanden
GPU-geheugen
30 GB
Contextvenster
4k tokens
Redeneren
Goed in
Chat · Meertalig
Varianten Dezelfde gewichten, andere precisie
# Variant Download GPU-geheugen Context Toelichting
01 q3f16_1 30 GB 30 GB 4k tokens 3-bits gewichten, f16 Aanbevolen
Zo draai je het
01 Open de chat De knop hierboven opent Llama 3.1 70B Instruct in de AI-chat in de browser, met het model al geselecteerd.
02 Eén keer downloaden 30 GB komt binnen vanaf Hugging Face en blijft in de cache van je browser. Je kunt alvast typen tijdens het downloaden.
03 Privé chatten Het model draait op je GPU. Niets van wat je typt wordt geüpload, en het blijft offline werken.
Vragen
Hoe groot is de download van Llama 3.1 70B Instruct?

30 GB voor de q3f16_1-variant, verdeeld over 456 bestanden. Het wordt één keer gedownload en blijft in de cache van je browser, zodat elk later bezoek meteen begint en offline werkt.

Wat heeft mijn apparaat nodig om Llama 3.1 70B Instruct te draaien?

Een browser met WebGPU — een recente Chrome, Edge, Firefox of Safari — en ongeveer 30 GB GPU-geheugen. Het hulpmiddel controleert je GPU, geheugen en vrije ruimte en zegt of Llama 3.1 70B Instruct past voordat er iets wordt gedownload.

Wordt er iets van wat ik typ naar een server gestuurd?

Nee. Llama 3.1 70B Instruct draait op je eigen GPU in het browsertabblad. Het enige netwerkverkeer is de eenmalige download van de modelbestanden vanaf Hugging Face; je prompts en de antwoorden verlaten het apparaat nooit, en de chats staan in deze browser.

Hoe lang kan een gesprek met Llama 3.1 70B Instruct worden?

Het contextvenster is 4k tokens. Langere gesprekken blijven werken — de oudste beurten vallen met een melding weg zodra het gesprek niet meer past.

Onder welke licentie is Llama 3.1 70B Instruct uitgebracht?

De gewichten vallen onder Llama 3.1 Community License, overgenomen van de modelkaart van meta-llama/Meta-Llama-3.1-70B-Instruct. Controleer de licentie zelf voordat je het commercieel gebruikt.

Andere modellen Eerst dezelfde familie, dan dezelfde grootte

Alle 65 modellen Open de chat

Cijfers afgelezen uit de WebLLM 0.2.84-catalogus en de modelkaart op 2026-09-03.

/ai/browser-based-ai-chat
1 tool selected
Runs locally·The model downloads once·Your input never leaves
Out0 B
Ready