Kies de modelgrootte
Een gekwantiseerd 8B-model vraagt weinig ruimte. 32B en 70B kunnen meer, maar hebben duidelijk meer geheugen nodig.
Lokale AI. Jouw hardware. Jouw gegevens.
Bereken hoeveel snel geheugen je model werkelijk nodig heeft en vergelijk complete systemen op modelgrootte, snelheid, formaat en budget.
In drie stappen goed kiezen
Modelgewichten, contextcache en werkruimte moeten samen in het snelle geheugen passen. Alleen het TOPS-getal van de NPU vertelt je dat niet.
Een gekwantiseerd 8B-model vraagt weinig ruimte. 32B en 70B kunnen meer, maar hebben duidelijk meer geheugen nodig.
Een krachtige losse GPU levert hoge snelheid. Veel unified memory kan grotere modellen bevatten, met een ander prestatieprofiel.
Koeling, UMA-limiet, SSD, uitbreidbaarheid en de exacte configuratie zijn net zo belangrijk als de processornaam.
Geheugenklassen
Een praktisch begin voor veel gekwantiseerde 7B–14B-modellen en een normale contextlengte.
Chat · samenvatten · eerste code-assistentGeschikt voor gekwantiseerde 20B–32B-modellen of meerdere kleine componenten met nuttige reserve.
Programmeren · RAG · agentsDe capaciteitsklasse voor 70B-modellen en lange context, afhankelijk van runtime en kwantisatie.
70B · lange context · meerdere dienstenDe bereiken bevatten een praktische reserve, maar zijn geen garantie. Architectuur, kwantisatie, KV-cache en runtime veranderen het werkelijke verbruik.
Concrete complete systemen
Vergelijk twee Ryzen AI Max+ mini-pc's met veel geheugen, een professioneel workstation en een NVIDIA-systeem voor AI-ontwikkeling.
Capaciteit · compact formaat
Ryzen AI Max+ 395, 128 GB unified memory en een configuratie met 2 TB: bedoeld voor grote gekwantiseerde modellen in een klein formaat.
Capaciteit en netwerk · compact
Een 128GB-systeem met 2TB-SSD en dubbele 10GbE, geschikt om één LLM aan meerdere apparaten in huis beschikbaar te stellen.
Workstation · zakelijke ondersteuning
Ryzen AI Max+ PRO 395, maximaal 128 GB, interne voeding en Thunderbolt 4 in een compacte zakelijke behuizing.
NVIDIA-stack · AI-systeem
GB10 Grace Blackwell, 128 GB coherent geheugen en een NVIDIA-omgeving op Ubuntu. Bedoeld voor CUDA, niet als gewone Windows-pc.
* Advertentielink. Bij een aankoop kunnen wij een commissie ontvangen; je prijs blijft hetzelfde. Als Amazon-partner verdienen wij aan in aanmerking komende aankopen. Controleer altijd de exacte configuratie en beschikbaarheid bij de verkoper.
Begin bij jouw workload
De pc-kiezer gebruikt modelklasse, context, toepassing en prioriteit. Je krijgt een verklaarde hardwareklasse en concrete compatibele systemen.
Kies op basis van je doel
Voor 8B–32B geeft een RTX 5090 met 32 GB VRAM voorrang aan snelheid. Combineer die met minimaal 64 GB RAM en 2 TB NVMe.
Controlepunten voor een RTX 5090-pc128 GB unified memory kan veel gekwantiseerde 70B-modellen met reserve bevatten, al blijft de snelheid lager dan bij grote professionele GPU's.
Vergelijk opties voor 70BEen SSD van 2 TB is een goed begin. Meerdere families, kwantisaties en RAG-data vullen hem snel; controleer daarom het tweede M.2-slot.
Vergelijk opslag en uitbreiding