70B-Kaufberatung für zuhause

Welcher PC eignet sich für lokale 70B-LLMs?

Für ein quantisiertes 70B-Modell zählt zuerst die Speicherkapazität. 32 GB VRAM sind schnell, aber meist zu klein für Modell plus Kontext. Realistische Wege beginnen bei einer knappen 48-GB-Klasse und werden ab 64 bis 96 GB deutlich alltagstauglicher.

Warum die Datei nicht alles ist

Modellgewichte plus Kontext plus Reserve

Eine grobe Q4-Rechnung startet bei etwa einem halben Byte je Parameter. Bei 70 Milliarden Parametern sind das bereits rund 35 GB – vor Format-Overhead, KV-Cache, Runtime und Betriebssystem.

32 GB

Zu knapp für Vollbelegung

Teilweises GPU-Offloading ist möglich, verlagert aber Arbeit in langsameren System-RAM.

RTX 5090 · schnell bei kleineren Modellen
128 GB

Mehr Luft für den Gesamtstack

Gemeinsamer Systemspeicher schafft Reserve für RAG, Embeddings und weitere Dienste, ist aber nicht vollständig GPU-Speicher.

Kapazitätsfokus · genaue UMA-Grenze prüfen

MoE-Modelle, multimodale Encoder, extreme Kontextlängen und höhere Quantisierungen können deutlich mehr Speicher verlangen. Prüfe immer die konkrete Modelldatei und Runtime.

Drei realistische Wege

Kapazität, Tempo und Preis gegeneinander abwägen

128 GB Unified Memory

Stärke: viel Modellkapazität in einem kompakten Komplettsystem. Kompromiss: geringere Bandbreite als eine große diskrete GPU und eine feste Obergrenze für den GPU-Anteil.

Passend für: private 70B-Assistenten, lokale Wissenssysteme und moderate Einzelplatznutzung.

Ryzen-AI-Max-PCs vergleichen

96 GB diskreter VRAM

Stärke: Modell und großer Kontext können vollständig auf einer sehr schnellen GPU liegen. Kompromiss: professionelle Workstations kosten erheblich mehr und benötigen starke Kühlung sowie Stromversorgung.

Passend für: intensive professionelle Nutzung, große Kontexte und hohen Durchsatz.

RTX PRO 6000 mit 96 GB prüfen

32 GB GPU plus System-RAM

Stärke: sehr schnell für kleinere Modelle und bereits vorhandene Hardware kann genutzt werden. Kompromiss: 70B benötigt Teil-Offload; PCIe und CPU-RAM bremsen die Ausgabe.

Passend für: gelegentliche 70B-Nutzung, wenn 8B bis 32B der Alltag bleiben.

RTX-5090-Pfad verstehen

Klare Kaufentscheidung

Welcher Weg passt zu welchem Ziel?

PrioritätEmpfohlener PfadWichtigste Kontrolle
70B möglichst kompakt128 GB Unified Memorymaximale UMA-Zuweisung und Runtime-Support
Hohes Tempo und DauerbetriebWorkstation mit 96 GB VRAMexakte GPU, Netzteil, Kühlung und Service
Meist 8B–32B, selten 70BRTX 5090 + 128 GB System-RAMOffload-Unterstützung und erwartetes Tempo
Kleines Budget, Geduld vorhandenCPU-Inferenz mit 128 GB RAMSpeicherbandbreite; deutlich geringeres Tempo akzeptieren
Mehrere gleichzeitige Nutzerprofessionelle GPU-/ServerklasseKV-Cache pro Sitzung und Batch-Verhalten

Komplettsystem auswählen

Unser sinnvoller Startpunkt für zuhause

Wenn lokale 70B-Nutzung das Hauptziel und Spitzentempo zweitrangig ist, ist ein 128-GB-Unified-Memory-System der geradlinigste Komplettsystem-Pfad. Für beruflich zeitkritische Nutzung ist großer diskreter VRAM technisch stärker, aber in einer anderen Preisklasse.

Kapazitätsfokus für zuhause

MINISFORUM MS-S1 Max · 128 GB

Kompaktes System mit Ryzen AI Max+ 395, Radeon 8060S und großem gemeinsamen Speicherpool.

128 GB

Warum dieser Pfad

Die Konfiguration vermeidet einen Multi-GPU-Aufbau und bietet ausreichend Gesamtspeicher für viele quantisierte 70B-Modelle, Kontext und Systemreserve. Zwei 10-GbE-Ports eignen sich zudem für NAS-Speicher oder mehrere Clients im Heimnetz.

Wichtiger Kompromiss

Der fest verlötete Speicher ist nicht erweiterbar, und die Radeon 8060S liefert nicht das Tempo einer großen diskreten GPU. Prüfe vorab die maximale UMA-Zuweisung sowie HIP- oder Vulkan-Unterstützung deiner Runtime.

CPU / Grafik
Ryzen AI Max+ 395 / Radeon 8060S
Speicher
128 GB LPDDR5X, gemeinsam
SSD-Ausbau
2× M.2 2280; 2 TB enthalten
Netzwerk
2× 10GbE, Wi-Fi 7
Anschlüsse
4× USB4, HDMI 2.1, PCIe-Steckplatz
Stromversorgung
internes 320-W-Netzteil

* Werbelink. Bei einem Kauf können wir eine Provision erhalten; dein Preis bleibt unverändert. Als Amazon-Partner verdiene ich an qualifizierten Verkäufen. Die Zielseite ist für die aktuelle Konfiguration und Lieferinformation maßgeblich.

Vor der Auswahl

Berechne Modell und Kontext gemeinsam

Unser Finder liefert eine konservative Speicherklasse. Für 70B solltest du anschließend die tatsächliche GGUF-Dateigröße und den geplanten Kontext in deiner Runtime kontrollieren.

PC-Finder starten