Viel Modellspeicher auf kleinem Raum

KI-Mini-PCs für lokale LLMs: 64 oder 128 GB?

Ein guter KI-Mini-PC wird nicht durch eine NPU-Zahl definiert, sondern durch den für das Modell nutzbaren schnellen Speicher, ein unterstütztes GPU-Backend, ausreichende SSD-Kapazität und eine Kühlung, die längere Inferenzlast trägt.

Die schnelle Auswahl

Welche Mini-PC-Klasse passt zu deinem Modell?

64 GB: kompakter 32B-PC

Sinnvoll für viele quantisierte 20B- bis 32B-Modelle, lokale RAG-Anwendungen und große Kontexte. Für 70B bleibt nach Betriebssystem und Runtime meist zu wenig Reserve.

Guter Fit: 14B bis 32B

128 GB: 70B mit Reserve

Die kapazitätsstarke Wahl für quantisierte 70B-Modelle, mehrere lokale Dienste oder große Wissenssammlungen. Der Arbeitsspeicher ist in der Regel verlötet.

Guter Fit: 32B bis 70B

NVIDIA-Appliance: anderer Fokus

Der ASUS Ascent GX10 verbindet 128 GB mit dem NVIDIA-Stack. Dafür musst du Arm64, Linux, geschlossene Hardware und den höheren Preis bewusst wählen.

Guter Fit: CUDA-nahe Entwicklung
Mini-PC, GPU-Tower und kompakte KI-Appliance im Größenvergleich
Mini-PC oder Tower: Unified-Memory-Systeme bieten viel Kapazität in einem kleinen Gehäuse; ein großer GPU-Tower priorisiert Bandbreite, Kühlung und Aufrüstbarkeit.

Speicher statt Schlagwort

Modellgröße und sinnvolle Gesamtkapazität

Die Bereiche gelten grob für Q4-ähnliche Textmodelle mit Reserve. Kontext, Bildencoder, parallele Nutzer und das Betriebssystem können den Bedarf erhöhen.

ModellklasseSinnvolle Mini-PC-KapazitätWarum
7B bis 14B32 GB oder mehrGenug Platz für Modell, normalen Kontext und Desktop-Nutzung; 64 GB schaffen Reserve für weitere Dienste.
20B bis 32B64 GBModellgewichte, KV-Cache und Runtime passen mit alltagstauglicher Reserve in einen gemeinsamen Pool.
65B bis 70B128 GBViele Q4-Varianten benötigen etwa 40 bis 45 GB nur für Gewichte; Kontext und Systemlast kommen hinzu.
über 70B128 GB, genau rechnenQuantisierung, Architektur und Kontext entscheiden. „Passt“ bedeutet nicht automatisch angenehmes Tempo.

Konkrete Komplettsysteme

Drei KI-Mini-PCs mit klarer Aufgabe

Vergleiche immer die exakte Speicher- und SSD-Konfiguration. Gleiche Modellnamen werden häufig mit deutlich unterschiedlichen Ausstattungen angeboten.

Kapazität und Heimserver

MINISFORUM MS-S1 Max

128 GB Unified Memory, 2 TB SSD und zwei 10-GbE-Anschlüsse.

128 GB

Warum wählen?

Eine starke Kombination für quantisierte 70B-Modelle, große Modellbibliotheken und mehrere Geräte im Heimnetz. Das interne 320-W-Netzteil und die Netzwerkanschlüsse machen das System servernäher als typische Mini-PCs.

Vor dem Kauf

128 GB / 2 TB exakt bestätigen. Der LPDDR5X-Speicher ist fest verbaut; UMA-Zuweisung, Radeon-Backend und Lautstärke unter Dauerlast bleiben wichtige Prüfungen.

CPU / Grafik
Ryzen AI Max+ 395 / Radeon 8060S
Speicher
128 GB LPDDR5X, gemeinsam
SSD
2 TB; zweiter M.2-Steckplatz
Netzwerk
2× 10GbE, Wi-Fi 7

Kompakter 32B-Einstieg

GMKtec EVO-X2

64 GB Unified Memory und 1 TB SSD in einem kompakten Ryzen-AI-Max+-PC.

64 GB

Warum wählen?

Gut für lokale 20B- bis 32B-Modelle, einen leisen Schreibtisch und eine später ergänzte Modell-SSD. Zwei USB4-Ports und zwei M.2-Steckplätze erhöhen den Alltagsnutzen.

Vor dem Kauf

Die 64 GB sind fest verbaut und nicht vollständig für das Modell frei. Die verlinkte 64-GB-/1-TB-Variante nicht mit kleineren oder 128-GB-Angeboten verwechseln.

CPU / Grafik
Ryzen AI Max+ 395 / Radeon 8060S
Speicher
64 GB LPDDR5X, gemeinsam
SSD
1 TB; zweiter M.2-Steckplatz
Netzwerk
2,5GbE, Wi-Fi 7

Business-Workstation

HP Z2 Mini G1a

64 GB Unified Memory, 2 TB SSD und Ryzen AI Max+ PRO 395.

64 GB

Warum wählen?

Die kompakte Workstation passt zu professionellen Arbeitsplätzen, die Thunderbolt 4, ein internes Netzteil und ein eindeutig dokumentiertes Business-Modell schätzen.

Vor dem Kauf

Für 70B ist die 64-GB-Version zu knapp. Prüfe A40MYET#ABD, 64 GB, 2 TB und die geltenden Garantiebedingungen; der Arbeitsspeicher ist nicht aufrüstbar.

CPU / Grafik
Ryzen AI Max+ PRO 395 / Radeon 8060S
Speicher
64 GB LPDDR5X-8533, gemeinsam
SSD
2 TB; zwei M.2-2280-Steckplätze
Anschlüsse
2× Thunderbolt 4, 2,5GbE, Wi-Fi 7

* Werbelink. Bei einem Kauf können wir eine Provision erhalten; dein Preis bleibt unverändert. Als Amazon-Partner verdienen wir an qualifizierten Verkäufen. Exakte Ausstattung, Verkäufer, Preis und Lieferbarkeit bitte auf der Zielseite prüfen.

Vier kompakte Hardwarewege

Welches System löst welches Problem?

SystemSchneller SpeicherBesonders passendWichtigste Grenze
MINISFORUM MS-S1 Max128 GB gemeinsam70B, 10-GbE-Heimserver, große Modellbibliothekfest verbauter Speicher; Radeon-Backend
GMKtec EVO-X264 GB gemeinsamkompakte 20B- bis 32B-Nutzung70B zu knapp; 1-TB-Basis
HP Z2 Mini G1a64 GB gemeinsam32B-Arbeitsplatz mit Business-Ausstattungfest verbauter Speicher; höherer Support-Aufpreis
ASUS Ascent GX10128 GB kohärentNVIDIA-Stack und große lokale ModelleArm/Linux; SSD nicht für Nutzerwechsel

Kaufcheck

Sieben Angaben, die im Angebot stehen müssen

Exakte RAM-Kapazität

64 und 128 GB sind nicht nachrüstbar. Kaufe die spätere Zielkapazität sofort.

UMA-/VGM-Grenze

Prüfe BIOS, Treiber und die maximal der Grafik zuweisbare Speichermenge für genau dieses System.

Runtime-Support

Ollama, LM Studio und llama.cpp unterstützen nicht jede GPU unter jedem Betriebssystem gleich gut.

SSD und zweiter Slot

2 TB sind der praktischere Start für mehrere große Modelle; ein zweiter M.2-Slot erleichtert spätere Erweiterungen.

Dauerlast-Kühlung

Lies Leistungsprofile und Lüftersteuerung. Ein kurzer Benchmark sagt wenig über lange Inferenzsitzungen.

Netzwerk

2,5GbE genügt vielen Einzelplätzen; 10GbE lohnt sich für NAS-Daten und mehrere lokale Clients.

Modellnummer

Gleiche Produktfamilien enthalten verschiedene RAM-, SSD- und Betriebssystemvarianten.

Garantiegebiet

Importmodell, Netzteil, Tastaturlayout, Rückgabe und Vor-Ort-Service vor dem Kauf abgleichen.

KI-Mini-PC

Viel gemeinsamer Speicher, geringer Platzbedarf und meist niedrigere Leistungsaufnahme. Besonders attraktiv, wenn ein großes Modell wichtiger ist als höchste Tokenrate.

  • 64 bis 128 GB im kleinen Gehäuse
  • Arbeitsspeicher meist verlötet
  • Backend und UMA-Konfiguration prüfen

RTX-5090-Tower

32 GB fester VRAM, hohe Bandbreite und breite CUDA-Unterstützung. Die bessere Wahl für besonders schnelle 8B- bis 32B-Inferenz und spätere Komponentenwechsel.

  • hohes Tempo bei passendem Modell
  • mehr Platz, Strom und Kühlung
  • 70B meist nur mit Offload
RTX-5090-PCs genauer prüfen

Häufige Fragen

KI-Mini-PCs im praktischen Einsatz

Reichen 64 GB für ein lokales 70B-LLM?

Manche stark quantisierten Varianten können rechnerisch starten, doch Betriebssystem, Runtime und Kontext lassen wenig Reserve. Für eine belastbare 70B-Planung ist 128 GB die passendere Klasse.

Ist Unified Memory dasselbe wie VRAM?

Nein. CPU und integrierte GPU teilen einen gemeinsamen Pool. Wie viel davon die GPU und Runtime praktisch verwenden können, hängt von System, BIOS, Treiber und Backend ab.

Kann ein Mini-PC als lokaler KI-Server laufen?

Ja. Achte dann besonders auf Dauerlast-Kühlung, API-Schutz, Netzwerkgeschwindigkeit, SSD-Kapazität und den Strombedarf im Leerlauf.

Brauche ich eine NPU für lokale LLMs?

Für die hier betrachteten großen Sprachmodelle sind schneller Modell-RAM und ein unterstütztes GPU-Backend wichtiger. Eine NPU-Zahl allein sagt nicht, welche LLM-Größe praktisch läuft.

Technische Primärquellen

Speicher und Software selbst prüfen

AMD nennt für Ryzen AI Max+ 395 bis zu 128 GB Systemspeicher und bis zu 96 GB Variable Graphics Memory. Die aktuelle AMD-Produktspezifikation sowie die Ollama-Hardwareliste helfen beim Abgleich. Die konkrete Gehäuse-, SSD- und Anschlussausstattung bleibt Sache des jeweiligen Systemherstellers.