Votre IA. Votre matériel. Vos données.

Trouvez le bon PC pour exécuter votre LLM en local

Estimez la mémoire réellement nécessaire, puis comparez des systèmes complets selon la taille du modèle, la vitesse, l’encombrement et votre budget.

  • fonctionnement sans cloud
  • comparaison centrée sur la mémoire
  • critères transparents

Trois décisions essentielles

Un « PC IA » n’est pas forcément un bon PC pour LLM

Pour un modèle de langage local, les poids du modèle, le cache de contexte et la marge du logiciel doivent tenir ensemble dans une mémoire rapide. Le nombre de TOPS de la NPU ne répond pas à cette question et ne remplace ni la VRAM ni une grande mémoire unifiée.

01

Choisir la taille du modèle

Un modèle quantifié de 7B à 14B reste accessible. Les classes 20B à 32B demandent plus de mémoire, tandis qu’un 70B nécessite généralement une configuration de grande capacité.

02

Privilégier vitesse ou capacité

Une carte graphique haut de gamme est très rapide tant que le modèle tient dans sa VRAM. Une mémoire unifiée de 64 ou 128 Go accueille des modèles plus grands, avec un profil de performances différent.

03

Vérifier la configuration exacte

La quantité de mémoire réellement allouable, le refroidissement, le SSD, les emplacements d’extension et la compatibilité du moteur d’inférence comptent autant que le nom du processeur.

Repères de mémoire

Quelle capacité viser pour un LLM local ?

Comprendre la mémoire du modèle
16 Go

Modèles compacts

Un point de départ pratique pour de nombreux modèles 7B à 14B correctement quantifiés et un contexte raisonnable.

Chat · résumé · premiers assistants de code
64–128 Go

Grands modèles

La capacité recherchée pour beaucoup de modèles 70B quantifiés, les longs contextes ou une pile d’agents, selon le moteur utilisé.

70B · contexte long · services locaux

Ces valeurs incluent une marge pratique, mais ne constituent pas une garantie. L’architecture, la quantification, le contexte, le cache KV et le moteur d’inférence modifient la consommation réelle.

Systèmes complets à étudier

Comparez la capacité, la vitesse et l’écosystème logiciel avant de choisir. Les liens de disponibilité ouvrent une recherche correspondant au modèle dans la boutique de votre pays.

Voir le comparatif complet

Capacité · format compact

GMKtec EVO-X2

Ryzen AI Max+ 395, Radeon 8060S et configurations 64 ou 128 Go. Une piste sérieuse lorsque la capacité du modèle prime sur la vitesse maximale d’un GPU dédié. Lire le guide.

  • 64–128 Gomémoire unifiée
  • 2× M.2stockage évolutif
  • Compactfaible encombrement
Vérifier les configurations disponibles*

Capacité et réseau · compact

Beelink GTR9 Pro

Un système Ryzen AI Max+ 395 avec 128 Go et deux ports 10GbE, intéressant pour servir un modèle à plusieurs appareils du réseau local. Lire le guide.

  • 128 Gomémoire unifiée
  • 2× 10GbEréseau filaire
  • 2× USB4périphériques rapides
Vérifier les configurations disponibles*

Vitesse · tour de bureau

PC GeForce RTX 5090

Les 32 Go de VRAM conviennent aux modèles qui tiennent entièrement sur le GPU et aux charges où la vitesse par jeton est prioritaire. La mémoire système ne remplace pas la VRAM.

  • 32 GoVRAM dédiée
  • 64 Go+RAM conseillée
  • 2 To+SSD conseillé
Comparer les PC complets*

Écosystème NVIDIA · station IA

ASUS Ascent GX10

Le GB10 Grace Blackwell, ses 128 Go cohérents et son environnement Linux ciblent les travaux CUDA et les modèles volumineux. Ce n’est pas un PC Windows généraliste. Lire le guide.

  • 128 Gomémoire cohérente
  • Linux/Armplateforme de développement
  • Compactstation de bureau
Vérifier la disponibilité*

* Lien rémunéré. Si vous effectuez un achat, nous pouvons recevoir une commission ; votre prix reste inchangé. En tant que Partenaire Amazon, nous réalisons un bénéfice sur les achats remplissant les conditions requises. Vérifiez toujours la configuration exacte et le prix final chez le vendeur.

Votre usage décide

Du modèle au PC adapté en une minute

Le configurateur prend en compte la classe du modèle, le contexte, l’usage principal et votre priorité. Il fournit une classe matérielle expliquée et des systèmes concrets à comparer.

Calculer ma recommandation

Choisir selon l’objectif

Quel type de système vous aide réellement ?

Code et RAG rapides

Pour des modèles de 8B à 32B, une grande carte graphique dédiée offre souvent la meilleure vitesse si la charge tient dans sa VRAM.

Vérifier un PC RTX 5090

Exécuter un 70B chez soi

Une mémoire unifiée de 128 Go peut accueillir beaucoup de modèles 70B quantifiés avec une marge raisonnable, à une vitesse inférieure aux gros GPU professionnels.

Comparer les solutions 70B

Conserver plusieurs modèles

Deux téraoctets constituent un bon départ, mais plusieurs familles, quantifications et bases documentaires remplissent rapidement le SSD. Un second emplacement M.2 est précieux.

Comparer stockage et extensions