Elige el tamaño del modelo
Un modelo 8B cuantizado ocupa poco. Los modelos 32B y 70B pueden ofrecer más capacidad, pero exigen bastante más memoria.
IA local. Tu hardware. Tus datos.
Calcula cuánta memoria rápida necesita realmente tu modelo y compara sistemas completos por tamaño de modelo, velocidad, formato y presupuesto.
Elegir bien en tres pasos
Los pesos del modelo, la caché de contexto y el margen operativo deben caber juntos en memoria rápida. La cifra TOPS de la NPU no responde a esa pregunta.
Un modelo 8B cuantizado ocupa poco. Los modelos 32B y 70B pueden ofrecer más capacidad, pero exigen bastante más memoria.
Una GPU dedicada potente da más velocidad. Mucha memoria unificada admite modelos mayores, aunque con un perfil de rendimiento distinto.
Refrigeración, límite UMA, SSD, ampliación y configuración exacta importan tanto como el nombre del procesador.
Clases de memoria
Un comienzo práctico para muchos modelos 7B–14B cuantizados y una longitud de contexto normal.
Chat · resúmenes · primer asistente de códigoAdecuado para modelos 20B–32B cuantizados o varios componentes pequeños con margen útil.
Programación · RAG · agentesLa clase de capacidad para modelos 70B y contextos largos, según el motor y la cuantización.
70B · contexto largo · varios serviciosLos intervalos incluyen una reserva práctica, pero no son una garantía. Arquitectura, cuantización, caché KV y motor cambian el consumo real.
Sistemas completos concretos
Compara dos mini PC Ryzen AI Max+ con mucha memoria, una workstation profesional y un sistema NVIDIA pensado para desarrollo de IA.
Capacidad · formato compacto
Ryzen AI Max+ 395, 128 GB de memoria unificada y una configuración de 2 TB para modelos cuantizados grandes en poco espacio.
Capacidad y red · compacto
Un sistema de 128 GB, SSD de 2 TB y doble 10GbE para compartir un LLM con varios equipos de casa.
Workstation · soporte profesional
Ryzen AI Max+ PRO 395, hasta 128 GB, fuente interna y Thunderbolt 4 en una carcasa profesional compacta.
Entorno NVIDIA · sistema de IA
GB10 Grace Blackwell, 128 GB de memoria coherente y entorno NVIDIA sobre Ubuntu. Está pensado para CUDA, no como PC Windows convencional.
* Enlace publicitario. Podemos recibir una comisión si compras; tu precio no cambia. Como Afiliados de Amazon, obtenemos ingresos por las compras que cumplen los requisitos aplicables. Comprueba siempre la configuración exacta y la disponibilidad con el vendedor.
Empieza por tu carga de trabajo
El buscador usa clase de modelo, contexto, aplicación y prioridad. Obtendrás una clase de hardware explicada y sistemas concretos compatibles.
Elige según tu objetivo
Para 8B–32B, una RTX 5090 con 32 GB de VRAM prioriza la velocidad. Combínala con al menos 64 GB de RAM y 2 TB NVMe.
Qué comprobar en un PC RTX 5090128 GB de memoria unificada pueden albergar muchos modelos 70B cuantizados con margen, aunque la velocidad sea menor que con grandes GPU profesionales.
Comparar opciones para 70BUn SSD de 2 TB es un buen comienzo. Varias familias, cuantizaciones y datos RAG lo llenan rápido; comprueba la segunda ranura M.2.
Comparar almacenamiento y ampliación