Saltar al contenido

Los mejores modelos de IA en local para 32 GB de VRAM

37 modelos abiertos caben en 32 GB de memoria gráfica en Q4_K_M con contexto de 8K; 15 tienen puntuación de inteligencia independiente. Aquí están clasificados, con el contexto más largo que admite cada uno.

Las mejores elecciones para 32 GB

Velocidades en RTX 5090, la tarjeta NVIDIA más reciente con esta memoria. El contexto máximo es el más largo que aún carga sin desbordar a la RAM.

Todos los modelos puntuados que caben en 32 GB

#ModeloECIMemoriaContexto máx.
1QwenQwen3.8 27B149,417 GB128K
2QwenQwen3.6 27B146,516,5 GB128K
3QwenQwen3.6 35B A3B143,921,2 GB256K
4GoogleGemma 4 31B142,718,8 GB128K
5QwenQwen3.5 35B A3B142,521 GB256K
6GoogleGemma 4 26B A4B141,916,5 GB256K
7QwenQwen3 30B A3B Thinking 2507139,618,3 GB128K
8QwenQwen3.5 9B139,55,8 GB256K
9OpenAIgpt-oss 20b137,811,3 GB128K
10QwenQwen3 30B A3B 2507137,418,3 GB128K
11Mistral AIMagistral Small 2506133,214,9 GB32K
12Mistral AIMistral Small 3.2 24B131,714,9 GB64K
13Mistral AIMagistral Small 2509131,414,9 GB64K
14MicrosoftPhi-4 14B130,410,1 GB16K
15MetaLlama 3.1 8B116,65,9 GB128K

22 más que caben pero aún no tienen puntuación independiente

Los más grandes primero, con el contexto más largo que admite cada uno.

Memoria en Q4_K_M con contexto de 8K, incluidos los búferes del propio programa. Una cuantización menor cabe en menos; un contexto más largo necesita más.

Lo que añaden 48 GB

1 modelos puntuados más caben en 48 GB; abajo, los más inteligentes.

Ver la guía de 48 GB

Dispositivos con 32 GB