Saltar al contenido

Los mejores modelos de IA en local para 48 GB de VRAM

39 modelos abiertos caben en 48 GB de memoria gráfica en Q4_K_M con contexto de 8K; 16 tienen puntuación de inteligencia independiente. Aquí están clasificados, con el contexto más largo que admite cada uno.

Las mejores elecciones para 48 GB

Velocidades en RTX A6000, la tarjeta NVIDIA más reciente con esta memoria. El contexto máximo es el más largo que aún carga sin desbordar a la RAM.

Todos los modelos puntuados que caben en 48 GB

#ModeloECIMemoriaContexto máx.
1QwenQwen3.8 27B149,417 GB256K
2QwenQwen3.6 27B146,516,5 GB256K
3QwenQwen3.6 35B A3B143,921,2 GB256K
4GoogleGemma 4 31B142,718,8 GB256K
5QwenQwen3.5 35B A3B142,521 GB256K
6GoogleGemma 4 26B A4B141,916,5 GB256K
7QwenQwen3 30B A3B Thinking 2507139,618,3 GB256K
8QwenQwen3.5 9B139,55,8 GB256K
9OpenAIgpt-oss 20b137,811,3 GB128K
10QwenQwen3 30B A3B 2507137,418,3 GB256K
11Mistral AIMagistral Small 2506133,214,9 GB32K
12Mistral AIMistral Small 3.2 24B131,714,9 GB128K
13Mistral AIMagistral Small 2509131,414,9 GB128K
14MicrosoftPhi-4 14B130,410,1 GB16K
15MetaLlama 3.3 70B127,342,4 GB16K
16MetaLlama 3.1 8B116,65,9 GB128K

23 más que caben pero aún no tienen puntuación independiente

Los más grandes primero, con el contexto más largo que admite cada uno.

Memoria en Q4_K_M con contexto de 8K, incluidos los búferes del propio programa. Una cuantización menor cabe en menos; un contexto más largo necesita más.

Dispositivos con 48 GB