Saltar al contenido

Los mejores modelos de IA en local para 24 GB de VRAM

35 modelos abiertos caben en 24 GB de memoria gráfica en Q4_K_M con contexto de 8K; 15 tienen puntuación de inteligencia independiente. Aquí están clasificados, con el contexto más largo que admite cada uno.

Las mejores elecciones para 24 GB

Velocidades en RTX 3090 Ti, la tarjeta NVIDIA más reciente con esta memoria. El contexto máximo es el más largo que aún carga sin desbordar a la RAM.

Todos los modelos puntuados que caben en 24 GB

#ModeloECIMemoriaContexto máx.
1QwenQwen3.8 27B149,417 GB64K
2QwenQwen3.6 27B146,516,5 GB64K
3QwenQwen3.6 35B A3B143,921,2 GB64K
4GoogleGemma 4 31B142,718,8 GB32K
5QwenQwen3.5 35B A3B142,521 GB64K
6GoogleGemma 4 26B A4B141,916,5 GB256K
7QwenQwen3 30B A3B Thinking 2507139,618,3 GB32K
8QwenQwen3.5 9B139,55,8 GB256K
9OpenAIgpt-oss 20b137,811,3 GB128K
10QwenQwen3 30B A3B 2507137,418,3 GB32K
11Mistral AIMagistral Small 2506133,214,9 GB32K
12Mistral AIMistral Small 3.2 24B131,714,9 GB32K
13Mistral AIMagistral Small 2509131,414,9 GB32K
14MicrosoftPhi-4 14B130,410,1 GB16K
15MetaLlama 3.1 8B116,65,9 GB128K

20 más que caben pero aún no tienen puntuación independiente

Los más grandes primero, con el contexto más largo que admite cada uno.

Memoria en Q4_K_M con contexto de 8K, incluidos los búferes del propio programa. Una cuantización menor cabe en menos; un contexto más largo necesita más.

Dispositivos con 24 GB