Los mejores modelos de IA en local para 8 GB de VRAM
15 modelos abiertos caben en 8 GB de memoria gráfica en Q4_K_M con contexto de 8K; 2 tienen puntuación de inteligencia independiente. Aquí están clasificados, con el contexto más largo que admite cada uno.
Las mejores elecciones para 8 GB
#1 · ECI 139,5
Qwen3.5 9B
- Memoria
- 5,8 GB
- Contexto máx.
- 32K
- Velocidad
- ~50 t/s
#2 · ECI 116,6
Llama 3.1 8B
- Memoria
- 5,9 GB
- Contexto máx.
- 16K
- Velocidad
- ~54 t/s
Velocidades en RTX 5060 Ti 8GB, la tarjeta NVIDIA más reciente con esta memoria. El contexto máximo es el más largo que aún carga sin desbordar a la RAM.
Todos los modelos puntuados que caben en 8 GB
| # | Modelo | ECI | Memoria | Contexto máx. |
|---|---|---|---|---|
| 1 | 139,5 | 5,8 GB | 32K | |
| 2 | 116,6 | 5,9 GB | 16K |
13 más que caben pero aún no tienen puntuación independiente
Los más grandes primero, con el contexto más largo que admite cada uno.
Ministral 3 8B8,9B · 8K
Granite 4.2 8B8,8B · 8K
Gemma 4 E4B8B · 128K
Olmo 3 7B7,3B · 8K
Gemma 4 E2B5,1B · 128K
Qwen3.5 4B4,7B · 128K
Ministral 3 3B3,9B · 32K
Granite 4.2 3B3,7B · 32K
Llama 3.2 3B3,2B · 32K
SmolLM3 3B3,1B · 64K
LFM2.5 2.6B2,7B · 128K
Qwen3.5 2B2,3B · 256K
Qwen3.5 0.8B0,9B · 256K
Memoria en Q4_K_M con contexto de 8K, incluidos los búferes del propio programa. Una cuantización menor cabe en menos; un contexto más largo necesita más.
Lo que añaden 12 GB
1 modelos puntuados más caben en 12 GB; abajo, los más inteligentes.
Ver la guía de 12 GB