Saltar al contenido

Los mejores modelos de IA en local para 16 GB de VRAM

23 modelos abiertos caben en 16 GB de memoria gráfica en Q4_K_M con contexto de 8K; 7 tienen puntuación de inteligencia independiente. Aquí están clasificados, con el contexto más largo que admite cada uno.

Las mejores elecciones para 16 GB

Velocidades en RTX 5080, la tarjeta NVIDIA más reciente con esta memoria. El contexto máximo es el más largo que aún carga sin desbordar a la RAM.

Todos los modelos puntuados que caben en 16 GB

#ModeloECIMemoriaContexto máx.
1QwenQwen3.5 9B139,55,8 GB256K
2OpenAIgpt-oss 20b137,811,3 GB128K
3Mistral AIMagistral Small 2506133,214,9 GB8K
4Mistral AIMistral Small 3.2 24B131,714,9 GB8K
5Mistral AIMagistral Small 2509131,414,9 GB8K
6MicrosoftPhi-4 14B130,410,1 GB16K
7MetaLlama 3.1 8B116,65,9 GB64K

16 más que caben pero aún no tienen puntuación independiente

Los más grandes primero, con el contexto más largo que admite cada uno.

Memoria en Q4_K_M con contexto de 8K, incluidos los búferes del propio programa. Una cuantización menor cabe en menos; un contexto más largo necesita más.

Lo que añaden 24 GB

8 modelos puntuados más caben en 24 GB; abajo, los más inteligentes.

Ver la guía de 24 GB

Dispositivos con 16 GB