Aller au contenu

Les meilleurs modèles d'IA en local pour 16 Go de VRAM

23 modèles ouverts tiennent dans 16 Go de mémoire graphique en Q4_K_M avec un contexte de 8K ; 7 ont un score d’intelligence indépendant. Les voici classés, avec le contexte le plus long que chacun accepte.

Les meilleurs choix pour 16 Go

Vitesses sur RTX 5080, la carte NVIDIA la plus récente avec cette mémoire. Le contexte max. est le plus long qui se charge encore sans déborder dans la RAM.

Tous les modèles notés qui tiennent dans 16 Go

#ModèleECIMémoireContexte max.
1QwenQwen3.5 9B139,55,8 GB256K
2OpenAIgpt-oss 20b137,811,3 GB128K
3Mistral AIMagistral Small 2506133,214,9 GB8K
4Mistral AIMistral Small 3.2 24B131,714,9 GB8K
5Mistral AIMagistral Small 2509131,414,9 GB8K
6MicrosoftPhi-4 14B130,410,1 GB16K
7MetaLlama 3.1 8B116,65,9 GB64K

16 autres qui tiennent mais n’ont pas encore de score indépendant

Les plus gros d’abord, avec le contexte le plus long que chacun accepte.

Mémoire en Q4_K_M avec un contexte de 8K, tampons du logiciel compris. Une quantification plus petite tient dans moins ; un contexte plus long demande plus.

Ce qu’apportent 24 Go

8 modèles notés de plus tiennent dans 24 Go ; les plus intelligents ci-dessous.

Voir le guide 24 Go

Appareils avec 16 Go