Aller au contenu

Les meilleurs modèles d'IA en local pour 32 Go de VRAM

37 modèles ouverts tiennent dans 32 Go de mémoire graphique en Q4_K_M avec un contexte de 8K ; 15 ont un score d’intelligence indépendant. Les voici classés, avec le contexte le plus long que chacun accepte.

Les meilleurs choix pour 32 Go

Vitesses sur RTX 5090, la carte NVIDIA la plus récente avec cette mémoire. Le contexte max. est le plus long qui se charge encore sans déborder dans la RAM.

Tous les modèles notés qui tiennent dans 32 Go

#ModèleECIMémoireContexte max.
1QwenQwen3.8 27B149,417 GB128K
2QwenQwen3.6 27B146,516,5 GB128K
3QwenQwen3.6 35B A3B143,921,2 GB256K
4GoogleGemma 4 31B142,718,8 GB128K
5QwenQwen3.5 35B A3B142,521 GB256K
6GoogleGemma 4 26B A4B141,916,5 GB256K
7QwenQwen3 30B A3B Thinking 2507139,618,3 GB128K
8QwenQwen3.5 9B139,55,8 GB256K
9OpenAIgpt-oss 20b137,811,3 GB128K
10QwenQwen3 30B A3B 2507137,418,3 GB128K
11Mistral AIMagistral Small 2506133,214,9 GB32K
12Mistral AIMistral Small 3.2 24B131,714,9 GB64K
13Mistral AIMagistral Small 2509131,414,9 GB64K
14MicrosoftPhi-4 14B130,410,1 GB16K
15MetaLlama 3.1 8B116,65,9 GB128K

22 autres qui tiennent mais n’ont pas encore de score indépendant

Les plus gros d’abord, avec le contexte le plus long que chacun accepte.

Mémoire en Q4_K_M avec un contexte de 8K, tampons du logiciel compris. Une quantification plus petite tient dans moins ; un contexte plus long demande plus.

Ce qu’apportent 48 Go

1 modèles notés de plus tiennent dans 48 Go ; les plus intelligents ci-dessous.

Voir le guide 48 Go

Appareils avec 32 Go