Alternatives plus légères
Des modèles qui demandent moins de mémoire que Qwen3.5 4B et obtiennent un score proche ou meilleur.
Aucun modèle noté n’est à la fois plus léger et presque aussi intelligent que Qwen3.5 4B.
Qwen · 4,7B · Dense
Qwen3.5 4B est un modèle de 4,7B de Qwen avec un contexte de 256K tokens. En Q4_K_M avec 8K de contexte, il demande environ 3,1 Go ; 5 Go laissent de la marge pour les longues conversations.
| Quant. | Bits | Mémoire | Qualité | Sur votre matériel |
|---|---|---|---|---|
| Q2_K | 3,16 | — | Nettement moins bon | … |
| Q3_K_M | 4 | — | Légère perte | … |
| Q4_K_M | 4,89 | — | Bonne | … |
| Q5_K_M | 5,7 | — | Bonne | … |
| Q6_K | 6,56 | — | Quasi originale | … |
| Q8_0 | 8,5 | — | Quasi originale | … |
| F16 | 16 | — | Originale | … |
En Q4_K_M. Le cache du contexte grandit à chaque token que le modèle garde en tête.
| Contexte | Cache de contexte | Total |
|---|---|---|
| 4K | 0,1 GB | 3 GB |
| 8K | 0,3 GB | 3,1 GB |
| 32K | 1 GB | 3,9 GB |
| 128K | 4 GB | 6,9 GB |
| 256K | 8 GB | 10,9 GB |
Des modèles qui demandent moins de mémoire que Qwen3.5 4B et obtiennent un score proche ou meilleur.
Aucun modèle noté n’est à la fois plus léger et presque aussi intelligent que Qwen3.5 4B.
Des modèles notés de taille proche, côte à côte sur votre appareil.
Les appareils de bureau avec le moins de mémoire qui donnent à Qwen3.5 4B la note A ou S en Q4_K_M.
Oui, si votre GPU ou votre Mac dispose d'environ 3,1 Go libres en Q4_K_M. Ouvrez cette page sur cet ordinateur pour voir la note de votre matériel, puis lancez-le avec llama.cpp, Ollama ou LM Studio.
Environ 3,1 Go en Q4_K_M avec 8K de contexte et 4,7 Go en Q8_0. Les quantifications plus basses tiennent sur des cartes plus petites avec une perte de qualité ; les longs contextes s'ajoutent au total.