Zum Inhalt

Die besten lokalen KI-Modelle für 16 GB VRAM

23 offene Modelle passen bei Q4_K_M mit 8K Kontext in 16 GB Grafikspeicher; 7 davon haben eine unabhängige Intelligenzbewertung. Hier sind sie gerankt, mit dem längsten Kontext, den jedes schafft.

Die besten Wahlen für 16 GB

Tempo auf RTX 5080, der neuesten NVIDIA-Karte mit so viel Speicher. Max. Kontext ist der längste, der noch ohne Auslagern in den RAM lädt.

Alle bewerteten Modelle, die in 16 GB passen

#ModellECISpeicherMax. Kontext
1QwenQwen3.5 9B139,55,8 GB256K
2OpenAIgpt-oss 20b137,811,3 GB128K
3Mistral AIMagistral Small 2506133,214,9 GB8K
4Mistral AIMistral Small 3.2 24B131,714,9 GB8K
5Mistral AIMagistral Small 2509131,414,9 GB8K
6MicrosoftPhi-4 14B130,410,1 GB16K
7MetaLlama 3.1 8B116,65,9 GB64K

16 weitere, die passen, aber noch keine unabhängige Bewertung haben

Größte zuerst, mit dem längsten Kontext, den jedes schafft.

Speicher bei Q4_K_M mit 8K Kontext, inklusive der Puffer der Software. Kleinere Quantisierung braucht weniger, längerer Kontext mehr.

Was 24 GB dazu bringen

8 weitere bewertete Modelle passen in 24 GB; die intelligentesten davon unten.

Zum 24-GB-Ratgeber

Geräte mit 16 GB