Kleinere Alternativen
Modelle, die weniger Speicher als Mistral Medium 3.5 128B brauchen und etwa gleich gut oder besser abschneiden.
Mistral AI · 127,7B · Dense
Mistral Medium 3.5 128B ist ein 127,7B-Modell von Mistral AI mit 256K Token Kontext. In Q4_K_M mit 8K Kontext braucht es etwa 72,8 GB; mit 93 GB bleibt Luft für lange Chats.
| Quant. | Bits | Speicher | Qualität | Auf deiner Hardware |
|---|---|---|---|---|
| Q2_K | 3,16 | — | Spürbar schlechter | … |
| Q3_K_M | 4 | — | Etwas Verlust | … |
| Q4_K_M | 4,89 | — | Gut | … |
| Q5_K_M | 5,7 | — | Gut | … |
| Q6_K | 6,56 | — | Fast original | … |
| Q8_0 | 8,5 | — | Fast original | … |
| F16 | 16 | — | Original | … |
In Q4_K_M. Der Kontext-Cache wächst mit jedem Token, das das Modell im Blick behält.
| Kontext | Kontext-Cache | Gesamt |
|---|---|---|
| 4K | 1,4 GB | 71,4 GB |
| 8K | 2,8 GB | 72,8 GB |
| 32K | 11 GB | 81,1 GB |
| 128K | 44 GB | 114,1 GB |
| 256K | 88 GB | 158,1 GB |
Modelle, die weniger Speicher als Mistral Medium 3.5 128B brauchen und etwa gleich gut oder besser abschneiden.
Bewertete Modelle ähnlicher Größe, nebeneinander auf deinem Gerät.
Desktop-Geräte mit dem wenigsten Speicher, die Mistral Medium 3.5 128B bei Q4_K_M Note A oder S geben.
Kein Desktop-Gerät in unserem Katalog erreicht damit Note A oder besser.
Ja, wenn deine GPU oder dein Mac in Q4_K_M etwa 72,8 GB frei hat. Öffne diese Seite auf dem Rechner, um die Note für deine Hardware zu sehen, und starte es mit llama.cpp, Ollama oder LM Studio.
Etwa 72,8 GB in Q4_K_M mit 8K Kontext und 126,8 GB in Q8_0. Niedrigere Quantisierungen passen auf kleinere Karten, mit etwas Qualitätsverlust; längerer Kontext kommt hinzu.
Deine Privatsphäre
Wir nutzen PostHog, um zu verstehen, wie die Seite genutzt wird, und sie zu verbessern. Wenn du zustimmst, speichert es eine Kennung in deinem Browser und zeichnet deine Sitzung auf (Textfelder bleiben verborgen). Wenn du ablehnst, zählen wir den Besuch nur anonym, ohne Cookies. Du kannst das jederzeit im Fußbereich ändern.