Vramwise: wissen, ob ein LLM auf Ihre GPU passt
Vramwise prüft anhand der aktuellen Hugging-Face-Konfiguration des Modells, ob ein LLM auf Ihre GPU, Ihren Mac oder Mini-PC passt (VRAM, KV-Cache und Geschwindigkeit), in Ihrem Browser.
Das Wichtigste
- Was es ist
- VRAM-Rechner für Sprachmodelle (LLM) auf GPU, Mac und Mini-PC, im Browser.
- Preis
- ab 5 US$ · 5 US$ einmalig
- Kostenlos
- Die Prüfung selbst: jedes Modell, jede gelistete GPU, jeder Mac oder Mini-PC, ohne Konto.
- Grenzen
- Eine Schätzung aus der Modellkonfiguration und den veröffentlichten Hardwaredaten, kein Benchmark. Pro (einmalig 5 US$): Tabelle als Markdown kopieren oder als .md-Datei laden.
- Sprache
- Die App ist auf Englisch. Preise in US-Dollar (USD).
- Zuletzt aktualisiert
Pläne und PreiseKostenlos testen
- Beispiel: Qwen3-8B passt auf einer RTX 4090 in BF16.
- MoE-fähig: Ein 30B-A3B nutzt 3,3B aktive Parameter.
- Macs: echte Speicherbandbreite und GPU-Speichergrenze.
Pläne und Preise: Vramwise
| Vramwise Pro | 5 US$ einmalig | Kaufen |
Sichere Zahlung über Stripe · sofortige Lieferung · Support: cybermax.tools@gmail.com
So funktioniert es
- Nutzen Sie die kostenlose Version im Browser: ohne Anmeldung, nichts wird hochgeladen.
- Wählen Sie einen Plan und zahlen Sie per Karte über Stripe.
- Stripe bringt Sie mit aktiviertem Pro zurück zur App; Ihr Freischaltcode aktiviert Pro in jedem anderen Browser.
Häufige Fragen
Woher kommen die Modelldaten?
Aus der veröffentlichten Konfiguration des Modells auf Hugging Face, live gelesen.
Was bietet Pro?
Die Passungstabelle als Markdown für READMEs, GitHub-Issues oder Foren kopieren oder als .md-Datei herunterladen. Einmalig 5 US$.
Ist das exakt?
Es ist eine Schätzung: Der tatsächliche Bedarf hängt von Inferenz-Engine, Quantisierung und Kontextlänge ab.
Vollständige Seite auf Englisch (echte Beispiele und Preisvergleich)
Diese Seite in anderen Sprachen: English Español Português (Brasil) Français 日本語