Q4_K_M
Kompakt und praktisch als erste Wahl. Hier beginnen, außer Sie wissen bereits, dass Ihr System genug RAM oder VRAM für größere Varianten hat.
pb_qwen3_5_9b_dora_v7_stable_q4_k_m.gguf
PowerBASIC-fokussierte Qwen 9B DoRA GGUF Modellvarianten für lokale KI-Runtimes wie LM Studio, Ollama, llama.cpp-kompatible Tools, KoboldCpp, text-generation-webui und andere lokale GGUF-fähige Inferenzumgebungen.
Wenn Sie lokal mit KI-Tools arbeiten und den Fokus bewusst auf PowerBASIC-Code legst, sind diese Modelle als gute Zusatzoption gedacht. Wählen Sie die Quantisierung nach Ihrem verfügbaren RAM/VRAM: Q4_K_M für einen sparsamen Einstieg, Q6_K für mehr Qualität oder Q8_0/F16/BF16 für maximale Präzision.

Beginnen Sie mit Q4_K_M, außer Sie wissen sicher, dass Ihr Rechner genug Speicher für größere Varianten hat.
Nutzen Sie Q6_K, wenn Sie stärkere Ausgabequalität wünschen und mehr Speicher einsetzen können.
Nutzen Sie Q8_0 oder F16/BF16 nur für leistungsfähige Hardware, Archivierung, Konvertierung oder Referenz-Workflows.
Alle aktuellen Modell-Dateien und Release-Informationen liegen in einem Repo mit konsistenten Dateinamen, Metadaten und direkten Download-Links.
Online auf Hugging Face: https://huggingface.co/Theogott/pb-qwen3_5-9b-powerbasic-ggufs
Kompakt und praktisch als erste Wahl. Hier beginnen, außer Sie wissen bereits, dass Ihr System genug RAM oder VRAM für größere Varianten hat.
pb_qwen3_5_9b_dora_v7_stable_q4_k_m.gguf
Noch kompakter mit guter Qualität. Ideal für CPU-Offloading oder wenn Speicher knapp ist.
pb_qwen3_5_9b_dora_v7_stable_q4_k_s.gguf
Die kleinste und schnellste Variante. Beste Wahl für reine CPU-Inferenz oder sehr beschränkten Speicher.
pb_qwen3_5_9b_dora_v7_stable_q4_0.gguf
Geeignet, wenn mehr Speicher für stärkere Antworten und stabileres codeorientiertes Verhalten verfügbar ist.
pb_qwen3_5_9b_dora_v7_stable_q6_k.gguf
Für leistungsfähige Hardware, wenn Qualität wichtiger ist als Downloadgröße und Speicherbedarf.
pb_qwen3_5_9b_dora_v7_stable_q8_0.gguf
Für anspruchsvolle Workflows mit hoher Genauigkeit, z. B. Codeanalyse, Konvertierung und detailierte Tests.
pb_qwen3_5_9b_dora_v7_stable_f16.gguf
Brain-float16 Variante für maximale GPU-Performance bei gleichbleibender hoher Qualität.
pb_qwen3_5_9b_dora_v7_stable_bf16.gguf
Online auf Hugging Face: https://huggingface.co/Theogott/spr-qwen3_5-9b-dora-vramsafe-gguf
VRAM-schonende Variante mit reduzierter Speicherbelastung bei weiterhin stabilem Verhalten.
spr_qwen3_5_9b_dora_vramsafe_q4_k_m.gguf
Hohe Qualität mit kontrollierterem VRAM-Einsatz.
spr_qwen3_5_9b_dora_vramsafe_q6_k.gguf
Für bessere Ausgabequalität in lokalen Runtimes mit ausreichend Speicher.
spr_qwen3_5_9b_dora_vramsafe_q8_0.gguf
Höhere Präzisionsvariante für anspruchsvolle Inferenz- und Konvertierungs-Workflows.
spr_qwen3_5_9b_dora_vramsafe_bf16.gguf
Tägliche Abrufe aller angebotenen Downloads der letzten 28 Tage (rollierend). Jede Download-Datei ist dauerhaft durch eine eigene Farbe gekennzeichnet.