Q4_K_M
Kompakt und praktisch als erste Wahl. Hier beginnen, ausser du weisst bereits, dass dein System genug RAM oder VRAM für größere Varianten hat.
pb_qwen3_5_9b_dora_v7_stable_q4_k_m.gguf
PowerBASIC-fokussierte Qwen 9B DoRA GGUF Modellvarianten für lokale KI-Runtimes wie LM Studio, Ollama, llama.cpp-kompatible Tools, KoboldCpp, text-generation-webui und andere lokale GGUF-fähige Inferenzumgebungen.
Wenn du lokal mit KI-Tools arbeitest und den Fokus bewusst auf PowerBASIC-Code legst, sind diese Modelle als gute Zusatzoption gedacht. Wähle die Quantisierung nach deinem verfügbaren RAM/VRAM: Q4_K_M für einen sparsamen Einstieg, Q6_K für mehr Qualität oder Q8_0/F16/BF16 für maximale Präzision.

Beginne mit Q4_K_M, ausser du weisst sicher, dass dein Rechner genug Speicher für größere Varianten hat.
Nutze Q6_K, wenn du staerkere Ausgabequalitaet willst und mehr Speicher einsetzen kannst.
Nutze Q8_0 oder F16/BF16 nur für leistungsfähige Hardware, Archivierung, Konvertierung oder Referenz-Workflows.
Alle aktuellen Modell-Dateien und Release-Informationen liegen in einem Repo mit konsistenten Dateinamen, Metadaten und direkten Download-Links.
Online auf Hugging Face: https://huggingface.co/Theogott/pb-qwen3_5-9b-powerbasic-ggufs
Kompakt und praktisch als erste Wahl. Hier beginnen, ausser du weisst bereits, dass dein System genug RAM oder VRAM für größere Varianten hat.
pb_qwen3_5_9b_dora_v7_stable_q4_k_m.gguf
Noch kompakter mit guter Qualität. Ideal für CPU-Offloading oder wenn Speicher knapp ist.
pb_qwen3_5_9b_dora_v7_stable_q4_k_s.gguf
Die kleinste und schnellste Variante. Beste Wahl für reine CPU-Inferenz oder sehr beschraenkten Speicher.
pb_qwen3_5_9b_dora_v7_stable_q4_0.gguf
Geeignet, wenn mehr Speicher für staerkere Antworten und stabileres codeorientiertes Verhalten verfügbar ist.
pb_qwen3_5_9b_dora_v7_stable_q6_k.gguf
Für leistungsfähige Hardware, wenn Qualität wichtiger ist als Downloadgröße und Speicherbedarf.
pb_qwen3_5_9b_dora_v7_stable_q8_0.gguf
Für anspruchsvolle Workflows mit hoher Genauigkeit, z. B. Codeanalyse, Konvertierung und detailierte Tests.
pb_qwen3_5_9b_dora_v7_stable_f16.gguf
Brain-float16 Variante für maximale GPU-Performance bei gleichbleibender hoher Qualität.
pb_qwen3_5_9b_dora_v7_stable_bf16.gguf
Online auf Hugging Face: https://huggingface.co/Theogott/spr-qwen3_5-9b-dora-vramsafe-gguf
VRAM-schonende Variante mit reduzierter Speicherbelastung bei weiterhin stabilem Verhalten.
spr_qwen3_5_9b_dora_vramsafe_q4_k_m.gguf
Hohe Qualität mit kontrollierterem VRAM-Einsatz.
spr_qwen3_5_9b_dora_vramsafe_q6_k.gguf
Für bessere Ausgabequalitaet in lokalen Runtimes mit ausreichend Speicher.
spr_qwen3_5_9b_dora_vramsafe_q8_0.gguf
Hoehere Praezisionsvariante für anspruchsvolle Inferenz- und Konvertierungs-Workflows.
spr_qwen3_5_9b_dora_vramsafe_bf16.gguf