🚀 Qwen Coder Boosted
Qwen3-Coder-30B-A3B-Instruct (4-bit quantisiert) auf Zero GPU (NVIDIA RTX Pro 6000 Blackwell, 48 GB shared VRAM).
Features
- 🧠 Qwen3-Coder-30B-A3B – MoE Coding-Modell, ~15 GB in 4-bit
- ⚡ Zero GPU – GPU nur bei Bedarf, schläft dazwischen
- 🎯 32K Kontext – große Code-Blöcke
- 🌡️ Temperature einstellbar (0.1–1.5)
- 💬 Streaming Chat-UI
Nutzung
Einfach Prompt eingeben und loslegen! Der Space nutzt dein PRO-Quota (40 Min/Tag inklusive).
Hardware
- GPU: NVIDIA RTX Pro 6000 Blackwell (geteilt, 48 GB)
- Quantisierung: 4-bit NF4 (BitsAndBytes)
- Attention: Flash Attention 2