Views
No views yet


pip3 install --upgrade rwkv-fla transformersexport WKV_MODE=chunk1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3
4model = AutoModelForCausalLM.from_pretrained(
5 "RWKV-Red-Team/ARWKV-7B-Preview-0.1-NoG-32B",
6 device_map="auto",
7 torch_dtype=torch.float16,
8 trust_remote_code=True,
9)
10tokenizer = AutoTokenizer.from_pretrained(
11 "RWKV-Red-Team/ARWKV-7B-Preview-0.1-NoG-32B"
12)| Component | Specification | Note |
|---|---|---|
| Architecture | RWKV-7 TimeMix + SwiGLU | Hybrid design |
| Context Window | 2048 training CTX | Preview limitation |
| Training Tokens | 40M | Distillation-focused |
| Precision | FP16 inference recommended(16G Vram required) | 15%↑ vs BF16 |
1Qwen2.5 Decoder Layer:
2- Grouped Query Attention
3+ RWKV-7 Time Mixing (Eq.3)
4- RoPE Positional Encoding
5+ State Recurrence
6= Hybrid Layer Output