Views
No views yet
| 属性 | 值 |
|---|---|
| 平台 | RK3576 ✅ |
| 量化 | W4A16 ✅ |
| 文件大小 | 1.3 GB |
| 内存需求 | ~2.5 GB (含Swap) |
| NPU核心 | 1-2个 |
1huggingface-cli download JiahaoLi/DeepSeek-R1-Distill-Qwen-RK3576 \
2 DeepSeek-R1-Distill-Qwen-1.5B_W4A16_RK3576.rkllm \
3 --local-dir ./models/DeepSeek-R1-1.5B1cd ./models/DeepSeek-R1-1.5B
2rkllm DeepSeek-R1-Distill-Qwen-1.5B_W4A16_RK3576.rkllm1from rkllm.api import RKLLM
2
3llm = RKLLM()
4llm.load_rkllm("DeepSeek-R1-Distill-Qwen-1.5B_W4A16_RK3576.rkllm")
5llm.build(target_platform='rk3576', num_npu_core=2)
6
7# 测试推理
8response = llm.inference(["你好"])
9print(response)| 指标 | 预期值 |
|---|---|
| 推理速度 | 15-20 tokens/s |
| 内存占用 | ~2.5 GB |
| 上下文长度 | 4096 tokens |
| 量化精度 | W4A16 (4-bit权重, 16-bit激活) |