Views
No views yet
Qwen/Qwen2.5-1.5B-Instruct 做 QLoRA 微调后合并。免责声明:本模型仅供研究与教育演示,不构成投资建议。金融市场有风险,决策请自行负责。
| 项 | 值 |
|---|---|
| 基座 | Qwen2.5-1.5B-Instruct |
| 数据 | ~284 条 ShareGPT(约 28% 多轮) |
| 方法 | QLoRA r=16,4 epochs |
| 多轮评测 | 6/10(门槛 8/10,未达标) |
| 状态 | Experimental preview |
safetensors + tokenizer:HF Space CPU / 本地 GPUdruckenmiller-1.5b-v2-q4_k_m.gguf:推荐用 llama.cpp / llama-cpp-python(约 1GB)druckenmiller-1.5b-v2-f16.gguf:全精度 GGUF(约 3GB)1# Transformers(需 GPU 更佳)
2from transformers import AutoModelForCausalLM, AutoTokenizer
3import torch
4
5repo = "januschoy/druckenmiller-1.5b-v2"
6tok = AutoTokenizer.from_pretrained(repo, trust_remote_code=True)
7model = AutoModelForCausalLM.from_pretrained(repo, torch_dtype=torch.float16, device_map="auto", trust_remote_code=True)