Views
No views yet
Qwen2.5-7B-Instruct, specifically fine-tuned to solve high-precision directional trading signals in the IndicatorsEnv (OpenEnv) reinforcement learning environment.| Metric | Zero-Shot Baseline | GRPO Fine-Tuned (Step 220+) | Δ Status |
|---|---|---|---|
| Bullish Recall | 36.0% | 56.0% | +20.0% 🚀 |
| Bearish Recall | 0.0% | 20.0% | +20.0% 🚀 |
| Neutral Recall | 70.0% | 0.0% | Active Decision Making |
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3
4base_model_id = "Qwen/Qwen2.5-7B-Instruct"
5adapter_id = "bawsi99/indicators-grpo-qwen7b"
6
7# Load Base Model
8model = AutoModelForCausalLM.from_pretrained(
9 base_model_id,
10 torch_dtype="auto",
11 device_map="auto",
12)
13
14# Load Adapter
15model = PeftModel.from_pretrained(model, adapter_id)
16
17# Ready for Inference