Views
No views yet
Qwen/Qwen2.5-7B-Instructr=16, alpha=32, dropout=0.0q_proj,k_proj,v_proj,o_proj,gate_proj,up_proj,down_projfrom_marker (ACTION:)409635011.0e-61232320.030.0150 / 501from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_id = "uchkw/qwen2.5-7b-instruct-sft-v4"
4tokenizer = AutoTokenizer.from_pretrained(model_id)
5model = AutoModelForCausalLM.from_pretrained(model_id, device_map="auto")u-10bei/sft_alfworld_trajectory_dataset_v5u-10bei/dbbench_sft_dataset_react_v4u-10bei/dbbench_sft_dataset_react_v3ACTION: ...) with exact matching against AVAILABLE ACTIONS.Task succeeded. in observation context) while preserving strict action targets.ALF:DB = 55:45.3645519181.00.47110.150046764 -> 128 (before/after duplication)