Views
No views yet
ft-b042b356-9d1d, based on Qwen/Qwen3.5-35B-A3B-Base.config.json, tokenizer files, processor configuration, and shard index. The model configuration retains the Qwen-compatible chat template supplied in tokenizer_config.json.| Property | Value |
|---|---|
| Base model | Qwen/Qwen3.5-35B-A3B-Base |
| Checkpoint | Together AI Final Merged, step 40 |
| Architecture | Qwen3_5MoeForConditionalGeneration |
| Format | Hugging Face Transformers / Safetensors |
| Pipeline | Image-text-to-text |
1from transformers import AutoProcessor, Qwen3_5MoeForConditionalGeneration
2
3model_id = "RoseG/Qwen3.5-35B-A3B-Base-8be64d30-Merged"
4processor = AutoProcessor.from_pretrained(model_id)
5model = Qwen3_5MoeForConditionalGeneration.from_pretrained(
6 model_id,
7 torch_dtype="auto",
8 device_map="auto",
9)