Views
No views yet
model/
├── config.json # モデル設定
├── pytorch_model.bin # モデル重み
├── tokenizer.json # トークナイザー
└── README.md # このファイル1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3# モデルとトークナイザーの読み込み
4model = AutoModelForCausalLM.from_pretrained(
5 "weblab-llm-competition-2025-bridge/truthowl-model1",
6 trust_remote_code=True,
7 device_map="auto"
8)
9tokenizer = AutoTokenizer.from_pretrained(
10 "weblab-llm-competition-2025-bridge/truthowl-model1",
11 trust_remote_code=True
12)
13
14# 推論実行(reasoning有効)
15prompt = "Please solve the problem. Include your reasoning process in your answer."
16inputs = tokenizer(prompt, return_tensors="pt")
17outputs = model.generate(
18 **inputs,
19 max_new_tokens=2000,
20 do_sample=True,
21 temperature=0.7
22)
23response = tokenizer.decode(outputs[0], skip_special_tokens=True)1python -m vllm.entrypoints.openai.api_server \
2 --model weblab-llm-competition-2025-bridge/truthowl-model1 \
3 --tensor-parallel-size 8 \
4 --max-model-len 131072 \
5 --gpu-memory-utilization 0.85 \
6 --trust-remote-code \
7 --dtype bfloat16eval_32b_sft_mixed_timestamped.sh