Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2import torch
3
4# Load model and tokenizer
5model_name = "TrialPanorama/Qwen-3-8B-TP"
6tokenizer = AutoTokenizer.from_pretrained(model_name)
7model = AutoModelForCausalLM.from_pretrained(
8 model_name,
9 torch_dtype=torch.bfloat16,
10 device_map="auto"
11)
12
13# Prepare input (a toy example)
14prompt = """Given the following clinical trial information, search for relevant studies:
15
16[Input Information]
17
18Please provide relevant clinical trials and reasoning."""
19
20# Generate response
21messages = [
22 {"role": "user", "content": prompt}
23]
24text = tokenizer.apply_chat_template(
25 messages,
26 tokenize=False,
27 add_generation_prompt=True,
28 enable_thinking=True
29)
30model_inputs = tokenizer([text], return_tensors="pt").to(model.device)
31
32outputs = model.generate(
33 **model_inputs,
34 max_new_tokens=512,
35 temperature=0.6,
36 top_p=0.95,
37 do_sample=True
38)
39
40response = tokenizer.decode(outputs[0], skip_special_tokens=True)
41print(response)1from vllm import LLM, SamplingParams
2
3# Initialize vLLM
4llm = LLM(
5 model="TrialPanorama/Qwen-3-8B-TP",
6 tensor_parallel_size=1,
7 dtype="bfloat16",
8 enable_reasoning=True,
9 reasoning_parser="deepseek_r1"
10)
11
12# Set sampling parameters
13sampling_params = SamplingParams(
14 temperature=0.6,
15 top_p=0.95,
16 max_tokens=512
17)
18
19# Generate
20prompts = ["Your study search prompt here"]
21outputs = llm.generate(prompts, sampling_params)
22
23for output in outputs:
24 print(output.outputs[0].text)1from sglang import Runtime, Engine, ModelConfig, SamplingParams
2
3# Initialize SGLang
4runtime = Runtime(
5 model_path="TrialPanorama/Qwen-3-8B-TP",
6 reasoning_parser="qwen3"
7)
8
9# Set sampling parameters
10sampling_params = SamplingParams(
11 temperature=0.6,
12 top_p=0.95,
13 max_new_tokens=512
14)
15
16# Generate
17prompts = ["Your study search prompt here"]
18outputs = runtime.generate(prompts, sampling_params)
19
20for output in outputs:
21 print(output.text)1@article{wang2025trialpanorama,
2 title = {Developing Large Language Models for Clinical Research Using One Million Clinical Trials},
3 author = {Wang, Zifeng and Lin, Jiacheng and Jin, Qiao and Gao, Junyi and Pradeepkumar, Jathurshan and Jiang, Pengcheng and Lu, Zhiyong and Sun, Jimeng},
4 journal = {arXiv preprint arXiv:2505.16097},
5 year = {2025},
6 url = {https://arxiv.org/abs/2505.16097}
7}