HOS-OSS-1.54B is a lightweight 1.54B parameter causal language model optimized for text and code generation tasks.
It is designed for fast inference, low resource usage, and local deployment.
1from transformers import AutoTokenizer, AutoModelForCausalLM
2import torch
3
4model_name = "hydffgg/HOS-OSS-1.54B"
5
6tokenizer = AutoTokenizer.from_pretrained(model_name)
7model = AutoModelForCausalLM.from_pretrained(model_name)
8
9prompt = "User: Write a Python Hello World\nAssistant:"
10
11inputs = tokenizer(prompt, return_tensors="pt")
12
13with torch.no_grad():
14 outputs = model.generate(
15 **inputs,
16 max_new_tokens=100,
17 temperature=0.7
18 )
19
20print(tokenizer.decode(outputs[0], skip_special_tokens=True))