Views
No views yet
1from transformers import AutoTokenizer, AutoModel
2import torch
3
4tokenizer = AutoTokenizer.from_pretrained("Kanompung/Tsunami_llm_embed")
5model = AutoModel.from_pretrained("Kanompung/Tsunami_llm_embed")
6
7texts = ["สวัสดีครับ", "วันนี้อากาศดี"]
8enc = tokenizer(texts, padding=True, truncation=True, return_tensors="pt")
9with torch.no_grad():
10 out = model(**enc)
11
12embeds = out.last_hidden_state.mean(dim=1)
13print(embeds.shape)
14