Views
No views yet
| Параметр | Значение |
|---|---|
| Архитектура | GPT2-nano |
| Параметры | 4,634 |
| Размер модели | ~18.1 KB |
| Словарь | 500 токенов |
| Контекст | 32 токена |
| Скрытый размер | 8 |
| Слои | 1 |
| Головы внимания | 1 |
| Активация | gelu_new |
| Обучена на | 53 диалогах |
| Эпох обучения | 500 |
1from transformers import AutoModelForCausalLM, AutoTokenizer
2import torch
3
4# Загрузка модели
5model_name = "prostochel097/alphagpt-ultramini"
6tokenizer = AutoTokenizer.from_pretrained(model_name)
7model = AutoModelForCausalLM.from_pretrained(model_name)
8
9# Генерация текста
10prompt = "Привет"
11inputs = tokenizer(prompt, return_tensors="pt")
12
13with torch.no_grad():
14 outputs = model.generate(
15 **inputs,
16 max_new_tokens=20,
17 temperature=0.8,
18 do_sample=True,
19 pad_token_id=tokenizer.pad_token_id,
20 eos_token_id=tokenizer.eos_token_id
21 )
22
23generated_text = tokenizer.decode(outputs[0], skip_special_tokens=True)
24print(f"Сгенерировано: {generated_text}")