Views
No views yet

🔗 Versão base (CPT):plvictor/Theo-10M-PTBR-Base
| Parâmetro | Valor |
|---|---|
| Parâmetros reais | 7,4M |
| Camadas | 4 · d_model=256 · FFN=1.024 |
| Contexto máximo | 512 tokens |
| Vocabulário | 16.000 tokens (BPE próprio) |
| SFT examples | ~19.000 pares de conversação teológica |
| GPU | NVIDIA L40S 48 GB (RunPod) |
| SFT gerado com | Qwen 35B como modelo professor |
1git lfs install
2git clone https://huggingface.co/plvictor/Theo-10M-Chat
3cd Theo-10M-Chat
4pip install -r requirements.txt
5
6python chat.py1import torch
2from config import get_config
3from src.model import BabelTransformer
4
5cfg = get_config("babel_10M")
6model = BabelTransformer(cfg)
7ckpt = torch.load("theo-10m-chat.pt", map_location="cpu", weights_only=False)
8model.load_state_dict(ckpt["model_state_dict"], strict=False)
9model.eval()