Views
No views yet
model.safetensors, tokenizer ByteLevel BPE e metadados de treino. O código de inferência (pinhao.sample) fica no repositório GitHub do projeto.python -m pinhao.sample --config configs/pinhao_8m.py --prompt "Diz aí, piá"temperature=0.15, top_k=5 (defaults de pinhao.sample.generate(); temperature=0.8 alta faz a amostragem divergir no meio da resposta);generate() aplica pinhao.curitibize.curitibize_text() no texto final por padrão (apply_curitibize=True) — injeção determinística de vocabulário/cadência, o que nenhuma rede de 7,4M consegue garantir sozinha;model.safetensors diretamente (sem passar por pinhao.sample), replique pelo menos o pós-processamento de estilo para ter a mesma garantia, em texto ou para uso com TTS:1from pinhao.curitibize import curitibize_text
2
3texto_bruto = "<saída do model.generate(...) decodificada>"
4texto_final = curitibize_text(texto_bruto)