Qwen2.5-14B-Instruct continually pre-trained on synthetic data from a single generator (GPT-4.1-mini), mixed 1:1 with FineWeb (English) as replay corpus to mitigate catastrophic forgetting.
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model = AutoModelForCausalLM.from_pretrained("hugo/protocolos-clinicos-br-cpt_replay-1gen-14b", torch_dtype="auto", device_map="auto")
4tok = AutoTokenizer.from_pretrained("hugo/protocolos-clinicos-br-cpt_replay-1gen-14b")
Research model for studying domain adaptation of LLMs to Brazilian clinical guidelines. Not a certified medical device. Even at the best accuracy reported in the paper, residual errors may involve consequential details (dosages, contraindications). Use only under qualified professional supervision.