The official codes for "Towards Evaluating and Building Versatile Large Language Models for Medicine"
This repository hosts MMedS-Llama-3-8B. Its foundation model,
MMed-Llama-3-8B,
is a multilingual medical language model which has undergone additional continuous pretraining on MMedC. Furthermore, the model has
been fine-tuned under supervision using MedS-Ins, a comprehensive dataset designed specifically for supervised fine-tuning (SFT),
featuring 13.5 million samples across 122 tasks. For more details, please refer to our paper.
1import torch
2from transformers import AutoTokenizer, AutoModelForCausalLM
3tokenizer = AutoTokenizer.from_pretrained("Henrychur/MMed-Llama-3-8B-EnIns")
4model = AutoModelForCausalLM.from_pretrained("Henrychur/MMed-Llama-3-8B-EnIns", torch_dtype=torch.float16)