Views
No views yet
| Model | Repo ID in HF 🤗 | Domain | Base Model | Training Data | Evaluation Benchmark |
|---|---|---|---|---|---|
| Visual Instruction Synthesizer | AdaptLLM/visual-instruction-synthesizer | - | open-llava-next-llama3-8b | VisionFLAN and ALLaVA | - |
| AdaMLLM-med-1B | AdaptLLM/biomed-InternVL3-1B | Biomedicine | InternVL3-1B | biomed-visual-instructions | biomed-VQA-benchmark |
| AdaMLLM-med-4B | AdaptLLM/biomed-gemma-3-4b-it | Biomedicine | gemma-3-4b-it | biomed-visual-instructions | biomed-VQA-benchmark |
| AdaMLLM-med-3B | AdaptLLM/biomed-Qwen2.5-VL-3B-Instruct | Biomedicine | Qwen2.5-VL-3B-Instruct | biomed-visual-instructions | biomed-VQA-benchmark |
| AdaMLLM-food-3B | AdaptLLM/food-Qwen2.5-VL-3B-Instruct | Food | Qwen2.5-VL-3B-Instruct | food-visual-instructions | food-VQA-benchmark |
| AdaMLLM-remote-sensing-3B | AdaptLLM/remote-sensing-Qwen2.5-VL-3B-Instruct | Remote Sensing | Qwen2.5-VL-3B-Instruct | remote-sensing-visual-instructions | remote-sensing-VQA-benchmark |
| AdaMLLM-med-2B | AdaptLLM/biomed-Qwen2-VL-2B-Instruct | Biomedicine | Qwen2-VL-2B-Instruct | biomed-visual-instructions | biomed-VQA-benchmark |
| AdaMLLM-food-2B | AdaptLLM/food-Qwen2-VL-2B-Instruct | Food | Qwen2-VL-2B-Instruct | food-visual-instructions | food-VQA-benchmark |
| AdaMLLM-remote-sensing-2B | AdaptLLM/remote-sensing-Qwen2-VL-2B-Instruct | Remote Sensing | Qwen2-VL-2B-Instruct | remote-sensing-visual-instructions | remote-sensing-VQA-benchmark |
| AdaMLLM-med-8B | AdaptLLM/biomed-LLaVA-NeXT-Llama3-8B | Biomedicine | open-llava-next-llama3-8b | biomed-visual-instructions | biomed-VQA-benchmark |
| AdaMLLM-food-8B | AdaptLLM/food-LLaVA-NeXT-Llama3-8B | Food | open-llava-next-llama3-8b | food-visual-instructions | food-VQA-benchmark |
| AdaMLLM-remote-sensing-8B | AdaptLLM/remote-sensing-LLaVA-NeXT-Llama3-8B | Remote Sensing | open-llava-next-llama3-8b | remote-sensing-visual-instructions | remote-sensing-VQA-benchmark |
| AdaMLLM-med-11B | AdaptLLM/biomed-Llama-3.2-11B-Vision-Instruct | Biomedicine | Llama-3.2-11B-Vision-Instruct | biomed-visual-instructions | biomed-VQA-benchmark |
| AdaMLLM-food-11B | AdaptLLM/food-Llama-3.2-11B-Vision-Instruct | Food | Llama-3.2-11B-Vision-Instruct | food-visual-instructions | food-VQA-benchmark |
| AdaMLLM-remote-sensing-11B | AdaptLLM/remote-sensing-Llama-3.2-11B-Vision-Instruct | Remote Sensing | Llama-3.2-11B-Vision-Instruct | remote-sensing-visual-instructions | remote-sensing-VQA-benchmark |
1@article{adamllm,
2 title={On Domain-Adaptive Post-Training for Multimodal Large Language Models},
3 author={Cheng, Daixuan and Huang, Shaohan and Zhu, Ziyu and Zhang, Xintong and Zhao, Wayne Xin and Luan, Zhongzhi and Dai, Bo and Zhang, Zhenliang},
4 journal={arXiv preprint arXiv:2411.19930},
5 year={2024}
6}1@inproceedings{
2adaptllm,
3title={Adapting Large Language Models via Reading Comprehension},
4author={Daixuan Cheng and Shaohan Huang and Furu Wei},
5booktitle={The Twelfth International Conference on Learning Representations},
6year={2024},
7url={https://openreview.net/forum?id=y886UXPEZ0}
8}