Views
No views yet
HuggingFaceTB/SmolVLM2-2.2B-Instruct,
fine-tuned on mrdbourke/FoodExtract-1k-Vision.1{"is_food": 1, "image_title": "salad",
2 "food_items": ["tomato", "lettuce"], "drink_items": []}1from transformers import AutoProcessor, AutoModelForImageTextToText
2from peft import PeftModel
3
4base = "HuggingFaceTB/SmolVLM2-2.2B-Instruct"
5processor = AutoProcessor.from_pretrained(base)
6model = AutoModelForImageTextToText.from_pretrained(base)
7model = PeftModel.from_pretrained(model, "sergiudanstan/smolvlm2-2.2b-foodextract-lora").merge_and_unload()