Views
No views yet
FINAL-Bench/Darwin-35B-A3B-Opus, a next-generation Multimodal Vision-Language Model (VLM).image-text-to-text 파이프라인을 지원하여 복잡한 시각 자료 분석, 도표 해석, OCR 등이 가능합니다.mlx-lm 또는 비전 전용 MLX 패키지가 필요합니다.pip install -U mlx-lm pillowPIL.Image를 활용해 질문을 던질 수 있습니다.1from mlx_lm import load, generate
2from PIL import Image
3
4# 본인의 허깅페이스 저장소 아이디/이름으로 수정하여 사용하세요.
5model, tokenizer = load("cudo528/Darwin-35B-A3B-Opus-MLX-4bit")
6
7# 분석할 이미지 로드
8image_path = "sample_chart.png"
9image = Image.open(image_path)
10
11# 이미지와 함께 텍스트 프롬프트 작성
12prompt = "이 이미지에 포함된 데이터 그래프를 한국어로 상세히 분석하고 요약해줘."
13
14response = generate(
15 model,
16 tokenizer,
17 prompt=prompt,
18 images=[image], # 멀티모달 입력 배열
19 max_tokens=2048,
20 verbose=True # 심층 추론 과정(<thought>)을 모니터링하려면 True
21)
22print(response).safetensors)