Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
dacon-skku-bias-vlm-v8a – AI Model by psh3333 | AlphaNeural AI
You can deploy this model and start earning money today!
psh3333
/
dacon-skku-bias-vlm-v8a
like
0
safetensors
qwen3_vl
multimodal
bias
grpo
vlm
dacon
bbq
Qwen/Qwen3-VL-8B-Instruct
finetune
apache-2.0
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
DACON SKKU Bias VLM — v8A (robustness GRPO, first attempt)
GRPO-only 단일토큰 멀티모달 편향완화 VLM. base Qwen3-VL-8B-Instruct (Apache-2.0). v8A는 강건성 보상 GRPO 1차 시도로
OOD를 0.8117로 향상
시켰으나
옵션순서 강건성이 0.9411로 하락
(trade-off). 이를 보완한 것이 v8B(=셔플 일관성 회복). 음성결과/대조군으로 보존.
평가 (held-out 공개 v8_eval 900)
BBQ amb/dis 1.0/1.0 · OOD 0.8117 · option-shuffle consistency 0.9411 · format 0.9733 · 과기권/사람오류 0/0.
학습: 공개 BBQ+OOD, LoRA rank 32, 단일토큰. DACON 평가셋 미사용.