Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
DataVortexS_dpov3 – AI Model by ENERGY-DRINK-LOVE | AlphaNeural AI
You can deploy this model and start earning money today!
ENERGY-DRINK-LOVE
/
DataVortexS_dpov3
like
0
transformers
safetensors
llama
text-generation
trl
dpo
generated_from_trainer
2305.18290
Edentns/DataVortexS-10.7B-dpo-v1.11
finetune
cc-by-nc-4.0
autotrain_compatible
text-generation-inference
endpoints_compatible
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
ENERGY-DRINK-LOVE/DataVortexS_dpov3
Our Team
Youjin Chung
Jingyeom Kim
Model
Base Model
Edentns/DataVortexS-10.7B-dpo-v1.11
Hardware and Software
Hardware: A100 * 8 for training our model
Deepspeed library & Huggingface TRL Trainer
Dataset
DPO_dataset
자체 제작 dpo dataset(AI-hub dataset 활용)
OpenOrca DPO 등 영어 데이터셋 번역(ENERGY-DRINK-LOVE/translate_share_gpt_dedup_llama_SFT_1024, 자체모델 활용)
Training Method
DPO
Benchmark
Ko LM Eval Harness
Ko-LLM-Leaderboard
(240316기준 7등)
image/png
Average
Ko-ARC
Ko-HellaSwag
Ko-MMLU
Ko-TruthfulQA
Ko-CommonGen V2
60.18
56.23
69.15
52.76
67.87
54.9