Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
flammen17-py-DPO-v1-7B-AWQ – AI Model by solidrust | AlphaNeural AI
You can deploy this model and start earning money today!
solidrust
/
flammen17-py-DPO-v1-7B-AWQ
like
0
transformers
safetensors
mistral
text-generation
4-bit
AWQ
autotrain_compatible
endpoints_compatible
experimental
jondurbin/py-dpo-v0.1
nbeerbower/flammen17-py-DPO-v1-7B
quantized
apache-2.0
text-generation-inference
awq
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
nbeerbower/flammen17-py-DPO-v1-7B AWQ
Model creator:
nbeerbower
Original model:
flammen17-py-DPO-v1-7B
image/png
Model Summary
A Mistral 7B LLM built from merging pretrained models and finetuning on
Jon Durbin
's
py-dpo-v0.1
.
Finetuned using an A100 on Google Colab. 🙏
Fine-tune a Mistral-7b model with Direct Preference Optimization
-
Maxime Labonne