Beta
Explore
Marketplace
Neural Labs
Playground
Wallet
Docs
mistral-7b-jondurbin-truthy-dpo – AI Model by CorticalStack | AlphaNeural AI
You can deploy this model and start earning money today!
CorticalStack
/
mistral-7b-jondurbin-truthy-dpo
like
0
transformers
safetensors
mistral
text-generation
dpo
mistralai/Mistral-7B-v0.1
finetune
apache-2.0
autotrain_compatible
text-generation-inference
endpoints_compatible
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
mistral-7b-jondurbin-truthy-dpo
mistral-7b-jondurbin-truthy-dpo is a DPO fine-tuned version of
mistralai/Mistral-7B-v0.1
using the
jondurbin/truthy-dpo-v0.1
dataset.
LoRA
r: 16
LoRA alpha: 16
LoRA dropout: 0.05
Training arguments
Batch size: 4
Gradient accumulation steps: 4
Optimizer: paged_adamw_32bit
Max steps: 100
Learning rate: 5e-05
Learning rate scheduler type: cosine
Beta: 0.1
Max prompt length: 1024
Max length: 1536