Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
Llama3.2-1B-summary-length-exp4 – AI Model by amang1802 | AlphaNeural AI
You can deploy this model and start earning money today!
amang1802
/
Llama3.2-1B-summary-length-exp4
like
0
transformers
safetensors
llama
text-generation
conversational
autotrain_compatible
text-generation-inference
endpoints_compatible
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
Model Card for Model ID
Summary Length PPO experiment #2
No KL divergence in loss
Model Details
Dataset size: 1024
Epochs: 2
Batch Size: 4 * 8 (w / Gradient Accumulation)
Optimizer args: Torch AdamW default, except
LR = 0.0001
Outcomes
Only outputs one word "relationship"