Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
Spooke_-_distilgpt2-finetuned-python_code_instructions_18k_alpaca-gguf – AI Model by RichardErkhov | AlphaNeural AI
You can deploy this model and start earning money today!
RichardErkhov
/
Spooke_-_distilgpt2-finetuned-python_code_instructions_18k_alpaca-gguf
like
0
endpoints_compatible
gguf
template
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
Quantization made by Richard Erkhov.
Github
Discord
Request more models
distilgpt2-finetuned-python_code_instructions_18k_alpaca - GGUF
Model creator:
https://huggingface.co/Spooke/
Original model:
https://huggingface.co/Spooke/distilgpt2-finetuned-python_code_instructions_18k_alpaca/
Name
Quant method
Size
distilgpt2-finetuned-python_code_instructions_18k_alpaca.Q2_K.gguf
Q2_K
0.06GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.IQ3_XS.gguf
IQ3_XS
0.07GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.IQ3_S.gguf
IQ3_S
0.07GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.Q3_K_S.gguf
Q3_K_S
0.07GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.IQ3_M.gguf
IQ3_M
0.07GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.Q3_K.gguf
Q3_K
0.07GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.Q3_K_M.gguf
Q3_K_M
0.07GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.Q3_K_L.gguf
Q3_K_L
0.07GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.IQ4_XS.gguf
IQ4_XS
0.07GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.Q4_0.gguf
Q4_0
0.08GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.IQ4_NL.gguf
IQ4_NL
0.08GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.Q4_K_S.gguf
Q4_K_S
0.08GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.Q4_K.gguf
Q4_K
0.08GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.Q4_K_M.gguf
Q4_K_M
0.08GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.Q4_1.gguf
Q4_1
0.08GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.Q5_0.gguf
Q5_0
0.09GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.Q5_K_S.gguf
Q5_K_S
0.09GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.Q5_K.gguf
Q5_K
0.09GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.Q5_K_M.gguf
Q5_K_M
0.09GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.Q5_1.gguf
Q5_1
0.09GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.Q6_K.gguf
Q6_K
0.1GB
distilgpt2-finetuned-python_code_instructions_18k_alpaca.Q8_0.gguf
Q8_0
0.12GB
Original model description:
library_name: transformers license: apache-2.0 base_model: distilgpt2 tags:
generated_from_trainer model-index:
name: distilgpt2-finetuned-python_code_instructions_18k_alpaca results: []
distilgpt2-finetuned-python_code_instructions_18k_alpaca
This model is a fine-tuned version of
distilgpt2
on an unknown dataset. It achieves the following results on the evaluation set:
Loss: 1.4143
Model description
More information needed
Intended uses & limitations
More information needed
Training and evaluation data
More information needed
Training procedure
Training hyperparameters
The following hyperparameters were used during training:
learning_rate: 2e-05
train_batch_size: 8
eval_batch_size: 8
seed: 42
optimizer: Adam with betas=(0.9,0.999) and epsilon=1e-08
lr_scheduler_type: linear
num_epochs: 7
Training results
Training Loss
Epoch
Step
Validation Loss
1.7118
1.0
3862
1.5780
1.5838
2.0
7724
1.4955
1.4914
3.0
11586
1.4615
1.4532
4.0
15448
1.4364
1.4292
5.0
19310
1.4241
1.4136
6.0
23172
1.4171
1.3778
7.0
27034
1.4143
Framework versions
Transformers 4.44.2
Pytorch 2.4.1+cu121
Datasets 3.0.1
Tokenizers 0.19.1