| Name | Quant method | Size |
|---|---|---|
| Minueza-32M-UltraChat.Q2_K.gguf | Q2_K | 0.0GB |
| Minueza-32M-UltraChat.IQ3_XS.gguf | IQ3_XS | 0.0GB |
| Minueza-32M-UltraChat.IQ3_S.gguf | IQ3_S | 0.0GB |
| Minueza-32M-UltraChat.Q3_K_S.gguf | Q3_K_S | 0.0GB |
| Minueza-32M-UltraChat.IQ3_M.gguf | IQ3_M | 0.0GB |
| Minueza-32M-UltraChat.Q3_K.gguf | Q3_K | 0.0GB |
| Minueza-32M-UltraChat.Q3_K_M.gguf | Q3_K_M | 0.0GB |
| Minueza-32M-UltraChat.Q3_K_L.gguf | Q3_K_L | 0.0GB |
| Minueza-32M-UltraChat.IQ4_XS.gguf | IQ4_XS | 0.0GB |
| Minueza-32M-UltraChat.Q4_0.gguf | Q4_0 | 0.0GB |
| Minueza-32M-UltraChat.IQ4_NL.gguf | IQ4_NL | 0.0GB |
| Minueza-32M-UltraChat.Q4_K_S.gguf | Q4_K_S | 0.0GB |
| Minueza-32M-UltraChat.Q4_K.gguf | Q4_K | 0.0GB |
| Minueza-32M-UltraChat.Q4_K_M.gguf | Q4_K_M | 0.0GB |
| Minueza-32M-UltraChat.Q4_1.gguf | Q4_1 | 0.0GB |
| Minueza-32M-UltraChat.Q5_0.gguf | Q5_0 | 0.0GB |
| Minueza-32M-UltraChat.Q5_K_S.gguf | Q5_K_S | 0.0GB |
| Minueza-32M-UltraChat.Q5_K.gguf | Q5_K | 0.0GB |
| Minueza-32M-UltraChat.Q5_K_M.gguf | Q5_K_M | 0.0GB |
| Minueza-32M-UltraChat.Q5_1.gguf | Q5_1 | 0.0GB |
| Minueza-32M-UltraChat.Q6_K.gguf | Q6_K | 0.0GB |
| Minueza-32M-UltraChat.Q8_0.gguf | Q8_0 | 0.0GB |
<|im_start|>system
{system_message}<|im_end|>
<|im_start|>user
{user_message}<|im_end|>
<|im_start|>assistant1do_sample: true
2temperature: 0.65
3top_p: 0.55
4top_k: 35
5repetition_penalty: 1.1761from transformers import pipeline
2
3generate = pipeline("text-generation", "Felladrin/Minueza-32M-UltraChat")
4
5messages = [
6 {
7 "role": "system",
8 "content": "You are a highly knowledgeable and friendly assistant. Your goal is to understand and respond to user inquiries with clarity. Your interactions are always respectful, helpful, and focused on delivering the most accurate information to the user.",
9 },
10 {
11 "role": "user",
12 "content": "Hey! Got a question for you!",
13 },
14 {
15 "role": "assistant",
16 "content": "Sure! What's it?",
17 },
18 {
19 "role": "user",
20 "content": "What are some potential applications for quantum computing?",
21 },
22]
23
24prompt = generate.tokenizer.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
25
26output = generate(
27 prompt,
28 max_new_tokens=256,
29 do_sample=True,
30 temperature=0.65,
31 top_k=35,
32 top_p=0.55,
33 repetition_penalty=1.176,
34)
35
36print(output[0]["generated_text"])| Hyperparameter | Value |
|---|---|
| Learning rate | 2e-5 |
| Total train batch size | 16 |
| Max. sequence length | 2048 |
| Weight decay | 0 |
| Warmup ratio | 0.1 |
| Optimizer | Adam with betas=(0.9,0.999) and epsilon=1e-08 |
| Scheduler | cosine |
| Seed | 42 |
| Metric | Value |
|---|---|
| Avg. | 28.97 |
| AI2 Reasoning Challenge (25-Shot) | 21.08 |
| HellaSwag (10-Shot) | 26.95 |
| MMLU (5-Shot) | 26.08 |
| TruthfulQA (0-shot) | 47.70 |
| Winogrande (5-shot) | 51.78 |
| GSM8k (5-shot) | 0.23 |