Views
No views yet
reddit-v5-dedupe-pii-nsfw-toxic-0074.json.gziko-004 is the fourth model in the iko series — a chain of continued pre-training runs starting from the original GPT-2 Medium checkpoint.| Field | Value |
|---|---|
| Base model | iko-003 (itself continued from iko-002) |
| Architecture | GPT-2 Medium (355M) |
| Adapter | LoRA (r=32, α=64, dropout=0.05) |
| Target modules | c_attn, c_proj, c_fc |
| Quantization | 4-bit NF4 + double quant |
| Sequence length | 512 |
| Effective batch size | 16 (2 × 8 gradient accumulation) |
| Learning rate | 2.2 × 10⁻⁵ |
| Optimizer | AdamW 8-bit |
| Scheduler | cosine decay + warmup |
| Training steps | ~250–270 (≈ 82 min on Colab T4) |
| Replay buffer | ~4000 examples from previous shard (0053) |
| New data consumed | ~62k documents from shard 0074 |
| Hardware | Google Colab Tesla T4 (single GPU) |
| Framework | transformers + peft + trl + bitsandbytes |
| Date | March 2026 |
1from transformers import pipeline, AutoTokenizer, AutoModelForCausalLM
2
3model_id = "iko-01/iko-004"
4
5tokenizer = AutoTokenizer.from_pretrained(model_id)
6model = AutoModelForCausalLM.from_pretrained(
7 model_id,
8 torch_dtype="auto",
9 device_map="auto"
10)
11
12pipe = pipeline(
13 "text-generation",
14 model=model,
15 tokenizer=tokenizer,
16 max_new_tokens=180,
17 do_sample=True,
18 temperature=0.85,
19 top_p=0.92,
20 repetition_penalty=1.05
21)
22
23prompt = """Write a sarcastic reddit comment about someone overusing AI emojis:"""
24
25out = pipe(prompt)[0]["generated_text"]
26print(out)1@misc{iko-series-2026,
2 author = {Younes (machkour)},
3 title = {iko — Continued Pre-training Series on Filtered Reddit Shards},
4 year = {2026},
5 publisher = {Hugging Face},
6 howpublished = {\url{https://huggingface.co/iko-01/iko-004}}
7}