Views
No views yet
Qwen/Qwen3-0.6B, treinado com técnicas de reinforcement learning usando GRPO (um tipo de treinamento baseado em recompensa) e com fine-tuning via LoRA. O objetivo foi ajustar o modelo para gerar respostas mais coerentes e contextualmente relevantes a partir de prompts inspirados no famoso repositório "Awesome ChatGPT Prompts".fka/awesome-chatgpt-prompts1from transformers import pipeline
2
3model = "Ambrosio1994/Qwen3-0.6B-awesome-prompts"
4generator = pipeline("text-generation", model=model)
5
6messages = [{"role": "user", "content": "Act as: an Ethereum developer"}]
7
8response = generator(messages, max_new_tokens=512, do_sample=True, temperature=1.0, min_p=0.1)
9print(response[0]["generated_text"][1]["content"])
10