Views
No views yet
french-llm-v3-mistral-Q4_K_M.gguf (168 MB, quantisé Q4_K_M) ⭐french-llm-v3-mistral-f16.gguf (520 MB, précision float16)config.json, pytorch_model.bin (519 MB)tokenizer.json + config (vocabulaire Mistral 32k)vincent-pro-ai/french-llm-from-scratch-GGUFfrench-llm-v3-mistral-Q4_K_M.gguf (168 MB)pip install "transformers>=4.41" torch accelerate1from transformers import AutoModelForCausalLM, AutoTokenizer
2import torch
3
4repo = "vincent-pro-ai/french-llm-from-scratch-GGUF"
5tokenizer = AutoTokenizer.from_pretrained(repo)
6model = AutoModelForCausalLM.from_pretrained(repo, torch_dtype=torch.float16, device_map="auto")
7
8prompt = "Bonjour, comment ça va ?\n"
9inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
10out = model.generate(**inputs, max_new_tokens=100, temperature=0.8, top_p=0.9)
11print(tokenizer.decode(out[0], skip_special_tokens=True))