Views
No views yet
model.safetensors) for the Mistral-7B architecture. It is ready for deployment, inference, and downstream fine-tuning tasks.model.safetensors: The primary tensor weights ($\approx 7.34$ GB optimized format).config.json & generation_config.json: Architecture settings and text generation parameters (temperature, top_p).tokenizer.json & tokenizer_config.json: The vocabulary mapping and tokenization configurations.chat_template.jinja: Built-in template for structuring conversational inputs.pip install transformers torch accelerate safetensors1from transformers import AutoModelForCausalLM, AutoTokenizer
2import torch
3
4model_id = "mengleap-stnap/Mistral-7B"
5
6print("Loading tokenizer and model...")
7# Load Tokenizer
8tokenizer = AutoTokenizer.from_pretrained(model_id)
9
10# Load Model with FP16 precision for VRAM optimization
11model = AutoModelForCausalLM.from_pretrained(
12 model_id,
13 torch_dtype=torch.float16,
14 device_map="auto"
15)
16
17# Define your prompt
18prompt = "Explain the concept of Artificial Intelligence in three simple sentences."
19
20# Format input tokens
21inputs = tokenizer(prompt, return_tensors="pt").to("cuda" if torch.cuda.is_available() else "cpu")
22
23print("Generating response...")
24# Generate tokens
25with torch.no_grad():
26 outputs = model.generate(
27 **inputs,
28 max_new_tokens=150,
29 temperature=0.7,
30 do_sample=True,
31 top_p=0.9,
32 pad_token_id=tokenizer.eos_token_id
33 )
34
35# Decode and print output
36response = tokenizer.decode(outputs[0], skip_special_tokens=True)
37print("\n--- AI Response ---")
38print(response)1Parameter Value Description
2-------------------------------------------------------------------------------------------------
3temperature 0.7 Balances creativity and factual consistency.
4-------------------------------------------------------------------------------------------------
5top_p 0.9 Filters out low-probability words for smoother sentences.
6-------------------------------------------------------------------------------------------------
7do_sample True Enables probabilistic sampling instead of greedy decoding.

