Views
No views yet
google/gemma-4-e2b-it (via unsloth/gemma-4-E2B-it)q_proj, k_proj, v_proj, o_proj, gate_proj, up_proj, down_proj)1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_name = "Capitaller/gemma_4E2B-it_finetune"
4tokenizer = AutoTokenizer.from_pretrained(model_name)
5model = AutoModelForCausalLM.from_pretrained(model_name)
6
7# Ensure you use the proper chat format
8messages = [
9 {"role": "user", "content": "How should I design an Agentic AI architecture on AWS that uses the Model Context Protocol (MCP)?"},
10]
11
12inputs = tokenizer.apply_chat_template(
13 messages,
14 add_generation_prompt=True,
15 tokenize=True,
16 return_tensors="pt"
17)
18
19outputs = model.generate(inputs, max_new_tokens=256, temperature=0.7)
20response = tokenizer.decode(outputs[0], skip_special_tokens=True)
21print(response)"What are the recommended AWS compute platforms for hosting an MCP server?""Write a brief step-by-step guide on securing an AI agent communication channel on AWS."