Views
No views yet
1# config.json
2"model_type": "granite"
3"architectures": [
4 "GraniteForCausalLM"
5]1# config.json
2"model_type": "llama"
3"architectures": [
4 "LlamaForCausalLM"
5]1# llama.cpp
2./llama-server --verbose --gpu-layers 99999 --parallel 2 --ctx-size 4096 -m ~/instructlab/models/granite-3.0-8b-instruct-Q4_K_M.gguf1# vllm
2vllm serve ~/instructlab/models/granite-3.0-8b-instruct-Q4_K_M.gguf