Views
No views yet
bldeaw/m1_planner_q4_k_m using llama.cpp on Hugging Face Spaces./data1MODEL_REPO_ID=bldeaw/m1_planner_q4_k_m
2MODEL_FILE=m1_planner_q4_k_m.gguf
3MODEL_REVISION=main
4CTX_SIZE=2048
5THREADS=2
6N_GPU_LAYERS=0
7MODEL_DIR=/data/models
8PORT=7860HF_TOKEN=hf_xxxxxMODEL_SHA256=xxxxxxxx1Dockerfile
2start.sh
3.dockerignore
4README.md1git clone https://huggingface.co/spaces/bldeaw/planner-llm
2cp Dockerfile start.sh .dockerignore README.md planner-llm/
3cd planner-llm
4git add .
5git commit -m "production deploy"
6git push origin main1from openai import OpenAI
2
3client = OpenAI(
4 base_url="https://bldeaw-planner-llm.hf.space/v1",
5 api_key="dummy"
6)
7
8resp = client.chat.completions.create(
9 model="local-model",
10 messages=[
11 {"role": "user", "content": "Hello"}
12 ]
13)
14
15print(resp.choices[0].message.content)1curl https://bldeaw-planner-llm.hf.space/v1/chat/completions \
2 -H "Content-Type: application/json" \
3 -d '{
4 "model": "local-model",
5 "messages": [
6 {"role": "user", "content": "Hello"}
7 ]
8 }'| Endpoint | Method |
|---|---|
| /v1/chat/completions | POST |
| /v1/completions | POST |
| /v1/models | GET |
| / | GET |
.env.gguf into the Space repo