Views
No views yet
AITeamVN/Vietnamese_Embedding in GGUF format1REL=b3827 # can change to a later release
2wget https://github.com/ggerganov/llama.cpp/releases/download/$REL/llama-$REL-bin-ubuntu-x64.zip --content-disposition --continue &> /dev/null
3wget https://github.com/ggerganov/llama.cpp/archive/refs/tags/$REL.zip --content-disposition --continue &> /dev/null
4unzip -q llama-$REL-bin-ubuntu-x64.zip
5unzip -q llama.cpp-$REL.zip
6mv llama.cpp-$REL/* .
7rm -r llama.cpp-$REL/ llama-$REL-bin-ubuntu-x64.zip llama.cpp-$REL.zip
8pip install -q -r requirements.txt
9
10rm -rf models/tmp/
11git clone --depth=1 --single-branch https://huggingface.co/AITeamVN/Vietnamese_Embedding models/tmp
12python convert_hf_to_gguf.py models/tmp/ --outfile model-f32.gguf --outtype f32
13
14build/bin/llama-quantize model-f32.gguf model-f16.gguf f16 2> /dev/null
15build/bin/llama-quantize model-f32.gguf model-bf16.gguf bf16 2> /dev/null
16build/bin/llama-quantize model-f32.gguf model-q8_0.gguf q8_0 2> /dev/null
17build/bin/llama-quantize model-f32.gguf model-q6_k.gguf q6_k 2> /dev/null
18build/bin/llama-quantize model-f32.gguf model-q5_k_m.gguf q5_k_m 2> /dev/null
19build/bin/llama-quantize model-f32.gguf model-q5_k_s.gguf q5_k_s 2> /dev/null
20build/bin/llama-quantize model-f32.gguf model-q4_k_m.gguf q4_k_m 2> /dev/null
21build/bin/llama-quantize model-f32.gguf model-q4_k_s.gguf q4_k_s 2> /dev/null
22
23rm -rf models/yolo/
24mkdir -p models/yolo
25mv model-*.gguf models/yolo/
26touch models/yolo/README.md
27huggingface-cli upload AITeamVN-Vietnamese_Embedding-gguf models/yolo .1build/bin/llama-embedding -m model-q5_k_m.gguf -p "Cô ấy cười nói suốt cả ngày" --embd-output-format array 2> /dev/null
2# OR
3build/bin/llama-server --embedding -c 8192 -m model-q5_k_m.gguf