Views
No views yet
1from transformers import AutoTokenizer, pipeline
2from transformers import AutoModelForCausalLM, AutoTokenizer, TextStreamer,GenerationConfig,TextIteratorStreamer
3from optimum.onnxruntime import ORTModelForCausalLM
4from transformers import logging
5logging.set_verbosity_error()
6import time
7model_id="brianwoo/GPT2-Onnx-Quantized"
8tokenizer = AutoTokenizer.from_pretrained(model_id)
9model = ORTModelForCausalLM.from_pretrained(model_id)
10streamer = TextStreamer(tokenizer,skip_prompt=True, skip_special_tokens=True,return_text=True)
11
12onnx_gen = pipeline("text-generation", model=model, tokenizer=tokenizer,streamer=streamer,return_text=True)
13
14while True:
15 text = input("\nBrian:")
16 print("Bot:\n")
17 t0=time.time()
18 gen = onnx_gen(text)
19 t=time.time()-t0
20 text=gen[0]["generated_text"]
21 print(t,len(text.split(" "))/t,"words /sec")
22
231from optimum.onnxruntime import ORTStableDiffusionXLImg2ImgPipeline , ORTStableDiffusionXLPipeline,ORTModelForCausalLM
2from transformers import AutoTokenizer
3from optimum.onnxruntime import ORTOptimizer
4from optimum.onnxruntime.configuration import OptimizationConfig
5from optimum.onnxruntime.configuration import AutoQuantizationConfig
6from optimum.onnxruntime import ORTQuantizer
7import os,torch
8from pathlib import Path
9Gbase="/gdrive/MyDrive/onnx/"
10
11model_checkpoint = "gpt2"
12save_directory = Gbase+"onnx/gpt2_arm64"
13
14tasks=['TinyLlama/TinyLlama-1.1B-Chat-v0.6',
15'pankajmathur/orca_mini_3b',
16'Fredithefish/RedPajama-INCITE-Chat-3B-Instruction-Tuning-with-GPT-4',
17'CobraMamba/mamba-gpt-3b-v4',
18'WizardLM/WizardCoder-3B-V1.0',
19'GeneZC/MiniChat-3B']
20
21
22
23
24#TinyLlama/TinyLlama-1.1B-Chat-v0.6
25#pankajmathur/orca_mini_3b
26#Fredithefish/RedPajama-INCITE-Chat-3B-Instruction-Tuning-with-GPT-4
27#CobraMamba/mamba-gpt-3b-v4
28#WizardLM/WizardCoder-3B-V1.0
29#GeneZC/MiniChat-3B
30
31def quantModel(model_checkpoint=model_checkpoint,save_directory=save_directory):
32 tokenizer = AutoTokenizer.from_pretrained(model_checkpoint)
33 tokenizer.save_pretrained(save_directory)
34 ort_model = ORTModelForCausalLM.from_pretrained(model_checkpoint, export=True)
35
36 optimizer = ORTOptimizer.from_pretrained(ort_model)
37 optimization_config = OptimizationConfig(optimization_level=3)
38
39 qconfig = AutoQuantizationConfig.arm64(is_static=False, per_channel=False)
40
41 quantizer = ORTQuantizer.from_pretrained(ort_model)
42
43 quantizer.quantize(save_dir=save_directory, quantization_config=qconfig,use_external_data_format=True)
44
45def doTasks(tasks=tasks,Gbase=Gbase):
46 for model_checkpoint in tasks:
47 save_directory=os.path.join(Gbase,Path(model_checkpoint).name)
48 try:quantModel(model_checkpoint=model_checkpoint,save_directory=save_directory)
49 except:
50 import traceback
51 traceback.print_exc()
52
53
54doTasks()1termux-setup-storage
2termux-wake-lock
3termux-change-repo
4pkg install tur-repo
5pkg update && pkg upgrade
6pkg install git proot-distro termimage vim termux-api
7
8
9
10disname='debian'
11user='brian'
12echo "proot-distro login $disname" > .shortcuts/debianai.sh
13echo "proot-distro login debian --user $user" > .shortcuts/debian.sh
14proot-distro install debian
15proot-distro login debian
16
17
18
19user='brian'
20apt update && apt upgrade
21apt install sudo locales
22echo "LANG=zh_CN.UTF-8" >> /etc/locale.conf
23sudo locale-gen
24adduser $user
25gpasswd -a $user sudo
26echo "$user ALL=(ALL:ALL) ALL" >> /etc/sudoers
27login $user
28
29
30
31
32
33echo 'source llm/bin/activate && source .cargo/env && cd /sdcard/Documents/Pydroid3/llm' > llm.env
34sudo locale-gen zh_CN.UTF-8
35sudo apt update && apt upgrade
36sudo apt install python3-full git curl vim wget
37sudo apt install python-is-python3
38sudo apt install python3-pip
39sudo apt install clang wget git cmake
40sudo apt install opencl-headers
41sudo apt install libopenblas-dev libopenblas0 libopenblas64-0 libblis-openmp-dev
42sudo apt install python3-torch python3-torchaudio python3-torchtext python3-torchvision
43sudo apt install libideep-dev libtorch-dev libonnx1
44sudo apt install pandoc build-essential
45sudo apt install libopenblas-dev libopenblas-openmp-dev libopenblas0 libopenblas64-0-openmp libopenblas64-dev libopenblas64-openmp-dev
46sudo apt install opencl-c-headers opencl-clhpp-headers libasl-dev libasl0 libclblast-dev libclc-13
47sudo apt install pandoc
48curl --proto '=https' --tlsv1.2 -sSf https://sh.rustup.rs | sh
49cd
50git clone https://github.com/flame/blis
51cd blis
52./configure --enable-cblas -t openmp auto
53make -j
54sudo make install
55rm -rf CLBlast/
56rm -rf llama.cpp
57git clone https://github.com/ggerganov/llama.cpp
58cd llama.cpp
59mkdir build
60make LLAMA_BLIS=1 -j -B
61cd
62python -m venv llm
63source llm/bin/activate
64
65
66pip uninstall ctransformers llama-cpp-python
67rm -rf ctransformers
68git clone --recurse-submodules https://github.com/marella/ctransformers
69cd ctransformers
70bash ./scripts/build.sh
71cd
72python -m pip install ./ctransformers/
73CMAKE_ARGS="-DLLAMA_BLAS=ON" pip install llama-cpp-python
74
75pip install --upgrade pip
76pip install --upgrade diffusers[torch]
77pip install --upgrade accelerate peft openvino optimum onnx onnxruntime nncf
78pip install opencv-python fastapi uvicorn flask
79pip install fastapi python-multipart pydantic sqlalchemy opencc-python-reimplemented pandas
80pip install --upgrade pip
81pip install fast-sentence-transformers
82pip install langchain
83pip install wikipedia unstructured pypdf pdf2image pdfminer chromadb qdrant-client lark momento annoy
84pip install doc2text pypandoc pandoc
85pip install opencv-python fastapi uvicorn flask
86pip install fastapi python-multipart pydantic sqlalchemy opencc-python-reimplemented pandas
87pip install --upgrade-strategy eager install optimum[onnxruntime]
88pip install optimum-intel
89pip install --upgrade-strategy eager optimum[openvino,nncf]
90pip install --force-reinstall transformers[torch]
91pip install --force-reinstall diffusers[torch]
921
2termux-setup-storage
3termux-wake-lock
4termux-change-repo
5pkg install tur-repo
6pkg update && pkg upgrade
7pkg install git proot-distro termimage vim termux-api
8
9
10
11disname='ubuntu'
12user='brian'
13echo "proot-distro login $disname" > .shortcuts/debianai.sh
14echo "proot-distro login ubuntu --user $user" > .shortcuts/ubuntu.sh
15proot-distro install ubuntu
16proot-distro login ubuntu
17
18
19
20
21user='brian'
22apt update && apt upgrade
23apt install sudo locales adduser
24echo "LANG=zh_CN.UTF-8" >> /etc/locale.conf
25sudo locale-gen
26adduser $user
27sudo gpasswd -a $user sudo
28echo "$user ALL=(ALL:ALL) ALL" >> /etc/sudoers
29login $user
30
31
32
33
34
35echo 'source llm/bin/activate && source .cargo/env && cd /sdcard/Documents/Pydroid3/llm' > llm.env
36sudo locale-gen zh_CN.UTF-8
37sudo apt update && apt upgrade
38sudo apt install python3-full git curl vim wget
39sudo apt install python-is-python3
40sudo apt install python3-pip
41sudo apt install clang wget git cmake
42sudo apt install opencl-headers
43sudo apt install libopenblas-dev libopenblas0 libopenblas64-0 libblis-openmp-dev
44sudo apt install python3-torch python3-torchaudio python3-torchtext python3-torchvision
45sudo apt install libideep-dev libtorch-dev libonnx1
46sudo apt install pandoc build-essential
47sudo apt install libopenblas-dev libopenblas-openmp-dev libopenblas0 libopenblas64-0-openmp libopenblas64-dev libopenblas64-openmp-dev
48sudo apt install opencl-c-headers opencl-clhpp-headers libasl-dev libasl0 libclblast-dev libclc-13
49sudo apt install pandoc
50curl --proto '=https' --tlsv1.2 -sSf https://sh.rustup.rs | sh
51cd
52git clone https://github.com/flame/blis
53cd blis
54./configure --enable-cblas -t openmp auto
55make -j
56sudo make install
57rm -rf CLBlast/
58rm -rf llama.cpp
59git clone https://github.com/ggerganov/llama.cpp
60cd llama.cpp
61mkdir build
62make LLAMA_BLIS=1 -j -B
63cd
64python -m venv llm
65source llm/bin/activate
66
67
68pip uninstall ctransformers llama-cpp-python
69rm -rf ctransformers
70git clone --recurse-submodules https://github.com/marella/ctransformers
71cd ctransformers
72bash ./scripts/build.sh
73cd
74python -m pip install ./ctransformers/
75CMAKE_ARGS="-DLLAMA_BLAS=ON" pip install llama-cpp-python
76
77pip install --upgrade pip
78pip install --upgrade diffusers[torch]
79pip install --upgrade accelerate peft openvino optimum onnx onnxruntime nncf
80pip install opencv-python fastapi uvicorn flask
81pip install fastapi python-multipart pydantic sqlalchemy opencc-python-reimplemented pandas
82pip install --upgrade pip
83pip install fast-sentence-transformers
84pip install langchain
85pip install wikipedia unstructured pypdf pdf2image pdfminer chromadb qdrant-client lark momento annoy
86pip install doc2text pypandoc pandoc
87pip install opencv-python fastapi uvicorn flask
88pip install fastapi python-multipart pydantic sqlalchemy opencc-python-reimplemented pandas
89pip install --upgrade-strategy eager install optimum[onnxruntime]
90pip install optimum-intel
91pip install --upgrade-strategy eager optimum[openvino,nncf]
92pip install --force-reinstall transformers[torch]
93pip install --force-reinstall diffusers[torch]
94