Views
No views yet

| Model | ELYZA-tasks-100 GPT4 score |
|---|---|
| Llama-3-ELYZA-JP-8B | 3.655 |
| Llama-3-ELYZA-JP-8B-GGUF (Q4_K_M) | 3.57 |
| Llama-3-ELYZA-JP-8B-AWQ | 3.39 |
pip install vllm1from vllm import LLM, SamplingParams
2
3llm = LLM(model="elyza/Llama-3-ELYZA-JP-8B-AWQ", quantization="awq")
4tokenizer = llm.get_tokenizer()
5
6DEFAULT_SYSTEM_PROMPT = "あなたは誠実で優秀な日本人のアシスタントです。特に指示が無い場合は、常に日本語で回答してください。"
7sampling_params = SamplingParams(temperature=0.6, top_p=0.9, max_tokens=1000)
8messages_batch = [
9 [
10 {"role": "system", "content": DEFAULT_SYSTEM_PROMPT},
11 {"role": "user", "content": "古代ギリシャを学ぶ上で知っておくべきポイントは?"}
12 ],
13 [
14 {"role": "system", "content": DEFAULT_SYSTEM_PROMPT},
15 {"role": "user", "content": "クマが海辺に行ってアザラシと友達になり、最終的には家に帰るというプロットの短編小説を書いてください。"}
16 ]
17]
18
19prompts = [
20 tokenizer.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
21 for messages in messages_batch
22]
23
24outputs = llm.generate(prompts, sampling_params)
25
26# Print the outputs.
27for output in outputs:
28 print(output.outputs[0].text)
29 print("=" * 50)1python -m vllm.entrypoints.openai.api_server \
2--model elyza/Llama-3-ELYZA-JP-8B-AWQ \
3--port 8000 \
4--host localhost \
5--quantization awq1curl http://localhost:8000/v1/chat/completions \
2-H "Content-Type: application/json" \
3-d '{
4 "model": "elyza/Llama-3-ELYZA-JP-8B-AWQ",
5 "messages": [
6 { "role": "system", "content": "あなたは誠実で優秀な日本人のアシスタントです。特に指示が無い場合は、常に日本語で回答してください。" },
7 { "role": "user", "content": "古代ギリシャを学ぶ上で知っておくべきポイントは?" }
8 ],
9 "temperature": 0.6,
10 "max_tokens": 1000,
11 "stream": false
12}'1import openai
2
3client = openai.OpenAI(
4 base_url="http://localhost:8000/v1",
5 api_key = "dummy_api_key"
6)
7
8completion = client.chat.completions.create(
9 model="elyza/Llama-3-ELYZA-JP-8B-AWQ",
10 messages=[
11 {"role": "system", "content": "あなたは誠実で優秀な日本人のアシスタントです。特に指示が無い場合は、常に日本語で回答してください。"},
12 {"role": "user", "content": "古代ギリシャを学ぶ上で知っておくべきポイントは?"}
13 ]
14)1@misc{elyzallama2024,
2 title={elyza/Llama-3-ELYZA-JP-8B},
3 url={https://huggingface.co/elyza/Llama-3-ELYZA-JP-8B},
4 author={Masato Hirakawa and Shintaro Horie and Tomoaki Nakamura and Daisuke Oba and Sam Passaglia and Akira Sasaki},
5 year={2024},
6}1@article{llama3modelcard,
2 title={Llama 3 Model Card},
3 author={AI@Meta},
4 year={2024},
5 url = {https://github.com/meta-llama/llama3/blob/main/MODEL_CARD.md}
6}