Views
No views yet
rinna/nekomata-14b-instruction
rinna/nekomata-14b. It adopts the Alpaca input format.1import torch
2from transformers import AutoTokenizer, AutoModelForCausalLM
3
4tokenizer = AutoTokenizer.from_pretrained("rinna/nekomata-14b-instruction", trust_remote_code=True)
5
6# Use GPU with bf16
7# model = AutoModelForCausalLM.from_pretrained("rinna/nekomata-14b-instruction", device_map="auto", trust_remote_code=True, bf16=True)
8
9# Use GPU with fp16
10# model = AutoModelForCausalLM.from_pretrained("rinna/nekomata-14b-instruction", device_map="auto", trust_remote_code=True, fp16=True)
11
12# Use CPU
13# model = AutoModelForCausalLM.from_pretrained("rinna/nekomata-14b-instruction", device_map="cpu", trust_remote_code=True)
14
15# Automatically select device and precision
16model = AutoModelForCausalLM.from_pretrained("rinna/nekomata-14b-instruction", device_map="auto", trust_remote_code=True)
17
18instruction = "次の日本語を英語に翻訳してください。"
19input = "大規模言語モデル(だいきぼげんごモデル、英: large language model、LLM)は、多数のパラメータ(数千万から数十億)を持つ人工ニューラルネットワークで構成されるコンピュータ言語モデルで、膨大なラベルなしテキストを使用して自己教師あり学習または半教師あり学習によって訓練が行われる。"
20prompt = f"""
21以下は、タスクを説明する指示と、文脈のある入力の組み合わせです。要求を適切に満たす応答を書きなさい。
22
23### 指示:
24{instruction}
25
26### 入力:
27{input}
28
29### 応答:
30"""
31token_ids = tokenizer.encode(prompt, add_special_tokens=False, return_tensors="pt")
32
33with torch.no_grad():
34 output_ids = model.generate(
35 token_ids.to(model.device),
36 max_new_tokens=200,
37 do_sample=True,
38 temperature=0.5,
39 pad_token_id=tokenizer.pad_token_id,
40 bos_token_id=tokenizer.bos_token_id,
41 eos_token_id=tokenizer.eos_token_id
42 )
43
44output = tokenizer.decode(output_ids.tolist()[0])
45print(output)
46"""
47以下は、タスクを説明する指示と、文脈のある入力の組み合わせです。要求を適切に満たす応答を書きなさい。
48
49### 指示:
50次の日本語を英語に翻訳してください。
51
52### 入力:
53大規模言語モデル(だいきぼげんごモデル、英: large language model、LLM)は、多数のパラメータ(数千万から数十億)を持つ人工ニューラルネットワークで構成されるコンピュータ言語モデルで、膨大なラベルなしテキストを使 用して自己教師あり学習または半教師あり学習によって訓練が行われる。
54
55### 応答:
56 A large language model (LLM) is a computer language model composed of artificial neural networks with many parameters (from tens of millions to billions) trained by self-supervised learning or semi-supervised learning using a large amount of unlabeled text.<|endoftext|>
57"""rinna/nekomata-14b for tokenization details.@misc{RinnaNekomataInstruction14b,
url={https://huggingface.co/rinna/nekomata-14b-instruction},
title={rinna/nekomata-14b-instruction},
author={Zhao, Tianyu and Sawada, Kei}
}