Views
No views yet
由于模型一直在更新,请同时注明使用的模型版本等信息,方便进行质量评估和更新翻译。
请注意,如果给轻小说机翻站使用,请参见机翻站站内教程,本 repo 不适用。
| 参数量 | 发布时间-底模-版本 | 模型 |
|---|---|---|
| 32B | 20240508-Qwen1.5-32B-v0.9 | 🤗 Sakura-32B-Qwen2beta-v0.9-GGUF |
| 20240508-Qwen1.5-32B-v0.10pre1 | 🤗 Sakura-32B-Qwen2beta-v0.10pre1-GGUF | |
| 14B | 20240111-Qwen-14B-v0.9 | 🤗 Sakura-13B-LNovel-v0.9b-GGUF |
| 20240213-Qwen1.5-14B-v0.9 | 🤗 Sakura-14B-Qwen2beta-v0.9-GGUF | |
| 20240516-Qwen1.5-14B-v0.9.2 | 🤗 Sakura-14B-Qwen2beta-v0.9.2-GGUF | |
| (最新) | 20241008-Qwen2.5-14B-v1.0 | 🤗 Sakura-14B-Qwen2.5-v1.0-GGUF |
| 7B | 20240116-Qwen-7B-v0.9 | 🤗 Sakura-7B-LNovel-v0.9-GGUF |
| 20240531-Qwen1.5-7B-Galtransl-v2.6 | 🤗 Galtransl-v2.6 | |
| ~2B | 20240214-Qwen1.5-1.8B-v0.9.1 | 🤗 Sakura-1B8-Qwen2beta-v0.9.1-GGUF |
| 20241012-Qwen2.5-1.5B-v1.0 | 🤗 Sakura-1.5B-Qwen2.5-v1.0-GGUF |
huggingface.co改成hf-mirror.com,使用hf镜像站下载。\n的情况下保留\n的能力。降低行数与原文不一致的概率。| 模型量化类型 | 模型大小 | 推荐显存大小 |
|---|---|---|
| fp16 | 26.3G | 超出游戏显卡显存范围 |
| Q8_0 | 14G | 24G |
| Q6_K | 11.4G | 20G |
| Q5_K_M | 10.1G | 16G |
| Q4_K_M | 8.8G | 16G |
| Q3_K_M | 7.2G | 16G |
| Q2_K | 6.1G | 12G |
1input_text_list = ['a', 'bb', 'ccc', ...] # 一系列上下文文本,每个元素代表一行的文本
2raw_text = "\n".join(input_text_list)
3messages=[
4 {
5 "role": "system",
6 "content": "你是一个轻小说翻译模型,可以流畅通顺地以日本轻小说的风格将日文翻译成简体中文,并联系上下文正确使用人称代词,不擅自添加原文中没有的代词。"
7 },
8 {
9 "role": "user",
10 "content": "将下面的日文文本翻译成中文:" + raw_text
11 }
12]1 gpt_dict = [{
2 "src": "原文1",
3 "dst": "译文1",
4 "info": "注释信息1",
5 },]
6 gpt_dict_text_list = []
7 for gpt in gpt_dict:
8 src = gpt['src']
9 dst = gpt['dst']
10 info = gpt['info'] if "info" in gpt.keys() else None
11 if info:
12 single = f"{src}->{dst} #{info}"
13 else:
14 single = f"{src}->{dst}"
15 gpt_dict_text_list.append(single)
16
17 gpt_dict_raw_text = "\n".join(gpt_dict_text_list)
18
19 user_prompt = "根据以下术语表(可以为空):\n" + gpt_dict_raw_text + "\n\n" + "将下面的日文文本根据上述术语表的对应关系和备注翻译成中文:" + japanese
20 prompt = "<|im_start|>system\n你是一个轻小说翻译模型,可以流畅通顺地使用给定的术语表以日本轻小说的风格将日文翻译成简体中文,并联系上下文正确使用人称代词,注意不要混淆使役态和被动态的主语和宾语,不要擅自添加原文中没有的代词,也不要擅自增加或减少换行。<|im_end|>\n" \ # system prompt
21 + "<|im_start|>user\n" + user_prompt + "<|im_end|>\n" \ # user prompt
22 + "<|im_start|>assistant\n" # assistant prompt start<|im_start|>system
你是一个轻小说翻译模型,可以流畅通顺地以日本轻小说的风格将日文翻译成简体中文,并联系上下文正确使用人称代词,不擅自添加原文中没有的代词。<|im_end|>
<|im_start|>user
将下面的日文文本翻译成中文:日文第一行
日文第二行
日文第三行
...
日文第n行<|im_end|>
<|im_start|>assistant
1input_text_list = ['a', 'bb', 'ccc', ...] # 一系列上下文文本,每个元素代表一行的文本
2raw_text = "\n".join(input_text_list)
3prompt = "<|im_start|>system\n你是一个轻小说翻译模型,可以流畅通顺地以日本轻小说的风格将日文翻译成简体中文,并联系上下文正确使用人称代词,不擅自添加原文中没有的代词。<|im_end|>\n" \ # system prompt
4 + "<|im_start|>user\n将下面的日文文本翻译成中文:" + raw_text + "<|im_end|>\n" \ # user prompt
5 + "<|im_start|>assistant\n" # assistant prompt start1input_text = "" # 要翻译的日文
2query = "将下面的日文文本翻译成中文:" + input_text
3prompt = "<reserved_106>" + query + "<reserved_107>"1input_text = "" # 要翻译的日文
2query = "将下面的日文文本翻译成中文:" + input_text
3prompt = "<|im_start|>system\n你是一个轻小说翻译模型,可以流畅通顺地以日本轻小说的风格将日文翻译成简体中文,并联系上下文正确使用人称代词,不擅自添加原文中没有的代词。<|im_end|>\n<|im_start|>user\n" + query + "<|im_end|>\n<|im_start|>assistant\n"| 参数 | 值 |
|---|---|
| temperature | 0.1 |
| top p | 0.3 |
| do sample | True |
| beams number | 1 |
| repetition penalty | 1 |
| max new token | 512 |
| min new token | 1 |