Views
No views yet
| Count | Domain | |
| Chinese Persona Chat (CPC) | 23,000 | Open |
| LCCC | 11,987,759 | Open |
| Emotional STC (ESTC) | 899,207 | Open |
| KdConv | 3,000 | Movie, Music, Travel |
[CLS] 对话历史:<history> [SEP] 知识:<knowledge> [SEP][CLS] <response> [SEP]1from transformers import BertTokenizer, BartForConditionalGeneration
2
3# Note that tokenizer is an object of BertTokenizer, instead of BartTokenizer
4tokenizer = BertTokenizer.from_pretrained("HIT-TMG/dialogue-bart-large-chinese")
5model = BartForConditionalGeneration.from_pretrained("HIT-TMG/dialogue-bart-large-chinese")
6
7# an example from CPC dev data
8history = ["可以 认识 一下 吗 ?", "当然 可以 啦 , 你好 。", "嘿嘿 你好 , 请问 你 最近 在 忙 什么 呢 ?", "我 最近 养 了 一只 狗狗 , 我 在 训练 它 呢 。"]
9history_str = "对话历史:" + tokenizer.sep_token.join(history)
10input_ids = tokenizer(history_str, return_tensors='pt').input_ids
11output_ids = model.generate(input_ids)[0]
12print(tokenizer.decode(output_ids, skip_special_tokens=True))