Views
No views yet
pip install simctg --upgrade1import torch
2# load SimCTG language model
3from simctg.simctggpt import SimCTGGPT
4model_name = r'cambridgeltl/simctg_lccc_dialogue'
5model = SimCTGGPT(model_name)
6model.eval()
7tokenizer = model.tokenizer
8eos_token = '[SEP]'
9eos_token_id = tokenizer.convert_tokens_to_ids([eos_token])[0]1context_list = ['刺猬很可爱!以前别人送了只没养,味儿太大!', '是很可爱但是非常臭', '是啊,没办法养', '那个怎么养哦不会扎手吗']
2prefix_text = eos_token.join(context_list).strip(eos_token) + eos_token
3print ('Prefix is: {}'.format(prefix_text))
4tokens = tokenizer.tokenize(prefix_text)
5input_ids = tokenizer.convert_tokens_to_ids(tokens)
6input_ids = torch.LongTensor(input_ids).view(1,-1)1beam_width, alpha, decoding_len = 5, 0.6, 64
2output = model.fast_contrastive_search(input_ids=input_ids, beam_width=beam_width, alpha=alpha,
3 decoding_len=decoding_len, end_of_sequence_token_id=eos_token_id,
4 early_stop=True)
5
6print("Output:\n" + 100 * '-')
7print(''.join(tokenizer.decode(output)))
8'''
9 Prefix is: 刺猬很可爱!以前别人送了只没养,味儿太大![SEP]是很可爱但是非常臭[SEP]是啊,没办法养[SEP]那个怎么养哦不会扎手吗[SEP]
10 Output:
11 ----------------------------------------------------------------------------------------------------
12 刺猬很可爱!以前别人送了只没养,味儿太大![SEP]是很可爱但是非常臭[SEP]是啊,没办法养[SEP]那个怎么养哦不会扎手吗[SEP]我觉得还好,就是有点臭
13'''1@article{su2022contrastive,
2 title={A Contrastive Framework for Neural Text Generation},
3 author={Su, Yixuan and Lan, Tian and Wang, Yan and Yogatama, Dani and Kong, Lingpeng and Collier, Nigel},
4 journal={arXiv preprint arXiv:2202.06417},
5 year={2022}
6}