Views
No views yet
1pip install xformers transformers
2pip install flash-attn --no-build-isolation
3git clone https://github.com/Dao-AILab/flash-attention && cd flash-attention
4cd csrc/rotary && pip install .
5cd ../layer_norm && pip install .1import torch
2from transformers import AutoModelForCausalLM
3
4# load pretrain model
5model = AutoModelForCausalLM.from_pretrained('qcw2333/YingLong_6m', trust_remote_code=True,torch_dtype=torch.bfloat16).cuda()
6
7# prepare input
8batch_size, lookback_length = 1, 2880
9seqs = torch.randn(batch_size, lookback_length).bfloat16().cuda()
10
11# generate forecast
12prediction_length = 96
13output = model.generate(seqs, future_token=prediction_length)
14
15print(output.shape)