Views
No views yet
facebook/bart-base| Metric | Score |
|---|---|
| Token F1 | 0.6837 (+/-0.1693) |
| BLEU-4 | 0.2797 (+/-0.2664) |
| ROUGE-L | 0.5701 (+/-0.2118) |
| Exact Match | 7/200 (3.5%) |
| Original | Reconstructed | Token F1 |
|---|---|---|
| "This is important because childhood sets the stage for the robustness of the im... | "This is crucial because the childhood sets robust foundations for the immune sy... | 0.811 |
| Chapter 8: Made in the USA - A Statement About Quality and Pride |
1import torch, torch.nn as nn, transformers
2from safetensors.torch import load_file
3
4# Load model
5model = transformers.AutoModelForSeq2SeqLM.from_pretrained("facebook/bart-base")
6tokenizer = transformers.AutoTokenizer.from_pretrained("facebook/bart-base")
7hidden = model.config.hidden_size
8
9embedding_transform = nn.Sequential(
10 nn.Linear(4096, 4096), nn.LayerNorm(4096), nn.Dropout(0.1), nn.GELU(),
11 nn.Linear(4096, hidden * 16),
12)
13
14# Load weights (download from this repo)
15state = load_file("model.safetensors") # or torch.load("bart_noisy.pt")
16et_state = {k.replace("embedding_transform.", ""): v for k, v in state.items() if k.startswith("embedding_transform.")}
17embedding_transform.load_state_dict(et_state)
18ed_state = {k.replace("encoder_decoder.", ""): v for k, v in state.items() if k.startswith("encoder_decoder.")}
19model.load_state_dict(ed_state, strict=False)
20
21# Invert a Qwen3-Embedding-8B embedding (4096-dim)
22device = torch.device("cuda")
23model, embedding_transform = model.to(device).eval(), embedding_transform.to(device).eval()
24
25with torch.no_grad():
26 emb = torch.tensor(your_embedding, dtype=torch.float32).unsqueeze(0).to(device)
27 proj = embedding_transform(emb).reshape(1, 16, hidden)
28 out = model.generate(inputs_embeds=proj, attention_mask=torch.ones(1, 16, device=device),
29 max_length=128, num_beams=4, early_stopping=True)
30 text = tokenizer.decode(out[0], skip_special_tokens=True)