Phát hiện hallucination tiếng Việt (ViHallu). Prompt Tuning: chèn 32 virtual token học được
vào trước input, đóng băng toàn bộ base model — chỉ train 81,920 tham số (0.002%).
Model 2 để so sánh với bản LoRA. DS319 Lab 6 · Lương Đắc Nguyên (23521041).
Kết quả (test = 2000)
Accuracy
Precision
Recall
Macro-F1
Sai format
0.8135
0.8149
0.8106
0.8098
0/2000
confusion matrix
So với LoRA (Acc 0.911): soft-prompt yếu hơn ~10 điểm nhưng chỉ dùng 81,920 tham số.