Đây là bộ dữ liệu khổng lồ thế hệ mới nhất dành riêng cho việc huấn luyện Linh Hương Linux AI.
Tập dữ liệu này được chia làm 2 cấu hình (Configs) riêng biệt để tránh lỗi xung đột cấu trúc (Schema Conflict):
Chứa 1,783 tình huống Supervised Fine-Tuning, làm sạch 100% bằng Heuristic Rejection Sampling.
Multi-turn Chat: Hội thoại nhiều lượt (nhớ bối cảnh).
Function Calling: Gọi hàm điều… See the full description on the dataset page:
https://huggingface.co/datasets/linhhuonglinux/linhhuonglinux-office-dataset-v3.