Obsidian Bases Query Dataset
Training data for a small language model that converts natural language questions into Obsidian Bases .base file format.
instruction: Natural language question
output: JSON .base file content
For fine-tuning Qwen 3 0.6B with TRL/SFT.
1,000 training samples
Generated via Claude Sonnet 4
Based on real vault schema (10 entity types)