Views
No views yet
1git clone https://github.com/yourusername/bengali-code-llm.git
2cd bengali-code-llmpip install -r requirements.txt1export HUGGINGFACE_TOKEN="your_token_here"
2export WANDB_API_KEY="your_wandb_key_here"1# Collect data
2python scripts/data_collector.py
3
4# Train tokenizer
5python scripts/tokenizer_trainer.py
6
7# Train model
8python scripts/model_trainer.py
9
10# Evaluate model
11python scripts/model_evaluator.pyscripts/data_collector.py)scripts/tokenizer_trainer.py)scripts/model_trainer.py)scripts/model_evaluator.py)bengali-code-llm/
├── .github/
│ └── workflows/
│ └── train_model.yml
├── scripts/
│ ├── data_collector.py
│ ├── tokenizer_trainer.py
│ ├── model_trainer.py
│ └── model_evaluator.py
├── data/
│ └── raw/
├── outputs/
│ ├── tokenizer/
│ ├── model/
│ └── evaluation/
├── requirements.txt
└── README.md