tangledgroup
/

tangled-llama-109m-32k-base-v0.1

Text Generation

text-generation-inference

Inference Endpoints

Model card Files Files and versions Community

tangled-llama-109m-32k-base-v0.1 / scripts /TRAIN.md

mtasic85's picture

logo

ea06257 about 2 months ago

|

669 Bytes

	# Train

	## Tokenizer

	```bash
	cd scripts
	python -m venv venv
	source venv/bin/activate
	pip install -U -r requirements.in
	```

	```bash
	python -B train_tokenizer.py
	```

	## Dataset

	```bash
	cd scripts
	python -m venv venv-lit
	source venv-lit/bin/activate
	pip install -U -r requirements-lit.in
	```

	```bash
	python -B prepare_pretrain_dataset.py
	```

	## Model

	```bash
	cd scripts
	python -m venv venv-lit
	source venv-lit/bin/activate
	pip install -U -r requirements-lit.in
	```

	```bash
	litgpt pretrain --config ./model.yaml
	```

	## Evaluate

	```bash
	litgpt evaluate --tasks 'hellaswag,gsm8k,truthfulqa_mc2,mmlu,winogrande,arc_challenge' --batch_size 8 out/pretrain/final/
	```