Model Card for None This model is a fine tuned version of meta llama/Llama 3.1 8B. It has been trained using TRL. Quick start Training procedure This model was trained with SFT. Framework versions TRL: 0.24.0 Transformers: 4.57.1 Pytorch: 2.6.0+cu124.post3 Datasets: 4.3.0 Tokenizers: 0.22.1 Citations Cite TRL as:
We use cookies for essential functionality and analytics. You can accept or reject analytics cookies.Cookie policy