tartuNLP/Llama-3.1-EstLLM-8B-Instruct-1125
Text Generation • 8B • Updated • 735 • • 6
None defined yet.
EstLLM: Enhancing Estonian Capabilities in Multilingual LLMs via Continued Pretraining and Post-Training
Teaching Old Tokenizers New Words: Efficient Tokenizer Adaptation for Pre-trained Models