- Trained India's first bilingual Kannada-English Large Language Models, Ambari-7b, advancing linguistic capabilities.
- Utilized the LLama2 7b base model, fine-tuned across multiple stages with 1 billion Kannada tokens. Significantly enhanced tokenization efficiency by 85% for Kannada.
- Performed Multistage finetuning and evaluation