M2Lingual: Enhancing Multilingual, Multi-Turn Instruction Alignment in Large Language Models
Collecting instruction fine-tuning (IFT) data is a resource and time intensive task especially in multilingual setting where finding proficient native speakers is challenging. Moreover, traditional data collection is prone to privacy risks, toxicity and lacks scalability. While, fully synthetic data…