BenNumEval: A Benchmark to Assess LLMs’ Numerical Reasoning Capabilities in Bengali
Large Language Models (LLMs) demonstrate exceptional proficiency in general-purpose tasks but struggle with numerical reasoning, particularly in low-resource languages like Bengali. Despite advancements, limited research has explored their numerical reasoning capabilities in these languages. To addr…