← Search

Florian Schottmann

2 accepted papers

2024

Turning English-centric LLMs Into Polyglots: How Much Multilinguality Is Needed?

EMNLP 2024finding

The vast majority of today’s large language models (LLMs) are English-centric, having been pretrained predominantly on English text. Yet, in order to meet user expectations, models need to be able to respond appropriately in multiple languages once deployed in downstream applications. This requires…

2023

Exploiting Biased Models to De-bias Text: A Gender-Fair Rewriting Model

ACL 2023long

Natural language generation models reproduce and often amplify the biases present in their training data. Previous research explored using sequence-to-sequence rewriting models to transform biased model outputs (or original texts) into more gender-fair language by creating pseudo training data throu…