EMNLP 2024finding0 citations

Demonstration Selection Strategies for Numerical Time Series Data-to-Text

Masayuki Kawarada, Tatsuya Ishigaki, Goran Topić, Hiroya Takamura

Abstract

Demonstration selection, the process of selecting examples used in prompts, plays a critical role in in-context learning. This paper explores demonstration selection methods for data-to-text tasks that involve numerical time series data as inputs.Previously developed demonstration selection methods primarily focus on textual inputs, often relying on embedding similarities of textual tokens to select similar instances from an example bank. However, this approach may not be suitable for numerical time series data.To address this issue, we propose two novel selection methods: (1) sequence similarity-based selection using various similarity measures, and (2) task-specific knowledge-based selection.From our experiments on two benchmark datasets, we found that our proposed models significantly outperform baseline selections and often surpass fine-tuned models. We also found that scale-invariant similarity measures such as Pearson’s correlation work better than scale-variant measures such as Euclidean distance.Manual evaluation by human judges also confirms that our proposed methods outperform conventional methods.

BibTeX
@inproceedings{kawarada-etal-2024-demonstration,
    title = "Demonstration Selection Strategies for Numerical Time Series Data-to-Text",
    author = "Kawarada, Masayuki  and
      Ishigaki, Tatsuya  and
      Topi{\'c}, Goran  and
      Takamura, Hiroya",
    editor = "Al-Onaizan, Yaser  and
      Bansal, Mohit  and
      Chen, Yun-Nung",
    booktitle = "Findings of the Association for Computational Linguistics: EMNLP 2024",
    month = nov,
    year = "2024",
    address = "Miami, Florida, USA",
    publisher = "Association for Computational Linguistics",
    url = "https://aclanthology.org/2024.findings-emnlp.435/",
    doi = "10.18653/v1/2024.findings-emnlp.435",
    pages = "7378--7392"
}