← All conferences

COLING 2024 Accepted Papers

The full list of 1,554 papers accepted at COLING 2024 (International Conference on Computational Linguistics). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.

Main: 1,554
  1. GAATME: A Genetic Algorithm for Adversarial Translation Metrics EvaluationMain1 citations
  2. GENTRAC: A Tool for Tracing Trauma in Genocide and Mass Atrocity Court TranscriptsMain1 citations
  3. GRIT: A Dataset of Group Reference Recognition in ItalianMain1 citations
  4. Generating Hard-Negative Out-of-Scope Data with ChatGPT for Intent ClassificationMain1 citations
  5. Global and Local Hierarchical Prompt Tuning Framework for Multi-level Implicit Discourse Relation RecognitionMain1 citations
  6. Gradient Consistency-based Parameter Allocation for Multilingual Neural Machine TranslationMain1 citations
  7. Grounded Multimodal Procedural Entity Recognition for Procedural Documents: A New Dataset and BaselineMain1 citations
  8. Halwasa: Quantify and Analyze Hallucinations in Large Language Models: Arabic as a Case StudyMain1 citations
  9. HoLM: Analyzing the Linguistic Unexpectedness in Homeric PoetryMain1 citations
  10. How Do Hyenas Deal with Human Speech? Speech Recognition and Translation with ConfHyenaMain1 citations
  11. How Important Is Tokenization in French Medical Masked Language Models?Main1 citations
  12. Human and System Perspectives on the Expression of Irony: An Analysis of Likelihood Labels and RationalesMain1 citations
  13. Humanistic Buddhism Corpus: A Challenging Domain-Specific Dataset of English Translations for Classical and Modern ChineseMain1 citations
  14. HyperMR: Hyperbolic Hypergraph Multi-hop Reasoning for Knowledge-based Visual Question AnsweringMain1 citations
  15. IDEM: The IDioms with EMotions Dataset for Emotion RecognitionMain1 citations
  16. IR2: Information Regularization for Information RetrievalMain1 citations
  17. Improved Out-of-Scope Intent Classification with Dual Encoding and Threshold-based Re-ClassificationMain1 citations
  18. Improving Bengali and Hindi Large Language ModelsMain1 citations
  19. Improving Chinese Named Entity Recognition with Multi-grained Words and Part-of-Speech Tags via Joint ModelingMain1 citations
  20. Improving Cross-lingual Transfer with Contrastive Negative Learning and Self-trainingMain1 citations
  21. Improving Factual Consistency in Abstractive Summarization with Sentence Structure PruningMain1 citations
  22. Improving Multi-view Document Clustering: Leveraging Multi-structure Processor and Hybrid Ensemble Clustering ModuleMain1 citations
  23. Improving Role-Oriented Dialogue Summarization with Interaction-Aware Contrastive LearningMain1 citations
  24. Improving Text Readability through Segmentation into RhesesMain1 citations
  25. Improving Unsupervised Neural Machine Translation via Training Data Self-CorrectionMain1 citations
  26. Information Extraction with Differentiable Beam Search on Graph RNNsMain1 citations
  27. Integrating Representation Subspace Mapping with Unimodal Auxiliary Loss for Attention-based Multimodal Emotion RecognitionMain1 citations
  28. Introducing a Parsed Corpus of Historical High GermanMain1 citations
  29. Is Modularity Transferable? A Case Study through the Lens of Knowledge DistillationMain1 citations
  30. Is Spoken Hungarian Low-resource?: A Quantitative Survey of Hungarian Speech Data SetsMain1 citations
  31. J-SNACS: Adposition and Case Supersenses for Japanese JoshiMain1 citations
  32. JL-Hate: An Annotated Dataset for Joint Learning of Hate Speech and Target DetectionMain1 citations
  33. KGConv, a Conversational Corpus Grounded in WikidataMain1 citations
  34. KPatch: Knowledge Patch to Pre-trained Language Model for Zero-Shot Stance Detection on Social MediaMain1 citations
  35. KnowVrDU: A Unified Knowledge-aware Prompt-Tuning Framework for Visually-rich Document UnderstandingMain1 citations
  36. Knowledge-enhanced Prompt Tuning for Dialogue-based Relation Extraction with Trigger and Label SemanticMain1 citations
  37. Korean Disaster Safety Information Sign Language Translation Benchmark DatasetMain1 citations
  38. LI4: Label-Infused Iterative Information Interacting Based Fact Verification in Question-answering DialogueMain1 citations
  39. Landmark-Guided Cross-Speaker Lip Reading with Mutual Information RegularizationMain1 citations
  40. Language Pivoting from Parallel Corpora for Word Sense Disambiguation of Historical Languages: A Case Study on LatinMain1 citations
  41. Learning Intrinsic Dimension via Information Bottleneck for Explainable Aspect-based Sentiment AnalysisMain1 citations
  42. Learning from Wrong Predictions in Low-Resource Neural Machine TranslationMain1 citations
  43. Leveraging Pre-existing Resources for Data-Efficient Counter-Narrative Generation in KoreanMain1 citations
  44. LexComSpaL2: A Lexical Complexity Corpus for Spanish as a Foreign LanguageMain1 citations
  45. LightVLP: A Lightweight Vision-Language Pre-training via Gated Interactive Masked AutoEncodersMain1 citations
  46. Limitations of Human Identification of Automatically Generated TextMain1 citations
  47. Linguistic Nudges and Verbal Interaction with Robots, Smart-Speakers, and HumansMain1 citations
  48. Linguistic Rule Induction Improves Adversarial and OOD Robustness in Large Language ModelsMain1 citations
  49. LoSST-AD: A Longitudinal Corpus for Tracking Alzheimer’s Disease Related Changes in Spontaneous SpeechMain1 citations
  50. M3: A Multi-Task Mixed-Objective Learning Framework for Open-Domain Multi-Hop Dense Sentence RetrievalMain1 citations
  51. M3TCM: Multi-modal Multi-task Context Model for Utterance Classification in Motivational InterviewsMain1 citations
  52. MCIL: Multimodal Counterfactual Instance Learning for Low-resource Entity-based Multimodal Information ExtractionMain1 citations
  53. MEVTR: A Multilingual Model Enhanced with Visual Text RepresentationsMain1 citations
  54. MHGRL: An Effective Representation Learning Model for Electronic Health RecordsMain1 citations
  55. ManNER & ManPOS: Pioneering NLP for Endangered Manchu LanguageMain1 citations
  56. Mapping the Past: Geographically Linking an Early 20th Century Swedish Encyclopedia with WikidataMain1 citations
  57. Medical Entity Disambiguation with Medical Mention Relation and Fine-grained Entity KnowledgeMain1 citations
  58. Medical Vision-Language Pre-Training for Brain AbnormalitiesMain1 citations
  59. Meta-Cognitive Analysis: Evaluating Declarative and Procedural Knowledge in Datasets and Large Language ModelsMain1 citations
  60. Metaphors in Online Religious Communication: A Detailed Dataset and Cross-Genre Metaphor DetectionMain1 citations
  61. Mind Your Neighbours: Leveraging Analogous Instances for Rhetorical Role Labeling for Legal DocumentsMain1 citations
  62. Mitigating Shortcuts in Language Models with Soft Label EncodingMain1 citations
  63. MoDE-CoTD: Chain-of-Thought Distillation for Complex Reasoning Tasks with Mixture of Decoupled LoRA-ExpertsMain1 citations
  64. Morpheme Sense Disambiguation: A New Task Aiming for Understanding the Language at Character LevelMain1 citations
  65. Motion Capture Analysis of Verb and Adjective Types in Austrian Sign Language (ÖGS)Main1 citations
  66. Multi-Grained Conversational Graph Network for Retrieval-based Dialogue SystemsMain1 citations
  67. Multi-Objective Forward Reasoning and Multi-Reward Backward Refinement for Product Review SummarizationMain1 citations
  68. MultiLexBATS: Multilingual Dataset of Lexical Semantic RelationsMain1 citations
  69. Murre24: Dialect Identification of Finnish Internet Forum MessagesMain1 citations
  70. NB Uttale: A Norwegian Pronunciation Lexicon with Dialect VariationMain1 citations
  71. NGLUEni: Benchmarking and Adapting Pretrained Language Models for Nguni LanguagesMain1 citations
  72. NLPre: A Revised Approach towards Language-centric Benchmarking of Natural Language Preprocessing SystemsMain1 citations
  73. NLoPT: N-gram Enhanced Low-Rank Task Adaptive Pre-training for Efficient Language Model AdaptionMain1 citations
  74. Negation Scope Conversion: Towards a Unified Negation-Annotated DatasetMain1 citations
  75. New Methods for Exploring Intonosyntax: Introducing an Intonosyntactic Treebank for Nigerian PidginMain1 citations
  76. New Semantic Task for the French Spoken Language Understanding MEDIA BenchmarkMain1 citations
  77. On the Adaptation of Unlimiformer for Decoder-Only TransformersMain1 citations
  78. On the Relationship between Skill Neurons and Robustness in Prompt TuningMain1 citations
  79. Opinions Are Not Always Positive: Debiasing Opinion Summarization with Model-Specific and Model-Agnostic MethodsMain1 citations
  80. PEaCE: A Chemistry-Oriented Dataset for Optical Character Recognition on Scientific DocumentsMain1 citations
  81. POS Tagging for the Endangered Dagur LanguageMain1 citations
  82. PPORTAL_ner: An Annotated Corpus of Portuguese Literary EntitiesMain1 citations
  83. PRODIS - a Speech Database and a Phoneme-based Language Model for the Study of Predictability Effects in PolishMain1 citations
  84. PROM: A Phrase-level Copying Mechanism with Pre-training for Abstractive SummarizationMain1 citations
  85. PaReNT (Parent Retrieval Neural Tool): A Deep Dive into Word Formation across LanguagesMain1 citations
  86. Parsing Headed ConstituenciesMain1 citations
  87. Parsing for Mauritian Creole Using Universal DependenciesMain1 citations
  88. Pointing Out the Shortcomings of Relation Extraction Models with Semantically Motivated AdversarialsMain1 citations
  89. PolyNERE: A Novel Ontology and Corpus for Named Entity Recognition and Relation Extraction in Polymer Science DomainMain1 citations
  90. PopAut: An Annotated Corpus for Populism Detection in Austrian News CommentsMain1 citations
  91. Pre-training Cross-Modal Retrieval by Expansive Lexicon-Patch AlignmentMain1 citations
  92. Project MOSLA: Recording Every Moment of Second Language AcquisitionMain1 citations
  93. Projective Methods for Mitigating Gender Bias in Pre-trained Language ModelsMain1 citations
  94. Prompt-fused Framework for Inductive Logical Query AnsweringMain1 citations
  95. PromptStream: Self-Supervised News Story Discovery Using Topic-Aware Article RepresentationsMain1 citations
  96. Pruning before Fine-tuning: A Retraining-free Compression Framework for Pre-trained Language ModelsMain1 citations
  97. QUEEREOTYPES: A Multi-Source Italian Corpus of Stereotypes towards LGBTQIA+ Community MembersMain1 citations
  98. QueryNER: Segmentation of E-commerce QueriesMain1 citations
  99. RADCoT: Retrieval-Augmented Distillation to Specialization Models for Generating Chain-of-Thoughts in Query ExpansionMain1 citations
  100. REFeREE: A REference-FREE Model-Based Metric for Text SimplificationMain1 citations
  101. RISE: Robust Early-exiting Internal Classifiers for Suicide Risk EvaluationMain1 citations
  102. Rationale-based Learning Using Self-Supervised Narrative Events for Text Summarisation of Interactive Digital NarrativesMain1 citations
  103. ReCAP: Semantic Role Enhanced Caption GenerationMain1 citations
  104. ReadLet: A Dataset for Oral, Visual and Tactile Text Reading Data of Early and Mature ReadersMain1 citations
  105. Reassessing Semantic Knowledge Encoded in Large Language Models through the Word-in-Context TaskMain1 citations
  106. Rebalancing Label Distribution While Eliminating Inherent Waiting Time in Multi Label Active Learning Applied to TransformersMain1 citations
  107. Refining rtMRI Landmark-Based Vocal Tract Contour Labels with FCN-Based Smoothing and Point-to-Curve ProjectionMain1 citations
  108. ReflectSumm: A Benchmark for Course Reflection SummarizationMain1 citations
  109. Reimagining Intent Prediction: Insights from Graph-Based Dialogue Modeling and Sentence EncodersMain1 citations
  110. Relation Classification via Bidirectional Prompt Learning with Data Augmentation by Large Language ModelMain1 citations
  111. Reranking Overgenerated Responses for End-to-End Task-Oriented Dialogue SystemsMain1 citations
  112. Retrieval-based Question Answering with Passage Expansion Using a Knowledge GraphMain1 citations
  113. Revisiting Three Text-to-Speech Synthesis Experiments with a Web-Based Audience Response SystemMain1 citations
  114. RoCoIns: Enhancing Robustness of Large Language Models through Code-Style InstructionsMain1 citations
  115. Russian Learner Corpus: Towards Error-Cause Annotation for L2 RussianMain1 citations
  116. S3Prompt: Instructing the Model with Self-calibration, Self-recall and Self-aggregation to Improve In-context LearningMain1 citations
  117. SPACE-IDEAS: A Dataset for Salient Information Detection in Space InnovationMain1 citations
  118. SPICED: News Similarity Detection Dataset with Multiple Topics and Complexity LevelsMain1 citations
  119. STAGE: Simple Text Data Augmentation by Graph ExplorationMain1 citations
  120. Saliency-Aware Interpolative Augmentation for Multimodal Financial PredictionMain1 citations
  121. Samayik: A Benchmark and Dataset for English-Sanskrit TranslationMain1 citations
  122. Schema Learning Corpus: Data and Annotation Focused on Complex EventsMain1 citations
  123. Searching by Code: A New SearchBySnippet Dataset and SnippeR Retrieval Model for Searching by Code SnippetsMain1 citations
  124. Sebastian, Basti, Wastl?! Recognizing Named Entities in Bavarian Dialectal DataMain1 citations
  125. Seeing Is Believing! towards Knowledge-Infused Multi-modal Medical Dialogue GenerationMain1 citations
  126. Selective Temporal Knowledge Graph ReasoningMain1 citations
  127. Self-reported Demographics and Discourse Dynamics in a Persuasive Online ForumMain1 citations
  128. Sequence Reducible Holdout Loss for Language Model PretrainingMain1 citations
  129. Sequence-to-Sequence Language Models for Character and Emotion Detection in Dream NarrativesMain1 citations
  130. Sequential and Repetitive Pattern Learning for Temporal Knowledge Graph ReasoningMain1 citations
  131. Sharing the Cost of Success: A Game for Evaluating and Learning Collaborative Multi-Agent Instruction Giving and Following PoliciesMain1 citations
  132. SimLex-999 for DutchMain1 citations
  133. Soft Well-Formed Semantic Parsing with Score-Based SelectionMain1 citations
  134. Sonos Voice Control Bias Assessment Dataset: A Methodology for Demographic Bias Assessment in Voice AssistantsMain1 citations
  135. Spanish Resource Grammar Version 2023Main1 citations
  136. SpeechAlign: A Framework for Speech Translation Alignment EvaluationMain1 citations
  137. SpreadNaLa: A Naturalistic Code Generation Evaluation Dataset of Spreadsheet FormulasMain1 citations
  138. StructAM: Enhancing Address Matching through Semantic Understanding of Structure-aware InformationMain1 citations
  139. Structure-aware Fine-tuning for Code Pre-trained ModelsMain1 citations
  140. Sub-Table Rescorer for Table Question AnsweringMain1 citations
  141. Subspace Defense: Discarding Adversarial Perturbations by Learning a Subspace for Clean SignalsMain1 citations
  142. SwissSLi: The Multi-parallel Sign Language Corpus for SwitzerlandMain1 citations
  143. TARN-VIST: Topic Aware Reinforcement Network for Visual StorytellingMain1 citations
  144. TAeKD: Teacher Assistant Enhanced Knowledge Distillation for Closed-Source Multilingual Neural Machine TranslationMain1 citations
  145. TED-EL: A Corpus for Speech Entity LinkingMain1 citations
  146. TaiChi: Improving the Robustness of NLP Models by Seeking Common Ground While Reserving DifferencesMain1 citations
  147. Take Its Essence, Discard Its Dross! Debiasing for Toxic Language Detection via Counterfactual Causal EffectMain1 citations
  148. TeClass: A Human-Annotated Relevance-based Headline Classification and Generation Dataset for TeluguMain1 citations
  149. Term-Driven Forward-Looking Claim Synthesis in Earnings CallsMain1 citations
  150. Text Filtering Classifiers for Medium-Resource LanguagesMain1 citations
  151. The Contextual Variability of English Nouns: The Impact of Categorical Specificity beyond Conceptual ConcretenessMain1 citations
  152. The ELCo Dataset: Bridging Emoji and Lexical CompositionMain1 citations
  153. The Effects of Pretraining in Video-Guided Machine TranslationMain1 citations
  154. The Impact of Stance Object Type on the Quality of Stance DetectionMain1 citations
  155. The Key Points: Using Feature Importance to Identify Shortcomings in Sign Language Recognition ModelsMain1 citations
  156. The Low Saxon LSDC Dataset at Universal DependenciesMain1 citations
  157. The Open-World Lottery Ticket Hypothesis for OOD Intent ClassificationMain1 citations
  158. The ParCoLab Parallel Corpus and Its Extension to Four Regional Languages of FranceMain1 citations
  159. The Role of Syntactic Span Preferences in Post-Hoc Explanation DisagreementMain1 citations
  160. The Slovak Autistic and Non-Autistic Child Speech Corpus:Task-Oriented Child-Adult InteractionsMain1 citations
  161. Topic Classification and Headline Generation for Maltese Using a Public News CorpusMain1 citations
  162. Towards Autonomous Tool Utilization in Language Models: A Unified, Efficient and Scalable FrameworkMain1 citations
  163. Towards More Realistic Chinese Spell Checking with New Benchmark and Specialized Expert ModelMain1 citations
  164. Towards the WhAP Corpus: A Resource for the Study of Italian on WhatsAppMain1 citations
  165. Triples-to-isiXhosa (T2X): Addressing the Challenges of Low-Resource Agglutinative Data-to-Text GenerationMain1 citations
  166. Uncertainty-Aware Cross-Modal Alignment for Hate Speech DetectionMain1 citations
  167. Universal Dependencies for Learner RussianMain1 citations
  168. Unveiling Strengths and Weaknesses of NLP Systems Based on a Rich Evaluation Corpus: The Case of NER in FrenchMain1 citations
  169. User Guide for KOTE: Korean Online That-gul Emotions DatasetMain1 citations
  170. Utilizing Local Hierarchy with Adversarial Training for Hierarchical Text ClassificationMain1 citations
  171. VI-OOD: A Unified Framework of Representation Learning for Textual Out-of-distribution DetectionMain1 citations
  172. Who Is Bragging More Online? A Large Scale Analysis of Bragging in Social MediaMain1 citations
  173. Why Voice Biomarkers of Psychiatric Disorders Are Not Used in Clinical Practice? Deconstructing the Myth of the Need for Objective DiagnosisMain1 citations
  174. WkNER: Enhancing Named Entity Recognition with Word Segmentation Constraints and kNN RetrievalMain1 citations
  175. Word-Aware Modality Stimulation for Multimodal FusionMain1 citations
  176. WordNet under Scrutiny: Dictionary Examples in the Era of Large Language ModelsMain1 citations
  177. Zero-shot Event Detection Using a Textual Entailment Model as an Enhanced AnnotatorMain1 citations
  178. Zero-shot Learning for Multilingual Discourse Relation ClassificationMain1 citations
  179. mForms : Multimodal Form Filling with Question AnsweringMain1 citations
  180. A Closer Look at Clustering Bilingual Comparable CorporaMain
  181. A Community-Driven Data-to-Text Platform for Football Match SummariesMain
  182. A Computational Approach to Quantifying Grammaticization of English Deverbal PrepositionsMain
  183. A Concept Based Approach for Translation of Medical Dialogues into PictographsMain
  184. A Corpus and Method for Chinese Named Entity Recognition in ManufacturingMain
  185. A Dual-View Approach to Classifying Radiology Reports by Co-TrainingMain
  186. A Fast and High-quality Text-to-Speech Method with Compressed Auxiliary Corpus and Limited Target Speaker CorpusMain
  187. A Hierarchical Sequence-to-Set Model with Coverage Mechanism for Aspect Category Sentiment AnalysisMain
  188. A Japanese News Simplification Corpus with FaithfulnessMain
  189. A Lifelong Multilingual Multi-granularity Semantic Alignment Approach via Maximum Co-occurrence ProbabilityMain
  190. A Luxembourgish Corpus as a Gender Bias Evaluation TestsetMain
  191. A Multi-Task Transformer Model for Fine-grained Labelling of Chest X-Ray ReportsMain
  192. A Persona-Based Corpus in the Diabetes Self-Care Domain - Applying a Human-Centered Approach to a Low-Resource ContextMain
  193. A Reinforcement Learning Approach to Improve Low-Resource Machine Translation Leveraging Domain Monolingual DataMain
  194. A Self-verified Method for Exploring Simile Knowledge from Pre-trained Language ModelsMain
  195. A Tool for Determining Distances and Overlaps between Multimodal AnnotationsMain
  196. A Trusted Multi-View Evidential Fusion Framework for Commonsense ReasoningMain
  197. A Typology of Errors for User Utterances in ChatbotsMain
  198. ADEA: An Argumentative Dialogue Dataset on Ethical Issues Concerning Future A.I. ApplicationsMain
  199. Abstract-level Deductive Reasoning for Pre-trained Language ModelsMain
  200. Abstractive Multi-Video Captioning: Benchmark Dataset Construction and Extensive EvaluationMain
  201. Action-Concentrated Embedding Framework: This Is Your Captain Sign-tokeningMain
  202. Aligning the Norwegian UD Treebank with Entity and Coreference InformationMain
  203. Alleviating Exposure Bias in Abstractive Summarization via Sequentially Generating and RevisingMain
  204. An Argument for Symmetric Coordination from Dependency Length Minimization: A Replication StudyMain
  205. An Automated End-to-End Open-Source Software for High-Quality Text-to-Speech Dataset GenerationMain
  206. An Effective Span-based Multimodal Named Entity Recognition with Consistent Cross-Modal AlignmentMain
  207. An Empirical Study on the Robustness of Massively Multilingual Neural Machine TranslationMain
  208. An Evaluation of Croatian ASR Models for Čakavian TranscriptionMain
  209. Analysis of Sensation-transfer Dialogues in MotorsportsMain
  210. Analysis on Unsupervised Acquisition Process of Bilingual Vocabulary through Iterative Back-TranslationMain
  211. Analyzing Interpretability of Summarization Model with Eye-gaze InformationMain
  212. AnnoCTR: A Dataset for Detecting and Linking Entities, Tactics, and Techniques in Cyber Threat ReportsMain
  213. Annotate Chinese Aspect with UMR——a Case Study on the Liitle PrinceMain
  214. Annotate the Way You Think: An Incremental Note Generation Framework for the Summarization of Medical ConversationsMain
  215. Annotating Chinese Word Senses with English WordNet: A Practice on OntoNotes Chinese Sense InventoriesMain
  216. Annotation of Japanese Discourse Relations Focusing on Concessive InferencesMain
  217. Applying Transfer Learning to German Metaphor PredictionMain
  218. Approaches and Challenges for Resolving Different Representations of Fictional Characters for Chinese NovelsMain
  219. Article Classification with Graph Neural Networks and MultigraphsMain
  220. At the Crossroad of Cuneiform and NLP: Challenges for Fine-grained Part-of-speech TaggingMain
  221. Automated Extraction of Prosodic Structure from Unannotated Sign Language VideoMain
  222. Automatic Construction of a Chinese Review Dataset for Aspect Sentiment Triplet Extraction via Iterative Weak SupervisionMain
  223. Automatic Construction of a Large-Scale Corpus for Geoparsing Using Wikipedia HyperlinksMain
  224. Automatic Decomposition of Text Editing Examples into Primitive Edit Operations: Toward Analytic Evaluation of Editing SystemsMain
  225. Automatic Extraction of Nominal Phrases from German Learner Texts of Different Proficiency LevelsMain
  226. Automatic Partitioning of a Code-Switched Speech Corpus Using Mixed-Integer ProgrammingMain
  227. Automatic Speech Recognition System-Independent Word Error Rate EstimationMain
  228. Automating Dataset Production Using Generative Text and Image ModelsMain
  229. Auxiliary Knowledge-Induced Learning for Automatic Multi-Label Medical Document ClassificationMain
  230. BERT-BC: A Unified Alignment and Interaction Model over Hierarchical BERT for Response SelectionMain
  231. BP4ER: Bootstrap Prompting for Explicit Reasoning in Medical Dialogue GenerationMain
  232. BengaliLCP: A Dataset for Lexical Complexity Prediction in the Bengali TextsMain
  233. Beyond Model Performance: Can Link Prediction Enrich French Lexical Graphs?Main
  234. BigNLI: Native Language Identification with Big Bird EmbeddingsMain
  235. BootTOD: Bootstrap Task-oriented Dialogue Representations by Aligning Diverse ResponsesMain
  236. Born a BabyNet with Hierarchical Parental Supervision for End-to-End Text Image Machine TranslationMain
  237. Bridging Computational Lexicography and Corpus Linguistics: A Query Extension for OntoLex-FrACMain
  238. Bridging Textual and Tabular Worlds for Fact Verification: A Lightweight, Attention-Based ModelMain
  239. Building MUSCLE, a Dataset for MUltilingual Semantic Classification of Links between EntitiesMain
  240. CLFFRD: Curriculum Learning and Fine-grained Fusion for Multimodal Rumor DetectionMain
  241. CO3: Low-resource Contrastive Co-training for Generative Conversational Query RewriteMain
  242. COMICORDA: Dialogue Act Recognition in Comic BooksMain
  243. CSSWiki: A Chinese Sentence Simplification Dataset with Linguistic and Content OperationsMain
  244. Can Language Models Learn Embeddings of Propositional Logic Assertions?Main
  245. Can We Identify Stance without Target Arguments? A Study for Rumour Stance ClassificationMain
  246. Categorial Grammar Induction with Stochastic Category SelectionMain
  247. Character-level Language Models for Abbreviation and Long-form DetectionMain
  248. Charles Translator: A Machine Translation System between Ukrainian and CzechMain
  249. Coarse-Tuning for Ad-hoc Document Retrieval Using Pre-trained Language ModelsMain
  250. Code-Mixed Text Augmentation for Latvian ASRMain
  251. Cognitive Information Bottleneck: Extracting Minimal Sufficient Cognitive Language Processing SignalsMain
  252. Computational Modelling of Plurality and Definiteness in Chinese Noun PhrasesMain
  253. Conceptual Pacts for Reference Resolution Using Small, Dynamically Constructed Language Models: A Study in Puzzle Building DialoguesMain
  254. Conjoin after Decompose: Improving Few-Shot Performance of Named Entity RecognitionMain
  255. Connecting Language Technologies with Rich, Diverse Data Sources Covering Thousands of LanguagesMain
  256. Contextual Modeling for Document-level ASR Error CorrectionMain
  257. Continued Pre-training on Sentence Analogies for Translation with Small DataMain
  258. Continuous Relational Diffusion Driven Topic Model with Multi-grained Text for MicroblogMain
  259. Contribution of Move Structure to Automatic Genre Identification: An Annotated Corpus of French Tourism WebsitesMain
  260. Controllable Sentence Simplification in Swedish Using Control Prefixes and Mined ParaphrasesMain
  261. Corpus Creation and Automatic Alignment of Historical Dutch Dialect SpeechMain
  262. Corpus Services: A Framework to Curate XML Corpus DataMain
  263. Correcting Pronoun Homophones with Subtle Semantics in Chinese Speech RecognitionMain
  264. Correlations between Multilingual Language Model Geometry and Crosslingual Transfer PerformanceMain
  265. Cost-Effective Discourse Annotation in the Prague Czech–English Dependency TreebankMain
  266. Creating Terminological Resources in the Digital Age for Less-resourced LanguagesMain
  267. CyberAgressionAdo-v2: Leveraging Pragmatic-Level Information to Decipher Online Hate in French Multiparty ChatsMain
  268. DET: A Dual-Encoding Transformer for Relational Graph EmbeddingMain
  269. DORE: A Dataset for Portuguese Definition GenerationMain
  270. Dealing with Data Scarcity in Spoken Question AnsweringMain
  271. Decoding at the Speed of Thought: Harnessing Parallel Decoding of Lexical Units for LLMsMain
  272. Deep Reinforcement Learning with Hierarchical Action Exploration for Dialogue GenerationMain
  273. Deriving Entity-Specific Embeddings from Multi-Entity SequencesMain
  274. Detecting Critical Errors Considering Cross-Cultural Factors in English-Korean TranslationMain
  275. Developing a Benchmark for Pronunciation Feedback: Creation of a Phonemically Annotated Speech Corpus of isiZulu Language Learner SpeechMain
  276. Development of Community-Oriented Text-to-Speech Models for Māori ‘Avaiki Nui (Cook Islands Māori)Main
  277. DiaSet: An Annotated Dataset of Arabic ConversationsMain
  278. Did You Get It? A Zero-Shot Approach to Locate Information Transfers in ConversationsMain
  279. Diffusion Based Counterfactual Augmentation for Dual Sentiment ClassificationMain
  280. DimA: A Parameter-efficient Fine-tuning Method with Knowledge Transfer Based on TransformerMain
  281. Disambiguating Homographs and Homophones Simultaneously: A Regrouping Method for JapaneseMain
  282. Disentangling Pretrained Representation to Leverage Low-Resource Languages in Multilingual Machine TranslationMain
  283. Distantly Supervised Contrastive Learning for Low-Resource Scripting Language SummarizationMain
  284. Do Large Language Models Understand Mansplaining? Well, Actually...Main
  285. Do Neural Language Models Inferentially Compose Concepts the Way Humans Can?Main
  286. EDEN: A Dataset for Event Detection in Norwegian NewsMain
  287. EEE-QA: Exploring Effective and Efficient Question-Answer RepresentationsMain
  288. EPOQUE: An English-Persian Quality Estimation DatasetMain
  289. ESCP: Enhancing Emotion Recognition in Conversation with Speech and Contextual PrefixesMain
  290. EVil-Probe - a Composite Benchmark for Extensive Visio-Linguistic ProbingMain
  291. Emotags: Computer-Assisted Verbal Labelling of Expressive Audiovisual Utterances for Expressive Multimodal TTSMain
  292. Encoding Gesture in Multimodal Dialogue: Creating a Corpus of Multimodal AMRMain
  293. Enhancing Distantly Supervised Named Entity Recognition with Strong Label Guided Lottery TrainingMain
  294. Enhancing Effectiveness and Robustness in a Low-Resource Regime via Decision-Boundary-aware Data AugmentationMain
  295. Enhancing Image-to-Text Generation in Radiology Reports through Cross-modal Multi-Task LearningMain
  296. Enhancing Knowledge Selection via Multi-level Document Semantic GraphMain
  297. Enhancing Large Language Models through Transforming Reasoning Problems into Classification TasksMain
  298. Enhancing Parameter-efficient Fine-tuning with Simple Calibration Based on Stable RankMain
  299. Enhancing Unrestricted Cross-Document Event Coreference with Graph Reconstruction NetworksMain
  300. Enough Is Enough! a Case Study on the Effect of Data Size for Evaluation Using Universal DependenciesMain
  301. EpLSA: Synergy of Expert-prefix Mixtures and Task-Oriented Latent Space Adaptation for Diverse Generative ReasoningMain
  302. EpiGEN: An Efficient Multi-Api Code GENeration Framework under Enterprise ScenarioMain
  303. Error Analysis of NLP Models and Non-Native Speakers of English Identifying Sarcasm in Reddit CommentsMain
  304. Evaluating Automatic Subtitling: Correlating Post-editing Effort and Automatic MetricsMain
  305. Evaluating Word Expansion for Multilingual Sentiment Analysis of Parliamentary SpeechMain
  306. Every Verb in Its Right Place? A Roadmap for Operationalizing Developmental Stages in the Acquisition of L2 GermanMain
  307. Evidence-guided Inference for Neutralized Zero-shot TransferMain
  308. Experimental versus In-Corpus Variation in Referring Expression ChoiceMain
  309. Exploring BERT-Based Classification Models for Detecting Phobia Subtypes: A Novel Tweet Dataset and Comparative AnalysisMain
  310. Exploring Geometric Representational Disparities between Multilingual and Bilingual Translation ModelsMain
  311. Exploring the Emotional Dimension of French Online Toxic ContentMain
  312. Extracting Biomedical Entities from Noisy Audio TranscriptsMain
  313. FAIRification of LeiLanDMain
  314. FFSTC: Fongbe to French Speech Translation CorpusMain
  315. FORECAST2023: A Forecast and Reasoning Corpus of Argumentation StructuresMain
  316. FRACAS: a FRench Annotated Corpus of Attribution relations in newSMain
  317. FReND: A French Resource of Negation DataMain
  318. FUSE - FrUstration and Surprise Expressions: A Subtle Emotional Multimodal Language CorpusMain
  319. Few-Shot Semantic Dependency Parsing via Graph Contrastive LearningMain
  320. Find-the-Common: A Benchmark for Explaining Visual Patterns from ImagesMain
  321. Finding Educationally Supportive Contexts for Vocabulary Learning with Attention-Based ModelsMain
  322. Fine-Grained Legal Argument-Pair Extraction via Coarse-Grained Pre-trainingMain
  323. Fine-Tuning a Pre-Trained Wav2Vec2 Model for Automatic Speech Recognition- Experiments with De Zahrar SprocheMain
  324. Fine-grained Classification of Circumstantial Meanings within the Prague Dependency Treebank Annotation SchemeMain
  325. Flexible Lexicalization in Rule-based Text RealizationMain
  326. FoTo: Targeted Visual Topic Modeling for Focused Analysis of Short TextsMain
  327. From Technology to Market. Bilingual Corpus on the Evaluation of Technology Opportunity DiscoveryMain
  328. GECSum: Generative Evaluation-Driven Sequence Level Contrastive Learning for Abstractive SummarizationMain
  329. GIL-GALaD: Gender Inclusive Language - German Auto-Assembled Large DatabaseMain
  330. Generating Clarification Questions for Disambiguating ContractsMain
  331. Generating Contextual Images for Long-Form TextMain
  332. German Also Hallucinates! Inconsistency Detection in News Summaries with the Absinth DatasetMain
  333. Granular Change Accuracy: A More Accurate Performance Metric for Dialogue State TrackingMain
  334. Guided Distant Supervision for Multilingual Relation Extraction Data: Adapting to a New LanguageMain
  335. HS-GC: Holistic Semantic Embedding and Global Contrast for Effective Text ClusteringMain
  336. Harnessing the Power of Large Language Model for Uncertainty Aware Graph ProcessingMain
  337. Hierarchical Topic Modeling via Contrastive Learning and Hyperbolic EmbeddingMain
  338. High-Order Semantic Alignment for Unsupervised Fine-Grained Image-Text RetrievalMain
  339. How Far Is Too Far? Studying the Effects of Domain Discrepancy on Masked Language ModelsMain
  340. How Gender Interacts with Political Values: A Case Study on Czech BERT ModelsMain
  341. How Much Do Robots Understand Rudeness? Challenges in Human-Robot InteractionMain
  342. How Speculative Can Speculative Decoding Be?Main
  343. How Well Can BERT Learn the Grammar of an Agglutinative and Flexible-Order Language? The Case of Basque.Main
  344. How to Understand “Support”? An Implicit-enhanced Causal Inference Approach for Weakly-supervised Phrase GroundingMain
  345. Humanitarian Corpora for English, French and SpanishMain
  346. Hyperbolic Representations for Prompt LearningMain
  347. IDC: Boost Text-to-image Retrieval via Indirect and Direct ConnectionsMain
  348. ILCiteR: Evidence-grounded Interpretable Local Citation RecommendationMain
  349. INMT-Lite: Accelerating Low-Resource Language Data Collection via Offline Interactive Neural Machine TranslationMain
  350. ISO 24617-12: A New Standard for Semantic AnnotationMain
  351. IT2ACL Learning Easy-to-Hard Instructions via 2-Phase Automated Curriculum Learning for Large Language ModelsMain
  352. Identifying Source Language Expressions for Pre-editing in Machine TranslationMain
  353. Ideological Knowledge Representation: Framing Climate Change in EcoLexiconMain
  354. Image Matters: A New Dataset and Empirical Study for Multimodal Hyperbole DetectionMain
  355. Impact of Task Adapting on Transformer Models for Targeted Sentiment Analysis in Croatian HeadlinesMain
  356. Improving Continual Few-shot Relation Extraction through Relational Knowledge Distillation and Prototype AugmentationMain
  357. Improving Copy-oriented Text Generation via EDU Copy MechanismMain
  358. Improving Grammatical Error Correction by Correction Acceptability DiscriminationMain
  359. Improving Implicit Discourse Relation Recognition with Semantics ConfrontationMain
  360. Improving Personalized Sentiment Representation with Knowledge-enhanced and Parameter-efficient Layer NormalizationMain
  361. Improving Vietnamese-English Medical Machine TranslationMain
  362. IndirectQA: Understanding Indirect Answers to Implicit Polar Questions in French and SpanishMain
  363. InfFeed: Influence Functions as a Feedback to Improve the Performance of Subjective TasksMain
  364. Integrating Headedness Information into an Auto-generated Multilingual CCGbank for Improved Semantic InterpretationMain
  365. Is Gender Reference Gender-specific? Studies in a Polar DomainMain
  366. IsraParlTweet: The Israeli Parliamentary and Twitter ResourceMain
  367. Italian Word Embeddings for the Medical DomainMain
  368. It’s Not under the Lamppost: Expanding the Reach of Conversational AIMain
  369. JLBert: Japanese Light BERT for Cross-Domain Short Text ClassificationMain
  370. JRC-Names-Retrieval: A Standardized Benchmark for Name SearchMain
  371. Joint Annotation of Morphology and Syntax in Dependency TreebanksMain
  372. KEHRL: Learning Knowledge-Enhanced Language Representations with Hierarchical Reinforcement LearningMain
  373. KIT-19: A Comprehensive Korean Instruction Toolkit on 19 Tasks for Fine-Tuning Korean Large Language ModelsMain
  374. Keyphrase Generation: Lessons from a Reproducibility StudyMain
  375. Khan Academy Corpus: A Multilingual Corpus of Khan Academy LecturesMain
  376. Killkan: The Automatic Speech Recognition Dataset for Kichwa with Morphosyntactic InformationMain
  377. Knowledge Enhanced Pre-training for Cross-lingual Dense RetrievalMain
  378. Knowledge Graphs for Real-World Rumour VerificationMain
  379. Knowledge Triplets Derivation from Scientific Publications via Dual-Graph ResonanceMain
  380. Knowledge-aware Attention Network for Medication Effectiveness PredictionMain
  381. KoDialogBench: Evaluating Conversational Understanding of Language Models with Korean Dialogue BenchmarkMain
  382. KoFREN: Comprehensive Korean Word Frequency Norms Derived from Large Scale Free Speech CorporaMain
  383. Konidioms Corpus: A Dataset of Idioms in Konkani LanguageMain
  384. Kosmic: Korean Text Similarity Metric Reflecting Honorific DistinctionsMain
  385. Labeling Comic Mischief Content in Online Videos with a Multimodal Hierarchical-Cross-Attention ModelMain
  386. Labeling Results of Topic Models: Word Sense Disambiguation as Key Method for Automatic Topic Labeling with GermaNetMain
  387. Language Models and Semantic Relations: A Dual RelationshipMain
  388. Learning Bidirectional Morphological Inflection like HumansMain
  389. Lemmatisation of Medieval Greek: Against the Limits of Transformer’s Capabilities?Main
  390. Leros: Learning Explicit Reasoning on Synthesized Data for Commonsense Question AnsweringMain
  391. Lessons from Deploying the First Bilingual Peruvian Sign Language - Spanish Online DictionaryMain
  392. Leveraging AMR Graph Structure for Better Sequence-to-Sequence AMR ParsingMain
  393. Leveraging Domain Corpora for Enhanced Terminology: The Case of Estonian-English Remote Sensing TermbaseMain
  394. Leveraging Information Redundancy of Real-World Data through Distant SupervisionMain
  395. Leveraging the Interplay between Syntactic and Acoustic Cues for Optimizing Korean TTS Pause FormationMain
  396. LexiVault: A Repository for Psycholinguistic Lexicons of Lesser-studied LanguagesMain
  397. LinguaMeta: Unified Metadata for Thousands of LanguagesMain
  398. Linking Adaptive Structure Induction and Neuron Filtering: A Spectral Perspective for Aspect-based Sentiment AnalysisMain
  399. Linking Judgement Text to Court Hearing Videos: UK Supreme Court as a Case StudyMain
  400. Loflòc: A Morphological Lexicon for Occitan using Universal DependenciesMain
  401. MAGPIE: Multi-Task Analysis of Media-Bias Generalization with Pre-Trained Identification of ExpressionsMain
  402. MMAPS: End-to-End Multi-Grained Multi-Modal Attribute-Aware Product SummarizationMain
  403. MORE-3S:Multimodal-based Offline Reinforcement Learning with Shared Semantic SpacesMain
  404. MRT: Multi-modal Short- and Long-range Temporal Convolutional Network for Time-sync Comment Video Behavior PredictionMain
  405. MUCH: A Multimodal Corpus Construction for Conversational Humor Recognition Based on Chinese SitcomMain
  406. MVP: Minimal Viable Phrase for Long Text UnderstandingMain
  407. MWE-Finder: A DemonstrationMain
  408. Mapping Work Task Descriptions from German Job Ads on the O*NET Work Activities OntologyMain
  409. Mathematical Entities: Corpora and BenchmarksMain
  410. Measuring Cross-Text Cohesion for Segmentation Similarity ScoringMain
  411. MemoryPrompt: A Light Wrapper to Improve Context Tracking in Pre-trained Language ModelsMain
  412. Meta-Adapter for Self-Supervised Speech Models: A Solution to Low-Resource Speech Recognition ChallengesMain
  413. Meta-Evaluation of Sentence Simplification MetricsMain
  414. Mitigating Linguistic Artifacts in Emotion Recognition for Conversations from TV Scripts to Daily ConversationsMain
  415. Mitigating Misleading Chain-of-Thought Reasoning with Selective FilteringMain
  416. MoPE: Mixture of Prefix Experts for Zero-Shot Dialogue State TrackingMain
  417. Modelling Argumentation for an User Opinion Aggregation ToolMain
  418. Modelling and Linking an Old Latin-Portuguese Dictionary to the LiLa Knowledge BaseMain
  419. Multi-Granularity Fusion Text Semantic Matching Based on WoBERTMain
  420. Multi-Tiered Cantonese Word SegmentationMain
  421. MultiLeg: Dataset for Text Sanitisation in Less-resourced LanguagesMain
  422. Multilinguality or Back-translation? A Case Study with EstonianMain
  423. Multimodal Behaviour in an Online Environment: The GEHM Zoom Corpus CollectionMain
  424. Multimodal Cross-lingual Phrase RetrievalMain
  425. Multimodal and Multilingual Laughter Detection in Stand-Up Comedy VideosMain
  426. NAIST-SIC-Aligned: An Aligned English-Japanese Simultaneous Interpretation CorpusMain
  427. Negation Triplet Extraction with Syntactic Dependency and Semantic ConsistencyMain
  428. Nested Event Extraction upon Pivot Element RecognitionMain
  429. Nested Noun Phrase Identification Using BERTMain
  430. New Datasets for Automatic Detection of Textual Entailment and of Contradictions between Sentences in FrenchMain
  431. New Evaluation Methodology for Qualitatively Comparing Classification ModelsMain
  432. New Proposal of Greenberg’s Universal 14 from TypometricsMain
  433. Non-Essential Is NEcessary: Order-agnostic Multi-hop Question GenerationMain
  434. Null Subjects in Spanish as a Machine Translation ProblemMain
  435. NutFrame: Frame-based Conceptual Structure Induction with LLMsMain
  436. OOVs in the Spotlight: How to Inflect Them?Main
  437. ORTicket: Let One Robust BERT Ticket Transfer across Different TasksMain
  438. On Modelling Corpus Citations in Computational Lexical ResourcesMain
  439. On the Use of Silver Standard Data for Zero-shot Classification Tasks in Information ExtractionMain
  440. On the Way to Lossless Compression of Language Transformers: Exploring Cross-Domain Properties of QuantizationMain
  441. OpenMSD: Towards Multilingual Scientific Documents Similarity MeasurementMain
  442. Out of the Mouths of MPs: Speaker Attribution in Parliamentary DebatesMain
  443. PILA: A Historical-Linguistic Dataset of Proto-Italic and LatinMain
  444. PRIMO: Progressive Induction for Multi-hop Open Rule GenerationMain
  445. PSentScore: Evaluating Sentiment Polarity in Dialogue SummarizationMain
  446. Palmyra 3.0: A User-Friendly Cloud-Based Platform for Morphology and Dependency Syntax AnnotationMain
  447. Parameter-Efficient Transfer Learning for End-to-end Speech TranslationMain
  448. Polish Discourse Corpus (PDC): Corpus Design, ISO-Compliant Annotation, Data Highlights, and Parser DevelopmentMain
  449. Post-decoder Biasing for End-to-End Speech Recognition of Multi-turn Medical InterviewMain
  450. PrOnto: Language Model Evaluations for 859 LanguagesMain
  451. Predictive and Distinctive Linguistic Features in Schizophrenia-Bipolar Spectrum DisordersMain
  452. Principal Component Analysis as a Sanity Check for Bayesian Phylolinguistic ReconstructionMain
  453. Producing a Parallel Universal Dependencies Treebank of Ancient Hebrew and Ancient Greek via Cross-Lingual ProjectionMain
  454. Prototype-based Prompt-Instance Interaction with Causal Intervention for Few-shot Event DetectionMain
  455. Puntuguese: A Corpus of Puns in Portuguese with Micro-editsMain
  456. PyRater: A Python Toolkit for Annotation AnalysisMain
  457. QA-based Event Start-Points Ordering for Clinical Temporal Relation AnnotationMain
  458. RAAMove: A Corpus for Analyzing Moves in Research Article AbstractsMain
  459. RT-VQ2A2: Real Time Vector Quantized Question Answering with ASRMain
  460. Rapidly Piloting Real-time Linguistic Assistance for Simultaneous Interpreters with Untrained Bilingual SurrogatesMain
  461. Re-evaluating the Tomes for the TimesMain
  462. Recommending Missed Citations Identified by Reviewers: A New Task, Dataset and BaselinesMain
  463. Reference-guided Style-Consistent Content TransferMain
  464. Related Work Is All You NeedMain
  465. Releasing the Capacity of GANs in Non-Autoregressive Image CaptioningMain
  466. Representation Degeneration Problem in Prompt-based Models for Natural Language UnderstandingMain
  467. Representing Compounding with OntoLex. An Evaluation of Vocabularies for Word Formation ResourcesMain
  468. RoboVox: A Single/Multi-channel Far-field Speaker Recognition Benchmark for a Mobile RobotMain
  469. SGCM: Salience-Guided Context Modeling for Question GenerationMain
  470. SLaCAD: A Spoken Language Corpus for Early Alzheimer’s Disease DetectionMain
  471. SM-FEEL-BG - the First Bulgarian Datasets and Classifiers for Detecting Feelings, Emotions, and Sentiments of Bulgarian Social Media TextMain
  472. SPLICE: A Singleton-Enhanced PipeLIne for Coreference REsolutionMain
  473. SPOTTER: A Framework for Investigating Convention Formation in a Visually Grounded Human-Robot Reference TaskMain
  474. STAF: Pushing the Boundaries of Test-Time Adaptation towards Practical Noise ScenariosMain
  475. STEntConv: Predicting Disagreement between Reddit Users with Stance Detection and a Signed Graph Convolutional NetworkMain
  476. Scalable Patent Classification with Aggregated Multi-View RankingMain
  477. Schroedinger’s Threshold: When the AUC Doesn’t Predict AccuracyMain
  478. Seeing Eye-to-Eye: Cross-Modal Coherence Relations Inform Eye-gaze Patterns During Comprehension & ProductionMain
  479. Self-Knowledge Distillation for Knowledge Graph EmbeddingMain
  480. Semantics-Aware Dual Graph Convolutional Networks for Argument Pair ExtractionMain
  481. Semantics-enhanced Cross-modal Masked Image Modeling for Vision-Language Pre-trainingMain
  482. Sense of the Day: Short Timeframe Temporal-Aware Word Sense DisambiguationMain
  483. ShadowSense: A Multi-annotated Dataset for Evaluating Word Sense InductionMain
  484. SilverAlign: MT-Based Silver Data Algorithm for Evaluating Word AlignmentMain
  485. Social Convos: Capturing Agendas and Emotions on Social MediaMain
  486. Spanless Event Annotation for Corpus-Wide Complex Event UnderstandingMain
  487. Stories and Personal Experiences in the COVID-19 DiscourseMain
  488. Strengthening the WiC: New Polysemy Dataset in Hindi and Lack of Cross Lingual TransferMain
  489. Structure-aware Generation Model for Cross-Domain Aspect-based Sentiment ClassificationMain
  490. SynTOD: Augmented Response Synthesis for Robust End-to-End Task-Oriented Dialogue SystemMain
  491. TAPASGO: Transfer Learning towards a German-Language Tabular Question Answering ModelMain
  492. TIGQA: An Expert-Annotated Question-Answering Dataset in TigrinyaMain
  493. TRELM: Towards Robust and Efficient Pre-training for Knowledge-Enhanced Language ModelsMain
  494. Textual Coverage of Eventive Entries in Lexical Semantic ResourcesMain
  495. The Corpus AIKIA: Using Ranking Annotation for Offensive Language Detection in Modern GreekMain
  496. The IgboAPI Dataset: Empowering Igbo Language Technologies through Multi-dialectal EnrichmentMain
  497. The Onomastic Repertoire of the Roman d’Alexandre (ORNARE). Designing an Integrated Digital Onomastic Tool for Medieval French RomanceMain
  498. The Role of Creaky Voice in Turn Taking and the Perception of Speaker Stance: Experiments Using Controllable TTSMain
  499. Theoretical and Empirical Advantages of Dense-Vector to One-Hot Encoding of Intent Classes in Open-World ScenariosMain
  500. Time-aware COMET: A Commonsense Knowledge Model with Temporal KnowledgeMain
  501. Title-based Extractive Summarization via MRC FrameworkMain
  502. To Learn or Not to Learn: Replaced Token Detection for Learning the Meaning of NegationMain
  503. Topic-Controllable Summarization: Topic-Aware Evaluation and Transformer MethodsMain
  504. Towards Comprehensive Language Analysis for Clinically Enriched Spontaneous DialogueMain
  505. Towards Cost-effective Multi-style Conversations: A Pilot Study in Task-oriented Dialogue GenerationMain
  506. Towards Generalizable and Faithful Logic Reasoning over Natural Language via Resolution RefutationMain
  507. Towards Human-Like Machine Comprehension: Few-Shot Relational Learning in Visually-Rich DocumentsMain
  508. Towards Semantic Tagging for IrishMain
  509. Towards Understanding the Relationship between In-context Learning and Compositional GeneralizationMain
  510. Towards Universal Dependencies for Ancash QuechuaMain
  511. Towards a Corpus of Spoken Maltese: Korpus tal-Malti Mitkellem, KMMMain
  512. Towards a Unified Taxonomy of Deep Syntactic RelationsMain
  513. Training BERT Models to Carry over a Coding System Developed on One Corpus to AnotherMain
  514. Transfer Fine-tuning for Quality Estimation of Text SimplificationMain
  515. Transformer-based Swedish Semantic Role Labeling through Transfer LearningMain
  516. Transformers for Bridging Persian Dialects: Transliteration Model for Tajiki and Iranian ScriptsMain
  517. TweetTER: A Benchmark for Target Entity Retrieval on Twitter without Knowledge BasesMain
  518. Typos Correction Training against Misspellings from Text-to-Text TransformersMain
  519. UDMorph: Morphosyntactically Tagged UD CorporaMain
  520. UkraiNER: A New Corpus and Annotation Scheme towards Comprehensive Entity RecognitionMain
  521. Uncovering Agendas: A Novel French & English Dataset for Agenda Detection on Social MediaMain
  522. Understanding How Positional Encodings Work in Transformer ModelMain
  523. UniPCM: Universal Pre-trained Conversation Model with Task-aware Automatic PromptMain
  524. Unicode Normalization and Grapheme Parsing of Indic LanguagesMain
  525. Unifying Latent and Lexicon Representations for Effective Video-Text RetrievalMain
  526. Unraveling Spontaneous Speech Dimensions for Cross-Corpus ASR System Evaluation for FrenchMain
  527. Unveiling Vulnerability of Self-AttentionMain
  528. Using Speech Technology to Test Theories of Phonetic and Phonological TypologyMain
  529. Utilizing Longer Context than Speech Bubbles in Automated Manga TranslationMain
  530. Validating and Exploring Large Geographic CorporaMain
  531. Visual-Linguistic Dependency Encoding for Image-Text RetrievalMain
  532. Visual-Textual Entailment with Quantities Using Model Checking and Knowledge InjectionMain
  533. WW-CSL: A New Dataset for Word-Based Wearable Chinese Sign Language DetectionMain
  534. WaCadie: Towards an Acadian French CorpusMain
  535. Well Begun Is Half Done: An Implicitly Augmented Generative Framework with Distribution Modification for Hierarchical Text ClassificationMain
  536. What Are the Implications of Your Question? Non-Information Seeking Question-Type Identification in CNN TranscriptsMain
  537. What Happens to a Dataset Transformed by a Projection-based Concept Removal Method?Main
  538. What Has LeBenchmark Learnt about French Syntax?Main
  539. What Is Needed for Intra-document Disambiguation of Math Identifiers?Main
  540. When Do “More Contexts” Help with Sarcasm Recognition?Main
  541. Which Sense Dominates Multisensory Semantic Understanding? A Brain Decoding StudyMain
  542. Who Did You Blame When Your Project Failed? Designing a Corpus for Presupposition Generation in Cross-Examination DialoguesMain
  543. Who Said What: Formalization and Benchmarks for the Task of Quote AttributionMain
  544. Willkommens-Merkel, Chaos-Johnson, and Tore-Klose: Modeling the Evaluative Meaning of German Personal Name CompoundsMain
  545. Word-level Commonsense Knowledge Selection for Event DetectionMain
  546. Would You Like to Make a Donation? A Dialogue System to Persuade You to DonateMain
  547. XAI-Attack: Utilizing Explainable AI to Find Incorrectly Learned Patterns for Black-Box Adversarial Example CreationMain
  548. XVD: Cross-Vocabulary Differentiable Training for Generative Adversarial AttacksMain
  549. ZeLa: Advancing Zero-Shot Multilingual Semantic Parsing with Large Language Models and Chain-of-Thought StrategiesMain
  550. ZenPropaganda: A Comprehensive Study on Identifying Propaganda Techniques in Russian Coronavirus-Related MediaMain
  551. Zero-shot Cross-lingual Automated Essay ScoringMain
  552. mALBERT: Is a Compact Multilingual BERT Model Still Worth It?Main
  553. myMediCon: End-to-End Burmese Automatic Speech Recognition for Medical ConversationsMain
  554. “Barking up the Right Tree”, a GAN-Based Pun Generation Model through Semantic PruningMain

COLING accepted papers in other years

Looking for submission deadlines instead? See the conference deadline calendar.