COLING 2024 Accepted Papers
The full list of 1,554 papers accepted at COLING 2024 (International Conference on Computational Linguistics). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Main: 1,554
- GAATME: A Genetic Algorithm for Adversarial Translation Metrics EvaluationMain1 citations
- GENTRAC: A Tool for Tracing Trauma in Genocide and Mass Atrocity Court TranscriptsMain1 citations
- GRIT: A Dataset of Group Reference Recognition in ItalianMain1 citations
- Generating Hard-Negative Out-of-Scope Data with ChatGPT for Intent ClassificationMain1 citations
- Global and Local Hierarchical Prompt Tuning Framework for Multi-level Implicit Discourse Relation RecognitionMain1 citations
- Gradient Consistency-based Parameter Allocation for Multilingual Neural Machine TranslationMain1 citations
- Grounded Multimodal Procedural Entity Recognition for Procedural Documents: A New Dataset and BaselineMain1 citations
- Halwasa: Quantify and Analyze Hallucinations in Large Language Models: Arabic as a Case StudyMain1 citations
- HoLM: Analyzing the Linguistic Unexpectedness in Homeric PoetryMain1 citations
- How Do Hyenas Deal with Human Speech? Speech Recognition and Translation with ConfHyenaMain1 citations
- How Important Is Tokenization in French Medical Masked Language Models?Main1 citations
- Human and System Perspectives on the Expression of Irony: An Analysis of Likelihood Labels and RationalesMain1 citations
- Humanistic Buddhism Corpus: A Challenging Domain-Specific Dataset of English Translations for Classical and Modern ChineseMain1 citations
- HyperMR: Hyperbolic Hypergraph Multi-hop Reasoning for Knowledge-based Visual Question AnsweringMain1 citations
- IDEM: The IDioms with EMotions Dataset for Emotion RecognitionMain1 citations
- IR2: Information Regularization for Information RetrievalMain1 citations
- Improved Out-of-Scope Intent Classification with Dual Encoding and Threshold-based Re-ClassificationMain1 citations
- Improving Bengali and Hindi Large Language ModelsMain1 citations
- Improving Chinese Named Entity Recognition with Multi-grained Words and Part-of-Speech Tags via Joint ModelingMain1 citations
- Improving Cross-lingual Transfer with Contrastive Negative Learning and Self-trainingMain1 citations
- Improving Factual Consistency in Abstractive Summarization with Sentence Structure PruningMain1 citations
- Improving Multi-view Document Clustering: Leveraging Multi-structure Processor and Hybrid Ensemble Clustering ModuleMain1 citations
- Improving Role-Oriented Dialogue Summarization with Interaction-Aware Contrastive LearningMain1 citations
- Improving Text Readability through Segmentation into RhesesMain1 citations
- Improving Unsupervised Neural Machine Translation via Training Data Self-CorrectionMain1 citations
- Information Extraction with Differentiable Beam Search on Graph RNNsMain1 citations
- Integrating Representation Subspace Mapping with Unimodal Auxiliary Loss for Attention-based Multimodal Emotion RecognitionMain1 citations
- Introducing a Parsed Corpus of Historical High GermanMain1 citations
- Is Modularity Transferable? A Case Study through the Lens of Knowledge DistillationMain1 citations
- Is Spoken Hungarian Low-resource?: A Quantitative Survey of Hungarian Speech Data SetsMain1 citations
- J-SNACS: Adposition and Case Supersenses for Japanese JoshiMain1 citations
- JL-Hate: An Annotated Dataset for Joint Learning of Hate Speech and Target DetectionMain1 citations
- KGConv, a Conversational Corpus Grounded in WikidataMain1 citations
- KPatch: Knowledge Patch to Pre-trained Language Model for Zero-Shot Stance Detection on Social MediaMain1 citations
- KnowVrDU: A Unified Knowledge-aware Prompt-Tuning Framework for Visually-rich Document UnderstandingMain1 citations
- Knowledge-enhanced Prompt Tuning for Dialogue-based Relation Extraction with Trigger and Label SemanticMain1 citations
- Korean Disaster Safety Information Sign Language Translation Benchmark DatasetMain1 citations
- LI4: Label-Infused Iterative Information Interacting Based Fact Verification in Question-answering DialogueMain1 citations
- Landmark-Guided Cross-Speaker Lip Reading with Mutual Information RegularizationMain1 citations
- Language Pivoting from Parallel Corpora for Word Sense Disambiguation of Historical Languages: A Case Study on LatinMain1 citations
- Learning Intrinsic Dimension via Information Bottleneck for Explainable Aspect-based Sentiment AnalysisMain1 citations
- Learning from Wrong Predictions in Low-Resource Neural Machine TranslationMain1 citations
- Leveraging Pre-existing Resources for Data-Efficient Counter-Narrative Generation in KoreanMain1 citations
- LexComSpaL2: A Lexical Complexity Corpus for Spanish as a Foreign LanguageMain1 citations
- LightVLP: A Lightweight Vision-Language Pre-training via Gated Interactive Masked AutoEncodersMain1 citations
- Limitations of Human Identification of Automatically Generated TextMain1 citations
- Linguistic Nudges and Verbal Interaction with Robots, Smart-Speakers, and HumansMain1 citations
- Linguistic Rule Induction Improves Adversarial and OOD Robustness in Large Language ModelsMain1 citations
- LoSST-AD: A Longitudinal Corpus for Tracking Alzheimer’s Disease Related Changes in Spontaneous SpeechMain1 citations
- M3: A Multi-Task Mixed-Objective Learning Framework for Open-Domain Multi-Hop Dense Sentence RetrievalMain1 citations
- M3TCM: Multi-modal Multi-task Context Model for Utterance Classification in Motivational InterviewsMain1 citations
- MCIL: Multimodal Counterfactual Instance Learning for Low-resource Entity-based Multimodal Information ExtractionMain1 citations
- MEVTR: A Multilingual Model Enhanced with Visual Text RepresentationsMain1 citations
- MHGRL: An Effective Representation Learning Model for Electronic Health RecordsMain1 citations
- ManNER & ManPOS: Pioneering NLP for Endangered Manchu LanguageMain1 citations
- Mapping the Past: Geographically Linking an Early 20th Century Swedish Encyclopedia with WikidataMain1 citations
- Medical Entity Disambiguation with Medical Mention Relation and Fine-grained Entity KnowledgeMain1 citations
- Medical Vision-Language Pre-Training for Brain AbnormalitiesMain1 citations
- Meta-Cognitive Analysis: Evaluating Declarative and Procedural Knowledge in Datasets and Large Language ModelsMain1 citations
- Metaphors in Online Religious Communication: A Detailed Dataset and Cross-Genre Metaphor DetectionMain1 citations
- Mind Your Neighbours: Leveraging Analogous Instances for Rhetorical Role Labeling for Legal DocumentsMain1 citations
- Mitigating Shortcuts in Language Models with Soft Label EncodingMain1 citations
- MoDE-CoTD: Chain-of-Thought Distillation for Complex Reasoning Tasks with Mixture of Decoupled LoRA-ExpertsMain1 citations
- Morpheme Sense Disambiguation: A New Task Aiming for Understanding the Language at Character LevelMain1 citations
- Motion Capture Analysis of Verb and Adjective Types in Austrian Sign Language (ÖGS)Main1 citations
- Multi-Grained Conversational Graph Network for Retrieval-based Dialogue SystemsMain1 citations
- Multi-Objective Forward Reasoning and Multi-Reward Backward Refinement for Product Review SummarizationMain1 citations
- MultiLexBATS: Multilingual Dataset of Lexical Semantic RelationsMain1 citations
- Murre24: Dialect Identification of Finnish Internet Forum MessagesMain1 citations
- NB Uttale: A Norwegian Pronunciation Lexicon with Dialect VariationMain1 citations
- NGLUEni: Benchmarking and Adapting Pretrained Language Models for Nguni LanguagesMain1 citations
- NLPre: A Revised Approach towards Language-centric Benchmarking of Natural Language Preprocessing SystemsMain1 citations
- NLoPT: N-gram Enhanced Low-Rank Task Adaptive Pre-training for Efficient Language Model AdaptionMain1 citations
- Negation Scope Conversion: Towards a Unified Negation-Annotated DatasetMain1 citations
- New Methods for Exploring Intonosyntax: Introducing an Intonosyntactic Treebank for Nigerian PidginMain1 citations
- New Semantic Task for the French Spoken Language Understanding MEDIA BenchmarkMain1 citations
- On the Adaptation of Unlimiformer for Decoder-Only TransformersMain1 citations
- On the Relationship between Skill Neurons and Robustness in Prompt TuningMain1 citations
- Opinions Are Not Always Positive: Debiasing Opinion Summarization with Model-Specific and Model-Agnostic MethodsMain1 citations
- PEaCE: A Chemistry-Oriented Dataset for Optical Character Recognition on Scientific DocumentsMain1 citations
- POS Tagging for the Endangered Dagur LanguageMain1 citations
- PPORTAL_ner: An Annotated Corpus of Portuguese Literary EntitiesMain1 citations
- PRODIS - a Speech Database and a Phoneme-based Language Model for the Study of Predictability Effects in PolishMain1 citations
- PROM: A Phrase-level Copying Mechanism with Pre-training for Abstractive SummarizationMain1 citations
- PaReNT (Parent Retrieval Neural Tool): A Deep Dive into Word Formation across LanguagesMain1 citations
- Parsing Headed ConstituenciesMain1 citations
- Parsing for Mauritian Creole Using Universal DependenciesMain1 citations
- Pointing Out the Shortcomings of Relation Extraction Models with Semantically Motivated AdversarialsMain1 citations
- PolyNERE: A Novel Ontology and Corpus for Named Entity Recognition and Relation Extraction in Polymer Science DomainMain1 citations
- PopAut: An Annotated Corpus for Populism Detection in Austrian News CommentsMain1 citations
- Pre-training Cross-Modal Retrieval by Expansive Lexicon-Patch AlignmentMain1 citations
- Project MOSLA: Recording Every Moment of Second Language AcquisitionMain1 citations
- Projective Methods for Mitigating Gender Bias in Pre-trained Language ModelsMain1 citations
- Prompt-fused Framework for Inductive Logical Query AnsweringMain1 citations
- PromptStream: Self-Supervised News Story Discovery Using Topic-Aware Article RepresentationsMain1 citations
- Pruning before Fine-tuning: A Retraining-free Compression Framework for Pre-trained Language ModelsMain1 citations
- QUEEREOTYPES: A Multi-Source Italian Corpus of Stereotypes towards LGBTQIA+ Community MembersMain1 citations
- QueryNER: Segmentation of E-commerce QueriesMain1 citations
- RADCoT: Retrieval-Augmented Distillation to Specialization Models for Generating Chain-of-Thoughts in Query ExpansionMain1 citations
- REFeREE: A REference-FREE Model-Based Metric for Text SimplificationMain1 citations
- RISE: Robust Early-exiting Internal Classifiers for Suicide Risk EvaluationMain1 citations
- Rationale-based Learning Using Self-Supervised Narrative Events for Text Summarisation of Interactive Digital NarrativesMain1 citations
- ReCAP: Semantic Role Enhanced Caption GenerationMain1 citations
- ReadLet: A Dataset for Oral, Visual and Tactile Text Reading Data of Early and Mature ReadersMain1 citations
- Reassessing Semantic Knowledge Encoded in Large Language Models through the Word-in-Context TaskMain1 citations
- Rebalancing Label Distribution While Eliminating Inherent Waiting Time in Multi Label Active Learning Applied to TransformersMain1 citations
- Refining rtMRI Landmark-Based Vocal Tract Contour Labels with FCN-Based Smoothing and Point-to-Curve ProjectionMain1 citations
- ReflectSumm: A Benchmark for Course Reflection SummarizationMain1 citations
- Reimagining Intent Prediction: Insights from Graph-Based Dialogue Modeling and Sentence EncodersMain1 citations
- Relation Classification via Bidirectional Prompt Learning with Data Augmentation by Large Language ModelMain1 citations
- Reranking Overgenerated Responses for End-to-End Task-Oriented Dialogue SystemsMain1 citations
- Retrieval-based Question Answering with Passage Expansion Using a Knowledge GraphMain1 citations
- Revisiting Three Text-to-Speech Synthesis Experiments with a Web-Based Audience Response SystemMain1 citations
- RoCoIns: Enhancing Robustness of Large Language Models through Code-Style InstructionsMain1 citations
- Russian Learner Corpus: Towards Error-Cause Annotation for L2 RussianMain1 citations
- S3Prompt: Instructing the Model with Self-calibration, Self-recall and Self-aggregation to Improve In-context LearningMain1 citations
- SPACE-IDEAS: A Dataset for Salient Information Detection in Space InnovationMain1 citations
- SPICED: News Similarity Detection Dataset with Multiple Topics and Complexity LevelsMain1 citations
- STAGE: Simple Text Data Augmentation by Graph ExplorationMain1 citations
- Saliency-Aware Interpolative Augmentation for Multimodal Financial PredictionMain1 citations
- Samayik: A Benchmark and Dataset for English-Sanskrit TranslationMain1 citations
- Schema Learning Corpus: Data and Annotation Focused on Complex EventsMain1 citations
- Searching by Code: A New SearchBySnippet Dataset and SnippeR Retrieval Model for Searching by Code SnippetsMain1 citations
- Sebastian, Basti, Wastl?! Recognizing Named Entities in Bavarian Dialectal DataMain1 citations
- Seeing Is Believing! towards Knowledge-Infused Multi-modal Medical Dialogue GenerationMain1 citations
- Selective Temporal Knowledge Graph ReasoningMain1 citations
- Self-reported Demographics and Discourse Dynamics in a Persuasive Online ForumMain1 citations
- Sequence Reducible Holdout Loss for Language Model PretrainingMain1 citations
- Sequence-to-Sequence Language Models for Character and Emotion Detection in Dream NarrativesMain1 citations
- Sequential and Repetitive Pattern Learning for Temporal Knowledge Graph ReasoningMain1 citations
- Sharing the Cost of Success: A Game for Evaluating and Learning Collaborative Multi-Agent Instruction Giving and Following PoliciesMain1 citations
- SimLex-999 for DutchMain1 citations
- Soft Well-Formed Semantic Parsing with Score-Based SelectionMain1 citations
- Sonos Voice Control Bias Assessment Dataset: A Methodology for Demographic Bias Assessment in Voice AssistantsMain1 citations
- Spanish Resource Grammar Version 2023Main1 citations
- SpeechAlign: A Framework for Speech Translation Alignment EvaluationMain1 citations
- SpreadNaLa: A Naturalistic Code Generation Evaluation Dataset of Spreadsheet FormulasMain1 citations
- StructAM: Enhancing Address Matching through Semantic Understanding of Structure-aware InformationMain1 citations
- Structure-aware Fine-tuning for Code Pre-trained ModelsMain1 citations
- Sub-Table Rescorer for Table Question AnsweringMain1 citations
- Subspace Defense: Discarding Adversarial Perturbations by Learning a Subspace for Clean SignalsMain1 citations
- SwissSLi: The Multi-parallel Sign Language Corpus for SwitzerlandMain1 citations
- TARN-VIST: Topic Aware Reinforcement Network for Visual StorytellingMain1 citations
- TAeKD: Teacher Assistant Enhanced Knowledge Distillation for Closed-Source Multilingual Neural Machine TranslationMain1 citations
- TED-EL: A Corpus for Speech Entity LinkingMain1 citations
- TaiChi: Improving the Robustness of NLP Models by Seeking Common Ground While Reserving DifferencesMain1 citations
- Take Its Essence, Discard Its Dross! Debiasing for Toxic Language Detection via Counterfactual Causal EffectMain1 citations
- TeClass: A Human-Annotated Relevance-based Headline Classification and Generation Dataset for TeluguMain1 citations
- Term-Driven Forward-Looking Claim Synthesis in Earnings CallsMain1 citations
- Text Filtering Classifiers for Medium-Resource LanguagesMain1 citations
- The Contextual Variability of English Nouns: The Impact of Categorical Specificity beyond Conceptual ConcretenessMain1 citations
- The ELCo Dataset: Bridging Emoji and Lexical CompositionMain1 citations
- The Effects of Pretraining in Video-Guided Machine TranslationMain1 citations
- The Impact of Stance Object Type on the Quality of Stance DetectionMain1 citations
- The Key Points: Using Feature Importance to Identify Shortcomings in Sign Language Recognition ModelsMain1 citations
- The Low Saxon LSDC Dataset at Universal DependenciesMain1 citations
- The Open-World Lottery Ticket Hypothesis for OOD Intent ClassificationMain1 citations
- The ParCoLab Parallel Corpus and Its Extension to Four Regional Languages of FranceMain1 citations
- The Role of Syntactic Span Preferences in Post-Hoc Explanation DisagreementMain1 citations
- The Slovak Autistic and Non-Autistic Child Speech Corpus:Task-Oriented Child-Adult InteractionsMain1 citations
- Topic Classification and Headline Generation for Maltese Using a Public News CorpusMain1 citations
- Towards Autonomous Tool Utilization in Language Models: A Unified, Efficient and Scalable FrameworkMain1 citations
- Towards More Realistic Chinese Spell Checking with New Benchmark and Specialized Expert ModelMain1 citations
- Towards the WhAP Corpus: A Resource for the Study of Italian on WhatsAppMain1 citations
- Triples-to-isiXhosa (T2X): Addressing the Challenges of Low-Resource Agglutinative Data-to-Text GenerationMain1 citations
- Uncertainty-Aware Cross-Modal Alignment for Hate Speech DetectionMain1 citations
- Universal Dependencies for Learner RussianMain1 citations
- Unveiling Strengths and Weaknesses of NLP Systems Based on a Rich Evaluation Corpus: The Case of NER in FrenchMain1 citations
- User Guide for KOTE: Korean Online That-gul Emotions DatasetMain1 citations
- Utilizing Local Hierarchy with Adversarial Training for Hierarchical Text ClassificationMain1 citations
- VI-OOD: A Unified Framework of Representation Learning for Textual Out-of-distribution DetectionMain1 citations
- Who Is Bragging More Online? A Large Scale Analysis of Bragging in Social MediaMain1 citations
- Why Voice Biomarkers of Psychiatric Disorders Are Not Used in Clinical Practice? Deconstructing the Myth of the Need for Objective DiagnosisMain1 citations
- WkNER: Enhancing Named Entity Recognition with Word Segmentation Constraints and kNN RetrievalMain1 citations
- Word-Aware Modality Stimulation for Multimodal FusionMain1 citations
- WordNet under Scrutiny: Dictionary Examples in the Era of Large Language ModelsMain1 citations
- Zero-shot Event Detection Using a Textual Entailment Model as an Enhanced AnnotatorMain1 citations
- Zero-shot Learning for Multilingual Discourse Relation ClassificationMain1 citations
- mForms : Multimodal Form Filling with Question AnsweringMain1 citations
- A Closer Look at Clustering Bilingual Comparable CorporaMain
- A Community-Driven Data-to-Text Platform for Football Match SummariesMain
- A Computational Approach to Quantifying Grammaticization of English Deverbal PrepositionsMain
- A Concept Based Approach for Translation of Medical Dialogues into PictographsMain
- A Corpus and Method for Chinese Named Entity Recognition in ManufacturingMain
- A Dual-View Approach to Classifying Radiology Reports by Co-TrainingMain
- A Fast and High-quality Text-to-Speech Method with Compressed Auxiliary Corpus and Limited Target Speaker CorpusMain
- A Hierarchical Sequence-to-Set Model with Coverage Mechanism for Aspect Category Sentiment AnalysisMain
- A Japanese News Simplification Corpus with FaithfulnessMain
- A Lifelong Multilingual Multi-granularity Semantic Alignment Approach via Maximum Co-occurrence ProbabilityMain
- A Luxembourgish Corpus as a Gender Bias Evaluation TestsetMain
- A Multi-Task Transformer Model for Fine-grained Labelling of Chest X-Ray ReportsMain
- A Persona-Based Corpus in the Diabetes Self-Care Domain - Applying a Human-Centered Approach to a Low-Resource ContextMain
- A Reinforcement Learning Approach to Improve Low-Resource Machine Translation Leveraging Domain Monolingual DataMain
- A Self-verified Method for Exploring Simile Knowledge from Pre-trained Language ModelsMain
- A Tool for Determining Distances and Overlaps between Multimodal AnnotationsMain
- A Trusted Multi-View Evidential Fusion Framework for Commonsense ReasoningMain
- A Typology of Errors for User Utterances in ChatbotsMain
- ADEA: An Argumentative Dialogue Dataset on Ethical Issues Concerning Future A.I. ApplicationsMain
- Abstract-level Deductive Reasoning for Pre-trained Language ModelsMain
- Abstractive Multi-Video Captioning: Benchmark Dataset Construction and Extensive EvaluationMain
- Action-Concentrated Embedding Framework: This Is Your Captain Sign-tokeningMain
- Aligning the Norwegian UD Treebank with Entity and Coreference InformationMain
- Alleviating Exposure Bias in Abstractive Summarization via Sequentially Generating and RevisingMain
- An Argument for Symmetric Coordination from Dependency Length Minimization: A Replication StudyMain
- An Automated End-to-End Open-Source Software for High-Quality Text-to-Speech Dataset GenerationMain
- An Effective Span-based Multimodal Named Entity Recognition with Consistent Cross-Modal AlignmentMain
- An Empirical Study on the Robustness of Massively Multilingual Neural Machine TranslationMain
- An Evaluation of Croatian ASR Models for Čakavian TranscriptionMain
- Analysis of Sensation-transfer Dialogues in MotorsportsMain
- Analysis on Unsupervised Acquisition Process of Bilingual Vocabulary through Iterative Back-TranslationMain
- Analyzing Interpretability of Summarization Model with Eye-gaze InformationMain
- AnnoCTR: A Dataset for Detecting and Linking Entities, Tactics, and Techniques in Cyber Threat ReportsMain
- Annotate Chinese Aspect with UMR——a Case Study on the Liitle PrinceMain
- Annotate the Way You Think: An Incremental Note Generation Framework for the Summarization of Medical ConversationsMain
- Annotating Chinese Word Senses with English WordNet: A Practice on OntoNotes Chinese Sense InventoriesMain
- Annotation of Japanese Discourse Relations Focusing on Concessive InferencesMain
- Applying Transfer Learning to German Metaphor PredictionMain
- Approaches and Challenges for Resolving Different Representations of Fictional Characters for Chinese NovelsMain
- Article Classification with Graph Neural Networks and MultigraphsMain
- At the Crossroad of Cuneiform and NLP: Challenges for Fine-grained Part-of-speech TaggingMain
- Automated Extraction of Prosodic Structure from Unannotated Sign Language VideoMain
- Automatic Construction of a Chinese Review Dataset for Aspect Sentiment Triplet Extraction via Iterative Weak SupervisionMain
- Automatic Construction of a Large-Scale Corpus for Geoparsing Using Wikipedia HyperlinksMain
- Automatic Decomposition of Text Editing Examples into Primitive Edit Operations: Toward Analytic Evaluation of Editing SystemsMain
- Automatic Extraction of Nominal Phrases from German Learner Texts of Different Proficiency LevelsMain
- Automatic Partitioning of a Code-Switched Speech Corpus Using Mixed-Integer ProgrammingMain
- Automatic Speech Recognition System-Independent Word Error Rate EstimationMain
- Automating Dataset Production Using Generative Text and Image ModelsMain
- Auxiliary Knowledge-Induced Learning for Automatic Multi-Label Medical Document ClassificationMain
- BERT-BC: A Unified Alignment and Interaction Model over Hierarchical BERT for Response SelectionMain
- BP4ER: Bootstrap Prompting for Explicit Reasoning in Medical Dialogue GenerationMain
- BengaliLCP: A Dataset for Lexical Complexity Prediction in the Bengali TextsMain
- Beyond Model Performance: Can Link Prediction Enrich French Lexical Graphs?Main
- BigNLI: Native Language Identification with Big Bird EmbeddingsMain
- BootTOD: Bootstrap Task-oriented Dialogue Representations by Aligning Diverse ResponsesMain
- Born a BabyNet with Hierarchical Parental Supervision for End-to-End Text Image Machine TranslationMain
- Bridging Computational Lexicography and Corpus Linguistics: A Query Extension for OntoLex-FrACMain
- Bridging Textual and Tabular Worlds for Fact Verification: A Lightweight, Attention-Based ModelMain
- Building MUSCLE, a Dataset for MUltilingual Semantic Classification of Links between EntitiesMain
- CLFFRD: Curriculum Learning and Fine-grained Fusion for Multimodal Rumor DetectionMain
- CO3: Low-resource Contrastive Co-training for Generative Conversational Query RewriteMain
- COMICORDA: Dialogue Act Recognition in Comic BooksMain
- CSSWiki: A Chinese Sentence Simplification Dataset with Linguistic and Content OperationsMain
- Can Language Models Learn Embeddings of Propositional Logic Assertions?Main
- Can We Identify Stance without Target Arguments? A Study for Rumour Stance ClassificationMain
- Categorial Grammar Induction with Stochastic Category SelectionMain
- Character-level Language Models for Abbreviation and Long-form DetectionMain
- Charles Translator: A Machine Translation System between Ukrainian and CzechMain
- Coarse-Tuning for Ad-hoc Document Retrieval Using Pre-trained Language ModelsMain
- Code-Mixed Text Augmentation for Latvian ASRMain
- Cognitive Information Bottleneck: Extracting Minimal Sufficient Cognitive Language Processing SignalsMain
- Computational Modelling of Plurality and Definiteness in Chinese Noun PhrasesMain
- Conceptual Pacts for Reference Resolution Using Small, Dynamically Constructed Language Models: A Study in Puzzle Building DialoguesMain
- Conjoin after Decompose: Improving Few-Shot Performance of Named Entity RecognitionMain
- Connecting Language Technologies with Rich, Diverse Data Sources Covering Thousands of LanguagesMain
- Contextual Modeling for Document-level ASR Error CorrectionMain
- Continued Pre-training on Sentence Analogies for Translation with Small DataMain
- Continuous Relational Diffusion Driven Topic Model with Multi-grained Text for MicroblogMain
- Contribution of Move Structure to Automatic Genre Identification: An Annotated Corpus of French Tourism WebsitesMain
- Controllable Sentence Simplification in Swedish Using Control Prefixes and Mined ParaphrasesMain
- Corpus Creation and Automatic Alignment of Historical Dutch Dialect SpeechMain
- Corpus Services: A Framework to Curate XML Corpus DataMain
- Correcting Pronoun Homophones with Subtle Semantics in Chinese Speech RecognitionMain
- Correlations between Multilingual Language Model Geometry and Crosslingual Transfer PerformanceMain
- Cost-Effective Discourse Annotation in the Prague Czech–English Dependency TreebankMain
- Creating Terminological Resources in the Digital Age for Less-resourced LanguagesMain
- CyberAgressionAdo-v2: Leveraging Pragmatic-Level Information to Decipher Online Hate in French Multiparty ChatsMain
- DET: A Dual-Encoding Transformer for Relational Graph EmbeddingMain
- DORE: A Dataset for Portuguese Definition GenerationMain
- Dealing with Data Scarcity in Spoken Question AnsweringMain
- Decoding at the Speed of Thought: Harnessing Parallel Decoding of Lexical Units for LLMsMain
- Deep Reinforcement Learning with Hierarchical Action Exploration for Dialogue GenerationMain
- Deriving Entity-Specific Embeddings from Multi-Entity SequencesMain
- Detecting Critical Errors Considering Cross-Cultural Factors in English-Korean TranslationMain
- Developing a Benchmark for Pronunciation Feedback: Creation of a Phonemically Annotated Speech Corpus of isiZulu Language Learner SpeechMain
- Development of Community-Oriented Text-to-Speech Models for Māori ‘Avaiki Nui (Cook Islands Māori)Main
- DiaSet: An Annotated Dataset of Arabic ConversationsMain
- Did You Get It? A Zero-Shot Approach to Locate Information Transfers in ConversationsMain
- Diffusion Based Counterfactual Augmentation for Dual Sentiment ClassificationMain
- DimA: A Parameter-efficient Fine-tuning Method with Knowledge Transfer Based on TransformerMain
- Disambiguating Homographs and Homophones Simultaneously: A Regrouping Method for JapaneseMain
- Disentangling Pretrained Representation to Leverage Low-Resource Languages in Multilingual Machine TranslationMain
- Distantly Supervised Contrastive Learning for Low-Resource Scripting Language SummarizationMain
- Do Large Language Models Understand Mansplaining? Well, Actually...Main
- Do Neural Language Models Inferentially Compose Concepts the Way Humans Can?Main
- EDEN: A Dataset for Event Detection in Norwegian NewsMain
- EEE-QA: Exploring Effective and Efficient Question-Answer RepresentationsMain
- EPOQUE: An English-Persian Quality Estimation DatasetMain
- ESCP: Enhancing Emotion Recognition in Conversation with Speech and Contextual PrefixesMain
- EVil-Probe - a Composite Benchmark for Extensive Visio-Linguistic ProbingMain
- Emotags: Computer-Assisted Verbal Labelling of Expressive Audiovisual Utterances for Expressive Multimodal TTSMain
- Encoding Gesture in Multimodal Dialogue: Creating a Corpus of Multimodal AMRMain
- Enhancing Distantly Supervised Named Entity Recognition with Strong Label Guided Lottery TrainingMain
- Enhancing Effectiveness and Robustness in a Low-Resource Regime via Decision-Boundary-aware Data AugmentationMain
- Enhancing Image-to-Text Generation in Radiology Reports through Cross-modal Multi-Task LearningMain
- Enhancing Knowledge Selection via Multi-level Document Semantic GraphMain
- Enhancing Large Language Models through Transforming Reasoning Problems into Classification TasksMain
- Enhancing Parameter-efficient Fine-tuning with Simple Calibration Based on Stable RankMain
- Enhancing Unrestricted Cross-Document Event Coreference with Graph Reconstruction NetworksMain
- Enough Is Enough! a Case Study on the Effect of Data Size for Evaluation Using Universal DependenciesMain
- EpLSA: Synergy of Expert-prefix Mixtures and Task-Oriented Latent Space Adaptation for Diverse Generative ReasoningMain
- EpiGEN: An Efficient Multi-Api Code GENeration Framework under Enterprise ScenarioMain
- Error Analysis of NLP Models and Non-Native Speakers of English Identifying Sarcasm in Reddit CommentsMain
- Evaluating Automatic Subtitling: Correlating Post-editing Effort and Automatic MetricsMain
- Evaluating Word Expansion for Multilingual Sentiment Analysis of Parliamentary SpeechMain
- Every Verb in Its Right Place? A Roadmap for Operationalizing Developmental Stages in the Acquisition of L2 GermanMain
- Evidence-guided Inference for Neutralized Zero-shot TransferMain
- Experimental versus In-Corpus Variation in Referring Expression ChoiceMain
- Exploring BERT-Based Classification Models for Detecting Phobia Subtypes: A Novel Tweet Dataset and Comparative AnalysisMain
- Exploring Geometric Representational Disparities between Multilingual and Bilingual Translation ModelsMain
- Exploring the Emotional Dimension of French Online Toxic ContentMain
- Extracting Biomedical Entities from Noisy Audio TranscriptsMain
- FAIRification of LeiLanDMain
- FFSTC: Fongbe to French Speech Translation CorpusMain
- FORECAST2023: A Forecast and Reasoning Corpus of Argumentation StructuresMain
- FRACAS: a FRench Annotated Corpus of Attribution relations in newSMain
- FReND: A French Resource of Negation DataMain
- FUSE - FrUstration and Surprise Expressions: A Subtle Emotional Multimodal Language CorpusMain
- Few-Shot Semantic Dependency Parsing via Graph Contrastive LearningMain
- Find-the-Common: A Benchmark for Explaining Visual Patterns from ImagesMain
- Finding Educationally Supportive Contexts for Vocabulary Learning with Attention-Based ModelsMain
- Fine-Grained Legal Argument-Pair Extraction via Coarse-Grained Pre-trainingMain
- Fine-Tuning a Pre-Trained Wav2Vec2 Model for Automatic Speech Recognition- Experiments with De Zahrar SprocheMain
- Fine-grained Classification of Circumstantial Meanings within the Prague Dependency Treebank Annotation SchemeMain
- Flexible Lexicalization in Rule-based Text RealizationMain
- FoTo: Targeted Visual Topic Modeling for Focused Analysis of Short TextsMain
- From Technology to Market. Bilingual Corpus on the Evaluation of Technology Opportunity DiscoveryMain
- GECSum: Generative Evaluation-Driven Sequence Level Contrastive Learning for Abstractive SummarizationMain
- GIL-GALaD: Gender Inclusive Language - German Auto-Assembled Large DatabaseMain
- Generating Clarification Questions for Disambiguating ContractsMain
- Generating Contextual Images for Long-Form TextMain
- German Also Hallucinates! Inconsistency Detection in News Summaries with the Absinth DatasetMain
- Granular Change Accuracy: A More Accurate Performance Metric for Dialogue State TrackingMain
- Guided Distant Supervision for Multilingual Relation Extraction Data: Adapting to a New LanguageMain
- HS-GC: Holistic Semantic Embedding and Global Contrast for Effective Text ClusteringMain
- Harnessing the Power of Large Language Model for Uncertainty Aware Graph ProcessingMain
- Hierarchical Topic Modeling via Contrastive Learning and Hyperbolic EmbeddingMain
- High-Order Semantic Alignment for Unsupervised Fine-Grained Image-Text RetrievalMain
- How Far Is Too Far? Studying the Effects of Domain Discrepancy on Masked Language ModelsMain
- How Gender Interacts with Political Values: A Case Study on Czech BERT ModelsMain
- How Much Do Robots Understand Rudeness? Challenges in Human-Robot InteractionMain
- How Speculative Can Speculative Decoding Be?Main
- How Well Can BERT Learn the Grammar of an Agglutinative and Flexible-Order Language? The Case of Basque.Main
- How to Understand “Support”? An Implicit-enhanced Causal Inference Approach for Weakly-supervised Phrase GroundingMain
- Humanitarian Corpora for English, French and SpanishMain
- Hyperbolic Representations for Prompt LearningMain
- IDC: Boost Text-to-image Retrieval via Indirect and Direct ConnectionsMain
- ILCiteR: Evidence-grounded Interpretable Local Citation RecommendationMain
- INMT-Lite: Accelerating Low-Resource Language Data Collection via Offline Interactive Neural Machine TranslationMain
- ISO 24617-12: A New Standard for Semantic AnnotationMain
- IT2ACL Learning Easy-to-Hard Instructions via 2-Phase Automated Curriculum Learning for Large Language ModelsMain
- Identifying Source Language Expressions for Pre-editing in Machine TranslationMain
- Ideological Knowledge Representation: Framing Climate Change in EcoLexiconMain
- Image Matters: A New Dataset and Empirical Study for Multimodal Hyperbole DetectionMain
- Impact of Task Adapting on Transformer Models for Targeted Sentiment Analysis in Croatian HeadlinesMain
- Improving Continual Few-shot Relation Extraction through Relational Knowledge Distillation and Prototype AugmentationMain
- Improving Copy-oriented Text Generation via EDU Copy MechanismMain
- Improving Grammatical Error Correction by Correction Acceptability DiscriminationMain
- Improving Implicit Discourse Relation Recognition with Semantics ConfrontationMain
- Improving Personalized Sentiment Representation with Knowledge-enhanced and Parameter-efficient Layer NormalizationMain
- Improving Vietnamese-English Medical Machine TranslationMain
- IndirectQA: Understanding Indirect Answers to Implicit Polar Questions in French and SpanishMain
- InfFeed: Influence Functions as a Feedback to Improve the Performance of Subjective TasksMain
- Integrating Headedness Information into an Auto-generated Multilingual CCGbank for Improved Semantic InterpretationMain
- Is Gender Reference Gender-specific? Studies in a Polar DomainMain
- IsraParlTweet: The Israeli Parliamentary and Twitter ResourceMain
- Italian Word Embeddings for the Medical DomainMain
- It’s Not under the Lamppost: Expanding the Reach of Conversational AIMain
- JLBert: Japanese Light BERT for Cross-Domain Short Text ClassificationMain
- JRC-Names-Retrieval: A Standardized Benchmark for Name SearchMain
- Joint Annotation of Morphology and Syntax in Dependency TreebanksMain
- KEHRL: Learning Knowledge-Enhanced Language Representations with Hierarchical Reinforcement LearningMain
- KIT-19: A Comprehensive Korean Instruction Toolkit on 19 Tasks for Fine-Tuning Korean Large Language ModelsMain
- Keyphrase Generation: Lessons from a Reproducibility StudyMain
- Khan Academy Corpus: A Multilingual Corpus of Khan Academy LecturesMain
- Killkan: The Automatic Speech Recognition Dataset for Kichwa with Morphosyntactic InformationMain
- Knowledge Enhanced Pre-training for Cross-lingual Dense RetrievalMain
- Knowledge Graphs for Real-World Rumour VerificationMain
- Knowledge Triplets Derivation from Scientific Publications via Dual-Graph ResonanceMain
- Knowledge-aware Attention Network for Medication Effectiveness PredictionMain
- KoDialogBench: Evaluating Conversational Understanding of Language Models with Korean Dialogue BenchmarkMain
- KoFREN: Comprehensive Korean Word Frequency Norms Derived from Large Scale Free Speech CorporaMain
- Konidioms Corpus: A Dataset of Idioms in Konkani LanguageMain
- Kosmic: Korean Text Similarity Metric Reflecting Honorific DistinctionsMain
- Labeling Comic Mischief Content in Online Videos with a Multimodal Hierarchical-Cross-Attention ModelMain
- Labeling Results of Topic Models: Word Sense Disambiguation as Key Method for Automatic Topic Labeling with GermaNetMain
- Language Models and Semantic Relations: A Dual RelationshipMain
- Learning Bidirectional Morphological Inflection like HumansMain
- Lemmatisation of Medieval Greek: Against the Limits of Transformer’s Capabilities?Main
- Leros: Learning Explicit Reasoning on Synthesized Data for Commonsense Question AnsweringMain
- Lessons from Deploying the First Bilingual Peruvian Sign Language - Spanish Online DictionaryMain
- Leveraging AMR Graph Structure for Better Sequence-to-Sequence AMR ParsingMain
- Leveraging Domain Corpora for Enhanced Terminology: The Case of Estonian-English Remote Sensing TermbaseMain
- Leveraging Information Redundancy of Real-World Data through Distant SupervisionMain
- Leveraging the Interplay between Syntactic and Acoustic Cues for Optimizing Korean TTS Pause FormationMain
- LexiVault: A Repository for Psycholinguistic Lexicons of Lesser-studied LanguagesMain
- LinguaMeta: Unified Metadata for Thousands of LanguagesMain
- Linking Adaptive Structure Induction and Neuron Filtering: A Spectral Perspective for Aspect-based Sentiment AnalysisMain
- Linking Judgement Text to Court Hearing Videos: UK Supreme Court as a Case StudyMain
- Loflòc: A Morphological Lexicon for Occitan using Universal DependenciesMain
- MAGPIE: Multi-Task Analysis of Media-Bias Generalization with Pre-Trained Identification of ExpressionsMain
- MMAPS: End-to-End Multi-Grained Multi-Modal Attribute-Aware Product SummarizationMain
- MORE-3S:Multimodal-based Offline Reinforcement Learning with Shared Semantic SpacesMain
- MRT: Multi-modal Short- and Long-range Temporal Convolutional Network for Time-sync Comment Video Behavior PredictionMain
- MUCH: A Multimodal Corpus Construction for Conversational Humor Recognition Based on Chinese SitcomMain
- MVP: Minimal Viable Phrase for Long Text UnderstandingMain
- MWE-Finder: A DemonstrationMain
- Mapping Work Task Descriptions from German Job Ads on the O*NET Work Activities OntologyMain
- Mathematical Entities: Corpora and BenchmarksMain
- Measuring Cross-Text Cohesion for Segmentation Similarity ScoringMain
- MemoryPrompt: A Light Wrapper to Improve Context Tracking in Pre-trained Language ModelsMain
- Meta-Adapter for Self-Supervised Speech Models: A Solution to Low-Resource Speech Recognition ChallengesMain
- Meta-Evaluation of Sentence Simplification MetricsMain
- Mitigating Linguistic Artifacts in Emotion Recognition for Conversations from TV Scripts to Daily ConversationsMain
- Mitigating Misleading Chain-of-Thought Reasoning with Selective FilteringMain
- MoPE: Mixture of Prefix Experts for Zero-Shot Dialogue State TrackingMain
- Modelling Argumentation for an User Opinion Aggregation ToolMain
- Modelling and Linking an Old Latin-Portuguese Dictionary to the LiLa Knowledge BaseMain
- Multi-Granularity Fusion Text Semantic Matching Based on WoBERTMain
- Multi-Tiered Cantonese Word SegmentationMain
- MultiLeg: Dataset for Text Sanitisation in Less-resourced LanguagesMain
- Multilinguality or Back-translation? A Case Study with EstonianMain
- Multimodal Behaviour in an Online Environment: The GEHM Zoom Corpus CollectionMain
- Multimodal Cross-lingual Phrase RetrievalMain
- Multimodal and Multilingual Laughter Detection in Stand-Up Comedy VideosMain
- NAIST-SIC-Aligned: An Aligned English-Japanese Simultaneous Interpretation CorpusMain
- Negation Triplet Extraction with Syntactic Dependency and Semantic ConsistencyMain
- Nested Event Extraction upon Pivot Element RecognitionMain
- Nested Noun Phrase Identification Using BERTMain
- New Datasets for Automatic Detection of Textual Entailment and of Contradictions between Sentences in FrenchMain
- New Evaluation Methodology for Qualitatively Comparing Classification ModelsMain
- New Proposal of Greenberg’s Universal 14 from TypometricsMain
- Non-Essential Is NEcessary: Order-agnostic Multi-hop Question GenerationMain
- Null Subjects in Spanish as a Machine Translation ProblemMain
- NutFrame: Frame-based Conceptual Structure Induction with LLMsMain
- OOVs in the Spotlight: How to Inflect Them?Main
- ORTicket: Let One Robust BERT Ticket Transfer across Different TasksMain
- On Modelling Corpus Citations in Computational Lexical ResourcesMain
- On the Use of Silver Standard Data for Zero-shot Classification Tasks in Information ExtractionMain
- On the Way to Lossless Compression of Language Transformers: Exploring Cross-Domain Properties of QuantizationMain
- OpenMSD: Towards Multilingual Scientific Documents Similarity MeasurementMain
- Out of the Mouths of MPs: Speaker Attribution in Parliamentary DebatesMain
- PILA: A Historical-Linguistic Dataset of Proto-Italic and LatinMain
- PRIMO: Progressive Induction for Multi-hop Open Rule GenerationMain
- PSentScore: Evaluating Sentiment Polarity in Dialogue SummarizationMain
- Palmyra 3.0: A User-Friendly Cloud-Based Platform for Morphology and Dependency Syntax AnnotationMain
- Parameter-Efficient Transfer Learning for End-to-end Speech TranslationMain
- Polish Discourse Corpus (PDC): Corpus Design, ISO-Compliant Annotation, Data Highlights, and Parser DevelopmentMain
- Post-decoder Biasing for End-to-End Speech Recognition of Multi-turn Medical InterviewMain
- PrOnto: Language Model Evaluations for 859 LanguagesMain
- Predictive and Distinctive Linguistic Features in Schizophrenia-Bipolar Spectrum DisordersMain
- Principal Component Analysis as a Sanity Check for Bayesian Phylolinguistic ReconstructionMain
- Producing a Parallel Universal Dependencies Treebank of Ancient Hebrew and Ancient Greek via Cross-Lingual ProjectionMain
- Prototype-based Prompt-Instance Interaction with Causal Intervention for Few-shot Event DetectionMain
- Puntuguese: A Corpus of Puns in Portuguese with Micro-editsMain
- PyRater: A Python Toolkit for Annotation AnalysisMain
- QA-based Event Start-Points Ordering for Clinical Temporal Relation AnnotationMain
- RAAMove: A Corpus for Analyzing Moves in Research Article AbstractsMain
- RT-VQ2A2: Real Time Vector Quantized Question Answering with ASRMain
- Rapidly Piloting Real-time Linguistic Assistance for Simultaneous Interpreters with Untrained Bilingual SurrogatesMain
- Re-evaluating the Tomes for the TimesMain
- Recommending Missed Citations Identified by Reviewers: A New Task, Dataset and BaselinesMain
- Reference-guided Style-Consistent Content TransferMain
- Related Work Is All You NeedMain
- Releasing the Capacity of GANs in Non-Autoregressive Image CaptioningMain
- Representation Degeneration Problem in Prompt-based Models for Natural Language UnderstandingMain
- Representing Compounding with OntoLex. An Evaluation of Vocabularies for Word Formation ResourcesMain
- RoboVox: A Single/Multi-channel Far-field Speaker Recognition Benchmark for a Mobile RobotMain
- SGCM: Salience-Guided Context Modeling for Question GenerationMain
- SLaCAD: A Spoken Language Corpus for Early Alzheimer’s Disease DetectionMain
- SM-FEEL-BG - the First Bulgarian Datasets and Classifiers for Detecting Feelings, Emotions, and Sentiments of Bulgarian Social Media TextMain
- SPLICE: A Singleton-Enhanced PipeLIne for Coreference REsolutionMain
- SPOTTER: A Framework for Investigating Convention Formation in a Visually Grounded Human-Robot Reference TaskMain
- STAF: Pushing the Boundaries of Test-Time Adaptation towards Practical Noise ScenariosMain
- STEntConv: Predicting Disagreement between Reddit Users with Stance Detection and a Signed Graph Convolutional NetworkMain
- Scalable Patent Classification with Aggregated Multi-View RankingMain
- Schroedinger’s Threshold: When the AUC Doesn’t Predict AccuracyMain
- Seeing Eye-to-Eye: Cross-Modal Coherence Relations Inform Eye-gaze Patterns During Comprehension & ProductionMain
- Self-Knowledge Distillation for Knowledge Graph EmbeddingMain
- Semantics-Aware Dual Graph Convolutional Networks for Argument Pair ExtractionMain
- Semantics-enhanced Cross-modal Masked Image Modeling for Vision-Language Pre-trainingMain
- Sense of the Day: Short Timeframe Temporal-Aware Word Sense DisambiguationMain
- ShadowSense: A Multi-annotated Dataset for Evaluating Word Sense InductionMain
- SilverAlign: MT-Based Silver Data Algorithm for Evaluating Word AlignmentMain
- Social Convos: Capturing Agendas and Emotions on Social MediaMain
- Spanless Event Annotation for Corpus-Wide Complex Event UnderstandingMain
- Stories and Personal Experiences in the COVID-19 DiscourseMain
- Strengthening the WiC: New Polysemy Dataset in Hindi and Lack of Cross Lingual TransferMain
- Structure-aware Generation Model for Cross-Domain Aspect-based Sentiment ClassificationMain
- SynTOD: Augmented Response Synthesis for Robust End-to-End Task-Oriented Dialogue SystemMain
- TAPASGO: Transfer Learning towards a German-Language Tabular Question Answering ModelMain
- TIGQA: An Expert-Annotated Question-Answering Dataset in TigrinyaMain
- TRELM: Towards Robust and Efficient Pre-training for Knowledge-Enhanced Language ModelsMain
- Textual Coverage of Eventive Entries in Lexical Semantic ResourcesMain
- The Corpus AIKIA: Using Ranking Annotation for Offensive Language Detection in Modern GreekMain
- The IgboAPI Dataset: Empowering Igbo Language Technologies through Multi-dialectal EnrichmentMain
- The Onomastic Repertoire of the Roman d’Alexandre (ORNARE). Designing an Integrated Digital Onomastic Tool for Medieval French RomanceMain
- The Role of Creaky Voice in Turn Taking and the Perception of Speaker Stance: Experiments Using Controllable TTSMain
- Theoretical and Empirical Advantages of Dense-Vector to One-Hot Encoding of Intent Classes in Open-World ScenariosMain
- Time-aware COMET: A Commonsense Knowledge Model with Temporal KnowledgeMain
- Title-based Extractive Summarization via MRC FrameworkMain
- To Learn or Not to Learn: Replaced Token Detection for Learning the Meaning of NegationMain
- Topic-Controllable Summarization: Topic-Aware Evaluation and Transformer MethodsMain
- Towards Comprehensive Language Analysis for Clinically Enriched Spontaneous DialogueMain
- Towards Cost-effective Multi-style Conversations: A Pilot Study in Task-oriented Dialogue GenerationMain
- Towards Generalizable and Faithful Logic Reasoning over Natural Language via Resolution RefutationMain
- Towards Human-Like Machine Comprehension: Few-Shot Relational Learning in Visually-Rich DocumentsMain
- Towards Semantic Tagging for IrishMain
- Towards Understanding the Relationship between In-context Learning and Compositional GeneralizationMain
- Towards Universal Dependencies for Ancash QuechuaMain
- Towards a Corpus of Spoken Maltese: Korpus tal-Malti Mitkellem, KMMMain
- Towards a Unified Taxonomy of Deep Syntactic RelationsMain
- Training BERT Models to Carry over a Coding System Developed on One Corpus to AnotherMain
- Transfer Fine-tuning for Quality Estimation of Text SimplificationMain
- Transformer-based Swedish Semantic Role Labeling through Transfer LearningMain
- Transformers for Bridging Persian Dialects: Transliteration Model for Tajiki and Iranian ScriptsMain
- TweetTER: A Benchmark for Target Entity Retrieval on Twitter without Knowledge BasesMain
- Typos Correction Training against Misspellings from Text-to-Text TransformersMain
- UDMorph: Morphosyntactically Tagged UD CorporaMain
- UkraiNER: A New Corpus and Annotation Scheme towards Comprehensive Entity RecognitionMain
- Uncovering Agendas: A Novel French & English Dataset for Agenda Detection on Social MediaMain
- Understanding How Positional Encodings Work in Transformer ModelMain
- UniPCM: Universal Pre-trained Conversation Model with Task-aware Automatic PromptMain
- Unicode Normalization and Grapheme Parsing of Indic LanguagesMain
- Unifying Latent and Lexicon Representations for Effective Video-Text RetrievalMain
- Unraveling Spontaneous Speech Dimensions for Cross-Corpus ASR System Evaluation for FrenchMain
- Unveiling Vulnerability of Self-AttentionMain
- Using Speech Technology to Test Theories of Phonetic and Phonological TypologyMain
- Utilizing Longer Context than Speech Bubbles in Automated Manga TranslationMain
- Validating and Exploring Large Geographic CorporaMain
- Visual-Linguistic Dependency Encoding for Image-Text RetrievalMain
- Visual-Textual Entailment with Quantities Using Model Checking and Knowledge InjectionMain
- WW-CSL: A New Dataset for Word-Based Wearable Chinese Sign Language DetectionMain
- WaCadie: Towards an Acadian French CorpusMain
- Well Begun Is Half Done: An Implicitly Augmented Generative Framework with Distribution Modification for Hierarchical Text ClassificationMain
- What Are the Implications of Your Question? Non-Information Seeking Question-Type Identification in CNN TranscriptsMain
- What Happens to a Dataset Transformed by a Projection-based Concept Removal Method?Main
- What Has LeBenchmark Learnt about French Syntax?Main
- What Is Needed for Intra-document Disambiguation of Math Identifiers?Main
- When Do “More Contexts” Help with Sarcasm Recognition?Main
- Which Sense Dominates Multisensory Semantic Understanding? A Brain Decoding StudyMain
- Who Did You Blame When Your Project Failed? Designing a Corpus for Presupposition Generation in Cross-Examination DialoguesMain
- Who Said What: Formalization and Benchmarks for the Task of Quote AttributionMain
- Willkommens-Merkel, Chaos-Johnson, and Tore-Klose: Modeling the Evaluative Meaning of German Personal Name CompoundsMain
- Word-level Commonsense Knowledge Selection for Event DetectionMain
- Would You Like to Make a Donation? A Dialogue System to Persuade You to DonateMain
- XAI-Attack: Utilizing Explainable AI to Find Incorrectly Learned Patterns for Black-Box Adversarial Example CreationMain
- XVD: Cross-Vocabulary Differentiable Training for Generative Adversarial AttacksMain
- ZeLa: Advancing Zero-Shot Multilingual Semantic Parsing with Large Language Models and Chain-of-Thought StrategiesMain
- ZenPropaganda: A Comprehensive Study on Identifying Propaganda Techniques in Russian Coronavirus-Related MediaMain
- Zero-shot Cross-lingual Automated Essay ScoringMain
- mALBERT: Is a Compact Multilingual BERT Model Still Worth It?Main
- myMediCon: End-to-End Burmese Automatic Speech Recognition for Medical ConversationsMain
- “Barking up the Right Tree”, a GAN-Based Pun Generation Model through Semantic PruningMain
COLING accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.