← All conferences

COLING 2024 Accepted Papers

The full list of 1,554 papers accepted at COLING 2024 (International Conference on Computational Linguistics). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.

Main: 1,554
  1. ChatGPT Is a Knowledgeable but Inexperienced Solver: An Investigation of Commonsense Problem in Large Language ModelsMain137 citations
  2. GPTEval: A Survey on Assessments of ChatGPT and GPT-4Main125 citations
  3. Large Language Models for Generative Recommendation: A Survey and Visionary DiscussionsMain105 citations
  4. CulturaX: A Cleaned, Enormous, and Multilingual Dataset for Large Language Models in 167 LanguagesMain99 citations
  5. Tricking LLMs into Disobedience: Formalizing, Analyzing, and Detecting JailbreaksMain85 citations
  6. CoCoMIC: Code Completion by Jointly Modeling In-file and Cross-file ContextMain76 citations
  7. Calibrating LLM-Based EvaluatorMain73 citations
  8. BAMBOO: A Comprehensive Benchmark for Evaluating Long Text Modeling Capacities of Large Language ModelsMain69 citations
  9. A Family of Pretrained Transformer Language Models for RussianMain59 citations
  10. Federated Foundation Models: Privacy-Preserving and Collaborative Learning for Large ModelsMain59 citations
  11. Jump to Conclusions: Short-Cutting Transformers with Linear TransformationsMain52 citations
  12. Enhancing Zero-Shot Chain-of-Thought Reasoning in Large Language Models through LogicMain44 citations
  13. MedMT5: An Open-Source Multilingual Text-to-Text LLM for the Medical DomainMain44 citations
  14. Multi-perspective Improvement of Knowledge Graph Completion with Large Language ModelsMain43 citations
  15. A Zero-shot and Few-shot Study of Instruction-Finetuned Large Language Models Applied to Clinical and Biomedical TasksMain42 citations
  16. Tug-of-War between Knowledge: Exploring and Resolving Knowledge Conflicts in Retrieval-Augmented Language ModelsMain42 citations
  17. Is LLM a Reliable Reviewer? A Comprehensive Evaluation of LLM on Automatic Paper Reviewing TasksMain40 citations
  18. The Touché23-ValueEval Dataset for Identifying Human Values behind ArgumentsMain39 citations
  19. Can Multiple-choice Questions Really Be Useful in Detecting the Abilities of LLMs?Main36 citations
  20. Language Models for Text Classification: Is In-Context Learning Enough?Main35 citations
  21. HumanEval-XL: A Multilingual Code Generation Benchmark for Cross-lingual Natural Language GeneralizationMain34 citations
  22. CBBQ: A Chinese Bias Benchmark Dataset Curated with Human-AI Collaboration for Large Language ModelsMain33 citations
  23. Do Emergent Abilities Exist in Quantized Large Language Models: An Empirical StudyMain33 citations
  24. Large Language Models Offer an Alternative to the Traditional Approach of Topic ModellingMain32 citations
  25. AlphaFin: Benchmarking Financial Analysis with Retrieval-Augmented Stock-Chain FrameworkMain30 citations
  26. Can Large Language Models Automatically Score Proficiency of Written Essays?Main29 citations
  27. Navigating Prompt Complexity for Zero-Shot Classification: A Study of Large Language Models in Computational Social ScienceMain29 citations
  28. CLIcK: A Benchmark Dataset of Cultural and Linguistic Intelligence in KoreanMain27 citations
  29. Can GPT-4 Identify Propaganda? Annotation and Detection of Propaganda Spans in News ArticlesMain27 citations
  30. Take Care of Your Prompt Bias! Investigating and Mitigating Prompt Bias in Factual Knowledge ExtractionMain27 citations
  31. Uncovering the Potential of ChatGPT for Discourse Analysis in Dialogue: An Empirical StudyMain27 citations
  32. Generative Multimodal Entity LinkingMain26 citations
  33. LatEval: An Interactive LLMs Evaluation Benchmark with Incomplete Information from Lateral Thinking PuzzlesMain26 citations
  34. Emotion Analysis in NLP: Trends, Gaps and Roadmap for Future DirectionsMain25 citations
  35. Analyzing the Performance of Large Language Models on Code SummarizationMain24 citations
  36. How Large Language Models Encode Context Knowledge? A Layer-Wise Probing StudyMain24 citations
  37. WorldValuesBench: A Large-Scale Benchmark Dataset for Multi-Cultural Value Awareness of Language ModelsMain24 citations
  38. Analyzing the Dynamics of Climate Change Discourse on Twitter: A New Annotated Corpus and Multi-Aspect ClassificationMain23 citations
  39. CBT-LLM: A Chinese Large Language Model for Cognitive Behavioral Therapy-based Mental Health Question AnsweringMain23 citations
  40. Prompting Large Language Models for Counterfactual Generation: An Empirical StudyMain23 citations
  41. A New Massive Multilingual Dataset for High-Performance Language TechnologiesMain21 citations
  42. Analyzing Large Language Models’ Capability in Location PredictionMain21 citations
  43. Effective Distillation of Table-based Reasoning Ability from LLMsMain21 citations
  44. Improving the Robustness of Large Language Models via Consistency AlignmentMain21 citations
  45. Language Variety Identification with True LabelsMain21 citations
  46. BenLLM-Eval: A Comprehensive Evaluation into the Potentials and Pitfalls of Large Language Models on Bengali NLPMain20 citations
  47. Ethical Reasoning and Moral Value Alignment of LLMs Depend on the Language We Prompt Them inMain20 citations
  48. Large Language Models as Financial Data Annotators: A Study on Effectiveness and EfficiencyMain20 citations
  49. MinT: Boosting Generalization in Mathematical Reasoning via Multi-view Fine-tuningMain20 citations
  50. FaiMA: Feature-aware In-context Learning for Multi-domain Aspect-based Sentiment AnalysisMain19 citations
  51. Unleashing the Power of Imbalanced Modality Information for Multi-modal Knowledge Graph CompletionMain19 citations
  52. Controlled Generation with Prompt Insertion for Natural Language Explanations in Grammatical Error CorrectionMain18 citations
  53. Release of Pre-Trained Models for the Japanese LanguageMain18 citations
  54. ChartThinker: A Contextual Chain-of-Thought Approach to Optimized Chart SummarizationMain17 citations
  55. Evaluating Gender Bias of Pre-trained Language Models in Natural Language Inference by Considering All LabelsMain17 citations
  56. From Laughter to Inequality: Annotated Dataset for Misogyny Detection in Tamil and Malayalam MemesMain17 citations
  57. HAE-RAE Bench: Evaluation of Korean Knowledge in Language ModelsMain17 citations
  58. IT5: Text-to-text Pretraining for Italian Language Understanding and GenerationMain17 citations
  59. LlamaCare: An Instruction Fine-Tuned Large Language Model for Clinical NLPMain17 citations
  60. Mixture-of-LoRAs: An Efficient Multitask Tuning Method for Large Language ModelsMain17 citations
  61. Teaching Large Language Models to Translate on Low-resource Languages with Textbook PromptingMain17 citations
  62. Towards Robust In-Context Learning for Machine Translation with Large Language ModelsMain17 citations
  63. A Paradigm Shift: The Future of Machine Translation Lies with Large Language ModelsMain16 citations
  64. Evolving Knowledge Distillation with Large Language Models and Active LearningMain16 citations
  65. How Good Are LLMs at Out-of-Distribution Detection?Main16 citations
  66. Optimizing Language Augmentation for Multilingual Large Language Models: A Case Study on KoreanMain16 citations
  67. Recent Trends in Personalized Dialogue Generation: A Review of Datasets, Methodologies, and EvaluationsMain16 citations
  68. Retentive or Forgetful? Diving into the Knowledge Memorizing Mechanism of Language ModelsMain16 citations
  69. Zero- and Few-Shot Prompting with LLMs: A Comparative Study with Fine-tuned Models for Bangla Sentiment AnalysisMain16 citations
  70. ChatGPT Rates Natural Language Explanation Quality like Humans: But on Which Scales?Main15 citations
  71. GPT-3.5 for Grammatical Error CorrectionMain15 citations
  72. HealthFC: Verifying Health Claims with Evidence-Based Medical Fact-CheckingMain15 citations
  73. How Susceptible Are LLMs to Logical Fallacies?Main15 citations
  74. LayoutLLM: Large Language Model Instruction Tuning for Visually Rich Document UnderstandingMain15 citations
  75. Enhancing Code Generation Performance of Smaller Models by Distilling the Reasoning Ability of LLMsMain14 citations
  76. Factorized Learning Assisted with Large Language Model for Gloss-free Sign Language TranslationMain14 citations
  77. Zero-Shot Spoken Language Understanding via Large Language Models: A Preliminary StudyMain14 citations
  78. Common Ground Tracking in Multimodal DialogueMain13 citations
  79. Evaluating Prompting Strategies for Grammatical Error Correction Based on Language ProficiencyMain13 citations
  80. GreekBART: The First Pretrained Greek Sequence-to-Sequence ModelMain13 citations
  81. LoNAS: Elastic Low-Rank Adapters for Efficient Large Language ModelsMain13 citations
  82. MentalRiskES: A New Corpus for Early Detection of Mental Disorders in SpanishMain13 citations
  83. My Science Tutor (MyST)–a Large Corpus of Children’s Conversational SpeechMain13 citations
  84. Unlocking Instructive In-Context Learning with Tabular Prompting for Relational Triple ExtractionMain13 citations
  85. A Corpus for Sentence-Level Subjectivity Detection on English News ArticlesMain12 citations
  86. Argument Quality Assessment in the Age of Instruction-Following Large Language ModelsMain12 citations
  87. Assessing the Capabilities of Large Language Models in Coreference: An EvaluationMain12 citations
  88. Benchmarking Hallucination in Large Language Models Based on Unanswerable Math Word ProblemMain12 citations
  89. CLASSLA-web: Comparable Web Corpora of South Slavic Languages Enriched with Linguistic and Genre AnnotationMain12 citations
  90. ChatGPT Role-play Dataset: Analysis of User Motives and Model NaturalnessMain12 citations
  91. Detecting Hallucination and Coverage Errors in Retrieval Augmented Generation for Controversial TopicsMain12 citations
  92. Prefix-diffusion: A Lightweight Diffusion Model for Diverse Image CaptioningMain12 citations
  93. Qabas: An Open-Source Arabic Lexicographic DatabaseMain12 citations
  94. Self-Explanation Prompting Improves Dialogue Understanding in Large Language ModelsMain12 citations
  95. ToNER: Type-oriented Named Entity Recognition with Generative Language ModelMain12 citations
  96. m3P: Towards Multimodal Multilingual Translation with Multimodal PromptMain12 citations
  97. Beyond Full Fine-tuning: Harnessing the Power of LoRA for Multi-Task Instruction TuningMain11 citations
  98. Beyond the Known: Investigating LLMs Performance on Out-of-Domain Intent DetectionMain11 citations
  99. Clue-Instruct: Text-Based Clue Generation for Educational Crossword PuzzlesMain11 citations
  100. DEEM: Dynamic Experienced Expert Modeling for Stance DetectionMain11 citations
  101. DanteLLM: Let’s Push Italian LLM Research Forward!Main11 citations
  102. Deep Learning Based Named Entity Recognition Models for RecipesMain11 citations
  103. From Text to Source: Results in Detecting Large Language Model-Generated ContentMain11 citations
  104. ILLUMINER: Instruction-tuned Large Language Models as Few-shot Intent Classifier and Slot FillerMain11 citations
  105. Is It Possible to Modify Text to a Target Readability Level? An Initial Investigation Using Zero-Shot Large Language ModelsMain11 citations
  106. KC-GenRe: A Knowledge-constrained Generative Re-ranking Method Based on Large Language Models for Knowledge Graph CompletionMain11 citations
  107. LA-UCL: LLM-Augmented Unsupervised Contrastive Learning Framework for Few-Shot Text ClassificationMain11 citations
  108. LexDrafter: Terminology Drafting for Legislative Documents Using Retrieval Augmented GenerationMain11 citations
  109. Quite Good, but Not Enough: Nationality Bias in Large Language Models - a Case Study of ChatGPTMain11 citations
  110. Text Style Transfer Evaluation Using Large Language ModelsMain11 citations
  111. tasksource: A Large Collection of NLP tasks with a Structured Dataset Preprocessing FrameworkMain11 citations
  112. ASEM: Enhancing Empathy in Chatbot through Attention-based Sentiment and Emotion ModelingMain10 citations
  113. CoRelation: Boosting Automatic ICD Coding through Contextualized Code Relation LearningMain10 citations
  114. Creation and Analysis of an International Corpus of Privacy LawsMain10 citations
  115. DOSA: A Dataset of Social Artifacts from Different Indian Geographical SubculturesMain10 citations
  116. Difficulty-Focused Contrastive Learning for Knowledge Tracing with a Large Language Model-Based Difficulty PredictionMain10 citations
  117. Eliciting Motivational Interviewing Skill Codes in Psychotherapy with LLMs: A Bilingual Dataset and Analytical StudyMain10 citations
  118. Enhancing Text-to-SQL Capabilities of Large Language Models through Tailored PromptingsMain10 citations
  119. Extracting Social Determinants of Health from Pediatric Patient Notes Using Large Language Models: Novel Corpus and MethodsMain10 citations
  120. Humanizing Machine-Generated Content: Evading AI-Text Detection through Adversarial AttackMain10 citations
  121. LongDocFACTScore: Evaluating the Factuality of Long Document Abstractive SummarisationMain10 citations
  122. Lˆ2GC:Lorentzian Linear Graph Convolutional Networks for Node ClassificationMain10 citations
  123. NumHG: A Dataset for Number-Focused Headline GenerationMain10 citations
  124. On Zero-Shot Counterspeech Generation by LLMsMain10 citations
  125. PACAR: Automated Fact-Checking with Planning and Customized Action Reasoning Using Large Language ModelsMain10 citations
  126. PSYDIAL: Personality-based Synthetic Dialogue Generation Using Large Language ModelsMain10 citations
  127. Prompt-based Zero-shot Relation Extraction with Semantic Knowledge AugmentationMain10 citations
  128. Rapidly Developing High-quality Instruction Data and Evaluation Benchmark for Large Language Models with Minimal Human Effort: A Case Study on JapaneseMain10 citations
  129. ToolRerank: Adaptive and Hierarchy-Aware Reranking for Tool RetrievalMain10 citations
  130. Untangle the KNOT: Interweaving Conflicting Knowledge and Reasoning Skills in Large Language ModelsMain10 citations
  131. A Comparative Analysis of Word-Level Metric Differential Privacy: Benchmarking the Privacy-Utility Trade-offMain9 citations
  132. A Comparative Study of Explicit and Implicit Gender Biases in Large Language Models via Self-evaluationMain9 citations
  133. A Frustratingly Simple Decoding Method for Neural Text GenerationMain9 citations
  134. A Hybrid Approach to Aspect Based Sentiment Analysis Using Transfer LearningMain9 citations
  135. BEIR-PL: Zero Shot Information Retrieval Benchmark for the Polish LanguageMain9 citations
  136. BanglaAutoKG: Automatic Bangla Knowledge Graph Construction with Semantic Neural Graph FilteringMain9 citations
  137. Building a Broad Infrastructure for Uniform Meaning RepresentationsMain9 citations
  138. CHisIEC: An Information Extraction Corpus for Ancient Chinese HistoryMain9 citations
  139. CTSM: Combining Trait and State Emotions for Empathetic Response ModelMain9 citations
  140. Can Large Language Models Discern Evidence for Scientific Hypotheses? Case Studies in the Social SciencesMain9 citations
  141. Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-ThoughtMain9 citations
  142. Characteristic AI Agents via Large Language ModelsMain9 citations
  143. Constructions Are So Difficult That Even Large Language Models Get Them Right for the Wrong ReasonsMain9 citations
  144. EthioLLM: Multilingual Large Language Models for Ethiopian Languages with Task EvaluationMain9 citations
  145. Evaluating Code-Switching Translation with Large Language ModelsMain9 citations
  146. EventGround: Narrative Reasoning by Grounding to Eventuality-centric Knowledge GraphsMain9 citations
  147. FCDS: Fusing Constituency and Dependency Syntax into Document-Level Relation ExtractionMain9 citations
  148. FLOR: On the Effectiveness of Language AdaptationMain9 citations
  149. GERMS-AT: A Sexism/Misogyny Dataset of Forum Comments from an Austrian Online NewspaperMain9 citations
  150. Has It All Been Solved? Open NLP Research Questions Not Solved by Large Language ModelsMain9 citations
  151. Improving Faithfulness of Large Language Models in Summarization via Sliding Generation and Self-ConsistencyMain9 citations
  152. Logic Rules as Explanations for Legal Case RetrievalMain9 citations
  153. MMAD:Multi-modal Movie Audio DescriptionMain9 citations
  154. Make Prompt-based Black-Box Tuning Colorful: Boosting Model Generalization from Three Orthogonal PerspectivesMain9 citations
  155. Making Pre-trained Language Models Better Continual Few-Shot Relation ExtractorsMain9 citations
  156. Multilingual Turn-taking Prediction Using Voice Activity ProjectionMain9 citations
  157. SaGE: Evaluating Moral Consistency in Large Language ModelsMain9 citations
  158. Self-Improvement Programming for Temporal Knowledge Graph Question AnsweringMain9 citations
  159. Small Language Models Are Good Too: An Empirical Study of Zero-Shot ClassificationMain9 citations
  160. SoftMCL: Soft Momentum Contrastive Learning for Fine-grained Sentiment-aware Pre-trainingMain9 citations
  161. Submodular-based In-context Example Selection for LLMs-based Machine TranslationMain9 citations
  162. Tree-Instruct: A Preliminary Study of the Intrinsic Relationship between Complexity and AlignmentMain9 citations
  163. VietMed: A Dataset and Benchmark for Automatic Speech Recognition of Vietnamese in the Medical DomainMain9 citations
  164. Are Large Language Models Good at Lexical Semantics? A Case of Taxonomy LearningMain8 citations
  165. Autonomous Aspect-Image Instruction a2II: Q-Former Guided Multimodal Sentiment ClassificationMain8 citations
  166. Basque and Spanish Counter Narrative Generation: Data Creation and EvaluationMain8 citations
  167. Benchmarking GPT-4 on Algorithmic Problems: A Systematic Evaluation of Prompting StrategiesMain8 citations
  168. Benchmarking Large Language Models for Persian: A Preliminary Study Focusing on ChatGPTMain8 citations
  169. Building a Data Infrastructure for a Mid-Resource Language: The Case of CatalanMain8 citations
  170. CONAN-MT-SP: A Spanish Corpus for Counternarrative Using GPT ModelsMain8 citations
  171. ChatEL: Entity Linking with ChatbotsMain8 citations
  172. CollabKG: A Learnable Human-Machine-Cooperative Information Extraction Toolkit for (Event) Knowledge Graph ConstructionMain8 citations
  173. Dual Encoder: Exploiting the Potential of Syntactic and Semantic for Aspect Sentiment Triplet ExtractionMain8 citations
  174. ECtHR-PCR: A Dataset for Precedent Understanding and Prior Case Retrieval in the European Court of Human RightsMain8 citations
  175. EDDA: An Encoder-Decoder Data Augmentation Framework for Zero-Shot Stance DetectionMain8 citations
  176. Evaluating Text-to-Speech Synthesis from a Large Discrete Token-based Speech Language ModelMain8 citations
  177. HYRR: Hybrid Infused Reranking for Passage RetrievalMain8 citations
  178. JCoLA: Japanese Corpus of Linguistic AcceptabilityMain8 citations
  179. KazSAnDRA: Kazakh Sentiment Analysis Dataset of Reviews and AttitudesMain8 citations
  180. MARASTA: A Multi-dialectal Arabic Cross-domain Stance CorpusMain8 citations
  181. MCTS: A Multi-Reference Chinese Text Simplification DatasetMain8 citations
  182. MoZIP: A Multilingual Benchmark to Evaluate Large Language Models in Intellectual PropertyMain8 citations
  183. PLAES: Prompt-generalized and Level-aware Learning Framework for Cross-prompt Automated Essay ScoringMain8 citations
  184. Prompting-based Synthetic Data Generation for Few-Shot Question AnsweringMain8 citations
  185. RECIPE4U: Student-ChatGPT Interaction Dataset in EFL Writing EducationMain8 citations
  186. Revisiting the Self-Consistency Challenges in Multi-Choice Question Formats for Large Language Model EvaluationMain8 citations
  187. Robust and Scalable Model Editing for Large Language ModelsMain8 citations
  188. SOBR: A Corpus for Stylometry, Obfuscation, and Bias on RedditMain8 citations
  189. SciNews: From Scholarly Complexities to Public Narratives – a Dataset for Scientific News Report GenerationMain8 citations
  190. Stance Reasoner: Zero-Shot Stance Detection on Social Media with Explicit ReasoningMain8 citations
  191. Tackling Long Code Search with Splitting, Encoding, and AggregatingMain8 citations
  192. The Ethical Question – Use of Indigenous Corpora for Large Language ModelsMain8 citations
  193. The ParlaSent Multilingual Training Dataset for Sentiment Identification in Parliamentary ProceedingsMain8 citations
  194. Your Stereotypical Mileage May Vary: Practical Challenges of Evaluating Biases in Multiple Languages and Cultural ContextsMain8 citations
  195. Zero-Shot Cross-Lingual Document-Level Event Causality Identification with Heterogeneous Graph Contrastive Transfer LearningMain8 citations
  196. A Challenge Dataset and Effective Models for Conversational Stance DetectionMain7 citations
  197. CMDAG: A Chinese Metaphor Dataset with Annotated Grounds as CoT for Boosting Metaphor GenerationMain7 citations
  198. ChainLM: Empowering Large Language Models with Improved Chain-of-Thought PromptingMain7 citations
  199. Comprehensive Study on German Language Models for Clinical and Biomedical Text UnderstandingMain7 citations
  200. Decoding Probing: Revealing Internal Linguistic Structures in Neural Language Models Using Minimal PairsMain7 citations
  201. Development and Evaluation of Pre-trained Language Models for Historical Danish and Norwegian Literary TextsMain7 citations
  202. Distillation with Explanations from Large Language ModelsMain7 citations
  203. Distribution Aware Metrics for Conditional Natural Language GenerationMain7 citations
  204. EmoTrans: Emotional Transition-based Model for Emotion Recognition in ConversationMain7 citations
  205. Evaluation of Really Good Grammatical Error CorrectionMain7 citations
  206. Examining Temporalities on Stance Detection towards COVID-19 VaccinationMain7 citations
  207. Exploring and Mitigating Shortcut Learning for Generative Large Language ModelsMain7 citations
  208. Framed Multi30K: A Frame-Based Multimodal-Multilingual DatasetMain7 citations
  209. GlotScript: A Resource and Tool for Low Resource Writing System IdentificationMain7 citations
  210. Gos 2: A New Reference Corpus of Spoken SlovenianMain7 citations
  211. IDEATE: Detecting AI-Generated Text Using Internal and External Factual StructuresMain7 citations
  212. Improving Robustness of GNN-based Anomaly Detection by Graph Adversarial TrainingMain7 citations
  213. Little Red Riding Hood Goes around the Globe: Crosslingual Story Planning and Generation with Large Language ModelsMain7 citations
  214. OATS: A Challenge Dataset for Opinion Aspect Target Sentiment Joint Detection for Aspect-Based Sentiment AnalysisMain7 citations
  215. On the Scaling Laws of Geographical Representation in Language ModelsMain7 citations
  216. PolQA: Polish Question Answering DatasetMain7 citations
  217. Pre-Trained Language Models Represent Some Geographic Populations Better than OthersMain7 citations
  218. Reinforcement Retrieval Leveraging Fine-grained Feedback for Fact Checking News Claims with Black-Box LLMMain7 citations
  219. Scaling Data Diversity for Fine-Tuning Language Models in Human AlignmentMain7 citations
  220. Sinkhorn Distance Minimization for Knowledge DistillationMain7 citations
  221. Slot and Intent Detection Resources for Bavarian and Lithuanian: Assessing Translations vs Natural Queries to Digital AssistantsMain7 citations
  222. The SAMER Arabic Text Simplification CorpusMain7 citations
  223. Towards Explainability and Fairness in Swiss Judgement Prediction: Benchmarking on a Multilingual DatasetMain7 citations
  224. A CURATEd CATalog: Rethinking the Extraction of Pretraining Corpora for Mid-Resourced LanguagesMain6 citations
  225. A Dataset for Pharmacovigilance in German, French, and Japanese: Annotating Adverse Drug Reactions across LanguagesMain6 citations
  226. A Matter of Perspective: Building a Multi-Perspective Annotated Dataset for the Study of Literary QualityMain6 citations
  227. A Survey on Natural Language Processing for ProgrammingMain6 citations
  228. AdaKron: An Adapter-based Parameter Efficient Model Tuning with Kronecker ProductMain6 citations
  229. Analyzing the Understanding of Morphologically Complex Words in Large Language ModelsMain6 citations
  230. Asking and Answering Questions to Extract Event-Argument StructuresMain6 citations
  231. Automatic Annotation of Grammaticality in Child-Caregiver ConversationsMain6 citations
  232. Automatic Coding of Contingency in Child-Caregiver ConversationsMain6 citations
  233. BLN600: A Parallel Corpus of Machine/Human Transcribed Nineteenth Century Newspaper TextsMain6 citations
  234. CARE: Co-Attention Network for Joint Entity and Relation ExtractionMain6 citations
  235. CWTM: Leveraging Contextualized Word Embeddings from BERT for Neural Topic ModelingMain6 citations
  236. ChatUIE: Exploring Chat-based Unified Information Extraction Using Large Language ModelsMain6 citations
  237. Choice-75: A Dataset on Decision Branching in Script LearningMain6 citations
  238. DARIUS: A Comprehensive Learner Corpus for Argument Mining in German-Language EssaysMain6 citations
  239. Do Language Models Care about Text Quality? Evaluating Web-Crawled Corpora across 11 LanguagesMain6 citations
  240. Does ChatGPT Know That It Does Not Know? Evaluating the Black-Box Calibration of ChatGPTMain6 citations
  241. Domain-Agnostic Adapter Architecture for Deception Detection: Extensive Evaluations with the DIFrauD BenchmarkMain6 citations
  242. Dynamic Knowledge Prompt for Chest X-ray Report GenerationMain6 citations
  243. EsCoLA: Spanish Corpus of Linguistic AcceptabilityMain6 citations
  244. Examining the Limitations of Computational Rumor Detection Models Trained on Static DatasetsMain6 citations
  245. GPT-HateCheck: Can LLMs Write Better Functional Tests for Hate Speech Detection?Main6 citations
  246. HuLU: Hungarian Language Understanding Benchmark KitMain6 citations
  247. Improving Recall of Large Language Models: A Model Collaboration Approach for Relational Triple ExtractionMain6 citations
  248. In-Context Example Retrieval from Multi-Perspectives for Few-Shot Aspect-Based Sentiment AnalysisMain6 citations
  249. Inductive Knowledge Graph Completion with GNNs and Rules: An AnalysisMain6 citations
  250. Knowledge GeoGebra: Leveraging Geometry of Relation Embeddings in Knowledge Graph CompletionMain6 citations
  251. Knowledge-augmented Graph Neural Networks with Concept-aware Attention for Adverse Drug Event DetectionMain6 citations
  252. LFED: A Literary Fiction Evaluation Dataset for Large Language ModelsMain6 citations
  253. Large Language Models Are Echo ChambersMain6 citations
  254. Linear Cross-document Event Coreference Resolution with X-AMRMain6 citations
  255. Low-Rank Prune-And-Factorize for Language Model CompressionMain6 citations
  256. MaiBaam: A Multi-Dialectal Bavarian Universal Dependency TreebankMain6 citations
  257. MaintIE: A Fine-Grained Annotation Schema and Benchmark for Information Extraction from Maintenance Short TextsMain6 citations
  258. MentalHelp: A Multi-Task Dataset for Mental Health in Social MediaMain6 citations
  259. PECC: Problem Extraction and Coding ChallengesMain6 citations
  260. PWESuite: Phonetic Word Embeddings and Tasks They FacilitateMain6 citations
  261. PejorativITy: Disambiguating Pejorative Epithets to Improve Misogyny Detection in Italian TweetsMain6 citations
  262. Probing Multimodal Large Language Models for Global and Local Semantic RepresentationsMain6 citations
  263. SarcNet: A Multilingual Multimodal Sarcasm Detection DatasetMain6 citations
  264. Scansion-based Lyrics GenerationMain6 citations
  265. Step-by-Step: Controlling Arbitrary Style in Text with Large Language ModelsMain6 citations
  266. Towards Building the LEMI Readability Platform for Children’s Literature in the Romanian LanguageMain6 citations
  267. Towards Robust Temporal Activity Localization Learning with Noisy LabelsMain6 citations
  268. TransCoder: Towards Unified Transferable Code Representation Learning Inspired by Human SkillsMain6 citations
  269. ZAEBUC-Spoken: A Multilingual Multidialectal Arabic-English Speech CorpusMain6 citations
  270. A Collection of Pragmatic-Similarity Judgments over Spoken Dialog UtterancesMain5 citations
  271. A Computational Model of Latvian MorphologyMain5 citations
  272. A Construction Grammar Corpus of Varying Schematicity: A Dataset for the Evaluation of Abstractions in Language ModelsMain5 citations
  273. A Logical Pattern Memory Pre-trained Model for Entailment Tree GenerationMain5 citations
  274. APOLLO: An Optimized Training Approach for Long-form Numerical ReasoningMain5 citations
  275. Adaptive Simultaneous Sign Language Translation with Confident Translation Length EstimationMain5 citations
  276. Aggregation of Reasoning: A Hierarchical Framework for Enhancing Answer Selection in Large Language ModelsMain5 citations
  277. An LLM-Enhanced Adversarial Editing System for Lexical SimplificationMain5 citations
  278. Analyzing Effects of Learning Downstream Tasks on Moral Bias in Large Language ModelsMain5 citations
  279. Automatic Authorship Analysis in Human-AI Collaborative WritingMain5 citations
  280. BalsuTalka.lv - Boosting the Common Voice Corpus for Low-Resource LanguagesMain5 citations
  281. Building a Database of Conversational RoutinesMain5 citations
  282. CASIMIR: A Corpus of Scientific Articles Enhanced with Multiple Author-Integrated RevisionsMain5 citations
  283. CHICA: A Developmental Corpus of Child-Caregiver’s Face-to-face vs. Video Call Conversations in Middle ChildhoodMain5 citations
  284. CMNEE:A Large-Scale Document-Level Event Extraction Dataset Based on Open-Source Chinese Military NewsMain5 citations
  285. CamemBERT-bio: Leveraging Continual Pre-training for Cost-Effective Models on French Biomedical DataMain5 citations
  286. CoANZSE Audio: Creation of an Online Corpus for Linguistic and Phonetic Analysis of Australian and New Zealand EnglishesMain5 citations
  287. CroCoSum: A Benchmark Dataset for Cross-Lingual Code-Switched SummarizationMain5 citations
  288. Cross-Lingual Learning vs. Low-Resource Fine-Tuning: A Case Study with Fact-Checking in TurkishMain5 citations
  289. Curriculum Learning Meets Directed Acyclic Graph for Multimodal Emotion RecognitionMain5 citations
  290. DECM: Evaluating Bilingual ASR Performance on a Code-switching/mixing BenchmarkMain5 citations
  291. Data Collection Pipeline for Low-Resource Languages: A Case Study on Constructing a Tetun Text CorpusMain5 citations
  292. Deconstructing In-Context Learning: Understanding Prompts via CorruptionMain5 citations
  293. Depth-Wise Attention (DWAtt): A Layer Fusion Method for Data-Efficient ClassificationMain5 citations
  294. Discourse Structure for the Minecraft CorpusMain5 citations
  295. Diversifying Question Generation over Knowledge Base via External Natural QuestionsMain5 citations
  296. DuetSim: Building User Simulator with Dual Large Language Models for Task-Oriented DialoguesMain5 citations
  297. Evaluating the Quality of a Corpus Annotation Scheme Using Pretrained Language ModelsMain5 citations
  298. Frame2: A FrameNet-based Multimodal Dataset for Tackling Text-image Interactions in VideoMain5 citations
  299. From News to Summaries: Building a Hungarian Corpus for Extractive and Abstractive SummarizationMain5 citations
  300. GCNet: Global-and-Context Collaborative Learning for Aspect-Based Sentiment AnalysisMain5 citations
  301. Generating Multiple-choice Questions for Medical Question Answering with Distractors and Cue-maskingMain5 citations
  302. Human vs. Machine Perceptions on Immigration StereotypesMain5 citations
  303. Hyperbolic Graph Neural Network for Temporal Knowledge Graph CompletionMain5 citations
  304. Identifying Fine-grained Depression Signs in Social Media PostsMain5 citations
  305. Improving Language Model Reasoning with Self-motivated LearningMain5 citations
  306. InfoEnh: Towards Multimodal Sentiment Analysis via Information Bottleneck Filter and Optimal Transport AlignmentMain5 citations
  307. Intent-Aware and Hate-Mitigating Counterspeech Generation via Dual-Discriminator Guided LLMsMain5 citations
  308. KazParC: Kazakh Parallel Corpus for Machine TranslationMain5 citations
  309. Language Technologies as If People Mattered: Centering Communities in Language Technology DevelopmentMain5 citations
  310. Logging Keystrokes in Writing by English LearnersMain5 citations
  311. M2SA: Multimodal and Multilingual Model for Sentiment Analysis of TweetsMain5 citations
  312. MNER-MI: A Multi-image Dataset for Multimodal Named Entity Recognition in Social MediaMain5 citations
  313. MRC-based Nested Medical NER with Co-prediction and Adaptive Pre-trainingMain5 citations
  314. Mixture-of-Prompt-Experts for Multi-modal Semantic UnderstandingMain5 citations
  315. Multilingual Generation in Abstractive Summarization: A Comparative StudyMain5 citations
  316. NSina: A News Corpus for SinhalaMain5 citations
  317. NarrativeTime: Dense Temporal Annotation on a TimelineMain5 citations
  318. New Intent Discovery with Attracting and Dispersing PrototypeMain5 citations
  319. No Need for Large-Scale Search: Exploring Large Language Models in Complex Knowledge Base Question AnsweringMain5 citations
  320. Plots Made Quickly: An Efficient Approach for Generating Visualizations from Natural Language QueriesMain5 citations
  321. Question Answering over Tabular Data with DataBench: A Large-Scale Empirical Evaluation of LLMsMain5 citations
  322. Restoring Ancient Ideograph: A Multimodal Multitask Neural Network ApproachMain5 citations
  323. Revisiting Context Choices for Context-aware Machine TranslationMain5 citations
  324. Revisiting Data Reconstruction Attacks on Real-world Dataset for Federated Natural Language UnderstandingMain5 citations
  325. SciMRC: Multi-perspective Scientific Machine Reading ComprehensionMain5 citations
  326. Sequence-to-Sequence Spanish Pre-trained Language ModelsMain5 citations
  327. SmartTrim: Adaptive Tokens and Attention Pruning for Efficient Vision-Language ModelsMain5 citations
  328. Still All Greeklish to Me: Greeklish to Greek TransliterationMain5 citations
  329. The Challenges of Creating a Parallel Multilingual Hate Speech Corpus: An ExplorationMain5 citations
  330. The Influence of Automatic Speech Recognition on Linguistic Features and Automatic Alzheimer’s Disease Detection from Spontaneous SpeechMain5 citations
  331. TransERR: Translation-based Knowledge Graph Embedding via Efficient Relation RotationMain5 citations
  332. Trustworthiness and Self-awareness in Large Language Models: An Exploration through the Think-Solve-Verify FrameworkMain5 citations
  333. Unveiling Project-Specific Bias in Neural Code ModelsMain5 citations
  334. Verbing Weirds Language (Models): Evaluation of English Zero-Derivation in Five LLMsMain5 citations
  335. WikiFactDiff: A Large, Realistic, and Temporally Adaptable Dataset for Atomic Factual Knowledge Update in Causal Language ModelsMain5 citations
  336. nEMO: Dataset of Emotional Speech in PolishMain5 citations
  337. ÌròyìnSpeech: A Multi-purpose Yorùbá Speech CorpusMain5 citations
  338. A Benchmark for Recipe Understanding in Artificial AgentsMain4 citations
  339. A Computational Analysis of the Dehumanisation of Migrants from Syria and Ukraine in Slovene News MediaMain4 citations
  340. A Corpus of Spontaneous L2 English Speech for Real-situation Speaking AssessmentMain4 citations
  341. A Hong Kong Sign Language Corpus Collected from Sign-interpreted TV NewsMain4 citations
  342. A Multimodal French Corpus of Aligned Speech, Text, and Pictogram Sequences for Speech-to-Pictogram Machine TranslationMain4 citations
  343. A Semantic Mention Graph Augmented Model for Document-Level Event Argument ExtractionMain4 citations
  344. A Tulu Resource for Machine TranslationMain4 citations
  345. ALLIES: A Speech Corpus for Segmentation, Speaker Diarization, Speech Recognition and Speaker Change DetectionMain4 citations
  346. AcnEmpathize: A Dataset for Understanding Empathy in Dermatology ConversationsMain4 citations
  347. Align-to-Distill: Trainable Attention Alignment for Knowledge Distillation in Neural Machine TranslationMain4 citations
  348. Alignment before Awareness: Towards Visual Question Localized-Answering in Robotic Surgery via Optimal Transport and Answer SemanticsMain4 citations
  349. Assessing Online Writing Feedback Resources: Generative AI vs. Good SamaritansMain4 citations
  350. Attack Named Entity Recognition by Entity Boundary InterferenceMain4 citations
  351. Audiocite.net : A Large Spoken Read Dataset in FrenchMain4 citations
  352. Automatic Data Visualization Generation from Chinese Natural Language QuestionsMain4 citations
  353. Automatic Extraction of Language-Specific Biomarkers of Healthy Aging in IcelandicMain4 citations
  354. Backdoor NLP Models via AI-Generated TextMain4 citations
  355. Becoming a High-Resource Language in Speech: The Catalan Case in the Common Voice CorpusMain4 citations
  356. Beyond Binary: Towards Embracing Complexities in Cyberbullying Detection and Intervention - a Position PaperMain4 citations
  357. BlendX: Complex Multi-Intent Detection with Blended PatternsMain4 citations
  358. CM-Off-Meme: Code-Mixed Hindi-English Offensive Meme Detection with Multi-Task Learning by Leveraging Contextual KnowledgeMain4 citations
  359. COMET for Low-Resource Machine Translation Evaluation: A Case Study of English-Maltese and Spanish-BasqueMain4 citations
  360. Can We Learn Question, Answer, and Distractors All from an Image? A New Task for Multiple-choice Visual Question AnsweringMain4 citations
  361. Classifying Social Media Users before and after Depression Diagnosis via Their Language Usage: A Dataset and StudyMain4 citations
  362. Context Shapes Emergent Communication about Concepts at Different Levels of AbstractionMain4 citations
  363. Contextualizing Generated Citation TextsMain4 citations
  364. Conversational Grounding: Annotation and Analysis of Grounding Acts and Grounding UnitsMain4 citations
  365. CuRIAM: Corpus Re Interpretation and Metalanguage in U.S. Supreme Court OpinionsMain4 citations
  366. DC-MBR: Distributional Cooling for Minimum Bayesian Risk DecodingMain4 citations
  367. DISRPT: A Multilingual, Multi-domain, Cross-framework Benchmark for Discourse ProcessingMain4 citations
  368. Dataset of Quotation Attribution in German News ArticlesMain4 citations
  369. Detecting Cybercrimes in Accordance with Pakistani Law: Dataset and Evaluation Using PLMsMain4 citations
  370. Document-Level Event Extraction via Information Interaction Based on Event Relation and Argument CorrelationMain4 citations
  371. EcoVerse: An Annotated Twitter Dataset for Eco-Relevance Classification, Environmental Impact Analysis, and Stance DetectionMain4 citations
  372. Emotion Recognition in Conversation via Dynamic PersonalityMain4 citations
  373. Empowering Oneida Language Revitalization: Development of an Oneida Verb ConjugatorMain4 citations
  374. Enhanced Facet Generation with LLM EditingMain4 citations
  375. Evaluating ChatGPT against Functionality Tests for Hate Speech DetectionMain4 citations
  376. Evaluating Self-Supervised Speech Representations for Indigenous American LanguagesMain4 citations
  377. Evaluating Unsupervised Dimensionality Reduction Methods for Pretrained Sentence EmbeddingsMain4 citations
  378. Event Extraction in Basque: Typologically Motivated Cross-Lingual Transfer-Learning AnalysisMain4 citations
  379. Exploring the Potential of Large Language Models (LLMs) for Low-resource Languages: A Study on Named-Entity Recognition (NER) and Part-Of-Speech (POS) Tagging for Nepali LanguageMain4 citations
  380. Exploring the Usability of Persuasion Techniques for Downstream Misinformation-related Classification TasksMain4 citations
  381. Eye-Tracking Features Masking Transformer Attention in Question-Answering TasksMain4 citations
  382. FRASIMED: A Clinical French Annotated Resource Produced through Crosslingual BERT-Based Annotation ProjectionMain4 citations
  383. From Graph to Word Bag: Introducing Domain Knowledge to Confusing Charge PredictionMain4 citations
  384. GPT-SW3: An Autoregressive Language Model for the Scandinavian LanguagesMain4 citations
  385. GerDISDETECT: A German Multilabel Dataset for Disinformation DetectionMain4 citations
  386. German Parliamentary Corpus (GerParCor) ReloadedMain4 citations
  387. Hypergraph-Based Session Modeling: A Multi-Collaborative Self-Supervised Approach for Enhanced Recommender SystemsMain4 citations
  388. Incorporating Lexical and Syntactic Knowledge for Unsupervised Cross-Lingual TransferMain4 citations
  389. InteRead: An Eye Tracking Dataset of Interrupted ReadingMain4 citations
  390. Investigating the Robustness of Modelling Decisions for Few-Shot Cross-Topic Stance Detection: A Preregistered StudyMain4 citations
  391. Is Crowdsourcing Breaking Your Bank? Cost-Effective Fine-Tuning of Pre-trained Language Models with Proximal Policy OptimizationMain4 citations
  392. Is Summary Useful or Not? An Extrinsic Human Evaluation of Text Summaries on Downstream TasksMain4 citations
  393. JMultiWOZ: A Large-Scale Japanese Multi-Domain Task-Oriented Dialogue DatasetMain4 citations
  394. JoTR: A Joint Transformer and Reinforcement Learning Framework for Dialogue Policy LearningMain4 citations
  395. K-pop Lyric Translation: Dataset, Analysis, and Neural-ModellingMain4 citations
  396. Leveraging Syntactic Dependencies in Disambiguation: The Case of African American EnglishMain4 citations
  397. LexAbSumm: Aspect-based Summarization of Legal DecisionsMain4 citations
  398. MM-IGLU: Multi-Modal Interactive Grounded Language UnderstandingMain4 citations
  399. Malaysian English News Decoded: A Linguistic Resource for Named Entity and Relation ExtractionMain4 citations
  400. Modeling the Quality of Dialogical ExplanationsMain4 citations
  401. Motivational Interviewing Transcripts Annotated with Global ScoresMain4 citations
  402. Multilingual Coreference Resolution in Low-resource South Asian LanguagesMain4 citations
  403. Multimodal Language Models Show Evidence of Embodied SimulationMain4 citations
  404. Out-of-Domain Intent Detection Considering Multi-Turn Dialogue ContextsMain4 citations
  405. PIRB: A Comprehensive Benchmark of Polish Dense and Hybrid Text Retrieval MethodsMain4 citations
  406. Probe Then Retrieve and Reason: Distilling Probing and Reasoning Capabilities into Smaller Language ModelsMain4 citations
  407. QCAW 1.0: Building a Qatari Corpus of Student Argumentative WritingMain4 citations
  408. RankPrompt: Step-by-Step Comparisons Make Language Models Better ReasonersMain4 citations
  409. Reading Does Not Equal Reading: Comparing, Simulating and Exploiting Reading Behavior across PopulationsMain4 citations
  410. Reference-less Analysis of Context Specificity in Translation with Personalised Language ModelsMain4 citations
  411. Resolving Legalese: A Multilingual Exploration of Negation Scope Resolution in Legal DocumentsMain4 citations
  412. RuBia: A Russian Language Bias Detection DatasetMain4 citations
  413. SUK 1.0: A New Training Corpus for Linguistic Annotation of Modern Standard SloveneMain4 citations
  414. Segmentation of Complex Question Turns for Argument Mining: A Corpus-based Study in the Financial DomainMain4 citations
  415. SentiCSE: A Sentiment-aware Contrastive Sentence Embedding Framework with Sentiment-guided Textual SimilarityMain4 citations
  416. So Hateful! Building a Multi-Label Hate Speech Annotated Arabic DatasetMain4 citations
  417. Soft-Prompting with Graph-of-Thought for Multi-modal Representation LearningMain4 citations
  418. Step Feasibility-Aware and Error-Correctable Entailment Tree GenerationMain4 citations
  419. TacoERE: Cluster-aware Compression for Event Relation ExtractionMain4 citations
  420. Targeted Syntactic Evaluation on the Chomsky HierarchyMain4 citations
  421. Temporal Knowledge Graph Reasoning with Dynamic Hypergraph EmbeddingMain4 citations
  422. To Share or Not to Share: What Risks Would Laypeople Accept to Give Sensitive Data to Differentially-Private NLP Systems?Main4 citations
  423. Topic Detection and Tracking with Time-Aware Document EmbeddingsMain4 citations
  424. Towards Dog Bark Decoding: Leveraging Human Speech Processing for Automated Bark ClassificationMain4 citations
  425. Towards Multi-modal Sarcasm Detection via Disentangled Multi-grained Multi-modal DistillingMain4 citations
  426. Towards a Danish Semantic Reasoning Benchmark - Compiled from Lexical-Semantic Resources for Assessing Selected Language Understanding Capabilities of Large Language ModelsMain4 citations
  427. Towards a Framework for Evaluating Explanations in Automated Fact VerificationMain4 citations
  428. Towards a Zero-Data, Controllable, Adaptive Dialog SystemMain4 citations
  429. Towards an Ideal Tool for Learner Error AnnotationMain4 citations
  430. Triple-R: Automatic Reasoning for Fact Verification Using Language ModelsMain4 citations
  431. Two Counterexamples to Tokenization and the Noiseless ChannelMain4 citations
  432. UCxn: Typologically Informed Annotation of Constructions Atop Universal DependenciesMain4 citations
  433. Universal Anaphora: The First Three YearsMain4 citations
  434. Unmasking Biases: Exploring Gender Bias in English-Catalan Machine Translation through Tokenization Analysis and Novel DatasetMain4 citations
  435. UrduMASD: A Multimodal Abstractive Summarization Dataset for UrduMain4 citations
  436. Using Persuasive Writing Strategies to Explain and Detect Health MisinformationMain4 citations
  437. When Argumentation Meets Cohesion: Enhancing Automatic Feedback in Student WritingMain4 citations
  438. A Controlled Reevaluation of Coreference Resolution ModelsMain3 citations
  439. A Differentiable Integer Linear Programming Solver for Explanation-Based Natural Language InferenceMain3 citations
  440. A Multi-Label Dataset of French Fake News: Human and Machine InsightsMain3 citations
  441. A Novel Three-stage Framework for Few-shot Named Entity RecognitionMain3 citations
  442. A Preliminary Study of ChatGPT for Spanish E2R Text AdaptationMain3 citations
  443. A Single Linear Layer Yields Task-Adapted Low-Rank MatricesMain3 citations
  444. A Two-Stage Framework with Self-Supervised Distillation for Cross-Domain Text ClassificationMain3 citations
  445. A Two-Stage Prediction-Aware Contrastive Learning Framework for Multi-Intent NLUMain3 citations
  446. A Web Portal about the State of the Art of NLP Tasks in SpanishMain3 citations
  447. Active Learning Design Choices for NER with TransformersMain3 citations
  448. Agettivu, Aggitivu o Aghjettivu? POS Tagging Corsican DialectsMain3 citations
  449. An LCF-IDF Document Representation Model Applied to Long Document ClassificationMain3 citations
  450. An Untold Story of Preprocessing Task Evaluation: An Alignment-based Joint Evaluation ApproachMain3 citations
  451. Annotations on a Budget: Leveraging Geo-Data Similarity to Balance Model Performance and Annotation CostMain3 citations
  452. Automatic Identification of COVID-19-Related Conspiracy Narratives in German Telegram Channels and ChatsMain3 citations
  453. Beyond Static Evaluation: A Dynamic Approach to Assessing AI Assistants’ API Invocation CapabilitiesMain3 citations
  454. Beyond Words: Decoding Facial Expression Dynamics in Motivational InterviewingMain3 citations
  455. Biomedical Entity Linking as Multiple Choice Question AnsweringMain3 citations
  456. Bootstrapping UMR Annotations for Arapaho from Language Documentation ResourcesMain3 citations
  457. CAM 2.0: End-to-End Open Domain Comparative Question Answering SystemMain3 citations
  458. CB-Whisper: Contextual Biasing Whisper Using Open-Vocabulary Keyword-SpottingMain3 citations
  459. CEPT: A Contrast-Enhanced Prompt-Tuning Framework for Emotion Recognition in ConversationMain3 citations
  460. CLHA: A Simple Yet Effective Contrastive Learning Framework for Human AlignmentMain3 citations
  461. Can Large Language Models Learn Translation Robustness from Noisy-Source In-context Demonstrations?Main3 citations
  462. Challenging Negative Gender Stereotypes: A Study on the Effectiveness of Automated Counter-StereotypesMain3 citations
  463. Charting the Linguistic Landscape of Developing Writers: An Annotation Scheme for Enhancing Native Language ProficiencyMain3 citations
  464. Chinese Morpheme-informed Evaluation of Large Language ModelsMain3 citations
  465. Chinese Sequence Labeling with Semi-Supervised Boundary-Aware Language Model Pre-trainingMain3 citations
  466. Chitchat as Interference: Adding User Backstories to Task-Oriented DialoguesMain3 citations
  467. Code-Mixed Probes Show How Pre-Trained Models Generalise on Code-Switched TextMain3 citations
  468. Context Matters: Enhancing Metaphor Recognition in ProverbsMain3 citations
  469. Continual Few-shot Event Detection via Hierarchical Augmentation NetworksMain3 citations
  470. ContrastWSD: Enhancing Metaphor Detection with Word Sense Disambiguation Following the Metaphor Identification ProcedureMain3 citations
  471. CrossTune: Black-Box Few-Shot Classification with Label EnhancementMain3 citations
  472. Czech Dataset for Complex Aspect-Based Sentiment Analysis TasksMain3 citations
  473. DDxGym: Online Transformer Policies in a Knowledge Graph Based Natural Language EnvironmentMain3 citations
  474. DELAN: Dual-Level Alignment for Vision-and-Language Navigation by Cross-Modal Contrastive LearningMain3 citations
  475. DP-CRE: Continual Relation Extraction via Decoupled Contrastive Learning and Memory Structure PreservationMain3 citations
  476. Detecting Loanwords in Emakhuwa: An Extremely Low-Resource Bantu Language Exhibiting Significant Borrowing from PortugueseMain3 citations
  477. Detecting Offensive Language in an Open Chatbot PlatformMain3 citations
  478. DiffusionDialog: A Diffusion Model for Diverse Dialog Generation with Latent SpaceMain3 citations
  479. Distill, Fuse, Pre-train: Towards Effective Event Causality Identification with Commonsense-Aware Pre-trained ModelMain3 citations
  480. Doc2SoarGraph: Discrete Reasoning over Visually-Rich Table-Text Documents via Semantic-Oriented Hierarchical GraphsMain3 citations
  481. Does the Language Matter? Curriculum Learning over Neo-Latin LanguagesMain3 citations
  482. Domain Adaptation for Dense Retrieval and Conversational Dense Retrieval through Self-Supervision by Meticulous Pseudo-Relevance LabelingMain3 citations
  483. Domain Generalization via Causal Adjustment for Cross-Domain Sentiment AnalysisMain3 citations
  484. Dynamic Reward Adjustment in Multi-Reward Reinforcement Learning for Counselor Reflection GenerationMain3 citations
  485. EFTNAS: Searching for Efficient Language Models in First-Order Weight-Reordered Super-NetworksMain3 citations
  486. Educational Dialogue Systems for Visually Impaired Students: Introducing a Task-Oriented User-Agent CorpusMain3 citations
  487. Eesthetic: A Paralex Lexicon of Estonian ParadigmsMain3 citations
  488. EmoPrompt-ECPE: Emotion Knowledge-aware Prompt-tuning for Emotion-Cause Pair ExtractionMain3 citations
  489. EmpCRL: Controllable Empathetic Response Generation via In-Context Commonsense Reasoning and Reinforcement LearningMain3 citations
  490. End-to-end Parsing of Procedural Text into Flow GraphsMain3 citations
  491. Enhance Robustness of Language Models against Variation Attack through Graph IntegrationMain3 citations
  492. Enhancing Semantics in Multimodal Chain of Thought via Soft Negative SamplingMain3 citations
  493. Enhancing Writing Proficiency Classification in Developmental Education: The Quest for AccuracyMain3 citations
  494. Error-Robust Retrieval for Chinese Spelling CheckMain3 citations
  495. Evaluating the Potential of Language-family-specific Generative Models for Low-resource Data Augmentation: A Faroese Case StudyMain3 citations
  496. EvoGrad: A Dynamic Take on the Winograd Schema Challenge with Human AdversariesMain3 citations
  497. Exploring Interpretability of Independent Components of Word Embeddings with Automated Word Intruder TestMain3 citations
  498. Exploring the Generalization of Cancer Clinical Trial Eligibility Classifiers across DiseasesMain3 citations
  499. FalAI: A Dataset for End-to-end Spoken Language Understanding in a Low-Resource ScenarioMain3 citations
  500. FastSpell: The LangId Magic SpellMain3 citations
  501. Few-Shot Learning for Cold-Start RecommendationMain3 citations
  502. Few-shot Named Entity Recognition via Superposition Concept DiscriminationMain3 citations
  503. FlattenQuant: Breaking through the Inference Compute-bound for Large Language Models with Per-tensor QuantizationMain3 citations
  504. FoRC4CL: A Fine-grained Field of Research Classification and Annotated Dataset of NLP ArticlesMain3 citations
  505. Gendered Grammar or Ingrained Bias? Exploring Gender Bias in Icelandic Language ModelsMain3 citations
  506. Geographically-Informed Language IdentificationMain3 citations
  507. Good or Bad News? Exploring GPT-4 for Sentiment Analysis for Faroese on a Public News CorporaMain3 citations
  508. Gramble: A Tabular Programming Language for Collaborative Linguistic ModelingMain3 citations
  509. HYPERTTS: Parameter Efficient Adaptation in Text to Speech Using HypernetworksMain3 citations
  510. HarmPot: An Annotation Framework for Evaluating Offline Harm Potential of Social Media TextMain3 citations
  511. Hierarchical Selection of Important Context for Generative Event Causality Identification with Optimal TransportsMain3 citations
  512. How to Do Politics with Words: Investigating Speech Acts in Parliamentary DebatesMain3 citations
  513. Human in the Loop: How to Effectively Create Coherent Topics by Manually Labeling Only a Few Documents per ClassMain3 citations
  514. Humans Need Context, What about Machines? Investigating Conversational Context in Abusive Language DetectionMain3 citations
  515. Hybrid of Spans and Table-Filling for Aspect-Level Sentiment Triplet ExtractionMain3 citations
  516. Improved Neural Protoform Reconstruction via Reflex PredictionMain3 citations
  517. InaGVAD : A Challenging French TV and Radio Corpus Annotated for Speech Activity Detection and Speaker Gender SegmentationMain3 citations
  518. Interpretable Short Video Rumor Detection Based on Modality TamperingMain3 citations
  519. Interpreting Themes from Educational StoriesMain3 citations
  520. Intrinsic Subgraph Generation for Interpretable Graph Based Visual Question AnsweringMain3 citations
  521. J-CRe3: A Japanese Conversation Dataset for Real-world Reference ResolutionMain3 citations
  522. JDocQA: Japanese Document Question Answering Dataset for Generative Language ModelsMain3 citations
  523. JFLD: A Japanese Benchmark for Deductive Reasoning Based on Formal LogicMain3 citations
  524. Jargon: A Suite of Language Models and Evaluation Tasks for French Specialized DomainsMain3 citations
  525. KCL: Few-shot Named Entity Recognition with Knowledge Graph and Contrastive LearningMain3 citations
  526. KET-QA: A Dataset for Knowledge Enhanced Table Question AnsweringMain3 citations
  527. KazQAD: Kazakh Open-Domain Question Answering DatasetMain3 citations
  528. Know-Adapter: Towards Knowledge-Aware Parameter-Efficient Transfer Learning for Few-shot Named Entity RecognitionMain3 citations
  529. KoCoSa: Korean Context-aware Sarcasm Detection DatasetMain3 citations
  530. LLMR: Knowledge Distillation with a Large Language Model-Induced RewardMain3 citations
  531. LLMSegm: Surface-level Morphological Segmentation Using Large Language ModelMain3 citations
  532. Layer-wise Regularized Dropout for Neural Language ModelsMain3 citations
  533. Learning Strategies for Robust Argument Mining: An Analysis of Variations in Language and DomainMain3 citations
  534. Let’s Rectify Step by Step: Improving Aspect-based Sentiment Analysis with Diffusion ModelsMain3 citations
  535. Leveraging Linguistically Enhanced Embeddings for Open Information ExtractionMain3 citations
  536. Linguistic Knowledge Can Enhance Encoder-Decoder Models (If You Let It)Main3 citations
  537. Linguistic Survey of India and Polyglotta Africana: Two Retrostandardized Digital Editions of Large Historical Collections of Multilingual WordlistsMain3 citations
  538. Locally Differentially Private In-Context LearningMain3 citations
  539. MAGIC: Multi-Argument Generation with Self-Refinement for Domain Generalization in Automatic Fact-CheckingMain3 citations
  540. MedQA-SWE - a Clinical Question & Answer Dataset for SwedishMain3 citations
  541. Monolingual Paraphrase Detection Corpus for Low Resource Pashto Language at Sentence LevelMain3 citations
  542. Motion Generation from Fine-grained Textual DescriptionsMain3 citations
  543. Multi-Channel Spatio-Temporal Transformer for Sign Language ProductionMain3 citations
  544. Multilingual Brain Surgeon: Large Language Models Can Be Compressed Leaving No Language behindMain3 citations
  545. Multilingual Sentence-T5: Scalable Sentence Encoders for Multilingual ApplicationsMain3 citations
  546. Multilingual Substitution-based Word Sense InductionMain3 citations
  547. Multimodal Cross-Document Event Coreference Resolution Using Linear Semantic Transfer and Mixed-Modality EnsemblesMain3 citations
  548. NER-guided Comprehensive Hierarchy-aware Prompt Tuning for Hierarchical Text ClassificationMain3 citations
  549. Neural Machine Translation between Low-Resource Languages with Synthetic PivotingMain3 citations
  550. On an Intermediate Task for Classifying URL Citations on Scholarly PapersMain3 citations
  551. Opinion Mining Using Pre-Trained Large Language Models: Identifying the Type, Polarity, Intensity, Expression, and Source of Private StatesMain3 citations
  552. Phonetic Segmentation of the UCLA Phonetics Lab ArchiveMain3 citations
  553. PopALM: Popularity-Aligned Language Models for Social Media Trendy Response PredictionMain3 citations
  554. Positive and Risky Message Assessment for Music ProductsMain3 citations
  555. ProCQA: A Large-scale Community-based Programming Question Answering Dataset for Code SearchMain3 citations
  556. PromISe: Releasing the Capabilities of LLMs with Prompt Introspective SearchMain3 citations
  557. Prompt-based Generation of Natural Language Explanations of Synthetic Lethality for Cancer Drug DiscoveryMain3 citations
  558. Prompting Explicit and Implicit Knowledge for Multi-hop Question Answering Based on Human Reading ProcessMain3 citations
  559. Prompting for Numerical Sequences: A Case Study on Market Comment GenerationMain3 citations
  560. Pseudonymization Categories across Domain BoundariesMain3 citations
  561. Quantifying the Impact of Disfluency on Spoken Content SummarizationMain3 citations
  562. Reconstruction of Cuneiform Literary Texts as Text MatchingMain3 citations
  563. Reduce Redundancy Then Rerank: Enhancing Code Summarization with a Novel Pipeline FrameworkMain3 citations
  564. Rethinking Word-level Adversarial Attack: The Trade-off between Efficiency, Effectiveness, and ImperceptibilityMain3 citations
  565. Retrieval-Augmented Modular Prompt Tuning for Low-Resource Data-to-Text GenerationMain3 citations
  566. RoCode: A Dataset for Measuring Code Intelligence from Problem Definitions in RomanianMain3 citations
  567. SDA: Simple Discrete Augmentation for Contrastive Sentence Representation LearningMain3 citations
  568. SI-NLI: A Slovene Natural Language Inference Dataset and Its EvaluationMain3 citations
  569. Select High-quality Synthetic QA Pairs to Augment Training Data in MRC under the Reward Guidance of Generative Language ModelsMain3 citations
  570. Semantic Frame Extraction in Multilingual Olfactory EventsMain3 citations
  571. SignBLEU: Automatic Evaluation of Multi-channel Sign Language TranslationMain3 citations
  572. Social Orientation: A New Feature for Dialogue AnalysisMain3 citations
  573. Speech Analysis of Language Varieties in ItalyMain3 citations
  574. StyleFlow: Disentangle Latent Representations via Normalizing Flow for Unsupervised Text Style TransferMain3 citations
  575. SuperST: Superficial Self-Training for Few-Shot Text ClassificationMain3 citations
  576. TARIC-SLU: A Tunisian Benchmark Dataset for Spoken Language UnderstandingMain3 citations
  577. TECA: A Two-stage Approach with Controllable Attention Soft Prompt for Few-shot Nested Named Entity RecognitionMain3 citations
  578. TIGER: A Unified Generative Model Framework for Multimodal Dialogue Response GenerationMain3 citations
  579. TMFN: A Target-oriented Multi-grained Fusion Network for End-to-end Aspect-based Multimodal Sentiment AnalysisMain3 citations
  580. The Syntactic Acceptability Dataset (Preview): A Resource for Machine Learning and Linguistic Analysis of EnglishMain3 citations
  581. To Err Is Human, How about Medical Large Language Models? Comparing Pre-trained Language Models for Medical Assessment Errors and ReliabilityMain3 citations
  582. Token-length Bias in Minimal-pair Paradigm DatasetsMain3 citations
  583. Towards Algorithmic Fidelity: Mental Health Representation across Demographics in Synthetic vs. Human-generated DataMain3 citations
  584. Towards Equitable Natural Language Understanding Systems for Dialectal Cohorts: Debiasing Training DataMain3 citations
  585. Towards Few-shot Entity Recognition in Document Images: A Graph Neural Network Approach Robust to Image ManipulationMain3 citations
  586. Towards Human-aligned Evaluation for Linear Programming Word ProblemsMain3 citations
  587. Towards Realistic Few-Shot Relation Extraction: A New Meta Dataset and EvaluationMain3 citations
  588. Transferring BERT Capabilities from High-Resource to Low-Resource Languages Using Vocabulary MatchingMain3 citations
  589. UMTIT: Unifying Recognition, Translation, and Generation for Multimodal Text Image TranslationMain3 citations
  590. UQA: Corpus for Urdu Question AnsweringMain3 citations
  591. UniRetriever: Multi-task Candidates Selection for Various Context-Adaptive Conversational RetrievalMain3 citations
  592. Universal Dependencies: Extensions for Modern and Historical GermanMain3 citations
  593. Unsupervised Grouping of Public Procurement Similar Items: Which Text Representation Should I Use?Main3 citations
  594. Using Pre-Trained Language Models in an End-to-End Pipeline for Antithesis DetectionMain3 citations
  595. What Factors Influence LLMs’ Judgments? A Case Study on Question AnsweringMain3 citations
  596. When Your Cousin Has the Right Connections: Unsupervised Bilingual Lexicon Induction for Related Data-Imbalanced LanguagesMain3 citations
  597. 3AM: An Ambiguity-Aware Multi-Modal Machine Translation DatasetMain2 citations
  598. A Canonical Form for Flexible Multiword ExpressionsMain2 citations
  599. A Dataset for Named Entity Recognition and Entity Linking in Chinese Historical NewspapersMain2 citations
  600. A Decade of Scholarly Research on Open Knowledge GraphsMain2 citations
  601. A Gaze-grounded Visual Question Answering Dataset for Clarifying Ambiguous Japanese QuestionsMain2 citations
  602. A Knowledge Plug-and-Play Test Bed for Open-domain Dialogue GenerationMain2 citations
  603. A Lightweight Approach to a Giga-Corpus of Historical Periodicals: The Story of a Slovenian Historical Newspaper CollectionMain2 citations
  604. A Linguistically-Informed Annotation Strategy for Korean Semantic Role LabelingMain2 citations
  605. A Multi-layered Approach to Physical Commonsense Understanding: Creation and Evaluation of an Italian DatasetMain2 citations
  606. A Multimodal In-Context Tuning Approach for E-Commerce Product Description GenerationMain2 citations
  607. A Natural Approach for Synthetic Short-Form Text AnalysisMain2 citations
  608. A Novel Corpus of Annotated Medical Imaging Reports and Information Extraction Results Using BERT-based Language ModelsMain2 citations
  609. A Quantum-Inspired Matching Network with Linguistic Theories for Metaphor DetectionMain2 citations
  610. A Regularization-based Transfer Learning Method for Information Extraction via Instructed Graph DecoderMain2 citations
  611. Agent-based Modeling of Language Change in a Small-world NetworkMain2 citations
  612. An Unsupervised Framework for Adaptive Context-aware Simplified-Traditional Chinese Character ConversionMain2 citations
  613. Analyzing Homonymy Disambiguation Capabilities of Pretrained Language ModelsMain2 citations
  614. Anchor and Broadcast: An Efficient Concept Alignment Approach for Evaluation of Semantic GraphsMain2 citations
  615. AnnoTheia: A Semi-Automatic Annotation Toolkit for Audio-Visual Speech TechnologiesMain2 citations
  616. Annotation and Classification of Relevant Clauses in Terms-and-Conditions ContractsMain2 citations
  617. Announcing the Prague Discourse Treebank 3.0Main2 citations
  618. Appraisal Framework for Clinical Empathy: A Novel Application to Breaking Bad News ConversationsMain2 citations
  619. Arbitrary Time Information Modeling via Polynomial Approximation for Temporal Knowledge Graph EmbeddingMain2 citations
  620. AuRoRA: A One-for-all Platform for Augmented Reasoning and Refining with Task-Adaptive Chain-of-Thought PromptingMain2 citations
  621. Automatic Punctuation Model for Spanish Live TranscriptionsMain2 citations
  622. Automatic Speech Interruption Detection: Analysis, Corpus, and SystemMain2 citations
  623. Benchmarking the Performance of Machine Translation Evaluation Metrics with Chinese Multiword ExpressionsMain2 citations
  624. Benchmarking the Simplification of Dutch Municipal TextMain2 citations
  625. Beyond Canonical Fine-tuning: Leveraging Hybrid Multi-Layer Pooled Representations of BERT for Automated Essay ScoringMain2 citations
  626. Beyond Linguistic Cues: Fine-grained Conversational Emotion Recognition via Belief-Desire ModellingMain2 citations
  627. C-Journal: A Journaling Application for Detecting and Classifying Cognitive Distortions Using Deep-Learning Based on a Crowd-sourced DatasetMain2 citations
  628. CAGK: Collaborative Aspect Graph Enhanced Knowledge-based RecommendationMain2 citations
  629. CAMERA³: An Evaluation Dataset for Controllable Ad Text Generation in JapaneseMain2 citations
  630. CLEVR-POC: Reasoning-Intensive Visual Question Answering in Partially Observable EnvironmentsMain2 citations
  631. Camel Morph MSA: A Large-Scale Open-Source Morphological Analyzer for Modern Standard ArabicMain2 citations
  632. Can Humans Identify Domains?Main2 citations
  633. Causal Intersectionality and Dual Form of Gradient Descent for Multimodal Analysis: A Case Study on Hateful MemesMain2 citations
  634. ChainNet: Structured Metaphor and Metonymy in WordNetMain2 citations
  635. CoBaLD Annotation: The Enrichment of the Enhanced Universal Dependencies with the Semantical PatternMain2 citations
  636. CoNLL#: Fine-grained Error Analysis and a Corrected Test Set for CoNLL-03 EnglishMain2 citations
  637. Code Defect Detection Using Pre-trained Language Models with Encoder-Decoder via Line-Level Defect LocalizationMain2 citations
  638. Collecting Human-Agent Dialogue Dataset with Frontal Brain Signal toward Capturing Unexpressed SentimentMain2 citations
  639. Collecting Linguistic Resources for Assessing Children’s Pronunciation of Nordic LanguagesMain2 citations
  640. Combining Discourse Coherence with Large Language Models for More Inclusive, Equitable, and Robust Task-Oriented DialogueMain2 citations
  641. Common European Language Data SpaceMain2 citations
  642. Complex Word Identification: A Comparative Study between ChatGPT and a Dedicated Model for This TaskMain2 citations
  643. ConEC: Earnings Call Dataset with Real-world Contexts for Benchmarking Contextual Speech RecognitionMain2 citations
  644. Constructing Korean Learners’ L2 Speech Corpus of Seven Languages for Automatic Pronunciation AssessmentMain2 citations
  645. Constructing a Dependency Treebank for Second Language Learners of KoreanMain2 citations
  646. Construction of Paired Knowledge Graph - Text Datasets Informed by Cyclic EvaluationMain2 citations
  647. Controllable Paraphrase Generation for Semantic and Lexical SimilaritiesMain2 citations
  648. Counterfactual Dialog Mixing as Data Augmentation for Task-Oriented Dialog SystemsMain2 citations
  649. Croatian Idioms Integration: Enhancing the LIdioms Multilingual Linked Idioms DatasetMain2 citations
  650. Cross-type French Multiword Expression Identification with Pre-trained Masked Language ModelsMain2 citations
  651. CuSINeS: Curriculum-driven Structure Induced Negative Sampling for Statutory Article RetrievalMain2 citations
  652. DEIE: Benchmarking Document-level Event Information Extraction with a Large-scale Chinese News DatasetMain2 citations
  653. DMON: A Simple Yet Effective Approach for Argument Structure LearningMain2 citations
  654. DOC-RAG: ASR Language Model Personalization with Domain-Distributed Co-occurrence Retrieval AugmentationMain2 citations
  655. DRAMA: Dynamic Multi-Granularity Graph Estimate Retrieval over Tabular and Textual Question AnsweringMain2 citations
  656. Dataset for Identification of Homophobia and Transphobia for Telugu, Kannada, and GujaratiMain2 citations
  657. DeFaktS: A German Dataset for Fine-Grained Disinformation Detection through Social Media FramingMain2 citations
  658. Deep Reinforcement Learning-based Dialogue Policy with Graph Convolutional Q-networkMain2 citations
  659. Demonstration Retrieval-Augmented Generative Event Argument ExtractionMain2 citations
  660. Denoising Table-Text Retrieval for Open-Domain Question AnsweringMain2 citations
  661. Detection, Diagnosis, and Explanation: A Benchmark for Chinese Medial Hallucination EvaluationMain2 citations
  662. Developing a Rhetorical Structure Theory Treebank for CzechMain2 citations
  663. DiscoGeM 2.0: A Parallel Corpus of English, German, French and Czech Implicit Discourse RelationsMain2 citations
  664. Distilling Causal Effect of Data in Continual Few-shot Relation LearningMain2 citations
  665. Domain Transferable Semantic Frames for Expert Interview DialoguesMain2 citations
  666. Domain-aware and Co-adaptive Feature Transformation for Domain Adaption Few-shot Relation ExtractionMain2 citations
  667. Dr3: Ask Large Language Models Not to Give Off-Topic Answers in Open Domain Multi-Hop Question AnsweringMain2 citations
  668. Dual Complex Number Knowledge Graph EmbeddingsMain2 citations
  669. Dynamic Spatial-Temporal Aggregation for Skeleton-Aware Sign Language RecognitionMain2 citations
  670. ESDM: Early Sensing Depression Model in Social Media StreamsMain2 citations
  671. Effective Integration of Text Diffusion and Pre-Trained Language Models with Linguistic Easy-First ScheduleMain2 citations
  672. Efficient AMR Parsing with CLAP: Compact Linearization with an Adaptable ParserMain2 citations
  673. Emancipating Event Extraction from the Constraints of Long-Tailed Distribution Data Utilizing Large Language ModelsMain2 citations
  674. EmoProgress: Cumulated Emotion Progression Analysis in Dreams and Customer Service DialoguesMain2 citations
  675. Empowering Low-Resource Regional Languages with Lexicons : A Comparative Study of NLP Tools for Morphosyntactic AnalysisMain2 citations
  676. Empowering Tree-structured Entailment Reasoning: Rhetorical Perception and LLM-driven InterpretabilityMain2 citations
  677. Emstremo: Adapting Emotional Support Response with Enhanced Emotion-Strategy Integrated SelectionMain2 citations
  678. Enhancing Court View Generation with Knowledge Injection and GuidanceMain2 citations
  679. Enhancing Cross-Document Event Coreference Resolution by Discourse Structure and Semantic InformationMain2 citations
  680. Enhancing Low-Resource LLMs Classification with PEFT and Synthetic DataMain2 citations
  681. Enhancing Phrase Representation by Information Bottleneck Guided Text Diffusion Process for Keyphrase ExtractionMain2 citations
  682. Enhancing Scientific Document Summarization with Research Community Perspective and Background KnowledgeMain2 citations
  683. Enhancing Translation Ability of Large Language Models by Leveraging Task-Related LayersMain2 citations
  684. Ensembles of Hybrid and End-to-End Speech Recognition.Main2 citations
  685. Estimating Lexical Complexity from Document-Level DistributionsMain2 citations
  686. Evaluating Topic Model on Asymmetric and Multi-Domain Financial CorpusMain2 citations
  687. Evaluating Workflows for Creating Orthographic Transcripts for Oral Corpora by Transcribing from Scratch or Correcting ASR-OutputMain2 citations
  688. Evaluation Dataset for Lexical Translation Consistency in Chinese-to-English Document-level TranslationMain2 citations
  689. Event Representation Learning with Multi-Grained Contrastive Learning and Triple-Mixture of ExpertsMain2 citations
  690. Executing Natural Language-Described Algorithms with Large Language Models: An InvestigationMain2 citations
  691. Explaining Pre-Trained Language Models with Attribution Scores: An Analysis in Low-Resource SettingsMain2 citations
  692. Explicit over Implict: Explicit Diversity Conditions for Effective Question Answer GenerationMain2 citations
  693. Exploring Pathological Speech Quality Assessment with ASR-Powered Wav2Vec2 in Data-Scarce ContextMain2 citations
  694. Exploring the Synergy of Dual-path Encoder and Alignment Module for Better Graph-to-Text GenerationMain2 citations
  695. Extending AZee with Non-manual Gesture Rules for French Sign LanguageMain2 citations
  696. FaGANet: An Evidence-Based Fact-Checking Model with Integrated Encoder Leveraging Contextual InformationMain2 citations
  697. Feature Structure Matching for Multi-source Sentiment Analysis with Efficient Adaptive TuningMain2 citations
  698. Federated Document-Level Biomedical Relation Extraction with Localized Context ContrastMain2 citations
  699. Few-Shot Relation Extraction with Hybrid Visual EvidenceMain2 citations
  700. FinCorpus-DE10k: A Corpus for the German Financial DomainMain2 citations
  701. Finding Spoken Identifications: Using GPT-4 Annotation for an Efficient and Fast Dataset Creation PipelineMain2 citations
  702. Fisher Mask Nodes for Language Model MergingMain2 citations
  703. GLAMR: Augmenting AMR with GL-VerbNet Event StructureMain2 citations
  704. GMEG-EXP: A Dataset of Human- and LLM-Generated Explanations of Grammatical and Fluency EditsMain2 citations
  705. GOLEM: GOld Standard for Learning and Evaluation of MotifsMain2 citations
  706. German SRL: Corpus Construction and Model TrainingMain2 citations
  707. Grammatical Error Correction for Code-Switched Sentences by Learners of EnglishMain2 citations
  708. Hierarchical Graph Convolutional Network Approach for Detecting Low-Quality DocumentsMain2 citations
  709. High-order Joint Constituency and Dependency ParsingMain2 citations
  710. How Diplomats Dispute: The UN Security Council Conflict CorpusMain2 citations
  711. How Robust Are the QA Models for Hybrid Scientific Tabular Data? A Study Using Customized DatasetMain2 citations
  712. How to Encode Domain Information in Relation ClassificationMain2 citations
  713. How to Solve Few-Shot Abusive Content Detection Using the Data We Actually HaveMain2 citations
  714. I Remember You!: SUI Corpus for Remembering and Utilizing Users’ Information in Chat-oriented Dialogue SystemsMain2 citations
  715. IAD: In-Context Learning Ability Decoupler of Large Language Models in Meta-TrainingMain2 citations
  716. Identifying and Aligning Medical Claims Made on Social Media with Medical EvidenceMain2 citations
  717. Impoverished Language Technology: The Lack of (Social) Class in NLPMain2 citations
  718. Improving Content Recommendation: Knowledge Graph-Based Semantic Contrastive Learning for Diversity and Cold-Start UsersMain2 citations
  719. Improving Low-Resource Keyphrase Generation through Unsupervised Title Phrase GenerationMain2 citations
  720. Incorporating Word-level Phonemic Decoding into Readability AssessmentMain2 citations
  721. Indic-TEDST: Datasets and Baselines for Low-Resource Speech to Text TranslationMain2 citations
  722. IndicFinNLP: Financial Natural Language Processing for Indian LanguagesMain2 citations
  723. InferBR: A Natural Language Inference Dataset in PortugueseMain2 citations
  724. Intention and Face in DialogMain2 citations
  725. Interpretable Assessment of Speech Intelligibility Using Deep Learning: A Case Study on Speech Disorders Due to Head and Neck CancersMain2 citations
  726. Introducing CQuAE : A New French Contextualised Question-Answering Corpus for the Education DomainMain2 citations
  727. JEMHopQA: Dataset for Japanese Explainable Multi-Hop Question AnsweringMain2 citations
  728. JaParaPat: A Large-Scale Japanese-English Parallel Patent Application CorpusMain2 citations
  729. KazEmoTTS: A Dataset for Kazakh Emotional Text-to-Speech SynthesisMain2 citations
  730. Knowledge-Guided Cross-Topic Visual Question GenerationMain2 citations
  731. Korean Bio-Medical Corpus (KBMC) for Medical Named Entity RecognitionMain2 citations
  732. LANID: LLM-assisted New Intent DiscoveryMain2 citations
  733. LCGbank: A Corpus of Syntactic Analyses Based on Proof NetsMain2 citations
  734. LHMKE: A Large-scale Holistic Multi-subject Knowledge Evaluation Benchmark for Chinese Large Language ModelsMain2 citations
  735. LM-Combiner: A Contextual Rewriting Model for Chinese Grammatical Error CorrectionMain2 citations
  736. Language and Speech Technology for Central Kurdish VarietiesMain2 citations
  737. Latent vs Explicit Knowledge Representation: How ChatGPT Answers Questions about Low-Frequency EntitiesMain2 citations
  738. LeadEmpathy: An Expert Annotated German Dataset of Empathy in Written Leadership CommunicationMain2 citations
  739. Leveraging Social Context for Humor Recognition and Sense of Humor Evaluation in Social Media with a New Chinese Humor Corpus - HumorWBMain2 citations
  740. Linking Named Entities in Diderot’s Encyclopédie to WikidataMain2 citations
  741. Llama-VITS: Enhancing TTS Synthesis with Semantic AwarenessMain2 citations
  742. LocalTweets to LocalHealth: A Mental Health Surveillance Framework Based on Twitter DataMain2 citations
  743. Longform Multimodal Lay Summarization of Scientific Papers: Towards Automatically Generating Science Blogs from Research ArticlesMain2 citations
  744. Look before You Leap: Dual Logical Verification for Knowledge-based Visual Question GenerationMain2 citations
  745. MDS: A Fine-Grained Dataset for Multi-Modal Dialogue SummarizationMain2 citations
  746. MKeCL: Medical Knowledge-Enhanced Contrastive Learning for Few-shot Disease DiagnosisMain2 citations
  747. MLDSP-MA: Multidimensional Attention for Multi-Round Long Dialogue Sentiment PredictionMain2 citations
  748. MULTICOLLAB: A Multimodal Corpus of Dialogues for Analyzing Collaboration and Frustration in LanguageMain2 citations
  749. MaCmS: Magahi Code-mixed Dataset for Sentiment AnalysisMain2 citations
  750. Majority Rules Guided Aspect-Category Based Sentiment Analysis via Label Prior KnowledgeMain2 citations
  751. Making Sentence Embeddings Robust to User-Generated ContentMain2 citations
  752. Massively Multilingual Token-Based Typology Using the Parallel Bible CorpusMain2 citations
  753. MccSTN: Multi-Scale Contrast and Fine-Grained Feature Fusion Networks for Subject-driven Style TransferMain2 citations
  754. MiDe22: An Annotated Multi-Event Tweet Dataset for Misinformation DetectionMain2 citations
  755. Mitigating Translationese in Low-resource Languages: The Storyboard ApproachMain2 citations
  756. MixRED: A Mix-lingual Relation Extraction DatasetMain2 citations
  757. MoNMT: Modularly Leveraging Monolingual and Bilingual Knowledge for Neural Machine TranslationMain2 citations
  758. Modalities Should Be Appropriately Leveraged: Uncertainty Guidance for Multimodal Chinese Spelling CorrectionMain2 citations
  759. Model-Agnostic Cross-Lingual Training for Discourse Representation Structure ParsingMain2 citations
  760. Modeling Low-Resource Health Coaching Dialogues via Neuro-Symbolic Goal Summarization and Text-Units-Text GenerationMain2 citations
  761. Modeling Orthographic Variation Improves NLP Performance for Nigerian PidginMain2 citations
  762. Multi-Dimensional Machine Translation Evaluation: Model Evaluation and Resource for KoreanMain2 citations
  763. Multi-Stage Multi-Modal Pre-Training for Automatic Speech RecognitionMain2 citations
  764. Multi-domain Hate Speech Detection Using Dual Contrastive Learning and Paralinguistic FeaturesMain2 citations
  765. Multi-modal Semantic Understanding with Contrastive Cross-modal Feature AlignmentMain2 citations
  766. Multi-stream Information Fusion Framework for Emotional Support ConversationMain2 citations
  767. Neural Multimodal Topic Modeling: A Comprehensive EvaluationMain2 citations
  768. OLViT: Multi-Modal State Tracking via Attention-Based Embeddings for Video-Grounded DialogMain2 citations
  769. On Leveraging Encoder-only Pre-trained Language Models for Effective Keyphrase GenerationMain2 citations
  770. PAD: A Robustness Enhancement Ensemble Method via Promoting Attention DiversityMain2 citations
  771. PASUM: A Pre-training Architecture for Social Media User Modeling Based on Text GraphMain2 citations
  772. PDAMeta: Meta-Learning Framework with Progressive Data Augmentation for Few-Shot Text ClassificationMain2 citations
  773. PSE v1.0: The First Open Access Corpus of Public Service EncountersMain2 citations
  774. ParaNames 1.0: Creating an Entity Name Corpus for 400+ Languages Using WikidataMain2 citations
  775. Pater Incertus? There Is a Solution: Automatic Discrimination between Cognates and Borrowings for Romance LanguagesMain2 citations
  776. Persona-aware Multi-party Conversation Response GenerationMain2 citations
  777. Phonotactic Complexity across DialectsMain2 citations
  778. Pluggable Neural Machine Translation Models via Memory-augmented AdaptersMain2 citations
  779. Polish-ASTE: Aspect-Sentiment Triplet Extraction Datasets for PolishMain2 citations
  780. PolitiCause: An Annotation Scheme and Corpus for Causality in Political TextsMain2 citations
  781. Prior Relational Schema Assists Effective Contrastive Learning for Inductive Knowledge Graph CompletionMain2 citations
  782. Probing Large Language Models for Scalar Adjective Lexical Semantics and Scalar Diversity PragmaticsMain2 citations
  783. Prompt Tuning for Few-shot Relation Extraction via Modeling Global and Local GraphsMain2 citations
  784. Prophecy Distillation for Boosting Abstractive SummarizationMain2 citations
  785. QDMR-based Planning-and-Solving Prompting for Complex Reasoning TasksMain2 citations
  786. Qsnail: A Questionnaire Dataset for Sequential Question GenerationMain2 citations
  787. Query-driven Relevant Paragraph Extraction from Legal JudgmentsMain2 citations
  788. RENN: A Rule Embedding Enhanced Neural Network Framework for Temporal Knowledge Graph CompletionMain2 citations
  789. RU22Fact: Optimizing Evidence for Multilingual Explainable Fact-Checking on Russia-Ukraine ConflictMain2 citations
  790. Recognizing Social Cues in Crisis SituationsMain2 citations
  791. Recognizing Value Resonance with Resonance-Tuned RoBERTa Task Definition, Experimental Validation, and Robust ModelingMain2 citations
  792. Refining Idioms Semantics Comprehension via Contrastive Learning and Cross-AttentionMain2 citations
  793. Reflecting the Male Gaze: Quantifying Female Objectification in 19th and 20th Century NovelsMain2 citations
  794. Reflections & Resonance: Two-Agent Partnership for Advancing LLM-based Story AnnotationMain2 citations
  795. Relation between Cross-Genre and Cross-Topic Transfer in Dependency ParsingMain2 citations
  796. Replace, Paraphrase or Fine-tune? Evaluating Automatic Simplification for Medical Texts in SpanishMain2 citations
  797. Revisiting the Classics: A Study on Identifying and Rectifying Gender Stereotypes in Rhymes and PoemsMain2 citations
  798. Rewiring the Transformer with Depth-Wise LSTMsMain2 citations
  799. RoBERTa Low Resource Fine Tuning for Sentiment Analysis in AlbanianMain2 citations
  800. SCOUT: A Situated and Multi-Modal Human-Robot Dialogue CorpusMain2 citations
  801. SENTA: Sentence Simplification System for SloveneMain2 citations
  802. SIGA: A Naturalistic NLI Dataset of English Scalar Implicatures with Gradable AdjectivesMain2 citations
  803. SamróMur MilljóN: An ASR Corpus of One Million Verified Read Prompts in IcelandicMain2 citations
  804. Sarcasm Detection in a Disaster ContextMain2 citations
  805. Scale-VAE: Preventing Posterior Collapse in Variational AutoencoderMain2 citations
  806. Schema-based Data Augmentation for Event ExtractionMain2 citations
  807. SciDMT: A Large-Scale Corpus for Detecting Scientific MentionsMain2 citations
  808. Select and Reorder: A Novel Approach for Neural Sign Language ProductionMain2 citations
  809. Semantic Map-based Generation of Navigation InstructionsMain2 citations
  810. Semantic Role Labeling Guided Out-of-distribution DetectionMain2 citations
  811. Silver Retriever: Advancing Neural Passage Retrieval for Polish Question AnsweringMain2 citations
  812. SkOTaPA: A Dataset for Skepticism Detection in Online Text after Persuasion AttemptMain2 citations
  813. SlovakSum: A Large Scale Slovak Summarization DatasetMain2 citations
  814. Source-free Domain Adaptation for Aspect-based Sentiment AnalysisMain2 citations
  815. Sparse Logistic Regression with High-order Features for Automatic Grammar Rule Extraction from TreebanksMain2 citations
  816. Specifying Genericity through Inclusiveness and Abstractness Continuous ScalesMain2 citations
  817. Speech Corpus for Korean Children with Autism Spectrum Disorder: Towards Automatic Assessment SystemsMain2 citations
  818. Speech Recognition Corpus of the Khinalug Language for Documenting Endangered LanguagesMain2 citations
  819. SynPrompt: Syntax-aware Enhanced Prompt Engineering for Aspect-based Sentiment AnalysisMain2 citations
  820. Synergetic Interaction Network with Cross-task Attention for Joint Relational Triple ExtractionMain2 citations
  821. Synthetic Data Generation and Joint Learning for Robust Code-Mixed TranslationMain2 citations
  822. TACO – Twitter Arguments from COnversationsMain2 citations
  823. TP-Link: Fine-grained Pre-Training for Text-to-SQL Parsing with Linking InformationMain2 citations
  824. Target-Adaptive Consistency Enhanced Prompt-Tuning for Multi-Domain Stance DetectionMain2 citations
  825. Task-Oriented Paraphrase AnalyticsMain2 citations
  826. Task-agnostic Distillation of Encoder-Decoder Language ModelsMain2 citations
  827. Tell Me Again! a Large-Scale Dataset of Multiple Summaries for the Same StoryMain2 citations
  828. Text-to-Multimodal Retrieval with Bimodal Input Fusion in Shared Cross-Modal TransformerMain2 citations
  829. Text2Story Lusa: A Dataset for Narrative Analysis in European Portuguese News ArticlesMain2 citations
  830. Text360Nav: 360-Degree Image Captioning Dataset for Urban Pedestrians NavigationMain2 citations
  831. The Distracted Ear: How Listeners Shape Conversational DynamicsMain2 citations
  832. The Emergence of Semantic Units in Massively Multilingual ModelsMain2 citations
  833. The RIP Corpus of Collaborative Hypothesis-MakingMain2 citations
  834. The Swedish Parliament Corpus 1867 – 2022Main2 citations
  835. There’s Something New about the Italian Parliament: The IPSA CorpusMain2 citations
  836. To Drop or Not to Drop? Predicting Argument Ellipsis Judgments: A Case Study in JapaneseMain2 citations
  837. TopicDiff: A Topic-enriched Diffusion Approach for Multimodal Conversational Emotion DetectionMain2 citations
  838. Topics as Entity Clusters: Entity-based Topics from Large Language Models and Graph Neural NetworksMain2 citations
  839. Towards Answering Health-related Questions from Medical Videos: Datasets and ApproachesMain2 citations
  840. Towards Graph-hop Retrieval and Reasoning in Complex Question Answering over Textual DatabaseMain2 citations
  841. Towards Robust Evidence-Aware Fake News Detection via Improving Semantic PerceptionMain2 citations
  842. Towards Standardized Annotation and Parsing for Korean FrameNetMain2 citations
  843. Transformer-based Joint Modelling for Automatic Essay Scoring and Off-Topic DetectionMain2 citations
  844. TunArTTS: Tunisian Arabic Text-To-Speech CorpusMain2 citations
  845. UniPSDA: Unsupervised Pseudo Semantic Data Augmentation for Zero-Shot Cross-Lingual Natural Language UnderstandingMain2 citations
  846. Unpacking Bias: An Empirical Study of Bias Measurement Metrics, Mitigation Algorithms, and Their InteractionsMain2 citations
  847. Using Bibliodata LODification to Create Metadata-Enriched Literary Corpora in Line with FAIR PrinciplesMain2 citations
  848. UzbekVerbDetection: Rule-based Detection of Verbs in Uzbek TextsMain2 citations
  849. Vygotsky Distance: Measure for Benchmark Task SimilarityMain2 citations
  850. What Can Diachronic Contexts and Topics Tell Us about the Present-Day Compositionality of English Noun Compounds?Main2 citations
  851. What Do Transformers Know about Government?Main2 citations
  852. When Cohesion Lies in the Embedding Space: Embedding-Based Reference-Free Metrics for Topic SegmentationMain2 citations
  853. WikiSplit++: Easy Data Refinement for Split and RephraseMain2 citations
  854. XATU: A Fine-grained Instruction-based Benchmark for Explainable Text UpdatesMain2 citations
  855. text2story: A Python Toolkit to Extract and Visualize Story Components of Narrative TextMain2 citations
  856. A Benchmark Evaluation of Clinical Named Entity Recognition in FrenchMain1 citations
  857. A Call for Clarity in Beam Search: How It Works and When It StopsMain1 citations
  858. A Cause-Effect Look at Alleviating Hallucination of Knowledge-grounded Dialogue GenerationMain1 citations
  859. A Corpus of German Abstract Meaning Representation (DeAMR)Main1 citations
  860. A Document-Level Text Simplification Dataset for JapaneseMain1 citations
  861. A Generative Model for Lambek Categorial SequentsMain1 citations
  862. A Large Annotated Reference Corpus of New High German PoetryMain1 citations
  863. A Multilingual Parallel Corpus for AromanianMain1 citations
  864. A Streamlined Span-based Factorization Method for Few Shot Named Entity RecognitionMain1 citations
  865. A Study on How Attention Scores in the BERT Model Are Aware of Lexical Categories in Syntactic and Semantic Tasks on the GLUE BenchmarkMain1 citations
  866. A Treebank of Asia Minor GreekMain1 citations
  867. A Virtual Patient Dialogue System Based on Question-Answering on Clinical RecordsMain1 citations
  868. A Workflow for HTR-Postprocessing, Labeling and Classifying Diachronic and Regional Variation in Pre-Modern Slavic TextsMain1 citations
  869. ABLE: Agency-BeLiefs Embedding to Address Stereotypical Bias through Awareness Instead of ObliviousnessMain1 citations
  870. AMenDeD: Modelling Concepts by Aligning Mentions, Definitions and Decontextualised EmbeddingsMain1 citations
  871. ARBRES Kenstur: A Breton-French Parallel Corpus Rooted in Field LinguisticsMain1 citations
  872. ART: The Alternating Reading Task Corpus for Speech Entrainment and ImitationMain1 citations
  873. Access Control Framework for Language CollectionsMain1 citations
  874. Action and Reaction Go Hand in Hand! a Multi-modal Dialogue Act Aided Sarcasm IdentificationMain1 citations
  875. Adaptive Reinforcement Tuning Language Models as Hard Data Generators for Sentence RepresentationMain1 citations
  876. Adding SPICE to Life: Speaker Profiling in Multiparty ConversationsMain1 citations
  877. Advancing Semi-Supervised Learning for Automatic Post-Editing: Data-Synthesis by Mask-Infilling with Erroneous TermsMain1 citations
  878. Advancing Topic Segmentation and Outline Generation in Chinese Texts: The Paragraph-level Topic Representation, Corpus, and BenchmarkMain1 citations
  879. Agenda-Driven Question Generation: A Case Study in the Courtroom DomainMain1 citations
  880. An Empirical Study of Synthetic Data Generation for Implicit Discourse Relation RecognitionMain1 citations
  881. An Event-based Abductive Learning for Hard Time-sensitive Question AnsweringMain1 citations
  882. Analyzing Chain-of-thought Prompting in Black-Box Large Language Models via Estimated V-informationMain1 citations
  883. Analyzing Occupational Distribution Representation in Japanese Language ModelsMain1 citations
  884. Analyzing Symptom-based Depression Level Estimation through the Prism of Psychiatric ExpertiseMain1 citations
  885. Annotating Customer-Oriented Behaviour in Call Centre Sales DialoguesMain1 citations
  886. Annotation of Transition-Relevance Places and Interruptions for the Description of Turn-Taking in Conversations in French Media ContentMain1 citations
  887. Annotations for Exploring Food Tweets from Multiple AspectsMain1 citations
  888. AntCritic: Argument Mining for Free-Form and Visually-Rich Financial CommentsMain1 citations
  889. Arabic Diacritization Using Morphologically Informed Character-Level ModelMain1 citations
  890. Are Text Classifiers Xenophobic? A Country-Oriented Bias Detection Method with Least Confounding VariablesMain1 citations
  891. AssameseBackTranslit: Back Transliteration of Romanized Assamese Social Media TextMain1 citations
  892. Assessing the Efficacy of Grammar Error Correction: A Human Evaluation Approach in the Japanese ContextMain1 citations
  893. Automatic Animacy Classification for Romanian NounsMain1 citations
  894. Automatic Speech Recognition for Gascon and Languedocian Variants of OccitanMain1 citations
  895. Automatically Estimating Textual and Phonemic Complexity for Cued Speech: How to See the Sounds from French TextsMain1 citations
  896. BAN-PL: A Polish Dataset of Banned Harmful and Offensive Content from Wykop.pl Web ServiceMain1 citations
  897. BKEE: Pioneering Event Extraction in the Vietnamese LanguageMain1 citations
  898. Beyond Code: Evaluate Thought Steps for Complex Code GenerationMain1 citations
  899. BiVert: Bidirectional Vocabulary Evaluation Using Relations for Machine TranslationMain1 citations
  900. Biomedical Concept Normalization over Nested Entities with Partial UMLS Terminology in RussianMain1 citations
  901. Bits and Pieces: Investigating the Effects of Subwords in Multi-task Parsing across Languages and DomainsMain1 citations
  902. Breakthrough from Nuance and Inconsistency: Enhancing Multimodal Sarcasm Detection with Context-Aware Self-Attention Fusion and Word Weight Calculation.Main1 citations
  903. Bridging the Code Gap: A Joint Learning Framework across Medical Coding SystemsMain1 citations
  904. Bring Invariant to Variant: A Contrastive Prompt-based Framework for Temporal Knowledge Graph ForecastingMain1 citations
  905. Building Question-Answer Data Using Web Register IdentificationMain1 citations
  906. Building a Japanese Document-Level Relation Extraction Dataset Assisted by Cross-Lingual TransferMain1 citations
  907. CALAMR: Component ALignment for Abstract Meaning RepresentationMain1 citations
  908. CAMAL: A Novel Dataset for Multi-label Conversational Argument Move AnalysisMain1 citations
  909. CE-VDG: Counterfactual Entropy-based Bias Reduction for Video-grounded Dialogue GenerationMain1 citations
  910. CLAUSE-ATLAS: A Corpus of Narrative Information to Scale up Computational Literary AnalysisMain1 citations
  911. CORI: CJKV Benchmark with Romanization Integration - a Step towards Cross-lingual Transfer beyond Textual ScriptsMain1 citations
  912. Can Factual Statements Be Deceptive? The DeFaBel Corpus of Belief-based DeceptionMain1 citations
  913. Can Machine Translation Bridge Multilingual Pretraining and Cross-lingual Transfer Learning?Main1 citations
  914. CareCorpus: A Corpus of Real-World Solution-Focused Caregiver Strategies for Personalized Pediatric Rehabilitation Service DesignMain1 citations
  915. Challenges in Pre-Training Graph Neural Networks for Context-Based Fake News Detection: An Evaluation of Current Strategies and Resource LimitationsMain1 citations
  916. ChatASU: Evoking LLM’s Reflexion to Truly Understand Aspect Sentiment in DialoguesMain1 citations
  917. Claim-Centric and Sentiment Guided Graph Attention Network for Rumour DetectionMain1 citations
  918. Clarifying Completions: Evaluating How LLMs Respond to Incomplete QuestionsMain1 citations
  919. Class-Incremental Few-Shot Event DetectionMain1 citations
  920. Collecting and Analyzing Dialogues in a Tagline Co-Writing TaskMain1 citations
  921. Comparative Analysis of Sign Language Interpreting Agents Perception: A Study of the DeafMain1 citations
  922. Comparing Static and Contextual Distributional Semantic Models on Intrinsic Tasks: An Evaluation on Mandarin Chinese DatasetsMain1 citations
  923. Comparison of Conventional Hybrid and CTC/Attention Decoders for Continuous Visual Speech RecognitionMain1 citations
  924. Comparison of the Intimacy Process between Real and Acting-based Long-term Text ChatsMain1 citations
  925. Constructing Indonesian-English Travelogue DatasetMain1 citations
  926. Context-Aware Non-Autoregressive Document-Level Translation with Sentence-Aligned Connectionist Temporal ClassificationMain1 citations
  927. Continual Reinforcement Learning for Controlled Text GenerationMain1 citations
  928. ControversialQA: Exploring Controversy in Question AnsweringMain1 citations
  929. Converting Legacy Data to CLDF: A FAIR Exit Strategy for Linguistic Web AppsMain1 citations
  930. CookingSense: A Culinary Knowledgebase with Multidisciplinary AssertionsMain1 citations
  931. Correcting Language Model Bias for Text Classification in True Zero-Shot LearningMain1 citations
  932. Cross-Lingual NLU: Mitigating Language-Specific Impact in Embeddings Leveraging Adversarial LearningMain1 citations
  933. Cross-Lingual Transfer Robustness to Lower-Resource Languages on Adversarial DatasetsMain1 citations
  934. Cross-lingual Named Entity Corpus for Slavic LanguagesMain1 citations
  935. Cross-lingual Transfer or Machine Translation? On Data Augmentation for Monolingual Semantic Textual SimilarityMain1 citations
  936. Curation of Benchmark Templates for Measuring Gender Bias in Named Entity Recognition ModelsMain1 citations
  937. DACL: Disfluency Augmented Curriculum Learning for Fluent Text GenerationMain1 citations
  938. DADIT: A Dataset for Demographic Classification of Italian Twitter Users and a Comparison of Prediction MethodsMain1 citations
  939. DANCER: Entity Description Augmented Named Entity Corrector for Automatic Speech RecognitionMain1 citations
  940. DGS-Fabeln-1: A Multi-Angle Parallel Corpus of Fairy Tales between German Sign Language and German TextMain1 citations
  941. DGoT: Dynamic Graph of Thoughts for Scientific Abstract GenerationMain1 citations
  942. Data Drift in Clinical Outcome Prediction from Admission NotesMain1 citations
  943. Data-Informed Global Sparseness in Attention Mechanisms for Deep Neural NetworksMain1 citations
  944. Debiasing Multi-Entity Aspect-Based Sentiment Analysis with Norm-Based Data AugmentationMain1 citations
  945. Deciphering Emotional Landscapes in the Iliad: A Novel French-Annotated Dataset for Emotion RecognitionMain1 citations
  946. Decompose, Prioritize, and Eliminate: Dynamically Integrating Diverse Representations for Multimodal Named Entity RecognitionMain1 citations
  947. Denoising Labeled Data for Comment Moderation Using Active LearningMain1 citations
  948. Dependencies over Times and Tools (DoTT)Main1 citations
  949. Depth Aware Hierarchical Replay Continual Learning for Knowledge Based Question AnsweringMain1 citations
  950. Detecting Conceptual Abstraction in LLMsMain1 citations
  951. Detecting Impact Relevant Sections in Scientific ResearchMain1 citations
  952. Detecting Sexual Content at the Sentence Level in First Millennium Latin TextsMain1 citations
  953. Dialogue Systems Can Generate Appropriate Responses without the Use of Question Marks?– a Study of the Effects of “?” for Spoken Dialogue Systems –Main1 citations
  954. Discriminative Language Model as Semantic Consistency Scorer for Prompt-based Few-Shot Text ClassificationMain1 citations
  955. Distractor Generation Using Generative and Discriminative Capabilities of Transformer-based ModelsMain1 citations
  956. DocScript: Document-level Script Event PredictionMain1 citations
  957. Document Set Expansion with Positive-Unlabeled Learning Using Intractable Density EstimationMain1 citations
  958. Does the Generator Mind Its Contexts? An Analysis of Generative Model Faithfulness under Context TransferMain1 citations
  959. DrBenchmark: A Large Language Understanding Evaluation Benchmark for French Biomedical DomainMain1 citations
  960. ELLEN: Extremely Lightly Supervised Learning for Efficient Named Entity RecognitionMain1 citations
  961. EMAD: A Bridge Tagset for Unifying Arabic POS AnnotationsMain1 citations
  962. EMOLIS App and Dataset to Find Emotionally Close CartoonsMain1 citations
  963. EROS:Entity-Driven Controlled Policy Document SummarizationMain1 citations
  964. Efficiency and Effectiveness in Task-Oriented Dialogue: On Construction Repetition, Information Rate, and Task SuccessMain1 citations
  965. Efficient and Accurate Contextual Re-Ranking for Knowledge Graph Question AnsweringMain1 citations
  966. Empowering Small-Scale Knowledge Graphs: A Strategy of Leveraging General-Purpose Knowledge Graphs for Enriched EmbeddingsMain1 citations
  967. Endowing Neural Language Learners with Human-like Biases: A Case Study on Dependency Length MinimizationMain1 citations
  968. Enhanced Coherence-Aware Network with Hierarchical Disentanglement for Aspect-Category Sentiment AnalysisMain1 citations
  969. Enhancing Emotion Prediction in News Headlines: Insights from ChatGPT and Seq2Seq Models for Free-Text GenerationMain1 citations
  970. Enhancing Few-Shot Topic Classification with Verbalizers. a Study on Automatic Verbalizer and Ensemble MethodsMain1 citations
  971. Enhancing Hindi Feature Representation through Fusion of Dual-Script Word EmbeddingsMain1 citations
  972. Enhancing Knowledge Retrieval with Topic Modeling for Knowledge-Grounded DialogueMain1 citations
  973. Enhancing Taiwanese Hokkien Dual Translation by Exploring and Standardizing of Four Writing SystemsMain1 citations
  974. Enriching Word Usage Graphs with Cluster DefinitionsMain1 citations
  975. Enriching a Time-Domain Astrophysics Corpus with Named Entity, Coreference and Astrophysical Relationship AnnotationsMain1 citations
  976. Esposito: An English-Persian Scientific Parallel Corpus for Machine TranslationMain1 citations
  977. Estimating the Causal Effects of Natural Logic Features in Transformer-Based NLI ModelsMain1 citations
  978. European Language Grid: One Year afterMain1 citations
  979. Evaluating Generative Language Models in Information Extraction as Subjective Question CorrectionMain1 citations
  980. Evaluating Performance of Pre-trained Word Embeddings on Assamese, a Low-resource LanguageMain1 citations
  981. Evaluating Saliency Explanations in NLP by CrowdsourcingMain1 citations
  982. Evaluating Shortest Edit Script Methods for Contextual LemmatizationMain1 citations
  983. Evaluating Webcam-based Gaze Data as an Alternative for Human Rationale AnnotationsMain1 citations
  984. Evaluating the Efficacy of Large Acoustic Model for Documenting Non-Orthographic Tribal Languages in IndiaMain1 citations
  985. Evaluating the IWSLT2023 Speech Translation Tasks: Human Annotations, Automatic Metrics, and SegmentationMain1 citations
  986. Event-enhanced Retrieval in Real-time SearchMain1 citations
  987. Experiments on Speech Synthesis for Teochew, Can Taiwanese Help ?Main1 citations
  988. Explainable Multi-hop Question Generation: An End-to-End Approach without Intermediate Question LabelingMain1 citations
  989. Exploring Neural Topic Modeling on a Classical Latin CorpusMain1 citations
  990. Exploring the Impact of Human Evaluator Group on Chat-Oriented Dialogue EvaluationMain1 citations
  991. Extending the Discourse Analysis Tool Suite with Whiteboards for Visual Qualitative AnalysisMain1 citations
  992. Extracting Financial Events from Raw Texts via Matrix ChunkingMain1 citations
  993. Fast Adaptation via Prompted Data: An Efficient Cross-Domain Fine-tuning Method for Large Language ModelsMain1 citations
  994. Few-Shot Multimodal Named Entity Recognition Based on Mutlimodal Causal Intervention GraphMain1 citations
  995. Few-shot Link Prediction on Hyper-relational FactsMain1 citations
  996. Few-shot Temporal Pruning Accelerates Diffusion Models for Text GenerationMain1 citations
  997. First Steps Towards the Integration of Resources on Historical Glossing Traditions in the History of Chinese: A Collection of Standardized Fǎnqiè Spellings from the GuǎngyùnMain1 citations
  998. From Linguistic Linked Data to Big DataMain1 citations
  999. From Text to Historical Ecological Knowledge: The Construction and Application of the Shan Jing Knowledge BaseMain1 citations
  1000. Fusion-in-T5: Unifying Variant Signals for Simple and Effective Document Ranking with Attention FusionMain1 citations

COLING accepted papers in other years

Looking for submission deadlines instead? See the conference deadline calendar.