← All conferences

COLING 2025 Accepted Papers

The full list of 848 papers accepted at COLING 2025 (International Conference on Computational Linguistics). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.

Main: 757Industry: 69System Demonstrations: 22
  1. Investigating the Factual Knowledge Boundary of Large Language Models with Retrieval AugmentationMain122 citations
  2. Style Over Substance: Evaluation Biases for Large Language ModelsMain72 citations
  3. InstructMol: Multi-Modal Integration for Building a Versatile and Reliable Molecular Assistant in Drug DiscoveryMain71 citations
  4. Cultural Alignment in Large Language Models: An Explanatory Analysis Based on Hofstede’s Cultural DimensionsMain63 citations
  5. MAC-SQL: A Multi-Agent Collaborative Framework for Text-to-SQLMain63 citations
  6. Intention Analysis Makes LLMs A Good Jailbreak DefenderMain58 citations
  7. MCS-SQL: Leveraging Multiple Prompts and Multiple-Choice Selection For Text-to-SQL GenerationMain42 citations
  8. LAiW: A Chinese Legal Large Language Models BenchmarkMain37 citations
  9. Investigating Bias in LLM-Based Bias Detection: Disparities between LLMs and Human PerceptionMain36 citations
  10. Exploring Concept Depth: How Large Language Models Acquire Knowledge and Concept at Different Layers?Main35 citations
  11. ToolEyes: Fine-Grained Evaluation for Tool Learning Capabilities of Large Language Models in Real-world ScenariosMain33 citations
  12. Efficient Tool Use with Chain-of-Abstraction ReasoningMain31 citations
  13. Rethinking Kullback-Leibler Divergence in Knowledge Distillation for Large Language ModelsMain30 citations
  14. ProSparse: Introducing and Enhancing Intrinsic Activation Sparsity within Large Language ModelsMain29 citations
  15. Scaffolding Coordinates to Promote Vision-Language Coordination in Large Multi-Modal ModelsMain29 citations
  16. sDPO: Don’t Use Your Data All at OnceIndustry27 citations
  17. What Makes for Good Visual Instructions? Synthesizing Complex Visual Reasoning Instructions for Visual Instruction TuningMain24 citations
  18. AI Hospital: Benchmarking Large Language Models in a Multi-agent Medical Interaction SimulatorMain23 citations
  19. Beyond Chain-of-Thought: A Survey of Chain-of-X Paradigms for LLMsMain22 citations
  20. ChatCite: LLM Agent with Human Workflow Guidance for Comparative Literature SummaryMain22 citations
  21. LoRA-drop: Efficient LoRA Parameter Pruning based on Output EvaluationMain20 citations
  22. ChartGemma: Visual Instruction-tuning for Chart Reasoning in the WildIndustry19 citations
  23. LLM-Personalize: Aligning LLM Planners with Human Preferences via Reinforced Self-Training for Housekeeping RobotsMain18 citations
  24. Persona-DB: Efficient Large Language Model Personalization for Response Prediction with Collaborative Data RefinementMain17 citations
  25. RichRAG: Crafting Rich Responses for Multi-faceted Queries in Retrieval-Augmented GenerationMain17 citations
  26. Benchmark Self-Evolving: A Multi-Agent Framework for Dynamic LLM EvaluationMain16 citations
  27. Less is More: A Simple yet Effective Token Reduction Method for Efficient Multi-modal LLMsMain15 citations
  28. Compress to Impress: Unleashing the Potential of Compressive Memory in Real-World Long-Term ConversationsMain14 citations
  29. Aligning LLMs with Individual Preferences via InteractionMain13 citations
  30. Does RAG Introduce Unfairness in LLMs? Evaluating Fairness in Retrieval-Augmented Generation SystemsMain13 citations
  31. Query-LIFE: Query-aware Language Image Fusion Embedding for E-Commerce RelevanceIndustry13 citations
  32. CMMaTH: A Chinese Multi-modal Math Skill Evaluation Benchmark for Foundation ModelsMain12 citations
  33. Let LLMs Take on the Latest Challenges! A Chinese Dynamic Question Answering BenchmarkMain12 citations
  34. MLaKE: Multilingual Knowledge Editing Benchmark for Large Language ModelsMain12 citations
  35. Mix-of-Granularity: Optimize the Chunking Granularity for Retrieval-Augmented GenerationMain12 citations
  36. PERSONA: A Reproducible Testbed for Pluralistic AlignmentMain12 citations
  37. Automated Clinical Data Extraction with Knowledge Conditioned LLMsIndustry11 citations
  38. CodeJudge-Eval: Can Large Language Models be Good Judges in Code Understanding?Main11 citations
  39. Exploring Backdoor Vulnerabilities of Chat ModelsMain11 citations
  40. FedMKT: Federated Mutual Knowledge Transfer for Large and Small Language ModelsMain11 citations
  41. LLMs Know What They Need: Leveraging a Missing Information Guided Framework to Empower Retrieval-Augmented GenerationMain11 citations
  42. SyntheT2C: Generating Synthetic Data for Fine-Tuning Large Language Models on the Text2Cypher TaskMain11 citations
  43. Why do language models perform worse for morphologically complex languages?Main11 citations
  44. ColBERT-XM: A Modular Multi-Vector Representation Model for Zero-Shot Multilingual Information RetrievalMain10 citations
  45. Counting-Stars: A Multi-evidence, Position-aware, and Scalable Benchmark for Evaluating Long-Context Large Language ModelsMain10 citations
  46. SKIntern: Internalizing Symbolic Knowledge for Distilling Better CoT Capabilities into Small Language ModelsMain10 citations
  47. Towards Consistent Natural-Language Explanations via Explanation-Consistency FinetuningMain10 citations
  48. A Review of Prominent Paradigms for LLM-Based Agents: Tool Use, Planning (Including RAG), and Feedback LearningMain9 citations
  49. Decoding Echo Chambers: LLM-Powered Simulations Revealing Polarization in Social NetworksMain9 citations
  50. Learning to Refuse: Towards Mitigating Privacy Risks in LLMsMain9 citations
  51. Look, Compare, Decide: Alleviating Hallucination in Large Vision-Language Models via Multi-View Multi-Path ReasoningMain9 citations
  52. Match, Compare, or Select? An Investigation of Large Language Models for Entity MatchingMain9 citations
  53. Taxonomy-Guided Zero-Shot Recommendations with LLMsMain9 citations
  54. medIKAL: Integrating Knowledge Graphs as Assistants of LLMs for Enhanced Clinical Diagnosis on EMRsMain9 citations
  55. Counterfactual Debating with Preset Stances for Hallucination Elimination of LLMsMain8 citations
  56. Edge-free but Structure-aware: Prototype-Guided Knowledge Distillation from GNNs to MLPsMain8 citations
  57. Efficient Solutions For An Intriguing Failure of LLMs: Long Context Window Does Not Mean LLMs Can Analyze Long Sequences FlawlesslyMain8 citations
  58. GraCoRe: Benchmarking Graph Comprehension and Complex Reasoning in Large Language ModelsMain8 citations
  59. HGCLIP: Exploring Vision-Language Models with Graph Representations for Hierarchical UnderstandingMain8 citations
  60. Making Large Language Models into World Models with Precondition and Effect KnowledgeMain8 citations
  61. AraDiCE: Benchmarks for Dialectal and Cultural Capabilities in LLMsMain7 citations
  62. Can Large Language Models perform Relation-based Argument Mining?Main7 citations
  63. Chain-of-Discussion: A Multi-Model Framework for Complex Evidence-Based Question AnsweringMain7 citations
  64. Do Large Language Models Mirror Cognitive Language Processing?Main7 citations
  65. Evaluating the Capabilities of Large Language Models for Multi-label Emotion UnderstandingMain7 citations
  66. Evaluating the Consistency of LLM EvaluatorsMain7 citations
  67. LLaMA-E: Empowering E-commerce Authoring with Object-Interleaved Instruction FollowingMain7 citations
  68. ManiTweet: A New Benchmark for Identifying Manipulation of News on Social MediaMain7 citations
  69. PreAct: Prediction Enhances Agent’s Planning AbilityMain7 citations
  70. Small Language Models can Outperform Humans in Short Creative Writing: A Study Comparing SLMs with Humans and LLMsMain7 citations
  71. Understanding the RoPE Extensions of Long-Context LLMs: An Attention PerspectiveMain7 citations
  72. What’s Wrong? Refining Meeting Summaries with LLM FeedbackMain7 citations
  73. AI-Press: A Multi-Agent News Generating and Feedback Simulation System Powered by Large Language ModelsSystem Demonstrations6 citations
  74. AsymKV: Enabling 1-Bit Quantization of KV Cache with Layer-Wise Asymmetric Quantization ConfigurationsMain6 citations
  75. Interaction Matters: An Evaluation Framework for Interactive Dialogue Assessment on English Second Language ConversationsMain6 citations
  76. Language Models Encode the Value of Numbers LinearlyMain6 citations
  77. LoRA Soups: Merging LoRAs for Practical Skill Composition TasksIndustry6 citations
  78. MBA-RAG: a Bandit Approach for Adaptive Retrieval-Augmented Generation through Question ComplexityMain6 citations
  79. Multilingual Knowledge Editing with Language-Agnostic Factual NeuronsMain6 citations
  80. Noise-powered Multi-modal Knowledge Graph Representation FrameworkMain6 citations
  81. QuickLLaMA: Query-aware Inference Acceleration for Large Language ModelsMain6 citations
  82. Alternate Preference Optimization for Unlearning Factual Knowledge in Large Language ModelsMain5 citations
  83. AraTrust: An Evaluation of Trustworthiness for LLMs in ArabicMain5 citations
  84. CONTRANS: Weak-to-Strong Alignment Engineering via Concept TransplantationMain5 citations
  85. Con-ReCall: Detecting Pre-training Data in LLMs via Contrastive DecodingMain5 citations
  86. Entropy Guided Extrapolative Decoding to Improve Factuality in Large Language ModelsMain5 citations
  87. Evolver: Chain-of-Evolution Prompting to Boost Large Multimodal Models for Hateful Meme DetectionMain5 citations
  88. Factual Dialogue Summarization via Learning from Large Language ModelsMain5 citations
  89. From Facts to Insights: A Study on the Generation and Evaluation of Analytical Reports for Deciphering Earnings CallsMain5 citations
  90. Get Confused Cautiously: Textual Sequence Memorization Erasure with Selective Entropy MaximizationMain5 citations
  91. How Likely Do LLMs with CoT Mimic Human Reasoning?Main5 citations
  92. How Well Can a Long Sequence Model Model Long Sequences? Comparing Architectural Inductive Biases on Long-Context AbilitiesMain5 citations
  93. Idea23D: Collaborative LMM Agents Enable 3D Model Generation from Interleaved Multimodal InputsMain5 citations
  94. InternLM-Law: An Open-Sourced Chinese Legal Large Language ModelMain5 citations
  95. JMedBench: A Benchmark for Evaluating Japanese Biomedical Large Language ModelsMain5 citations
  96. Let’s Focus on Neuron: Neuron-Level Supervised Fine-tuning for Large Language ModelMain5 citations
  97. Physics Reasoner: Knowledge-Augmented Reasoning for Solving Physics Problems with Large Language ModelsMain5 citations
  98. Revisiting Jailbreaking for Large Language Models: A Representation Engineering PerspectiveMain5 citations
  99. The Dark Side of Function Calling: Pathways to Jailbreaking Large Language ModelsMain5 citations
  100. Towards Data Contamination Detection for Modern Large Language Models: Limitations, Inconsistencies, and Oracle ChallengesMain5 citations
  101. Towards Understanding Multi-Task Learning (Generalization) of LLMs via Detecting and Exploring Task-Specific NeuronsMain5 citations
  102. Unveiling Language Competence Neurons: A Psycholinguistic Approach to Model InterpretabilityMain5 citations
  103. VisualRWKV: Exploring Recurrent Neural Networks for Visual Language ModelsMain5 citations
  104. Who Wrote This? The Key to Zero-Shot LLM-Generated Text Detection Is GECScoreMain5 citations
  105. AgriCLIP: Adapting CLIP for Agriculture and Livestock via Domain-Specialized Cross-Model AlignmentMain4 citations
  106. Automated Progressive Red TeamingMain4 citations
  107. Beyond Boundaries: Learning a Universal Entity Taxonomy across Datasets and Languages for Open Named Entity RecognitionMain4 citations
  108. Converging to a Lingua Franca: Evolution of Linguistic Regions and Semantics Alignment in Multilingual Large Language ModelsMain4 citations
  109. Decoding Decoded: Understanding Hyperparameter Effects in Open-Ended Text GenerationMain4 citations
  110. Detecting Conversational Mental Manipulation with Intent-Aware PromptingMain4 citations
  111. DnA-Eval: Enhancing Large Language Model Evaluation through Decomposition and AggregationMain4 citations
  112. Do LLMs Know When to NOT Answer? Investigating Abstention Abilities of Large Language ModelsMain4 citations
  113. EffiQA: Efficient Question-Answering with Strategic Multi-Model Collaboration on Knowledge GraphsMain4 citations
  114. Enhancing Retrieval-Augmented Generation: A Study of Best PracticesMain4 citations
  115. Grading Massive Open Online Courses Using Large Language ModelsMain4 citations
  116. LAW: Legal Agentic Workflows for Custody and Fund Services ContractsIndustry4 citations
  117. LLMs May Perform MCQA by Selecting the Least Incorrect OptionMain4 citations
  118. Linear Recency Bias During Training Improves Transformers’ Fit to Reading TimesMain4 citations
  119. Linguistic Minimal Pairs Elicit Linguistic Similarity in Large Language ModelsMain4 citations
  120. MuRAR: A Simple and Effective Multimodal Retrieval and Answer Refinement Framework for Multimodal Question AnsweringSystem Demonstrations4 citations
  121. Multimodal Fact-Checking with Vision Language Models: A Probing Classifier based Solution with Embedding StrategiesMain4 citations
  122. PropaInsight: Toward Deeper Understanding of Propaganda in Terms of Techniques, Appeals, and IntentMain4 citations
  123. Propulsion: Steering LLM with Tiny Fine-TuningMain4 citations
  124. RISCORE: Enhancing In-Context Riddle Solving in Language Models through Context-Reconstructed Example AugmentationMain4 citations
  125. SEED: Accelerating Reasoning Tree Construction via Scheduled Speculative DecodingMain4 citations
  126. Small Language Models Also Work With Small Vocabularies: Probing the Linguistic Abilities of Grapheme- and Phoneme-Based Baby LlamasMain4 citations
  127. SweetieChat: A Strategy-Enhanced Role-playing Framework for Diverse Scenarios Handling Emotional Support AgentMain4 citations
  128. Towards Boosting LLMs-driven Relevance Modeling with Progressive Retrieved Behavior-augmented PromptingIndustry4 citations
  129. Unifying Dual-Space Embedding for Entity Alignment via Contrastive LearningMain4 citations
  130. WER We Stand: Benchmarking Urdu ASR ModelsMain4 citations
  131. A Compressive Memory-based Retrieval Approach for Event Argument ExtractionMain3 citations
  132. ALIS: Aligned LLM Instruction Security Strategy for Unsafe Input PromptMain3 citations
  133. ALYMPICS: LLM Agents Meet Game TheoryMain3 citations
  134. AdaCQR: Enhancing Query Reformulation for Conversational Search via Sparse and Dense Retrieval AlignmentMain3 citations
  135. Assessing the Human Likeness of AI-Generated CounterspeechMain3 citations
  136. Awakening Augmented Generation: Learning to Awaken Internal Knowledge of Large Language Models for Question AnsweringMain3 citations
  137. BANER: Boundary-Aware LLMs for Few-Shot Named Entity RecognitionMain3 citations
  138. BackMATH: Towards Backward Reasoning for Solving Math Problems Step by StepIndustry3 citations
  139. BiLD: Bi-directional Logits Difference Loss for Large Language Model DistillationMain3 citations
  140. Boosting the Capabilities of Compact Models in Low-Data Contexts with Large Language Models and Retrieval-Augmented GenerationMain3 citations
  141. Breaking the Stage Barrier: A Novel Single-Stage Approach to Long Context Extension for Large Language ModelsMain3 citations
  142. CFSP: An Efficient Structured Pruning Framework for LLMs with Coarse-to-Fine Activation InformationMain3 citations
  143. Can Many-Shot In-Context Learning Help LLMs as Evaluators? A Preliminary Empirical StudyMain3 citations
  144. Charting the Future: Using Chart Question-Answering for Scalable Evaluation of LLM-Driven Data VisualizationsMain3 citations
  145. Collaborative Document Simplification Using Multi-Agent SystemsMain3 citations
  146. Cross-lingual Evaluation of Multilingual Text GenerationMain3 citations
  147. Debate-to-Write: A Persona-Driven Multi-Agent Framework for Diverse Argument GenerationMain3 citations
  148. Distance-Adaptive Quaternion Knowledge Graph Embedding with Bidirectional RotationMain3 citations
  149. Dynamic Graph Neural ODE Network for Multi-modal Emotion Recognition in ConversationMain3 citations
  150. Explaining Relationships Among Research PapersMain3 citations
  151. Exploiting the Index Gradients for Optimization-Based Jailbreaking on Large Language ModelsMain3 citations
  152. FS-DAG: Few Shot Domain Adapting Graph Networks for Visually Rich Document UnderstandingIndustry3 citations
  153. Federated Retrieval Augmented Generation for Multi-Product Question AnsweringIndustry3 citations
  154. Filter-then-Generate: Large Language Models with Structure-Text Adapter for Knowledge Graph CompletionMain3 citations
  155. Fine-tuning Large Language Models for Improving Factuality in Legal Question AnsweringMain3 citations
  156. FineRAG: Fine-grained Retrieval-Augmented Text-to-Image GenerationMain3 citations
  157. From Generalist to Specialist: A Survey of Large Language Models for ChemistryMain3 citations
  158. From Prejudice to Parity: A New Approach to Debiasing Large Language Model Word EmbeddingsMain3 citations
  159. GraphOTTER: Evolving LLM-based Graph Reasoning for Complex Table Question AnsweringMain3 citations
  160. How Transliterations Improve Crosslingual AlignmentMain3 citations
  161. Interactive Evaluation for Medical LLMs via Task-oriented Dialogue SystemMain3 citations
  162. Is Parameter Collision Hindering Continual Learning in LLMs?Main3 citations
  163. KG-FPQ: Evaluating Factuality Hallucination in LLMs with Knowledge Graph-based False Premise QuestionsMain3 citations
  164. KIA: Knowledge-Guided Implicit Vision-Language Alignment for Chest X-Ray Report GenerationMain3 citations
  165. Large Language Models are good multi-lingual learners : When LLMs meet cross-lingual promptsMain3 citations
  166. Leveraging Taxonomy and LLMs for Improved Multimodal Hierarchical ClassificationMain3 citations
  167. Lightweight Safety Guardrails Using Fine-tuned BERT EmbeddingsIndustry3 citations
  168. Luna: A Lightweight Evaluation Model to Catch Language Model Hallucinations with High Accuracy and Low CostIndustry3 citations
  169. META-LORA: Memory-Efficient Sample Reweighting for Fine-Tuning Large Language ModelsMain3 citations
  170. MOPO: Multi-Objective Prompt Optimization for Affective Text GenerationMain3 citations
  171. MQA-KEAL: Multi-hop Question Answering under Knowledge Editing for Arabic LanguageMain3 citations
  172. MURRE: Multi-Hop Table Retrieval with Removal for Open-Domain Text-to-SQLMain3 citations
  173. Multilingual and Explainable Text Detoxification with Parallel CorporaMain3 citations
  174. No Train but Gain: Language Arithmetic for training-free Language Adapters enhancementMain3 citations
  175. PMSS: Pretrained Matrices Skeleton Selection for LLM Fine-tuningMain3 citations
  176. Personalized Large Language Model Assistant with Evolving Conditional MemoryMain3 citations
  177. RAIDEN Benchmark: Evaluating Role-playing Conversational Agents with Measurement-Driven Custom DialoguesMain3 citations
  178. Revisiting Cosine Similarity via Normalized ICA-transformed EmbeddingsMain3 citations
  179. RoleBreak: Character Hallucination as a Jailbreak Attack in Role-Playing SystemsMain3 citations
  180. Scalability of Bayesian Network Structure Elicitation with Large Language Models: a Novel Methodology and Comparative AnalysisMain3 citations
  181. SelfPrompt: Autonomously Evaluating LLM Robustness via Domain-Constrained Knowledge Guidelines and Refined Adversarial PromptsMain3 citations
  182. StoryLLaVA: Enhancing Visual Storytelling with Multi-Modal Large Language ModelsMain3 citations
  183. TOOL-ED: Enhancing Empathetic Response Generation with the Tool Calling Capability of LLMMain3 citations
  184. Too Late to Train, Too Early To Use? A Study on Necessity and Viability of Low-Resource Bengali LLMsMain3 citations
  185. TransMI: A Framework to Create Strong Baselines from Multilingual Pretrained Language Models for Transliterated DataMain3 citations
  186. Zero-to-Strong Generalization: Eliciting Strong Capabilities of Large Language Models Iteratively without Gold LabelsMain3 citations
  187. “Not Aligned” is Not “Malicious”: Being Careful about Hallucinations of Large Language Models’ JailbreakMain3 citations
  188. A Novel Negative Sample Generation Method for Contrastive Learning in Hierarchical Text ClassificationMain2 citations
  189. AIGT: AI Generative Table Based on PromptMain2 citations
  190. Acquired TASTE: Multimodal Stance Detection with Textual and Structural EmbeddingsMain2 citations
  191. An Automatic Method to Estimate Correctness of RAGIndustry2 citations
  192. Aurora-M: Open Source Continual Pre-training for Multilingual Language and CodeIndustry2 citations
  193. Automatic Multiple-Choice Question Generation and Evaluation Systems Based on LLM: A Study Case With University ResolutionsMain2 citations
  194. BeefBot: Harnessing Advanced LLM and RAG Techniques for Providing Scientific and Technology Solutions to Beef ProducersSystem Demonstrations2 citations
  195. Beyond Surprisal: A Dual Metric Framework for Lexical Skill Acquisition in LLMsMain2 citations
  196. Bias Vector: Mitigating Biases in Language Models with Task Arithmetic ApproachMain2 citations
  197. CULTURALLY YOURS: A Reading Assistant for Cross-Cultural ContentSystem Demonstrations2 citations
  198. Can Large Language Models Serve as Effective Classifiers for Hierarchical Multi-Label Classification of Scientific Documents at Industrial Scale?Industry2 citations
  199. Can Large Language Models Understand You Better? An MBTI Personality Detection Dataset Aligned with Population TraitsMain2 citations
  200. Case2Code: Scalable Synthetic Data for Code GenerationMain2 citations
  201. CmEAA: Cross-modal Enhancement and Alignment Adapter for Radiology Report GenerationMain2 citations
  202. CoMIF: Modeling of Complex Multiple Interaction Factors for Conversation GenerationMain2 citations
  203. Cognitive Biases, Task Complexity, and Result Intepretability in Large Language ModelsMain2 citations
  204. Controlling Out-of-Domain Gaps in LLMs for Genre Classification and Generated Text DetectionMain2 citations
  205. Cross-Dialect Information Retrieval: Information Access in Low-Resource and High-Variance LanguagesMain2 citations
  206. Decompose-ToM: Enhancing Theory of Mind Reasoning in Large Language Models through Simulation and Task DecompositionMain2 citations
  207. Development of Numerical Error Detection Tasks to Analyze the Numerical Capabilities of Language ModelsMain2 citations
  208. DiffStyleTTS: Diffusion-based Hierarchical Prosody Modeling for Text-to-Speech with Diverse and Controllable StylesMain2 citations
  209. Do LLMs Play Dice? Exploring Probability Distribution Sampling in Large Language Models for Behavioral SimulationMain2 citations
  210. DynRank: Improve Passage Retrieval with Dynamic Zero-Shot Prompting Based on Question ClassificationMain2 citations
  211. ELITR-Bench: A Meeting Assistant Benchmark for Long-Context Language ModelsMain2 citations
  212. Egalitarian Language Representation in Language Models: It All Begins with TokenizersMain2 citations
  213. Enhancing Knowledge Distillation of Large Language Models through Efficient Multi-Modal Distribution AlignmentMain2 citations
  214. Enhancing Large Language Models for Scientific Multimodal Summarization with Multimodal OutputIndustry2 citations
  215. Enhancing Long-range Dependency with State Space Model and Kolmogorov-Arnold Networks for Aspect-based Sentiment AnalysisMain2 citations
  216. Enhancing Nursing and Elderly Care with Large Language Models: An AI-Driven FrameworkMain2 citations
  217. Enhancing Reranking for Recommendation with LLMs through User Preference RetrievalMain2 citations
  218. Enhancing Talk Moves Analysis in Mathematics Tutoring through Classroom Teaching DiscourseMain2 citations
  219. Enhancing the Reasoning Capabilities of Small Language Models via Solution Guidance Fine-TuningMain2 citations
  220. Exploring Language Model Generalization in Low-Resource Extractive QAMain2 citations
  221. Exploring the Limitations of Detecting Machine-Generated TextMain2 citations
  222. FIPO: Free-form Instruction-oriented Prompt Optimization with Preference Dataset and Modular Fine-tuning SchemaMain2 citations
  223. FinDABench: Benchmarking Financial Data Analysis Ability of Large Language ModelsMain2 citations
  224. From Chaotic OCR Words to Coherent Document: A Fine-to-Coarse Zoom-Out Network for Complex-Layout Document Image TranslationMain2 citations
  225. From Superficial to Deep: Integrating External Knowledge for Follow-up Question Generation Using Knowledge Graph and LLMMain2 citations
  226. From Traits to Empathy: Personality-Aware Multimodal Empathetic Response GenerationMain2 citations
  227. GAProtoNet: A Multi-head Graph Attention-based Prototypical Network for Interpretable Text ClassificationMain2 citations
  228. Gracefully Filtering Backdoor Samples for Generative Large Language Models without RetrainingMain2 citations
  229. GroUSE: A Benchmark to Evaluate Evaluators in Grounded Question AnsweringMain2 citations
  230. Hire Me or Not? Examining Language Model’s Behavior with Occupation AttributesMain2 citations
  231. Hit the Sweet Spot! Span-Level Ensemble for Large Language ModelsMain2 citations
  232. IberoBench: A Benchmark for LLM Evaluation in Iberian LanguagesMain2 citations
  233. Implicit Discourse Relation Classification For Nigerian PidginMain2 citations
  234. Imposter: Text and Frequency Guidance for Subject Driven Action Personalization using Diffusion ModelsMain2 citations
  235. Improving Automatic Grammatical Error Annotation for Chinese Through Linguistically-Informed Error TypologyMain2 citations
  236. Improving Multilingual Sign Language Translation with Automatically Clustered Language Family InformationMain2 citations
  237. Know Your RAG: Dataset Taxonomy and Generation Strategies for Evaluating RAG SystemsIndustry2 citations
  238. LLM-Friendly Knowledge Representation for Customer SupportIndustry2 citations
  239. LLMTreeRec: Unleashing the Power of Large Language Models for Cold-Start RecommendationsMain2 citations
  240. LOLA – An Open-Source Massively Multilingual Large Language ModelMain2 citations
  241. Large Language Models as an Indirect Reasoner: Contrapositive and Contradiction for Automated ReasoningMain2 citations
  242. Learning to Reason via Self-Iterative Process Feedback for Small Language ModelsMain2 citations
  243. Lexicography Saves Lives (LSL): Automatically Translating Suicide-Related LanguageMain2 citations
  244. Loki: An Open-Source Tool for Fact VerificationSystem Demonstrations2 citations
  245. LuxEmbedder: A Cross-Lingual Approach to Enhanced Luxembourgish Sentence EmbeddingsMain2 citations
  246. MIDLM: Multi-Intent Detection with Bidirectional Large Language ModelsMain2 citations
  247. Mitigating Language Confusion through Inference-time InterventionMain2 citations
  248. Mitigating Out-of-Entity Errors in Named Entity Recognition: A Sentence-Level StrategyMain2 citations
  249. MoSLD: An Extremely Parameter-Efficient Mixture-of-Shared LoRAs for Multi-Task LearningMain2 citations
  250. ModaFact: Multi-paradigm Evaluation for Joint Event Modality and Factuality DetectionMain2 citations
  251. Modal Feature Optimization Network with Prompt for Multimodal Sentiment AnalysisMain2 citations
  252. Montague semantics and modifier consistency measurement in neural language modelsMain2 citations
  253. Multimodal Aspect-Based Sentiment Analysis under Conditional RelationMain2 citations
  254. Multitask-Bench: Unveiling and Mitigating Safety Gaps in LLMs Fine-tuningMain2 citations
  255. NesTools: A Dataset for Evaluating Nested Tool Learning Abilities of Large Language ModelsMain2 citations
  256. NüshuRescue: Reviving the Endangered Nüshu Language with AIMain2 citations
  257. On Evaluation Protocols for Data Augmentation in a Limited Data ScenarioMain2 citations
  258. On the Effects of Fine-tuning Language Models for Text-Based Reinforcement LearningMain2 citations
  259. PARAPHRASUS: A Comprehensive Benchmark for Evaluating Paraphrase Detection ModelsMain2 citations
  260. Parameter-Efficient Fine-Tuning of Large Language Models via Deconvolution in SubspaceMain2 citations
  261. Persona-Consistent Dialogue Generation via Pseudo Preference TuningMain2 citations
  262. Piecing It All Together: Verifying Multi-Hop Multimodal ClaimsMain2 citations
  263. Prompting Large Language Models to Tackle the Full Software Development Lifecycle: A Case StudyMain2 citations
  264. RE-FIN: Retrieval-based Enrichment for Financial dataIndustry2 citations
  265. REVerSum: A Multi-staged Retrieval-Augmented Generation Method to Enhance Wikipedia Tail Biographies through Personal NarrativesIndustry2 citations
  266. Read Before Grounding: Scene Knowledge Visual Grounding via Multi-step ParsingMain2 citations
  267. RealSafe: Quantifying Safety Risks of Language Agents in Real-WorldMain2 citations
  268. Rethinking the Alignment of Psychotherapy Dialogue Generation with Motivational Interviewing StrategiesMain2 citations
  269. Retrieval Augmented Instruction Tuning for Open NER with Large Language ModelsMain2 citations
  270. SAGED: A Holistic Bias-Benchmarking Pipeline for Language Models with Customisable Fairness CalibrationMain2 citations
  271. SUMIE: A Synthetic Benchmark for Incremental Entity SummarizationMain2 citations
  272. Solid-SQL: Enhanced Schema-linking based In-context Learning for Robust Text-to-SQLMain2 citations
  273. T-MES: Trait-Aware Mix-of-Experts Representation Learning for Multi-trait Essay ScoringMain2 citations
  274. TEXT-CAKE: Challenging Language Models on Local Text CoherenceMain2 citations
  275. To Label or Not to Label: Hybrid Active Learning for Neural Machine TranslationMain2 citations
  276. Towards Real-World Rumor Detection: Anomaly Detection Framework with Graph Supervised Contrastive LearningMain2 citations
  277. Understanding Token Probability Encoding in Output EmbeddingsMain2 citations
  278. Unveiling Uncertainty: A Deep Dive into Calibration and Performance of Multimodal Large Language ModelsMain2 citations
  279. VeritasQA: A Truthfulness Benchmark Aimed at Multilingual TransferabilityMain2 citations
  280. WIKIGENBENCH:Exploring Full-length Wikipedia Generation under Real-World ScenarioMain2 citations
  281. Why Does ChatGPT “Delve” So Much? Exploring the Sources of Lexical Overrepresentation in Large Language ModelsMain2 citations
  282. A Context-Aware Approach for Enhancing Data Imputation with Pre-trained Language ModelsMain1 citations
  283. A Dual Contrastive Learning Framework for Enhanced Multimodal Conversational Emotion RecognitionMain1 citations
  284. A Flash in the Pan: Better Prompting Strategies to Deploy Out-of-the-Box LLMs as Conversational Recommendation SystemsMain1 citations
  285. A Framework for Effective Invocation Methods of Various LLM ServicesMain1 citations
  286. A Survey of Code-switched Arabic NLP: Progress, Challenges, and Future DirectionsMain1 citations
  287. A Survey of Generative Information ExtractionMain1 citations
  288. ADAPTIVE IE: Investigating the Complementarity of Human-AI Collaboration to Adaptively Extract Information on-the-flyMain1 citations
  289. AIDER: a Robust and Topic-Independent Framework for Detecting AI-Generated TextMain1 citations
  290. Aligning Large Language Models with Human Opinions through Persona Selection and Value–Belief–Norm ReasoningMain1 citations
  291. Aligning Retrieval with Reader Needs: Reader-Centered Passage Selection for Open-Domain Question AnsweringMain1 citations
  292. An Active Learning Framework for Inclusive Generation by Large Language ModelsMain1 citations
  293. An Efficient Retrieval-Based Method for Tabular Prediction with LLMMain1 citations
  294. An LLM-based Framework for Biomedical Terminology Normalization in Social Media via Multi-Agent CollaborationMain1 citations
  295. Analysing Zero-Shot Readability-Controlled Sentence SimplificationMain1 citations
  296. Analyzing the Attention Heads for Pronoun Disambiguation in Context-aware Machine Translation ModelsMain1 citations
  297. AutoProteinEngine: A Large Language Model Driven Agent Framework for Multimodal AutoML in Protein EngineeringIndustry1 citations
  298. Automatic Extraction of Metaphoric Analogies from Literary Texts: Task Formulation, Dataset Construction, and EvaluationMain1 citations
  299. BERT-based Classical Arabic Poetry Authorship AttributionMain1 citations
  300. Beyond Film Subtitles: Is YouTube the Best Approximation of Spoken Vocabulary?Main1 citations
  301. Biases in Large Language Model-Elicited Text: A Case Study in Natural Language InferenceMain1 citations
  302. Bilingual Evaluation of Language Models on General Knowledge in University Entrance Exams with Minimal ContaminationMain1 citations
  303. Building a Family of Data Augmentation Models for Low-cost LLM Fine-tuning on the CloudIndustry1 citations
  304. CAST: Cross-modal Alignment Similarity Test for Vision Language ModelsMain1 citations
  305. Can LLMs Help Create Grammar?: Automating Grammar Creation for Endangered Languages with In-Context LearningMain1 citations
  306. Can Large Language Models Differentiate Harmful from Argumentative Essays? Steps Toward Ethical Essay ScoringMain1 citations
  307. Can Model Uncertainty Function as a Proxy for Multiple-Choice Question Item Difficulty?Main1 citations
  308. Can We Afford The Perfect Prompt? Balancing Cost and Accuracy with the Economical Prompting IndexMain1 citations
  309. CarMem: Enhancing Long-Term Memory in LLM Voice Assistants through Category-BoundingIndustry1 citations
  310. CausalScore: An Automatic Reference-Free Metric for Assessing Response Relevance in Open-Domain Dialogue SystemsMain1 citations
  311. Chain-of-Specificity: Enhancing Task-Specific Constraint Adherence in Large Language ModelsMain1 citations
  312. Citation Amnesia: On The Recency Bias of NLP and Other Academic FieldsMain1 citations
  313. CoPrUS: Consistency Preserving Utterance Synthesis towards more realistic benchmark dialoguesMain1 citations
  314. CoSTA: Code-Switched Speech Translation using Aligned Speech-Text InterleavingMain1 citations
  315. Comparative Study of Multilingual Idioms and Similes in Large Language ModelsMain1 citations
  316. Confront Insider Threat: Precise Anomaly Detection in Behavior Logs Based on LLM Fine-TuningMain1 citations
  317. Context-Informed Machine Translation of Manga using Multimodal Large Language ModelsMain1 citations
  318. Continual Learning Using Only Large Language Model PromptingMain1 citations
  319. Cross-Refine: Improving Natural Language Explanation Generation by Learning in TandemMain1 citations
  320. DEGAP: Dual Event-Guided Adaptive Prefixes for Templated-Based Event Argument Extraction with Slot QueryingMain1 citations
  321. Data Augmentation for Cross-domain Parsing via Lightweight LLM Generation and Tree HybridizationMain1 citations
  322. Data Quality Enhancement on the Basis of Diversity with Large Language Models for Text Classification: Uncovered, Difficult, and NoisyMain1 citations
  323. DeTriever: Decoder-representation-based Retriever for Improving NL2SQL In-Context LearningMain1 citations
  324. DefVerify: Do Hate Speech Models Reflect Their Dataset’s Definition?Main1 citations
  325. Detecting Emotional Incongruity of Sarcasm by Commonsense ReasoningMain1 citations
  326. Dialectal and Low Resource Machine Translation for AromanianMain1 citations
  327. Discarding the Crutches: Adaptive Parameter-Efficient Expert Meta-Learning for Continual Semantic ParsingMain1 citations
  328. Distilling Rule-based Knowledge into Large Language ModelsMain1 citations
  329. Do Current Video LLMs Have Strong OCR Abilities? A Preliminary StudyMain1 citations
  330. Dr.ECI: Infusing Large Language Models with Causal Knowledge for Decomposed Reasoning in Event Causality IdentificationMain1 citations
  331. Dynamic-prototype Contrastive Fine-tuning for Continual Few-shot Relation Extraction with Unseen Relation DetectionMain1 citations
  332. E-Bench: Towards Evaluating the Ease-of-Use of Large Language ModelsMain1 citations
  333. Efficient Data Labeling by Hierarchical Crowdsourcing with Large Language ModelsMain1 citations
  334. Embedding-Informed Adaptive Retrieval-Augmented Generation of Large Language ModelsMain1 citations
  335. Engagement-driven Persona Prompting for Rewriting News TweetsMain1 citations
  336. Enhancing Arabic NLP Tasks through Character-Level Models and Data AugmentationMain1 citations
  337. Enhancing Discourse Parsing for Local Structures from Social Media with LLM-Generated DataMain1 citations
  338. Enhancing Factual Consistency in Text Summarization via Counterfactual DebiasingMain1 citations
  339. Enhancing Multi-party Dialogue Discourse Parsing with Explanation GenerationMain1 citations
  340. Enhancing multi-modal Relation Extraction with Reinforcement Learning Guided Graph Diffusion FrameworkMain1 citations
  341. Evaluating LLMs’ Capability to Identify Lexical Semantic Equivalence: Probing with the Word-in-Context TaskMain1 citations
  342. Evaluating Pixel Language Models on Non-Standardized LanguagesMain1 citations
  343. Evaluating Transformers for OCR Post-Correction in Early Modern Dutch TheatreMain1 citations
  344. EvoPrompt: Evolving Prompts for Enhanced Zero-Shot Named Entity Recognition with Large Language ModelsMain1 citations
  345. Explain-Analyze-Generate: A Sequential Multi-Agent Collaboration Method for Complex ReasoningMain1 citations
  346. Explanation Regularisation through the Lens of AttributionsMain1 citations
  347. Exploring the Impact of Language Switching on Personality Traits in LLMsMain1 citations
  348. Extracting the Essence and Discarding the Dross: Enhancing Code Generation with Contrastive Execution FeedbackMain1 citations
  349. Extrapolating to Unknown Opinions Using LLMsMain1 citations
  350. FarExStance: Explainable Stance Detection for FarsiMain1 citations
  351. Few-shot domain adaptation for named-entity recognition via joint constrained k-means and subspace selectionMain1 citations
  352. Fine-Grained Features-based Code Search for Precise Query-Code MatchingMain1 citations
  353. From Priest to Doctor: Domain Adaptation for Low-Resource Neural Machine TranslationMain1 citations
  354. GLoCIM: Global-view Long Chain Interest Modeling for news recommendationMain1 citations
  355. Generating Commonsense Reasoning Questions with Controllable Complexity through Multi-step Structural CompositionMain1 citations
  356. Gradient Inversion Attack in Federated Learning: Exposing Text Data through Discrete OptimizationMain1 citations
  357. Graph Representation Learning in Hyperbolic Space via Dual-MaskedMain1 citations
  358. How Well Can Large Language Models Reflect? A Human Evaluation of LLM-generated Reflections for Motivational Interviewing DialoguesMain1 citations
  359. How to Leverage Digit Embeddings to Represent Numbers?Main1 citations
  360. Human-Like Embodied AI Interviewer: Employing Android ERICA in Real International ConferenceSystem Demonstrations1 citations
  361. ICLEval: Evaluating In-Context Learning Ability of Large Language ModelsMain1 citations
  362. IRR: Image Review Ranking Framework for Evaluating Vision-Language ModelsMain1 citations
  363. Impromptu Cybercrime Euphemism DetectionMain1 citations
  364. Improved Sparse Upcycling for Instruction TuningMain1 citations
  365. Improvement in Sign Language Translation Using Text CTC AlignmentMain1 citations
  366. Improving Tool Retrieval by Leveraging Large Language Models for Query GenerationIndustry1 citations
  367. Inside-Outside Algorithm for Probabilistic Product-Free Lambek Categorial GrammarMain1 citations
  368. Integrating Visual Modalities with Large Language Models for Mental Health SupportMain1 citations
  369. Is Peer-Reviewing Worth the Effort?Main1 citations
  370. Is my Meeting Summary Good? Estimating Quality with a Multi-LLM EvaluatorIndustry1 citations
  371. It is not a piece of cake for GPT: Explaining Textual Entailment Recognition in the presence of Figurative LanguageMain1 citations
  372. Jump To Hyperspace: Comparing Euclidean and Hyperbolic Loss Functions for Hierarchical Multi-Label Text ClassificationMain1 citations
  373. KARRIEREWEGE: A large scale Career Path Prediction DatasetIndustry1 citations
  374. LLM Sensitivity Challenges in Abusive Language Detection: Instruction-Tuned vs. Human FeedbackMain1 citations
  375. LLMs on interactive feature collections with implicit dynamic decision strategyMain1 citations
  376. Language Adaptation of Large Language Models: An Empirical Study on LLaMA2Main1 citations
  377. Large Language Models are Good Annotators for Type-aware Data Augmentation in Grammatical Error CorrectionMain1 citations
  378. Large Language Models with Reinforcement Learning from Human Feedback Approach for Enhancing Explainable Sexism DetectionMain1 citations
  379. Learning to Verify Summary Facts with Fine-Grained LLM FeedbackMain1 citations
  380. Leveraging Explicit Reasoning for Inference Integration in Commonsense-Augmented Dialogue ModelsMain1 citations
  381. Leveraging LLM-Generated Schema Descriptions for Unanswerable Question Detection in Clinical DataMain1 citations
  382. Leveraging Language Models for Summarizing Mental State Examinations: A Comprehensive Evaluation and Dataset ReleaseMain1 citations
  383. Looks can be Deceptive: Distinguishing Repetition Disfluency from ReduplicationMain1 citations
  384. Low-Resource Fast Text Classification Based on Intra-Class and Inter-Class Distance CalculationMain1 citations
  385. Low-Resource Language Expansion and Translation Capacity Enhancement for LLM: A Study on the UyghurMain1 citations
  386. MIT-10M: A Large Scale Parallel Corpus of Multilingual Image TranslationMain1 citations
  387. MMD-ERE: Multi-Agent Multi-Sided Debate for Event Relation ExtractionMain1 citations
  388. MPID: A Modality-Preserving and Interaction-Driven Fusion Network for Multimodal Sentiment AnalysisMain1 citations
  389. MQM-APE: Toward High-Quality Error Annotation Predictors with Automatic Post-Editing in LLM Translation EvaluatorsMain1 citations
  390. MSG-LLM: A Multi-scale Interactive Framework for Graph-enhanced Large Language ModelsMain1 citations
  391. Making Task-Oriented Dialogue Datasets More Natural by Synthetically Generating Indirect User RequestsMain1 citations
  392. Measuring Contextual Informativeness in Child-Directed TextMain1 citations
  393. MiMoTable: A Multi-scale Spreadsheet Benchmark with Meta Operations for Table ReasoningMain1 citations
  394. MuKA: Multimodal Knowledge Augmented Visual Information-SeekingMain1 citations
  395. Multi-View Incongruity Learning for Multimodal Sarcasm DetectionMain1 citations
  396. Multilingual Continual Learning using Attention DistillationIndustry1 citations
  397. NYAYAANUMANA and INLEGALLLAMA: The Largest Indian Legal Judgment Prediction Dataset and Specialized Language Model for Enhanced Decision AnalysisMain1 citations
  398. NYT-Connections: A Deceptively Simple Text Classification Task that Stumps System-1 ThinkersMain1 citations
  399. No Size Fits All: The Perils and Pitfalls of Leveraging LLMs Vary with Company SizeIndustry1 citations
  400. Not Every Metric is Equal: Cognitive Models for Predicting N400 and P600 Components During Reading ComprehensionMain1 citations
  401. NovAScore: A New Automated Metric for Evaluating Document Level NoveltyMain1 citations
  402. OKG: On-the-Fly Keyword Generation in Sponsored Search AdvertisingIndustry1 citations
  403. Oddballness: universal anomaly detection with language modelsMain1 citations
  404. On Weaponization-Resistant Large Language Models with Prospect Theoretic AlignmentMain1 citations
  405. OpenFactCheck: Building, Benchmarking Customized Fact-Checking Systems and Evaluating the Factuality of Claims and LLMsMain1 citations
  406. OpenForecast: A Large-Scale Open-Ended Event Forecasting DatasetMain1 citations
  407. Optimizing Lifelong Fine-Tuning for Multiple Tasks via Dataless Distribution ReplayMain1 citations
  408. PADO: Personality-induced multi-Agents for Detecting OCEAN in human-generated textsMain1 citations
  409. PIRsuader: A Persuasive Chatbot for Mitigating Psychological Insulin Resistance in Type-2 Diabetic PatientsMain1 citations
  410. Part-Of-Speech Sensitivity of Routers in Mixture of Experts ModelsMain1 citations
  411. Planning with Multi-Constraints via Collaborative Language AgentsMain1 citations
  412. Position Information Emerges in Causal Transformers Without Positional Encodings via Similarity of Nearby EmbeddingsMain1 citations
  413. Positive Text Reframing under Multi-strategy OptimizationMain1 citations
  414. Post-Hoc Watermarking for Robust Detection in Text Generated by Large Language ModelsMain1 citations
  415. ProTOD: Proactive Task-oriented Dialogue System Based on Large Language ModelMain1 citations
  416. RUIE: Retrieval-based Unified Information Extraction using Large Language ModelMain1 citations
  417. Rationale-Guided Distillation for E-Commerce Relevance Classification: Bridging Large Language Models and Lightweight Cross-EncodersIndustry1 citations
  418. ReLayout: Towards Real-World Document Understanding via Layout-enhanced Pre-trainingMain1 citations
  419. Reasoning Graph Enhanced Exemplars Retrieval for In-Context LearningMain1 citations
  420. Refined Evaluation for End-to-End Grammatical Error Correction Using an Alignment-Based ApproachMain1 citations
  421. Rethinking Long Context Generation from the Continual Learning PerspectiveMain1 citations
  422. Retrieval-Augmented Generation for Large Language Model based Few-shot Chinese Spell CheckingMain1 citations
  423. Return of EM: Entity-driven Answer Set Expansion for QA EvaluationMain1 citations
  424. RoLargeSum: A Large Dialect-Aware Romanian News Dataset for Summary, Headline, and Keyword GenerationMain1 citations
  425. SCV: Light and Effective Multi-Vector Retrieval with Sequence Compressive VectorsIndustry1 citations
  426. STAND-Guard: A Small Task-Adaptive Content Moderation ModelIndustry1 citations
  427. Searching for Structure: Investigating Emergent Communication with Large Language ModelsMain1 citations
  428. Semantic Reshuffling with LLM and Heterogeneous Graph Auto-Encoder for Enhanced Rumor DetectionMain1 citations
  429. Sequential Fusion of Text-close and Text-far Representations for Multimodal Sentiment AnalysisMain1 citations
  430. Slender-Mamba: Fully Quantized Mamba in 1.58 Bits From Head to ToeMain1 citations
  431. Streamlining Biomedical Research with Specialized LLMsSystem Demonstrations1 citations
  432. SubRegWeigh: Effective and Efficient Annotation Weighing with Subword RegularizationMain1 citations
  433. Summarization of Opinionated Political Documents with Varied PerspectivesMain1 citations
  434. SynDARin: Synthesising Datasets for Automated Reasoning in Low-Resource LanguagesMain1 citations
  435. Synthetic Paths to Integral Truth: Mitigating Hallucinations Caused by Confirmation Bias with Synthetic DataMain1 citations
  436. TMATH A Dataset for Evaluating Large Language Models in Generating Educational Hints for Math Word ProblemsMain1 citations
  437. TermDiffuSum: A Term-guided Diffusion Model for Extractive Summarization of Legal DocumentsMain1 citations
  438. The Role of Natural Language Processing Tasks in Automatic Literary Character Network ConstructionMain1 citations
  439. Topology-of-Question-Decomposition: Enhancing Large Language Models with Information Retrieval for Knowledge-Intensive TasksMain1 citations
  440. Towards Faithful Multi-step Reasoning through Fine-Grained Causal-aware Attribution Reasoning DistillationMain1 citations
  441. Towards the Machine Translation of Scientific NeologismsMain1 citations
  442. URIEL+: Enhancing Linguistic Inclusion and Usability in a Typological and Multilingual Knowledge BaseMain1 citations
  443. Unlike “Likely”, “Unlike” is Unlikely: BPE-based Segmentation hurts Morphological Derivations in LLMsMain1 citations
  444. Unveiling Entity-Level Unlearning for Large Language Models: A Comprehensive AnalysisMain1 citations
  445. Unveiling Fake News with Adversarial Arguments Generated by Multimodal Large Language ModelsMain1 citations
  446. Unveiling Performance Challenges of Large Language Models in Low-Resource Healthcare: A Demographic Fairness PerspectiveMain1 citations
  447. Using Game Play to Investigate Multimodal and Conversational Grounding in Large Multimodal ModelsMain1 citations
  448. VLR-Bench: Multilingual Benchmark Dataset for Vision-Language Retrieval Augmented GenerationMain1 citations
  449. ViSoLex: An Open-Source Repository for Vietnamese Social Media Lexical NormalizationSystem Demonstrations1 citations
  450. Where do LLMs Encode the Knowledge to Assess the Ambiguity?Industry1 citations
  451. XFormParser: A Simple and Effective Multimodal Multilingual Semi-structured Form ParserMain1 citations
  452. Zero-shot Slot Filling in the Age of LLMs for Dialogue SystemsIndustry1 citations
  453. A Benchmark and Robustness Study of In-Context-Learning with Large Language Models in Music Entity DetectionMain
  454. A Benchmark of French ASR Systems Based on Error SeverityMain
  455. A Career Interview Dialogue System using Large Language Model-based Dynamic Slot GenerationMain
  456. A Chain-of-Task Framework for Instruction Tuning of LLMs Based on Chinese Grammatical Error CorrectionMain
  457. A Collaborative Reasoning Framework Powered by Reinforcement Learning and Large Language Models for Complex Questions Answering over Knowledge GraphMain
  458. A Combinatorial Approach to Neural Emergent CommunicationMain
  459. A Compliance Checking Framework Based on Retrieval Augmented GenerationMain
  460. A Dataset for Expert Reviewer Recommendation with Large Language Models as Zero-shot RankersMain
  461. A Graph Interaction Framework on Relevance for Multimodal Named Entity Recognition with Multiple ImagesMain
  462. A High-Quality Text-Rich Image Instruction Tuning Dataset via Hybrid Instruction GenerationMain
  463. A Knowledge Graph Reasoning-Based Model for Computerized Adaptive TestingMain
  464. A Probabilistic Toolkit for Multi-grained Word Segmentation in ChineseSystem Demonstrations
  465. A Recipe For Building a Compliant Real Estate ChatbotIndustry
  466. A Simple yet Efficient Prompt Compression Method for Text Classification Data Annotation Using LLMIndustry
  467. A Simple-Yet-Efficient Instruction Augmentation Method for Zero-Shot Sentiment ClassificationMain
  468. A Testset for Context-Aware LLM Translation in Korean-to-English Discourse Level TranslationMain
  469. A Text Embedding Model with Contrastive Example Mining for Point-of-Interest GeocodingMain
  470. ACE-M3: Automatic Capability Evaluator for Multimodal Medical ModelsMain
  471. ACL-rlg: A Dataset for Reading List GenerationMain
  472. AGCL: Aspect Graph Construction and Learning for Aspect-level Sentiment ClassificationMain
  473. AHVE-CNER: Aligned Hanzi Visual Encoding Enhance Chinese Named Entity Recognition with Multi-InformationMain
  474. AMAN: Agent for Mentoring and Assisting Newbies in MMORPGIndustry
  475. Acquiring Bidirectionality via Large and Small Language ModelsMain
  476. Adapters Selector: Cross-domains and Multi-tasks LoRA Modules Integration Usage MethodMain
  477. Addressing the Training-Inference Discrepancy in Discrete Diffusion for Text GenerationMain
  478. AdminSet and AdminBERT: a Dataset and a Pre-trained Language Model to Explore the Unstructured Maze of French Administrative DocumentsMain
  479. Aligning Complex Knowledge Graph Question Answering as Knowledge-Aware Constrained Code GenerationMain
  480. Ambiguity-aware Multi-level Incongruity Fusion Network for Multi-Modal Sarcasm DetectionMain
  481. An Efficient Dialogue Policy Agent with Model-Based Causal Reinforcement LearningMain
  482. Analyzing Continuous Semantic Shifts with Diachronic Word Similarity MatricesMain
  483. Analyzing Offensive Language Dataset Insights from Training Dynamics and Human Agreement LevelMain
  484. Annotating the French Wiktionary with supersenses for large scale lexical analysis: a use case to assess form-meaning relationships within the nominal lexiconMain
  485. Are Your Keywords Like My Queries? A Corpus-Wide Evaluation of Keyword Extractors with Real SearchesMain
  486. Argument Mining with Fine-Tuned Large Language ModelsMain
  487. Argumentation and Domain Discourse in Scholarly Articles on the Theory of International RelationsMain
  488. Aspect-Based Sentiment Analysis with Syntax-Opinion-Sentiment Reasoning ChainMain
  489. Attention-Seeker: Dynamic Self-Attention Scoring for Unsupervised Keyphrase ExtractionMain
  490. Automated Detection of Tropes In Short TextsMain
  491. Automated Molecular Concept Generation and Labeling with Large Language ModelsMain
  492. Automatic Evaluation of Language Generation Technology Based on Structure AlignmentMain
  493. Automatic Mathematic In-Context Example Generation for LLM Using Multi-Modal ConsistencyMain
  494. Autonomous Machine Learning-Based Peer Reviewer Selection SystemSystem Demonstrations
  495. BasqBBQ: A QA Benchmark for Assessing Social Biases in LLMs for Basque, a Low-Resource LanguageMain
  496. Benchmark Creation for Aspect-Based Sentiment Analysis in Low-Resource Odia Language and Evaluation through Fine-Tuning of Multilingual ModelsMain
  497. Best Practices for Distilling Large Language Models into BERT for Web Search RankingIndustry
  498. Beyond Dataset Creation: Critical View of Annotation Variation and Bias Probing of a Dataset for Online Radical Content DetectionMain
  499. Beyond Discrete Personas: Personality Modeling Through Journal Intensive ConversationsMain
  500. Beyond Visual Understanding Introducing PARROT-360V for Vision Language Model BenchmarkingIndustry
  501. BinarySelect to Improve Accessibility of Black-Box Attack ResearchMain
  502. Boosting Text-to-SQL through Multi-grained Error IdentificationMain
  503. Bridging Context Gaps: Enhancing Comprehension in Long-Form Social Conversations Through Contextualized ExcerptsMain
  504. Bridging Modality Gap for Effective Multimodal Sentiment Analysis in Fashion-related Social MediaMain
  505. Bridging the Language Gap: Dynamic Learning Strategies for Improving Multilingual Performance in LLMsMain
  506. C3LRSO: A Chinese Corpus for Complex Logical Reasoning in Sentence OrderingMain
  507. CACA: Context-Aware Cross-Attention Network for Extractive Aspect Sentiment Quad PredictionMain
  508. CASE: Large Scale Topic Exploitation for Decision Support SystemsSystem Demonstrations
  509. CDAˆ2: Counterfactual Diffusion Augmentation for Cross-Domain Adaptation in Low-Resource Sentiment AnalysisMain
  510. CE-DA: Custom Embedding and Dynamic Aggregation for Zero-Shot Relation ExtractionMain
  511. CEHA: A Dataset of Conflict Events in the Horn of AfricaMain
  512. CHIFRAUD: A Long-term Web Text Dataset for Chinese Fraud DetectionMain
  513. COF: Adaptive Chain of Feedback for Comparative Opinion Quintuple ExtractionMain
  514. CPsyExam: A Chinese Benchmark for Evaluating Psychology using ExaminationsMain
  515. CUTE: A Multilingual Dataset for Enhancing Cross-Lingual Knowledge Transfer in Low-Resource LanguagesMain
  516. CaDRL: Document-level Relation Extraction via Context-aware Differentiable Rule LearningMain
  517. Can LLMs Clarify? Investigation and Enhancement of Large Language Models on Argument Claim OptimizationMain
  518. CateEA: Enhancing Entity Alignment via Implicit Category SupervisionMain
  519. CharMoral: A Character Morality Dataset for Morally Dynamic Character Analysis in Long-Form NarrativesMain
  520. Chinese Automatic Readability Assessment Using Adaptive Pre-training and Linguistic Feature FusionMain
  521. Claim veracity assessment for explainable fake news detectionMain
  522. Clear Up Confusion: Iterative Differential Generation for Fine-grained Intent Detection with Contrastive FeedbackMain
  523. Close or Cloze? Assessing the Robustness of Large Language Models to Adversarial Perturbations via Word RecoveryMain
  524. Cognate Detection for Historical Language Reconstruction of Proto-Sabean Languages: the Case of Ge’ez, Tigrinya, and AmharicMain
  525. Comet: Dialog Context Fusion Mechanism for End-to-End Task-Oriented Dialog with Multi-task LearningMain
  526. Commonsense Subgraph for Inductive Relation Reasoning with Meta-learningMain
  527. CompUGE-Bench: Comparative Understanding and Generation Evaluation Benchmark for Comparative Question AnsweringSystem Demonstrations
  528. Conditional Semantic Textual Similarity via Conditional Contrastive LearningMain
  529. Consistency Rating of Semantic Transparency: an Evaluation Method for Metaphor Competence in Idiom Understanding TasksMain
  530. Context Filtering with Reward Modeling in Question AnsweringMain
  531. Contextual ASR Error Handling with LLMs Augmentation for Goal-Oriented Conversational AIIndustry
  532. Contextual Augmentation for Entity Linking using Large Language ModelsMain
  533. Courtroom-LLM: A Legal-Inspired Multi-LLM Framework for Resolving Ambiguous Text ClassificationsMain
  534. Cross Domain Classification of Education Talk TurnsMain
  535. Cross-Domain Fake News Detection based on Dual-Granularity Adversarial TrainingMain
  536. Cross-Lingual Knowledge Projection and Knowledge Enhancement for Zero-Shot Question Answering in Low-Resource LanguagesMain
  537. Cross-Lingual Sentence Compression for Length-Constrained Subtitles in Low-Resource SettingsMain
  538. Cross-lingual Social Misinformation Detector based on Hierarchical Mixture-of-Experts AdapterMain
  539. Cross-lingual Text Classification Transfer: The Case of UkrainianMain
  540. CryptOpiQA: A new Opinion and Question Answering dataset on CryptocurrencyMain
  541. CycleOIE: A Low-Resource Training Framework For Open Information ExtractionMain
  542. DAEA: Enhancing Entity Alignment in Real-World Knowledge Graphs Through Multi-Source Domain AdaptationMain
  543. DORA: Dynamic Optimization Prompt for Continuous Reflection of LLM-based AgentMain
  544. DP-FROST: Differentially Private Fine-tuning of Pre-trained Models with Freezing Model ParametersMain
  545. DROWN: Towards Tighter LiRPA-based Robustness CertificationMain
  546. DaCoM: Strategies to Construct Domain-specific Low-resource Language Machine Translation DatasetIndustry
  547. Debiasing by obfuscating with 007-classifiers promotes fairness in multi-community settingsMain
  548. Deploying Multi-task Online Server with Large Language ModelIndustry
  549. Detecting deepfakes and false ads through analysis of text and social engineering techniquesMain
  550. DialogueMMT: Dialogue Scenes Understanding Enhanced Multi-modal Multi-task Tuning for Emotion Recognition in ConversationsMain
  551. Discrete Subgraph Sampling for Interpretable Graph based Visual Question AnsweringMain
  552. Disentangle to Decay: Linear Attention with Trainable Decay FactorMain
  553. Disentangling Preference Representation and Text Generation for Efficient Individual Preference AlignmentMain
  554. Do language models practice what they preach? Examining language ideologies about gendered language reform encoded in LLMsMain
  555. Does Vision Accelerate Hierarchical Generalization in Neural Language Learners?Main
  556. Driving Chinese Spelling Correction from a Fine-Grained PerspectiveMain
  557. Dying or Departing? Euphemism Detection for Death Discourse in Historical TextsMain
  558. Dynamics of Instruction Fine-Tuning for Chinese Large Language ModelsMain
  559. ECC: Synergizing Emotion, Cause and Commonsense for Empathetic Dialogue GenerationMain
  560. EDAR: A pipeline for Emotion and Dialogue Act RecognitionIndustry
  561. EERPD: Leveraging Emotion and Emotion Regulation for Improving Personality DetectionMain
  562. ELAINE-medLLM: Lightweight English Japanese Chinese Trilingual Large Language Model for Bio-medical DomainMain
  563. EasyJudge: an Easy-to-use Tool for Comprehensive Response Evaluation of LLMsSystem Demonstrations
  564. Edit-Wise Preference Optimization for Grammatical Error CorrectionMain
  565. Efficient Architectures for High Resolution Vision-Language ModelsMain
  566. Efficient Cross-modal Prompt Learning with Semantic Enhancement for Domain-robust Fake News DetectionMain
  567. Efficient Vocabulary Reduction for Small Language ModelsIndustry
  568. Embedding Style Beyond Topics: Analyzing Dispersion Effects Across Different Language ModelsMain
  569. Empirical Study of Zero-shot Keyphrase Extraction with Large Language ModelsMain
  570. Empirical Study on Data Attributes Insufficiency of Evaluation Benchmarks for LLMsMain
  571. Enhancing Criminal Investigation Analysis with Summarization and Memory-based Retrieval-Augmented Generation: A Comprehensive Evaluation of Real Case DataMain
  572. Enhancing Emotional Support Conversations: A Framework for Dynamic Knowledge Filtering and Persona ExtractionMain
  573. Enhancing Event Causality Identification with LLM Knowledge and Concept-Level Event RelationsMain
  574. Enhancing Extractive Question Answering in Multiparty Dialogues with Logical Inference Memory NetworkMain
  575. Enhancing Future Link Prediction in Quantum Computing Semantic Networks through LLM-Initiated Node FeaturesIndustry
  576. Enhancing Large Language Models for Document-Level Translation Post-Editing Using Monolingual DataMain
  577. Enhancing Multimodal Named Entity Recognition through Adaptive Mixup Image AugmentationMain
  578. Enhancing One-Shot Pruned Pre-trained Language Models through Sparse-Dense-Sparse MechanismMain
  579. Enhancing Online Grooming Detection via Backtranslation AugmentationMain
  580. Enhancing Rhetorical Figure Annotation: An Ontology-Based Web Application with RAG IntegrationMain
  581. Enhancing Rumor Detection Methods with Propagation Structure Infused Language ModelMain
  582. Enhancing Zero-shot Chain of Thought Prompting via Uncertainty-Guided Strategy SelectionMain
  583. Evaluating Generalization Capability of Language Models across Abductive, Deductive and Inductive Logical ReasoningMain
  584. Evaluating Model Alignment with Human Perception: A Study on Shitsukan in LLMs and LVLMsMain
  585. Evaluating Open-Source ASR Systems: Performance Across Diverse Audio Conditions and Error Correction MethodsMain
  586. Evaluating Readability Metrics for German Medical Text SimplificationMain
  587. Exploring Content Predictability in Turn-Taking Through Different Computer-Mediated CommunicationsMain
  588. Exploring Fine-Grained Human Motion Video CaptioningMain
  589. Exploring Unified Training Framework for Multimodal User ProfilingMain
  590. Exploring the Impacts of Feature Fusion Strategy in Multi-modal Entity AlignmentMain
  591. Exploring the Reliability of Large Language Models as Customized Evaluators for Diverse NLP TasksMain
  592. Extending LLMs to New Languages: A Case Study of Llama and Persian AdaptationMain
  593. Extracting structure from an LLM - how to improve on surprisal-based models of Human Language ProcessingMain
  594. Extracting, Detecting, and Generating Research Questions for Scientific ArticlesMain
  595. FEAT-writing: An Interactive Training System for Argumentative WritingSystem Demonstrations
  596. FTFT: Efficient and Robust Fine-Tuning by Transferring Training DynamicsMain
  597. Factual Knowledge Assessment of Language Models Using DistractorsMain
  598. Faithful Inference Chains Extraction for Fact Verification over Multi-view Heterogeneous Graph with Causal InterventionMain
  599. FedCSR: A Federated Framework for Multi-Platform Cross-Domain Sequential Recommendation with Dual Contrastive LearningMain
  600. Federated Incremental Named Entity RecognitionMain
  601. Fine-Tuning Medium-Scale LLMs for Joint Intent Classification and Slot Filling: A Data-Efficient and Cost-Effective Solution for SMEsIndustry
  602. Finetuning LLMs for Comparative Assessment TasksMain
  603. Flashback: Memory Mechanism for Enhancing Memory Efficiency and Speed in Deep Sequential ModelsMain
  604. From Detection to Explanation: Effective Learning Strategies for LLMs in Online Abusive Language ResearchMain
  605. From Form to Meaning: The Case of Particles within the Prague Dependency Treebank Annotation SchemeMain
  606. From Multiple-Choice to Extractive QA: A Case Study for English and ArabicMain
  607. Fusion meets Function: The Adaptive Selection-Generation Approach in Event Argument ExtractionMain
  608. GADFA: Generator-Assisted Decision-Focused Approach for Opinion Expressing Timing IdentificationMain
  609. GEAR: A Simple GENERATE, EMBED, AVERAGE AND RANK Approach for Unsupervised Reverse DictionaryMain
  610. GECTurk WEB: An Explainable Online Platform for Turkish Grammatical Error Detection and CorrectionSystem Demonstrations
  611. GL-GAN: Perceiving and Integrating Global and Local Styles for Handwritten Text Generation with MambaMain
  612. GR-NLP-TOOLKIT: An Open-Source NLP Toolkit for Modern GreekSystem Demonstrations
  613. Gen-SQL: Efficient Text-to-SQL By Bridging Natural Language Question And Database Schema With Pseudo-SchemaMain
  614. GenWebNovel: A Genre-oriented Corpus of Entities in Chinese Web NovelsMain
  615. Generation-Augmented and Embedding Fusion in Document-Level Event Argument ExtractionMain
  616. Generation-Based and Emotion-Reflected Memory Update: Creating the KEEM Dataset for Better Long-Term ConversationMain
  617. Generics are puzzling. Can language models find the missing piece?Main
  618. Geo-Spatially Informed Models for Geocoding Unstructured AddressesIndustry
  619. Graph-Augmented Open-Domain Multi-Document SummarizationIndustry
  620. HLU: Human Vs LLM Generated Text Detection Dataset for Urdu at Multiple GranularitiesMain
  621. HYDEN: Hyperbolic Density Representations for Medical Images and ReportsMain
  622. Hands-off Image Editing: Language-guided Editing without any Task-specific Labeling, Masking or even TrainingMain
  623. HateBRXplain: A Benchmark Dataset with Human-Annotated Rationales for Explainable Hate Speech Detection in Brazilian PortugueseMain
  624. Hawkes based Representation Learning for Reasoning over Scale-free Community-structured Temporal Knowledge GraphsMain
  625. Hermit Kingdom Through the Lens of Multiple Perspectives: A Case Study of LLM Hallucination on North KoreaMain
  626. Hi-GEC: Hindi Grammar Error Correction in Low Resource ScenarioMain
  627. How Ambiguous Are the Rationales for Natural Language Reasoning? A Simple Approach to Handling Rationale UncertaintyMain
  628. How Credible Is an Answer From Retrieval-Augmented LLMs? Investigation and Evaluation With Multi-Hop QAMain
  629. How Many Languages Make Good Multilingual Instruction Tuning? A Case Study on BLOOMMain
  630. Human Interest Framing across Cultures: A Case Study on Climate ChangeMain
  631. HyperHatePrompt: A Hypergraph-based Prompting Fusion Model for Multimodal Hate DetectionMain
  632. HyperIDP: Customizing Temporal Hypergraph Neural Networks for Multi-Scale Information Diffusion PredictionMain
  633. IRUEX: A Study on Large Language Models Problem-Solving Skills in Iran’s University Entrance ExamMain
  634. ITERATE: Image-Text Enhancement, Retrieval, and Alignment for Transmodal Evolution with LLMsMain
  635. Improve Speech Translation Through Text RewriteIndustry
  636. Improving Accessibility of SCOTUS Opinions: A Benchmark Study and a New Dataset for Generic Heading Prediction and Specific Heading GenerationMain
  637. Improving Explainable Fact-Checking with Claim-Evidence CorrelationsMain
  638. Improving NMT Models by Retrofitting Quality Estimators into Trainable Energy LossMain
  639. Improving Relation Extraction by Sequence-to-sequence-based Dependency Parsing Pre-trainingMain
  640. Improving the Efficiency of Visually Augmented Language ModelsMain
  641. In-Context Reinforcement Learning with Retrieval-Augmented Generation for Text-to-SQLMain
  642. In-context Continual Learning Assisted by an External Continual LearnerMain
  643. Incorporating Review-missing Interactions for Generative Explainable RecommendationMain
  644. Incremental Transformer: Efficient Encoder for Incremented Text Over MRC and Conversation TasksMain
  645. Indigenous Languages Spoken in Argentina: A Survey of NLP and Speech ResourcesMain
  646. Inductive Link Prediction in N-ary Knowledge GraphsMain
  647. InstructGEC: Enhancing Unsupervised Grammatical Error Correction with Instruction TuningMain
  648. Integrating Group-based Preferences from Coarse to Fine for Cold-start Users RecommendationMain
  649. Intent Contrastive Learning Based on Multi-view Augmentation for Sequential RecommendationMain
  650. Interpreting Topic Models in Byte-Pair Encoding SpaceMain
  651. Investigating the Contextualised Word Embedding Dimensions Specified for Contextual and Temporal Semantic ChangesMain
  652. Investigating the Impact of Incremental Processing and Voice Activity Projection on Spoken Dialogue SystemsMain
  653. Iterative Structured Knowledge Distillation: Optimizing Language Models Through Layer-by-Layer DistillationMain
  654. It’s What You Say and How You Say It: Investigating the Effect of Linguistic vs. Behavioral Adaptation in Task-Oriented ChatbotsMain
  655. Just Read the Codebook! Make Use of Quality Codebooks in Zero-Shot Classification of Multilabel Frame DatasetsMain
  656. KG-TRICK: Unifying Textual and Relational Information Completion of Knowledge for Multilingual Knowledge GraphsMain
  657. KVFKT: A New Horizon in Knowledge Tracing with Attention-Based Embedding and Forgetting Curve IntegrationMain
  658. Know When to Fuse: Investigating Non-English Hybrid Retrieval in the Legal DomainMain
  659. Knowledge Graph Entity Typing with Curriculum Contrastive LearningMain
  660. Knowledge Graph Pooling and Unpooling for Concept AbstractionMain
  661. Knowledge Graph Unlearning with SchemaMain
  662. KnowledgePrompts: Exploring the Abilities of Large Language Models to Solve Proportional Analogies via Knowledge-Enhanced PromptingMain
  663. LASS: A Novel and Economical Data Augmentation Framework Based on Language Models for Debiasing Opinion SummarizationMain
  664. LENS: Learning Entities from Narratives of Skin CancerSystem Demonstrations
  665. LLM ContextBridge: A Hybrid Approach for Intent and Dialogue Understanding in IVSRIndustry
  666. LLM Evaluate: An Industry-Focused Evaluation Tool for Large Language ModelsIndustry
  667. LLM Sensitivity Evaluation Framework for Clinical DiagnosisMain
  668. LLM4RE: A Data-centric Feasibility Study for Relation ExtractionMain
  669. LLMs meet Bloom’s Taxonomy: A Cognitive View on Large Language Model EvaluationsMain
  670. LOG: A Local-to-Global Optimization Approach for Retrieval-based Explainable Multi-Hop Question AnsweringMain
  671. LTRS: Improving Word Sense Disambiguation via Learning to Rank SensesMain
  672. LUCE: A Dynamic Framework and Interactive Dashboard for Opinionated Text AnalysisSystem Demonstrations
  673. LaERC-S: Improving LLM-based Emotion Recognition in Conversation with Speaker CharacteristicsMain
  674. Language Models at the Syntax-Semantics Interface: A Case Study of the Long-Distance Binding of Chinese Reflexive ZijiMain
  675. Language Models over Large-Scale Knowledge Base: on Capacity, Flexibility and Reasoning for New FactsMain
  676. Large Language Model as a Teacher for Zero-shot Tagging at Extreme ScalesMain
  677. Large Language Model-Based Event Relation Extraction with RationalesMain
  678. Latent Space Interpretation for Stylistic Analysis and Explainable Authorship AttributionMain
  679. Learn from Failure: Causality-guided Contrastive Learning for Generalizable Implicit Hate Speech DetectionMain
  680. Learning Transition Patterns by Large Language Models for Sequential RecommendationMain
  681. Learning from Impairment: Leveraging Insights from Clinical Linguistics in Language Modelling ResearchMain
  682. Learning to Rewrite Negation Queries in Product SearchIndustry
  683. Leveraging Language-based Representations for Better Solving Symbol-related Problems with Large Language ModelsMain
  684. Leveraging Large Pre-trained Multilingual Models for High-Quality Speech-to-Text Translation on Industry ScenariosMain
  685. Leveraging Multilingual Models for Robust Grammatical Error Correction Across Low-Resource LanguagesIndustry
  686. Linguistic Features Extracted by GPT-4 Improve Alzheimer’s Disease Detection based on Spontaneous SpeechMain
  687. LionGuard: A Contextualized Moderation Classifier to Tackle Localized Unsafe ContentIndustry
  688. LlmLink: Dual LLMs for Dynamic Entity Linking on Long Narratives with Collaborative Memorisation and Prompt OptimisationMain
  689. LogiGraph: Logical Reasoning with Contrastive Learning and Lightweight Graph NetworksMain
  690. Looking at the Unseen: Effective Sampling of Non-Related Propositions for Argument MiningMain
  691. MAGRET: Machine-generated Text Detection with Rewritten TextsMain
  692. MDPO: Customized Direct Preference Optimization with a Metric-based Sampler for Question and Answer GenerationMain
  693. ME2-BERT: Are Events and Emotions what you need for Moral Foundation Prediction?Main
  694. MESAQA: A Dataset for Multi-Span Contextual and Evidence-Grounded Question AnsweringMain
  695. MIGRATE: Cross-Lingual Adaptation of Domain-Specific LLMs through Code-Switching and Embedding TransferMain
  696. MLD-EA: Check and Complete Narrative Coherence by Introducing Emotions and ActionsMain
  697. MLLM-I2W: Harnessing Multimodal Large Language Model for Zero-Shot Composed Image RetrievalMain
  698. MPPO: Multi Pair-wise Preference Optimization for LLMs with Arbitrary Negative SamplesMain
  699. MQM-Chat: Multidimensional Quality Metrics for Chat TranslationMain
  700. Measuring the Robustness of Reference-Free Dialogue Evaluation SystemsMain
  701. MedEx: Enhancing Medical Question-Answering with First-Order Logic based Reasoning and Knowledge InjectionMain
  702. Mining Word Boundaries from Speech-Text Parallel Data for Cross-domain Chinese Word SegmentationMain
  703. Mitigating Shortcut Learning via Smart Data Augmentation based on Large Language ModelMain
  704. Mitigating the Discrepancy Between Video and Text Temporal Sequences: A Time-Perception Enhanced Video Grounding method for LLMMain
  705. MoKA:Parameter Efficiency Fine-Tuning via Mixture of Kronecker Product AdaptionMain
  706. Momentum Posterior Regularization for Multi-hop Dense RetrievalMain
  707. Monte Carlo Tree Search Based Prompt Autogeneration for Jailbreak Attacks against LLMsMain
  708. MuPe Life Stories Dataset: Spontaneous Speech in Brazilian Portuguese with a Case Study Evaluation on ASR Bias against Speakers Groups and Topic ModelingMain
  709. Multi-Graph Co-Training for Capturing User Intent in Session-based RecommendationMain
  710. Multi-Layered Evaluation Using a Fusion of Metrics and LLMs as Judges in Open-Domain Question AnsweringMain
  711. Multi-Modal Entities Matter: Benchmarking Multi-Modal Entity AlignmentMain
  712. Multi-Modal Multi-Granularity Tokenizer for Chu Bamboo SlipsMain
  713. Multi-perspective Preference Alignment of LLMs for Programming-Community Question AnsweringMain
  714. Multilingual Supervision Improves Semantic Disambiguation of AdpositionsMain
  715. Multimodal Extraction and Recognition of Arabic Implicit Discourse RelationsMain
  716. NCRE: A Benchmark for Document-level Nominal Compound Relation ExtractionMain
  717. NLP for preserving Torlak, a vulnerable low-resource Slavic languageMain
  718. Neural Document Segmentation Using Weighted Sliding Windows with Transformer EncodersIndustry
  719. Non-Emotion-Centric Empathetic Dialogue GenerationMain
  720. Norm of Mean Contextualized Embeddings Determines their VarianceMain
  721. OVEL: Online Video Entity LinkingMain
  722. On Evaluating LLMs’ Capabilities as Functional Approximators: A Bayesian Evaluation FrameworkMain
  723. On the Human-level Performance of Visual Question AnsweringMain
  724. On the effective transfer of knowledge from English to Hindi WikipediaIndustry
  725. OptiPrune: Effective Pruning Approach for Every Target SparsityMain
  726. PDC & DM-SFT: A Road for LLM SQL Bug-Fix EnhancingIndustry
  727. PERC: Plan-As-Query Example Retrieval for Underrepresented Code GenerationMain
  728. PToco: Prefix-based Token-level Collaboration Enhances Reasoning for Multi-LLMsMain
  729. Page Stream Segmentation with LLMs: Challenges and Applications in Insurance Document AutomationIndustry
  730. Paraphrase Generation Evaluation Powered by an LLM: A Semantic Metric, Not a Lexical OneMain
  731. Paraphrase Makes Perfect: Leveraging Expression Paraphrase to Improve Implicit Sentiment LearningMain
  732. Partial Order-centered Hyperbolic Representation Learning for Few-shot Relation ExtractionMain
  733. Perceive the Passage of Time: A Systematic Evaluation of Large Language Model in Temporal RelativityMain
  734. Perturbation-driven Dual Auxiliary Contrastive Learning for Collaborative Filtering RecommendationMain
  735. PoemBERT: A Dynamic Masking Content and Ratio Based Semantic Language Model For Chinese Poem GenerationMain
  736. Poetry in Pixels: Prompt Tuning for Poem Image Generation via Diffusion ModelsMain
  737. PolyMinder: A Support System for Entity Annotation and Relation Extraction in Polymer Science DocumentsSystem Demonstrations
  738. Polysemy Interpretation and Transformer Language Models: A Case of Korean Adverbial Postposition -(u)loMain
  739. PrahokBART: A Pre-trained Sequence-to-Sequence Model for Khmer Natural Language GenerationMain
  740. Pre-trained Semantic Interaction based Inductive Graph Neural Networks for Text ClassificationMain
  741. Predicting Fine-tuned Performance on Larger Datasets Before Creating ThemIndustry
  742. ProsodyFlow: High-fidelity Text-to-Speech through Conditional Flow Matching and Prosody Modeling with Large Speech Language ModelsMain
  743. Pseudo-label Data Construction Method and Syntax-enhanced Model for Chinese Semantic Error RecognitionMain
  744. QABISAR: Query-Article Bipartite Interactions for Statutory Article RetrievalMain
  745. QUENCH: Measuring the gap between Indic and Non-Indic Contextual General Reasoning in LLMsMain
  746. Quality Beyond A Glance: Revealing Large Quality Differences Between Web-Crawled Parallel CorporaMain
  747. Quantifying the Influence of Evaluation Aspects on Long-Form Response AssessmentMain
  748. RA-MTR: A Retrieval Augmented Multi-Task Reader based Approach for Inspirational Quote Extraction from Long DocumentsMain
  749. RAGthoven: A Configurable Toolkit for RAG-enabled LLM ExperimentationSystem Demonstrations
  750. RAM2C: A Liberal Arts Educational Chatbot based on Retrieval-augmented Multi-role Multi-expert CollaborationMain
  751. RED-CT: A Systems Design Methodology for Using LLM-labeled Data to Train and Deploy Edge Linguistic ClassifiersIndustry
  752. RGR-KBQA: Generating Logical Forms for Question Answering Using Knowledge-Graph-Enhanced Large Language ModelMain
  753. ROUGE-SciQFS: A ROUGE-based Method to Automatically Create Datasets for Scientific Query-Focused SummarizationMain
  754. RRHF-V: Ranking Responses to Mitigate Hallucinations in Multimodal Large Language Models with Human FeedbackMain
  755. RUAccent: Advanced System for Stress Placement in Russian with Homograph ResolutionMain
  756. Ranking Over Scoring: Towards Reliable and Robust Automated Evaluation of LLM-Generated Medical Explanatory ArgumentsMain
  757. Re-Cent: A Relation-Centric Framework for Joint Zero-Shot Relation Triplet ExtractionMain
  758. Re-Examine Distantly Supervised NER: A New Benchmark and a Simple ApproachMain
  759. Reasoning with Trees: Faithful Question Answering over Knowledge GraphMain
  760. Reasoning-Oriented and Analogy-Based Methods for Locating and Editing in Zero-Shot Event-Relational ReasoningMain
  761. RecStream: Graph-aware Stream Management for Concurrent Recommendation Model Online ServingIndustry
  762. Refer to the Reference: Reference-focused Synthetic Automatic Post-Editing Data GenerationMain
  763. Relation Logical Reasoning and Relation-aware Entity Encoding for Temporal Knowledge Graph ReasoningMain
  764. Reliable, Reproducible, and Really Fast Leaderboards with EvalicaSystem Demonstrations
  765. Representation Purification for End-to-End Speech TranslationMain
  766. Representing the Under-Represented: Cultural and Core Capability Benchmarks for Developing Thai Large Language ModelsMain
  767. Resource-Efficient Anonymization of Textual Data via Knowledge Distillation from Large Language ModelsIndustry
  768. Rethinking Vocabulary Augmentation: Addressing the Challenges of Low-Resource Languages in Multilingual ModelsMain
  769. Rethinking-based Code Summarization with Chain of CommentsMain
  770. Revisiting Implicitly Abusive Language Detection: Evaluating LLMs in Zero-Shot and Few-Shot SettingsMain
  771. RoBGuard: Enhancing LLMs to Assess Risk of Bias in Clinical Trial DocumentsMain
  772. Robustness Evaluation of the German Extractive Question Answering TaskMain
  773. Rule-KBQA: Rule-Guided Reasoning for Complex Knowledge Base Question Answering with Large Language ModelsMain
  774. Rumor Detection on Social Media with Temporal Propagation Structure OptimizationMain
  775. SA-DETR:Span Aware Detection Transformer for Moment RetrievalMain
  776. SCCD: A Session-based Dataset for Chinese Cyberbullying DetectionMain
  777. SGMEA: Structure-Guided Multimodal Entity AlignmentMain
  778. SILC-EFSA: Self-aware In-context Learning Correction for Entity-level Financial Sentiment AnalysisMain
  779. SLAM: Towards Efficient Multilingual Reasoning via Selective Language AlignmentMain
  780. SLARD: A Chinese Superior Legal Article Retrieval DatasetMain
  781. SURE: Mutually Visible Objects and Self-generated Candidate Labels For Relation ExtractionMain
  782. SVD-GCL: A Noise-Augmented Hybrid Graph Contrastive Learning Framework for RecommendationMain
  783. Scene Graph and Dependency Grammar Enhanced Remote Sensing Change Caption Network (SGD-RSCCN)Main
  784. Seeing Beyond: Enhancing Visual Question Answering with Multi-Modal RetrievalIndustry
  785. Selected Languages are All You Need for Cross-lingual Truthfulness TransferMain
  786. Self-Evolution Knowledge Distillation for LLM-based Machine TranslationMain
  787. Semantic Captioning: Benchmark Dataset and Graph-Aware Few-Shot In-Context Learning for SQL2TextMain
  788. Semantic Role Labeling of NomBank PartitivesMain
  789. Semantic and Sentiment Dual-Enhanced Generative Model for Script Event PredictionMain
  790. Semi-Automated Construction of Sense-Annotated Datasets for Practically Any LanguageMain
  791. Should We Use a Fixed Embedding Size? Customized Dimension Sizes for Knowledge Graph EmbeddingMain
  792. Sibyl: Empowering Empathetic Dialogue Generation in Large Language Models via Sensible and Visionary Commonsense InferenceMain
  793. Simulating Dual-Process Thinking in Dialogue Topic Shift DetectionMain
  794. Speech Foundation Models and Crowdsourcing for Efficient, High-Quality Data CollectionMain
  795. Structured List-Grounded Question AnsweringMain
  796. Swift Cross-Dataset Pruning: Enhancing Fine-Tuning Efficiency in Natural Language UnderstandingMain
  797. TEEMIL : Towards Educational MCQ Difficulty Estimation in Indic LanguagesMain
  798. TEF: Causality-Aware Taxonomy Expansion via Front-Door CriterionMain
  799. TOP-Training: Target-Oriented Pretraining for Medical Extractive Question AnsweringMain
  800. TaCIE: Enhancing Instruction Comprehension in Large Language Models through Task-Centred Instruction EvolutionMain
  801. Task-Oriented Dialog Systems for the Senegalese Wolof LanguageMain
  802. Teaching-Inspired Integrated Prompting Framework: A Novel Approach for Enhancing Reasoning in Large Language ModelsIndustry
  803. Text-Attributed Graph Learning with Coupled AugmentationsMain
  804. The Gaps between Fine Tuning and In-context Learning in Bias Evaluation and DebiasingMain
  805. The Invalsi Benchmarks: measuring the Linguistic and Mathematical understanding of Large Language Models in ItalianMain
  806. The Only Way is Ethics: A Guide to Ethical Research with Large Language ModelsMain
  807. The PRECOM-SM Corpus: Gambling in Spanish Social MediaMain
  808. The Shift from Logic to Dialectic in Argumentation Theory: Implications for Computational Argument Quality AssessmentMain
  809. Tougher Text, Smarter Models: Raising the Bar for Adversarial Defence BenchmarksMain
  810. Towards Adaptive Mechanism Activation in Language AgentMain
  811. Towards Cross-Lingual Audio Abuse Detection in Low-Resource Settings with Few-Shot LearningMain
  812. Towards Database-Free Text-to-SQL Evaluation: A Graph-Based Metric for Functional CorrectnessMain
  813. Towards Efficient and Robust VQA-NLE Data Generation with Large Vision-Language ModelsMain
  814. Towards Human Understanding of Paraphrase Types in Large Language ModelsMain
  815. Towards Multilingual spoken Visual Question Answering system using Cross-AttentionMain
  816. Towards Robust Comparisons of NLP Models: A Case StudyMain
  817. Transformer-based Speech Model Learns Well as Infants and Encodes Abstractions through Exemplars in the Poverty of the Stimulus EnvironmentMain
  818. Transforming Code Understanding: Clustering-Based Retrieval for Improved Summarization in Domain-Specific LanguagesIndustry
  819. TriFine: A Large-Scale Dataset of Vision-Audio-Subtitle for Tri-Modal Machine Translation and Benchmark with Fine-Grained Annotated TagsMain
  820. Trucidator: Document-level Event Factuality Identification via Hallucination Enhancement and Cross-Document InferenceMain
  821. Two-stage Incomplete Utterance Rewriting on Editing OperationMain
  822. UCTG: A Unified Controllable Text Generation Framework for Query Auto-CompletionIndustry
  823. UR2N: Unified Retriever and ReraNkerIndustry
  824. Uchaguzi-2022: A Dataset of Citizen Reports on the 2022 Kenyan ElectionMain
  825. Uncertainty Modelling in Under-Represented Languages with Bayesian Deep Gaussian ProcessesMain
  826. Unified Grid Tagging Scheme for Aspect Sentiment Quad PredictionMain
  827. UnifiedGEC: Integrating Grammatical Error Correction Approaches for Multi-languages with a Unified FrameworkSystem Demonstrations
  828. Unmasking the Imposters: How Censorship and Domain Adaptation Affect the Detection of Machine-Generated TweetsMain
  829. Unraveling the Mystery: Defending Against Jailbreak Attacks Via Unearthing Real IntentionMain
  830. User Willingness-aware Sales Talk DatasetMain
  831. VEEF-Multi-LLM: Effective Vocabulary Expansion and Parameter Efficient Finetuning Towards Multilingual Large Language ModelsMain
  832. VaeDiff-DocRE: End-to-end Data Augmentation Framework for Document-level Relation ExtractionMain
  833. VideoQA-TA: Temporal-Aware Multi-Modal Video Question AnsweringMain
  834. Voice synthesis in Polish and English - analyzing prediction differences in speaker verification systemsMain
  835. VoxpopuliTTS: a large-scale multilingual TTS corpus for zero-shot speech generationMain
  836. What Makes Cryptic Crosswords Challenging for LLMs?Main
  837. What’s the most important value? INVP: INvestigating the Value Priorities of LLMs through Decision-making in Social ScenariosMain
  838. When Evolution Strategy Meets Language Models TuningMain
  839. Why should only High-Resource-Languages have all the fun? Pivot Based Evaluation in Low Resource SettingMain
  840. Word-level Cross-lingual Structure in Large Language ModelsMain
  841. XTR meets ColBERTv2: Adding ColBERTv2 Optimizations to XTRIndustry
  842. You Only Query Twice: Multimodal Rumor Detection via Evidential Evaluation from Dual PerspectivesMain
  843. Zero-Shot Entailment Learning for Ontology-Based Biomedical Annotation Without Explicit MentionsMain
  844. Zero-shot and Few-shot Learning with Instruction-following LLMs for Claim Matching in Automated Fact-checkingMain
  845. ZigZagKV: Dynamic KV Cache Compression for Long-context Modeling based on Layer UncertaintyMain
  846. data2lang2vec: Data Driven Typological Features CompletionMain
  847. t-HNE: A Text-guided Hierarchical Noise Eliminator for Multimodal Sentiment AnalysisMain
  848. “Stupid robot, I want to speak to a human!” User Frustration Detection in Task-Oriented Dialog SystemsIndustry

COLING accepted papers in other years

Looking for submission deadlines instead? See the conference deadline calendar.