← All conferences

EMNLP 2024 Accepted Papers

The full list of 2,379 papers accepted at EMNLP 2024 (Conference on Empirical Methods in Natural Language Processing). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.

Main: 1,234finding: 976Industry: 119System Demonstrations: 50
  1. SQFT: Low-cost Model Adaptation in Low-precision Sparse Foundation Modelsfinding3 citations
  2. SRAP-Agent: Simulating and Optimizing Scarce Resource Allocation Policy with LLM-based Agentfinding3 citations
  3. SURf: Teaching Large Vision-Language Models to Selectively Utilize Retrieved InformationMain3 citations
  4. Sanitizing Large Language Models in Bug Detection with Data-Flowfinding3 citations
  5. SciDoc2Diagrammer-MAF: Towards Generation of Scientific Diagrams from Documents guided by Multi-Aspect Feedback Refinementfinding3 citations
  6. SedarEval: Automated Evaluation using Self-Adaptive Rubricsfinding3 citations
  7. Seemingly Plausible Distractors in Multi-Hop Reasoning: Are Large Language Models Attentive Readers?Main3 citations
  8. Self-AMPLIFY: Improving Small Language Models with Self Post Hoc ExplanationsMain3 citations
  9. Self-Bootstrapped Visual-Language Model for Knowledge Selection and Question AnsweringMain3 citations
  10. Self-Distillation for Model Stacking Unlocks Cross-Lingual NLU in 200+ Languagesfinding3 citations
  11. Self-Refine Instruction-Tuning for Aligning Reasoning in Language ModelsMain3 citations
  12. Self-Training Large Language and Vision Assistant for Medical Question AnsweringMain3 citations
  13. Semformer: Transformer Language Models with Semantic PlanningMain3 citations
  14. Semi-Supervised Reward Modeling via Iterative Self-Trainingfinding3 citations
  15. Speechworthy Instruction-tuned Language ModelsMain3 citations
  16. Standardize: Aligning Language Models with Expert-Defined Standards for Content GenerationMain3 citations
  17. Stark: Social Long-Term Multi-Modal Conversation with Persona Commonsense Knowledgefinding3 citations
  18. Still Not Quite There! Evaluating Large Language Models for Comorbid Mental Health DiagnosisMain3 citations
  19. StorySparkQA: Expert-Annotated QA Pairs with Real-World Knowledge for Children’s Story-Based LearningMain3 citations
  20. Strategic Demonstration Selection for Improved Fairness in LLM In-Context LearningMain3 citations
  21. Student Data Paradox and Curious Case of Single Student-Tutor Model: Regressive Side Effects of Training LLMs for Personalized Learningfinding3 citations
  22. Surprise! Uniform Information Density Isn’t the Whole Story: Predicting Surprisal Contours in Long-form DiscourseMain3 citations
  23. Synchronous Faithfulness Monitoring for Trustworthy Retrieval-Augmented GenerationMain3 citations
  24. Systematic Evaluation of Long-Context LLMs on Financial ConceptsIndustry3 citations
  25. Taxonomy-guided Semantic Indexing for Academic Paper SearchMain3 citations
  26. Teaching Small Language Models Reasoning through Counterfactual DistillationMain3 citations
  27. Tell me what I need to know: Exploring LLM-based (Personalized) Abstractive Multi-Source Meeting SummarizationIndustry3 citations
  28. Text Fluoroscopy: Detecting LLM-Generated Text through Intrinsic FeaturesMain3 citations
  29. The Generation Gap: Exploring Age Bias in the Value Systems of Large Language ModelsMain3 citations
  30. The Lou Dataset - Exploring the Impact of Gender-Fair Language in German Text ClassificationMain3 citations
  31. Thinking Outside of the Differential Privacy Box: A Case Study in Text Privatization with Language Model PromptingMain3 citations
  32. Thoughts to Target: Enhance Planning for Target-driven ConversationMain3 citations
  33. To Err Is Human, but Llamas Can Learn It Toofinding3 citations
  34. Token Erasure as a Footprint of Implicit Vocabulary Items in LLMsMain3 citations
  35. Tools Fail: Detecting Silent Errors in Faulty ToolsMain3 citations
  36. Towards Robust Evaluation of Unlearning in LLMs via Data Transformationsfinding3 citations
  37. Towards a Similarity-adjusted Surprisal TheoryMain3 citations
  38. ToxiCraft: A Novel Framework for Synthetic Generation of Harmful Informationfinding3 citations
  39. TransAgents: Build Your Translation Company with Language AgentsSystem Demonstrations3 citations
  40. TruthReader: Towards Trustworthy Document Assistant Chatbot with Reliable AttributionSystem Demonstrations3 citations
  41. ULLME: A Unified Framework for Large Language Model Embeddings with Generation-Augmented LearningSystem Demonstrations3 citations
  42. UniSumEval: Towards Unified, Fine-grained, Multi-dimensional Summarization Evaluation for LLMsfinding3 citations
  43. Unveiling Factual Recall Behaviors of Large Language Models through Knowledge NeuronsMain3 citations
  44. Unveiling In-Context Learning: A Coordinate System to Understand Its Working MechanismMain3 citations
  45. Unveiling Multi-level and Multi-modal Semantic Representations in the Human Brain using Large Language ModelsMain3 citations
  46. VGA: Vision GUI Assistant - Minimizing Hallucinations through Image-Centric Fine-Tuningfinding3 citations
  47. VPL: Visual Proxy Learning Framework for Zero-Shot Medical Image Diagnosisfinding3 citations
  48. ValueScope: Unveiling Implicit Norms and Values via Return Potential Model of Social Interactionsfinding3 citations
  49. VideoCLIP-XL: Advancing Long Description Understanding for Video CLIP ModelsMain3 citations
  50. What do Large Language Models Need for Machine Translation Evaluation?Main3 citations
  51. What is “Typological Diversity” in NLP?Main3 citations
  52. When Reasoning Meets Information Aggregation: A Case Study with Sports NarrativesMain3 citations
  53. Where Am I From? Identifying Origin of LLM-generated ContentMain3 citations
  54. Where is the signal in tokenization space?Main3 citations
  55. Which questions should I answer? Salience Prediction of Inquisitive QuestionsMain3 citations
  56. Whiteboard-of-Thought: Thinking Step-by-Step Across ModalitiesMain3 citations
  57. Words Matter: Reducing Stigma in Online Conversations about Substance Use with Large Language ModelsMain3 citations
  58. Zero-Shot Cross-Lingual NER Using Phonemic Representations for Low-Resource LanguagesMain3 citations
  59. Zero-Shot Detection of LLM-Generated Text using Token CohesivenessMain3 citations
  60. Zero-Shot Fact Verification via Natural Logic and Large Language Modelsfinding3 citations
  61. “Any Other Thoughts, Hedgehog?” Linking Deliberation Chains in Collaborative Dialoguesfinding3 citations
  62. “Global is Good, Local is Bad?”: Understanding Brand Bias in LLMsMain3 citations
  63. “Knowing When You Don’t Know”: A Multilingual Relevance Assessment Dataset for Robust Retrieval-Augmented Generationfinding3 citations
  64. ”I Never Said That”: A dataset, taxonomy and baselines on response clarity classificationfinding3 citations
  65. ***YesBut***: A High-Quality Annotated Multimodal Dataset for evaluating Satire Comprehension capability of Vision-Language ModelsMain2 citations
  66. A Multi-Perspective Analysis of Memorization in Large Language ModelsMain2 citations
  67. A Semantic Search Engine for Mathlib4finding2 citations
  68. A Simple Angle-based Approach for Contrastive Learning of Unsupervised Sentence Representationfinding2 citations
  69. A Survey of AMR ApplicationsMain2 citations
  70. A linguistically-motivated evaluation methodology for unraveling model’s abilities in reading comprehension tasksMain2 citations
  71. AC-EVAL: Evaluating Ancient Chinese Language Understanding in Large Language Modelsfinding2 citations
  72. ALIGN-SIM: A Task-Free Test Bed for Evaluating and Interpreting Sentence Embeddings through Semantic Similarity Alignmentfinding2 citations
  73. ARES: Alternating Reinforcement Learning and Supervised Fine-Tuning for Enhanced Multi-Modal Chain-of-Thought Reasoning Through Diverse AI FeedbackMain2 citations
  74. ARTS: Assessing Readability & Text Simplicityfinding2 citations
  75. Active Learning for Abstractive Text Summarization via LLM-Determined Curriculum and Certainty Gain Maximizationfinding2 citations
  76. AdaSwitch: Adaptive Switching between Small and Large Agents for Effective Cloud-Local Collaborative LearningMain2 citations
  77. Adaptive Contrastive Search: Uncertainty-Guided Decoding for Open-Ended Text Generationfinding2 citations
  78. Aligners: Decoupling LLMs and Alignmentfinding2 citations
  79. An Empirical Analysis on Spatial Reasoning Capabilities of Large Multimodal ModelsMain2 citations
  80. An Empirical Study of Multilingual Reasoning Distillation for Question AnsweringMain2 citations
  81. An Evaluation Mechanism of LLM-based Agents on Manipulating APIsfinding2 citations
  82. An LLM Feature-based Framework for Dialogue Constructiveness AssessmentMain2 citations
  83. Analyzing Context Contributions in LLM-based Machine Translationfinding2 citations
  84. Analyzing Key Factors Influencing Emotion Prediction Performance of VLLMs in Conversational ContextsMain2 citations
  85. AutoRAG-HP: Automatic Online Hyper-Parameter Tuning for Retrieval-Augmented Generationfinding2 citations
  86. Automated Essay Scoring: A Reflection on the State of the ArtMain2 citations
  87. Automatically Generated Definitions and their utility for Modeling Word MeaningMain2 citations
  88. Autoregressive Multi-trait Essay Scoring via Reinforcement Learning with Scoring-aware Multiple RewardsMain2 citations
  89. Axis Tour: Word Tour Determines the Order of Axes in ICA-transformed Embeddingsfinding2 citations
  90. BLASER 2.0: a metric for evaluation and quality estimation of massively multilingual speech and text translationfinding2 citations
  91. BPE Gets Picky: Efficient Vocabulary Refinement During Tokenizer TrainingMain2 citations
  92. Beyond Correlation: Interpretable Evaluation of Machine Translation MetricsMain2 citations
  93. Bridging Modalities: Enhancing Cross-Modality Hate Speech Detection with Few-Shot In-Context LearningMain2 citations
  94. C3PA: An Open Dataset of Expert-Annotated and Regulation-Aware Privacy Policies to Enable Scalable Regulatory Compliance AuditsMain2 citations
  95. CERT-ED: Certifiably Robust Text Classification for Edit Distancefinding2 citations
  96. CHESS: Optimizing LLM Inference via Channel-Wise Thresholding and Selective SparsificationMain2 citations
  97. CHIRON: Rich Character Representations in Long-Form Narrativesfinding2 citations
  98. CItruS: Chunked Instruction-aware State Eviction for Long Sequence ModelingMain2 citations
  99. CMD: a framework for Context-aware Model self-DetoxificationMain2 citations
  100. CURE: Context- and Uncertainty-Aware Mental Disorder DetectionMain2 citations
  101. Can LLMs Understand the Implication of Emphasized Sentences in Dialogue?finding2 citations
  102. Can Large Language Models Understand DL-Lite Ontologies? An Empirical Studyfinding2 citations
  103. CasiMedicos-Arg: A Medical Question Answering Dataset Annotated with Explanatory Argumentative StructuresMain2 citations
  104. Causal Discovery Inspired Unsupervised Domain Adaptation for Emotion-Cause Pair Extractionfinding2 citations
  105. Characterizing Text Datasets with Psycholinguistic Featuresfinding2 citations
  106. CliMedBench: A Large-Scale Chinese Benchmark for Evaluating Medical Large Language Models in Clinical ScenariosMain2 citations
  107. Closing the Loop: Learning to Generate Writing Feedback via Language Model Simulated Student RevisionsMain2 citations
  108. Cluster-Norm for Unsupervised Probing of KnowledgeMain2 citations
  109. CoTAR: Chain-of-Thought Attribution Reasoning with Multi-level Granularityfinding2 citations
  110. Coffee-Gym: An Environment for Evaluating and Improving Natural Language Feedback on Erroneous CodeMain2 citations
  111. Commentator: A Code-mixed Multilingual Text Annotation FrameworkSystem Demonstrations2 citations
  112. CommonIT: Commonality-Aware Instruction Tuning for Large Language Models via Data PartitionsMain2 citations
  113. Commonsense Knowledge Editing Based on Free-Text in LLMsMain2 citations
  114. Concept Space Alignment in Multilingual LLMsMain2 citations
  115. Context-Aware Assistant Selection for Improved Inference Acceleration with Large Language ModelsMain2 citations
  116. ControlMath: Controllable Data Generation Promotes Math Generalist ModelsMain2 citations
  117. Controlling Risk of Retrieval-augmented Generation: A Counterfactual Prompting Frameworkfinding2 citations
  118. Cross-Lingual Multi-Hop Knowledge Editingfinding2 citations
  119. DA3: A Distribution-Aware Adversarial Attack against Language ModelsMain2 citations
  120. DAdEE: Unsupervised Domain Adaptation in Early Exit PLMsfinding2 citations
  121. DL-QAT: Weight-Decomposed Low-Rank Quantization-Aware Training for Large Language ModelsIndustry2 citations
  122. DVD: Dynamic Contrastive Decoding for Knowledge Amplification in Multi-Document Question AnsweringMain2 citations
  123. Debug Smarter, Not Harder: AI Agents for Error Resolution in Computational NotebooksSystem Demonstrations2 citations
  124. Deciphering the Interplay of Parametric and Non-parametric Memory in Retrieval-augmented Language ModelsMain2 citations
  125. Deeper Insights Without Updates: The Power of In-Context Learning Over Fine-Tuningfinding2 citations
  126. DetectBench: Can Large Language Model Detect and Piece Together Implicit Evidence?finding2 citations
  127. Detecting Errors through Ensembling Prompts (DEEP): An End-to-End LLM Framework for Detecting Factual ErrorsMain2 citations
  128. Detecting LLM-Assisted Cheating on Open-Ended Writing Tasks on Language Proficiency TestsIndustry2 citations
  129. Detecting Online Community Practices with Large Language Models: A Case Study of Pro-Ukrainian Publics on TwitterMain2 citations
  130. Detecting Temporal Ambiguity in Questionsfinding2 citations
  131. DetectiveNN: Imitating Human Emotional Reasoning with a Recall-Detect-Predict Framework for Emotion Recognition in Conversationsfinding2 citations
  132. Developing a Pragmatic Benchmark for Assessing Korean Legal Language Understanding in Large Language Modelsfinding2 citations
  133. Development of Cognitive Intelligence in Pre-trained Language ModelsMain2 citations
  134. Diversify, Rationalize, and Combine: Ensembling Multiple QA Strategies for Zero-shot Knowledge-based VQAfinding2 citations
  135. Do LLMs learn a true syntactic universal?Main2 citations
  136. Do great minds think alike? Investigating Human-AI Complementarity in Question Answering with CAIMIRAMain2 citations
  137. DocEdit-v2: Document Structure Editing Via Multimodal LLM GroundingMain2 citations
  138. Double-Checker: Large Language Model as a Checker for Few-shot Named Entity Recognitionfinding2 citations
  139. Draft on the Fly: Adaptive Self-Speculative Decoding using Cosine Similarityfinding2 citations
  140. E2CL: Exploration-based Error Correction Learning for Embodied Agentsfinding2 citations
  141. EDEN: Empathetic Dialogues for English Learningfinding2 citations
  142. ESC-Eval: Evaluating Emotion Support Conversations in Large Language ModelsMain2 citations
  143. EmoKnob: Enhance Voice Cloning with Fine-Grained Emotion ControlMain2 citations
  144. Emotion Granularity from Text: An Aggregate-Level Indicator of Mental HealthMain2 citations
  145. Enhancing Data Quality through Simple De-duplication: Navigating Responsible Computational Social Science ResearchMain2 citations
  146. Evaluating Biases in Context-Dependent Sexual and Reproductive Health Questionsfinding2 citations
  147. Evaluating Gender Bias of LLMs in Making Morality Judgementsfinding2 citations
  148. Evaluating Large Language Models along Dimensions of Language Variation: A Systematik Invesdigatiom uv Cross-lingual GeneralizationMain2 citations
  149. Evaluating Large Language Models via Linguistic ProfilingMain2 citations
  150. Evaluating Readability and Faithfulness of Concept-based ExplanationsMain2 citations
  151. Explaining Mixtures of Sources in News Articlesfinding2 citations
  152. Explicit, Implicit, and Scattered: Revisiting Event Extraction to Capture Complex ArgumentsMain2 citations
  153. Exploring Intrinsic Language-specific Subspaces in Fine-tuning Multilingual Neural Machine TranslationMain2 citations
  154. Exploring Space Efficiency in a Tree-based Linear Model for Extreme Multi-label ClassificationMain2 citations
  155. Exploring the Compositional Deficiency of Large Language Models in Mathematical Reasoning Through Trap ProblemsMain2 citations
  156. Exploring the Limits of Fine-grained LLM-based Physics Inference via Premise Removal Interventionsfinding2 citations
  157. Extending Context Window of Large Language Models from a Distributional PerspectiveMain2 citations
  158. FAC2E: Better Understanding Large Language Model Capabilities by Dissociating Language and CognitionMain2 citations
  159. FIRST: Faster Improved Listwise Reranking with Single Token DecodingMain2 citations
  160. FIZZ: Factual Inconsistency Detection by Zoom-in Summary and Zoom-out DocumentMain2 citations
  161. FactAlign: Long-form Factuality Alignment of Large Language Modelsfinding2 citations
  162. FairFlow: Mitigating Dataset Biases through Undecided Learning for Natural Language UnderstandingMain2 citations
  163. Few-shot clinical entity recognition in English, French and Spanish: masked language models outperform generative model promptingfinding2 citations
  164. Fine-Tuning Language Models on Multiple Datasets for Citation Intention Classificationfinding2 citations
  165. FineCops-Ref: A new Dataset and Task for Fine-Grained Compositional Referring Expression ComprehensionMain2 citations
  166. Gender Bias in Decision-Making with Large Language Models: A Study of Relationship Conflictsfinding2 citations
  167. GlobeSumm: A Challenging Benchmark Towards Unifying Multi-lingual, Cross-lingual and Multi-document News SummarizationMain2 citations
  168. Gloss2Text: Sign Language Gloss translation using LLMs and Semantically Aware Label Smoothingfinding2 citations
  169. Grounding Language in Multi-Perspective Referential CommunicationMain2 citations
  170. HELPD: Mitigating Hallucination of LVLMs by Hierarchical Feedback Learning with Vision-enhanced Penalty DecodingMain2 citations
  171. HiCuLR: Hierarchical Curriculum Learning for Rhetorical Role Labeling of Legal Documentsfinding2 citations
  172. Hierarchical Deconstruction of LLM Reasoning: A Graph-Based Framework for Analyzing Knowledge UtilizationMain2 citations
  173. How Far Can In-Context Alignment Go? Exploring the State of In-Context Alignmentfinding2 citations
  174. How Hard is this Test Set? NLI Characterization by Exploiting Training DynamicsMain2 citations
  175. Human-LLM Hybrid Text Answer Aggregation for Crowd AnnotationsMain2 citations
  176. HyQE: Ranking Contexts with Hypothetical Query Embeddingsfinding2 citations
  177. Hybrid-RACA: Hybrid Retrieval-Augmented Composition Assistance for Real-time Text PredictionIndustry2 citations
  178. HyperLoRA: Efficient Cross-task Generalization via Constrained Low-Rank Adapters Generationfinding2 citations
  179. ICON: Improving Inter-Report Consistency in Radiology Report Generation via Lesion-aware Mixup Augmentationfinding2 citations
  180. Improving Discriminative Capability of Reward Models in RLHF Using Contrastive LearningMain2 citations
  181. Improving Factual Consistency of News Summarization by Contrastive Preference Optimizationfinding2 citations
  182. In Defense of Structural Sparse Adapters for Concurrent LLM Servingfinding2 citations
  183. In-Context Compositional Generalization for Large Vision-Language ModelsMain2 citations
  184. In-context Contrastive Learning for Event Causality IdentificationMain2 citations
  185. Incubating Text Classifiers Following User Instruction with Nothing but LLMMain2 citations
  186. Inductive-Deductive Strategy Reuse for Multi-Turn Instructional DialoguesMain2 citations
  187. Inference-Time Decontamination: Reusing Leaked Benchmarks for Large Language Model Evaluationfinding2 citations
  188. Initialization of Large Language Models via Reparameterization to Mitigate Loss SpikesMain2 citations
  189. IntCoOp: Interpretability-Aware Vision-Language Prompt TuningMain2 citations
  190. InternalInspector I2: Robust Confidence Estimation in LLMs through Internal Statesfinding2 citations
  191. Investigating Multilingual Instruction-Tuning: Do Polyglot Models Demand for Multilingual Instructions?Main2 citations
  192. Investigating the Personality Consistency in Quantized Role-Playing Dialogue AgentsIndustry2 citations
  193. Is Compound Aspect-Based Sentiment Analysis Addressed by LLMs?finding2 citations
  194. Is GPT-4V (ision) All You Need for Automating Academic Data Visualization? Exploring Vision-Language Models’ Capability in Reproducing Academic Chartsfinding2 citations
  195. Is There a One-Model-Fits-All Approach to Information Extraction? Revisiting Task Definition Biasesfinding2 citations
  196. Jump Starting Bandits with LLM-Generated Prior KnowledgeMain2 citations
  197. KARL: Knowledge-Aware Retrieval and Representations aid Retention and Learning in StudentsMain2 citations
  198. Kiss up, Kick down: Exploring Behavioral Changes in Multi-modal Large Language Models with Assigned Visual PersonasMain2 citations
  199. Knowledge Verification to Nip Hallucination in the BudMain2 citations
  200. Knowledge-Centric Templatic Views of Documentsfinding2 citations
  201. Knowledge-Guided Dynamic Modality Attention Fusion Framework for Multimodal Sentiment Analysisfinding2 citations
  202. Knowledge-augmented Financial Market Analysis and Report GenerationIndustry2 citations
  203. Knowledge-based Consistency Testing of Large Language Modelsfinding2 citations
  204. LIONs: An Empirically Optimized Approach to Align Language ModelsMain2 citations
  205. LLM Explainability via Attributive Masking Learningfinding2 citations
  206. LLM See, LLM Do: Leveraging Active Inheritance to Target Non-Differentiable ObjectivesMain2 citations
  207. LLM-based Code-Switched Text Generation for Grammatical Error CorrectionMain2 citations
  208. LLMEdgeRefine: Enhancing Text Clustering with LLM-Based Boundary Point RefinementMain2 citations
  209. LLMs Are Zero-Shot Context-Aware Simultaneous TranslatorsMain2 citations
  210. LPZero: Language Model Zero-cost Proxy Search from Zerofinding2 citations
  211. Large Language Models Can Not Perform Well in Understanding and Manipulating Natural Language at Both Character and Word Levels?finding2 citations
  212. Large Language Models Know What To Say But Not When To Speakfinding2 citations
  213. Large Language Models are In-context Teachers for Knowledge Reasoningfinding2 citations
  214. Layer by Layer: Uncovering Where Multi-Task Learning Happens in Instruction-Tuned Large Language ModelsMain2 citations
  215. Learning Autonomous Driving Tasks via Human Feedbacks with Large Language Modelsfinding2 citations
  216. Learning to Correct for QA Reasoning with Black-box LLMsMain2 citations
  217. Learning to Paraphrase for Alignment with LLM Preferencefinding2 citations
  218. Let Me Teach You: Pedagogical Foundations of Feedback for Language ModelsMain2 citations
  219. Let the Expert Stick to His Last: Expert-Specialized Fine-Tuning for Sparse Architectural Large Language ModelsMain2 citations
  220. Leveraging Web-Crawled Data for High-Quality Fine-Tuningfinding2 citations
  221. LexC-Gen: Generating Data for Extremely Low-Resource Languages with Large Language Models and Bilingual Lexiconsfinding2 citations
  222. LexMatcher: Dictionary-centric Data Curation for LLM-based Machine Translationfinding2 citations
  223. Lifelong Event Detection via Optimal TransportMain2 citations
  224. Light-weight Fine-tuning Method for Defending Adversarial Noise in Pre-trained Medical Vision-Language Modelsfinding2 citations
  225. Long Sequence Modeling with Attention Tensorization: From Sequence to Tensor Learningfinding2 citations
  226. Losing Visual Needles in Image Haystacks: Vision Language Models are Easily Distracted in Short and Long Contextsfinding2 citations
  227. Lost in Translation: Chemical Language Models and the Misunderstanding of Molecule Structuresfinding2 citations
  228. Low-Resource Machine Translation through the Lens of Personalized Federated Learningfinding2 citations
  229. MAVEN-FACT: A Large-scale Event Factuality Detection Datasetfinding2 citations
  230. MELT: Materials-aware Continued Pre-training for Language Model Adaptation to Materials Sciencefinding2 citations
  231. MERLIN: Multimodal Embedding Refinement via LLM-based Iterative Navigation for Text-Video Retrieval-Rerank PipelineIndustry2 citations
  232. MORPHEUS: Modeling Role from Personalized Dialogue History by Exploring and Utilizing Latent SpaceMain2 citations
  233. MOSEL: Inference Serving Using Dynamic Modality SelectionMain2 citations
  234. Make Some Noise: Unlocking Language Model Parallel Inference Capability through Noisy TrainingMain2 citations
  235. Measuring and Improving Attentiveness to Partial Inputs with Counterfactualsfinding2 citations
  236. MedCare: Advancing Medical LLMs through Decoupling Clinical Alignment and Knowledge Aggregationfinding2 citations
  237. MedReadMe: A Systematic Study for Fine-grained Sentence Readability in Medical DomainMain2 citations
  238. Minimal Yet Big Impact: How AI Agent Back-channeling Enhances Conversational Engagement through Conversation Persistence and Context Richnessfinding2 citations
  239. Mirror-Consistency: Harnessing Inconsistency in Majority Votingfinding2 citations
  240. Mitigate Extrinsic Social Bias in Pre-trained Language Models via Continuous Prompts AdjustmentMain2 citations
  241. Mixture-of-Skills: Learning to Optimize Data Usage for Fine-Tuning Large Language ModelsMain2 citations
  242. Model Balancing Helps Low-data Training and Fine-tuningMain2 citations
  243. Modeling Layout Reading Order as Ordering Relations for Visually-rich Document UnderstandingMain2 citations
  244. Navigating Hallucinations for Reasoning of Unintentional Activitiesfinding2 citations
  245. Nebula: A discourse aware Minecraft Builderfinding2 citations
  246. NoiseBench: Benchmarking the Impact of Real Label Noise on Named Entity RecognitionMain2 citations
  247. On the Universal Truthfulness Hyperplane Inside LLMsMain2 citations
  248. Open-world Multi-label Text Classification with Extremely Weak SupervisionMain2 citations
  249. OpenSep: Leveraging Large Language Models with Textual Inversion for Open World Audio SeparationMain2 citations
  250. Optimized Speculative Sampling for GPU Hardware AcceleratorsMain2 citations
  251. Out-of-Distribution Detection through Soft Clustering with Non-Negative Kernel Regressionfinding2 citations
  252. P-FOLIO: Evaluating and Improving Logical Reasoning with Abundant Human-Written Reasoning Chainsfinding2 citations
  253. PALM: Few-Shot Prompt Learning for Audio Language ModelsMain2 citations
  254. PCQPR: Proactive Conversational Question Planning with ReflectionMain2 citations
  255. Pelican: Correcting Hallucination in Vision-LLMs via Claim Decomposition and Program of Thought VerificationMain2 citations
  256. Performance-Guided LLM Knowledge Distillation for Efficient Text Classification at ScaleMain2 citations
  257. Pioneering Reliable Assessment in Text-to-Image Knowledge Editing: Leveraging a Fine-Grained Dataset and an Innovative Criterionfinding2 citations
  258. Please note that I’m just an AI: Analysis of Behavior Patterns of LLMs in (Non-)offensive Speech IdentificationMain2 citations
  259. PolyWER: A Holistic Evaluation Framework for Code-Switched Speech Recognitionfinding2 citations
  260. PositionID: LLMs can Control Lengths, Copy and Paste with Explicit Positional Awarenessfinding2 citations
  261. PreAlign: Boosting Cross-Lingual Transfer by Early Establishment of Multilingual AlignmentMain2 citations
  262. Predicting generalization performance with correctness discriminatorsfinding2 citations
  263. Presentations are not always linear! GNN meets LLM for Text Document-to-Presentation Transformation with Attributionfinding2 citations
  264. Preserving Pre-trained Representation Space: On Effectiveness of Prefix-tuning for Large Multi-modal Modelsfinding2 citations
  265. ProConSuL: Project Context for Code Summarization with LLMsIndustry2 citations
  266. Promoting Constructive Deliberation: Reframing for Receptivenessfinding2 citations
  267. PsyGUARD: An Automated System for Suicide Detection and Risk Assessment in Psychological CounselingMain2 citations
  268. QGEval: Benchmarking Multi-dimensional Evaluation for Question GenerationMain2 citations
  269. QuBE: Question-based Belief Enhancement for Agentic LLM ReasoningMain2 citations
  270. Quantum Recurrent Architectures for Text ClassificationMain2 citations
  271. Query Routing for Homogeneous Tools: An Instantiation in the RAG Scenariofinding2 citations
  272. RAFT: Realistic Attacks to Fool Text DetectorsMain2 citations
  273. Re-examining Sexism and Misogyny Classification with Annotator Attitudesfinding2 citations
  274. RealVul: Can We Detect Vulnerabilities in Web Applications with LLM?Main2 citations
  275. Reconstruct Your Previous Conversations! Comprehensively Investigating Privacy Leakage Risks in Conversations with GPT ModelsMain2 citations
  276. Reference-based Metrics Disprove Themselves in Question Generationfinding2 citations
  277. Remember This Event That Year? Assessing Temporal Information and Understanding in Large Language Modelsfinding2 citations
  278. RepEval: Effective Text Evaluation with LLM RepresentationMain2 citations
  279. ReportGPT: Human-in-the-loop Verifiable Table-to-Text GenerationIndustry2 citations
  280. Resampled Datasets Are Not Enough: Mitigating Societal Bias Beyond Single AttributesMain2 citations
  281. Rethinking Pragmatics in Large Language Models: Towards Open-Ended Evaluation and Preference TuningMain2 citations
  282. Retrieval-Augmented Code Generation for Situated Action Generation: A Case Study on Minecraftfinding2 citations
  283. Reward Difference Optimization For Sample Reweighting In Offline RLHFfinding2 citations
  284. RoQLlama: A Lightweight Romanian Adapted Language Modelfinding2 citations
  285. Ruler: A Model-Agnostic Method to Control Generated Length for Large Language Modelsfinding2 citations
  286. SAFETY-J: Evaluating Safety with Critiquefinding2 citations
  287. SHIELD: LLM-Driven Schema Induction for Predictive Analytics in EV Battery Supply Chain DisruptionsIndustry2 citations
  288. SLANG: New Concept Comprehension of Large Language ModelsMain2 citations
  289. Scaling Laws Across Model Architectures: A Comparative Analysis of Dense and MoE Models in Large Language ModelsMain2 citations
  290. Scaling Synthetic Logical Reasoning Datasets with Context-Sensitive Declarative GrammarsMain2 citations
  291. ScalingFilter: Assessing Data Quality through Inverse Utilization of Scaling LawsMain2 citations
  292. SciDQA: A Deep Reading Comprehension Dataset over Scientific PapersMain2 citations
  293. Securing Multi-turn Conversational Language Models From Distributed Backdoor Attacksfinding2 citations
  294. See Detail Say Clear: Towards Brain CT Report Generation via Pathological Clue-driven Representation Learningfinding2 citations
  295. Self-training Language Models for Arithmetic Reasoningfinding2 citations
  296. Shaking Up VLMs: Comparing Transformers and Structured State Space Models for Vision & Language ModelingMain2 citations
  297. Should Cross-Lingual AMR Parsing go Meta? An Empirical Assessment of Meta-Learning and Joint Learning AMR Parsingfinding2 citations
  298. SimLLM: Detecting Sentences Generated by Large Language Models Using Similarity between the Generation and its Re-generationMain2 citations
  299. Socratic Human Feedback (SoHF): Expert Steering Strategies for LLM Code Generationfinding2 citations
  300. Speaking in Wavelet Domain: A Simple and Efficient Approach to Speed up Speech Diffusion ModelMain2 citations
  301. SpecHub: Provable Acceleration to Multi-Draft Speculative DecodingMain2 citations
  302. Subword Segmentation in LLMs: Looking at Inflection and ConsistencyMain2 citations
  303. Successfully Guiding Humans with Imperfect Instructions by Highlighting Potential Errors and Suggesting CorrectionsMain2 citations
  304. Synthetic Knowledge Ingestion: Towards Knowledge Refinement and Injection for Enhancing Large Language ModelsMain2 citations
  305. TKGT: Redefinition and A New Way of Text-to-Table Tasks Based on Real World Demands and Knowledge Graphs Augmented LLMsMain2 citations
  306. TRoTR: A Framework for Evaluating the Re-contextualization of Text ReuseMain2 citations
  307. Table Question Answering for Low-resourced Indic LanguagesMain2 citations
  308. Take Off the Training Wheels! Progressive In-Context Learning for Effective AlignmentMain2 citations
  309. Taking a Deep Breath: Enhancing Language Modeling of Large Language Models with Sentinel Tokensfinding2 citations
  310. Taylor Unswift: Secured Weight Release for Large Language Models via Taylor ExpansionMain2 citations
  311. Temporally Consistent Factuality Probing for Large Language ModelsMain2 citations
  312. Textual Dataset Distillation via Language Model Embeddingfinding2 citations
  313. The Best Defense is Attack: Repairing Semantics in Textual Adversarial ExamplesMain2 citations
  314. The Illusion of Competence: Evaluating the Effect of Explanations on Users’ Mental Models of Visual Question Answering SystemsMain2 citations
  315. The Language of Trauma: Modeling Traumatic Event Descriptions Across Domains with Explainable AIfinding2 citations
  316. The State of the Art of Large Language Models on Chartered Financial Analyst ExamsIndustry2 citations
  317. Threshold-driven Pruning with Segmented Maximum Term Weights for Approximate Cluster-based Sparse RetrievalMain2 citations
  318. TimeR4 : Time-aware Retrieval-Augmented Large Language Models for Temporal Knowledge Graph Question AnsweringMain2 citations
  319. To Ask LLMs about English Grammaticality, Prompt Them in a Different Languagefinding2 citations
  320. TongGu: Mastering Classical Chinese Understanding with Knowledge-Grounded Large Language Modelsfinding2 citations
  321. ToolPlanner: A Tool Augmented LLM for Multi Granularity Instructions with Path Planning and FeedbackMain2 citations
  322. Toward Compositional Behavior in Neural Models: A Survey of Current ViewsMain2 citations
  323. Tree of Problems: Improving structured problem solving with compositionalityMain2 citations
  324. Turn Waste into Worth: Rectifying Top-k Router of MoEMain2 citations
  325. UNO Arena for Evaluating Sequential Decision-Making Capability of Large Language ModelsMain2 citations
  326. Uncertainty Calibration for Tool-Using Language Agentsfinding2 citations
  327. Unlocking Black-Box Prompt Tuning Efficiency via Zeroth-Order Optimizationfinding2 citations
  328. Unveiling Implicit Table Knowledge with Question-Then-Pinpoint Reasoner for Insightful Table Summarizationfinding2 citations
  329. Updating CLIP to Prefer Descriptions Over CaptionsMain2 citations
  330. Visual Editing with LLM-based Tool Chaining: An Efficient Distillation Approach for Real-Time ApplicationsIndustry2 citations
  331. Visual Text Matters: Improving Text-KVQA with Visual Text Entity Knowledge-aware Large Multimodal AssistantMain2 citations
  332. Waterfall: Scalable Framework for Robust Text Watermarking and Provenance for LLMsMain2 citations
  333. What Are the Odds? Language Models Are Capable of Probabilistic ReasoningMain2 citations
  334. What Matters in Memorizing and Recalling Facts? Multifaceted Benchmarks for Knowledge Probing in Language Modelsfinding2 citations
  335. What is lost in Normalization? Exploring Pitfalls in Multilingual ASR Model EvaluationsMain2 citations
  336. Who’s Who: Large Language Models Meet Knowledge Conflicts in Practicefinding2 citations
  337. i-Code Studio: A Configurable and Composable Framework for Integrative AISystem Demonstrations2 citations
  338. “Image, Tell me your story!” Predicting the original meta-context of visual misinformationMain2 citations
  339. “In-Dialogues We Learn”: Towards Personalized Dialogue Without Pre-defined Profiles through In-Dialogue LearningMain2 citations
  340. A Coarse-to-Fine Prototype Learning Approach for Multi-Label Few-Shot Intent Detectionfinding1 citations
  341. A Comparison of Language Modeling and Translation as Multilingual Pretraining ObjectivesMain1 citations
  342. A Decoding Algorithm for Length-Control Summarization Based on Directed Acyclic Transformersfinding1 citations
  343. A Fairness-Driven Method for Learning Human-Compatible Negotiation Strategiesfinding1 citations
  344. A Fast and Sound Tagging Method for Discontinuous Named-Entity RecognitionMain1 citations
  345. A Hassle-free Algorithm for Strong Differential Privacy in Federated Learning SystemsIndustry1 citations
  346. A Morphology-Based Investigation of Positional EncodingsMain1 citations
  347. A New Pipeline for Knowledge Graph Reasoning Enhanced by Large Language Models Without Fine-TuningMain1 citations
  348. A Novel Metric for Measuring the Robustness of Large Language Models in Non-adversarial Scenariosfinding1 citations
  349. A Robust Dual-debiasing VQA Model based on Counterfactual Causal Effectfinding1 citations
  350. A Study of Nationality Bias in Names and Perplexity using Off-the-Shelf Affect-related Tweet ClassifiersMain1 citations
  351. A Study of Parameter Efficient Fine-tuning by Learning to Efficiently Fine-Tunefinding1 citations
  352. A Systematic Analysis of Large Language Models as Soft Reasoners: The Case of Syllogistic InferencesMain1 citations
  353. ACCEPT: Adaptive Codebook for Composite and Efficient Prompt Tuningfinding1 citations
  354. AHP-Powered LLM Reasoning for Multi-Criteria Evaluation of Open-Ended Responsesfinding1 citations
  355. ASL STEM Wiki: Dataset and Benchmark for Interpreting STEM ArticlesMain1 citations
  356. Abstraction-of-Thought Makes Language Models Better Reasonersfinding1 citations
  357. Accurate and Data-Efficient Toxicity Prediction when Annotators DisagreeMain1 citations
  358. Adaptable Moral Stances of Large Language Models on Sexist Content: Implications for Society and Gender DiscourseMain1 citations
  359. Adaptation Odyssey in LLMs: Why Does Additional Pretraining Sometimes Fail to Improve?Main1 citations
  360. Adapters Mixup: Mixing Parameter-Efficient Adapters to Enhance the Adversarial Robustness of Fine-tuned Pre-trained Text ClassifiersMain1 citations
  361. Adapting LLMs for Structured Natural Language API IntegrationIndustry1 citations
  362. Adaptive Query Rewriting: Aligning Rewriters through Marginal Probability of Conversational AnswersMain1 citations
  363. Advancing Vision-Language Models with Adapter Ensemble Strategiesfinding1 citations
  364. Aegis:An Advanced LLM-Based Multi-Agent for Intelligent Functional Safety EngineeringIndustry1 citations
  365. AliGATr: Graph-based layout generation for form understandingfinding1 citations
  366. AlignCap: Aligning Speech Emotion Captioning to Human PreferencesMain1 citations
  367. AlignSum: Data Pyramid Hierarchical Fine-tuning for Aligning with Human Summarization Preferencefinding1 citations
  368. AlignedCoT: Prompting Large Language Models via Native-Speaking Demonstrationsfinding1 citations
  369. AmazonQAC: A Large-Scale, Naturalistic Query Autocomplete DatasetIndustry1 citations
  370. An Analysis of Multilingual FActScoreMain1 citations
  371. An Instruction Tuning-Based Contrastive Learning Framework for Aspect Sentiment Quad Prediction with Implicit Aspects and Opinionsfinding1 citations
  372. An Inversion Attack Against Obfuscated Embedding Matrix in Language Model InferenceMain1 citations
  373. An LLM-Enabled Knowledge Elicitation and Retrieval Framework for Zero-Shot Cross-Lingual Stance Identificationfinding1 citations
  374. Analysis of Plan-based Retrieval for Grounded Text GenerationMain1 citations
  375. Are LLMs Aware that Some Questions are not Open-ended?finding1 citations
  376. Are Large Language Models Good Classifiers? A Study on Edit Intent Classification in Scientific Document RevisionsMain1 citations
  377. Are modern neural ASR architectures robust for polysynthetic languages?finding1 citations
  378. Attacks against Abstractive Text Summarization Models through Lead Bias and Influence Functionsfinding1 citations
  379. Audio-Based Linguistic Feature Extraction for Enhancing Multi-lingual and Low-Resource Text-to-Speechfinding1 citations
  380. AudioVSR: Enhancing Video Speech Recognition with Audio DataMain1 citations
  381. Auto-Evolve: Enhancing Large Language Model’s Performance via Self-Reasoning Frameworkfinding1 citations
  382. AutoPersuade: A Framework for Evaluating and Explaining Persuasive ArgumentsMain1 citations
  383. AutoTrain: No-code training for state-of-the-art modelsSystem Demonstrations1 citations
  384. Automatic sentence segmentation of clinical record narratives in real-world dataMain1 citations
  385. Autoregressive Pre-Training on Pixels and TextsMain1 citations
  386. BSharedRAG: Backbone Shared Retrieval-Augmented Generation for the E-commerce Domainfinding1 citations
  387. Back to School: Translation Using Grammar BooksMain1 citations
  388. BadFair: Backdoored Fairness Attacks with Group-conditioned Triggersfinding1 citations
  389. BanglaTLit: A Benchmark Dataset for Back-Transliteration of Romanized Banglafinding1 citations
  390. Beyond Agreement: Diagnosing the Rationale Alignment of Automated Essay Scoring Methods based on Linguistically-informed Counterfactualsfinding1 citations
  391. Beyond Embeddings: The Promise of Visual Table in Visual ReasoningMain1 citations
  392. Beyond Label Attention: Transparency in Language Models for Automated Medical Coding via Dictionary LearningMain1 citations
  393. Beyond Reference: Evaluating High Quality Translations Better than Human ReferencesMain1 citations
  394. Bi-DCSpell: A Bi-directional Detector-Corrector Interactive Framework for Chinese Spelling Checkfinding1 citations
  395. BiasWipe: Mitigating Unintended Bias in Text Classifiers through Model InterpretabilityMain1 citations
  396. Bio-RFX: Refining Biomedical Extraction via Advanced Relation Classification and Structural ConstraintsMain1 citations
  397. Block-Diagonal Orthogonal Relation and Matrix Entity for Knowledge Graph Embeddingfinding1 citations
  398. BoolQuestions: Does Dense Retrieval Understand Boolean Logic in Language?finding1 citations
  399. Boosting Logical Fallacy Reasoning in LLMs via Logical Structure TreeMain1 citations
  400. Breaking ReLU Barrier: Generalized MoEfication for Dense Pretrained ModelsMain1 citations
  401. Breaking the Hourglass Phenomenon of Residual Quantization: Enhancing the Upper Bound of Generative RetrievalIndustry1 citations
  402. Bridging Cultures in the Kitchen: A Framework and Benchmark for Cross-Cultural Recipe RetrievalMain1 citations
  403. Building Resources for Emakhuwa: Machine Translation and News Classification BenchmarksMain1 citations
  404. Building an Efficient Multilingual Non-Profit IR System for the Islamic Domain Leveraging Multiprocessing Design in RustIndustry1 citations
  405. CHAmbi: A New Benchmark on Chinese Ambiguity Challenges for Large Language Modelsfinding1 citations
  406. CMR Scaling Law: Predicting Critical Mixture Ratios for Continual Pre-training of Language ModelsMain1 citations
  407. CROWD: Certified Robustness via Weight Distribution for Smoothed Classifiers against Backdoor Attackfinding1 citations
  408. CaT-Bench: Benchmarking Language Model Understanding of Causal and Temporal Dependencies in PlansMain1 citations
  409. Can Active Label Correction Improve LLM-based Modular AI Systems?Main1 citations
  410. Can LLMs Learn From Mistakes? An Empirical Study on Reasoning Tasksfinding1 citations
  411. Can Language Models Induce Grammatical Knowledge from Indirect Evidence?Main1 citations
  412. Can Large Language Models Enhance Predictions of Disease Progression? Investigating Through Disease Network Link PredictionMain1 citations
  413. Can Machines Resonate with Humans? Evaluating the Emotional and Empathic Comprehension of LMsfinding1 citations
  414. Can Textual Unlearning Solve Cross-Modality Safety Alignment?finding1 citations
  415. Can We Instruct LLMs to Compensate for Position Bias?finding1 citations
  416. CapEEN: Image Captioning with Early Exits and Knowledge Distillationfinding1 citations
  417. Chain and Causal Attention for Efficient Entity TrackingMain1 citations
  418. Chain-of-Rewrite: Aligning Question and Documents for Open-Domain Question Answeringfinding1 citations
  419. ChatGPT Doesn’t Trust Chargers Fans: Guardrail Sensitivity in ContextMain1 citations
  420. ClaimLens: Automated, Explainable Fact-Checking on Voting Claims Using Frame-SemanticsSystem Demonstrations1 citations
  421. CmdCaliper: A Semantic-Aware Command-Line Embedding Model and Dataset for Security ResearchMain1 citations
  422. CoCoHD: Congress Committee Hearing Datasetfinding1 citations
  423. CoCoST: Automatic Complex Code Generation with Online Searching and Correctness TestingMain1 citations
  424. CoGen: Learning from Feedback with Coupled Comprehension and GenerationMain1 citations
  425. CoXQL: A Dataset for Parsing Explanation Requests in Conversational XAI Systemsfinding1 citations
  426. CodeFort: Robust Training for Code Generation Modelsfinding1 citations
  427. Communicate to Play: Pragmatic Reasoning for Efficient Cross-Cultural Communicationfinding1 citations
  428. Compare without Despair: Reliable Preference Evaluation with Generation Separabilityfinding1 citations
  429. Comparing Neighbors Together Makes it Easy: Jointly Comparing Multiple Candidates for Efficient and Effective RetrievalMain1 citations
  430. Comparing a BERT Classifier and a GPT classifier for Detecting Connective Language Across Multiple Social MediaMain1 citations
  431. ConTReGen: Context-driven Tree-structured Retrieval for Open-domain Long-form Text Generationfinding1 citations
  432. Contextualized Graph Representations for Generating Counter-Narratives against Hate Speechfinding1 citations
  433. Continual Test-time Adaptation for End-to-end Speech Recognition on Noisy SpeechMain1 citations
  434. Contrastive Entity Coreference and Disambiguation for Historical TextsMain1 citations
  435. Control Large Language Models via Divide and ConquerMain1 citations
  436. CorrSynth - A Correlated Sampling Method for Diverse Dataset Generation from LLMsMain1 citations
  437. Cost-Performance Optimization for Processing Low-Resource Language Tasks Using Commercial LLMsfinding1 citations
  438. CoverICL: Selective Annotation for In-Context Learning via Active Graph CoverageMain1 citations
  439. Cross-Lingual Unlearning of Selective Knowledge in Multilingual Language Modelsfinding1 citations
  440. DC-Instruct: An Effective Framework for Generative Multi-intent Spoken Language UnderstandingMain1 citations
  441. DEM: Distribution Edited Model for Training with Mixed Data DistributionsMain1 citations
  442. DISCERN: Decoding Systematic Errors in Natural Language for Text ClassifiersMain1 citations
  443. DKEC: Domain Knowledge Enhanced Multi-Label Classification for Diagnosis PredictionMain1 citations
  444. Dancing in Chains: Reconciling Instruction Following and Faithfulness in Language ModelsMain1 citations
  445. Datasets for Multilingual Answer Sentence Selectionfinding1 citations
  446. De-Identification of Sensitive Personal Data in Datasets Derived from IIT-CDIPMain1 citations
  447. Debiasing Text Safety Classifiers through a Fairness-Aware EnsembleIndustry1 citations
  448. Deciphering Rumors: A Multi-Task Learning Approach with Intent-aware Hierarchical Contrastive LearningMain1 citations
  449. Decoding Susceptibility: Modeling Misbelief to Misinformation Through a Computational ApproachMain1 citations
  450. DeepPavlov 1.0: Your Gateway to Advanced NLP Models Backed by Transformers and Transfer LearningSystem Demonstrations1 citations
  451. Denoising Rationalization for Multi-hop Fact Verification via Multi-granular Explainerfinding1 citations
  452. Detecting Machine-Generated Long-Form Content with Latent-Space Variablesfinding1 citations
  453. DetoxLLM: A Framework for Detoxification with ExplanationsMain1 citations
  454. Dial BeInfo for Faithfulness: Improving Factuality of Information-Seeking Dialogue via Behavioural Fine-Tuningfinding1 citations
  455. Difficult Task Yes but Simple Task No: Unveiling the Laziness in Multimodal LLMsfinding1 citations
  456. Disordered-DABS: A Benchmark for Dynamic Aspect-Based Summarization in Disordered Textsfinding1 citations
  457. Distilling Knowledge from Text-to-Image Generative Models Improves Visio-Linguistic Reasoning in CLIPMain1 citations
  458. Diverse and Effective Synthetic Data Generation for Adaptable Zero-Shot Dialogue State Trackingfinding1 citations
  459. Divide and Conquer Radiology Report Generation via Observation Level Fine-grained Pretraining and Prompt TuningMain1 citations
  460. Do LLMs Know to Respect Copyright Notice?Main1 citations
  461. Do Large Language Models Know How Much They Know?Main1 citations
  462. Do Text-to-Vis Benchmarks Test Real Use of Visualisations?Main1 citations
  463. DocHieNet: A Large and Diverse Dataset for Document Hierarchy ParsingMain1 citations
  464. Document Hashing with Multi-Grained Prototype-Induced Hierarchical Generative Modelfinding1 citations
  465. Domain adapted machine translation: What does catastrophic forgetting forget and why?Main1 citations
  466. Downstream Trade-offs of a Family of Text Watermarksfinding1 citations
  467. Dual-oriented Disentangled Network with Counterfactual Intervention for Multimodal Intent DetectionMain1 citations
  468. Dynamic Multi-Reward Weighting for Multi-Style Controllable GenerationMain1 citations
  469. DynamicER: Resolving Emerging Mentions to Dynamic Entities for RAGMain1 citations
  470. EAVE: Efficient Product Attribute Value Extraction via Lightweight Sparse-layer Interactionfinding1 citations
  471. ECON: On the Detection and Resolution of Evidence ConflictsMain1 citations
  472. Edit-Constrained Decoding for Sentence Simplificationfinding1 citations
  473. Effective Demonstration Annotation for In-Context Learning via Language Model-Based Determinantal Point ProcessMain1 citations
  474. Effective Synthetic Data and Test-Time Adaptation for OCR CorrectionMain1 citations
  475. Efficient Performance Tracking: Leveraging Large Language Models for Automated Construction of Scientific LeaderboardsMain1 citations
  476. Efficient Sequential Decision Making with Large Language ModelsMain1 citations
  477. Embedded Named Entity Recognition using Probing ClassifiersMain1 citations
  478. Embedding and Gradient Say Wrong: A White-Box Method for Hallucination DetectionMain1 citations
  479. EmbodiedBERT: Cognitively Informed Metaphor Detection Incorporating Sensorimotor Informationfinding1 citations
  480. Encoding Spreadsheets for Large Language ModelsMain1 citations
  481. Enhancing Emotion-Cause Pair Extraction in Conversations via Center Event Detection and Reasoningfinding1 citations
  482. Enhancing Healthcare LLM Trust with Atypical Presentations Recalibrationfinding1 citations
  483. Enhancing Large Language Model Based Sequential Recommender Systems with Pseudo Labels Reconstructionfinding1 citations
  484. Enhancing Multi-Label Text Classification under Label-Dependent Noise: A Label-Specific Denoising Frameworkfinding1 citations
  485. Entity Insertion in Multilingual Linked Corpora: The Case of WikipediaMain1 citations
  486. Entity or Relation Embeddings? An Analysis of Encoding Strategies for Relation Extractionfinding1 citations
  487. Error Analysis of Multilingual Language Models in Machine Translation: A Case Study of English-Amharic TranslationMain1 citations
  488. Evaluating Automatic Metrics with Incremental Machine Translation Systemsfinding1 citations
  489. Evaluating Concurrent Robustness of Language Models Across Diverse Challenge SetsMain1 citations
  490. Evaluating LLMs for Targeted Concept Simplification for Domain-Specific TextsMain1 citations
  491. Evaluating Language Model Character Traitsfinding1 citations
  492. Event Causality Identification with Synthetic ControlMain1 citations
  493. ExpertEase: A Multi-Agent Framework for Grade-Specific Document Simplification with Large Language Modelsfinding1 citations
  494. Explicit Inductive Inference using Large Language Modelsfinding1 citations
  495. Exploring Intra and Inter-language Consistency in Embeddings with ICAMain1 citations
  496. Exploring Nested Named Entity Recognition with Large Language Models: Methods, Challenges, and InsightsMain1 citations
  497. Exploring the Potential of Multimodal LLM with Knowledge-Intensive Multimodal ASRfinding1 citations
  498. Exploring the Role of Reasoning Structures for Constructing Proofs in Multi-Step Natural Language Reasoning with Large Language ModelsMain1 citations
  499. FAME: Towards Factual Multi-Task Model EditingMain1 citations
  500. FANTAstic SEquences and Where to Find Them: Faithful and Efficient API Call Generation through State-tracked Constrained Decoding and Rerankingfinding1 citations
  501. FOOL ME IF YOU CAN! An Adversarial Dataset to Investigate the Robustness of LMs in Word Sense DisambiguationMain1 citations
  502. Faithful and Plausible Natural Language Explanations for Image Classification: A Pipeline Approachfinding1 citations
  503. FanLoRA: Fantastic LoRAs and Where to Find Them in Large Language Model Fine-tuningIndustry1 citations
  504. Few-shot Prompting for Pairwise Ranking: An Effective Non-Parametric Retrieval Modelfinding1 citations
  505. Fewer is More: Boosting Math Reasoning with Reinforced Context PruningMain1 citations
  506. FinDVer: Explainable Claim Verification over Long and Hybrid-content Financial DocumentsMain1 citations
  507. Financial Forecasting from Textual and Tabular Time Seriesfinding1 citations
  508. Fine-Tuning Language Models with Differential Privacy through Adaptive Noise Allocationfinding1 citations
  509. Fisher Information-based Efficient Curriculum Federated Learning with Large Language ModelsMain1 citations
  510. Flee the Flaw: Annotating the Underlying Logic of Fallacious Arguments Through Templates and Slot-fillingMain1 citations
  511. Fool Me Once? Contrasting Textual and Visual Explanations in a Clinical Decision-Support SettingMain1 citations
  512. Forecasting Future International Events: A Reliable Dataset for Text-Based Event Modelingfinding1 citations
  513. Forgetting Curve: A Reliable Method for Evaluating Memorization Capability for Long-Context ModelsMain1 citations
  514. Formality is Favored: Unraveling the Learning Preferences of Large Language Models on Data with Conflicting KnowledgeMain1 citations
  515. From Test-Taking to Test-Making: Examining LLM Authoring of Commonsense Assessment Itemsfinding1 citations
  516. From Text Segmentation to Enhanced Representation Learning: A Novel Approach to Multi-Label Classification for Long Textsfinding1 citations
  517. Fusion-Eval: Integrating Assistant Evaluators with LLMsIndustry1 citations
  518. FuxiTranyu: A Multilingual Large Language Model Trained with Balanced DataIndustry1 citations
  519. GE2PE: Persian End-to-End Grapheme-to-Phoneme Conversionfinding1 citations
  520. GLaPE: Gold Label-agnostic Prompt Evaluation for Large Language ModelsMain1 citations
  521. GOVERN: Gradient Orientation Vote Ensemble for Multi-Teacher Reinforced DistillationIndustry1 citations
  522. Generalizing Clinical De-identification Models by Privacy-safe Data Augmentation using GPT-4Main1 citations
  523. Generate then Refine: Data Augmentation for Zero-shot Intent Detectionfinding1 citations
  524. Generative Subgraph Retrieval for Knowledge Graph–Grounded Dialog GenerationMain1 citations
  525. Global Reward to Local Rewards: Multimodal-Guided Decomposition for Improving Dialogue AgentsMain1 citations
  526. Grounding Partially-Defined Events in Multimodal Datafinding1 citations
  527. GuardBench: A Large-Scale Benchmark for Guardrail ModelsMain1 citations
  528. Guided Knowledge Generation with Language Models for Commonsense Reasoningfinding1 citations
  529. Guided Profile Generation Improves Personalization with Large Language Modelsfinding1 citations
  530. HateCOT: An Explanation-Enhanced Dataset for Generalizable Offensive Speech Detection via Large Language Modelsfinding1 citations
  531. How Does the Disclosure of AI Assistance Affect the Perceptions of Writing?Main1 citations
  532. I Could’ve Asked That: Reformulating Unanswerable QuestionsMain1 citations
  533. I Need Help! Evaluating LLM’s Ability to Ask for Users’ Support: A Case Study on Text-to-SQL GenerationMain1 citations
  534. I love pineapple on pizza != I hate pineapple on pizza: Stance-Aware Sentence Transformers for Opinion MiningMain1 citations
  535. I-AM-G: Interest Augmented Multimodal Generator for Item PersonalizationMain1 citations
  536. IFCap: Image-like Retrieval and Frequency-based Entity Filtering for Zero-shot CaptioningMain1 citations
  537. Improve Meta-learning for Few-Shot Text Classification with All You Can Acquire from the Tasksfinding1 citations
  538. Improving Adversarial Robustness in Vision-Language Models with Architecture and Prompt Designfinding1 citations
  539. Improving Knowledge Graph Completion with Structure-Aware Supervised Contrastive LearningMain1 citations
  540. Improving LLM Attributions with Randomized Path-Integrationfinding1 citations
  541. Improving Multilingual Instruction Finetuning via Linguistically Natural and Diverse Datasetsfinding1 citations
  542. Improving Referring Ability for Biomedical Language Modelsfinding1 citations
  543. Improving Retrieval in Sponsored Search by Leveraging Query Context SignalsIndustry1 citations
  544. Improving Spoken Language Modeling with Phoneme Classification: A Simple Fine-tuning ApproachMain1 citations
  545. In2Core: Leveraging Influence Functions for Coreset Selection in Instruction Finetuning of Large Language Modelsfinding1 citations
  546. Incorporating Precedents for Legal Judgement Prediction on European Court of Human Rights Casesfinding1 citations
  547. Information Parity: Measuring and Predicting the Multilingual Capabilities of Language Modelsfinding1 citations
  548. Infrared-LLaVA: Enhancing Understanding of Infrared Images in Multi-Modal Large Language Modelsfinding1 citations
  549. Integrating Structural Semantic Knowledge for Enhanced Information Extraction Pre-trainingMain1 citations
  550. Intended Target Identification for Anomia Patients with Gradient-based Selective Augmentationfinding1 citations
  551. Interpretability-based Tailored Knowledge Editing in TransformersMain1 citations
  552. Interpreting Context Look-ups in Transformers: Investigating Attention-MLP InteractionsMain1 citations
  553. Interventional Speech Noise Injection for ASR Generalizable Spoken Language UnderstandingMain1 citations
  554. Introducing Spatial Information and a Novel Evaluation Scheme for Open-Domain Live Commentary Generationfinding1 citations
  555. Investigating and Mitigating Object Hallucinations in Pretrained Vision-Language (CLIP) ModelsMain1 citations
  556. Is It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models?Main1 citations
  557. Is This a Bad Table? A Closer Look at the Evaluation of Table Generation from TextMain1 citations
  558. Joint Pre-Encoding Representation and Structure Embedding for Efficient and Low-Resource Knowledge Graph CompletionMain1 citations
  559. KMatrix: A Flexible Heterogeneous Knowledge Enhancement Toolkit for Large Language ModelSystem Demonstrations1 citations
  560. KNN-Instruct: Automatic Instruction Construction with K Nearest Neighbor DeductionMain1 citations
  561. Knowledge-Centric Hallucination DetectionMain1 citations
  562. KorSmishing Explainer: A Korean-centric LLM-based Framework for Smishing Detection and Explanation GenerationIndustry1 citations
  563. LEGOBench: Scientific Leaderboard Generation Benchmarkfinding1 citations
  564. LLM-Evolve: Evaluation for LLM’s Evolving Capability on BenchmarksMain1 citations
  565. LLM-supertagger: Categorial Grammar Supertagging via Large Language Modelsfinding1 citations
  566. LLMs as Collaborator: Demands-Guided Collaborative Retrieval-Augmented Generation for Commonsense Knowledge-Grounded Open-Domain Dialogue Systemsfinding1 citations
  567. LLMs to Replace Crowdsourcing For Parallel Data Creation? The Case of Text Detoxificationfinding1 citations
  568. LM-Interview: An Easy-to-use Smart Interviewer System via Knowledge-guided Language Model ExploitationSystem Demonstrations1 citations
  569. LM2: A Simple Society of Language Models Solves Complex ReasoningMain1 citations
  570. LaRS: Latent Reasoning Skills for Chain-of-Thought Reasoningfinding1 citations
  571. Label Confidence Weighted Learning for Target-level Sentence SimplificationMain1 citations
  572. Language Concept Erasure for Language-invariant Dense RetrievalMain1 citations
  573. Large Language Model for Multi-Domain Translation: Benchmarking and Domain CoT Fine-tuningfinding1 citations
  574. Large Language Models Are Challenged by Habitat-Centered Reasoningfinding1 citations
  575. Latent Concept-based Explanation of NLP ModelsMain1 citations
  576. Learning Interpretable Legal Case Retrieval via Knowledge-Guided Case ReformulationMain1 citations
  577. Learning When to Retrieve, What to Rewrite, and How to Respond in Conversational QAfinding1 citations
  578. Learning to Ask Informative Questions: Enhancing LLMs with Preference Optimization and Expected Information Gainfinding1 citations
  579. Learning to Extract Structured Entities Using Language ModelsMain1 citations
  580. Learning to Route for Dynamic Adapter Composition in Continual Learning with Language Modelsfinding1 citations
  581. Less is More: Parameter-Efficient Selection of Intermediate Tasks for Transfer LearningMain1 citations
  582. Let’s Ask GNN: Empowering Large Language Model for Graph In-Context Learningfinding1 citations
  583. Let’s discuss! Quality Dimensions and Annotated Datasets for Computational Argument Quality AssessmentMain1 citations
  584. Leveraging Context-Aware Prompting for Commit Message GenerationMain1 citations
  585. Leveraging Estimated Transferability Over Human Intuition for Model Selection in Text RankingMain1 citations
  586. Leveraging pre-trained language models for linguistic analysis: A case of argument structure constructionsMain1 citations
  587. Lighthouse: A User-Friendly Library for Reproducible Video Moment Retrieval and Highlight DetectionSystem Demonstrations1 citations
  588. Link, Synthesize, Retrieve: Universal Document Linking for Zero-Shot Information RetrievalMain1 citations
  589. LoRASC: Expressive and Generalizable Low-rank Adaptation for Large Models via Slow Cascaded Learningfinding1 citations
  590. Local Contrastive Editing of Gender StereotypesMain1 citations
  591. Locally Measuring Cross-lingual Lexical Alignment: A Domain and Word Level Perspectivefinding1 citations
  592. Locating Information Gaps and Narrative Inconsistencies Across Languages: A Case Study of LGBT People Portrayals on WikipediaMain1 citations
  593. M3Hop-CoT: Misogynous Meme Identification with Multimodal Multi-hop Chain-of-ThoughtMain1 citations
  594. MARCO: Multi-Agent Real-time Chat OrchestrationIndustry1 citations
  595. MARE: Multi-Aspect Rationale Extractor on Unsupervised Rationale ExtractionMain1 citations
  596. MASIVE: Open-Ended Affective State Identification in English and SpanishMain1 citations
  597. MATSA: Multi-Agent Table Structure AttributionSystem Demonstrations1 citations
  598. MC-indexing: Effective Long Document Retrieval via Multi-view Content-aware Indexingfinding1 citations
  599. MDCR: A Dataset for Multi-Document Conditional Reasoningfinding1 citations
  600. MIPD: Exploring Manipulation and Intention In a Novel Corpus of Polish DisinformationMain1 citations
  601. MMUTF: Multimodal Multimedia Event Argument Extraction with Unified Template Fillingfinding1 citations
  602. MTA4DPR: Multi-Teaching-Assistants Based Iterative Knowledge Distillation for Dense Passage RetrievalMain1 citations
  603. MTLS: Making Texts into Linguistic SymbolsMain1 citations
  604. Make Compound Sentences Simple to Analyze: Learning to Split Sentences for Aspect-based Sentiment Analysisfinding1 citations
  605. MalAlgoQA: Pedagogical Evaluation of Counterfactual Reasoning in Large Language Models and Implications for AI in Educationfinding1 citations
  606. Margin Matching Preference Optimization: Enhanced Model Alignment with Granular Feedbackfinding1 citations
  607. Matryoshka-Adaptor: Unsupervised and Supervised Tuning for Smaller Embedding DimensionsMain1 citations
  608. McCrolin: Multi-consistency Cross-lingual Training for Retrieval Question Answeringfinding1 citations
  609. Measuring Psychological Depth in Language ModelsMain1 citations
  610. Measuring the Robustness of NLP Models to Domain Shiftsfinding1 citations
  611. Media Attitude Detection via Framing Analysis with Events and their RelationsMain1 citations
  612. Merge to Learn: Efficiently Adding Skills to Language Models with Model Mergingfinding1 citations
  613. Message Passing on Semantic-Anchor-Graphs for Fine-grained Emotion Representation Learning and ClassificationMain1 citations
  614. Metrics for What, Metrics for Whom: Assessing Actionability of Bias Evaluation Metrics in NLPMain1 citations
  615. MirrorStories: Reflecting Diversity through Personalized Narrative Generation with Large Language ModelsMain1 citations
  616. Mitigating Frequency Bias and Anisotropy in Language Model Pre-Training with Syntactic SmoothingMain1 citations
  617. Mitigating Training Imbalance in LLM Fine-Tuning via Selective Parameter MergingMain1 citations
  618. Mitigating the Impact of Reference Quality on Evaluation of Summarization Systems with Reference-Free MetricsMain1 citations
  619. Mixture of Diverse Size ExpertsIndustry1 citations
  620. MoDULA: Mixture of Domain-Specific and Universal LoRA for Multi-Task LearningMain1 citations
  621. Modeling News Interactions and Influence for Financial Market Predictionfinding1 citations
  622. MolTRES: Improving Chemical Language Representation Learning for Molecular Property PredictionMain1 citations
  623. Monitoring Hate Speech in Indonesia: An NLP-based Classification of Social Media TextsSystem Demonstrations1 citations
  624. Multi-Dialect Vietnamese: Task, Dataset, Baseline Models and ChallengesMain1 citations
  625. Multi-Loss Fusion: Angular and Contrastive Integration for Machine-Generated Text Detectionfinding1 citations
  626. Multi-Target Cross-Lingual Summarization: a novel task and a language-neutral approachfinding1 citations
  627. Multi-label Sequential Sentence Classification via Large Language Modelfinding1 citations
  628. Multi-trait User Simulation with Adaptive Decoding for Conversational Task Assistantsfinding1 citations
  629. MultiSkill: Evaluating Large Multimodal Models for Fine-grained Alignment Skillsfinding1 citations
  630. Multiple Knowledge-Enhanced Interactive Graph Network for Multimodal Conversational Emotion Recognitionfinding1 citations
  631. Multiple Sources are Better Than One: Incorporating External Knowledge in Low-Resource GlossingMain1 citations
  632. NALA: an Effective and Interpretable Entity Alignment Methodfinding1 citations
  633. Nash CoT: Multi-Path Inference with Preference EquilibriumMain1 citations
  634. NeuroMax: Enhancing Neural Topic Modeling via Maximizing Mutual Information and Group Topic Regularizationfinding1 citations
  635. Neuron Specialization: Leveraging Intrinsic Task Modularity for Multilingual Machine TranslationMain1 citations
  636. Noise, Novels, Numbers. A Framework for Detecting and Categorizing Noise in Danish and Norwegian LiteratureMain1 citations
  637. Normalized Narrow Jump To Conclusions: Normalized Narrow Shortcuts for Parameter Efficient Early Exit Transformer Predictionfinding1 citations
  638. Numbers Matter! Bringing Quantity-awareness to Retrieval Systemsfinding1 citations
  639. OATH-Frames: Characterizing Online Attitudes Towards Homelessness with LLM AssistantsMain1 citations
  640. On Efficient Language and Vision Assistants for Visually-Situated Natural Language Understanding: What Matters in Reading and ReasoningMain1 citations
  641. On the Empirical Complexity of Reasoning and Planning in LLMsfinding1 citations
  642. On the Fragility of Active Learners for Text ClassificationMain1 citations
  643. On the Rigour of Scientific Writing: Criteria, Analysis, and Insightsfinding1 citations
  644. One-to-many testing for code generation from (just) natural languagefinding1 citations
  645. OpenT2T: An Open-Source Toolkit for Table-to-Text GenerationSystem Demonstrations1 citations
  646. Optimizing Rare Word Accuracy in Direct Speech Translation with a Retrieval-and-Demonstration ApproachMain1 citations
  647. Order of Magnitude Speedups for LLM Membership InferenceMain1 citations
  648. PANDA: Persona Attributes Navigation for Detecting and Alleviating Overuse Problem in Large Language ModelsMain1 citations
  649. PDF-to-Tree: Parsing PDF Text Blocks into a Treefinding1 citations
  650. PclGPT: A Large Language Model for Patronizing and Condescending Language Detectionfinding1 citations
  651. PepRec: Progressive Enhancement of Prompting for RecommendationMain1 citations
  652. Persuasiveness of Generated Free-Text Rationales in Subjective Decisions: A Case Study on Pairwise Argument Rankingfinding1 citations
  653. Position Paper: Data-Centric AI in the Age of Large Language Modelsfinding1 citations
  654. Precise Model Benchmarking with Only a Few ObservationsMain1 citations
  655. Predicting Entity Salience in Extremely Short DocumentsIndustry1 citations
  656. Predictive Multiplicity of Knowledge Graph Embeddings in Link Predictionfinding1 citations
  657. Preference-Guided Reflective Sampling for Aligning Language ModelsMain1 citations
  658. Preserving Multi-Modal Capabilities of Pre-trained VLMs for Improving Vision-Linguistic CompositionalityMain1 citations
  659. Pretraining and Finetuning Language Models on Geospatial Networks for Accurate Address MatchingIndustry1 citations
  660. Privacy Evaluation Benchmarks for NLP Modelsfinding1 citations
  661. Private Language Models via Truncated Laplacian MechanismMain1 citations
  662. Probing the Depths of Language Models’ Contact-Center Knowledge for Quality AssuranceIndustry1 citations
  663. Prompt-Based Bias Calibration for Better Zero/Few-Shot Learning of Language Modelsfinding1 citations
  664. QEFT: Quantization for Efficient Fine-Tuning of LLMsfinding1 citations
  665. QUEST: Efficient Extreme Multi-Label Text Classification with Large Language Models on Commodity Hardwarefinding1 citations
  666. Quality Matters: Evaluating Synthetic Data for Tool-Using LLMsMain1 citations
  667. Quantifying the Gaps Between Translation and Native Perception in Training for Multimodal, Multilingual RetrievalMain1 citations
  668. Query-OPT: Optimizing Inference of Large Language Models via Multi-Query Instructions in Meeting SummarizationIndustry1 citations
  669. RAR: Retrieval-augmented retrieval for code generation in low resource languagesMain1 citations
  670. RAt: Injecting Implicit Bias for Text-To-Image Prompt Refinement ModelsMain1 citations
  671. RECANTFormer: Referring Expression Comprehension with Varying Numbers of TargetsMain1 citations
  672. RETAIN: Interactive Tool for Regression Testing Guided LLM MigrationSystem Demonstrations1 citations
  673. RSA-Control: A Pragmatics-Grounded Lightweight Controllable Text Generation FrameworkMain1 citations
  674. Rationalizing Transformer Predictions via End-To-End Differentiable Self-TrainingMain1 citations
  675. ReDel: A Toolkit for LLM-Powered Recursive Multi-Agent SystemsSystem Demonstrations1 citations
  676. Recent Advances in Online Hate Speech Moderation: Multimodality and the Role of Large Modelsfinding1 citations
  677. Recent Trends in Linear Text Segmentation: A Surveyfinding1 citations
  678. Reconsidering Sentence-Level Sign Language TranslationMain1 citations
  679. Relevance Is a Guiding Light: Relevance-aware Adaptive Learning for End-to-end Task-oriented Dialogue SystemMain1 citations
  680. Repairing Catastrophic-Neglect in Text-to-Image Diffusion Models via Attention-Guided Feature Enhancementfinding1 citations
  681. Repairs in a Block World: A New Benchmark for Handling User Corrections with Multi-Modal Language ModelsMain1 citations
  682. Representation Alignment and Adversarial Networks for Cross-lingual Dependency Parsingfinding1 citations
  683. Representational Isomorphism and Alignment of Multilingual Large Language Modelsfinding1 citations
  684. Retrospex: Language Agent Meets Offline Reinforcement Learning CriticMain1 citations
  685. Reusing Transferable Weight Increments for Low-resource Style GenerationMain1 citations
  686. Revealing Personality Traits: A New Benchmark Dataset for Explainable Personality Recognition on DialoguesMain1 citations
  687. Revisiting Supervised Contrastive Learning for Microblog ClassificationMain1 citations
  688. Revisiting the Impact of Pursuing Modularity for Code Generationfinding1 citations
  689. Rewarding What Matters: Step-by-Step Reinforcement Learning for Task-Oriented Dialoguefinding1 citations
  690. RoBERT2VecTM: A Novel Approach for Topic Extraction in Islamic Studiesfinding1 citations
  691. Robust ASR Error Correction with Conservative Data FilteringIndustry1 citations
  692. SAAS: Solving Ability Amplification Strategy for Enhanced Mathematical Reasoning in Large Language ModelsIndustry1 citations
  693. SCA: Selective Compression Attention for Efficiently Extending the Context Window of Large Language Modelsfinding1 citations
  694. SEAVER: Attention Reallocation for Mitigating Distractions in Language Models for Conditional Semantic Textual Similarity Measurementfinding1 citations
  695. SEED: Semantic Knowledge Transfer for Language Model Adaptation to Materials ScienceIndustry1 citations
  696. SEGMENT+: Long Text Processing with Short-Context Language ModelsMain1 citations
  697. SPEED++: A Multilingual Event Extraction Framework for Epidemic Prediction and PreparednessMain1 citations
  698. SSP: Self-Supervised Prompting for Cross-Lingual Transfer to Low-Resource Languages using Large Language Modelsfinding1 citations
  699. STTATTS: Unified Speech-To-Text And Text-To-Speech Modelfinding1 citations
  700. Scalable Efficient Training of Large Language Models with Low-dimensional Projected AttentionMain1 citations
  701. SciER: An Entity and Relation Extraction Dataset for Datasets, Methods, and Tasks in Scientific DocumentsMain1 citations
  702. SciPrompt: Knowledge-augmented Prompting for Fine-grained Categorization of Scientific TopicsMain1 citations
  703. Scope-enhanced Compositional Semantic Parsing for DRTMain1 citations
  704. Seeing the Forest through the Trees: Data Leakage from Partial Transformer GradientsMain1 citations
  705. Selection-p: Self-Supervised Task-Agnostic Prompt Compression for Faithfulness and Transferabilityfinding1 citations
  706. Self-Constructed Context Decompilation with Fined-grained Alignment Enhancementfinding1 citations
  707. Self-Evaluation of Large Language Model based on Glass-box Featuresfinding1 citations
  708. Self-contradictory reasoning evaluation and detectionfinding1 citations
  709. Semantic Training Signals Promote Hierarchical Syntactic Generalization in TransformersMain1 citations
  710. Sequential API Function Calling Using GraphQL SchemaMain1 citations
  711. Sequential LLM Framework for Fashion RecommendationIndustry1 citations
  712. Shoes-ACOSI: A Dataset for Aspect-Based Sentiment Analysis with Implicit Opinion Extractionfinding1 citations
  713. Simul-MuST-C: Simultaneous Multilingual Speech Translation Corpus Using Large Language ModelMain1 citations
  714. Simultaneous Interpretation Corpus Construction by Large Language Models in Distant Language PairMain1 citations
  715. Simultaneous Masking, Not Prompting Optimization: A Paradigm Shift in Fine-tuning LLMs for Simultaneous TranslationMain1 citations
  716. Skills-in-Context: Unlocking Compositionality in Large Language Modelsfinding1 citations
  717. SparkRA: A Retrieval-Augmented Knowledge Service System Based on Spark Large Language ModelSystem Demonstrations1 citations
  718. SpeciaLex: A Benchmark for In-Context Specialized Lexicon Learningfinding1 citations
  719. Statistical Uncertainty in Word Embeddings: GloVe-VMain1 citations
  720. Story Morals: Surfacing value-driven narrative schemas using large language modelsMain1 citations
  721. Strengthening Structural Inductive Biases by Pre-training to Perform Syntactic TransformationsMain1 citations
  722. Structured Optimal Brain Pruning for Large Language ModelsMain1 citations
  723. Subjective Topic meets LLMs: Unleashing Comprehensive, Reflective and Creative Thinking through the Negation of NegationMain1 citations
  724. Survival of the Safest: Towards Secure Prompt Optimization through Interleaved Multi-Objective EvolutionIndustry1 citations
  725. Synergizing In-context Learning with Hints for End-to-end Task-oriented Dialog SystemsMain1 citations
  726. TCSinger: Zero-Shot Singing Voice Synthesis with Style Transfer and Multi-Level Style ControlMain1 citations
  727. TL-CL: Task And Language Incremental Continual LearningMain1 citations
  728. TRIP NEGOTIATOR: A Travel Persona-aware Reinforced Dialogue Generation Model for Personalized Integrative Negotiation in Tourismfinding1 citations
  729. TROPE: TRaining-Free Object-Part Enhancement for Seamlessly Improving Fine-Grained Zero-Shot Image Captioningfinding1 citations
  730. Tab2Text - A framework for deep learning with tabular datafinding1 citations
  731. Taking a turn for the better: Conversation redirection throughout the course of mental-health therapyfinding1 citations
  732. Talking the Talk Does Not Entail Walking the Walk: On the Limits of Large Language Models in Lexical Entailment Recognitionfinding1 citations
  733. Temporal Cognitive Tree: A Hierarchical Modeling Approach for Event Temporal Relation Extractionfinding1 citations
  734. Temporal Fact Reasoning over Hyper-Relational Knowledge Graphsfinding1 citations
  735. Text Grafting: Near-Distribution Weak Supervision for Minority Classes in Text ClassificationMain1 citations
  736. Textless Speech-to-Speech Translation With Limited Parallel Datafinding1 citations
  737. The Accuracy Paradox in RLHF: When Better Reward Models Don’t Yield Better Language ModelsMain1 citations
  738. The Computational Anatomy of Humility: Modeling Intellectual Humility in Online Public DiscourseMain1 citations
  739. The Emergence of Compositional Languages in Multi-entity Referential Games: from Image to Graph RepresentationsMain1 citations
  740. The Mystery of the Pathological Path-star Task for Language ModelsMain1 citations
  741. The Shape of Word Embeddings: Quantifying Non-Isometry with Topological Data Analysisfinding1 citations
  742. The effects of distance on NPI illusive effects in BERTMain1 citations
  743. TinyStyler: Efficient Few-Shot Text Style Transfer with Authorship Embeddingsfinding1 citations
  744. To Word Senses and Beyond: Inducing Concepts with Contextualized Language ModelsMain1 citations
  745. Tokenization Falling Short: On Subword Robustness in Large Language Modelsfinding1 citations
  746. Topic-Oriented Open Relation Extraction with A Priori Seed GenerationMain1 citations
  747. Towards Difficulty-Agnostic Efficient Transfer Learning for Vision-Language ModelsMain1 citations
  748. Towards Efficient Visual-Language Alignment of the Q-Former for Visual Reasoning Tasksfinding1 citations
  749. Towards Enhancing Coherence in Extractive Summarization: Dataset and Experiments with LLMsMain1 citations
  750. Towards Explainable Computerized Adaptive Testing with Large Language Modelfinding1 citations
  751. Towards Faithful Knowledge Graph Explanation Through Deep Alignment in Commonsense Question AnsweringMain1 citations
  752. Towards Low-Resource Harmful Meme Detection with LMM AgentsMain1 citations
  753. Towards Online Continuous Sign Language Recognition and TranslationMain1 citations
  754. Towards Robust Extractive Question Answering Models: Rethinking the Training Methodologyfinding1 citations
  755. Towards Tool Use Alignment of Large Language ModelsMain1 citations
  756. Towards a Greek Proverb Atlas: Computational Spatial Exploration and Attribution of Greek ProverbsMain1 citations
  757. ToxiCloakCN: Evaluating Robustness of Offensive Language Detection in Chinese with Cloaking PerturbationsMain1 citations
  758. Toxicity Detection is NOT all you Need: Measuring the Gaps to Supporting Volunteer Content Moderators through a User-Centric MethodMain1 citations
  759. Train Once, Deploy Anywhere: Matryoshka Representation Learning for Multimodal Recommendationfinding1 citations
  760. Training-free Deep Concept Injection Enables Language Models for Video Question AnsweringMain1 citations
  761. TransferTOD: A Generalizable Chinese Multi-Domain Task-Oriented Dialogue System with Transfer CapabilitiesMain1 citations
  762. Transferability of Syntax-Aware Graph Neural Networks in Zero-Shot Cross-Lingual Semantic Role Labelingfinding1 citations
  763. Twists, Humps, and Pebbles: Multilingual Speech Recognition Models Exhibit Gender Performance GapsMain1 citations
  764. Two-tiered Encoder-based Hallucination Detection for Retrieval-Augmented Generation in the WildIndustry1 citations
  765. ULMR: Unlearning Large Language Models via Negative Response and Model Parameter AverageIndustry1 citations
  766. Understanding Slang with LLMs: Modelling Cross-Cultural Nuances through ParaphrasingMain1 citations
  767. Understanding “Democratization” in NLP and ML ResearchMain1 citations
  768. UniGen: Universal Domain Generalization for Sentiment Classification via Zero-shot Dataset GenerationMain1 citations
  769. UniTabNet: Bridging Vision and Language Models for Enhanced Table Structure Recognitionfinding1 citations
  770. Unknown Claims: Generation of Fact-Checking Training Examples from Unstructured and Structured DataMain1 citations
  771. Unlocking Anticipatory Text Generation: A Constrained Approach for Large Language Models DecodingMain1 citations
  772. Unlocking the Future: Exploring Look-Ahead Planning Mechanistic Interpretability in Large Language ModelsMain1 citations
  773. Unraveling Babel: Exploring Multilingual Activation Patterns of LLMs and Their ApplicationsMain1 citations
  774. Unsupervised Domain Adaptation for Keyphrase Generation using Citation Contextsfinding1 citations
  775. Unsupervised End-to-End Task-Oriented Dialogue with LLMs: The Power of the Noisy ChannelMain1 citations
  776. Unsupervised Extraction of Dialogue Policies from ConversationsMain1 citations
  777. Unveiling the mystery of visual attributes of concrete and abstract concepts: Variability, nearest neighbors, and challenging categoriesMain1 citations
  778. Using LLMs to simulate students’ responses to exam questionsfinding1 citations
  779. Using RL to Identify Divisive Perspectives Improves LLMs Abilities to Identify Communities on Social Mediafinding1 citations
  780. VHASR: A Multimodal Speech Recognition System With Vision HotwordsMain1 citations
  781. Value Alignment from Unstructured TextIndustry1 citations
  782. Varying Sentence Representations via Condition-Specified RoutersMain1 citations
  783. VerifyMatch: A Semi-Supervised Learning Paradigm for Natural Language Inference with Confidence-Aware MixUpMain1 citations
  784. What’s Mine becomes Yours: Defining, Annotating and Detecting Context-Dependent Paraphrases in News Interview DialogsMain1 citations
  785. When Compression Meets Model Compression: Memory-Efficient Double Compression for Large Language Modelsfinding1 citations
  786. When Context Leads but Parametric Memory Follows in Large Language ModelsMain1 citations
  787. Where am I? Large Language Models Wandering between Semantics and Structures in Long ContextsMain1 citations
  788. Which Programming Language and What Features at Pre-training Stage Affect Downstream Logical Inference Performance?Main1 citations
  789. Who is better at math, Jenny or Jingzhen? Uncovering Stereotypes in Large Language ModelsMain1 citations
  790. Why do objects have many names? A study on word informativeness in language use and lexical systemsMain1 citations
  791. WildVis: Open Source Visualizer for Million-Scale Chat Logs in the WildSystem Demonstrations1 citations
  792. Will LLMs Replace the Encoder-Only Models in Temporal Relation Classification?Main1 citations
  793. Wrong-of-Thought: An Integrated Reasoning Framework with Multi-Perspective Verification and Wrong Informationfinding1 citations
  794. ZEBRA: Zero-Shot Example-Based Retrieval Augmentation for Commonsense Question AnsweringMain1 citations
  795. Zero-shot Commonsense Reasoning over Machine Imaginationfinding1 citations
  796. Zero-shot Cross-domain Dialogue State Tracking via Context-aware Auto-prompting and Instruction-following Contrastive DecodingMain1 citations
  797. xCOMET-lite: Bridging the Gap Between Efficiency and Quality in Learned MT Evaluation MetricsMain1 citations
  798. ‘Quis custodiet ipsos custodes?’ Who will watch the watchmen? On Detecting AI-generated peer-reviewsMain1 citations
  799. A Bayesian Approach to Harnessing the Power of LLMs in Authorship AttributionMain
  800. A Closer Look at Multidimensional Online Political IncivilityMain
  801. A Cost-Efficient Modular Sieve for Extracting Product Information from Company WebsitesIndustry
  802. A Critical Look at Meta-evaluating Summarisation Evaluation Metricsfinding
  803. A Deep Analysis of the Impact of Multiword Expressions and Named Entities on Chinese-English Machine Translationsfinding
  804. A Framework of Knowledge Graph-Enhanced Large Language Model Based on Question Decomposition and Atomic Retrievalfinding
  805. A Learning Rate Path Switching Training Paradigm for Version Updates of Large Language ModelsMain
  806. A Pointer Network-based Approach for Joint Extraction and Detection of Multi-Label Multi-Class Intentsfinding
  807. A Survey of Ontology Expansion for Conversational UnderstandingMain
  808. A Training Data Recipe to Accelerate A* Search with Language Modelsfinding
  809. A Two-Step Approach for Data-Efficient French Pronunciation LearningMain
  810. A new approach for fine-tuning sentence transformers for intent classification and out-of-scope detection tasksIndustry
  811. ABLE: Personalized Disability Support with Politeness and Empathy IntegrationMain
  812. AGRaME: Any-Granularity Ranking with Multi-Vector EmbeddingsMain
  813. ALVIN: Active Learning Via INterpolationMain
  814. AMR-Evol: Adaptive Modular Response Evolution Elicits Better Knowledge Distillation for Large Language Models in Code GenerationMain
  815. ASTE-Transformer: Modelling Dependencies in Aspect-Sentiment Triplet Extractionfinding
  816. ASTRA: Automatic Schema Matching using Machine TranslationIndustry
  817. ATAP: Automatic Template-Augmented Commonsense Knowledge Graph Completion via Pre-Trained Language ModelsMain
  818. ATQ: Activation Transformation forWeight-Activation Quantization of Large Language Modelsfinding
  819. AXCEL: Automated eXplainable Consistency Evaluation using LLMsfinding
  820. Academics Can Contribute to Domain-Specialized Language ModelsMain
  821. Achieving Stronger Generation via Simple Contrastive Tuningfinding
  822. Active Listening: Personalized Question Generation in Open-Domain Social Conversation with User Model Based Promptingfinding
  823. Adaptive Axes: A Pipeline for In-domain Social Stereotype AnalysisMain
  824. Adaptive Feature-based Low-Rank Compression of Large Language Models via Bayesian Optimizationfinding
  825. Adaptive Immune-based Sound-Shape Code Substitution for Adversarial Chinese Text AttacksMain
  826. Advancing Cross-Lingual Entity Alignment with Large Language Models: Tailored Sample Segmentation and Zero-Shot Promptsfinding
  827. Advancing Semantic Textual Similarity Modeling: A Regression Framework with Translated ReLU and Smooth K2 LossMain
  828. Advancing Test-Time Adaptation in Wild Acoustic Test SettingsMain
  829. Adversarial Attacks on Parts of Speech: An Empirical Study in Text-to-Image Generationfinding
  830. Adversarial Text Generation using Large Language Models for Dementia DetectionMain
  831. AfriInstruct: Instruction Tuning of African Languages for Diverse Tasksfinding
  832. All You Need is Attention: Lightweight Attention-based Data Augmentation for Text Classificationfinding
  833. An Effective Deployment of Diffusion LM for Data Augmentation in Low-Resource Sentiment ClassificationMain
  834. An Experimental Analysis on Evaluating Patent CitationsMain
  835. An L* Algorithm for Deterministic Weighted Regular LanguagesMain
  836. Applying Contrastive Learning to Code Vulnerability Type ClassificationMain
  837. Applying Intrinsic Debiasing on Downstream Tasks: Challenges and Considerations for Machine TranslationMain
  838. Are Data Augmentation Methods in Named Entity Recognition Applicable for Uncertainty Estimation?Main
  839. Are ELECTRA’s Sentence Embeddings Beyond Repair? The Case of Semantic Textual Similarityfinding
  840. Are Large Vision Language Models up to the Challenge of Chart Comprehension and Reasoningfinding
  841. Argument Relation Classification through Discourse Markers and Adversarial TrainingMain
  842. Arxiv Copilot: A Self-Evolving and Efficient LLM System for Personalized Academic AssistanceSystem Demonstrations
  843. Assessing “Implicit” Retrieval Robustness of Large Language ModelsMain
  844. Assisting Breastfeeding and Maternity Experts in Responding to User Queries with an AI-in-the-loop ApproachIndustry
  845. Athena: Safe Autonomous Agents with Verbal Contrastive LearningIndustry
  846. Attribute Controlled Fine-tuning for Large Language Models: A Case Study on Detoxificationfinding
  847. Augmenting Reasoning Capabilities of LLMs with Graph Structures in Knowledge Base Question Answeringfinding
  848. Automated Tone Transcription and Clustering with Tone2Vecfinding
  849. Automatic Reconstruction of Ancient Chinese Pronunciationsfinding
  850. Automating Easy Read Text Segmentationfinding
  851. BAPO: Base-Anchored Preference Optimization for Overcoming Forgetting in Large Language Models Personalizationfinding
  852. BC-Prover: Backward Chaining Prover for Formal Theorem ProvingMain
  853. BIPEFT: Budget-Guided Iterative Search for Parameter Efficient Fine-Tuning of Large Pretrained Language Modelsfinding
  854. BPID: A Benchmark for Personal Identity DeduplicationIndustry
  855. Bahasa Harmony: A Comprehensive Dataset for Bahasa Text-to-Speech Synthesis with Discrete Codec Modeling of EnGen-TTS.finding
  856. Balancing Visual Context Understanding in Dialogue for Image Retrievalfinding
  857. Be Helpful but Don’t Talk too Much - Enhancing Helpfulness in Conversations through Relevance in Multi-Turn Emotional SupportMain
  858. Be a Multitude to Itself: A Prompt Evolution Framework for Red Teamingfinding
  859. Belief Revision: The Adaptability of Large Language Models ReasoningMain
  860. Beyond Accuracy Optimization: Computer Vision Losses for Large Language Model Fine-Tuningfinding
  861. Beyond Common Words: Enhancing ASR Cross-Lingual Proper Noun Recognition Using Large Language Modelsfinding
  862. Beyond Fine-tuning: Unleashing the Potential of Continuous Pretraining for Clinical LLMs.finding
  863. BiKT: Enabling Bidirectional Knowledge Transfer Between Pretrained Models and Sequential Downstream Tasksfinding
  864. Birdie: Advancing State Space Language Modeling with Dynamic Mixtures of Training ObjectivesMain
  865. BookWorm: A Dataset for Character Description and Analysisfinding
  866. Bootstrapped Policy Learning for Task-oriented Dialogue through Goal ShapingMain
  867. Breaking the Boundaries: A Unified Framework for Chinese Named Entity Recognition Across Text and Speechfinding
  868. By My Eyes: Grounding Multimodal Large Language Models with Sensor Data via Visual PromptingMain
  869. CARER - ClinicAl Reasoning-Enhanced Representation for Temporal Health Risk PredictionMain
  870. CASE: Efficient Curricular Data Pre-training for Building Assistive Psychology Expert Modelsfinding
  871. CAVA: A Tool for Cultural Alignment Visualization & AnalysisSystem Demonstrations
  872. CEAMC: Corpus and Empirical Study of Argument Analysis in Education via LLMsfinding
  873. CED: Comparing Embedding Differences for Detecting Out-of-Distribution and Hallucinated Textfinding
  874. CNEQ: Incorporating numbers into Knowledge Graph Reasoningfinding
  875. CONSTRUCTURE: Benchmarking CONcept STRUCTUre REasoning for Multimodal Large Language Modelsfinding
  876. CONTESTS: a Framework for Consistency Testing of Span Probabilities in Language ModelsMain
  877. CONTOR: Benchmarking Strategies for Completing Ontologies with Plausible Missing Rulesfinding
  878. CSLM: A Framework for Question Answering Dataset Generation through Collaborative Small Language Modelsfinding
  879. CSSL: Contrastive Self-Supervised Learning for Dependency Parsing on Relatively Free Word Ordered and Morphologically Rich Low Resource LanguagesMain
  880. Can LLMs Replace Clinical Doctors? Exploring Bias in Disease Diagnosis by Large Language Modelsfinding
  881. Can LLMs replace Neil deGrasse Tyson? Evaluating the Reliability of LLMs as Science CommunicatorsMain
  882. Can visual language models resolve textual ambiguity with visual cues? Let visual puns tell you!Main
  883. CareCorpus+: Expanding and Augmenting Caregiver Strategy Data to Support Pediatric RehabilitationMain
  884. Centrality-aware Product Retrieval and RankingIndustry
  885. Chain of Condition: Construct, Verify and Solve Conditions for Conditional Question Answeringfinding
  886. CharacterGLM: Customizing Social Characters with Large Language ModelsIndustry
  887. ChatHF: Collecting Rich Human Feedback from Real-time ConversationsSystem Demonstrations
  888. CoCoLoFa: A Dataset of News Comments with Common Logical Fallacies Written by LLM-Assisted CrowdsMain
  889. CommVQA: Situating Visual Question Answering in Communicative ContextsMain
  890. Communicating with Speakers and Listeners of Different Pragmatic LevelsMain
  891. Comparing Edge-based and Node-based Methods on a Citation Prediction Taskfinding
  892. Computational Meme Understanding: A SurveyMain
  893. Consistent Bidirectional Language Modelling: Expressive Power and Representational ConcisenessMain
  894. Consistent Document-level Relation Extraction via Counterfactualsfinding
  895. Context-Aware Adapter Tuning for Few-Shot Relation Learning in Knowledge GraphsMain
  896. Context-Driven Index Trimming: A Data Quality Perspective to Enhancing Precision of RALMsfinding
  897. Contrastive Token Learning with Similarity Decay for Repetition Suppression in Machine Translationfinding
  898. Contribution of Linguistic Typology to Universal Dependency Parsing: An Empirical InvestigationMain
  899. Controlled Transformation of Text-Attributed Graphsfinding
  900. Creative Problem Solving in Large Language and Vision Models - What Would it Take?finding
  901. Creative and Context-Aware Translation of East Asian Idioms with GPT-4finding
  902. Crisis counselor language and perceived genuine concern in crisis conversationsfinding
  903. Cross-domain NER with Generated Task-Oriented Knowledge: An Empirical Study from Information Density PerspectiveMain
  904. Cross-lingual Back-Parsing: Utterance Synthesis from Meaning Representation for Zero-Resource Semantic ParsingMain
  905. Cross-lingual Contextualized Phrase Retrievalfinding
  906. Cross-lingual Transfer for Automatic Question Generation by Learning Interrogative Structures in Target LanguagesMain
  907. Curriculum Consistency Learning for Conditional Sentence GenerationMain
  908. DECOR: Improving Coherence in L2 English Writing with a Novel Benchmark for Incoherence Detection, Reasoning, and RewritingMain
  909. DEFT-UCS: Data Efficient Fine-Tuning for Pre-Trained Language Models via Unsupervised Core-Set Selection for Text-EditingMain
  910. Data-driven Coreference-based Ontology Buildingfinding
  911. DataTales: A Benchmark for Real-World Intelligent Data NarrationMain
  912. Dealing with Controversy: An Emotion and Coping Strategy Corpus Based on Role Playingfinding
  913. Debate as Optimization: Adaptive Conformal Prediction and Diverse Retrieval for Event Extractionfinding
  914. Deciphering Cognitive Distortions in Patient-Doctor Mental Health Conversations: A Multimodal LLM-Based Detection and Reasoning FrameworkMain
  915. DecorateLM: Data Engineering through Corpus Rating, Tagging, and Editing with Language ModelsMain
  916. Delving into Qualitative Implications of Synthetic Data for Hate Speech DetectionMain
  917. Democratizing Large Language Models via Personalized Parameter-Efficient Fine-tuningMain
  918. Demonstration Selection Strategies for Numerical Time Series Data-to-Textfinding
  919. Dependency Graph Parsing as Sequence LabelingMain
  920. Detecting Ambiguous Utterances in an Intelligent AssistantIndustry
  921. DiAL : Diversity Aware Listwise Ranking for Query Auto-CompleteIndustry
  922. Dialog2Flow: Pre-training Soft-Contrastive Action-Driven Sentence Embeddings for Automatic Dialog Flow ExtractionMain
  923. DisGeM: Distractor Generation for Multiple Choice Questions with Span Maskingfinding
  924. Discovering Biases in Information Retrieval Models Using Relevance Thesaurus as Global ExplanationMain
  925. Disentangling Questions from Query Generation for Task-Adaptive Retrievalfinding
  926. Distance-aware Calibration for Pre-trained Language Modelsfinding
  927. Distributional Properties of Subword RegularizationMain
  928. Diversity Over Size: On the Effect of Sample and Topic Sizes for Topic-Dependent Argument Mining DatasetsMain
  929. Divide and Conquer: Legal Concept-guided Criminal Court View Generationfinding
  930. Divide-Conquer-Reasoning for Consistency Evaluation and Automatic Improvement of Large Language ModelsIndustry
  931. Do *they* mean ‘us’? Interpreting Referring Expression variation under Intergroup Biasfinding
  932. Do LLMs Think Fast and Slow? A Causal Study on Sentiment Analysisfinding
  933. Do LLMs suffer from Multi-Party Hangover? A Diagnostic Approach to Addressee Recognition and Response Selection in ConversationsMain
  934. Do You Know What You Are Talking About? Characterizing Query-Knowledge Relevance For Reliable Retrieval Augmented GenerationMain
  935. DocEE-zh: A Fine-grained Benchmark for Chinese Document-level Event Extractionfinding
  936. DocKD: Knowledge Distillation from LLMs for Open-World Document Understanding ModelsMain
  937. Does Context Help Mitigate Gender Bias in Neural Machine Translation?finding
  938. Does Object Grounding Really Reduce Hallucination of Large Vision-Language Models?Main
  939. Domain Adaptation via Prompt Learning for Alzheimer’s Detectionfinding
  940. Don’t Shoot The Breeze: Topic Continuity Model Using Nonlinear Naive Bayes With AttentionIndustry
  941. Don’t be my Doctor! Recognizing Healthcare Advice in Large Language ModelsIndustry
  942. Dual Process Masking for Dialogue Act Recognitionfinding
  943. Dual-Phase Accelerated Prompt Optimizationfinding
  944. Dual-teacher Knowledge Distillation for Low-frequency Word Translationfinding
  945. DyVo: Dynamic Vocabularies for Learned Sparse Retrieval with EntitiesMain
  946. Dynamic Multi-granularity Attribution Network for Aspect-based Sentiment AnalysisMain
  947. Dynamic Rewarding with Prompt Optimization Enables Tuning-free Self-Alignment of Language ModelsMain
  948. ECIS-VQG: Generation of Entity-centric Information-seeking Questions from VideosMain
  949. EH-MAM: Easy-to-Hard Masked Acoustic Modeling for Self-Supervised Speech Representation LearningMain
  950. ESG-Kor: A Korean Dataset for ESG-related Information Extraction and Practical Use Casesfinding
  951. EU DisinfoTest: a Benchmark for Evaluating Language Models’ Ability to Detect Disinformation Narrativesfinding
  952. EXPLORA: Efficient Exemplar Subset Selection for Complex ReasoningMain
  953. Efficient Active Learning with Adaptersfinding
  954. Efficient Data Generation for Source-grounded Information-seeking Dialogs: A Use Case for Meeting Transcriptsfinding
  955. Efficient Overshadowed Entity Disambiguation by Mitigating Shortcut LearningMain
  956. Efficient Pointwise-Pairwise Learning-to-Rank for News Recommendationfinding
  957. Efficient Unseen Language Adaptation for Multilingual Pre-Trained Language ModelsMain
  958. Efficient Vision-Language pre-training via domain-specific learning for human activitiesMain
  959. Efficient and Interpretable Grammatical Error Correction with Mixture of Expertsfinding
  960. Efficiently Computing Susceptibility to Context in Language Modelsfinding
  961. Eliciting Instruction-tuned Code Language Models’ Capabilities to Utilize Auxiliary Function for Code Generationfinding
  962. Emosical: An Emotion-Annotated Musical Theatre Datasetfinding
  963. Empirical Prior for Text Autoencodersfinding
  964. Employing Glyphic Information for Chinese Event Extraction with Vision-Language Modelfinding
  965. Empowering Large Language Model for Continual Video Question Answering with Collaborative PromptingMain
  966. Enable Fast Sampling for Seq2Seq Text Diffusionfinding
  967. Enabling Cross-Platform Comparison of Online Communities Using Content and Opinion Similarityfinding
  968. Enhanced Hallucination Detection in Neural Machine Translation through Simple Detector AggregationMain
  969. Enhancing AI Assisted Writing with One-Shot Implicit Negative FeedbackMain
  970. Enhancing Arguments Recognition for Financial Mathematical Reasoning over Hybrid Datafinding
  971. Enhancing Byzantine-Resistant Aggregations with Client Embeddingfinding
  972. Enhancing Discourse Dependency Parsing with Sentence Dependency Parsing: A Unified Generative Method Based on Code Representationfinding
  973. Enhancing Fine-Grained Image Classifications via Cascaded Vision Language Modelsfinding
  974. Enhancing Incremental Summarization with Structured Representationsfinding
  975. Enhancing Language Model Alignment: A Confidence-Based Approach to Label SmoothingMain
  976. Enhancing Learning-Based Binary Code Similarity Detection Model through Adversarial Training with Multiple Function Variantsfinding
  977. Enhancing Legal Case Retrieval via Scaling High-quality Synthetic Query-Candidate PairsMain
  978. Enhancing Polyglot Voices by Leveraging Cross-Lingual Fine-Tuning in Any-to-One Voice Conversionfinding
  979. Enhancing Short-Text Topic Modeling with LLM-Driven Context Expansion and Prefix-Tuned VAEsfinding
  980. Enhancing Temporal Modeling of Video LLMs via Time Gatingfinding
  981. Enhancing Training Data Attribution for Large Language Models with Fitting Error ConsiderationMain
  982. Evaluating Moral Beliefs across LLMs through a Pluralistic Frameworkfinding
  983. Evaluating Short-Term Temporal Fluctuations of Social Biases in Social Media Data and Masked Language ModelsMain
  984. Evaluating the Effectiveness of Large Language Models in Establishing Conversational GroundingMain
  985. Evaluation of Question Answer Generation for Portuguese: Insights and Datasetsfinding
  986. Event-Keyed Summarizationfinding
  987. Evolutionary Contrastive Distillation for Language Model Alignmentfinding
  988. Exploiting Careful Design of SVM Solution for Aspect-term Sentiment Analysisfinding
  989. Exploring Automated Keyword Mnemonics Generation with Large Language Models via Overgenerate-and-Rankfinding
  990. Exploring Quantization for Efficient Pre-Training of Transformer Language Modelsfinding
  991. Exploring Question Guidance and Answer Calibration for Visually Grounded Video Question Answeringfinding
  992. Exploring Union and Intersection of Visual Regions for Generating Questions, Answers, and DistractorsMain
  993. Exploring the Capability of Multimodal LLMs with Yonkoma Manga: The YManga Dataset and Its Challenging Tasksfinding
  994. Exploring the Learning Capabilities of Language Models using LEVERWORLDSMain
  995. External Knowledge-Driven Argument Mining: Leveraging Attention-Enhanced Multi-Network ModelsMain
  996. Extractive Medical Entity Disambiguation with Memory Mechanism and Memorized Entity Informationfinding
  997. F2RL: Factuality and Faithfulness Reinforcement Learning Framework for Claim-Guided Evidence-Supported Counterspeech GenerationMain
  998. FASTTRACK: Reliable Fact Tracing via Clustering and LLM-Powered Evidence Validationfinding
  999. FRoG: Evaluating Fuzzy Reasoning of Generalized Quantifiers in LLMsMain
  1000. Fairness-Aware Online Positive-Unlabeled LearningIndustry

Looking for submission deadlines instead? See the conference deadline calendar.