← All conferences

NAACL 2024 Accepted Papers

The full list of 912 papers accepted at NAACL 2024 (North American Chapter of the Association for Computational Linguistics). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.

Long: 487Findings: 286Short: 75Industry: 43System Demonstrations: 21
  1. GPTScore: Evaluate as You DesireLong566 citations
  2. AGIEval: A Human-Centric Benchmark for Evaluating Foundation ModelsFindings447 citations
  3. Sentiment Analysis in the Era of Large Language Models: A Reality CheckFindings363 citations
  4. Large Language Models are Effective Text Rankers with Pairwise Ranking PromptingFindings255 citations
  5. Unleashing the Emergent Cognitive Synergy in Large Language Models: A Task-Solving Agent through Multi-Persona Self-CollaborationLong246 citations
  6. Effective Long-Context Scaling of Foundation ModelsLong231 citations
  7. Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual TasksLong220 citations
  8. AnnoLLM: Making Large Language Models to Be Better Crowdsourced AnnotatorsIndustry214 citations
  9. XSTest: A Test Suite for Identifying Exaggerated Safety Behaviours in Large Language ModelsLong197 citations
  10. Large Language Models Sensitivity to The Order of Options in Multiple-Choice QuestionsFindings196 citations
  11. From Quantity to Quality: Boosting LLM Performance with Self-Guided Data Selection for Instruction TuningLong181 citations
  12. Trusting Your Evidence: Hallucinate Less with Context-aware DecodingShort179 citations
  13. Better Zero-Shot Reasoning with Role-Play PromptingLong174 citations
  14. REPLUG: Retrieval-Augmented Black-Box Language ModelsLong172 citations
  15. Adaptive-RAG: Learning to Adapt Retrieval-Augmented Large Language Models through Question ComplexityLong162 citations
  16. Head-to-Tail: How Knowledgeable are Large Language Models (LLMs)? A.K.A. Will LLMs Replace Knowledge Graphs?Long161 citations
  17. A Pretrainer’s Guide to Training Data: Measuring the Effects of Data Age, Domain Coverage, Quality, & ToxicityLong155 citations
  18. LLM-Rec: Personalized Recommendation via Prompting Large Language ModelsFindings146 citations
  19. RecMind: Large Language Model Powered Agent For RecommendationFindings144 citations
  20. ARES: An Automated Evaluation Framework for Retrieval-Augmented Generation SystemsLong130 citations
  21. Instructions as Backdoors: Backdoor Vulnerabilities of Instruction Tuning for Large Language ModelsLong129 citations
  22. Can Knowledge Graphs Reduce Hallucinations in LLMs? : A SurveyLong125 citations
  23. MMC: Advancing Multimodal Chart Understanding with Large-scale Instruction TuningLong123 citations
  24. Multilingual Machine Translation with Large Language Models: Empirical Results and AnalysisFindings121 citations
  25. A Wolf in Sheep’s Clothing: Generalized Nested Jailbreak Prompts can Fool Large Language Models EasilyLong118 citations
  26. Ghostbuster: Detecting Text Ghostwritten by Large Language ModelsLong115 citations
  27. Backdooring Instruction-Tuned Large Language Models with Virtual Prompt InjectionLong109 citations
  28. SOLAR 10.7B: Scaling Large Language Models with Simple yet Effective Depth Up-ScalingIndustry109 citations
  29. PersonaLLM: Investigating the Ability of Large Language Models to Express Personality TraitsFindings107 citations
  30. Removing RLHF Protections in GPT-4 via Fine-TuningShort104 citations
  31. Investigating Data Contamination in Modern Benchmarks for Large Language ModelsLong101 citations
  32. MindAgent: Emergent Gaming InteractionFindings100 citations
  33. CMB: A Comprehensive Medical Benchmark in ChineseLong99 citations
  34. MART: Improving LLM Safety with Multi-round Automatic Red-TeamingLong99 citations
  35. TopicGPT: A Prompt-based Topic Modeling FrameworkLong98 citations
  36. REST: Retrieval-Based Speculative DecodingLong97 citations
  37. TableLlama: Towards Open Large Generalist Models for TablesLong96 citations
  38. ADaPT: As-Needed Decomposition and Planning with Language ModelsFindings92 citations
  39. On Learning to Summarize with Large Language Models as ReferencesLong89 citations
  40. Composite Backdoor Attacks Against Large Language ModelsFindings84 citations
  41. Routing to the Expert: Efficient Reward-guided Ensemble of Large Language ModelsLong83 citations
  42. ExpertQA: Expert-Curated Questions and Attributed AnswersLong81 citations
  43. LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language ModelsLong79 citations
  44. Beyond Yes and No: Improving Zero-Shot LLM Rankers via Scoring Fine-Grained Relevance LabelsShort78 citations
  45. Complex Claim Verification with Evidence Retrieved in the WildLong78 citations
  46. Branch-Solve-Merge Improves Large Language Model Evaluation and GenerationLong77 citations
  47. Reducing hallucination in structured outputs via Retrieval-Augmented GenerationIndustry77 citations
  48. Assisting in Writing Wikipedia-like Articles From Scratch with Large Language ModelsLong75 citations
  49. What Matters in Training a GPT4-Style Language Model with Multimodal Inputs?Long75 citations
  50. Self-Checker: Plug-and-Play Modules for Fact-Checking with Large Language ModelsFindings74 citations
  51. Simulating Opinion Dynamics with Networks of LLM-based AgentsFindings74 citations
  52. Attacks, Defenses and Evaluations for LLM Conversation Safety: A SurveyLong71 citations
  53. HelpSteer: Multi-attribute Helpfulness Dataset for SteerLMLong71 citations
  54. Mustango: Toward Controllable Text-to-Music GenerationLong69 citations
  55. Self-Prompting Large Language Models for Zero-Shot Open-Domain QALong69 citations
  56. SemStamp: A Semantic Watermark with Paraphrastic Robustness for Text GenerationLong68 citations
  57. Cognitive Overload: Jailbreaking Large Language Models with Overloaded Logical ThinkingFindings67 citations
  58. A Survey of Confidence Estimation and Calibration in Large Language ModelsLong66 citations
  59. InstructABSA: Instruction Learning for Aspect Based Sentiment AnalysisShort66 citations
  60. GLiNER: Generalist Model for Named Entity Recognition using Bidirectional TransformerLong64 citations
  61. Does GPT-4 pass the Turing test?Long62 citations
  62. Volcano: Mitigating Multimodal Hallucination through Self-Feedback Guided RevisionLong61 citations
  63. Empowering Diffusion Models on the Embedding Space for Text GenerationLong59 citations
  64. Are Multilingual LLMs Culturally-Diverse Reasoners? An Investigation into Multicultural Proverbs and SayingsLong57 citations
  65. Unveiling the Generalization Power of Fine-Tuned Large Language ModelsLong57 citations
  66. LMFlow: An Extensible Toolkit for Finetuning and Inference of Large Foundation ModelsSystem Demonstrations56 citations
  67. The Bias Amplification Paradox in Text-to-Image GenerationLong55 citations
  68. Tied-LoRA: Enhancing parameter efficiency of LoRA with Weight TyingLong55 citations
  69. Do Multilingual Language Models Think Better in English?Short54 citations
  70. Found in the Middle: Permutation Self-Consistency Improves Listwise Ranking in Large Language ModelsLong52 citations
  71. Benchmarking Generation and Evaluation Capabilities of Large Language Models for Instruction Controllable SummarizationFindings50 citations
  72. ChatGPT as an Attack Tool: Stealthy Textual Backdoor Attack via Blackbox Generative Model TriggerLong50 citations
  73. A Robust Semantics-based Watermark for Large Language Model against ParaphrasingFindings47 citations
  74. Citation: A Key to Building Responsible and Accountable Large Language ModelsFindings47 citations
  75. MEGAVERSE: Benchmarking Large Language Models Across Languages, Modalities, Models and TasksLong46 citations
  76. Metacognitive Prompting Improves Understanding in Large Language ModelsLong46 citations
  77. R-Tuning: Instructing Large Language Models to Say ‘I Don’t Know’Long46 citations
  78. Can Public Large Language Models Help Private Cross-device Federated Learning?Findings45 citations
  79. Instructional Fingerprinting of Large Language ModelsLong45 citations
  80. TofuEval: Evaluating Hallucinations of LLMs on Topic-Focused Dialogue SummarizationLong45 citations
  81. LLMs Are Few-Shot In-Context Low-Resource Language LearnersLong44 citations
  82. The Curious Decline of Linguistic Diversity: Training Language Models on Synthetic TextFindings43 citations
  83. Language Models Implement Simple Word2Vec-style Vector ArithmeticLong42 citations
  84. Adapting Fake News Detection to the Era of Large Language ModelsFindings40 citations
  85. SELF-GUARD: Empower the LLM to Safeguard ItselfLong40 citations
  86. How Interpretable are Reasoning Explanations from Prompting Large Language Models?Findings39 citations
  87. AudioChatLlama: Towards General-Purpose Speech Abilities for LLMsLong38 citations
  88. Measuring and Improving Chain-of-Thought Reasoning in Vision-Language ModelsLong38 citations
  89. Task-Agnostic Detector for Insertion-Based Backdoor AttacksFindings38 citations
  90. Value FULCRA: Mapping Large Language Models to the Multidimensional Spectrum of Basic Human ValueLong37 citations
  91. GPT-who: An Information Density-based Machine-Generated Text DetectorFindings36 citations
  92. LLatrieval: LLM-Verified Retrieval for Verifiable GenerationLong36 citations
  93. Large Language Models Help Humans Verify Truthfulness – Except When They Are Convincingly WrongLong36 citations
  94. Rethinking Tabular Data Understanding with Large Language ModelsLong36 citations
  95. BotChat: Evaluating LLMs’ Capabilities of Having Multi-Turn DialoguesFindings35 citations
  96. Bridging the Novice-Expert Gap via Models of Decision-Making: A Case Study on Remediating Math MistakesLong35 citations
  97. InsCL: A Data-efficient Continual Learning Paradigm for Fine-tuning Large Language Models with InstructionsLong35 citations
  98. Self-Improving for Zero-Shot Named Entity Recognition with Large Language ModelsShort35 citations
  99. LETI: Learning to Generate from Textual InteractionsFindings34 citations
  100. Tokenizer Choice For LLM Training: Negligible or Crucial?Findings34 citations
  101. Efficient Benchmarking (of Language Models)Long33 citations
  102. Understanding the Capabilities and Limitations of Large Language Models for Cultural CommonsenseLong33 citations
  103. Effective Large Language Model Adaptation for Improved Grounding and Citation GenerationLong32 citations
  104. From Language Modeling to Instruction Following: Understanding the Behavior Shift in LLMs after Instruction TuningLong32 citations
  105. Knowing What LLMs DO NOT Know: A Simple Yet Effective Self-Detection MethodLong31 citations
  106. MacGyver: Are Large Language Models Creative Problem Solvers?Long31 citations
  107. MusiLingo: Bridging Music and Text with Pre-trained Language Models for Music Captioning and Query ResponseFindings30 citations
  108. Stealthy and Persistent Unalignment on Large Language Models via Backdoor InjectionsLong30 citations
  109. The ART of LLM Refinement: Ask, Refine, and TrustLong30 citations
  110. Defending Against Weight-Poisoning Backdoor Attacks for Parameter-Efficient Fine-TuningFindings29 citations
  111. Elastic Weight Removal for Faithful and Abstractive Dialogue GenerationLong29 citations
  112. Embrace Divergence for Richer Insights: A Multi-document Summarization Benchmark and a Case Study on Summarizing Diverse Information from News ArticlesLong29 citations
  113. End-to-End Beam Retrieval for Multi-Hop Question AnsweringLong29 citations
  114. LLM-as-a-Coauthor: Can Mixed Human-Written and Machine-Generated Text Be Detected?Findings29 citations
  115. On the Multilingual Ability of Decoder-based Pre-trained Language Models: Finding and Controlling Language-Specific NeuronsLong29 citations
  116. Grounding Gaps in Language Model GenerationsLong28 citations
  117. A Continued Pretrained LLM Approach for Automatic Medical Note GenerationShort27 citations
  118. ALoRA: Allocating Low-Rank Adaptation for Fine-tuning Large Language ModelsLong27 citations
  119. Evidence-Driven Retrieval Augmented Response Generation for Online MisinformationLong27 citations
  120. How Trustworthy are Open-Source LLMs? An Assessment under Malicious Demonstrations Shows their VulnerabilitiesLong27 citations
  121. Instruction-following Evaluation through Verbalizer ManipulationFindings27 citations
  122. Language Models Hallucinate, but May Excel at Fact VerificationLong27 citations
  123. RS-DPO: A Hybrid Rejection Sampling and Direct Preference Optimization Method for Alignment of Large Language ModelsFindings27 citations
  124. S3Eval: A Synthetic, Scalable, Systematic Evaluation Suite for Large Language ModelLong27 citations
  125. Advancing Beyond Identification: Multi-bit Watermark for Large Language ModelsLong26 citations
  126. OpenFMNav: Towards Open-Set Zero-Shot Object Navigation via Vision-Language Foundation ModelsFindings26 citations
  127. The steerability of large language models toward data-driven personasLong26 citations
  128. X-Eval: Generalizable Multi-aspect Text Evaluation via Augmented Instruction Tuning with Auxiliary Evaluation AspectsLong26 citations
  129. AutoPRM: Automating Procedural Supervision for Multi-Step Reasoning via Controllable Question DecompositionLong25 citations
  130. Evaluating Large Language Models as Generative User Simulators for Conversational RecommendationLong25 citations
  131. Learning to Compress Prompt in Natural Language FormatsLong25 citations
  132. Multimodal Multi-loss Fusion Network for Sentiment AnalysisLong25 citations
  133. Rethinking Machine Ethics – Can LLMs Perform Moral Reasoning through the Lens of Moral Theories?Findings25 citations
  134. AceGPT, Localizing Large Language Models in ArabicLong24 citations
  135. Deceptive Semantic Shortcuts on Reasoning Chains: How Far Can Models Go without Hallucination?Long24 citations
  136. Enhancing Chain-of-Thoughts Prompting with Iterative Bootstrapping in Large Language ModelsFindings24 citations
  137. GenTKG: Generative Forecasting on Temporal Knowledge Graph with Large Language ModelsFindings24 citations
  138. A Closer Look at the Self-Verification Abilities of Large Language Models in Logical ReasoningLong23 citations
  139. Enhancing Contextual Understanding in Large Language Models through Contrastive DecodingLong23 citations
  140. From Shortcuts to Triggers: Backdoor Defense with Denoised PoELong23 citations
  141. OpinionGPT: Modelling Explicit Biases in Instruction-Tuned LLMsSystem Demonstrations23 citations
  142. SeaEval for Multilingual Foundation Models: From Cross-Lingual Alignment to Cultural ReasoningLong23 citations
  143. Tiny Titans: Can Smaller Large Language Models Punch Above Their Weight in the Real World for Meeting Summarization?Industry23 citations
  144. Aligning Large Language Models with Recommendation KnowledgeFindings22 citations
  145. AutoLoRA: Automatically Tuning Matrix Ranks in Low-Rank Adaptation Based on Meta LearningLong22 citations
  146. Guiding Large Language Models to Post-Edit Machine Translation with Error AnnotationsFindings22 citations
  147. LoRETTA: Low-Rank Economic Tensor-Train Adaptation for Ultra-Low-Parameter Fine-Tuning of Large Language ModelsLong22 citations
  148. Making Language Models Better Tool Learners with Execution FeedbackLong22 citations
  149. Revisiting Zero-Shot Abstractive Summarization in the Era of Large Language Models from the Perspective of Position BiasShort22 citations
  150. TelME: Teacher-leading Multimodal Fusion Network for Emotion Recognition in ConversationLong22 citations
  151. COPAL-ID: Indonesian Language Reasoning with Local Culture and NuancesLong21 citations
  152. CoMM: Collaborative Multi-Agent, Multi-Reasoning-Path Prompting for Complex Problem SolvingFindings21 citations
  153. LLMRefine: Pinpointing and Refining Large Language Models via Fine-Grained Actionable FeedbackFindings21 citations
  154. MILL: Mutual Verification with Large Language Models for Zero-Shot Query ExpansionLong21 citations
  155. ReFACT: Updating Text-to-Image Models by Editing the Text EncoderLong21 citations
  156. A Systematic Comparison of Syllogistic Reasoning in Humans and Language ModelsLong20 citations
  157. Improving Machine Translation with Human Feedback: An Exploration of Quality Estimation as a Reward ModelLong20 citations
  158. LLaMA-Rider: Spurring Large Language Models to Explore the Open WorldFindings20 citations
  159. TabSQLify: Enhancing Reasoning Capabilities of LLMs Through Table DecompositionLong20 citations
  160. Are Large Language Model Temporally Grounded?Long19 citations
  161. BUFFET: Benchmarking Large Language Models for Few-shot Cross-lingual TransferLong19 citations
  162. CodecLM: Aligning Language Models with Tailored Synthetic DataFindings19 citations
  163. Flames: Benchmarking Value Alignment of LLMs in ChineseLong19 citations
  164. LLM-based Medical Assistant Personalization with Short- and Long-Term Memory CoordinationLong19 citations
  165. LangNav: Language as a Perceptual Representation for NavigationFindings19 citations
  166. On Large Language Models’ Hallucination with Regard to Known FactsLong19 citations
  167. The Perspectivist Paradigm Shift: Assumptions and Challenges of Capturing Human LabelsLong19 citations
  168. Uncertainty Quantification for In-Context Learning of Large Language ModelsLong19 citations
  169. When Life Gives You Lemons, Make Cherryade: Converting Feedback from Bad Responses into Good LabelsLong19 citations
  170. pyvene: A Library for Understanding and Improving PyTorch Models via InterventionsSystem Demonstrations19 citations
  171. A Study on the Calibration of In-context LearningLong18 citations
  172. A Systematic Comparison of Contextualized Word Embeddings for Lexical Semantic ChangeLong18 citations
  173. ComCLIP: Training-Free Compositional Image and Text MatchingLong18 citations
  174. DialogBench: Evaluating LLMs as Human-like Dialogue SystemsLong18 citations
  175. Direct Preference Optimization for Neural Machine Translation with Minimum Bayes Risk DecodingShort18 citations
  176. EIVEN: Efficient Implicit Attribute Value Extraction using Multimodal LLMIndustry18 citations
  177. Exploring Automated Distractor Generation for Math Multiple-choice Questions via Large Language ModelsFindings18 citations
  178. Fake Alignment: Are LLMs Really Aligned Well?Long18 citations
  179. How are Prompts Different in Terms of Sensitivity?Long18 citations
  180. InstructEval: Systematic Evaluation of Instruction Selection MethodsFindings18 citations
  181. NLP for Counterspeech against Hate: A Survey and How-To GuideFindings18 citations
  182. Rehearsal-Free Modular and Compositional Continual Learning for Language ModelsShort18 citations
  183. Which Modality should I use - Text, Motif, or Image? : Understanding Graphs with Large Language ModelsFindings18 citations
  184. A Novel Paradigm Boosting Translation Capabilities of Large Language ModelsFindings17 citations
  185. CLEAN–EVAL: Clean Evaluation on Contaminated Large Language ModelsFindings17 citations
  186. Contextual Refinement of Translations: Large Language Models for Sentence and Document-Level Post-EditingLong17 citations
  187. Exploring the Impact of Table-to-Text Methods on Augmenting LLM-based Question Answering with Domain Hybrid DataIndustry17 citations
  188. First Tragedy, then Parse: History Repeats Itself in the New Era of Large Language ModelsLong17 citations
  189. GEE! Grammar Error Explanation with Large Language ModelsFindings17 citations
  190. GenRES: Rethinking Evaluation for Generative Relation Extraction in the Era of Large Language ModelsLong17 citations
  191. Low-code LLM: Graphical User Interface over Large Language ModelsSystem Demonstrations17 citations
  192. SocREval: Large Language Models with the Socratic Method for Reference-free Reasoning EvaluationFindings17 citations
  193. SportQA: A Benchmark for Sports Understanding in Large Language ModelsLong17 citations
  194. Transformers Can Represent n-gram Language ModelsLong17 citations
  195. Universal Prompt Optimizer for Safe Text-to-Image GenerationLong17 citations
  196. What Makes Math Word Problems Challenging for LLMs?Findings17 citations
  197. AbsPyramid: Benchmarking the Abstraction Ability of Language Models with a Unified Entailment GraphFindings16 citations
  198. PlanRAG: A Plan-then-Retrieval Augmented Generation for Generative Large Language Models as Decision MakersLong16 citations
  199. Sub-Sentence Encoder: Contrastive Learning of Propositional Semantic RepresentationsLong16 citations
  200. This Land is Your, My Land: Evaluating Geopolitical Bias in Language Models through Territorial DisputesLong16 citations
  201. Topics, Authors, and Institutions in Large Language Model Research: Trends from 17K arXiv PapersLong16 citations
  202. Universal NER: A Gold-Standard Multilingual Named Entity Recognition BenchmarkLong16 citations
  203. WaterJudge: Quality-Detection Trade-off when Watermarking Large Language ModelsFindings16 citations
  204. When Hindsight is Not 20/20: Testing Limits on Reflective Thinking in Large Language ModelsFindings16 citations
  205. Why So Gullible? Enhancing the Robustness of Retrieval-Augmented Models against Counterfactual NoiseFindings16 citations
  206. Ada-LEval: Evaluating long-context LLMs with length-adaptable benchmarksLong15 citations
  207. AgentQuest: A Modular Benchmark Framework to Measure Progress and Improve LLM AgentsSystem Demonstrations15 citations
  208. Depression Detection in Clinical Interviews with LLM-Empowered Structural Element GraphLong15 citations
  209. Emotion-Anchored Contrastive Learning Framework for Emotion Recognition in ConversationFindings15 citations
  210. Evaluating the Deductive Competence of Large Language ModelsLong15 citations
  211. Exploring Cross-Cultural Differences in English Hate Speech Annotations: From Dataset Construction to AnalysisLong15 citations
  212. Improving In-context Learning of Multilingual Generative Language Models with Cross-lingual AlignmentLong15 citations
  213. OrchestraLLM: Efficient Orchestration of Language Models for Dialogue State TrackingLong15 citations
  214. POLYIE: A Dataset of Information Extraction from Polymer Material Scientific LiteratureLong15 citations
  215. Personalized Jargon Identification for Enhanced Interdisciplinary CommunicationLong15 citations
  216. Safer-Instruct: Aligning Language Models with Automated Preference DataLong15 citations
  217. Toolink: Linking Toolkit Creation and Using through Chain-of-Solving on Open-Source ModelLong15 citations
  218. Can Language Model Moderators Improve the Health of Online Discourse?Long14 citations
  219. DecoderLens: Layerwise Interpretation of Encoder-Decoder TransformersFindings14 citations
  220. EchoPrompt: Instructing the Model to Rephrase Queries for Improved In-context LearningShort14 citations
  221. Evaluating In-Context Learning of Libraries for Code GenerationLong14 citations
  222. Instruction Tuning with Human CurriculumFindings14 citations
  223. Leveraging Generative Large Language Models with Visual Instruction and Demonstration Retrieval for Multimodal Sarcasm DetectionLong14 citations
  224. Modeling the Sacred: Considerations when Using Religious Texts in Natural Language ProcessingFindings14 citations
  225. Natural Language Embedded Programs for Hybrid Language Symbolic ReasoningFindings14 citations
  226. On-the-fly Definition Augmentation of LLMs for Biomedical NERLong14 citations
  227. Psychometric Predictive Power of Large Language ModelsFindings14 citations
  228. RESPROMPT: Residual Connection Prompting Advances Multi-Step Reasoning in Large Language ModelsLong14 citations
  229. Role Prompting Guided Domain Adaptation with General Capability Preserve for Large Language ModelsFindings14 citations
  230. Teaching Language Models to Self-Improve through Interactive DemonstrationsLong14 citations
  231. UICoder: Finetuning Large Language Models to Generate User Interface Code through Automated FeedbackLong14 citations
  232. ACLSum: A New Dataset for Aspect-based Summarization of Scientific PublicationsLong13 citations
  233. Actively Learn from LLMs with Uncertainty Propagation for Generalized Category DiscoveryLong13 citations
  234. BeLLM: Backward Dependency Enhanced Large Language Model for Sentence EmbeddingsLong13 citations
  235. Breaking the Language Barrier: Can Direct Inference Outperform Pre-Translation in Multilingual LLM Applications?Short13 citations
  236. Bridging the Gap between Different Vocabularies for LLM EnsembleLong13 citations
  237. Bring Your Own KG: Self-Supervised Program Synthesis for Zero-Shot KGQAFindings13 citations
  238. Capturing Perspectives of Crowdsourced Annotators in Subjective Learning TasksLong13 citations
  239. Chart-based Reasoning: Transferring Capabilities from LLMs to VLMsFindings13 citations
  240. ContraDoc: Understanding Self-Contradictions in Documents with Large Language ModelsLong13 citations
  241. Enhancing Cross-lingual Sentence Embedding for Low-resource Languages with Word AlignmentFindings13 citations
  242. Fair Abstractive Summarization of Diverse PerspectivesLong13 citations
  243. In-Context Example Ordering Guided by Label DistributionsFindings13 citations
  244. IterAlign: Iterative Constitutional Alignment of Large Language ModelsLong13 citations
  245. KDMCSE: Knowledge Distillation Multimodal Sentence Embeddings with Adaptive Angular margin Contrastive LearningLong13 citations
  246. Leveraging LLMs for Synthesizing Training Data Across Many Languages in Multilingual Dense RetrievalLong13 citations
  247. Multilingual Pretraining and Instruction Tuning Improve Cross-Lingual Knowledge Alignment, But Only ShallowlyLong13 citations
  248. On Evaluating the Integration of Reasoning and Action in LLM Agents with Database Question AnsweringFindings13 citations
  249. Prompt Space Optimizing Few-shot Reasoning Success with Large Language ModelsFindings13 citations
  250. ReEval: Automatic Hallucination Evaluation for Retrieval-Augmented Large Language Models via Transferable Adversarial AttacksFindings13 citations
  251. Retrieval Helps or Hurts? A Deeper Dive into the Efficacy of Retrieval Augmentation to Language ModelsLong13 citations
  252. zrLLM: Zero-Shot Relational Learning on Temporal Knowledge Graphs with Large Language ModelsLong13 citations
  253. ALOHa: A New Measure for Hallucination in Captioning ModelsShort12 citations
  254. Confronting LLMs with Traditional ML: Rethinking the Fairness of Large Language Models in Tabular ClassificationsLong12 citations
  255. Crafting In-context Examples according to LMs’ Parametric KnowledgeFindings12 citations
  256. Do Localization Methods Actually Localize Memorized Data in LLMs? A Tale of Two BenchmarksLong12 citations
  257. FUN with Fisher: Improving Generalization of Adapter-Based Cross-lingual Transfer with Scheduled UnfreezingLong12 citations
  258. LLM-Driven Knowledge Injection Advances Zero-Shot and Cross-Target Stance DetectionShort12 citations
  259. MAFALDA: A Benchmark and Comprehensive Study of Fallacy Detection and ClassificationLong12 citations
  260. OSCaR: Object State Captioning and State Change RepresentationFindings12 citations
  261. ParallelPARC: A Scalable Pipeline for Generating Natural-Language AnalogiesLong12 citations
  262. Teaching Llama a New Language Through Cross-Lingual Knowledge TransferFindings12 citations
  263. TriSum: Learning Summarization Ability from Large Language Models with Structured RationaleLong12 citations
  264. A Multi-Aspect Framework for Counter Narrative Evaluation using Large Language ModelsShort11 citations
  265. A Tree-of-Thoughts to Broaden Multi-step Reasoning across LanguagesFindings11 citations
  266. Beyond Performance: Quantifying and Mitigating Label Bias in LLMsLong11 citations
  267. Carpe diem: On the Evaluation of World Knowledge in Lifelong Language ModelsLong11 citations
  268. E5: Zero-shot Hierarchical Table Analysis using Augmented LLMs via Explain, Extract, Execute, Exhibit and ExtrapolateLong11 citations
  269. GPT-Fathom: Benchmarking Large Language Models to Decipher the Evolutionary Path towards GPT-4 and BeyondFindings11 citations
  270. ICXML: An In-Context Learning Framework for Zero-Shot Extreme Multi-Label ClassificationFindings11 citations
  271. In-context Learning Generalizes, But Not Always Robustly: The Case of SyntaxLong11 citations
  272. LeanReasoner: Boosting Complex Logical Reasoning with LeanLong11 citations
  273. METAL: Towards Multilingual Meta-EvaluationFindings11 citations
  274. More Samples or More Prompts? Exploring Effective Few-Shot In-Context Learning for LLMs with In-Context SamplingFindings11 citations
  275. NLP Systems That Can’t Tell Use from Mention Censor Counterspeech, but Teaching the Distinction HelpsLong11 citations
  276. On-the-Fly Fusion of Large Language Models and Machine TranslationFindings11 citations
  277. Paraphrase and Solve: Exploring and Exploiting the Impact of Surface Form on Mathematical Reasoning in Large Language ModelsLong11 citations
  278. Shears: Unstructured Sparsity with Neural Low-rank Adapter SearchIndustry11 citations
  279. Struc-Bench: Are Large Language Models Good at Generating Complex Structured Tabular Data?Short11 citations
  280. Towards an On-device Agent for Text RewritingFindings11 citations
  281. Unitxt: Flexible, Shareable and Reusable Data Preparation and Evaluation for Generative AISystem Demonstrations11 citations
  282. Unlocking Emergent Modularity in Large Language ModelsLong11 citations
  283. Assessing Factual Reliability of Large Language Model KnowledgeLong10 citations
  284. BPE-knockout: Pruning Pre-existing BPE Tokenisers with Backwards-compatible Morphological Semi-supervisionLong10 citations
  285. Building Knowledge-Guided Lexica to Model Cultural VariationLong10 citations
  286. Document Image Machine Translation with Dynamic Multi-pre-trained Models AssemblingLong10 citations
  287. Ethos: Rectifying Language Models in Orthogonal Parameter SpaceFindings10 citations
  288. Getting Sick After Seeing a Doctor? Diagnosing and Mitigating Knowledge Conflicts in Event Temporal ReasoningFindings10 citations
  289. Long-form evaluation of model editingLong10 citations
  290. MATHSENSEI: A Tool-Augmented Large Language Model for Mathematical ReasoningLong10 citations
  291. ReTA: Recursively Thinking Ahead to Improve the Strategic Reasoning of Large Language ModelsLong10 citations
  292. SEMQA: Semi-Extractive Multi-Source Question AnsweringLong10 citations
  293. SMILE: Multimodal Dataset for Understanding Laughter in Video with Language ModelsFindings10 citations
  294. TRAQ: Trustworthy Retrieval Augmented Question Answering via Conformal PredictionLong10 citations
  295. The Colorful Future of LLMs: Evaluating and Improving LLMs as Emotional Supporters for Queer YouthLong10 citations
  296. The Impact of Depth on Compositional Generalization in Transformer Language ModelsLong10 citations
  297. Time Machine GPTFindings10 citations
  298. Tokenization Matters: Navigating Data-Scarce Tokenization for Gender Inclusive Language TechnologiesFindings10 citations
  299. Visual Grounding Helps Learn Word Meanings in Low-Data RegimesLong10 citations
  300. X-LLaVA: Optimizing Bilingual Large Vision-Language AlignmentFindings10 citations
  301. You don’t need a personality test to know these models are unreliable: Assessing the Reliability of Large Language Models on Psychometric InstrumentsLong10 citations
  302. A Preference-driven Paradigm for Enhanced Translation with Large Language ModelsLong9 citations
  303. A Theory Guided Scaffolding Instruction Framework for LLM-Enabled Metaphor ReasoningLong9 citations
  304. Arithmetic Reasoning with LLM: Prolog Generation & PermutationShort9 citations
  305. Assessing Logical Puzzle Solving in Large Language Models: Insights from a Minesweeper Case StudyLong9 citations
  306. Differentially Private Next-Token Prediction of Large Language ModelsLong9 citations
  307. Edu-ConvoKit: An Open-Source Library for Education Conversation DataSystem Demonstrations9 citations
  308. Efficiently Distilling LLMs for Edge ApplicationsIndustry9 citations
  309. Examining Modularity in Multilingual LMs via Language-Specialized SubnetworksFindings9 citations
  310. Extending CLIP’s Image-Text Alignment to Referring Image SegmentationLong9 citations
  311. GRASP: A Disagreement Analysis Framework to Assess Group Associations in PerspectivesLong9 citations
  312. Improving Adversarial Data Collection by Supporting Annotators: Lessons from GAHD, a German Hate Speech DatasetLong9 citations
  313. IndiBias: A Benchmark Dataset to Measure Social Biases in Language Models for Indian ContextLong9 citations
  314. Investigating the Emergent Audio Classification Ability of ASR Foundation ModelsLong9 citations
  315. Large Human Language Models: A Need and the ChallengesLong9 citations
  316. Llama meets EU: Investigating the European political spectrum through the lens of LLMsShort9 citations
  317. Measuring Social Norms of Large Language ModelsFindings9 citations
  318. Naive Bayes-based Context Extension for Large Language ModelsLong9 citations
  319. PEEB: Part-based Image Classifiers with an Explainable and Editable Language BottleneckFindings9 citations
  320. Planning and Editing What You Retrieve for Enhanced Tool LearningFindings9 citations
  321. Pruning as a Domain-specific LLM ExtractorFindings9 citations
  322. RENOVI: A Benchmark Towards Remediating Norm Violations in Socio-Cultural ConversationsFindings9 citations
  323. Reverse Chain: A Generic-Rule for LLMs to Master Multi-API PlanningFindings9 citations
  324. Solving General Natural-Language-Description Optimization Problems with Large Language ModelsIndustry9 citations
  325. Toward Informal Language Processing: Knowledge of Slang in Large Language ModelsLong9 citations
  326. Visual Grounding for User InterfacesIndustry9 citations
  327. Weight-Inherited Distillation for Task-Agnostic BERT CompressionFindings9 citations
  328. Z-GMOT: Zero-shot Generic Multiple Object TrackingFindings9 citations
  329. Backdoor Attacks on Multilingual Machine TranslationLong8 citations
  330. CLGSI: A Multimodal Sentiment Analysis Framework based on Contrastive Learning Guided by Sentiment IntensityFindings8 citations
  331. COSIGN: Contextual Facts Guided Generation for Knowledge Graph CompletionLong8 citations
  332. Contextualizing Argument Quality Assessment with Relevant KnowledgeShort8 citations
  333. DEED: Dynamic Early Exit on Decoder for Accelerating Encoder-Decoder Transformer ModelsFindings8 citations
  334. DIALIGHT: Lightweight Multilingual Development and Evaluation of Task-Oriented Dialogue Systems with Large Language ModelsSystem Demonstrations8 citations
  335. DiLM: Distilling Dataset into Language Model for Text-level Dataset DistillationFindings8 citations
  336. Do Large Language Models Rank Fairly? An Empirical Study on the Fairness of LLMs as RankersLong8 citations
  337. FREB-TQA: A Fine-Grained Robustness Evaluation Benchmark for Table Question AnsweringLong8 citations
  338. Heterogeneity over Homogeneity: Investigating Multilingual Speech Pre-Trained Models for Detecting Audio DeepfakeFindings8 citations
  339. Hierarchical Attention Graph for Scientific Document Summarization in Global and Local LevelFindings8 citations
  340. In-context Learning and Gradient Descent RevisitedLong8 citations
  341. It’s All Relative! – A Synthetic Query Generation Approach for Improving Zero-Shot Relevance PredictionFindings8 citations
  342. Language Models can be Deductive SolversFindings8 citations
  343. Low-resource neural machine translation with morphological modelingFindings8 citations
  344. NLP Progress in Indigenous Latin American LanguagesLong8 citations
  345. NeuroComparatives: Neuro-Symbolic Distillation of Comparative KnowledgeFindings8 citations
  346. PILOT: Legal Case Outcome Prediction with Case LawLong8 citations
  347. Prompt-Singer: Controllable Singing-Voice-Synthesis with Natural Language PromptLong8 citations
  348. Reinforcement Learning with Token-level Feedback for Controllable Text GenerationFindings8 citations
  349. SharpSeq: Empowering Continual Event Detection through Sharpness-Aware Sequential-task LearningLong8 citations
  350. UniverSLU: Universal Spoken Language Understanding for Diverse Tasks with Natural Language InstructionsLong8 citations
  351. What Are We Measuring When We Evaluate Large Vision-Language Models? An Analysis of Latent Factors and BiasesLong8 citations
  352. AWESOME: GPU Memory-constrained Long Document Summarization using Memory Mechanism and Global Salient ContentLong7 citations
  353. AdaRefiner: Refining Decisions of Language Models with Adaptive FeedbackFindings7 citations
  354. Advancing the Robustness of Large Language Models through Self-Denoised SmoothingShort7 citations
  355. Automatic Generation of Model and Data Cards: A Step Towards Responsible AILong7 citations
  356. CM-TTS: Enhancing Real Time Text-to-Speech Synthesis Efficiency through Weighted Samplers and Consistency ModelsFindings7 citations
  357. Can LLM’s Generate Human-Like Wayfinding Instructions? Towards Platform-Agnostic Embodied Instruction SynthesisShort7 citations
  358. CoDa: Constrained Generation based Data Augmentation for Low-Resource NLPFindings7 citations
  359. DIVKNOWQA: Assessing the Reasoning Ability of LLMs via Open-Domain Question Answering over Knowledge Base and TextFindings7 citations
  360. DialogCC: An Automated Pipeline for Creating High-Quality Multi-Modal Dialogue DatasetLong7 citations
  361. Embodied Executable Policy Learning with Language-based Scene SummarizationLong7 citations
  362. Enhancing the General Agent Capabilities of Low-Paramter LLMs through Tuning and Multi-Branch ReasoningFindings7 citations
  363. Event Causality Is Key to Computational Story UnderstandingLong7 citations
  364. Fine-Tuning Language Models with Reward Learning on PolicyLong7 citations
  365. GoT: Effective Graph-of-Thought Reasoning in Language ModelsFindings7 citations
  366. HILL: Hierarchy-aware Information Lossless Contrastive Learning for Hierarchical Text ClassificationLong7 citations
  367. How Well Do Large Language Models Truly Ground?Long7 citations
  368. How did we get here? Summarizing conversation dynamicsLong7 citations
  369. ICLE++: Modeling Fine-Grained Traits for Holistic Essay ScoringLong7 citations
  370. Improving Health Question Answering with Reliable and Time-Aware Evidence RetrievalFindings7 citations
  371. IterCQR: Iterative Conversational Query Reformulation with Retrieval GuidanceLong7 citations
  372. Key ingredients for effective zero-shot cross-lingual knowledge transfer in generative tasksLong7 citations
  373. Kreyòl-MT: Building MT for Latin American, Caribbean and Colonial African Creole LanguagesLong7 citations
  374. LifeTox: Unveiling Implicit Toxicity in Life AdviceShort7 citations
  375. Lossless Acceleration of Large Language Model via Adaptive N-gram Parallel DecodingIndustry7 citations
  376. MSciNLI: A Diverse Benchmark for Scientific Natural Language InferenceLong7 citations
  377. Mitigating Bias for Question Answering Models by Tracking Bias InfluenceLong7 citations
  378. MultiParaDetox: Extending Text Detoxification with Parallel Data to New LanguagesShort7 citations
  379. Optimizing LLM Based Retrieval Augmented Generation Pipelines in the Financial DomainIndustry7 citations
  380. PaD: Program-aided Distillation Can Teach Small Models Reasoning Better than Chain-of-thought Fine-tuningLong7 citations
  381. Polarity Calibration for Opinion SummarizationLong7 citations
  382. Product Description and QA Assisted Self-Supervised Opinion SummarizationFindings7 citations
  383. Reason from Fallacy: Enhancing Large Language Models’ Logical Reasoning through Logical Fallacy UnderstandingFindings7 citations
  384. SGSH: Stimulate Large Language Models with Skeleton Heuristics for Knowledge Base Question GenerationFindings7 citations
  385. The Impact of Differential Privacy on Group Disparity MitigationFindings7 citations
  386. The Integration of Semantic and Structural Knowledge in Knowledge Graph Entity TypingLong7 citations
  387. The Role of n-gram Smoothing in the Age of Neural NetworksLong7 citations
  388. The Whole is Better than the Sum: Using Aggregated Demonstrations in In-Context Learning for Sequential RecommendationFindings7 citations
  389. Think While You Write: Hypothesis Verification Promotes Faithful Knowledge-to-Text GenerationFindings7 citations
  390. To Tell The Truth: Language of Deception and Language ModelsLong7 citations
  391. TrojFSP: Trojan Insertion in Few-shot Prompt TuningLong7 citations
  392. VisLingInstruct: Elevating Zero-Shot Learning in Multi-Modal Language Models with Autonomous Instruction OptimizationLong7 citations
  393. Visually Guided Generative Text-Layout Pre-training for Document IntelligenceLong7 citations
  394. Visually-Aware Context Modeling for News Image CaptioningLong7 citations
  395. “One-Size-Fits-All”? Examining Expectations around What Constitute “Fair” or “Good” NLG System BehaviorsLong7 citations
  396. A Novel Two-step Fine-tuning Framework for Transfer Learning in Low-Resource Neural Machine TranslationFindings6 citations
  397. A Survey of Meaning Representations – From Theory to Practical UtilityLong6 citations
  398. AMA-LSTM: Pioneering Robust and Fair Financial Audio Analysis for Stock Volatility PredictionIndustry6 citations
  399. AMRFact: Enhancing Summarization Factuality Evaluation with AMR-Driven Negative Samples GenerationLong6 citations
  400. ATG: Benchmarking Automated Theorem Generation for Generative Language ModelsFindings6 citations
  401. Adaptive Rank Selections for Low-Rank Approximation of Language ModelsLong6 citations
  402. AfriMTE and AfriCOMET: Enhancing COMET to Embrace Under-resourced African LanguagesLong6 citations
  403. Aligning as Debiasing: Causality-Aware Alignment via Reinforcement Learning with Interventional FeedbackLong6 citations
  404. An Interactive Framework for Profiling News Media SourcesLong6 citations
  405. Analyzing the Role of Semantic Representations in the Era of Large Language ModelsLong6 citations
  406. Biomedical Entity Representation with Graph-Augmented Multi-Objective TransformerFindings6 citations
  407. CCSum: A Large-Scale and High-Quality Dataset for Abstractive News SummarizationLong6 citations
  408. CoE-SQL: In-Context Learning for Multi-Turn Text-to-SQL with Chain-of-EditionsLong6 citations
  409. DoG-Instruct: Towards Premium Instruction-Tuning Data via Text-Grounded Instruction WrappingLong6 citations
  410. Elote, Choclo and Mazorca: on the Varieties of SpanishLong6 citations
  411. Enhancing Large Language Models Against Inductive Instructions with Dual-critique PromptingLong6 citations
  412. Event Detection from Social Media for Epidemic PredictionLong6 citations
  413. F-MALLOC: Feed-forward Memory Allocation for Continual Learning in Neural Machine TranslationLong6 citations
  414. GOLD: Geometry Problem Solver with Natural Language DescriptionFindings6 citations
  415. Generalizable Multilingual Hate Speech Detection on Low Resource Indian Languages using Fair Selection in Federated LearningLong6 citations
  416. Graph-Induced Syntactic-Semantic Spaces in Transformer-Based Variational AutoEncodersFindings6 citations
  417. Groundedness in Retrieval-augmented Long-form Generation: An Empirical StudyFindings6 citations
  418. HPipe: Large Language Model Pipeline Parallelism for Long Context on Heterogeneous Cost-effective DevicesIndustry6 citations
  419. Hallucination Diversity-Aware Active Learning for Text SummarizationLong6 citations
  420. Improved Text Emotion Prediction Using Combined Valence and Arousal Ordinal ClassificationShort6 citations
  421. JAMDEC: Unsupervised Authorship Obfuscation using Constrained Decoding over Small Language ModelsLong6 citations
  422. Leveraging Code to Improve In-Context Learning for Semantic ParsingLong6 citations
  423. Lower Bounds on the Expressivity of Recurrent Neural Language ModelsLong6 citations
  424. MAGID: An Automated Pipeline for Generating Synthetic Multi-modal DatasetsLong6 citations
  425. Memory Augmented Language Models through Mixture of Word ExpertsLong6 citations
  426. Mind’s Mirror: Distilling Self-Evaluation Capability and Comprehensive Thinking from Large Language ModelsLong6 citations
  427. Multi-Operational Mathematical Derivations in Latent SpaceLong6 citations
  428. Native Language Identification in Texts: A SurveyLong6 citations
  429. Okay, Let’s Do This! Modeling Event Coreference with Generated Rationales and Knowledge DistillationLong6 citations
  430. On the Role of Summary Content Units in Text Summarization EvaluationShort6 citations
  431. PRODIGy: a PROfile-based DIalogue Generation datasetFindings6 citations
  432. SemRoDe: Macro Adversarial Training to Learn Representations that are Robust to Word-Level AttacksLong6 citations
  433. Semi-Structured Chain-of-Thought: Integrating Multiple Sources of Knowledge for Improved Language Model ReasoningLong6 citations
  434. Semi-Supervised Dialogue Abstractive Summarization via High-Quality Pseudolabel SelectionLong6 citations
  435. SimSCOOD: Systematic Analysis of Out-of-Distribution Generalization in Fine-tuned Source Code ModelsFindings6 citations
  436. Social Meme-ing: Measuring Linguistic Variation in MemesLong6 citations
  437. Text Diffusion Model with Encoder-Decoder Transformers for Sequence-to-Sequence GenerationLong6 citations
  438. The Promises and Pitfalls of Using Language Models to Measure Instruction Quality in EducationLong6 citations
  439. The taste of IPA: Towards open-vocabulary keyword spotting and forced alignment in any languageLong6 citations
  440. ToXCL: A Unified Framework for Toxic Speech Detection and ExplanationLong6 citations
  441. Two Heads are Better than One: Nested PoE for Robust Defense Against Multi-BackdoorsLong6 citations
  442. UINav: A Practical Approach to Train On-Device Automation AgentsIndustry6 citations
  443. Uncertainty Estimation on Sequential Labeling via Uncertainty TransmissionFindings6 citations
  444. mEdIT: Multilingual Text Editing via Instruction TuningLong6 citations
  445. mOthello: When Do Cross-Lingual Representation Alignment and Cross-Lingual Transfer Emerge in Multilingual Models?Findings6 citations
  446. A Measure for Transparent Comparison of Linguistic Diversity in Multilingual NLP Data SetsFindings5 citations
  447. Anisotropy is Not Inherent to TransformersLong5 citations
  448. CPopQA: Ranking Cultural Concept Popularity by LLMsShort5 citations
  449. Comparing Two Model Designs for Clinical Note Generation; Is an LLM a Useful Evaluator of Consistency?Findings5 citations
  450. Connecting the Dots: Inferring Patent Phrase Similarity with Retrieved Phrase GraphsFindings5 citations
  451. Context Does Matter: Implications for Crowdsourced Evaluation Labels in Task-Oriented Dialogue SystemsFindings5 citations
  452. Crossing Linguistic Horizons: Finetuning and Comprehensive Evaluation of Vietnamese Large Language ModelsFindings5 citations
  453. David helps Goliath: Inference-Time Collaboration Between Small Specialized and Large General Diffusion LMsLong5 citations
  454. Defining and Detecting Vulnerability in Human Evaluation Guidelines: A Preliminary Study Towards Reliable NLG EvaluationLong5 citations
  455. Does Pre-trained Language Model Actually Infer Unseen Links in Knowledge Graph Completion?Long5 citations
  456. EMONA: Event-level Moral Opinions in News ArticlesLong5 citations
  457. Efficient Information Extraction in Few-Shot Relation Classification through Contrastive Representation LearningShort5 citations
  458. Encoding of lexical tone in self-supervised models of spoken languageLong5 citations
  459. Explaining Text Similarity in Transformer ModelsLong5 citations
  460. Exploring Self-supervised Logic-enhanced Training for Large Language ModelsLong5 citations
  461. FLAP: Flow-Adhering Planning with Constrained Decoding in LLMsLong5 citations
  462. Generalizable Sarcasm Detection is Just Around the Corner, of Course!Long5 citations
  463. Global Gallery: The Fine Art of Painting Culture Portraits through Multilingual Instruction TuningLong5 citations
  464. HateModerate: Testing Hate Speech Detectors against Content Moderation PoliciesFindings5 citations
  465. Intent-conditioned and Non-toxic Counterspeech Generation using Multi-Task Instruction Tuning with RLAIFLong5 citations
  466. Investigating Acceleration of LLaMA Inference by Enabling Intermediate Layer Decoding via Instruction Tuning with ‘LITE’Findings5 citations
  467. KnowLA: Enhancing Parameter-efficient Finetuning with Knowledgeable AdaptationLong5 citations
  468. LinkPrompt: Natural and Universal Adversarial Attacks on Prompt-based Language ModelsLong5 citations
  469. MOKA: Moral Knowledge Augmentation for Moral Event ExtractionLong5 citations
  470. MapGuide: A Simple yet Effective Method to Reconstruct Continuous Language from Brain ActivitiesLong5 citations
  471. Modeling Empathetic Alignment in ConversationLong5 citations
  472. MuLan: A Study of Fact Mutability in Language ModelsShort5 citations
  473. Narrowing the Gap between Zero- and Few-shot Machine Translation by Matching StylesFindings5 citations
  474. Q-Tuning: Queue-based Prompt Tuning for Lifelong Few-shot Language LearningFindings5 citations
  475. QueryExplorer: An Interactive Query Generation Assistant for Search and ExplorationSystem Demonstrations5 citations
  476. Rationale-based Opinion SummarizationLong5 citations
  477. Select and Summarize: Scene Saliency for Movie Script SummarizationFindings5 citations
  478. Selective Perception: Learning Concise State Descriptions for Language Model ActorsShort5 citations
  479. Set-Aligning Framework for Auto-Regressive Event Temporal Graph GenerationLong5 citations
  480. Solving Data-centric Tasks using Large Language ModelsFindings5 citations
  481. Synthetic Query Generation for Privacy-Preserving Deep Retrieval Systems using Differentially Private Language ModelsLong5 citations
  482. To Translate or Not to Translate: A Systematic Investigation of Translation-Based Cross-Lingual Transfer to Low-Resource LanguagesLong5 citations
  483. Towards Explainability in Legal Outcome Prediction ModelsLong5 citations
  484. Tram: A Token-level Retrieval-augmented Mechanism for Source Code SummarizationFindings5 citations
  485. Uncertainty Estimation in Large Language Models to Support Biodiversity ConservationIndustry5 citations
  486. Unlocking Parameter-Efficient Fine-Tuning for Low-Resource Language TranslationFindings5 citations
  487. VLUE: A New Benchmark and Multi-task Knowledge Transfer Learning for Vietnamese Natural Language UnderstandingFindings5 citations
  488. Whispers of Doubt Amidst Echoes of Triumph in NLP RobustnessLong5 citations
  489. “You are an expert annotator”: Automatic Best–Worst-Scaling Annotations for Emotion Intensity ModelingLong5 citations
  490. ALBA: Adaptive Language-Based Assessments for Mental HealthLong4 citations
  491. Advancing Regular Language Reasoning in Linear Recurrent Neural NetworksShort4 citations
  492. An Effective Automated Speaking Assessment Approach to Mitigating Data Scarcity and Imbalanced DistributionFindings4 citations
  493. An Examination of the Compositionality of Large Generative Vision-Language ModelsLong4 citations
  494. AnchorAL: Computationally Efficient Active Learning for Large and Imbalanced DatasetsLong4 citations
  495. Anti-LM Decoding for Zero-shot In-context Machine TranslationFindings4 citations
  496. Aspect-based Sentiment Analysis with Context DenoisingFindings4 citations
  497. BUST: Benchmark for the evaluation of detectors of LLM-Generated TextLong4 citations
  498. Benchmark Transparency: Measuring the Impact of Data on EvaluationLong4 citations
  499. Best of Both Worlds: A Pliable and Generalizable Neuro-Symbolic Approach for Relation ClassificationFindings4 citations
  500. Beyond Surface Similarity: Detecting Subtle Semantic Shifts in Financial NarrativesFindings4 citations
  501. Comparing Explanation Faithfulness between Multilingual and Monolingual Fine-tuned Language ModelsLong4 citations
  502. Conformer-Based Speech Recognition On Extreme Edge-Computing DevicesIndustry4 citations
  503. DAGCN: Distance-based and Aspect-oriented Graph Convolutional Network for Aspect-based Sentiment AnalysisFindings4 citations
  504. DivTOD: Unleashing the Power of LLMs for Diversifying Task-Oriented Dialogue RepresentationsFindings4 citations
  505. Do Prompt Positions Really Matter?Findings4 citations
  506. Effective and Efficient Conversation Retrieval for Dialogue State Tracking with Implicit Text SummariesLong4 citations
  507. Emergent Abilities in Reduced-Scale Generative Language ModelsFindings4 citations
  508. FedLFC: Towards Efficient Federated Multilingual Modeling with LoRA-based Language Family ClusteringFindings4 citations
  509. GINopic: Topic Modeling with Graph Isomorphism NetworkLong4 citations
  510. GOLD: Generalized Knowledge Distillation via Out-of-Distribution-Guided Language Data GenerationFindings4 citations
  511. Generating Mental Health Transcripts with SAPE (Spanish Adaptive Prompt Engineering)Long4 citations
  512. HTCCN: Temporal Causal Convolutional Networks with Hawkes Process for Extrapolation Reasoning in Temporal Knowledge GraphsLong4 citations
  513. Identifying Linear Relational Concepts in Large Language ModelsLong4 citations
  514. Instructing Large Language Models to Identify and Ignore Irrelevant ConditionsLong4 citations
  515. Is Reference Necessary in the Evaluation of NLG Systems? When and Where?Long4 citations
  516. LLM-based Frameworks for API Argument Filling in Task-Oriented Conversational SystemsIndustry4 citations
  517. LaDiC: Are Diffusion Models Really Inferior to Autoregressive Counterparts for Image-to-Text Generation?Long4 citations
  518. Language Models (Mostly) Do Not Consider Emotion Triggers When Predicting EmotionShort4 citations
  519. Large Language Models can Contrastively Refine their Generation for Better Sentence Representation LearningLong4 citations
  520. Leveraging LLMs for Dialogue Quality MeasurementIndustry4 citations
  521. Leveraging Prototypical Representations for Mitigating Social Bias without Demographic InformationShort4 citations
  522. Low-Rank Adaptation for Multilingual Summarization: An Empirical StudyFindings4 citations
  523. MDR: Model-Specific Demonstration Retrieval at Inference Time for In-Context LearningLong4 citations
  524. Media Bias Detection Across Families of Language ModelsLong4 citations
  525. Multiple-Question Multiple-Answer Text-VQAIndustry4 citations
  526. On the Way to Gentle AI Counselor: Politeness Cause Elicitation and Intensity Tagging in Code-mixed Hinglish Conversations for Social GoodFindings4 citations
  527. Open-Vocabulary Federated Learning with Multimodal PrototypingLong4 citations
  528. P3Sum: Preserving Author’s Perspective in News Summarization with Diffusion Language ModelsLong4 citations
  529. PatentEval: Understanding Errors in Patent GenerationLong4 citations
  530. Program-Aided Reasoners (Better) Know What They KnowLong4 citations
  531. Query-Efficient Textual Adversarial Example Generation for Black-Box AttacksLong4 citations
  532. RST-LoRA: A Discourse-Aware Low-Rank Adaptation for Long Document Abstractive SummarizationLong4 citations
  533. RobustSentEmbed: Robust Sentence Embeddings Using Adversarial Self-Supervised Contrastive LearningFindings4 citations
  534. SlimFit: Memory-Efficient Fine-Tuning of Transformer-based Models Using Training DynamicsLong4 citations
  535. SuperGLEBer: German Language Understanding Evaluation BenchmarkLong4 citations
  536. TISE: A Tripartite In-context Selection Method for Event Argument ExtractionLong4 citations
  537. Towards Reducing Diagnostic Errors with Interpretable Risk PredictionLong4 citations
  538. Ungrammatical-syntax-based In-context Example Selection for Grammatical Error CorrectionLong4 citations
  539. Unleashing the Power of LLMs in Court View Generation by Stimulating Internal Knowledge and Incorporating External KnowledgeFindings4 citations
  540. WebWISE: Unlocking Web Interface Control for LLMs via Sequential ExplorationFindings4 citations
  541. X-PARADE: Cross-Lingual Textual Entailment and Information Divergence across ParagraphsLong4 citations
  542. jp-evalb: Robust Alignment-based PARSEVAL MeasuresSystem Demonstrations4 citations
  543. kNN-ICL: Compositional Task-Oriented Parsing Generalization with Nearest Neighbor In-Context LearningLong4 citations
  544. A School Student Essay Corpus for Analyzing Interactions of Argumentative Structure and QualityLong3 citations
  545. A Symbolic Framework for Evaluating Mathematical Reasoning and Generalisation with TransformersLong3 citations
  546. Addressing Both Statistical and Causal Gender Fairness in NLP ModelsFindings3 citations
  547. Addressing Healthcare-related Racial and LGBTQ+ Biases in Pretrained Language ModelsFindings3 citations
  548. An Empirical Study of Consistency Regularization for End-to-End Speech-to-Text TranslationLong3 citations
  549. BEAR: A Unified Framework for Evaluating Relational Knowledge in Causal and Masked Language ModelsFindings3 citations
  550. BookSQL: A Large Scale Text-to-SQL Dataset for Accounting DomainLong3 citations
  551. CASA: Causality-driven Argument Sufficiency AssessmentLong3 citations
  552. CNER: Concept and Named Entity RecognitionLong3 citations
  553. CONSCENDI: A Contrastive and Scenario-Guided Distillation Approach to Guardrail Models for Virtual AssistantsLong3 citations
  554. Conformal Intent Classification and Clarification for Fast and Accurate Intent RecognitionFindings3 citations
  555. Contextual Label Projection for Cross-Lingual Structured PredictionLong3 citations
  556. ContraSim – Analyzing Neural Representations Based on Contrastive LearningLong3 citations
  557. Corpus Considerations for Annotator Modeling and ScalingLong3 citations
  558. DOCMASTER: A Unified Platform for Annotation, Training, & Inference in Document Question-AnsweringSystem Demonstrations3 citations
  559. DUQGen: Effective Unsupervised Domain Adaptation of Neural Rankers by Diversifying Synthetic Query GenerationLong3 citations
  560. DeMuX: Data-efficient Multilingual LearningLong3 citations
  561. Debiasing with Sufficient Projection: A General Theoretical Framework for Vector RepresentationsLong3 citations
  562. Deja vu: Contrastive Historical Modeling with Prefix-tuning for Temporal Knowledge Graph ReasoningFindings3 citations
  563. Denoising Attention for Query-aware User ModelingFindings3 citations
  564. DialogVCS: Robust Natural Language Understanding in Dialogue System UpgradeLong3 citations
  565. Diffusion Glancing Transformer for Parallel Sequence-to-Sequence LearningLong3 citations
  566. Diverse Perspectives, Divergent Models: Cross-Cultural Evaluation of Depression Detection on TwitterShort3 citations
  567. DoubleLingo: Causal Estimation with Large Language ModelsShort3 citations
  568. EDEntail: An Entailment-based Few-shot Text Classification with Extensional DefinitionFindings3 citations
  569. Efficient Citer: Tuning Large Language Models for Enhanced Answer Quality and VerificationFindings3 citations
  570. Efficient End-to-End Visual Document Understanding with Rationale DistillationLong3 citations
  571. Enhancing Argument Summarization: Prioritizing Exhaustiveness in Key Point Generation and Introducing an Automatic Coverage Evaluation MetricLong3 citations
  572. Entity Disambiguation via Fusion Entity DecodingLong3 citations
  573. Event-Content-Oriented Dialogue Generation in Short VideoLong3 citations
  574. Extracting Lexical Features from Dialects via Interpretable Dialect ClassifiersShort3 citations
  575. Fact Checking Beyond Training SetLong3 citations
  576. Few-shot Knowledge Graph Relational Reasoning via Subgraph AdaptationLong3 citations
  577. Finding Replicable Human Evaluations via Stable Ranking ProbabilityLong3 citations
  578. Fine-grained Gender Control in Machine Translation with Large Language ModelsLong3 citations
  579. GenDecider: Integrating “None of the Candidates” Judgments in Zero-Shot Entity Linking Re-rankingShort3 citations
  580. Generalizable and Stable Finetuning of Pretrained Language Models on Low-Resource TextsLong3 citations
  581. Generating Signed Language Instructions in Large-Scale Dialogue SystemsIndustry3 citations
  582. GraSAME: Injecting Token-Level Structural Information to Pretrained Language Models via Graph-guided Self-Attention MechanismFindings3 citations
  583. Grammar-based Data Augmentation for Low-Resource Languages: The Case of Guarani-Spanish Neural Machine TranslationLong3 citations
  584. Ignore Me But Don’t Replace Me: Utilizing Non-Linguistic Elements for Pretraining on the Cybersecurity DomainFindings3 citations
  585. Incorporating Exponential Smoothing into MLP: a Simple but Effective Sequence ModelFindings3 citations
  586. IndiSentiment140: Sentiment Analysis Dataset for Indian Languages with Emphasis on Low-Resource Languages using Machine TranslationLong3 citations
  587. KTRL+F: Knowledge-Augmented In-Document SearchLong3 citations
  588. Keep it Private: Unsupervised Privatization of Online TextLong3 citations
  589. Know When To Stop: A Study of Semantic Drift in Text GenerationLong3 citations
  590. Knowledgeable In-Context Tuning: Exploring and Exploiting Factual Knowledge for In-Context LearningFindings3 citations
  591. Language Models are Alignable Decision-Makers: Dataset and Application to the Medical Triage DomainIndustry3 citations
  592. LayoutPointer: A Spatial-Context Adaptive Pointer Network for Visual Information ExtractionLong3 citations
  593. Lost in Space: Probing Fine-grained Spatial Understanding in Vision and Language ResamplersShort3 citations
  594. Lost in Transcription: Identifying and Quantifying the Accuracy Biases of Automatic Speech Recognition Systems Against Disfluent SpeechLong3 citations
  595. Lost in Translation? Translation Errors and Challenges for Fair Assessment of Text-to-Image Models on Multilingual ConceptsShort3 citations
  596. M3T: A New Benchmark Dataset for Multi-Modal Document-Level Machine TranslationShort3 citations
  597. MaCSC: Towards Multimodal-augmented Pre-trained Language Models via Conceptual Prototypes and Self-balancing CalibrationLong3 citations
  598. MedCycle: Unpaired Medical Report Generation via Cycle-ConsistencyFindings3 citations
  599. MiLe Loss: a New Loss for Mitigating the Bias of Learning Difficulties in Generative Language ModelsFindings3 citations
  600. Mitigating Hallucination in Abstractive Summarization with Domain-Conditional Mutual InformationFindings3 citations
  601. Multi-Review Fusion-in-ContextFindings3 citations
  602. PAELLA: Parameter-Efficient Lightweight Language-Agnostic Captioning ModelFindings3 citations
  603. Personalized Review Recommendation based on Implicit dimension miningShort3 citations
  604. Pregnant Questions: The Importance of Pragmatic Awareness in Maternal Health Question AnsweringLong3 citations
  605. Prompting Few-shot Multi-hop Question Generation via Comprehending Type-aware SemanticsFindings3 citations
  606. QualEval: Qualitative Evaluation for Model ImprovementLong3 citations
  607. REQUAL-LM: Reliability and Equity through Aggregation in Large Language ModelsFindings3 citations
  608. Reliability Estimation of News Media Sources: Birds of a Feather Flock TogetherLong3 citations
  609. SCANNER: Knowledge-Enhanced Approach for Robust Multi-modal Named Entity Recognition of Unseen EntitiesLong3 citations
  610. SLIDE: Reference-free Evaluation for Machine Translation using a Sliding Document WindowShort3 citations
  611. SLiM: Speculative Decoding with Hypothesis ReductionFindings3 citations
  612. SQATIN: Supervised Instruction Tuning Meets Question Answering for Improved Dialogue NLULong3 citations
  613. SpeedE: Euclidean Geometric Knowledge Graph Embedding Strikes BackFindings3 citations
  614. SumCSE: Summary as a transformation for Contrastive LearningFindings3 citations
  615. Testing the limits of logical reasoning in neural and hybrid modelsFindings3 citations
  616. Think Before You Speak: Cultivating Communication Skills of Large Language Models via Inner MonologueFindings3 citations
  617. UNcommonsense Reasoning: Abductive Reasoning about Uncommon SituationsLong3 citations
  618. Unified Examination of Entity Linking in Absence of Candidate SetsShort3 citations
  619. Unveiling the Magic: Investigating Attention Distillation in Retrieval-Augmented GenerationShort3 citations
  620. When Quantization Affects Confidence of Large Language Models?Findings3 citations
  621. i-Code V2: An Autoregressive Generation Framework over Vision, Language, and Speech DataFindings3 citations
  622. A Comprehensive Study of Gender Bias in Chemical Named Entity Recognition ModelsLong2 citations
  623. A Lightweight Mixture-of-Experts Neural Machine Translation Model with Stage-wise Training StrategyFindings2 citations
  624. A Transformer with Stack AttentionFindings2 citations
  625. A diverse Multilingual News Headlines Dataset from around the WorldShort2 citations
  626. ARM: Alignment with Residual Energy-Based ModelLong2 citations
  627. Adaptive Cross-lingual Text Classification through In-Context One-Shot DemonstrationsLong2 citations
  628. An Automatic Prompt Generation System for Tabular Data TasksIndustry2 citations
  629. Anonymity at Risk? Assessing Re-Identification Capabilities of Large Language Models in Court DecisionsFindings2 citations
  630. Asking More Informative Questions for Grounded RetrievalFindings2 citations
  631. Attention Alignment and Flexible Positional Embeddings Improve Transformer Length ExtrapolationFindings2 citations
  632. Automatic Pair Construction for Contrastive Post-trainingFindings2 citations
  633. Automatic Restoration of Diacritics for Speech Data SetsLong2 citations
  634. Automatic, Meta and Human Evaluation for Multimodal Summarization with Multimodal OutputLong2 citations
  635. CELI: Simple yet Effective Approach to Enhance Out-of-Domain Generalization of Cross-Encoders.Short2 citations
  636. COMMIT: Code-Mixing English-Centric Large Language Model for Multilingual Instruction TuningFindings2 citations
  637. Code Models are Zero-shot Precondition ReasonersLong2 citations
  638. Compensate Quantization Errors: Make Weights Hierarchical to Compensate Each OtherFindings2 citations
  639. ContrastiveMix: Overcoming Code-Mixing Dilemma in Cross-Lingual Transfer for Information RetrievalShort2 citations
  640. Control-DAG: Constrained Decoding for Non-Autoregressive Directed Acyclic T5 using Weighted Finite State AutomataShort2 citations
  641. Deferred NAM: Low-latency Top-K Context Injection via Deferred Context Encoding for Non-Streaming ASRIndustry2 citations
  642. Detecting Bipolar Disorder from Misdiagnosed Major Depressive Disorder with Mood-Aware Multi-Task LearningLong2 citations
  643. Discourse-Aware In-Context Learning for Temporal Expression NormalizationShort2 citations
  644. Dissecting Paraphrases: The Impact of Prompt Syntax and supplementary Information on Knowledge Retrieval from Pretrained Language ModelsLong2 citations
  645. Divergent Token Metrics: Measuring degradation to prune away LLM components – and optimize quantizationLong2 citations
  646. Do Vision-Language Models Understand Compound Nouns?Short2 citations
  647. Ensuring Safe and High-Quality Outputs: A Guideline Library Approach for Language ModelsLong2 citations
  648. Exploring Key Point Analysis with Pairwise Generation and Graph PartitioningLong2 citations
  649. Exploring Language Model’s Code Generation Ability with Auxiliary FunctionsFindings2 citations
  650. Exploring the Trade-off Between Model Performance and Explanation Plausibility of Text Classifiers Using Human RationalesFindings2 citations
  651. FAMuS: Frames Across Multiple SourcesLong2 citations
  652. Fixing Rogue Memorization in Many-to-One Multilingual Translators of Extremely-Low-Resource Languages by Rephrasing Training SamplesLong2 citations
  653. Fumbling in Babel: An Investigation into ChatGPT’s Language Identification AbilityFindings2 citations
  654. Fusion Makes Perfection: An Efficient Multi-Grained Matching Approach for Zero-Shot Relation ExtractionShort2 citations
  655. Gaussian Process Optimization for Adaptable Multi-Objective Text Generation using Linearly-Weighted Language ModelsFindings2 citations
  656. Generating Attractive and Authentic Copywriting from Customer ReviewsLong2 citations
  657. Generating Uncontextualized and Contextualized Questions for Document-Level Event Argument ExtractionLong2 citations
  658. GuyLingo: The Republic of Guyana Creole CorporaShort2 citations
  659. HIL: Hybrid Isotropy Learning for Zero-shot Performance in Dense retrievalLong2 citations
  660. How Lexical is Bilingual Lexicon Induction?Findings2 citations
  661. HumanRankEval: Automatic Evaluation of LMs as Conversational AssistantsLong2 citations
  662. Improving Pre-trained Language Model Sensitivity via Mask Specific losses: A case study on Biomedical NERLong2 citations
  663. Improving Toponym Resolution by Predicting Attributes to Constrain Geographical Ontology EntriesShort2 citations
  664. Is Prompt Transfer Always Effective? An Empirical Study of Prompt Transfer for Question AnsweringShort2 citations
  665. LEAF: Language Learners’ English Essays and Feedback CorpusShort2 citations
  666. LSTDial: Enhancing Dialogue Generation via Long- and Short-Term Measurement FeedbackLong2 citations
  667. Language Agnostic Code EmbeddingsLong2 citations
  668. LanguageFlow: Advancing Diffusion Language Generation with Probabilistic FlowsLong2 citations
  669. Laying Anchors: Semantically Priming Numerals in Language ModelingFindings2 citations
  670. Less is More for Improving Automatic Evaluation of Factual ConsistencyIndustry2 citations
  671. Leveraging Contextual Information for Effective Entity Salience DetectionFindings2 citations
  672. Leveraging Summarization for Unsupervised Dialogue Topic SegmentationFindings2 citations
  673. Low-Cost Generation and Evaluation of Dictionary Example SentencesLong2 citations
  674. MICo: Preventative Detoxification of Large Language Models through Inhibition ControlFindings2 citations
  675. Massive End-to-end Speech Recognition Models with Time ReductionLong2 citations
  676. Measuring Cross-lingual Transfer in BytesLong2 citations
  677. Metaphor Detection with Context Enhancement and Curriculum LearningLong2 citations
  678. Mix-Initiative Response Generation with Dynamic Prefix TuningLong2 citations
  679. Modeling and Detecting Company Risks from NewsIndustry2 citations
  680. More room for language: Investigating the effect of retrieval on language modelsShort2 citations
  681. MuMath: Multi-perspective Data Augmentation for Mathematical Reasoning in Large Language ModelsFindings2 citations
  682. Multi-stage Retrieve and Re-rank Model for Automatic Medical Coding RecommendationLong2 citations
  683. Multimodal Chart Retrieval: A Comparison of Text, Table and Image Based ApproachesLong2 citations
  684. Named Entity Recognition Under Domain Shift via Metric Learning for Life SciencesLong2 citations
  685. Navigation as Attackers Wish? Towards Building Robust Embodied Agents under Federated LearningLong2 citations
  686. Neurocache: Efficient Vector Retrieval for Long-range Language ModelingLong2 citations
  687. Normalizing without Modernizing: Keeping Historical Wordforms of Middle French while Reducing Spelling VariantsFindings2 citations
  688. ODD: A Benchmark Dataset for the Natural Language Processing Based Opioid Related Aberrant Behavior DetectionLong2 citations
  689. On Linearizing Structured Data in Encoder-Decoder Language Models: Insights from Text-to-SQLLong2 citations
  690. On the True Distribution Approximation of Minimum Bayes-Risk DecodingShort2 citations
  691. PEMA: An Offsite-Tunable Plug-in External Memory Adaptation for Language ModelsLong2 citations
  692. Parameter-Efficient Instruction Tuning of Large Language Models For Extreme Financial Numeral LabellingLong2 citations
  693. Personalized Federated Learning for Text Classification with Gradient-Free Prompt TuningFindings2 citations
  694. Pre-trained Language Models for Entity Blocking: A Reproducibility StudyLong2 citations
  695. Probing the Category of Verbal Aspect in Transformer Language ModelsFindings2 citations
  696. Promptly Predicting Structures: The Return of InferenceLong2 citations
  697. RE2: Region-Aware Relation Extraction from Visually Rich DocumentsLong2 citations
  698. REXEL: An End-to-end Model for Document-Level Relation Extraction and Entity LinkingIndustry2 citations
  699. RedCoast: A Lightweight Tool to Automate Distributed Training of LLMs on Any GPU/TPUsSystem Demonstrations2 citations
  700. Regularized Conventions: Equilibrium Computation as a Model of Pragmatic ReasoningLong2 citations
  701. Reinforced Multiple Instance Selection for Speaker Attribute PredictionLong2 citations
  702. Revisiting subword tokenization: A case study on affixal negation in large language modelsLong2 citations
  703. RoDia: A New Dataset for Romanian Dialect Identification from SpeechFindings2 citations
  704. SKICSE: Sentence Knowable Information Prompted by LLMs Improves Contrastive Sentence EmbeddingsShort2 citations
  705. Self-Adaptive Sampling for Accurate Video Question Answering on Image Text ModelsFindings2 citations
  706. Self-Cleaning: Improving a Named Entity Recognizer Trained on Noisy Data with a Few Clean InstancesFindings2 citations
  707. Self-generated Replay Memories for Continual Neural Machine TranslationLong2 citations
  708. Sentence-level Media Bias Analysis with Event Relation GraphLong2 citations
  709. Show Your Work with Confidence: Confidence Bands for Tuning CurvesLong2 citations
  710. Signer Diversity-driven Data Augmentation for Signer-Independent Sign Language TranslationFindings2 citations
  711. Source-Free Unsupervised Domain Adaptation for Question Answering via Prompt-Assisted Self-learningFindings2 citations
  712. Strings from the Library of Babel: Random Sampling as a Strong Baseline for Prompt OptimisationLong2 citations
  713. Subspace Representations for Soft Set Operations and Sentence SimilaritiesLong2 citations
  714. SumTra: A Differentiable Pipeline for Few-Shot Cross-Lingual SummarizationLong2 citations
  715. TOPICAL: TOPIC Pages AutomagicaLlySystem Demonstrations2 citations
  716. TRUE-UIE: Two Universal Relations Unify Information Extraction TasksLong2 citations
  717. Targeted Augmentation for Low-Resource Event ExtractionFindings2 citations
  718. Testing the Effect of Code Documentation on Large Language Model Code UnderstandingFindings2 citations
  719. Towards Improved Multi-Source Attribution for Long-Form Answer GenerationLong2 citations
  720. UGIF-DataSet: A New Dataset for Cross-lingual, Cross-modal Sequential actions on the UIFindings2 citations
  721. What if you said that differently?: How Explanation Formats Affect Human Feedback Efficacy and User PerceptionLong2 citations
  722. When Does Monolingual Data Help Multilingual Translation: The Role of Domain and Model ScaleLong2 citations
  723. XAL: EXplainable Active Learning Makes Classifiers Better Low-resource LearnersLong2 citations
  724. iACOS: Advancing Implicit Sentiment Extraction with Informative and Adaptive Negative ExamplesLong2 citations
  725. A (More) Realistic Evaluation Setup for Generalisation of Community Models on Malicious Content DetectionFindings1 citations
  726. A Likelihood Ratio Test of Genetic Relationship among LanguagesLong1 citations
  727. A Systematic Analysis of Subwords and Cross-Lingual Transfer in Multilingual TranslationFindings1 citations
  728. A Universal Dependencies Treebank for Highland Puebla NahuatlLong1 citations
  729. ATLAS: A System for PDF-centric Human Interaction Data CollectionSystem Demonstrations1 citations
  730. Adjusting Interpretable Dimensions in Embedding Space with Human JudgmentsLong1 citations
  731. Analysis of State-Level Legislative Process in Enhanced Linguistic and Nationwide Network ContextsLong1 citations
  732. Analyzing the Use of Metaphors in News Editorials for Political FramingLong1 citations
  733. BeLeaf: Belief Prediction as Tree GenerationSystem Demonstrations1 citations
  734. Beyond Borders: Investigating Cross-Jurisdiction Transfer in Legal Case SummarizationLong1 citations
  735. Bilateral Masking with prompt for Knowledge Graph CompletionFindings1 citations
  736. CARE: Extracting Experimental Findings From Clinical LiteratureFindings1 citations
  737. CERET: Cost-Effective Extrinsic Refinement for Text GenerationLong1 citations
  738. Causal Inference for Human-Language Model CollaborationLong1 citations
  739. CoUDA: Coherence Evaluation via Unified Data AugmentationLong1 citations
  740. Concept Over Time Analysis: Unveiling Temporal Patterns for Qualitative Data AnalysisSystem Demonstrations1 citations
  741. Contrastive Learning as a Polarizer: Mitigating Gender Bias by Fair and Biased sentencesFindings1 citations
  742. Create! Don’t Repeat: A Paradigm Shift in Multi-Label Augmentation through Label Creative GenerationLong1 citations
  743. Cross-Lingual Summarization with Pseudo-Label RegularizationFindings1 citations
  744. Curated Datasets and Neural Models for Machine Translation of Informal Registers between Mayan and Spanish VernacularsLong1 citations
  745. Curriculum Masking in Vision-Language Pretraining to Maximize Cross Modal InteractionLong1 citations
  746. DEMO: A Statistical Perspective for Efficient Image-Text MatchingLong1 citations
  747. Dial-MAE: ConTextual Masked Auto-Encoder for Retrieval-based Dialogue SystemsLong1 citations
  748. Don’t be a Fool: Pooling Strategies in Offensive Language Detection from User-Intended Adversarial AttacksFindings1 citations
  749. DriftWatch: A Tool that Automatically Detects Data Drift and Extracts Representative Examples Affected by DriftIndustry1 citations
  750. DynaMo: Accelerating Language Model Inference with Dynamic Multi-Token SamplingLong1 citations
  751. EdTec-QBuilder: A Semantic Retrieval Tool for Assembling Vocational Training Exams in German LanguageSystem Demonstrations1 citations
  752. Enhancing Perception: Refining Explanations of News Claims with LLM ConversationsFindings1 citations
  753. Evaluating Step-by-Step Reasoning through Symbolic VerificationFindings1 citations
  754. Extractive Summarization with Text GeneratorLong1 citations
  755. Extremely Weakly-supervised Text Classification with Wordsets Mining and Sync-DenoisingLong1 citations
  756. Extremely efficient online query encoding for dense retrievalFindings1 citations
  757. FIRE: A Dataset for Financial Relation ExtractionFindings1 citations
  758. FastFit: Fast and Effective Few-Shot Text Classification with a Multitude of ClassesSystem Demonstrations1 citations
  759. Few-TK: A Dataset for Few-shot Scientific Typed Keyphrase RecognitionFindings1 citations
  760. Fighting crime with Transformers: Empirical analysis of address parsing methods in payment dataIndustry1 citations
  761. Hypernetwork-Assisted Parameter-Efficient Fine-Tuning with Meta-Knowledge Distillation for Domain Knowledge DisentanglementFindings1 citations
  762. Identifying Self-Disclosures of Use, Misuse and Addiction in Community-based Social Media PostsFindings1 citations
  763. Impossible Distillation for Paraphrasing and Summarization: How to Make High-quality Lemonade out of Small, Low-quality ModelLong1 citations
  764. Improving Factual Accuracy of Neural Table-to-Text Output by Addressing Input Problems in ToTToLong1 citations
  765. Interplay of Machine Translation, Diacritics, and DiacritizationLong1 citations
  766. Interpreting Answers to Yes-No Questions in Dialogues from Multiple DomainsFindings1 citations
  767. Interpreting User Requests in the Context of Natural Language Standing InstructionsFindings1 citations
  768. Isometric Neural Machine Translation using Phoneme Count Ratio Reward-based Reinforcement LearningFindings1 citations
  769. LatticeGen: Hiding Generated Text in a Lattice for Privacy-Aware Large Language Model Generation on CloudFindings1 citations
  770. Learning Cross-Architecture Instruction Embeddings for Binary Code Analysis in Low-Resource ArchitecturesFindings1 citations
  771. LegalDiscourse: Interpreting When Laws Apply and To WhomLong1 citations
  772. Leitner-Guided Memory Replay for Cross-lingual Continual LearningLong1 citations
  773. Lifelong Event Detection with Embedding Space Separation and CompactionShort1 citations
  774. MOSAICo: a Multilingual Open-text Semantically Annotated Interlinked CorpusLong1 citations
  775. MT-PATCHER: Selective and Extendable Knowledge Distillation from Large Language Models for Machine TranslationLong1 citations
  776. Methods, Applications, and Directions of Learning-to-Rank in NLP ResearchFindings1 citations
  777. MisgenderMender: A Community-Informed Approach to Interventions for MisgenderingLong1 citations
  778. Multi-Granularity Guided Fusion-in-DecoderFindings1 citations
  779. Multilingual Nonce Dependency Treebanks: Understanding how Language Models Represent and Process Syntactic StructureLong1 citations
  780. My Heart Skipped a Beat! Recognizing Expressions of Embodied Emotion in Natural LanguageLong1 citations
  781. Newspaper Signaling for Crisis PredictionSystem Demonstrations1 citations
  782. Noisy Multi-Label Text Classification via Instance-Label Pair CorrectionFindings1 citations
  783. Non-contrastive sentence representations via self-supervisionFindings1 citations
  784. Order-Based Pre-training Strategies for Procedural Text UnderstandingShort1 citations
  785. PELMS: Pre-training for Effective Low-Shot Multi-Document SummarizationLong1 citations
  786. Pedagogically Aligned Objectives Create Reliable Automatic Cloze TestsLong1 citations
  787. Prompt Tuned Embedding Classification for Industry Sector AllocationIndustry1 citations
  788. PromptFix: Few-shot Backdoor Removal via Adversarial Prompt TuningLong1 citations
  789. R-Spin: Efficient Speaker and Noise-invariant Representation Learning with Acoustic PiecesLong1 citations
  790. READ: Improving Relation Extraction from an ADversarial PerspectiveFindings1 citations
  791. REMATCH: Robust and Efficient Matching of Local Knowledge Graphs to Improve Structural and Semantic SimilarityFindings1 citations
  792. Re-evaluating the Need for Visual Signals in Unsupervised Grammar InductionFindings1 citations
  793. Rectifying Demonstration Shortcut in In-Context LearningLong1 citations
  794. Retrieving Examples from Memory for Retrieval Augmented Neural Machine Translation: A Systematic ComparisonFindings1 citations
  795. Returning to the Start: Generating Narratives with Related EndpointsShort1 citations
  796. Scaling Up Authorship AttributionIndustry1 citations
  797. Secure Your Model: An Effective Key Prompt Protection Mechanism for Large Language ModelsFindings1 citations
  798. Self-Demos: Eliciting Out-of-Demonstration Generalizability in Large Language ModelsFindings1 citations
  799. Self-Regulated Data-Free Knowledge Amalgamation for Text ClassificationIndustry1 citations
  800. Separation and Fusion: A Novel Multiple Token Linking Model for Event Argument ExtractionLong1 citations
  801. Sequential Compositional Generalization in Multimodal ModelsLong1 citations
  802. Simple and effective data augmentation for compositional generalizationLong1 citations
  803. Subword Attention and Post-Processing for Rare and Unknown Contextualized EmbeddingsFindings1 citations
  804. Tailoring Vaccine Messaging with Common-Ground OpinionsFindings1 citations
  805. Take One Step at a Time to Know Incremental Utility of Demonstration: An Analysis on Reranking for Few-Shot In-Context LearningLong1 citations
  806. Teaching a Multilingual Large Language Model to Understand Multilingual Speech via Multi-Instructional TrainingFindings1 citations
  807. The Impact of Language on Arithmetic Proficiency: A Multilingual Investigation with Cross-Agent Checking ComputationShort1 citations
  808. The Unreasonable Effectiveness of Random Target Embeddings for Continuous-Output Neural Machine TranslationShort1 citations
  809. Think Before You Act: A Two-Stage Framework for Mitigating Gender Bias Towards Vision-Language TasksLong1 citations
  810. Toward Interactive Regional Understanding in Vision-Large Language ModelsLong1 citations
  811. Towards Better Generalization in Open-Domain Question Answering by Mitigating Context MemorizationFindings1 citations
  812. UNO-DST: Leveraging Unlabelled Data in Zero-Shot Dialogue State TrackingFindings1 citations
  813. UniArk: Improving Generalisation and Consistency for Factual Knowledge Extraction through DebiasingLong1 citations
  814. Unveiling Divergent Inductive Biases of LLMs on Temporal DataShort1 citations
  815. Verifying Claims About Metaphors with Large-Scale Automatic Metaphor IdentificationShort1 citations
  816. VertAttack: Taking Advantage of Text Classifiers’ Horizontal VisionLong1 citations
  817. ViGLUE: A Vietnamese General Language Understanding Benchmark and Analysis of Vietnamese Language ModelsFindings1 citations
  818. Visual Enhanced Entity-Level Interaction Network for Multimodal SummarizationFindings1 citations
  819. What Causes the Failure of Explicit to Implicit Discourse Relation Recognition?Long1 citations
  820. Where are you from? Geolocating Speech and Applications to Language IdentificationLong1 citations
  821. Which One? Leveraging Context Between Objects and Multiple Views for Language GroundingLong1 citations
  822. XNLIeu: a dataset for cross-lingual NLI in BasqueLong1 citations
  823. ZSEE: A Dataset based on Zeolite Synthesis Event Extraction for Automated Synthesis PlatformFindings1 citations
  824. Zero-Shot vs. Translation-Based Cross-Lingual Transfer: The Case of Lexical GapsShort1 citations
  825. Zero-shot Generative Linguistic SteganographyLong1 citations
  826. ZhuJiu-Knowledge: A Fairer Platform for Evaluating Multiple Knowledge Types in Large Language ModelsSystem Demonstrations1 citations
  827. A Rationale-centric Counterfactual Data Augmentation Method for Cross-Document Event Coreference ResolutionLong
  828. A Study on Scaling Up Multilingual News Framing AnalysisFindings
  829. A Zero-Shot Monolingual Dual Stage Information Retrieval System for Spanish Biomedical Systematic Literature ReviewsLong
  830. Accurate Knowledge Distillation via n-best RerankingLong
  831. AdaPT: A Set of Guidelines for Hyperbolic Multimodal Multilingual NLPFindings
  832. Adversarial DPO: Harnessing Harmful Data for Reducing Toxicity with Minimal Impact on Coherence and Evasiveness in Dialogue AgentsFindings
  833. An NLP-Focused Pilot Training Agent for Safe and Efficient Aviation CommunicationIndustry
  834. Applications of BERT Models Towards Automation of Clinical Coding in IcelandicFindings
  835. Automating the Generation of a Functional Semantic Types Ontology with Foundational ModelsIndustry
  836. Beta-LR: Interpretable Logical Reasoning based on Beta DistributionFindings
  837. Beyond Read-Only: Crafting a Comprehensive Chinese Text-to-SQL Dataset for Database Manipulation and QueryFindings
  838. Characterizing Human and Zero-Shot GPT-3.5 Object-Similarity JudgmentsFindings
  839. Clear Up Confusion: Advancing Cross-Domain Few-Shot Relation Extraction through Relation-Aware Prompt LearningShort
  840. Content-Specific Humorous Image Captioning Using Incongruity Resolution Chain-of-ThoughtFindings
  841. Contrastive Preference Learning for Neural Machine TranslationFindings
  842. Contrastive and Consistency Learning for Neural Noisy-Channel Model in Spoken Language UnderstandingLong
  843. DLM: A Decoupled Learning Model for Long-tailed Polyphone Disambiguation in MandarinLong
  844. Discovering Lobby-Parliamentarian Alignments through NLPLong
  845. Discovering and Mitigating Indirect Bias in Attention-Based Model ExplanationsFindings
  846. DuRE: Dual Contrastive Self Training for Semi-Supervised Relation ExtractionLong
  847. EDC: Effective and Efficient Dialog Comprehension For Dialog State TrackingLong
  848. EcoSpeak: Cost-Efficient Bias Mitigation for Partially Cross-Lingual Speaker VerificationFindings
  849. Efficient Dependency Tree Sampling Without ReplacementFindings
  850. Efficient Sample-Specific Encoder PerturbationsShort
  851. Explanation Extraction from Hierarchical Classification Frameworks for Long Legal DocumentsFindings
  852. Exploring the Factual Consistency in Dialogue Comprehension of Large Language ModelsLong
  853. Extending Input Contexts of Language Models through Training on Segmented SequencesFindings
  854. FPT: Feature Prompt Tuning for Few-shot Readability AssessmentLong
  855. Graph Integrated Language Transformers for Next Action Prediction in Complex Phone CallsIndustry
  856. Group Fairness in Multilingual Speech Recognition ModelsFindings
  857. How does Multi-Task Training Affect Transformer In-Context Capabilities? Investigations with Function ClassesShort
  858. IPED: An Implicit Perspective for Relational Triple Extraction based on Diffusion ModelLong
  859. Improving Absent Keyphrase Generation with Diversity HeadsFindings
  860. Improving Factuality in Clinical Abstractive Multi-Document Summarization by Guided Continued Pre-trainingShort
  861. IruMozhi: Automatically classifying diglossia in TamilFindings
  862. LEEETs-Dial: Linguistic Entrainment in End-to-End Task-oriented Dialogue systemsFindings
  863. Language Model Based Unsupervised Dependency Parsing with Conditional Mutual Information and Grammatical ConstraintsLong
  864. Language-Independent Representations Improve Zero-Shot SummarizationShort
  865. Large Language Models Encode the Practice of MedicineIndustry
  866. Learning Mutually Informed Representations for Characters and SubwordsFindings
  867. Leveraging Customer Feedback for Multi-modal Insight ExtractionIndustry
  868. Leveraging Interesting Facts to Enhance User Engagement with Conversational InterfacesIndustry
  869. Leveraging Natural Language Processing and Large Language Models for Assisting Due Diligence in the Legal DomainIndustry
  870. Leveraging the Structure of Pre-trained Embeddings to Minimize Annotation EffortLong
  871. MCAD: Multi-teacher Cross-modal Alignment Distillation for efficient image-text retrievalFindings
  872. MCECR: A Novel Dataset for Multilingual Cross-Document Event Coreference ResolutionFindings
  873. MEMORY-VQ: Compression for Tractable Internet-Scale MemoryShort
  874. Mapping Long-term Causalities in Psychiatric Symptomatology and Life Events from Social MediaLong
  875. Matching Varying-Length Texts via Topic-Informed and Decoupled Sentence EmbeddingsFindings
  876. Measuring Entrainment in Spontaneous Code-switched SpeechLong
  877. Mitigating Language-Level Performance Disparity in mPLMs via Teacher Language Selection and Cross-lingual Self-DistillationLong
  878. Modularized Multilingual NMT with Fine-grained InterlinguaLong
  879. Multi-Scale Prompt Memory-Augmented Model for Black-Box ScenariosLong
  880. Multilingual Models for ASR in Chibchan LanguagesLong
  881. Multimodal Contextual Dialogue Breakdown Detection for Conversational AI ModelsIndustry
  882. Natural Language-based State Representation in Deep Reinforcement LearningFindings
  883. No Context Needed: Contextual Quandary In Idiomatic Reasoning With Pre-Trained Language ModelsLong
  884. Not All Metrics Are Guilty: Improving NLG Evaluation by Diversifying ReferencesLong
  885. On Narrative Question Answering SkillsShort
  886. On Retrieval Augmentation and the Limitations of Language Model TrainingShort
  887. On the Effectiveness of Adversarial Robustness for Abuse Mitigation with CounterspeechLong
  888. Plug-in Language Model: Controlling Text Generation with a Simple Regression ModelFindings
  889. Principles from Clinical Research for NLP Model GeneralizationLong
  890. Prompting Vision-Language Models For Aspect-Controlled Generation of Referring ExpressionsFindings
  891. Quantum-inspired Language Model with Lindblad Master Equation and Interference Measurement for Sentiment AnalysisLong
  892. R-BASS : Relevance-aided Block-wise Adaptation for Speech SummarizationFindings
  893. RTSUM: Relation Triple-based Interpretable Summarization with Multi-level Salience VisualizationSystem Demonstrations
  894. Read between the lines - Functionality Extraction From READMEsFindings
  895. SELF-EXPERTISE: Knowledge-based Instruction Dataset Augmentation for a Legal Expert Language ModelFindings
  896. ScriptMix: Mixing Scripts for Low-resource Language ParsingLong
  897. Search Query Refinement for Japanese Named Entity Recognition in E-commerce DomainIndustry
  898. Self-Regulated Sample Diversity in Large Language ModelsFindings
  899. Semantically-Prompted Language Models Improve Visual DescriptionsFindings
  900. Separately Parameterizing Singleton Detection Improves End-to-end Neural Coreference ResolutionShort
  901. Structured Pruning for Large Language Models Using Coupled Components Elimination and Minor Fine-tuningFindings
  902. Synonym relations affect object detection learned on vision-language dataFindings
  903. T3M: Text Guided 3D Human Motion Synthesis from SpeechFindings
  904. TagDebias: Entity and Concept Tagging for Social Bias Mitigation in Pretrained Language ModelsFindings
  905. The Effect of Data Partitioning Strategy on Model Generalizability: A Case Study of Morphological SegmentationLong
  906. Towards Translating Objective Product Attributes Into Customer LanguageIndustry
  907. Tree-of-Question: Structured Retrieval Framework for Korean Question Answering SystemsIndustry
  908. UEGP: Unified Expert-Guided Pre-training for Knowledge RekindleFindings
  909. Unlocking Structure Measuring: Introducing PDD, an Automatic Metric for Positional Discourse CoherenceShort
  910. VOLTA: Improving Generative Diversity by Variational Mutual Information Maximizing AutoencoderFindings
  911. XferBench: a Data-Driven Benchmark for Emergent LanguageLong
  912. “Tell me who you are and I tell you how you argue”: Predicting Stances and Arguments for Stakeholder GroupsFindings

NAACL accepted papers in other years

Looking for submission deadlines instead? See the conference deadline calendar.