NAACL 2024 Accepted Papers
The full list of 912 papers accepted at NAACL 2024 (North American Chapter of the Association for Computational Linguistics). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Long: 487Findings: 286Short: 75Industry: 43System Demonstrations: 21
- GPTScore: Evaluate as You DesireLong566 citations
- AGIEval: A Human-Centric Benchmark for Evaluating Foundation ModelsFindings447 citations
- Sentiment Analysis in the Era of Large Language Models: A Reality CheckFindings363 citations
- Large Language Models are Effective Text Rankers with Pairwise Ranking PromptingFindings255 citations
- Unleashing the Emergent Cognitive Synergy in Large Language Models: A Task-Solving Agent through Multi-Persona Self-CollaborationLong246 citations
- Effective Long-Context Scaling of Foundation ModelsLong231 citations
- Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual TasksLong220 citations
- AnnoLLM: Making Large Language Models to Be Better Crowdsourced AnnotatorsIndustry214 citations
- XSTest: A Test Suite for Identifying Exaggerated Safety Behaviours in Large Language ModelsLong197 citations
- Large Language Models Sensitivity to The Order of Options in Multiple-Choice QuestionsFindings196 citations
- From Quantity to Quality: Boosting LLM Performance with Self-Guided Data Selection for Instruction TuningLong181 citations
- Trusting Your Evidence: Hallucinate Less with Context-aware DecodingShort179 citations
- Better Zero-Shot Reasoning with Role-Play PromptingLong174 citations
- REPLUG: Retrieval-Augmented Black-Box Language ModelsLong172 citations
- Adaptive-RAG: Learning to Adapt Retrieval-Augmented Large Language Models through Question ComplexityLong162 citations
- Head-to-Tail: How Knowledgeable are Large Language Models (LLMs)? A.K.A. Will LLMs Replace Knowledge Graphs?Long161 citations
- A Pretrainer’s Guide to Training Data: Measuring the Effects of Data Age, Domain Coverage, Quality, & ToxicityLong155 citations
- LLM-Rec: Personalized Recommendation via Prompting Large Language ModelsFindings146 citations
- RecMind: Large Language Model Powered Agent For RecommendationFindings144 citations
- ARES: An Automated Evaluation Framework for Retrieval-Augmented Generation SystemsLong130 citations
- Instructions as Backdoors: Backdoor Vulnerabilities of Instruction Tuning for Large Language ModelsLong129 citations
- Can Knowledge Graphs Reduce Hallucinations in LLMs? : A SurveyLong125 citations
- MMC: Advancing Multimodal Chart Understanding with Large-scale Instruction TuningLong123 citations
- Multilingual Machine Translation with Large Language Models: Empirical Results and AnalysisFindings121 citations
- A Wolf in Sheep’s Clothing: Generalized Nested Jailbreak Prompts can Fool Large Language Models EasilyLong118 citations
- Ghostbuster: Detecting Text Ghostwritten by Large Language ModelsLong115 citations
- Backdooring Instruction-Tuned Large Language Models with Virtual Prompt InjectionLong109 citations
- SOLAR 10.7B: Scaling Large Language Models with Simple yet Effective Depth Up-ScalingIndustry109 citations
- PersonaLLM: Investigating the Ability of Large Language Models to Express Personality TraitsFindings107 citations
- Removing RLHF Protections in GPT-4 via Fine-TuningShort104 citations
- Investigating Data Contamination in Modern Benchmarks for Large Language ModelsLong101 citations
- MindAgent: Emergent Gaming InteractionFindings100 citations
- CMB: A Comprehensive Medical Benchmark in ChineseLong99 citations
- MART: Improving LLM Safety with Multi-round Automatic Red-TeamingLong99 citations
- TopicGPT: A Prompt-based Topic Modeling FrameworkLong98 citations
- REST: Retrieval-Based Speculative DecodingLong97 citations
- TableLlama: Towards Open Large Generalist Models for TablesLong96 citations
- ADaPT: As-Needed Decomposition and Planning with Language ModelsFindings92 citations
- On Learning to Summarize with Large Language Models as ReferencesLong89 citations
- Composite Backdoor Attacks Against Large Language ModelsFindings84 citations
- Routing to the Expert: Efficient Reward-guided Ensemble of Large Language ModelsLong83 citations
- ExpertQA: Expert-Curated Questions and Attributed AnswersLong81 citations
- LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language ModelsLong79 citations
- Beyond Yes and No: Improving Zero-Shot LLM Rankers via Scoring Fine-Grained Relevance LabelsShort78 citations
- Complex Claim Verification with Evidence Retrieved in the WildLong78 citations
- Branch-Solve-Merge Improves Large Language Model Evaluation and GenerationLong77 citations
- Reducing hallucination in structured outputs via Retrieval-Augmented GenerationIndustry77 citations
- Assisting in Writing Wikipedia-like Articles From Scratch with Large Language ModelsLong75 citations
- What Matters in Training a GPT4-Style Language Model with Multimodal Inputs?Long75 citations
- Self-Checker: Plug-and-Play Modules for Fact-Checking with Large Language ModelsFindings74 citations
- Simulating Opinion Dynamics with Networks of LLM-based AgentsFindings74 citations
- Attacks, Defenses and Evaluations for LLM Conversation Safety: A SurveyLong71 citations
- HelpSteer: Multi-attribute Helpfulness Dataset for SteerLMLong71 citations
- Mustango: Toward Controllable Text-to-Music GenerationLong69 citations
- Self-Prompting Large Language Models for Zero-Shot Open-Domain QALong69 citations
- SemStamp: A Semantic Watermark with Paraphrastic Robustness for Text GenerationLong68 citations
- Cognitive Overload: Jailbreaking Large Language Models with Overloaded Logical ThinkingFindings67 citations
- A Survey of Confidence Estimation and Calibration in Large Language ModelsLong66 citations
- InstructABSA: Instruction Learning for Aspect Based Sentiment AnalysisShort66 citations
- GLiNER: Generalist Model for Named Entity Recognition using Bidirectional TransformerLong64 citations
- Does GPT-4 pass the Turing test?Long62 citations
- Volcano: Mitigating Multimodal Hallucination through Self-Feedback Guided RevisionLong61 citations
- Empowering Diffusion Models on the Embedding Space for Text GenerationLong59 citations
- Are Multilingual LLMs Culturally-Diverse Reasoners? An Investigation into Multicultural Proverbs and SayingsLong57 citations
- Unveiling the Generalization Power of Fine-Tuned Large Language ModelsLong57 citations
- LMFlow: An Extensible Toolkit for Finetuning and Inference of Large Foundation ModelsSystem Demonstrations56 citations
- The Bias Amplification Paradox in Text-to-Image GenerationLong55 citations
- Tied-LoRA: Enhancing parameter efficiency of LoRA with Weight TyingLong55 citations
- Do Multilingual Language Models Think Better in English?Short54 citations
- Found in the Middle: Permutation Self-Consistency Improves Listwise Ranking in Large Language ModelsLong52 citations
- Benchmarking Generation and Evaluation Capabilities of Large Language Models for Instruction Controllable SummarizationFindings50 citations
- ChatGPT as an Attack Tool: Stealthy Textual Backdoor Attack via Blackbox Generative Model TriggerLong50 citations
- A Robust Semantics-based Watermark for Large Language Model against ParaphrasingFindings47 citations
- Citation: A Key to Building Responsible and Accountable Large Language ModelsFindings47 citations
- MEGAVERSE: Benchmarking Large Language Models Across Languages, Modalities, Models and TasksLong46 citations
- Metacognitive Prompting Improves Understanding in Large Language ModelsLong46 citations
- R-Tuning: Instructing Large Language Models to Say ‘I Don’t Know’Long46 citations
- Can Public Large Language Models Help Private Cross-device Federated Learning?Findings45 citations
- Instructional Fingerprinting of Large Language ModelsLong45 citations
- TofuEval: Evaluating Hallucinations of LLMs on Topic-Focused Dialogue SummarizationLong45 citations
- LLMs Are Few-Shot In-Context Low-Resource Language LearnersLong44 citations
- The Curious Decline of Linguistic Diversity: Training Language Models on Synthetic TextFindings43 citations
- Language Models Implement Simple Word2Vec-style Vector ArithmeticLong42 citations
- Adapting Fake News Detection to the Era of Large Language ModelsFindings40 citations
- SELF-GUARD: Empower the LLM to Safeguard ItselfLong40 citations
- How Interpretable are Reasoning Explanations from Prompting Large Language Models?Findings39 citations
- AudioChatLlama: Towards General-Purpose Speech Abilities for LLMsLong38 citations
- Measuring and Improving Chain-of-Thought Reasoning in Vision-Language ModelsLong38 citations
- Task-Agnostic Detector for Insertion-Based Backdoor AttacksFindings38 citations
- Value FULCRA: Mapping Large Language Models to the Multidimensional Spectrum of Basic Human ValueLong37 citations
- GPT-who: An Information Density-based Machine-Generated Text DetectorFindings36 citations
- LLatrieval: LLM-Verified Retrieval for Verifiable GenerationLong36 citations
- Large Language Models Help Humans Verify Truthfulness – Except When They Are Convincingly WrongLong36 citations
- Rethinking Tabular Data Understanding with Large Language ModelsLong36 citations
- BotChat: Evaluating LLMs’ Capabilities of Having Multi-Turn DialoguesFindings35 citations
- Bridging the Novice-Expert Gap via Models of Decision-Making: A Case Study on Remediating Math MistakesLong35 citations
- InsCL: A Data-efficient Continual Learning Paradigm for Fine-tuning Large Language Models with InstructionsLong35 citations
- Self-Improving for Zero-Shot Named Entity Recognition with Large Language ModelsShort35 citations
- LETI: Learning to Generate from Textual InteractionsFindings34 citations
- Tokenizer Choice For LLM Training: Negligible or Crucial?Findings34 citations
- Efficient Benchmarking (of Language Models)Long33 citations
- Understanding the Capabilities and Limitations of Large Language Models for Cultural CommonsenseLong33 citations
- Effective Large Language Model Adaptation for Improved Grounding and Citation GenerationLong32 citations
- From Language Modeling to Instruction Following: Understanding the Behavior Shift in LLMs after Instruction TuningLong32 citations
- Knowing What LLMs DO NOT Know: A Simple Yet Effective Self-Detection MethodLong31 citations
- MacGyver: Are Large Language Models Creative Problem Solvers?Long31 citations
- MusiLingo: Bridging Music and Text with Pre-trained Language Models for Music Captioning and Query ResponseFindings30 citations
- Stealthy and Persistent Unalignment on Large Language Models via Backdoor InjectionsLong30 citations
- The ART of LLM Refinement: Ask, Refine, and TrustLong30 citations
- Defending Against Weight-Poisoning Backdoor Attacks for Parameter-Efficient Fine-TuningFindings29 citations
- Elastic Weight Removal for Faithful and Abstractive Dialogue GenerationLong29 citations
- Embrace Divergence for Richer Insights: A Multi-document Summarization Benchmark and a Case Study on Summarizing Diverse Information from News ArticlesLong29 citations
- End-to-End Beam Retrieval for Multi-Hop Question AnsweringLong29 citations
- LLM-as-a-Coauthor: Can Mixed Human-Written and Machine-Generated Text Be Detected?Findings29 citations
- On the Multilingual Ability of Decoder-based Pre-trained Language Models: Finding and Controlling Language-Specific NeuronsLong29 citations
- Grounding Gaps in Language Model GenerationsLong28 citations
- A Continued Pretrained LLM Approach for Automatic Medical Note GenerationShort27 citations
- ALoRA: Allocating Low-Rank Adaptation for Fine-tuning Large Language ModelsLong27 citations
- Evidence-Driven Retrieval Augmented Response Generation for Online MisinformationLong27 citations
- How Trustworthy are Open-Source LLMs? An Assessment under Malicious Demonstrations Shows their VulnerabilitiesLong27 citations
- Instruction-following Evaluation through Verbalizer ManipulationFindings27 citations
- Language Models Hallucinate, but May Excel at Fact VerificationLong27 citations
- RS-DPO: A Hybrid Rejection Sampling and Direct Preference Optimization Method for Alignment of Large Language ModelsFindings27 citations
- S3Eval: A Synthetic, Scalable, Systematic Evaluation Suite for Large Language ModelLong27 citations
- Advancing Beyond Identification: Multi-bit Watermark for Large Language ModelsLong26 citations
- OpenFMNav: Towards Open-Set Zero-Shot Object Navigation via Vision-Language Foundation ModelsFindings26 citations
- The steerability of large language models toward data-driven personasLong26 citations
- X-Eval: Generalizable Multi-aspect Text Evaluation via Augmented Instruction Tuning with Auxiliary Evaluation AspectsLong26 citations
- AutoPRM: Automating Procedural Supervision for Multi-Step Reasoning via Controllable Question DecompositionLong25 citations
- Evaluating Large Language Models as Generative User Simulators for Conversational RecommendationLong25 citations
- Learning to Compress Prompt in Natural Language FormatsLong25 citations
- Multimodal Multi-loss Fusion Network for Sentiment AnalysisLong25 citations
- Rethinking Machine Ethics – Can LLMs Perform Moral Reasoning through the Lens of Moral Theories?Findings25 citations
- AceGPT, Localizing Large Language Models in ArabicLong24 citations
- Deceptive Semantic Shortcuts on Reasoning Chains: How Far Can Models Go without Hallucination?Long24 citations
- Enhancing Chain-of-Thoughts Prompting with Iterative Bootstrapping in Large Language ModelsFindings24 citations
- GenTKG: Generative Forecasting on Temporal Knowledge Graph with Large Language ModelsFindings24 citations
- A Closer Look at the Self-Verification Abilities of Large Language Models in Logical ReasoningLong23 citations
- Enhancing Contextual Understanding in Large Language Models through Contrastive DecodingLong23 citations
- From Shortcuts to Triggers: Backdoor Defense with Denoised PoELong23 citations
- OpinionGPT: Modelling Explicit Biases in Instruction-Tuned LLMsSystem Demonstrations23 citations
- SeaEval for Multilingual Foundation Models: From Cross-Lingual Alignment to Cultural ReasoningLong23 citations
- Tiny Titans: Can Smaller Large Language Models Punch Above Their Weight in the Real World for Meeting Summarization?Industry23 citations
- Aligning Large Language Models with Recommendation KnowledgeFindings22 citations
- AutoLoRA: Automatically Tuning Matrix Ranks in Low-Rank Adaptation Based on Meta LearningLong22 citations
- Guiding Large Language Models to Post-Edit Machine Translation with Error AnnotationsFindings22 citations
- LoRETTA: Low-Rank Economic Tensor-Train Adaptation for Ultra-Low-Parameter Fine-Tuning of Large Language ModelsLong22 citations
- Making Language Models Better Tool Learners with Execution FeedbackLong22 citations
- Revisiting Zero-Shot Abstractive Summarization in the Era of Large Language Models from the Perspective of Position BiasShort22 citations
- TelME: Teacher-leading Multimodal Fusion Network for Emotion Recognition in ConversationLong22 citations
- COPAL-ID: Indonesian Language Reasoning with Local Culture and NuancesLong21 citations
- CoMM: Collaborative Multi-Agent, Multi-Reasoning-Path Prompting for Complex Problem SolvingFindings21 citations
- LLMRefine: Pinpointing and Refining Large Language Models via Fine-Grained Actionable FeedbackFindings21 citations
- MILL: Mutual Verification with Large Language Models for Zero-Shot Query ExpansionLong21 citations
- ReFACT: Updating Text-to-Image Models by Editing the Text EncoderLong21 citations
- A Systematic Comparison of Syllogistic Reasoning in Humans and Language ModelsLong20 citations
- Improving Machine Translation with Human Feedback: An Exploration of Quality Estimation as a Reward ModelLong20 citations
- LLaMA-Rider: Spurring Large Language Models to Explore the Open WorldFindings20 citations
- TabSQLify: Enhancing Reasoning Capabilities of LLMs Through Table DecompositionLong20 citations
- Are Large Language Model Temporally Grounded?Long19 citations
- BUFFET: Benchmarking Large Language Models for Few-shot Cross-lingual TransferLong19 citations
- CodecLM: Aligning Language Models with Tailored Synthetic DataFindings19 citations
- Flames: Benchmarking Value Alignment of LLMs in ChineseLong19 citations
- LLM-based Medical Assistant Personalization with Short- and Long-Term Memory CoordinationLong19 citations
- LangNav: Language as a Perceptual Representation for NavigationFindings19 citations
- On Large Language Models’ Hallucination with Regard to Known FactsLong19 citations
- The Perspectivist Paradigm Shift: Assumptions and Challenges of Capturing Human LabelsLong19 citations
- Uncertainty Quantification for In-Context Learning of Large Language ModelsLong19 citations
- When Life Gives You Lemons, Make Cherryade: Converting Feedback from Bad Responses into Good LabelsLong19 citations
- pyvene: A Library for Understanding and Improving PyTorch Models via InterventionsSystem Demonstrations19 citations
- A Study on the Calibration of In-context LearningLong18 citations
- A Systematic Comparison of Contextualized Word Embeddings for Lexical Semantic ChangeLong18 citations
- ComCLIP: Training-Free Compositional Image and Text MatchingLong18 citations
- DialogBench: Evaluating LLMs as Human-like Dialogue SystemsLong18 citations
- Direct Preference Optimization for Neural Machine Translation with Minimum Bayes Risk DecodingShort18 citations
- EIVEN: Efficient Implicit Attribute Value Extraction using Multimodal LLMIndustry18 citations
- Exploring Automated Distractor Generation for Math Multiple-choice Questions via Large Language ModelsFindings18 citations
- Fake Alignment: Are LLMs Really Aligned Well?Long18 citations
- How are Prompts Different in Terms of Sensitivity?Long18 citations
- InstructEval: Systematic Evaluation of Instruction Selection MethodsFindings18 citations
- NLP for Counterspeech against Hate: A Survey and How-To GuideFindings18 citations
- Rehearsal-Free Modular and Compositional Continual Learning for Language ModelsShort18 citations
- Which Modality should I use - Text, Motif, or Image? : Understanding Graphs with Large Language ModelsFindings18 citations
- A Novel Paradigm Boosting Translation Capabilities of Large Language ModelsFindings17 citations
- CLEAN–EVAL: Clean Evaluation on Contaminated Large Language ModelsFindings17 citations
- Contextual Refinement of Translations: Large Language Models for Sentence and Document-Level Post-EditingLong17 citations
- Exploring the Impact of Table-to-Text Methods on Augmenting LLM-based Question Answering with Domain Hybrid DataIndustry17 citations
- First Tragedy, then Parse: History Repeats Itself in the New Era of Large Language ModelsLong17 citations
- GEE! Grammar Error Explanation with Large Language ModelsFindings17 citations
- GenRES: Rethinking Evaluation for Generative Relation Extraction in the Era of Large Language ModelsLong17 citations
- Low-code LLM: Graphical User Interface over Large Language ModelsSystem Demonstrations17 citations
- SocREval: Large Language Models with the Socratic Method for Reference-free Reasoning EvaluationFindings17 citations
- SportQA: A Benchmark for Sports Understanding in Large Language ModelsLong17 citations
- Transformers Can Represent n-gram Language ModelsLong17 citations
- Universal Prompt Optimizer for Safe Text-to-Image GenerationLong17 citations
- What Makes Math Word Problems Challenging for LLMs?Findings17 citations
- AbsPyramid: Benchmarking the Abstraction Ability of Language Models with a Unified Entailment GraphFindings16 citations
- PlanRAG: A Plan-then-Retrieval Augmented Generation for Generative Large Language Models as Decision MakersLong16 citations
- Sub-Sentence Encoder: Contrastive Learning of Propositional Semantic RepresentationsLong16 citations
- This Land is Your, My Land: Evaluating Geopolitical Bias in Language Models through Territorial DisputesLong16 citations
- Topics, Authors, and Institutions in Large Language Model Research: Trends from 17K arXiv PapersLong16 citations
- Universal NER: A Gold-Standard Multilingual Named Entity Recognition BenchmarkLong16 citations
- WaterJudge: Quality-Detection Trade-off when Watermarking Large Language ModelsFindings16 citations
- When Hindsight is Not 20/20: Testing Limits on Reflective Thinking in Large Language ModelsFindings16 citations
- Why So Gullible? Enhancing the Robustness of Retrieval-Augmented Models against Counterfactual NoiseFindings16 citations
- Ada-LEval: Evaluating long-context LLMs with length-adaptable benchmarksLong15 citations
- AgentQuest: A Modular Benchmark Framework to Measure Progress and Improve LLM AgentsSystem Demonstrations15 citations
- Depression Detection in Clinical Interviews with LLM-Empowered Structural Element GraphLong15 citations
- Emotion-Anchored Contrastive Learning Framework for Emotion Recognition in ConversationFindings15 citations
- Evaluating the Deductive Competence of Large Language ModelsLong15 citations
- Exploring Cross-Cultural Differences in English Hate Speech Annotations: From Dataset Construction to AnalysisLong15 citations
- Improving In-context Learning of Multilingual Generative Language Models with Cross-lingual AlignmentLong15 citations
- OrchestraLLM: Efficient Orchestration of Language Models for Dialogue State TrackingLong15 citations
- POLYIE: A Dataset of Information Extraction from Polymer Material Scientific LiteratureLong15 citations
- Personalized Jargon Identification for Enhanced Interdisciplinary CommunicationLong15 citations
- Safer-Instruct: Aligning Language Models with Automated Preference DataLong15 citations
- Toolink: Linking Toolkit Creation and Using through Chain-of-Solving on Open-Source ModelLong15 citations
- Can Language Model Moderators Improve the Health of Online Discourse?Long14 citations
- DecoderLens: Layerwise Interpretation of Encoder-Decoder TransformersFindings14 citations
- EchoPrompt: Instructing the Model to Rephrase Queries for Improved In-context LearningShort14 citations
- Evaluating In-Context Learning of Libraries for Code GenerationLong14 citations
- Instruction Tuning with Human CurriculumFindings14 citations
- Leveraging Generative Large Language Models with Visual Instruction and Demonstration Retrieval for Multimodal Sarcasm DetectionLong14 citations
- Modeling the Sacred: Considerations when Using Religious Texts in Natural Language ProcessingFindings14 citations
- Natural Language Embedded Programs for Hybrid Language Symbolic ReasoningFindings14 citations
- On-the-fly Definition Augmentation of LLMs for Biomedical NERLong14 citations
- Psychometric Predictive Power of Large Language ModelsFindings14 citations
- RESPROMPT: Residual Connection Prompting Advances Multi-Step Reasoning in Large Language ModelsLong14 citations
- Role Prompting Guided Domain Adaptation with General Capability Preserve for Large Language ModelsFindings14 citations
- Teaching Language Models to Self-Improve through Interactive DemonstrationsLong14 citations
- UICoder: Finetuning Large Language Models to Generate User Interface Code through Automated FeedbackLong14 citations
- ACLSum: A New Dataset for Aspect-based Summarization of Scientific PublicationsLong13 citations
- Actively Learn from LLMs with Uncertainty Propagation for Generalized Category DiscoveryLong13 citations
- BeLLM: Backward Dependency Enhanced Large Language Model for Sentence EmbeddingsLong13 citations
- Breaking the Language Barrier: Can Direct Inference Outperform Pre-Translation in Multilingual LLM Applications?Short13 citations
- Bridging the Gap between Different Vocabularies for LLM EnsembleLong13 citations
- Bring Your Own KG: Self-Supervised Program Synthesis for Zero-Shot KGQAFindings13 citations
- Capturing Perspectives of Crowdsourced Annotators in Subjective Learning TasksLong13 citations
- Chart-based Reasoning: Transferring Capabilities from LLMs to VLMsFindings13 citations
- ContraDoc: Understanding Self-Contradictions in Documents with Large Language ModelsLong13 citations
- Enhancing Cross-lingual Sentence Embedding for Low-resource Languages with Word AlignmentFindings13 citations
- Fair Abstractive Summarization of Diverse PerspectivesLong13 citations
- In-Context Example Ordering Guided by Label DistributionsFindings13 citations
- IterAlign: Iterative Constitutional Alignment of Large Language ModelsLong13 citations
- KDMCSE: Knowledge Distillation Multimodal Sentence Embeddings with Adaptive Angular margin Contrastive LearningLong13 citations
- Leveraging LLMs for Synthesizing Training Data Across Many Languages in Multilingual Dense RetrievalLong13 citations
- Multilingual Pretraining and Instruction Tuning Improve Cross-Lingual Knowledge Alignment, But Only ShallowlyLong13 citations
- On Evaluating the Integration of Reasoning and Action in LLM Agents with Database Question AnsweringFindings13 citations
- Prompt Space Optimizing Few-shot Reasoning Success with Large Language ModelsFindings13 citations
- ReEval: Automatic Hallucination Evaluation for Retrieval-Augmented Large Language Models via Transferable Adversarial AttacksFindings13 citations
- Retrieval Helps or Hurts? A Deeper Dive into the Efficacy of Retrieval Augmentation to Language ModelsLong13 citations
- zrLLM: Zero-Shot Relational Learning on Temporal Knowledge Graphs with Large Language ModelsLong13 citations
- ALOHa: A New Measure for Hallucination in Captioning ModelsShort12 citations
- Confronting LLMs with Traditional ML: Rethinking the Fairness of Large Language Models in Tabular ClassificationsLong12 citations
- Crafting In-context Examples according to LMs’ Parametric KnowledgeFindings12 citations
- Do Localization Methods Actually Localize Memorized Data in LLMs? A Tale of Two BenchmarksLong12 citations
- FUN with Fisher: Improving Generalization of Adapter-Based Cross-lingual Transfer with Scheduled UnfreezingLong12 citations
- LLM-Driven Knowledge Injection Advances Zero-Shot and Cross-Target Stance DetectionShort12 citations
- MAFALDA: A Benchmark and Comprehensive Study of Fallacy Detection and ClassificationLong12 citations
- OSCaR: Object State Captioning and State Change RepresentationFindings12 citations
- ParallelPARC: A Scalable Pipeline for Generating Natural-Language AnalogiesLong12 citations
- Teaching Llama a New Language Through Cross-Lingual Knowledge TransferFindings12 citations
- TriSum: Learning Summarization Ability from Large Language Models with Structured RationaleLong12 citations
- A Multi-Aspect Framework for Counter Narrative Evaluation using Large Language ModelsShort11 citations
- A Tree-of-Thoughts to Broaden Multi-step Reasoning across LanguagesFindings11 citations
- Beyond Performance: Quantifying and Mitigating Label Bias in LLMsLong11 citations
- Carpe diem: On the Evaluation of World Knowledge in Lifelong Language ModelsLong11 citations
- E5: Zero-shot Hierarchical Table Analysis using Augmented LLMs via Explain, Extract, Execute, Exhibit and ExtrapolateLong11 citations
- GPT-Fathom: Benchmarking Large Language Models to Decipher the Evolutionary Path towards GPT-4 and BeyondFindings11 citations
- ICXML: An In-Context Learning Framework for Zero-Shot Extreme Multi-Label ClassificationFindings11 citations
- In-context Learning Generalizes, But Not Always Robustly: The Case of SyntaxLong11 citations
- LeanReasoner: Boosting Complex Logical Reasoning with LeanLong11 citations
- METAL: Towards Multilingual Meta-EvaluationFindings11 citations
- More Samples or More Prompts? Exploring Effective Few-Shot In-Context Learning for LLMs with In-Context SamplingFindings11 citations
- NLP Systems That Can’t Tell Use from Mention Censor Counterspeech, but Teaching the Distinction HelpsLong11 citations
- On-the-Fly Fusion of Large Language Models and Machine TranslationFindings11 citations
- Paraphrase and Solve: Exploring and Exploiting the Impact of Surface Form on Mathematical Reasoning in Large Language ModelsLong11 citations
- Shears: Unstructured Sparsity with Neural Low-rank Adapter SearchIndustry11 citations
- Struc-Bench: Are Large Language Models Good at Generating Complex Structured Tabular Data?Short11 citations
- Towards an On-device Agent for Text RewritingFindings11 citations
- Unitxt: Flexible, Shareable and Reusable Data Preparation and Evaluation for Generative AISystem Demonstrations11 citations
- Unlocking Emergent Modularity in Large Language ModelsLong11 citations
- Assessing Factual Reliability of Large Language Model KnowledgeLong10 citations
- BPE-knockout: Pruning Pre-existing BPE Tokenisers with Backwards-compatible Morphological Semi-supervisionLong10 citations
- Building Knowledge-Guided Lexica to Model Cultural VariationLong10 citations
- Document Image Machine Translation with Dynamic Multi-pre-trained Models AssemblingLong10 citations
- Ethos: Rectifying Language Models in Orthogonal Parameter SpaceFindings10 citations
- Getting Sick After Seeing a Doctor? Diagnosing and Mitigating Knowledge Conflicts in Event Temporal ReasoningFindings10 citations
- Long-form evaluation of model editingLong10 citations
- MATHSENSEI: A Tool-Augmented Large Language Model for Mathematical ReasoningLong10 citations
- ReTA: Recursively Thinking Ahead to Improve the Strategic Reasoning of Large Language ModelsLong10 citations
- SEMQA: Semi-Extractive Multi-Source Question AnsweringLong10 citations
- SMILE: Multimodal Dataset for Understanding Laughter in Video with Language ModelsFindings10 citations
- TRAQ: Trustworthy Retrieval Augmented Question Answering via Conformal PredictionLong10 citations
- The Colorful Future of LLMs: Evaluating and Improving LLMs as Emotional Supporters for Queer YouthLong10 citations
- The Impact of Depth on Compositional Generalization in Transformer Language ModelsLong10 citations
- Time Machine GPTFindings10 citations
- Tokenization Matters: Navigating Data-Scarce Tokenization for Gender Inclusive Language TechnologiesFindings10 citations
- Visual Grounding Helps Learn Word Meanings in Low-Data RegimesLong10 citations
- X-LLaVA: Optimizing Bilingual Large Vision-Language AlignmentFindings10 citations
- You don’t need a personality test to know these models are unreliable: Assessing the Reliability of Large Language Models on Psychometric InstrumentsLong10 citations
- A Preference-driven Paradigm for Enhanced Translation with Large Language ModelsLong9 citations
- A Theory Guided Scaffolding Instruction Framework for LLM-Enabled Metaphor ReasoningLong9 citations
- Arithmetic Reasoning with LLM: Prolog Generation & PermutationShort9 citations
- Assessing Logical Puzzle Solving in Large Language Models: Insights from a Minesweeper Case StudyLong9 citations
- Differentially Private Next-Token Prediction of Large Language ModelsLong9 citations
- Edu-ConvoKit: An Open-Source Library for Education Conversation DataSystem Demonstrations9 citations
- Efficiently Distilling LLMs for Edge ApplicationsIndustry9 citations
- Examining Modularity in Multilingual LMs via Language-Specialized SubnetworksFindings9 citations
- Extending CLIP’s Image-Text Alignment to Referring Image SegmentationLong9 citations
- GRASP: A Disagreement Analysis Framework to Assess Group Associations in PerspectivesLong9 citations
- Improving Adversarial Data Collection by Supporting Annotators: Lessons from GAHD, a German Hate Speech DatasetLong9 citations
- IndiBias: A Benchmark Dataset to Measure Social Biases in Language Models for Indian ContextLong9 citations
- Investigating the Emergent Audio Classification Ability of ASR Foundation ModelsLong9 citations
- Large Human Language Models: A Need and the ChallengesLong9 citations
- Llama meets EU: Investigating the European political spectrum through the lens of LLMsShort9 citations
- Measuring Social Norms of Large Language ModelsFindings9 citations
- Naive Bayes-based Context Extension for Large Language ModelsLong9 citations
- PEEB: Part-based Image Classifiers with an Explainable and Editable Language BottleneckFindings9 citations
- Planning and Editing What You Retrieve for Enhanced Tool LearningFindings9 citations
- Pruning as a Domain-specific LLM ExtractorFindings9 citations
- RENOVI: A Benchmark Towards Remediating Norm Violations in Socio-Cultural ConversationsFindings9 citations
- Reverse Chain: A Generic-Rule for LLMs to Master Multi-API PlanningFindings9 citations
- Solving General Natural-Language-Description Optimization Problems with Large Language ModelsIndustry9 citations
- Toward Informal Language Processing: Knowledge of Slang in Large Language ModelsLong9 citations
- Visual Grounding for User InterfacesIndustry9 citations
- Weight-Inherited Distillation for Task-Agnostic BERT CompressionFindings9 citations
- Z-GMOT: Zero-shot Generic Multiple Object TrackingFindings9 citations
- Backdoor Attacks on Multilingual Machine TranslationLong8 citations
- CLGSI: A Multimodal Sentiment Analysis Framework based on Contrastive Learning Guided by Sentiment IntensityFindings8 citations
- COSIGN: Contextual Facts Guided Generation for Knowledge Graph CompletionLong8 citations
- Contextualizing Argument Quality Assessment with Relevant KnowledgeShort8 citations
- DEED: Dynamic Early Exit on Decoder for Accelerating Encoder-Decoder Transformer ModelsFindings8 citations
- DIALIGHT: Lightweight Multilingual Development and Evaluation of Task-Oriented Dialogue Systems with Large Language ModelsSystem Demonstrations8 citations
- DiLM: Distilling Dataset into Language Model for Text-level Dataset DistillationFindings8 citations
- Do Large Language Models Rank Fairly? An Empirical Study on the Fairness of LLMs as RankersLong8 citations
- FREB-TQA: A Fine-Grained Robustness Evaluation Benchmark for Table Question AnsweringLong8 citations
- Heterogeneity over Homogeneity: Investigating Multilingual Speech Pre-Trained Models for Detecting Audio DeepfakeFindings8 citations
- Hierarchical Attention Graph for Scientific Document Summarization in Global and Local LevelFindings8 citations
- In-context Learning and Gradient Descent RevisitedLong8 citations
- It’s All Relative! – A Synthetic Query Generation Approach for Improving Zero-Shot Relevance PredictionFindings8 citations
- Language Models can be Deductive SolversFindings8 citations
- Low-resource neural machine translation with morphological modelingFindings8 citations
- NLP Progress in Indigenous Latin American LanguagesLong8 citations
- NeuroComparatives: Neuro-Symbolic Distillation of Comparative KnowledgeFindings8 citations
- PILOT: Legal Case Outcome Prediction with Case LawLong8 citations
- Prompt-Singer: Controllable Singing-Voice-Synthesis with Natural Language PromptLong8 citations
- Reinforcement Learning with Token-level Feedback for Controllable Text GenerationFindings8 citations
- SharpSeq: Empowering Continual Event Detection through Sharpness-Aware Sequential-task LearningLong8 citations
- UniverSLU: Universal Spoken Language Understanding for Diverse Tasks with Natural Language InstructionsLong8 citations
- What Are We Measuring When We Evaluate Large Vision-Language Models? An Analysis of Latent Factors and BiasesLong8 citations
- AWESOME: GPU Memory-constrained Long Document Summarization using Memory Mechanism and Global Salient ContentLong7 citations
- AdaRefiner: Refining Decisions of Language Models with Adaptive FeedbackFindings7 citations
- Advancing the Robustness of Large Language Models through Self-Denoised SmoothingShort7 citations
- Automatic Generation of Model and Data Cards: A Step Towards Responsible AILong7 citations
- CM-TTS: Enhancing Real Time Text-to-Speech Synthesis Efficiency through Weighted Samplers and Consistency ModelsFindings7 citations
- Can LLM’s Generate Human-Like Wayfinding Instructions? Towards Platform-Agnostic Embodied Instruction SynthesisShort7 citations
- CoDa: Constrained Generation based Data Augmentation for Low-Resource NLPFindings7 citations
- DIVKNOWQA: Assessing the Reasoning Ability of LLMs via Open-Domain Question Answering over Knowledge Base and TextFindings7 citations
- DialogCC: An Automated Pipeline for Creating High-Quality Multi-Modal Dialogue DatasetLong7 citations
- Embodied Executable Policy Learning with Language-based Scene SummarizationLong7 citations
- Enhancing the General Agent Capabilities of Low-Paramter LLMs through Tuning and Multi-Branch ReasoningFindings7 citations
- Event Causality Is Key to Computational Story UnderstandingLong7 citations
- Fine-Tuning Language Models with Reward Learning on PolicyLong7 citations
- GoT: Effective Graph-of-Thought Reasoning in Language ModelsFindings7 citations
- HILL: Hierarchy-aware Information Lossless Contrastive Learning for Hierarchical Text ClassificationLong7 citations
- How Well Do Large Language Models Truly Ground?Long7 citations
- How did we get here? Summarizing conversation dynamicsLong7 citations
- ICLE++: Modeling Fine-Grained Traits for Holistic Essay ScoringLong7 citations
- Improving Health Question Answering with Reliable and Time-Aware Evidence RetrievalFindings7 citations
- IterCQR: Iterative Conversational Query Reformulation with Retrieval GuidanceLong7 citations
- Key ingredients for effective zero-shot cross-lingual knowledge transfer in generative tasksLong7 citations
- Kreyòl-MT: Building MT for Latin American, Caribbean and Colonial African Creole LanguagesLong7 citations
- LifeTox: Unveiling Implicit Toxicity in Life AdviceShort7 citations
- Lossless Acceleration of Large Language Model via Adaptive N-gram Parallel DecodingIndustry7 citations
- MSciNLI: A Diverse Benchmark for Scientific Natural Language InferenceLong7 citations
- Mitigating Bias for Question Answering Models by Tracking Bias InfluenceLong7 citations
- MultiParaDetox: Extending Text Detoxification with Parallel Data to New LanguagesShort7 citations
- Optimizing LLM Based Retrieval Augmented Generation Pipelines in the Financial DomainIndustry7 citations
- PaD: Program-aided Distillation Can Teach Small Models Reasoning Better than Chain-of-thought Fine-tuningLong7 citations
- Polarity Calibration for Opinion SummarizationLong7 citations
- Product Description and QA Assisted Self-Supervised Opinion SummarizationFindings7 citations
- Reason from Fallacy: Enhancing Large Language Models’ Logical Reasoning through Logical Fallacy UnderstandingFindings7 citations
- SGSH: Stimulate Large Language Models with Skeleton Heuristics for Knowledge Base Question GenerationFindings7 citations
- The Impact of Differential Privacy on Group Disparity MitigationFindings7 citations
- The Integration of Semantic and Structural Knowledge in Knowledge Graph Entity TypingLong7 citations
- The Role of n-gram Smoothing in the Age of Neural NetworksLong7 citations
- The Whole is Better than the Sum: Using Aggregated Demonstrations in In-Context Learning for Sequential RecommendationFindings7 citations
- Think While You Write: Hypothesis Verification Promotes Faithful Knowledge-to-Text GenerationFindings7 citations
- To Tell The Truth: Language of Deception and Language ModelsLong7 citations
- TrojFSP: Trojan Insertion in Few-shot Prompt TuningLong7 citations
- VisLingInstruct: Elevating Zero-Shot Learning in Multi-Modal Language Models with Autonomous Instruction OptimizationLong7 citations
- Visually Guided Generative Text-Layout Pre-training for Document IntelligenceLong7 citations
- Visually-Aware Context Modeling for News Image CaptioningLong7 citations
- “One-Size-Fits-All”? Examining Expectations around What Constitute “Fair” or “Good” NLG System BehaviorsLong7 citations
- A Novel Two-step Fine-tuning Framework for Transfer Learning in Low-Resource Neural Machine TranslationFindings6 citations
- A Survey of Meaning Representations – From Theory to Practical UtilityLong6 citations
- AMA-LSTM: Pioneering Robust and Fair Financial Audio Analysis for Stock Volatility PredictionIndustry6 citations
- AMRFact: Enhancing Summarization Factuality Evaluation with AMR-Driven Negative Samples GenerationLong6 citations
- ATG: Benchmarking Automated Theorem Generation for Generative Language ModelsFindings6 citations
- Adaptive Rank Selections for Low-Rank Approximation of Language ModelsLong6 citations
- AfriMTE and AfriCOMET: Enhancing COMET to Embrace Under-resourced African LanguagesLong6 citations
- Aligning as Debiasing: Causality-Aware Alignment via Reinforcement Learning with Interventional FeedbackLong6 citations
- An Interactive Framework for Profiling News Media SourcesLong6 citations
- Analyzing the Role of Semantic Representations in the Era of Large Language ModelsLong6 citations
- Biomedical Entity Representation with Graph-Augmented Multi-Objective TransformerFindings6 citations
- CCSum: A Large-Scale and High-Quality Dataset for Abstractive News SummarizationLong6 citations
- CoE-SQL: In-Context Learning for Multi-Turn Text-to-SQL with Chain-of-EditionsLong6 citations
- DoG-Instruct: Towards Premium Instruction-Tuning Data via Text-Grounded Instruction WrappingLong6 citations
- Elote, Choclo and Mazorca: on the Varieties of SpanishLong6 citations
- Enhancing Large Language Models Against Inductive Instructions with Dual-critique PromptingLong6 citations
- Event Detection from Social Media for Epidemic PredictionLong6 citations
- F-MALLOC: Feed-forward Memory Allocation for Continual Learning in Neural Machine TranslationLong6 citations
- GOLD: Geometry Problem Solver with Natural Language DescriptionFindings6 citations
- Generalizable Multilingual Hate Speech Detection on Low Resource Indian Languages using Fair Selection in Federated LearningLong6 citations
- Graph-Induced Syntactic-Semantic Spaces in Transformer-Based Variational AutoEncodersFindings6 citations
- Groundedness in Retrieval-augmented Long-form Generation: An Empirical StudyFindings6 citations
- HPipe: Large Language Model Pipeline Parallelism for Long Context on Heterogeneous Cost-effective DevicesIndustry6 citations
- Hallucination Diversity-Aware Active Learning for Text SummarizationLong6 citations
- Improved Text Emotion Prediction Using Combined Valence and Arousal Ordinal ClassificationShort6 citations
- JAMDEC: Unsupervised Authorship Obfuscation using Constrained Decoding over Small Language ModelsLong6 citations
- Leveraging Code to Improve In-Context Learning for Semantic ParsingLong6 citations
- Lower Bounds on the Expressivity of Recurrent Neural Language ModelsLong6 citations
- MAGID: An Automated Pipeline for Generating Synthetic Multi-modal DatasetsLong6 citations
- Memory Augmented Language Models through Mixture of Word ExpertsLong6 citations
- Mind’s Mirror: Distilling Self-Evaluation Capability and Comprehensive Thinking from Large Language ModelsLong6 citations
- Multi-Operational Mathematical Derivations in Latent SpaceLong6 citations
- Native Language Identification in Texts: A SurveyLong6 citations
- Okay, Let’s Do This! Modeling Event Coreference with Generated Rationales and Knowledge DistillationLong6 citations
- On the Role of Summary Content Units in Text Summarization EvaluationShort6 citations
- PRODIGy: a PROfile-based DIalogue Generation datasetFindings6 citations
- SemRoDe: Macro Adversarial Training to Learn Representations that are Robust to Word-Level AttacksLong6 citations
- Semi-Structured Chain-of-Thought: Integrating Multiple Sources of Knowledge for Improved Language Model ReasoningLong6 citations
- Semi-Supervised Dialogue Abstractive Summarization via High-Quality Pseudolabel SelectionLong6 citations
- SimSCOOD: Systematic Analysis of Out-of-Distribution Generalization in Fine-tuned Source Code ModelsFindings6 citations
- Social Meme-ing: Measuring Linguistic Variation in MemesLong6 citations
- Text Diffusion Model with Encoder-Decoder Transformers for Sequence-to-Sequence GenerationLong6 citations
- The Promises and Pitfalls of Using Language Models to Measure Instruction Quality in EducationLong6 citations
- The taste of IPA: Towards open-vocabulary keyword spotting and forced alignment in any languageLong6 citations
- ToXCL: A Unified Framework for Toxic Speech Detection and ExplanationLong6 citations
- Two Heads are Better than One: Nested PoE for Robust Defense Against Multi-BackdoorsLong6 citations
- UINav: A Practical Approach to Train On-Device Automation AgentsIndustry6 citations
- Uncertainty Estimation on Sequential Labeling via Uncertainty TransmissionFindings6 citations
- mEdIT: Multilingual Text Editing via Instruction TuningLong6 citations
- mOthello: When Do Cross-Lingual Representation Alignment and Cross-Lingual Transfer Emerge in Multilingual Models?Findings6 citations
- A Measure for Transparent Comparison of Linguistic Diversity in Multilingual NLP Data SetsFindings5 citations
- Anisotropy is Not Inherent to TransformersLong5 citations
- CPopQA: Ranking Cultural Concept Popularity by LLMsShort5 citations
- Comparing Two Model Designs for Clinical Note Generation; Is an LLM a Useful Evaluator of Consistency?Findings5 citations
- Connecting the Dots: Inferring Patent Phrase Similarity with Retrieved Phrase GraphsFindings5 citations
- Context Does Matter: Implications for Crowdsourced Evaluation Labels in Task-Oriented Dialogue SystemsFindings5 citations
- Crossing Linguistic Horizons: Finetuning and Comprehensive Evaluation of Vietnamese Large Language ModelsFindings5 citations
- David helps Goliath: Inference-Time Collaboration Between Small Specialized and Large General Diffusion LMsLong5 citations
- Defining and Detecting Vulnerability in Human Evaluation Guidelines: A Preliminary Study Towards Reliable NLG EvaluationLong5 citations
- Does Pre-trained Language Model Actually Infer Unseen Links in Knowledge Graph Completion?Long5 citations
- EMONA: Event-level Moral Opinions in News ArticlesLong5 citations
- Efficient Information Extraction in Few-Shot Relation Classification through Contrastive Representation LearningShort5 citations
- Encoding of lexical tone in self-supervised models of spoken languageLong5 citations
- Explaining Text Similarity in Transformer ModelsLong5 citations
- Exploring Self-supervised Logic-enhanced Training for Large Language ModelsLong5 citations
- FLAP: Flow-Adhering Planning with Constrained Decoding in LLMsLong5 citations
- Generalizable Sarcasm Detection is Just Around the Corner, of Course!Long5 citations
- Global Gallery: The Fine Art of Painting Culture Portraits through Multilingual Instruction TuningLong5 citations
- HateModerate: Testing Hate Speech Detectors against Content Moderation PoliciesFindings5 citations
- Intent-conditioned and Non-toxic Counterspeech Generation using Multi-Task Instruction Tuning with RLAIFLong5 citations
- Investigating Acceleration of LLaMA Inference by Enabling Intermediate Layer Decoding via Instruction Tuning with ‘LITE’Findings5 citations
- KnowLA: Enhancing Parameter-efficient Finetuning with Knowledgeable AdaptationLong5 citations
- LinkPrompt: Natural and Universal Adversarial Attacks on Prompt-based Language ModelsLong5 citations
- MOKA: Moral Knowledge Augmentation for Moral Event ExtractionLong5 citations
- MapGuide: A Simple yet Effective Method to Reconstruct Continuous Language from Brain ActivitiesLong5 citations
- Modeling Empathetic Alignment in ConversationLong5 citations
- MuLan: A Study of Fact Mutability in Language ModelsShort5 citations
- Narrowing the Gap between Zero- and Few-shot Machine Translation by Matching StylesFindings5 citations
- Q-Tuning: Queue-based Prompt Tuning for Lifelong Few-shot Language LearningFindings5 citations
- QueryExplorer: An Interactive Query Generation Assistant for Search and ExplorationSystem Demonstrations5 citations
- Rationale-based Opinion SummarizationLong5 citations
- Select and Summarize: Scene Saliency for Movie Script SummarizationFindings5 citations
- Selective Perception: Learning Concise State Descriptions for Language Model ActorsShort5 citations
- Set-Aligning Framework for Auto-Regressive Event Temporal Graph GenerationLong5 citations
- Solving Data-centric Tasks using Large Language ModelsFindings5 citations
- Synthetic Query Generation for Privacy-Preserving Deep Retrieval Systems using Differentially Private Language ModelsLong5 citations
- To Translate or Not to Translate: A Systematic Investigation of Translation-Based Cross-Lingual Transfer to Low-Resource LanguagesLong5 citations
- Towards Explainability in Legal Outcome Prediction ModelsLong5 citations
- Tram: A Token-level Retrieval-augmented Mechanism for Source Code SummarizationFindings5 citations
- Uncertainty Estimation in Large Language Models to Support Biodiversity ConservationIndustry5 citations
- Unlocking Parameter-Efficient Fine-Tuning for Low-Resource Language TranslationFindings5 citations
- VLUE: A New Benchmark and Multi-task Knowledge Transfer Learning for Vietnamese Natural Language UnderstandingFindings5 citations
- Whispers of Doubt Amidst Echoes of Triumph in NLP RobustnessLong5 citations
- “You are an expert annotator”: Automatic Best–Worst-Scaling Annotations for Emotion Intensity ModelingLong5 citations
- ALBA: Adaptive Language-Based Assessments for Mental HealthLong4 citations
- Advancing Regular Language Reasoning in Linear Recurrent Neural NetworksShort4 citations
- An Effective Automated Speaking Assessment Approach to Mitigating Data Scarcity and Imbalanced DistributionFindings4 citations
- An Examination of the Compositionality of Large Generative Vision-Language ModelsLong4 citations
- AnchorAL: Computationally Efficient Active Learning for Large and Imbalanced DatasetsLong4 citations
- Anti-LM Decoding for Zero-shot In-context Machine TranslationFindings4 citations
- Aspect-based Sentiment Analysis with Context DenoisingFindings4 citations
- BUST: Benchmark for the evaluation of detectors of LLM-Generated TextLong4 citations
- Benchmark Transparency: Measuring the Impact of Data on EvaluationLong4 citations
- Best of Both Worlds: A Pliable and Generalizable Neuro-Symbolic Approach for Relation ClassificationFindings4 citations
- Beyond Surface Similarity: Detecting Subtle Semantic Shifts in Financial NarrativesFindings4 citations
- Comparing Explanation Faithfulness between Multilingual and Monolingual Fine-tuned Language ModelsLong4 citations
- Conformer-Based Speech Recognition On Extreme Edge-Computing DevicesIndustry4 citations
- DAGCN: Distance-based and Aspect-oriented Graph Convolutional Network for Aspect-based Sentiment AnalysisFindings4 citations
- DivTOD: Unleashing the Power of LLMs for Diversifying Task-Oriented Dialogue RepresentationsFindings4 citations
- Do Prompt Positions Really Matter?Findings4 citations
- Effective and Efficient Conversation Retrieval for Dialogue State Tracking with Implicit Text SummariesLong4 citations
- Emergent Abilities in Reduced-Scale Generative Language ModelsFindings4 citations
- FedLFC: Towards Efficient Federated Multilingual Modeling with LoRA-based Language Family ClusteringFindings4 citations
- GINopic: Topic Modeling with Graph Isomorphism NetworkLong4 citations
- GOLD: Generalized Knowledge Distillation via Out-of-Distribution-Guided Language Data GenerationFindings4 citations
- Generating Mental Health Transcripts with SAPE (Spanish Adaptive Prompt Engineering)Long4 citations
- HTCCN: Temporal Causal Convolutional Networks with Hawkes Process for Extrapolation Reasoning in Temporal Knowledge GraphsLong4 citations
- Identifying Linear Relational Concepts in Large Language ModelsLong4 citations
- Instructing Large Language Models to Identify and Ignore Irrelevant ConditionsLong4 citations
- Is Reference Necessary in the Evaluation of NLG Systems? When and Where?Long4 citations
- LLM-based Frameworks for API Argument Filling in Task-Oriented Conversational SystemsIndustry4 citations
- LaDiC: Are Diffusion Models Really Inferior to Autoregressive Counterparts for Image-to-Text Generation?Long4 citations
- Language Models (Mostly) Do Not Consider Emotion Triggers When Predicting EmotionShort4 citations
- Large Language Models can Contrastively Refine their Generation for Better Sentence Representation LearningLong4 citations
- Leveraging LLMs for Dialogue Quality MeasurementIndustry4 citations
- Leveraging Prototypical Representations for Mitigating Social Bias without Demographic InformationShort4 citations
- Low-Rank Adaptation for Multilingual Summarization: An Empirical StudyFindings4 citations
- MDR: Model-Specific Demonstration Retrieval at Inference Time for In-Context LearningLong4 citations
- Media Bias Detection Across Families of Language ModelsLong4 citations
- Multiple-Question Multiple-Answer Text-VQAIndustry4 citations
- On the Way to Gentle AI Counselor: Politeness Cause Elicitation and Intensity Tagging in Code-mixed Hinglish Conversations for Social GoodFindings4 citations
- Open-Vocabulary Federated Learning with Multimodal PrototypingLong4 citations
- P3Sum: Preserving Author’s Perspective in News Summarization with Diffusion Language ModelsLong4 citations
- PatentEval: Understanding Errors in Patent GenerationLong4 citations
- Program-Aided Reasoners (Better) Know What They KnowLong4 citations
- Query-Efficient Textual Adversarial Example Generation for Black-Box AttacksLong4 citations
- RST-LoRA: A Discourse-Aware Low-Rank Adaptation for Long Document Abstractive SummarizationLong4 citations
- RobustSentEmbed: Robust Sentence Embeddings Using Adversarial Self-Supervised Contrastive LearningFindings4 citations
- SlimFit: Memory-Efficient Fine-Tuning of Transformer-based Models Using Training DynamicsLong4 citations
- SuperGLEBer: German Language Understanding Evaluation BenchmarkLong4 citations
- TISE: A Tripartite In-context Selection Method for Event Argument ExtractionLong4 citations
- Towards Reducing Diagnostic Errors with Interpretable Risk PredictionLong4 citations
- Ungrammatical-syntax-based In-context Example Selection for Grammatical Error CorrectionLong4 citations
- Unleashing the Power of LLMs in Court View Generation by Stimulating Internal Knowledge and Incorporating External KnowledgeFindings4 citations
- WebWISE: Unlocking Web Interface Control for LLMs via Sequential ExplorationFindings4 citations
- X-PARADE: Cross-Lingual Textual Entailment and Information Divergence across ParagraphsLong4 citations
- jp-evalb: Robust Alignment-based PARSEVAL MeasuresSystem Demonstrations4 citations
- kNN-ICL: Compositional Task-Oriented Parsing Generalization with Nearest Neighbor In-Context LearningLong4 citations
- A School Student Essay Corpus for Analyzing Interactions of Argumentative Structure and QualityLong3 citations
- A Symbolic Framework for Evaluating Mathematical Reasoning and Generalisation with TransformersLong3 citations
- Addressing Both Statistical and Causal Gender Fairness in NLP ModelsFindings3 citations
- Addressing Healthcare-related Racial and LGBTQ+ Biases in Pretrained Language ModelsFindings3 citations
- An Empirical Study of Consistency Regularization for End-to-End Speech-to-Text TranslationLong3 citations
- BEAR: A Unified Framework for Evaluating Relational Knowledge in Causal and Masked Language ModelsFindings3 citations
- BookSQL: A Large Scale Text-to-SQL Dataset for Accounting DomainLong3 citations
- CASA: Causality-driven Argument Sufficiency AssessmentLong3 citations
- CNER: Concept and Named Entity RecognitionLong3 citations
- CONSCENDI: A Contrastive and Scenario-Guided Distillation Approach to Guardrail Models for Virtual AssistantsLong3 citations
- Conformal Intent Classification and Clarification for Fast and Accurate Intent RecognitionFindings3 citations
- Contextual Label Projection for Cross-Lingual Structured PredictionLong3 citations
- ContraSim – Analyzing Neural Representations Based on Contrastive LearningLong3 citations
- Corpus Considerations for Annotator Modeling and ScalingLong3 citations
- DOCMASTER: A Unified Platform for Annotation, Training, & Inference in Document Question-AnsweringSystem Demonstrations3 citations
- DUQGen: Effective Unsupervised Domain Adaptation of Neural Rankers by Diversifying Synthetic Query GenerationLong3 citations
- DeMuX: Data-efficient Multilingual LearningLong3 citations
- Debiasing with Sufficient Projection: A General Theoretical Framework for Vector RepresentationsLong3 citations
- Deja vu: Contrastive Historical Modeling with Prefix-tuning for Temporal Knowledge Graph ReasoningFindings3 citations
- Denoising Attention for Query-aware User ModelingFindings3 citations
- DialogVCS: Robust Natural Language Understanding in Dialogue System UpgradeLong3 citations
- Diffusion Glancing Transformer for Parallel Sequence-to-Sequence LearningLong3 citations
- Diverse Perspectives, Divergent Models: Cross-Cultural Evaluation of Depression Detection on TwitterShort3 citations
- DoubleLingo: Causal Estimation with Large Language ModelsShort3 citations
- EDEntail: An Entailment-based Few-shot Text Classification with Extensional DefinitionFindings3 citations
- Efficient Citer: Tuning Large Language Models for Enhanced Answer Quality and VerificationFindings3 citations
- Efficient End-to-End Visual Document Understanding with Rationale DistillationLong3 citations
- Enhancing Argument Summarization: Prioritizing Exhaustiveness in Key Point Generation and Introducing an Automatic Coverage Evaluation MetricLong3 citations
- Entity Disambiguation via Fusion Entity DecodingLong3 citations
- Event-Content-Oriented Dialogue Generation in Short VideoLong3 citations
- Extracting Lexical Features from Dialects via Interpretable Dialect ClassifiersShort3 citations
- Fact Checking Beyond Training SetLong3 citations
- Few-shot Knowledge Graph Relational Reasoning via Subgraph AdaptationLong3 citations
- Finding Replicable Human Evaluations via Stable Ranking ProbabilityLong3 citations
- Fine-grained Gender Control in Machine Translation with Large Language ModelsLong3 citations
- GenDecider: Integrating “None of the Candidates” Judgments in Zero-Shot Entity Linking Re-rankingShort3 citations
- Generalizable and Stable Finetuning of Pretrained Language Models on Low-Resource TextsLong3 citations
- Generating Signed Language Instructions in Large-Scale Dialogue SystemsIndustry3 citations
- GraSAME: Injecting Token-Level Structural Information to Pretrained Language Models via Graph-guided Self-Attention MechanismFindings3 citations
- Grammar-based Data Augmentation for Low-Resource Languages: The Case of Guarani-Spanish Neural Machine TranslationLong3 citations
- Ignore Me But Don’t Replace Me: Utilizing Non-Linguistic Elements for Pretraining on the Cybersecurity DomainFindings3 citations
- Incorporating Exponential Smoothing into MLP: a Simple but Effective Sequence ModelFindings3 citations
- IndiSentiment140: Sentiment Analysis Dataset for Indian Languages with Emphasis on Low-Resource Languages using Machine TranslationLong3 citations
- KTRL+F: Knowledge-Augmented In-Document SearchLong3 citations
- Keep it Private: Unsupervised Privatization of Online TextLong3 citations
- Know When To Stop: A Study of Semantic Drift in Text GenerationLong3 citations
- Knowledgeable In-Context Tuning: Exploring and Exploiting Factual Knowledge for In-Context LearningFindings3 citations
- Language Models are Alignable Decision-Makers: Dataset and Application to the Medical Triage DomainIndustry3 citations
- LayoutPointer: A Spatial-Context Adaptive Pointer Network for Visual Information ExtractionLong3 citations
- Lost in Space: Probing Fine-grained Spatial Understanding in Vision and Language ResamplersShort3 citations
- Lost in Transcription: Identifying and Quantifying the Accuracy Biases of Automatic Speech Recognition Systems Against Disfluent SpeechLong3 citations
- Lost in Translation? Translation Errors and Challenges for Fair Assessment of Text-to-Image Models on Multilingual ConceptsShort3 citations
- M3T: A New Benchmark Dataset for Multi-Modal Document-Level Machine TranslationShort3 citations
- MaCSC: Towards Multimodal-augmented Pre-trained Language Models via Conceptual Prototypes and Self-balancing CalibrationLong3 citations
- MedCycle: Unpaired Medical Report Generation via Cycle-ConsistencyFindings3 citations
- MiLe Loss: a New Loss for Mitigating the Bias of Learning Difficulties in Generative Language ModelsFindings3 citations
- Mitigating Hallucination in Abstractive Summarization with Domain-Conditional Mutual InformationFindings3 citations
- Multi-Review Fusion-in-ContextFindings3 citations
- PAELLA: Parameter-Efficient Lightweight Language-Agnostic Captioning ModelFindings3 citations
- Personalized Review Recommendation based on Implicit dimension miningShort3 citations
- Pregnant Questions: The Importance of Pragmatic Awareness in Maternal Health Question AnsweringLong3 citations
- Prompting Few-shot Multi-hop Question Generation via Comprehending Type-aware SemanticsFindings3 citations
- QualEval: Qualitative Evaluation for Model ImprovementLong3 citations
- REQUAL-LM: Reliability and Equity through Aggregation in Large Language ModelsFindings3 citations
- Reliability Estimation of News Media Sources: Birds of a Feather Flock TogetherLong3 citations
- SCANNER: Knowledge-Enhanced Approach for Robust Multi-modal Named Entity Recognition of Unseen EntitiesLong3 citations
- SLIDE: Reference-free Evaluation for Machine Translation using a Sliding Document WindowShort3 citations
- SLiM: Speculative Decoding with Hypothesis ReductionFindings3 citations
- SQATIN: Supervised Instruction Tuning Meets Question Answering for Improved Dialogue NLULong3 citations
- SpeedE: Euclidean Geometric Knowledge Graph Embedding Strikes BackFindings3 citations
- SumCSE: Summary as a transformation for Contrastive LearningFindings3 citations
- Testing the limits of logical reasoning in neural and hybrid modelsFindings3 citations
- Think Before You Speak: Cultivating Communication Skills of Large Language Models via Inner MonologueFindings3 citations
- UNcommonsense Reasoning: Abductive Reasoning about Uncommon SituationsLong3 citations
- Unified Examination of Entity Linking in Absence of Candidate SetsShort3 citations
- Unveiling the Magic: Investigating Attention Distillation in Retrieval-Augmented GenerationShort3 citations
- When Quantization Affects Confidence of Large Language Models?Findings3 citations
- i-Code V2: An Autoregressive Generation Framework over Vision, Language, and Speech DataFindings3 citations
- A Comprehensive Study of Gender Bias in Chemical Named Entity Recognition ModelsLong2 citations
- A Lightweight Mixture-of-Experts Neural Machine Translation Model with Stage-wise Training StrategyFindings2 citations
- A Transformer with Stack AttentionFindings2 citations
- A diverse Multilingual News Headlines Dataset from around the WorldShort2 citations
- ARM: Alignment with Residual Energy-Based ModelLong2 citations
- Adaptive Cross-lingual Text Classification through In-Context One-Shot DemonstrationsLong2 citations
- An Automatic Prompt Generation System for Tabular Data TasksIndustry2 citations
- Anonymity at Risk? Assessing Re-Identification Capabilities of Large Language Models in Court DecisionsFindings2 citations
- Asking More Informative Questions for Grounded RetrievalFindings2 citations
- Attention Alignment and Flexible Positional Embeddings Improve Transformer Length ExtrapolationFindings2 citations
- Automatic Pair Construction for Contrastive Post-trainingFindings2 citations
- Automatic Restoration of Diacritics for Speech Data SetsLong2 citations
- Automatic, Meta and Human Evaluation for Multimodal Summarization with Multimodal OutputLong2 citations
- CELI: Simple yet Effective Approach to Enhance Out-of-Domain Generalization of Cross-Encoders.Short2 citations
- COMMIT: Code-Mixing English-Centric Large Language Model for Multilingual Instruction TuningFindings2 citations
- Code Models are Zero-shot Precondition ReasonersLong2 citations
- Compensate Quantization Errors: Make Weights Hierarchical to Compensate Each OtherFindings2 citations
- ContrastiveMix: Overcoming Code-Mixing Dilemma in Cross-Lingual Transfer for Information RetrievalShort2 citations
- Control-DAG: Constrained Decoding for Non-Autoregressive Directed Acyclic T5 using Weighted Finite State AutomataShort2 citations
- Deferred NAM: Low-latency Top-K Context Injection via Deferred Context Encoding for Non-Streaming ASRIndustry2 citations
- Detecting Bipolar Disorder from Misdiagnosed Major Depressive Disorder with Mood-Aware Multi-Task LearningLong2 citations
- Discourse-Aware In-Context Learning for Temporal Expression NormalizationShort2 citations
- Dissecting Paraphrases: The Impact of Prompt Syntax and supplementary Information on Knowledge Retrieval from Pretrained Language ModelsLong2 citations
- Divergent Token Metrics: Measuring degradation to prune away LLM components – and optimize quantizationLong2 citations
- Do Vision-Language Models Understand Compound Nouns?Short2 citations
- Ensuring Safe and High-Quality Outputs: A Guideline Library Approach for Language ModelsLong2 citations
- Exploring Key Point Analysis with Pairwise Generation and Graph PartitioningLong2 citations
- Exploring Language Model’s Code Generation Ability with Auxiliary FunctionsFindings2 citations
- Exploring the Trade-off Between Model Performance and Explanation Plausibility of Text Classifiers Using Human RationalesFindings2 citations
- FAMuS: Frames Across Multiple SourcesLong2 citations
- Fixing Rogue Memorization in Many-to-One Multilingual Translators of Extremely-Low-Resource Languages by Rephrasing Training SamplesLong2 citations
- Fumbling in Babel: An Investigation into ChatGPT’s Language Identification AbilityFindings2 citations
- Fusion Makes Perfection: An Efficient Multi-Grained Matching Approach for Zero-Shot Relation ExtractionShort2 citations
- Gaussian Process Optimization for Adaptable Multi-Objective Text Generation using Linearly-Weighted Language ModelsFindings2 citations
- Generating Attractive and Authentic Copywriting from Customer ReviewsLong2 citations
- Generating Uncontextualized and Contextualized Questions for Document-Level Event Argument ExtractionLong2 citations
- GuyLingo: The Republic of Guyana Creole CorporaShort2 citations
- HIL: Hybrid Isotropy Learning for Zero-shot Performance in Dense retrievalLong2 citations
- How Lexical is Bilingual Lexicon Induction?Findings2 citations
- HumanRankEval: Automatic Evaluation of LMs as Conversational AssistantsLong2 citations
- Improving Pre-trained Language Model Sensitivity via Mask Specific losses: A case study on Biomedical NERLong2 citations
- Improving Toponym Resolution by Predicting Attributes to Constrain Geographical Ontology EntriesShort2 citations
- Is Prompt Transfer Always Effective? An Empirical Study of Prompt Transfer for Question AnsweringShort2 citations
- LEAF: Language Learners’ English Essays and Feedback CorpusShort2 citations
- LSTDial: Enhancing Dialogue Generation via Long- and Short-Term Measurement FeedbackLong2 citations
- Language Agnostic Code EmbeddingsLong2 citations
- LanguageFlow: Advancing Diffusion Language Generation with Probabilistic FlowsLong2 citations
- Laying Anchors: Semantically Priming Numerals in Language ModelingFindings2 citations
- Less is More for Improving Automatic Evaluation of Factual ConsistencyIndustry2 citations
- Leveraging Contextual Information for Effective Entity Salience DetectionFindings2 citations
- Leveraging Summarization for Unsupervised Dialogue Topic SegmentationFindings2 citations
- Low-Cost Generation and Evaluation of Dictionary Example SentencesLong2 citations
- MICo: Preventative Detoxification of Large Language Models through Inhibition ControlFindings2 citations
- Massive End-to-end Speech Recognition Models with Time ReductionLong2 citations
- Measuring Cross-lingual Transfer in BytesLong2 citations
- Metaphor Detection with Context Enhancement and Curriculum LearningLong2 citations
- Mix-Initiative Response Generation with Dynamic Prefix TuningLong2 citations
- Modeling and Detecting Company Risks from NewsIndustry2 citations
- More room for language: Investigating the effect of retrieval on language modelsShort2 citations
- MuMath: Multi-perspective Data Augmentation for Mathematical Reasoning in Large Language ModelsFindings2 citations
- Multi-stage Retrieve and Re-rank Model for Automatic Medical Coding RecommendationLong2 citations
- Multimodal Chart Retrieval: A Comparison of Text, Table and Image Based ApproachesLong2 citations
- Named Entity Recognition Under Domain Shift via Metric Learning for Life SciencesLong2 citations
- Navigation as Attackers Wish? Towards Building Robust Embodied Agents under Federated LearningLong2 citations
- Neurocache: Efficient Vector Retrieval for Long-range Language ModelingLong2 citations
- Normalizing without Modernizing: Keeping Historical Wordforms of Middle French while Reducing Spelling VariantsFindings2 citations
- ODD: A Benchmark Dataset for the Natural Language Processing Based Opioid Related Aberrant Behavior DetectionLong2 citations
- On Linearizing Structured Data in Encoder-Decoder Language Models: Insights from Text-to-SQLLong2 citations
- On the True Distribution Approximation of Minimum Bayes-Risk DecodingShort2 citations
- PEMA: An Offsite-Tunable Plug-in External Memory Adaptation for Language ModelsLong2 citations
- Parameter-Efficient Instruction Tuning of Large Language Models For Extreme Financial Numeral LabellingLong2 citations
- Personalized Federated Learning for Text Classification with Gradient-Free Prompt TuningFindings2 citations
- Pre-trained Language Models for Entity Blocking: A Reproducibility StudyLong2 citations
- Probing the Category of Verbal Aspect in Transformer Language ModelsFindings2 citations
- Promptly Predicting Structures: The Return of InferenceLong2 citations
- RE2: Region-Aware Relation Extraction from Visually Rich DocumentsLong2 citations
- REXEL: An End-to-end Model for Document-Level Relation Extraction and Entity LinkingIndustry2 citations
- RedCoast: A Lightweight Tool to Automate Distributed Training of LLMs on Any GPU/TPUsSystem Demonstrations2 citations
- Regularized Conventions: Equilibrium Computation as a Model of Pragmatic ReasoningLong2 citations
- Reinforced Multiple Instance Selection for Speaker Attribute PredictionLong2 citations
- Revisiting subword tokenization: A case study on affixal negation in large language modelsLong2 citations
- RoDia: A New Dataset for Romanian Dialect Identification from SpeechFindings2 citations
- SKICSE: Sentence Knowable Information Prompted by LLMs Improves Contrastive Sentence EmbeddingsShort2 citations
- Self-Adaptive Sampling for Accurate Video Question Answering on Image Text ModelsFindings2 citations
- Self-Cleaning: Improving a Named Entity Recognizer Trained on Noisy Data with a Few Clean InstancesFindings2 citations
- Self-generated Replay Memories for Continual Neural Machine TranslationLong2 citations
- Sentence-level Media Bias Analysis with Event Relation GraphLong2 citations
- Show Your Work with Confidence: Confidence Bands for Tuning CurvesLong2 citations
- Signer Diversity-driven Data Augmentation for Signer-Independent Sign Language TranslationFindings2 citations
- Source-Free Unsupervised Domain Adaptation for Question Answering via Prompt-Assisted Self-learningFindings2 citations
- Strings from the Library of Babel: Random Sampling as a Strong Baseline for Prompt OptimisationLong2 citations
- Subspace Representations for Soft Set Operations and Sentence SimilaritiesLong2 citations
- SumTra: A Differentiable Pipeline for Few-Shot Cross-Lingual SummarizationLong2 citations
- TOPICAL: TOPIC Pages AutomagicaLlySystem Demonstrations2 citations
- TRUE-UIE: Two Universal Relations Unify Information Extraction TasksLong2 citations
- Targeted Augmentation for Low-Resource Event ExtractionFindings2 citations
- Testing the Effect of Code Documentation on Large Language Model Code UnderstandingFindings2 citations
- Towards Improved Multi-Source Attribution for Long-Form Answer GenerationLong2 citations
- UGIF-DataSet: A New Dataset for Cross-lingual, Cross-modal Sequential actions on the UIFindings2 citations
- What if you said that differently?: How Explanation Formats Affect Human Feedback Efficacy and User PerceptionLong2 citations
- When Does Monolingual Data Help Multilingual Translation: The Role of Domain and Model ScaleLong2 citations
- XAL: EXplainable Active Learning Makes Classifiers Better Low-resource LearnersLong2 citations
- iACOS: Advancing Implicit Sentiment Extraction with Informative and Adaptive Negative ExamplesLong2 citations
- A (More) Realistic Evaluation Setup for Generalisation of Community Models on Malicious Content DetectionFindings1 citations
- A Likelihood Ratio Test of Genetic Relationship among LanguagesLong1 citations
- A Systematic Analysis of Subwords and Cross-Lingual Transfer in Multilingual TranslationFindings1 citations
- A Universal Dependencies Treebank for Highland Puebla NahuatlLong1 citations
- ATLAS: A System for PDF-centric Human Interaction Data CollectionSystem Demonstrations1 citations
- Adjusting Interpretable Dimensions in Embedding Space with Human JudgmentsLong1 citations
- Analysis of State-Level Legislative Process in Enhanced Linguistic and Nationwide Network ContextsLong1 citations
- Analyzing the Use of Metaphors in News Editorials for Political FramingLong1 citations
- BeLeaf: Belief Prediction as Tree GenerationSystem Demonstrations1 citations
- Beyond Borders: Investigating Cross-Jurisdiction Transfer in Legal Case SummarizationLong1 citations
- Bilateral Masking with prompt for Knowledge Graph CompletionFindings1 citations
- CARE: Extracting Experimental Findings From Clinical LiteratureFindings1 citations
- CERET: Cost-Effective Extrinsic Refinement for Text GenerationLong1 citations
- Causal Inference for Human-Language Model CollaborationLong1 citations
- CoUDA: Coherence Evaluation via Unified Data AugmentationLong1 citations
- Concept Over Time Analysis: Unveiling Temporal Patterns for Qualitative Data AnalysisSystem Demonstrations1 citations
- Contrastive Learning as a Polarizer: Mitigating Gender Bias by Fair and Biased sentencesFindings1 citations
- Create! Don’t Repeat: A Paradigm Shift in Multi-Label Augmentation through Label Creative GenerationLong1 citations
- Cross-Lingual Summarization with Pseudo-Label RegularizationFindings1 citations
- Curated Datasets and Neural Models for Machine Translation of Informal Registers between Mayan and Spanish VernacularsLong1 citations
- Curriculum Masking in Vision-Language Pretraining to Maximize Cross Modal InteractionLong1 citations
- DEMO: A Statistical Perspective for Efficient Image-Text MatchingLong1 citations
- Dial-MAE: ConTextual Masked Auto-Encoder for Retrieval-based Dialogue SystemsLong1 citations
- Don’t be a Fool: Pooling Strategies in Offensive Language Detection from User-Intended Adversarial AttacksFindings1 citations
- DriftWatch: A Tool that Automatically Detects Data Drift and Extracts Representative Examples Affected by DriftIndustry1 citations
- DynaMo: Accelerating Language Model Inference with Dynamic Multi-Token SamplingLong1 citations
- EdTec-QBuilder: A Semantic Retrieval Tool for Assembling Vocational Training Exams in German LanguageSystem Demonstrations1 citations
- Enhancing Perception: Refining Explanations of News Claims with LLM ConversationsFindings1 citations
- Evaluating Step-by-Step Reasoning through Symbolic VerificationFindings1 citations
- Extractive Summarization with Text GeneratorLong1 citations
- Extremely Weakly-supervised Text Classification with Wordsets Mining and Sync-DenoisingLong1 citations
- Extremely efficient online query encoding for dense retrievalFindings1 citations
- FIRE: A Dataset for Financial Relation ExtractionFindings1 citations
- FastFit: Fast and Effective Few-Shot Text Classification with a Multitude of ClassesSystem Demonstrations1 citations
- Few-TK: A Dataset for Few-shot Scientific Typed Keyphrase RecognitionFindings1 citations
- Fighting crime with Transformers: Empirical analysis of address parsing methods in payment dataIndustry1 citations
- Hypernetwork-Assisted Parameter-Efficient Fine-Tuning with Meta-Knowledge Distillation for Domain Knowledge DisentanglementFindings1 citations
- Identifying Self-Disclosures of Use, Misuse and Addiction in Community-based Social Media PostsFindings1 citations
- Impossible Distillation for Paraphrasing and Summarization: How to Make High-quality Lemonade out of Small, Low-quality ModelLong1 citations
- Improving Factual Accuracy of Neural Table-to-Text Output by Addressing Input Problems in ToTToLong1 citations
- Interplay of Machine Translation, Diacritics, and DiacritizationLong1 citations
- Interpreting Answers to Yes-No Questions in Dialogues from Multiple DomainsFindings1 citations
- Interpreting User Requests in the Context of Natural Language Standing InstructionsFindings1 citations
- Isometric Neural Machine Translation using Phoneme Count Ratio Reward-based Reinforcement LearningFindings1 citations
- LatticeGen: Hiding Generated Text in a Lattice for Privacy-Aware Large Language Model Generation on CloudFindings1 citations
- Learning Cross-Architecture Instruction Embeddings for Binary Code Analysis in Low-Resource ArchitecturesFindings1 citations
- LegalDiscourse: Interpreting When Laws Apply and To WhomLong1 citations
- Leitner-Guided Memory Replay for Cross-lingual Continual LearningLong1 citations
- Lifelong Event Detection with Embedding Space Separation and CompactionShort1 citations
- MOSAICo: a Multilingual Open-text Semantically Annotated Interlinked CorpusLong1 citations
- MT-PATCHER: Selective and Extendable Knowledge Distillation from Large Language Models for Machine TranslationLong1 citations
- Methods, Applications, and Directions of Learning-to-Rank in NLP ResearchFindings1 citations
- MisgenderMender: A Community-Informed Approach to Interventions for MisgenderingLong1 citations
- Multi-Granularity Guided Fusion-in-DecoderFindings1 citations
- Multilingual Nonce Dependency Treebanks: Understanding how Language Models Represent and Process Syntactic StructureLong1 citations
- My Heart Skipped a Beat! Recognizing Expressions of Embodied Emotion in Natural LanguageLong1 citations
- Newspaper Signaling for Crisis PredictionSystem Demonstrations1 citations
- Noisy Multi-Label Text Classification via Instance-Label Pair CorrectionFindings1 citations
- Non-contrastive sentence representations via self-supervisionFindings1 citations
- Order-Based Pre-training Strategies for Procedural Text UnderstandingShort1 citations
- PELMS: Pre-training for Effective Low-Shot Multi-Document SummarizationLong1 citations
- Pedagogically Aligned Objectives Create Reliable Automatic Cloze TestsLong1 citations
- Prompt Tuned Embedding Classification for Industry Sector AllocationIndustry1 citations
- PromptFix: Few-shot Backdoor Removal via Adversarial Prompt TuningLong1 citations
- R-Spin: Efficient Speaker and Noise-invariant Representation Learning with Acoustic PiecesLong1 citations
- READ: Improving Relation Extraction from an ADversarial PerspectiveFindings1 citations
- REMATCH: Robust and Efficient Matching of Local Knowledge Graphs to Improve Structural and Semantic SimilarityFindings1 citations
- Re-evaluating the Need for Visual Signals in Unsupervised Grammar InductionFindings1 citations
- Rectifying Demonstration Shortcut in In-Context LearningLong1 citations
- Retrieving Examples from Memory for Retrieval Augmented Neural Machine Translation: A Systematic ComparisonFindings1 citations
- Returning to the Start: Generating Narratives with Related EndpointsShort1 citations
- Scaling Up Authorship AttributionIndustry1 citations
- Secure Your Model: An Effective Key Prompt Protection Mechanism for Large Language ModelsFindings1 citations
- Self-Demos: Eliciting Out-of-Demonstration Generalizability in Large Language ModelsFindings1 citations
- Self-Regulated Data-Free Knowledge Amalgamation for Text ClassificationIndustry1 citations
- Separation and Fusion: A Novel Multiple Token Linking Model for Event Argument ExtractionLong1 citations
- Sequential Compositional Generalization in Multimodal ModelsLong1 citations
- Simple and effective data augmentation for compositional generalizationLong1 citations
- Subword Attention and Post-Processing for Rare and Unknown Contextualized EmbeddingsFindings1 citations
- Tailoring Vaccine Messaging with Common-Ground OpinionsFindings1 citations
- Take One Step at a Time to Know Incremental Utility of Demonstration: An Analysis on Reranking for Few-Shot In-Context LearningLong1 citations
- Teaching a Multilingual Large Language Model to Understand Multilingual Speech via Multi-Instructional TrainingFindings1 citations
- The Impact of Language on Arithmetic Proficiency: A Multilingual Investigation with Cross-Agent Checking ComputationShort1 citations
- The Unreasonable Effectiveness of Random Target Embeddings for Continuous-Output Neural Machine TranslationShort1 citations
- Think Before You Act: A Two-Stage Framework for Mitigating Gender Bias Towards Vision-Language TasksLong1 citations
- Toward Interactive Regional Understanding in Vision-Large Language ModelsLong1 citations
- Towards Better Generalization in Open-Domain Question Answering by Mitigating Context MemorizationFindings1 citations
- UNO-DST: Leveraging Unlabelled Data in Zero-Shot Dialogue State TrackingFindings1 citations
- UniArk: Improving Generalisation and Consistency for Factual Knowledge Extraction through DebiasingLong1 citations
- Unveiling Divergent Inductive Biases of LLMs on Temporal DataShort1 citations
- Verifying Claims About Metaphors with Large-Scale Automatic Metaphor IdentificationShort1 citations
- VertAttack: Taking Advantage of Text Classifiers’ Horizontal VisionLong1 citations
- ViGLUE: A Vietnamese General Language Understanding Benchmark and Analysis of Vietnamese Language ModelsFindings1 citations
- Visual Enhanced Entity-Level Interaction Network for Multimodal SummarizationFindings1 citations
- What Causes the Failure of Explicit to Implicit Discourse Relation Recognition?Long1 citations
- Where are you from? Geolocating Speech and Applications to Language IdentificationLong1 citations
- Which One? Leveraging Context Between Objects and Multiple Views for Language GroundingLong1 citations
- XNLIeu: a dataset for cross-lingual NLI in BasqueLong1 citations
- ZSEE: A Dataset based on Zeolite Synthesis Event Extraction for Automated Synthesis PlatformFindings1 citations
- Zero-Shot vs. Translation-Based Cross-Lingual Transfer: The Case of Lexical GapsShort1 citations
- Zero-shot Generative Linguistic SteganographyLong1 citations
- ZhuJiu-Knowledge: A Fairer Platform for Evaluating Multiple Knowledge Types in Large Language ModelsSystem Demonstrations1 citations
- A Rationale-centric Counterfactual Data Augmentation Method for Cross-Document Event Coreference ResolutionLong
- A Study on Scaling Up Multilingual News Framing AnalysisFindings
- A Zero-Shot Monolingual Dual Stage Information Retrieval System for Spanish Biomedical Systematic Literature ReviewsLong
- Accurate Knowledge Distillation via n-best RerankingLong
- AdaPT: A Set of Guidelines for Hyperbolic Multimodal Multilingual NLPFindings
- Adversarial DPO: Harnessing Harmful Data for Reducing Toxicity with Minimal Impact on Coherence and Evasiveness in Dialogue AgentsFindings
- An NLP-Focused Pilot Training Agent for Safe and Efficient Aviation CommunicationIndustry
- Applications of BERT Models Towards Automation of Clinical Coding in IcelandicFindings
- Automating the Generation of a Functional Semantic Types Ontology with Foundational ModelsIndustry
- Beta-LR: Interpretable Logical Reasoning based on Beta DistributionFindings
- Beyond Read-Only: Crafting a Comprehensive Chinese Text-to-SQL Dataset for Database Manipulation and QueryFindings
- Characterizing Human and Zero-Shot GPT-3.5 Object-Similarity JudgmentsFindings
- Clear Up Confusion: Advancing Cross-Domain Few-Shot Relation Extraction through Relation-Aware Prompt LearningShort
- Content-Specific Humorous Image Captioning Using Incongruity Resolution Chain-of-ThoughtFindings
- Contrastive Preference Learning for Neural Machine TranslationFindings
- Contrastive and Consistency Learning for Neural Noisy-Channel Model in Spoken Language UnderstandingLong
- DLM: A Decoupled Learning Model for Long-tailed Polyphone Disambiguation in MandarinLong
- Discovering Lobby-Parliamentarian Alignments through NLPLong
- Discovering and Mitigating Indirect Bias in Attention-Based Model ExplanationsFindings
- DuRE: Dual Contrastive Self Training for Semi-Supervised Relation ExtractionLong
- EDC: Effective and Efficient Dialog Comprehension For Dialog State TrackingLong
- EcoSpeak: Cost-Efficient Bias Mitigation for Partially Cross-Lingual Speaker VerificationFindings
- Efficient Dependency Tree Sampling Without ReplacementFindings
- Efficient Sample-Specific Encoder PerturbationsShort
- Explanation Extraction from Hierarchical Classification Frameworks for Long Legal DocumentsFindings
- Exploring the Factual Consistency in Dialogue Comprehension of Large Language ModelsLong
- Extending Input Contexts of Language Models through Training on Segmented SequencesFindings
- FPT: Feature Prompt Tuning for Few-shot Readability AssessmentLong
- Graph Integrated Language Transformers for Next Action Prediction in Complex Phone CallsIndustry
- Group Fairness in Multilingual Speech Recognition ModelsFindings
- How does Multi-Task Training Affect Transformer In-Context Capabilities? Investigations with Function ClassesShort
- IPED: An Implicit Perspective for Relational Triple Extraction based on Diffusion ModelLong
- Improving Absent Keyphrase Generation with Diversity HeadsFindings
- Improving Factuality in Clinical Abstractive Multi-Document Summarization by Guided Continued Pre-trainingShort
- IruMozhi: Automatically classifying diglossia in TamilFindings
- LEEETs-Dial: Linguistic Entrainment in End-to-End Task-oriented Dialogue systemsFindings
- Language Model Based Unsupervised Dependency Parsing with Conditional Mutual Information and Grammatical ConstraintsLong
- Language-Independent Representations Improve Zero-Shot SummarizationShort
- Large Language Models Encode the Practice of MedicineIndustry
- Learning Mutually Informed Representations for Characters and SubwordsFindings
- Leveraging Customer Feedback for Multi-modal Insight ExtractionIndustry
- Leveraging Interesting Facts to Enhance User Engagement with Conversational InterfacesIndustry
- Leveraging Natural Language Processing and Large Language Models for Assisting Due Diligence in the Legal DomainIndustry
- Leveraging the Structure of Pre-trained Embeddings to Minimize Annotation EffortLong
- MCAD: Multi-teacher Cross-modal Alignment Distillation for efficient image-text retrievalFindings
- MCECR: A Novel Dataset for Multilingual Cross-Document Event Coreference ResolutionFindings
- MEMORY-VQ: Compression for Tractable Internet-Scale MemoryShort
- Mapping Long-term Causalities in Psychiatric Symptomatology and Life Events from Social MediaLong
- Matching Varying-Length Texts via Topic-Informed and Decoupled Sentence EmbeddingsFindings
- Measuring Entrainment in Spontaneous Code-switched SpeechLong
- Mitigating Language-Level Performance Disparity in mPLMs via Teacher Language Selection and Cross-lingual Self-DistillationLong
- Modularized Multilingual NMT with Fine-grained InterlinguaLong
- Multi-Scale Prompt Memory-Augmented Model for Black-Box ScenariosLong
- Multilingual Models for ASR in Chibchan LanguagesLong
- Multimodal Contextual Dialogue Breakdown Detection for Conversational AI ModelsIndustry
- Natural Language-based State Representation in Deep Reinforcement LearningFindings
- No Context Needed: Contextual Quandary In Idiomatic Reasoning With Pre-Trained Language ModelsLong
- Not All Metrics Are Guilty: Improving NLG Evaluation by Diversifying ReferencesLong
- On Narrative Question Answering SkillsShort
- On Retrieval Augmentation and the Limitations of Language Model TrainingShort
- On the Effectiveness of Adversarial Robustness for Abuse Mitigation with CounterspeechLong
- Plug-in Language Model: Controlling Text Generation with a Simple Regression ModelFindings
- Principles from Clinical Research for NLP Model GeneralizationLong
- Prompting Vision-Language Models For Aspect-Controlled Generation of Referring ExpressionsFindings
- Quantum-inspired Language Model with Lindblad Master Equation and Interference Measurement for Sentiment AnalysisLong
- R-BASS : Relevance-aided Block-wise Adaptation for Speech SummarizationFindings
- RTSUM: Relation Triple-based Interpretable Summarization with Multi-level Salience VisualizationSystem Demonstrations
- Read between the lines - Functionality Extraction From READMEsFindings
- SELF-EXPERTISE: Knowledge-based Instruction Dataset Augmentation for a Legal Expert Language ModelFindings
- ScriptMix: Mixing Scripts for Low-resource Language ParsingLong
- Search Query Refinement for Japanese Named Entity Recognition in E-commerce DomainIndustry
- Self-Regulated Sample Diversity in Large Language ModelsFindings
- Semantically-Prompted Language Models Improve Visual DescriptionsFindings
- Separately Parameterizing Singleton Detection Improves End-to-end Neural Coreference ResolutionShort
- Structured Pruning for Large Language Models Using Coupled Components Elimination and Minor Fine-tuningFindings
- Synonym relations affect object detection learned on vision-language dataFindings
- T3M: Text Guided 3D Human Motion Synthesis from SpeechFindings
- TagDebias: Entity and Concept Tagging for Social Bias Mitigation in Pretrained Language ModelsFindings
- The Effect of Data Partitioning Strategy on Model Generalizability: A Case Study of Morphological SegmentationLong
- Towards Translating Objective Product Attributes Into Customer LanguageIndustry
- Tree-of-Question: Structured Retrieval Framework for Korean Question Answering SystemsIndustry
- UEGP: Unified Expert-Guided Pre-training for Knowledge RekindleFindings
- Unlocking Structure Measuring: Introducing PDD, an Automatic Metric for Positional Discourse CoherenceShort
- VOLTA: Improving Generative Diversity by Variational Mutual Information Maximizing AutoencoderFindings
- XferBench: a Data-Driven Benchmark for Emergent LanguageLong
- “Tell me who you are and I tell you how you argue”: Predicting Stances and Arguments for Stakeholder GroupsFindings
NAACL accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.