EMNLP 2024 Accepted Papers
The full list of 2,379 papers accepted at EMNLP 2024 (Conference on Empirical Methods in Natural Language Processing). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Main: 1,234finding: 976Industry: 119System Demonstrations: 50
- Fast Forwarding Low-Rank TrainingMain
- Fast Streaming Transducer ASR Prototyping via Knowledge Distillation with Whisperfinding
- FastAdaSP: Multitask-Adapted Efficient Inference for Large Speech Language ModelIndustry
- Fill In The Gaps: Model Calibration and Generalization with Synthetic DataMain
- Finding the Optimal Byte-Pair Encoding Merge Operations for Neural Machine Translation in a Low-Resource Settingfinding
- Fine-Grained Detection of Solidarity for Women and Migrants in 155 Years of German Parliamentary DebatesMain
- First Heuristic Then Rational: Dynamic Use of Heuristics in Language Model ReasoningMain
- Free your mouse! Command Large Language Models to Generate Code to Format Word DocumentsMain
- From Bottom to Top: Extending the Potential of Parameter Efficient Fine-TuningMain
- From Pixels to Personas: Investigating and Modeling Self-Anthropomorphism in Human-Robot Dialoguesfinding
- Functionality learning through specification instructionsfinding
- GDPO: Learning to Directly Align Language Models with Diversity Using GFlowNetsMain
- GDTB: Genre Diverse Data for English Shallow Discourse Parsing across Modalities, Text Types, and DomainsMain
- GENRA: Enhancing Zero-shot Retrieval with Rank AggregationMain
- GOME: Grounding-based Metaphor Binding With Conceptual Elaboration For Figurative Language IllustrationMain
- GPT vs RETRO: Exploring the Intersection of Retrieval and Parameter-Efficient Fine-TuningMain
- GRIZAL: Generative Prior-guided Zero-Shot Temporal Action LocalizationMain
- Gazelle: An Instruction Dataset for Arabic Writing Assistancefinding
- Gender Identity in Pretrained Language Models: An Inclusive Approach to Data Creation and Probingfinding
- General Collaborative Framework between Large Language Model and Experts for Universal Information Extractionfinding
- Generating Demonstrations for In-Context Compositional Generalization in Grounded Language LearningMain
- Generating Vehicular Icon Descriptions and Indications Using Large Vision-Language ModelsIndustry
- Generation with Dynamic VocabularyMain
- Generative Deduplication For Socia Media Data Selectionfinding
- Generative Dictionary: Improving Language Learner Understanding with Contextual DefinitionsSystem Demonstrations
- Generative Models for Automatic Medical Decision Rule Extraction from TextMain
- GeoIndia: A Seq2Seq Geocoding Approach for Indian AddressesIndustry
- Getting The Most Out of Your Training Data: Exploring Unsupervised Tasks for Morphological InflectionMain
- Giving Control Back to Models: Enabling Offensive Language Detection Models to Autonomously Identify and Mitigate Biasesfinding
- GlossLM: A Massively Multilingual Corpus and Pretrained Model for Interlinear Glossed TextMain
- Gold Panning in Vocabulary: An Adaptive Method for Vocabulary Expansion of Domain-Specific LLMsMain
- Gradient Localization Improves Lifelong Pretraining of Language Modelsfinding
- Granular Entity Mapper: Advancing Fine-grained Multimodal Named Entity Recognition and Groundingfinding
- Graph-tree Fusion Model with Bidirectional Information Propagation for Long Document Classificationfinding
- GraphQL Query Generation: A Large Training and Benchmarking DatasetIndustry
- GuardEmb: Dynamic Watermark for Safeguarding Large Language Model Embedding Service Against Model Stealing Attackfinding
- H-LegalKI: A Hierarchical Legal Knowledge Integration Framework for Legal Community Question Answeringfinding
- HSDreport: Heart Sound Diagnosis with Echocardiography Reportsfinding
- Hateful Word in Context ClassificationMain
- HealthAlignSumm : Utilizing Alignment for Multimodal Summarization of Code-Mixed Healthcare Dialoguesfinding
- Hit the Nail on the Head: Parameter-Efficient Multi-task Tuning via Human Language Interventionfinding
- Hop, skip, jump to Convergence: Dynamics of Learning Rate Transitions for Improved Training of Large Language Modelsfinding
- How Entangled is Factuality and Deception in German?finding
- How to Train Your Fact Verifier: Knowledge Transfer with Multimodal Open Modelsfinding
- HumVI: A Multilingual Dataset for Detecting Violent Incidents Impacting Humanitarian Aidfinding
- Hyper-QKSG: Framework for Automating Query Generation and Knowledge-Snippet Extraction from Tables and ListsIndustry
- ICL: Iterative Continual Learning for Multi-domain Neural Machine Translationfinding
- IM-BERT: Enhancing Robustness of BERT through the Implicit Euler MethodMain
- ITER: Iterative Transformer-based Entity Recognition and Relation Extractionfinding
- Identifying Factual Inconsistencies in Summaries: Grounding LLM Inference via Task Taxonomyfinding
- Identifying High Consideration E-Commerce Search QueriesIndustry
- Images Speak Louder than Words: Understanding and Mitigating Bias in Vision-Language Model from a Causal Mediation PerspectiveMain
- Impeding LLM-assisted Cheating in Introductory Programming Assignments via Adversarial PerturbationMain
- Improving Argument Effectiveness Across Ideologies using Instruction-tuned Large Language Modelsfinding
- Improving Few-Shot Cross-Domain Named Entity Recognition by Instruction Tuning a Word-Embedding based Retrieval Augmented Large Language ModelIndustry
- Improving Hierarchical Text Clustering with LLM-guided Multi-view Cluster RepresentationIndustry
- Improving Multi-party Dialogue Generation via Topic and Rhetorical CoherenceMain
- Improving Quotation Attribution with Fictional Character Embeddingsfinding
- In Search of the Long-Tail: Systematic Generation of Long-Tail Inferential Knowledge via Logical Rule Guided SearchMain
- Incomplete Utterance Rewriting with Editing Operation Guidance and Utterance AugmentationMain
- IndoCL: Benchmarking Indonesian Language Development Assessmentfinding
- Induct-Learn: Short Phrase Prompting with Instruction InductionMain
- Inference Helps PLMs’ Conceptual Understanding: Improving the Abstract Inference Ability with Hierarchical Conceptual Entailment GraphsMain
- Inference and Verbalization Functions During In-Context Learningfinding
- InsertGNN: A Hierarchical Graph Neural Network for the TOEFL Sentence Insertion Problemfinding
- Instance-Level Dynamic LoRAs Composition for Cross-Task Generalizationfinding
- Instruct, Not Assist: LLM-based Multi-Turn Planning and Hierarchical Questioning for Socratic Code Debuggingfinding
- Instruction-Driven Game Engine: A Poker Case StudySystem Demonstrations
- Integrating Argumentation and Hate-Speech-based Techniques for Countering MisinformationMain
- Integrating INCEpTION into larger annotation processesSystem Demonstrations
- Integrating Plutchik’s Theory with Mixture of Experts for Enhancing Emotion ClassificationMain
- Interpretable Composition Attribution Enhancement for Visio-linguistic Compositional UnderstandingMain
- Introducing Compiler Semantics into Large Language Models as Programming Language Translators: A Case Study of C to x86 Assemblyfinding
- Investigating Large Language Models for Complex Word Identification in Multilingual and Multidomain SetupsMain
- Irrelevant Alternatives Bias Large Language Model Hiring Decisionsfinding
- I’m sure you’re a real scholar yourself: Exploring Ironic Content Generation by Large Language Modelsfinding
- LINKAGE: Listwise Ranking among Varied-Quality References for Non-Factoid QA Evaluation via LLMsfinding
- LINKED: Eliciting, Filtering and Integrating Knowledge in Large Language Model for Commonsense Reasoningfinding
- LLM as a metric critic for low resource relation identificationfinding
- LLM-Based Offline Learning for Embodied Agents via Consistency-Guided Reward Ensemblefinding
- LLMs Cannot (Yet) Match the Specificity and Simplicity of Online Communities in Long Form Question Answeringfinding
- LONGAGENT: Achieving Question Answering for 128k-Token-Long Documents through Multi-Agent CollaborationMain
- LaRA: Large Rank Adaptation for Speech and Text Cross-Modal Learning in Large Language Modelsfinding
- Language is Scary when Over-Analyzed: Unpacking Implied Misogynistic Reasoning with Argumentation Theory-Driven PromptsMain
- Language models and brains align due to more than next-word prediction and word-level informationMain
- Language, OCR, Form Independent (LOFI) pipeline for Industrial Document Information ExtractionIndustry
- Language-to-Code Translation with a Single Labeled ExampleMain
- Large Language Models Are Poor Clinical Decision-Makers: A Comprehensive BenchmarkMain
- Large Language Models are Limited in Out-of-Context Knowledge Reasoningfinding
- Learning Dynamic Multi-attribute Interest for Personalized Product Searchfinding
- Learning Semantic Structure through First-Order-Logic Translationfinding
- Learning from Imperfect Data: Towards Efficient Knowledge Distillation of Autoregressive Language Models for Text-to-SQLfinding
- Learning from Implicit User Feedback, Emotions and Demographic Information in Task-Oriented and Document-Grounded Dialoguesfinding
- Learning from Mistakes: Iterative Prompt Relabeling for Text-to-Image Diffusion Model Trainingfinding
- Learning from Relevant Subgoals in Successful Dialogs using Iterative Training for Task-oriented Dialog Systemsfinding
- Learning to Ask Denotative and Connotative Questions for Knowledge-based VQAfinding
- Learning to Generate Rules for Realistic Few-Shot Relation Classification: An Encoder-Decoder Approachfinding
- Learning to Match Representations is Better for End-to-End Task-Oriented Dialog Systemfinding
- Learning to Plan by Updating Natural Languagefinding
- Learning to Rank Salient Content for Query-focused SummarizationMain
- Learning to Write Rationally: How Information Is Distributed in Non-native Speakers’ EssaysMain
- Leveraging BERT and TFIDF Features for Short Text Clustering via Alignment-Promoting Co-TrainingMain
- Leveraging Conflicts in Social Media Posts: Unintended Offense DatasetMain
- Leveraging Grammar Induction for Language Understanding and Generationfinding
- Linear Layer Extrapolation for Fine-Grained Emotion ClassificationMain
- Llama SLayer 8B: Shallow Layers Hold the Key to Knowledge Injectionfinding
- LoRAExit: Empowering Dynamic Modulation of LLMs in Resource-limited Settings using Low-rank Adaptersfinding
- LoRAN: Improved Low-Rank Adaptation by a Non-Linear Transformationfinding
- Local and Global Decoding in Text Generationfinding
- LogicST: A Logical Self-Training Framework for Document-Level Relation Extraction with Incomplete AnnotationsMain
- Logits Reranking via Semantic Labels for Hard Samples in Text Classificationfinding
- Look Who’s Talking Now: Covert Channels From Biased LLMsfinding
- M3D: MultiModal MultiDocument Fine-Grained Inconsistency DetectionMain
- M3SciQA: A Multi-Modal Multi-Document Scientific QA Benchmark for Evaluating Foundation Modelsfinding
- MAR: Matching-Augmented Reasoning for Enhancing Visual-based Entity Question AnsweringMain
- MEANT: Multimodal Encoder for Antecedent InformationMain
- MGCL: Multi-Granularity Clue Learning for Emotion-Cause Pair Extraction via Cross-Grained Knowledge Distillationfinding
- MILD Bot: Multidisciplinary Childhood Cancer Survivor Question-Answering BotIndustry
- MIMIR: A Customizable Agent Tuning Platform for Enhanced Scientific ApplicationsSystem Demonstrations
- MM-ChatAlign: A Novel Multimodal Reasoning Framework based on Large Language Models for Entity Alignmentfinding
- MMAR: Multilingual and Multimodal Anaphora Resolution in Instructional Videosfinding
- MMoE: Enhancing Multimodal Models with Mixtures of Multimodal Interaction ExpertsMain
- MOSEL: 950,000 Hours of Speech Data for Open-Source Speech Foundation Model Training on EU LanguagesMain
- MP-RNA: Unleashing Multi-species RNA Foundation Model via Calibrated Secondary Structure Predictionfinding
- MP2D: An Automated Topic Shift Dialogue Generation Framework Leveraging Knowledge GraphsMain
- MQuinE: a Cure for “Z-paradox” in Knowledge Graph EmbeddingMain
- MVP-Bench: Can Large Vision-Language Models Conduct Multi-level Visual Perception Like Humans?finding
- Making Large Language Models Better Reasoners with Orchestrated Streaming ExperiencesMain
- MedINST: Meta Dataset of Biomedical Instructionsfinding
- MedLogic-AQA: Enhancing Medicare Question Answering with Abstractive Models Focusing on Logical Structuresfinding
- MediTOD: An English Dialogue Dataset for Medical History Taking with Comprehensive AnnotationsMain
- Medico: Towards Hallucination Detection and Correction with Multi-source Evidence FusionSystem Demonstrations
- Memory-Efficient Fine-Tuning of Transformers via Token SelectionMain
- Mental Disorder Classification via Temporal Representation of Textfinding
- Mentor-KD: Making Small Language Models Better Multi-step ReasonersMain
- Merely Judging Metaphor is Not Enough: Research on Reasonable Metaphor Detectionfinding
- MetaKP: On-Demand Keyphrase Generationfinding
- Methods of Automatic Matrix Language Determination for Code-Switched SpeechMain
- MiTTenS: A Dataset for Evaluating Gender MistranslationMain
- Misinformation with Legal Consequences (MisLC): A New Task Towards Harnessing Societal Harm of Misinformationfinding
- Mitigating Matthew Effect: Multi-Hypergraph Boosted Multi-Interest Self-Supervised Learning for Conversational RecommendationMain
- Mixed-Session Conversation with Egocentric Memoryfinding
- MoCoKGC: Momentum Contrast Entity Encoding for Knowledge Graph CompletionMain
- Model Internals-based Answer Attribution for Trustworthy Retrieval-Augmented GenerationMain
- Model-based Preference Optimization in Abstractive Summarization without Human FeedbackMain
- Moleco: Molecular Contrastive Learning with Chemical Language Models for Molecular Property PredictionIndustry
- More Bang for your Context: Virtual Documents for Question Answering over Long Documentsfinding
- More Insightful Feedback for Tutoring: Enhancing Generation Mechanisms and Automatic EvaluationMain
- Multi-Level Cross-Modal Alignment for Speech Relation ExtractionMain
- Multi-pass Decoding for Grammatical Error CorrectionMain
- MultiVerse: Efficient and Expressive Zero-Shot Multi-Task Text-to-Speechfinding
- Multilingual Contrastive Decoding via Language-Agnostic Layers Skippingfinding
- Multilingual Fine-Grained News Headline Hallucination Detectionfinding
- Multilingual Synopses of Movie Narratives: A Dataset for Vision-Language Story Understandingfinding
- Multilingual Topic Classification in X: Dataset and AnalysisMain
- Multimodal Clickbait Detection by De-confounding Biases Using Causal Representation InferenceMain
- NCPrompt: NSP-Based Prompt Learning and Contrastive Learning for Implicit Discourse Relation Recognitionfinding
- Natural Evolution-based Dual-Level Aggregation for Temporal Knowledge Graph Reasoningfinding
- Navigating Noisy Feedback: Enhancing Reinforcement Learning with Error-Prone Language Modelsfinding
- Navigating the Nuances: A Fine-grained Evaluation of Vision-Language Navigationfinding
- Neural Search Space in Gboard DecoderIndustry
- NeuroTrialNER: An Annotated Corpus for Neurological Diseases and Therapies in Clinical Trial RegistriesMain
- News Risk Alerting System (NRAS): A Data-Driven LLM Approach to Proactive Credit Risk MonitoringIndustry
- OEE-CFC: A Dataset for Open Event Extraction from Chinese Financial Commentaryfinding
- OMG-QA: Building Open-Domain Multi-Modal Generative Question Answering SystemsIndustry
- Oddballs and Misfits: Detecting Implicit Abuse in Which Identity Groups are Depicted as Deviating from the NormMain
- On Creating an English-Thai Code-switched Machine Translation in Medical Domainfinding
- On Eliciting Syntax from Language Models via HashingMain
- On Mitigating Performance Disparities in Multilingual Speech RecognitionMain
- On the In-context Generation of Language ModelsMain
- On the Influence of Gender and Race in Romantic Relationship Prediction from Large Language ModelsMain
- One-to-Many Communication and Compositionality in Emergent CommunicationMain
- One2Set + Large Language Model: Best Partners for Keyphrase GenerationMain
- OneNet: A Fine-Tuning Free Framework for Few-Shot Entity Linking via Large Language Model PromptingMain
- Optimizing Chinese Lexical Simplification Across Word Types: A Hybrid ApproachMain
- Optimizing Entity Resolution in Voice Interfaces: An ASR-Aware Entity Reference Expansion ApproachIndustry
- Optimizing Instruction Synthesis: Effective Exploration of Evolutionary Space with Tree Searchfinding
- Overcome Noise and Bias: Segmentation-Aided Multi-Granularity Denoising and Debiasing for Enhanced Quarduples Extraction in DialogueMain
- PARA: Parameter-Efficient Fine-tuning with Prompt-Aware Representation AdjustmentIndustry
- PE: A Poincare Explanation Method for Fast Text Hierarchy Generationfinding
- PEARL: Preference Extraction with Exemplar Augmentation and Retrieval with LLM AgentsIndustry
- PFA-ERC: Psuedo-Future Augmented Dynamic Emotion Recognition in Conversationsfinding
- PKAD: Pretrained Knowledge is All You Need to Detect and Mitigate Textual Backdoor Attacksfinding
- PRISM: A New Lens for Improved Color UnderstandingIndustry
- PRoDeliberation: Parallel Robust Deliberation for End-to-End Spoken Language Understandingfinding
- PSC: Extending Context Window of Large Language Models via Phase Shift CalibrationMain
- PSST: A Benchmark for Evaluation-driven Text Public-Speaking Style Transferfinding
- Pcc-tuning: Breaking the Contrastive Learning Ceiling in Semantic Textual SimilarityMain
- Personalized Video Comment Generationfinding
- PhiloGPT: A Philology-Oriented Large Language Model for Ancient Chinese Manuscripts with Dunhuang as Case StudyMain
- Phonetic and Lexical Discovery of Canine Vocalizationfinding
- Pixology: Probing the Linguistic and Visual Capabilities of Pixel-based Language ModelsMain
- PizzaCommonSense: A Dataset for Commonsense Reasoning about Intermediate Steps in Cooking Recipesfinding
- Platform-Invariant Topic Modeling via Contrastive Learning to Mitigate Platform-Induced Biasfinding
- Plot Twist: Multimodal Models Don’t Comprehend Simple Chart Detailsfinding
- Pre-trained Language Models Return Distinguishable Probability Distributions to Unfaithfully Hallucinated Textsfinding
- Precision or Recall? An Analysis of Image Captions for Training Text-to-Image Generation Modelfinding
- Predicate Debiasing in Vision-Language Models Integration for Scene Graph Generation EnhancementMain
- Predicting Rewards Alongside Tokens: Non-disruptive Parameter Insertion for Efficient Inference Intervention in Large Language ModelMain
- Probing the Capacity of Language Model Agents to Operationalize Disparate Experiential Context Despite Distractionfinding
- Problem-Oriented Segmentation and Retrieval: Case Study on Tutoring Conversationsfinding
- Prompt-Tuned Muti-Task Taxonomic Transformer (PTMTTaxoFormer)Industry
- Prove Your Point!: Bringing Proof-Enhancement Principles to Argumentative Essay GenerationMain
- Provenance: A Light-weight Fact-checker for Retrieval Augmented LLM Generation OutputIndustry
- Pruning Multilingual Large Language Models for Multilingual Inferencefinding
- Pruning via Merging: Compressing LLMs via Manifold Alignment Based Layer MergingMain
- PsFuture: A Pseudo-Future-based Zero-Shot Adaptive Policy for Simultaneous Machine TranslationMain
- Pseudo-Label Enhanced Prototypical Contrastive Learning for Uniformed Intent Discoveryfinding
- PyramidCodec: Hierarchical Codec for Long-form Music Generation in Audio Domainfinding
- QRMeM: Unleash the Length Limitation through Question then Reflection Memory Mechanismfinding
- QUIS: Question-guided Insights Generation for Automated Exploratory Data AnalysisIndustry
- QUITE: Quantifying Uncertainty in Natural Language Text in Bayesian Reasoning ScenariosMain
- Query-based Cross-Modal Projector Bolstering Mamba Multimodal LLMfinding
- RA2FD: Distilling Faithfulness into Efficient Dialogue SystemsMain
- RAC: Retrieval-augmented Conversation Dataset for Open-domain Question Answering in Conversational SettingsIndustry
- RAG4ITOps: A Supervised Fine-Tunable and Comprehensive RAG Framework for IT Operations and MaintenanceIndustry
- RAGViz: Diagnose and Visualize Retrieval-Augmented GenerationSystem Demonstrations
- RRADistill: Distilling LLMs’ Passage Ranking Ability for Long-Tail Queries Document Re-Ranking on a Search EngineIndustry
- Random Label Forests: An Ensemble Method with Label Subsampling For Extreme Multi-Label Problemsfinding
- Rater Cohesion and Quality from a Vicarious Perspectivefinding
- Re-Evaluating Evaluation for Multilingual SummarizationMain
- Read Anywhere Pointed: Layout-aware GUI Screen Reading with Tree-of-Lens GroundingMain
- Reap the Wild Wind: Detecting Media Storms in Large-Scale News Corporafinding
- Reasoning Paths Optimization: Learning to Reason and Explore From Diverse Pathsfinding
- Reasoning or a Semblance of it? A Diagnostic Study of Transitive Reasoning in LLMsMain
- Red Teaming Language Models for Processing Contradictory DialoguesMain
- Refining App Reviews: Dataset, Methodology, and EvaluationIndustry
- RepMatch: Quantifying Cross-Instance Similarities in Representation SpaceMain
- Representational Analysis of Binding in Language ModelsMain
- Rethinking Code Refinement: Learning to Judge Code Efficiencyfinding
- Rethinking Evaluation Methods for Machine Unlearningfinding
- Rethinking Pruning Large Language Models: Benefits and Pitfalls of Reconstruction Error MinimizationMain
- Rethinking the Evaluation of In-Context Learning for LLMsMain
- Rethinking the Role of Proxy Rewards in Language Model AlignmentMain
- Retrieval Augmented Spelling Correction for E-Commerce ApplicationsIndustry
- Retrieval-enriched zero-shot image classification in low-resource domainsMain
- Retrieving Contextual Information for Long-Form Question Answering using Weak Supervisionfinding
- RevMUX: Data Multiplexing with Reversible Adapters for Efficient LLM Batch InferenceMain
- Revealing COVID-19’s Social Dynamics: Diachronic Semantic Analysis of Vaccine and Symptom Discourse on Twitterfinding
- Reverse-Engineering the ReaderMain
- Revisiting Supertagging for faster HPSG parsingMain
- Reward Modeling Requires Automatic Adjustment Based on Data Qualityfinding
- RoCEL: Advancing Table Entity Linking through Distinctive Row and Column ContextsMain
- SALMON: A Structure-Aware Language Model with logicality and densification strategy for Temporal Knowledge Graph Reasoningfinding
- SARCAT: Generative Span-Act Guided Response Generation using Copy-enhanced Target Augmentationfinding
- SCOI: Syntax-augmented Coverage-based In-context Example Selection for Machine TranslationMain
- SRF: Enhancing Document-Level Relation Extraction with a Novel Secondary Reasoning FrameworkMain
- STOP! Benchmarking Large Language Models with Sensitivity Testing on Offensive ProgressionsMain
- SaSR-Net: Source-Aware Semantic Representation Network for Enhancing Audio-Visual Question Answeringfinding
- Salient Information Prompting to Steer Content in Prompt-based Abstractive SummarizationIndustry
- Sample Design Engineering: An Empirical Study on Designing Better Fine-Tuning Samples for Information Extraction with LLMsIndustry
- Satyrn: A Platform for Analytics Augmented GenerationMain
- Scalable Fine-tuning from Multiple Data Sources: A First-Order Approximation Approachfinding
- Scalable and Domain-General Abstractive Proposition Segmentationfinding
- Scaling Parameter-Constrained Language Models with Quality DataIndustry
- Schema-Guided Culture-Aware Complex Event Simulation with Multi-Agent Role-PlaySystem Demonstrations
- Search if you don’t know! Knowledge-Augmented Korean Grammatical Error Correction with Large Language Modelsfinding
- SecCoder: Towards Generalizable and Robust Secure Code GenerationMain
- Seeing Through VisualBERT: A Causal Adventure on Memetic Landscapesfinding
- Seg2Act: Global Context-aware Action Generation for Document Logical StructuringMain
- Selective Annotation via Data Allocation: These Data Should Be Triaged to Experts for Annotation Rather Than the Modelfinding
- Selective Vision is the Challenge for Visual Reasoning: A Benchmark for Visual Argument UnderstandingMain
- Self-Evolution Fine-Tuning for Policy Optimizationfinding
- Self-Powered LLM Modality Expansion for Large Speech-Text ModelsMain
- Self-Renewal Prompt Optimizing with Implicit Reasoningfinding
- Self-Training for Sample-Efficient Active Learning for Text Classification with Pre-Trained Language ModelsMain
- Self-supervised Preference Optimization: Enhance Your Language Model with Preference Degree Awarenessfinding
- Semantic Token Reweighting for Interpretable and Controllable Text Embeddings in CLIPfinding
- Semantics and Sentiment: Cross-lingual Variations in Emoji UseMain
- Shortcuts Arising from Contrast: Towards Effective and Lightweight Clean-Label Attacks in Prompt-Based LearningMain
- Show and Guide: Instructional-Plan Grounded Vision and Language ModelMain
- Sing it, Narrate it: Quality Musical Lyrics Translationfinding
- SocialGaze: Improving the Integration of Human Social Norms in Large Language Modelsfinding
- SparseGrad: A Selective Method for Efficient Fine-tuning of MLP LayersMain
- SpeechQE: Estimating the Quality of Direct Speech TranslationMain
- Stable Language Model Pre-training by Reducing Embedding VariabilityMain
- Stanceformer: Target-Aware Transformer for Stance Detectionfinding
- Stochastic Fine-Tuning of Language Models Using Masked Gradientsfinding
- Story Embeddings — Narrative-Focused Representations of Fictional StoriesMain
- Structured Object Language Modeling (SO-LM): Native Structured Objects Generation Conforming to Complex Schemas with Self-Supervised DenoisingIndustry
- Studying and Mitigating Biases in Sign Language Understanding ModelsMain
- Style-Shifting Behaviour of the Manosphere on RedditMain
- StyleRemix: Interpretable Authorship Obfuscation via Distillation and Perturbation of Style ElementsMain
- SummaCoz: A Dataset for Improving the Interpretability of Factual Consistency Detection for Summarizationfinding
- Susu Box or Piggy Bank: Assessing Cultural Commonsense Knowledge between Ghana and the USMain
- SynthEval: Hybrid Behavioral Testing of NLP Models with Synthetic CheckListsfinding
- TAIL: A Toolkit for Automatic and Realistic Long-Context Large Language Model EvaluationSystem Demonstrations
- TEMA: Token Embeddings Mapping for Enriching Low-Resource Language ModelsMain
- TOWER: Tree Organized Weighting for Evaluating Complex Instructionsfinding
- Tag-grounded Visual Instruction Tuning with Retrieval AugmentationMain
- Target-Aware Language Modeling via Granular Data SamplingMain
- Teaching Embodied Reinforcement Learning Agents: Informativeness and Diversity of Language UseMain
- TelBench: A Benchmark for Evaluating Telco-Specific Large Language ModelsIndustry
- Temperature-Centric Investigation of Speculative Decoding with Knowledge Distillationfinding
- TempoFormer: A Transformer for Temporally-aware Representations in Change DetectionMain
- Tending Towards Stability: Convergence Challenges in Small Language Modelsfinding
- Text2Chart31: Instruction Tuning for Chart Generation with Automatic FeedbackMain
- Text2Model: Text-based Model Induction for Zero-shot Image Classificationfinding
- TextLap: Customizing Language Models for Text-to-Layout Planningfinding
- The Craft of Selective Prediction: Towards Reliable Case Outcome Classification - An Empirical Study on European Court of Human Rights Casesfinding
- The Death and Life of Great Prompts: Analyzing the Evolution of LLM Prompts from the Structural PerspectiveMain
- The Empirical Variability of Narrative Perceptions of Social Media TextsMain
- The Greatest Good Benchmark: Measuring LLMs’ Alignment with Utilitarian Moral DilemmasMain
- The Mystery of Compositional Generalization in Graph-based Generative Commonsense Reasoningfinding
- The Overlooked Repetitive Lengthening Form in Sentiment Analysisfinding
- Time Matters: An End-to-End Solution for Temporal Claim VerificationIndustry
- To Know or Not To Know? Analyzing Self-Consistency of Large Language Models under Ambiguityfinding
- To Preserve or To Compress: An In-Depth Study of Connector Selection in Multimodal Large Language ModelsMain
- Toeing the Party Line: Election Manifestos as a Key to Understand Political Discourse on Twitterfinding
- Together We Can: Multilingual Automatic Post-Editing for Low-Resource Languagesfinding
- TokenVerse: Towards Unifying Speech and NLP Tasks via Transducer-based ASRMain
- Toolken+: Improving LLM Tool Usage with Reranking and a Reject Optionfinding
- Towards Aligning Language Models with Textual FeedbackMain
- Towards Benchmarking Situational Awareness of Large Language Models:Comprehensive Benchmark, Evaluation and Analysisfinding
- Towards Effective Counter-Responses: Aligning Human Preferences with Strategies to Combat Online Trollingfinding
- Towards Explainable Chinese Native Learner Essay Fluency Assessment: Dataset, Tasks, and Methodfinding
- Towards Fast Multilingual LLM Inference: Speculative Decoding and Specialized DraftersMain
- Towards Interpretable Sequence Continuation: Analyzing Shared Circuits in Large Language ModelsMain
- Towards One-to-Many Visual Question Answeringfinding
- Towards Pareto-Efficient RLHF: Paying Attention to a Few High-Reward Samples with Reward Dropoutfinding
- Towards Probing Speech-Specific Risks in Large Multimodal Models: A Taxonomy, Benchmark, and InsightsMain
- Traffic Light or Light Traffic? Investigating Phrasal Semantics in Large Language Modelsfinding
- Transfer Learning for Text Classification via Model Risk Analysisfinding
- TransferCVLM: Transferring Cross-Modal Knowledge for Vision-Language Modelingfinding
- Translation Canvas: An Explainable Interface to Pinpoint and Analyze Translation SystemsSystem Demonstrations
- Translation of Multifaceted Data without Re-Training of Machine Translation Systemsfinding
- TuringQ: Benchmarking AI Comprehension in Theory of Computationfinding
- Tutor-ICL: Guiding Large Language Models for Improved In-Context Learning Performancefinding
- UNICORN: A Unified Causal Video-Oriented Language-Modeling Framework for Temporal Video-Language TasksMain
- UOUO: Uncontextualized Uncommon Objects for Measuring Knowledge Horizons of Vision Language ModelsMain
- Ukrainian Resilience: A Dataset for Detection of Help-Seeking Signals Amidst the Chaos of Warfinding
- Understanding Faithfulness and Reasoning of Large Language Models on Plain Biomedical Summariesfinding
- Understanding Higher-Order Correlations Among Semantic Components in EmbeddingsMain
- Unlabeled Debiasing in Downstream Tasks via Class-wise Low Variance RegularizationMain
- Unleashing the Potential of Large Language Models through Spectral Modulationfinding
- Unleashing the Potentials of Likelihood Composition for Multi-modal Language Modelsfinding
- Unleashing the Power of Emojis in Texts via Self-supervised Graph Pre-TrainingMain
- Unleashing the Power of Large Language Models in Zero-shot Relation Extraction via Self-Promptingfinding
- Unlocking Markets: A Multilingual Benchmark to Cross-Market Question AnsweringMain
- Unsupervised Discrete Representations of American Sign LanguageMain
- Unsupervised Hierarchical Topic Modeling via Anchor Word Clustering and Path Guidancefinding
- Unsupervised Human Preference LearningMain
- Unsupervised Named Entity Disambiguation for Low Resource DomainsMain
- Unveiling Narrative Reasoning Limits of Large Language Models with Trope in Movie Synopsesfinding
- Unveiling and Consulting Core Experts in Retrieval-Augmented MoE-based LLMsMain
- Unveiling the Invisible: Captioning Videos with Metaphorsfinding
- Unveiling the Role of Pretraining in Direct Speech TranslationMain
- Updating Large Language Models’ Memories with Time Constraintsfinding
- Using Language Models to Disambiguate Lexical Choices in TranslationMain
- VE-KD: Vocabulary-Expansion Knowledge-Distillation for Training Smaller Domain-Specific Language Modelsfinding
- VIEWS: Entity-Aware News Video CaptioningMain
- VLEU: a Method for Automatic Evaluation for Generalizability of Text-to-Image ModelsMain
- Variational Language Concepts for Interpreting Foundation Language Modelsfinding
- Verba volant, scripta volant? Don’t worry! There are computational solutions for protoword reconstructionMain
- Video Discourse Parsing and Its Application to Multimodal Summarization: A Dataset and Baseline Approachesfinding
- Video-Text Prompting for Weakly Supervised Spatio-Temporal Video GroundingMain
- Visual Pivoting Unsupervised Multimodal Machine Translation in Low-Resource Distant Language Pairsfinding
- Visual Prompting in LLMs for Enhancing Emotion RecognitionMain
- Visual Question Decomposition on Multimodal Large Language Modelsfinding
- Voices in a Crowd: Searching for clusters of unique perspectivesMain
- Walia-LLM: Enhancing Amharic-LLaMA by Integrating Task-Specific and Generative Datasetsfinding
- Weak Reward Model Transforms Generative Models into Robust Causal Event Extraction SystemsMain
- What Would Happen Next? Predicting Consequences from An Event Causality Graphfinding
- What are the Generator Preferences for End-to-end Task-Oriented Dialog System?Main
- When Generative Adversarial Networks Meet Sequence Labeling ChallengesMain
- When and Where Did it Happen? An Encoder-Decoder Model to Identify Scenario Contextfinding
- When the Misidentified Adverbial Phrase Functions as a Complementfinding
- Who Wrote When? Author Diarization in Social Media Discussionsfinding
- Will LLMs Sink or Swim? Exploring Decision-Making Under Pressurefinding
- With Ears to See and Eyes to Hear: Sound Symbolism Experiments with Multimodal Large Language ModelsMain
- Word-Conditioned 3D American Sign Language Motion Generationfinding
- Words Worth a Thousand Pictures: Measuring and Understanding Perceptual Variability in Text-to-Image GenerationMain
- XDetox: Text Detoxification with Token-Level Toxicity ExplanationsMain
- Xinference: Making Large Model Serving EasySystem Demonstrations
- You Make me Feel like a Natural Question: Training QA Systems on Transformed Trivia QuestionsMain
- Zero-shot Cross-Lingual Transfer for Synthetic Data Generation in Grammatical Error DetectionMain
- “Vorbești Românește?” A Recipe to Train Powerful Romanian LLMs with English Instructionsfinding
- “What is the value of templates?” Rethinking Document Information Extraction Datasets for LLMsfinding
- “You Gotta be a Doctor, Lin” : An Investigation of Name-Based Bias of Large Language Models in Employment RecommendationsMain
EMNLP accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.