ACL 2024 Accepted Papers
The full list of 1,930 papers accepted at ACL 2024 (Association for Computational Linguistics). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Findings: 953Long: 863Short: 76System Demonstrations: 38
- Integrating Physician Diagnostic Logic into Large Language Models: Preference Learning from Process FeedbackFindings5 citations
- Interactive Text-to-Image Retrieval with Large Language Models: A Plug-and-Play ApproachLong5 citations
- Interpretability of Language Models via Task SpacesLong5 citations
- Just Ask One More Time! Self-Agreement Improves Reasoning of Language Models in (Almost) All ScenariosFindings5 citations
- Knowledge Context Modeling with Pre-trained Language Models for Contrastive Knowledge Graph CompletionFindings5 citations
- Label-aware Hard Negative Sampling Strategies with Momentum Contrastive Learning for Implicit Hate Speech DetectionFindings5 citations
- Language Models can Exploit Cross-Task In-context Learning for Data-Scarce Novel TasksLong5 citations
- Large Language Models are Few-Shot Training Example Generators: A Case Study in Fallacy RecognitionFindings5 citations
- Learn from Failure: Fine-tuning LLMs with Trial-and-Error Data for Intuitionistic Propositional Logic ProvingLong5 citations
- Learning Relational Decomposition of Queries for Question Answering from TablesLong5 citations
- Learning Task Decomposition to Assist Humans in Competitive ProgrammingLong5 citations
- Lost in the Source Language: How Large Language Models Evaluate the Quality of Machine TranslationFindings5 citations
- MC2: Towards Transparent and Culturally-Aware NLP for Minority Languages in ChinaLong5 citations
- MedREQAL: Examining Medical Knowledge Recall of Large Language Models via Question AnsweringFindings5 citations
- MentalManip: A Dataset For Fine-grained Analysis of Mental Manipulation in ConversationsLong5 citations
- Mitigating Reversal Curse in Large Language Models via Semantic-aware Permutation TrainingFindings5 citations
- Mixture-of-Supernets: Improving Weight-Sharing Supernet Training with Architecture-Routed Mixture-of-ExpertsFindings5 citations
- Model Composition for Multimodal Large Language ModelsLong5 citations
- MovieSum: An Abstractive Summarization Dataset for Movie ScreenplaysFindings5 citations
- NEO-BENCH: Evaluating Robustness of Large Language Models with NeologismsLong5 citations
- NaijaHate: Evaluating Hate Speech Detection on Nigerian Twitter Using Representative DataLong5 citations
- NaturalCodeBench: Examining Coding Performance Mismatch on HumanEval and Natural User QueriesFindings5 citations
- No perspective, no perception!! Perspective-aware Healthcare Answer SummarizationFindings5 citations
- NounAtlas: Filling the Gap in Nominal Semantic Role LabelingLong5 citations
- PEMT: Multi-Task Correlation Guided Mixture-of-Experts Enables Parameter-Efficient Transfer LearningFindings5 citations
- PIXAR: Auto-Regressive Language Modeling in Pixel SpaceFindings5 citations
- PLaD: Preference-based Large Language Model Distillation with Pseudo-Preference PairsFindings5 citations
- PRP-Graph: Pairwise Ranking Prompting to LLMs with Graph Aggregation for Effective Text Re-rankingLong5 citations
- PixT3: Pixel-based Table-To-Text GenerationLong5 citations
- PlatoLM: Teaching LLMs in Multi-Round Dialogue via a User SimulatorLong5 citations
- Prefix Text as a Yarn: Eliciting Non-English Alignment in Foundation Language ModelFindings5 citations
- Probing Language Models for Pre-training Data DetectionLong5 citations
- RecGPT: Generative Pre-training for Text-based RecommendationShort5 citations
- Refine, Align, and Aggregate: Multi-view Linguistic Features Enhancement for Aspect Sentiment Triplet ExtractionFindings5 citations
- Reflect-RL: Two-Player Online RL Fine-Tuning for LMsLong5 citations
- Revealing the Parametric Knowledge of Language Models: A Unified Framework for Attribution MethodsLong5 citations
- S3-DST: Structured Open-Domain Dialogue Segmentation and State Tracking in the Era of LLMsFindings5 citations
- STRUCTSUM Generation for Faster Text ComprehensionLong5 citations
- STYLE: Improving Domain Transferability of Asking Clarification Questions in Large Language Model Powered Conversational AgentsFindings5 citations
- SceMQA: A Scientific College Entrance Level Multimodal Question Answering BenchmarkShort5 citations
- Search-Adaptor: Embedding Customization for Information RetrievalLong5 citations
- Selene: Pioneering Automated Proof in Software VerificationLong5 citations
- Self-Augmented In-Context Learning for Unsupervised Word TranslationShort5 citations
- Self-Consistent Reasoning-based Aspect-Sentiment Quad Prediction with Extract-Then-Assign StrategyFindings5 citations
- Self-Modifying State Modeling for Simultaneous Machine TranslationLong5 citations
- Self-Para-Consistency: Improving Reasoning Tasks at Low Cost for Large Language ModelsFindings5 citations
- Semantic are Beacons: A Semantic Perspective for Unveiling Parameter-Efficient Fine-Tuning in Knowledge LearningFindings5 citations
- Soul-Mix: Enhancing Multimodal Machine Translation with Manifold MixupLong5 citations
- Speech-based Slot Filling using Large Language ModelsFindings5 citations
- Synergetic Event Understanding: A Collaborative Approach to Cross-Document Event Coreference Resolution with Large Language ModelsLong5 citations
- TAXI: Evaluating Categorical Knowledge Editing for Language ModelsFindings5 citations
- Talk With Human-like Agents: Empathetic Dialogue Through Perceptible Acoustic Reception and ReactionLong5 citations
- Teaching-Assistant-in-the-Loop: Improving Knowledge Distillation from Imperfect Teacher Models in Low-Budget ScenariosFindings5 citations
- Tell Me What’s Next: Textual Foresight for Generic UI RepresentationsFindings5 citations
- Temperature-scaling surprisal estimates improve fit to human reading times – but does it do so for the “right reasons”?Long5 citations
- TextGenSHAP: Scalable Post-Hoc Explanations in Text Generation with Long DocumentsFindings5 citations
- Threads of Subtlety: Detecting Machine-Generated Texts Through Discourse MotifsLong5 citations
- Through the Lens of Split Vote: Exploring Disagreement, Difficulty and Calibration in Legal Case Outcome ClassificationLong5 citations
- Towards Artwork Explanation in Large-scale Vision Language ModelsShort5 citations
- Tox-BART: Leveraging Toxicity Attributes for Explanation Generation of Implicit Hate SpeechFindings5 citations
- ToxVidLM: A Multimodal Framework for Toxicity Detection in Code-Mixed VideosFindings5 citations
- Transferable Embedding Inversion Attack: Uncovering Privacy Risks in Text Embeddings without Model QueriesLong5 citations
- Tree-of-Traversals: A Zero-Shot Reasoning Algorithm for Augmenting Black-box Language Models with Knowledge GraphsLong5 citations
- URG: A Unified Ranking and Generation Method for Ensembling Language ModelsFindings5 citations
- Uncovering Limitations of Large Language Models in Information Seeking from TablesFindings5 citations
- Unsupervised Distractor Generation via Large Language Model Distilling and Counterfactual Contrastive DecodingFindings5 citations
- Verifiable Generation with Subsentence-Level Fine-Grained CitationsFindings5 citations
- WARDEN: Multi-Directional Backdoor Watermarks for Embedding-as-a-Service Copyright ProtectionLong5 citations
- XFT: Unlocking the Power of Code Instruction Tuning by Simply Merging Upcycled Mixture-of-ExpertsLong5 citations
- XMoE: Sparse Models with Fine-grained and Adaptive Expert SelectionFindings5 citations
- A Critical Study of What Code-LLMs (Do Not) LearnFindings4 citations
- A Multi-Task Embedder For Retrieval Augmented LLMsLong4 citations
- A Novel Cartography-Based Curriculum Learning Method Applied on RoNLI: The First Romanian Natural Language Inference CorpusLong4 citations
- A Ship of Theseus: Curious Cases of Paraphrasing in LLM-Generated TextsLong4 citations
- AGR: Reinforced Causal Agent-Guided Self-explaining RationalizationShort4 citations
- Advancing Post-OCR Correction: A Comparative Study of Synthetic DataFindings4 citations
- Amanda: Adaptively Modality-Balanced Domain Adaptation for Multimodal Emotion RecognitionFindings4 citations
- An Element is Worth a Thousand Words: Enhancing Legal Case Retrieval by Incorporating Legal ElementsFindings4 citations
- An Open Multilingual System for Scoring Readability of WikipediaLong4 citations
- Argument Mining in Data Scarce Settings: Cross-lingual Transfer and Few-shot TechniquesLong4 citations
- Autonomous Workflow for Multimodal Fine-Grained Training Assistants Towards Mixed RealityFindings4 citations
- BASS: Batched Attention-optimized Speculative SamplingFindings4 citations
- Beyond Literal Descriptions: Understanding and Locating Open-World Objects Aligned with Human IntentionsFindings4 citations
- Beyond Memorization: The Challenge of Random Memory Access in Language ModelsLong4 citations
- Bilingual Rhetorical Structure Parsing with Large Parallel AnnotationsFindings4 citations
- Browse and Concentrate: Comprehending Multimodal Content via Prior-LLM Context FusionLong4 citations
- Building Bridges: A Dataset for Evaluating Gender-Fair Machine Translation into GermanFindings4 citations
- Can ChatGPT’s Performance be Improved on Verb Metaphor Detection Tasks? Bootstrapping and Combining Tacit KnowledgeLong4 citations
- ChartCheck: Explainable Fact-Checking over Real-World Chart ImagesFindings4 citations
- ChronosLex: Time-aware Incremental Training for Temporal Generalization of Legal Classification TasksLong4 citations
- Cognitive Visual-Language Mapper: Advancing Multimodal Comprehension with Enhanced Visual Knowledge AlignmentLong4 citations
- ColorSwap: A Color and Word Order Dataset for Multimodal EvaluationFindings4 citations
- Concise and Precise Context Compression for Tool-Using Language ModelsFindings4 citations
- DeCoT: Debiasing Chain-of-Thought for Knowledge-Intensive Tasks in Large Language Models via Causal InterventionLong4 citations
- Decoding the Narratives: Analyzing Personal Drug Experiences Shared on RedditFindings4 citations
- DiffChat: Learning to Chat with Text-to-Image Synthesis Models for Interactive Image CreationFindings4 citations
- DolphCoder: Echo-Locating Code Large Language Models with Diverse and Multi-Objective Instruction TuningLong4 citations
- Dual Prompt Tuning based Contrastive Learning for Hierarchical Text ClassificationFindings4 citations
- EIT: Enhanced Interactive TransformerLong4 citations
- EZ-STANCE: A Large Dataset for English Zero-Shot Stance DetectionLong4 citations
- Enhanced Language Model Truthfulness with Learnable Intervention and Uncertainty ExpressionFindings4 citations
- Enhancing Distractor Generation for Multiple-Choice Questions with Retrieval Augmented Pretraining and Knowledge Graph IntegrationFindings4 citations
- Epistemology of Language Models: Do Language Models Have Holistic Knowledge?Findings4 citations
- Error-preserving Automatic Speech Recognition of Young English Learners’ LanguageLong4 citations
- Evidence Retrieval is almost All You Need for Fact VerificationFindings4 citations
- Explainability and Hate Speech: Structured Explanations Make Social Media Moderators FasterShort4 citations
- Exploring Defeasibility in Causal ReasoningFindings4 citations
- Exploring Hybrid Question Answering via Program-based PromptingLong4 citations
- FENICE: Factuality Evaluation of summarization based on Natural language Inference and Claim ExtractionFindings4 citations
- FOCUS: Forging Originality through Contrastive Use in Self-Plagiarism for Language ModelsFindings4 citations
- FUSE: Measure-Theoretic Compact Fuzzy Set Representation for Taxonomy ExpansionFindings4 citations
- Fair Federated Learning with Biased Vision-Language ModelsFindings4 citations
- Few-shot Dialogue Strategy Learning for Motivational Interviewing via Inductive ReasoningFindings4 citations
- Fine-Tuning Pre-Trained Language Models with Gaze SupervisionShort4 citations
- From Representational Harms to Quality-of-Service Harms: A Case Study on Llama 2 Safety SafeguardsFindings4 citations
- Fundamental Capabilities of Large Language Models and their Applications in Domain Scenarios: A SurveyLong4 citations
- GPT is Not an Annotator: The Necessity of Human Annotation in Fairness Benchmark ConstructionLong4 citations
- Generating Coherent Sequences of Visual Illustrations for Real-World Manual TasksLong4 citations
- Generating Diverse and High-Quality Texts by Minimum Bayes Risk DecodingFindings4 citations
- Generative Explore-Exploit: Training-free Optimization of Generative Recommender Systems using LLM OptimizersLong4 citations
- Generative Pretrained Structured Transformers: Unsupervised Syntactic Language Models at ScaleLong4 citations
- Hyperparameter-Free Approach for Faster Minimum Bayes Risk DecodingFindings4 citations
- IMGTB: A Framework for Machine-Generated Text Detection BenchmarkingSystem Demonstrations4 citations
- In-context Mixing (ICM): Code-mixed Prompts for Multilingual LLMsLong4 citations
- Incorporating Syntax and Lexical Knowledge to Multilingual Sentiment Classification on Large Language ModelsFindings4 citations
- Injecting Salesperson’s Dialogue Strategies in Large Language Models with Chain-of-Thought ReasoningFindings4 citations
- Instances Need More Care: Rewriting Prompts for Instances with LLMs in the Loop Yields Better Zero-Shot PerformanceFindings4 citations
- Instruction Fusion: Advancing Prompt Evolution through HybridizationLong4 citations
- Isotropy, Clusters, and ClassifiersShort4 citations
- It Is Not About What You Say, It Is About How You Say It: A Surprisingly Simple Approach for Improving Reading ComprehensionFindings4 citations
- JumpCoder: Go Beyond Autoregressive Coder via Online ModificationLong4 citations
- KIWI: A Dataset of Knowledge-Intensive Writing Instructions for Answering Research QuestionsFindings4 citations
- LLM as Prompter: Low-resource Inductive Reasoning on Arbitrary Knowledge GraphsFindings4 citations
- Label-Efficient Model Selection for Text GenerationLong4 citations
- Label-Synchronous Neural Transducer for E2E Simultaneous Speech TranslationLong4 citations
- Language Models Do Hard Arithmetic Tasks Easily and Hardly Do Easy Arithmetic TasksShort4 citations
- Language Models can Evaluate Themselves via Probability DiscrepancyFindings4 citations
- Learning to Generate Answers with Citations via Factual Consistency ModelsLong4 citations
- M3AV: A Multimodal, Multigenre, and Multipurpose Audio-Visual Academic Lecture DatasetLong4 citations
- MARVEL: Unlocking the Multi-Modal Capability of Dense Retrieval via Visual Module PluginLong4 citations
- MRL Parsing Without Tears: The Case of HebrewFindings4 citations
- Measuring and Addressing Indexical Bias in Information RetrievalFindings4 citations
- Media Framing: A typology and Survey of Computational Approaches Across DisciplinesLong4 citations
- Mitigating Hallucinations in Large Vision-Language Models (LVLMs) via Language-Contrastive Decoding (LCD)Findings4 citations
- Mitigating Privacy Seesaw in Large Language Models: Augmented Privacy Neuron Editing via Activation PatchingFindings4 citations
- MultiSQL: A Schema-Integrated Context-Dependent Text2SQL Dataset with Diverse SQL OperationsFindings4 citations
- NewsBench: A Systematic Evaluation Framework for Assessing Editorial Capabilities of Large Language Models in Chinese JournalismLong4 citations
- NextLevelBERT: Masked Language Modeling with Higher-Level Representations for Long DocumentsLong4 citations
- Outdated Issue Aware Decoding for Factual Knowledge EditingFindings4 citations
- PCAD: Towards ASR-Robust Spoken Language Understanding via Prototype Calibration and Asymmetric DecouplingLong4 citations
- Personalized Topic Selection Model for Topic-Grounded DialogueFindings4 citations
- ProLex: A Benchmark for Language Proficiency-oriented Lexical SubstitutionFindings4 citations
- Proofread: Fixes All Errors with One TapSystem Demonstrations4 citations
- REFINESUMM: Self-Refining MLLM for Generating a Multimodal Summarization DatasetLong4 citations
- Reasoning Like a Doctor: Improving Medical Dialogue Systems via Diagnostic Reasoning Process AlignmentFindings4 citations
- Reasoning in Conversation: Solving Subjective Tasks through Dialogue Simulation for Large Language ModelsLong4 citations
- Recognizing Everything from All Modalities at Once: Grounded Multimodal Universal Information ExtractionFindings4 citations
- RelayAttention for Efficient Large Language Model Serving with Long System PromptsLong4 citations
- Respond in my Language: Mitigating Language Inconsistency in Response Generation based on Large Language ModelsLong4 citations
- Retrieval Augmented Fact Verification by Synthesizing Contrastive ArgumentsLong4 citations
- Revisiting OPRO: The Limitations of Small-Scale LLMs as OptimizersFindings4 citations
- Robust Frame-Semantic Models with Lexical Unit Trees and Negative SamplesLong4 citations
- Robust Singing Voice Transcription Serves SynthesisLong4 citations
- SCALE: Synergized Collaboration of Asymmetric Language Translation EnginesFindings4 citations
- SEGO: Sequential Subgoal Optimization for Mathematical Problem-SolvingLong4 citations
- SSS: Editing Factual Knowledge in Language Models towards Semantic Sparse SpaceFindings4 citations
- See It All: Contextualized Late Aggregation for 3D Dense CaptioningFindings4 citations
- Selective “Selective Prediction”: Reducing Unnecessary Abstention in Vision-Language ReasoningFindings4 citations
- Self-Evolving GPT: A Lifelong Autonomous Experiential LearnerLong4 citations
- Simpson’s Paradox and the Accuracy-Fluency Tradeoff in TranslationShort4 citations
- Simul-LLM: A Framework for Exploring High-Quality Simultaneous Translation with Large Language ModelsLong4 citations
- Small But Funny: A Feedback-Driven Approach to Humor DistillationLong4 citations
- Strengthened Symbol Binding Makes Large Language Models Reliable Multiple-Choice SelectorsLong4 citations
- SumSurvey: An Abstractive Dataset of Scientific Survey Papers for Long Document SummarizationFindings4 citations
- Text-to-Song: Towards Controllable Music Generation Incorporating Vocal and AccompanimentLong4 citations
- The Emotion Dynamics of Literary NovelsFindings4 citations
- Toward In-Context Teaching: Adapting Examples to Students’ MisconceptionsLong4 citations
- Towards Robust Temporal Reasoning of Large Language Models via a Multi-Hop QA Dataset and Pseudo-Instruction TuningFindings4 citations
- Transferable and Efficient Non-Factual Content Detection via Probe Training with Offline Consistency CheckingLong4 citations
- Trust in Internal or External Knowledge? Generative Multi-Modal Entity Linking with Knowledge RetrieverFindings4 citations
- UniBridge: A Unified Approach to Cross-Lingual Transfer Learning for Low-Resource LanguagesLong4 citations
- Unlearning Traces the Influential Training Data of Language ModelsLong4 citations
- Unraveling and Mitigating Retriever Inconsistencies in Retrieval-Augmented Large Language ModelsFindings4 citations
- Using Synchronic Definitions and Semantic Relations to Classify Semantic Change TypesLong4 citations
- Variationist: Exploring Multifaceted Variation and Bias in Written Language DataSystem Demonstrations4 citations
- Views Are My Own, but Also Yours: Benchmarking Theory of Mind Using Common GroundFindings4 citations
- Visualization Recommendation with Prompt-based Reprogramming of Large Language ModelsLong4 citations
- Word Matters: What Influences Domain Adaptation in Summarization?Long4 citations
- Your Co-Workers Matter: Evaluating Collaborative Capabilities of Language Models in Blocks WorldFindings4 citations
- A Deep Dive into the Trade-Offs of Parameter-Efficient Preference Alignment TechniquesLong3 citations
- A Meta-Learning Perspective on Transformers for Causal Language ModelingFindings3 citations
- A Sentiment Consolidation Framework for Meta-Review GenerationLong3 citations
- A Survey on Modelling Morality for Text AnalysisFindings3 citations
- A Unified Joint Approach with Topological Context Learning and Rule Augmentation for Knowledge Graph CompletionFindings3 citations
- A Unified Temporal Knowledge Graph Reasoning Model Towards Interpolation and ExtrapolationLong3 citations
- A multi-level multi-label text classification dataset of 19th century Ottoman and Russian literary and critical textsFindings3 citations
- AI ‘News’ Content Farms Are Easy to Make and Hard to Detect: A Case Study in ItalianLong3 citations
- Abstract Meaning Representation-Based Logic-Driven Data Augmentation for Logical ReasoningFindings3 citations
- Accelerating Multilingual Language Model for Excessively Tokenized LanguagesFindings3 citations
- Advancement in Graph Understanding: A Multimodal Benchmark and Fine-Tuning of Vision-Language ModelsLong3 citations
- Advancing Abductive Reasoning in Knowledge Graphs through Complex Logical Hypothesis GenerationLong3 citations
- An Empirical Analysis on Large Language Models in Debate EvaluationShort3 citations
- An Empirical Study on the Characteristics of Bias upon Context Length Variation for BanglaFindings3 citations
- Analysis of Multi-Source Language Training in Cross-Lingual TransferLong3 citations
- Are U a Joke Master? Pun Generation via Multi-Stage Curriculum Learning towards a Humor LLMFindings3 citations
- AustroTox: A Dataset for Target-Based Austrian German Offensive Language DetectionFindings3 citations
- AutoDSL: Automated domain-specific language design for structural representation of procedures with constraintsLong3 citations
- Benchmarking and Improving Compositional Generalization of Multi-aspect Controllable Text GenerationLong3 citations
- Bias in News Summarization: Measures, Pitfalls and CorporaFindings3 citations
- Bridging the Empirical-Theoretical Gap in Neural Network Formal Language Learning Using Minimum Description LengthLong3 citations
- Budget-Constrained Tool Learning with PlanningFindings3 citations
- BvSP: Broad-view Soft Prompting for Few-Shot Aspect Sentiment Quad PredictionLong3 citations
- CHECKWHY: Causal Fact Verification via Argument StructureLong3 citations
- COSMIC: Mutual Information for Task-Agnostic Summarization EvaluationLong3 citations
- CR-UTP: Certified Robustness against Universal Text Perturbations on Large Language ModelsFindings3 citations
- CaMML: Context-Aware Multimodal Learner for Large ModelsLong3 citations
- Can Large Language Models Follow Concept Annotation Guidelines? A Case Study on Scientific and Financial DomainsFindings3 citations
- Can Large Language Models Interpret Noun-Noun Compounds? A Linguistically-Motivated Study on Lexicalized and Novel CompoundsLong3 citations
- Challenging Large Language Models with New Tasks: A Study on their Adaptability and RobustnessFindings3 citations
- Chinese Spelling Corrector Is Just a Language LearnerFindings3 citations
- Classist Tools: Social Class Correlates with Performance in NLPLong3 citations
- Cleaner Pretraining Corpus Curation with Neural Web ScrapingShort3 citations
- Code-Switching Can be Better Aligners: Advancing Cross-Lingual SLU through Representation-Level and Prediction-Level AlignmentShort3 citations
- CogMG: Collaborative Augmentation Between Large Language Model and Knowledge GraphSystem Demonstrations3 citations
- Combining Hierachical VAEs with LLMs for clinically meaningful timeline summarisation in social mediaFindings3 citations
- Comments as Natural Logic Pivots: Improve Code Generation via Comment PerspectiveFindings3 citations
- Comprehensive Abstractive Comment Summarization with Dynamic Clustering and Chain of ThoughtFindings3 citations
- DINER: Debiasing Aspect-based Sentiment Analysis with Multi-variable Causal InferenceFindings3 citations
- DORY: Deliberative Prompt Recovery for LLMFindings3 citations
- DeVAn: Dense Video Annotation for Video-Language ModelsLong3 citations
- Definition generation for lexical semantic change detectionFindings3 citations
- Don’t Augment, Rewrite? Assessing Abusive Language Detection with Synthetic DataFindings3 citations
- Dwell in the Beginning: How Language Models Embed Long Documents for Dense RetrievalShort3 citations
- Dynamic Stochastic Decoding Strategy for Open-Domain Dialogue GenerationFindings3 citations
- EUROPA: A Legal Multilingual Keyphrase Generation DatasetLong3 citations
- Efficiently Exploring Large Language Models for Document-Level Machine Translation with In-context LearningFindings3 citations
- Emergent Word Order Universals from Cognitively-Motivated Language ModelsLong3 citations
- End-to-end Learning of Logical Rules for Enhancing Document-level Relation ExtractionLong3 citations
- Every Answer Matters: Evaluating Commonsense with Probabilistic MeasuresLong3 citations
- Explanation-aware Soft Ensemble Empowers Large Language Model In-context LearningLong3 citations
- FastGAS: Fast Graph-based Annotation Selection for In-Context LearningFindings3 citations
- From Discrimination to Generation: Low-Resource Intent Detection with Language Model Instruction TuningFindings3 citations
- From Sights to Insights: Towards Summarization of Multimodal Clinical DocumentsLong3 citations
- Generalizability of Mixture of Domain-Specific Adapters from the Lens of Signed Weight Directions and its Application to Effective Model PruningLong3 citations
- Generative Input: Towards Next-Generation Input Methods ParadigmFindings3 citations
- Generative Pre-trained Speech Language Model with Efficient Hierarchical TransformerLong3 citations
- Graph-Structured Speculative DecodingFindings3 citations
- GrowOVER: How Can LLMs Adapt to Growing Real-World Knowledge?Long3 citations
- Guardians of the Machine Translation Meta-Evaluation: Sentinel Metrics Fall In!Long3 citations
- Handling Ambiguity in Emotion: From Out-of-Domain Detection to Distribution EstimationLong3 citations
- Harnessing Large Language Models as Post-hoc CorrectorsFindings3 citations
- Hyperspherical Multi-Prototype with Optimal Transport for Event Argument ExtractionLong3 citations
- IAPT: Instance-Aware Prompt Tuning for Large Language ModelsLong3 citations
- IEPile: Unearthing Large Scale Schema-Conditioned Information Extraction CorpusShort3 citations
- IMO: Greedy Layer-Wise Sparse Representation Learning for Out-of-Distribution Text Classification with Pre-trained ModelsLong3 citations
- Improving Conversational Abilities of Quantized Large Language Models via Direct Preference AlignmentLong3 citations
- Improving Hateful Meme Detection through Retrieval-Guided Contrastive LearningLong3 citations
- IndicIRSuite: Multilingual Dataset and Neural Information Models for Indian LanguagesShort3 citations
- Knowledge Crosswords: Geometric Knowledge Reasoning with Large Language ModelsFindings3 citations
- LC4EE: LLMs as Good Corrector for Event ExtractionFindings3 citations
- LLM Knows Body Language, Too: Translating Speech Voices into Human GesturesLong3 citations
- LLM can Achieve Self-Regulation via Hyperparameter Aware GenerationFindings3 citations
- Language models emulate certain cognitive profiles: An investigation of how predictability measures interact with individual differencesFindings3 citations
- Large Language Models Are No Longer Shallow ParsersLong3 citations
- Legal Case Retrieval: A Survey of the State of the ArtLong3 citations
- Leveraging Machine-Generated Rationales to Facilitate Social Meaning Detection in ConversationsLong3 citations
- Light-PEFT: Lightening Parameter-Efficient Fine-Tuning via Early PruningFindings3 citations
- M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge DistillationFindings3 citations
- MIKE: A New Benchmark for Fine-grained Multimodal Entity Knowledge EditingFindings3 citations
- MS2SL: Multimodal Spoken Data-Driven Continuous Sign Language ProductionFindings3 citations
- Measuring Meaning Composition in the Human Brain with Composition Scores from Large Language ModelsLong3 citations
- MedDec: A Dataset for Extracting Medical Decisions from Discharge SummariesFindings3 citations
- MemeMQA: Multimodal Question Answering for Memes via Rationale-Based InferencingFindings3 citations
- MetaSumPerceiver: Multimodal Multi-Document Evidence Summarization for Fact-CheckingLong3 citations
- MoPS: Modular Story Premise Synthesis for Open-Ended Automatic Story GenerationLong3 citations
- Multi-modal Concept Alignment Pre-training for Generative Medical Visual Question AnsweringFindings3 citations
- MultiPICo: Multilingual Perspectivist Irony CorpusLong3 citations
- NLP-KG: A System for Exploratory Search of Scientific Literature in Natural Language ProcessingSystem Demonstrations3 citations
- ONSEP: A Novel Online Neural-Symbolic Framework for Event Prediction Based on Large Language ModelFindings3 citations
- On The Persona-based Summarization of Domain-Specific DocumentsFindings3 citations
- Open-Set Semi-Supervised Text Classification via Adversarial Disagreement MaximizationLong3 citations
- Optimal Transport Guided Correlation Assignment for Multimodal Entity LinkingFindings3 citations
- Order-Agnostic Data Augmentation for Few-Shot Named Entity RecognitionLong3 citations
- Perceptions of Language Technology Failures from South Asian English SpeakersFindings3 citations
- Quality-Aware Translation Models: Efficient Generation and Quality Estimation in a Single ModelLong3 citations
- Question-Instructed Visual Descriptions for Zero-Shot Video AnsweringFindings3 citations
- RA-LoRA: Rank-Adaptive Parameter-Efficient Fine-Tuning for Accurate 2-bit Quantized Large Language ModelsFindings3 citations
- RORA: Robust Free-Text Rationale EvaluationLong3 citations
- Ranking Large Language Models without Ground TruthFindings3 citations
- Realistic Evaluation of Toxicity in Large Language ModelsFindings3 citations
- Recovering document annotations for sentence-level bitextFindings3 citations
- Referral Augmentation for Zero-Shot Information RetrievalFindings3 citations
- Reformulating Domain Adaptation of Large Language Models as Adapt-Retrieve-Revise: A Case Study on Chinese Legal DomainFindings3 citations
- Rethinking the Multimodal Correlation of Multimodal Sequential Learning via Generalizable Attentional Results AlignmentLong3 citations
- RulE: Knowledge Graph Reasoning with Rule EmbeddingFindings3 citations
- Rule or Story, Which is a Better Commonsense Expression for Talking with Large Language Models?Long3 citations
- Self-Training with Pseudo-Label Scorer for Aspect Sentiment Quad PredictionLong3 citations
- Semantic Role Labeling from Chinese Speech via End-to-End LearningFindings3 citations
- Semisupervised Neural Proto-Language ReconstructionLong3 citations
- Simple but Effective Compound Geometric Operations for Temporal Knowledge Graph CompletionLong3 citations
- SpaRC and SpaRP: Spatial Reasoning Characterization and Path Generation for Understanding Spatial Reasoning Capability of Large Language ModelsLong3 citations
- SpeechGuard: Exploring the Adversarial Robustness of Multi-modal Large Language ModelsFindings3 citations
- SpikeVoice: High-Quality Text-to-Speech Via Efficient Spiking Neural NetworkLong3 citations
- StatBot.Swiss: Bilingual Open Data Exploration in Natural LanguageFindings3 citations
- Striking Gold in Advertising: Standardization and Exploration of Ad Text GenerationLong3 citations
- Strong hallucinations from negation and how to fix themFindings3 citations
- StructEval: Deepen and Broaden Large Language Model Assessment via Structured EvaluationFindings3 citations
- Subtle Signatures, Strong Shields: Advancing Robust and Imperceptible Watermarking in Large Language ModelsFindings3 citations
- SyllabusQA: A Course Logistics Question Answering DatasetLong3 citations
- TTM-RE: Memory-Augmented Document-Level Relation ExtractionLong3 citations
- Teaching Language Models to Self-Improve by Learning from Language FeedbackFindings3 citations
- Teaching Small Language Models to Reason for Knowledge-Intensive Multi-Hop Question AnsweringFindings3 citations
- The Hidden Space of Transformer Language AdaptersLong3 citations
- Through the MUD: A Multi-Defendant Charge Prediction Benchmark with Linked Crime ElementsLong3 citations
- Timeline-based Sentence Decomposition with In Context Learning for Temporal Fact ExtractionLong3 citations
- To Distill or Not to Distill? On the Robustness of Robust Knowledge DistillationLong3 citations
- Towards Demonstration-Aware Large Language Models for Machine TranslationFindings3 citations
- Towards Objectively Benchmarking Social Intelligence of Language Agents at the Action LevelFindings3 citations
- Towards Robust and Generalized Parameter-Efficient Fine-Tuning for Noisy Label LearningLong3 citations
- Training a Better Chinese Spelling Correction Model via Prior-knowledge Guided TeacherFindings3 citations
- Tree-Averaging Algorithms for Ensemble-Based Unsupervised Discontinuous Constituency ParsingLong3 citations
- Tree-of-Counterfactual Prompting for Zero-Shot Stance DetectionLong3 citations
- Two Issues with Chinese Spelling Correction and A Refinement SolutionShort3 citations
- Uncovering the Full Potential of Visual Grounding Methods in VQALong3 citations
- Understanding Retrieval Robustness for Retrieval-augmented Image CaptioningLong3 citations
- Uni-Dubbing: Zero-Shot Speech Synthesis from Visual ArticulationLong3 citations
- Unity in Diversity: Collaborative Pre-training Across Multimodal Medical SourcesLong3 citations
- Unsupervised Multimodal Clustering for Semantics Discovery in Multimodal UtterancesLong3 citations
- Unveiling Opinion Evolution via Prompting and Diffusion for Short Video Fake News DetectionFindings3 citations
- Unveiling the Achilles’ Heel of NLG Evaluators: A Unified Adversarial Framework Driven by Large Language ModelsFindings3 citations
- VISPool: Enhancing Transformer Encoders with Vector Visibility Graph Neural NetworksFindings3 citations
- VISREAS: Complex Visual Reasoning with Unanswerable QuestionsFindings3 citations
- VisDiaHalBench: A Visual Dialogue Benchmark For Diagnosing Hallucination in Large Vision-Language ModelsLong3 citations
- VulLibGen: Generating Names of Vulnerability-Affected Packages via a Large Language ModelLong3 citations
- WatME: Towards Lossless Watermarking Through Lexical RedundancyLong3 citations
- Wav2Gloss: Generating Interlinear Glossed Text from SpeechLong3 citations
- Wav2SQL: Direct Generalizable Speech-To-SQL ParsingFindings3 citations
- When is a Language Process a Language Model?Findings3 citations
- Which Side Are You On? A Multi-task Dataset for End-to-End Argument Summarisation and EvaluationFindings3 citations
- X-Shot: A Unified System to Handle Frequent, Few-shot and Zero-shot Learning Simultaneously in ClassificationFindings3 citations
- Zero-Shot Cross-Domain Dialogue State Tracking via Dual Low-Rank AdaptationLong3 citations
- A Joint Coreference-Aware Approach to Document-Level Target Sentiment AnalysisLong2 citations
- A Multidimensional Framework for Evaluating Lexical Semantic Change with Social Science ApplicationsLong2 citations
- ARAIDA: Analogical Reasoning-Augmented Interactive Data AnnotationLong2 citations
- ASPIRE: Language-Guided Data Augmentation for Improving Robustness Against Spurious CorrelationsFindings2 citations
- Accurate and Nuanced Open-QA Evaluation Through Textual EntailmentFindings2 citations
- Aligning Large Language Models via Fine-grained SupervisionShort2 citations
- Aligning Speech Segments Beyond Pure SemanticsFindings2 citations
- Are LLMs classical or nonmonotonic reasoners? Lessons from genericsShort2 citations
- Asymmetric Bias in Text-to-Image Generation with Adversarial AttacksFindings2 citations
- Automatic Bug Detection in LLM-Powered Text-Based Games Using LLMsFindings2 citations
- BATS: BenchmArking Text Simplicity 🦇Findings2 citations
- BEnQA: A Question Answering Benchmark for Bengali and EnglishFindings2 citations
- BIPED: Pedagogically Informed Tutoring System for ESL EducationLong2 citations
- Babel-ImageNet: Massively Multilingual Evaluation of Vision-and-Language RepresentationsLong2 citations
- BeamAggR: Beam Aggregation Reasoning over Multi-source Knowledge for Multi-hop Question AnsweringLong2 citations
- Benchmarking and Improving Long-Text Translation with Large Language ModelsFindings2 citations
- Beyond Orthography: Automatic Recovery of Short Vowels and Dialectal Sounds in ArabicLong2 citations
- Biasly: An Expert-Annotated Dataset for Subtle Misogyny Detection and MitigationFindings2 citations
- Boosting Zero-Shot Crosslingual Performance using LLM-Based Augmentations with Effective Data SelectionFindings2 citations
- BranchNorm: Robustly Scaling Extremely Deep TransformersFindings2 citations
- CICLe: Conformal In-Context Learning for Largescale Multi-Class Food Risk ClassificationFindings2 citations
- CTC-based Non-autoregressive Textless Speech-to-Speech TranslationFindings2 citations
- CaLM: Contrasting Large and Small Language Models to Verify Grounded GenerationFindings2 citations
- Can We Continually Edit Language Models? On the Knowledge Attenuation in Sequential Model EditingFindings2 citations
- Can Your Model Tell a Negation from an Implicature? Unravelling Challenges With Intent EncodersLong2 citations
- Challenges to Evaluating the Generalization of Coreference Resolution Models: A Measurement Modeling PerspectiveFindings2 citations
- Co-training for Low Resource Scientific Natural Language InferenceLong2 citations
- Combining Supervised Learning and Reinforcement Learning for Multi-Label Classification Tasks with Partial LabelsLong2 citations
- Complex Logical Query Answering by Calibrating Knowledge Graph Completion ModelsFindings2 citations
- Continual Contrastive Spoken Language UnderstandingFindings2 citations
- CorNav: Autonomous Agent with Self-Corrected Planning for Zero-Shot Vision-and-Language NavigationFindings2 citations
- DAFNet: Dynamic Auxiliary Fusion for Sequential Model Editing in Large Language ModelsFindings2 citations
- DAPR: A Benchmark on Document-Aware Passage RetrievalLong2 citations
- DATA-CUBE: Data Curriculum for Instruction-based Sentence Representation LearningFindings2 citations
- DM-BLI: Dynamic Multiple Subspaces Alignment for Unsupervised Bilingual Lexicon InductionLong2 citations
- Deciphering Hate: Identifying Hateful Memes and Their TargetsLong2 citations
- Decoder-only Streaming Transformer for Simultaneous TranslationLong2 citations
- Deepfake Defense: Constructing and Evaluating a Specialized Urdu Deepfake Audio DatasetFindings2 citations
- Definition Generation for Automatically Induced Semantic FrameFindings2 citations
- Detection and Positive Reconstruction of Cognitive Distortion Sentences: Mandarin Dataset and EvaluationFindings2 citations
- DiFiNet: Boundary-Aware Semantic Differentiation and Filtration Network for Nested Named Entity RecognitionLong2 citations
- Dictionary-Aided Translation for Handling Multi-Word Expressions in Low-Resource LanguagesFindings2 citations
- Digital Socrates: Evaluating LLMs through Explanation CritiquesLong2 citations
- Disentangling Dialect from Social Bias via Multitask Learning to Improve FairnessFindings2 citations
- Do Pre-Trained Language Models Detect and Understand Semantic Underspecification? Ask the DUST!Findings2 citations
- DocPilot: Copilot for Automating PDF Edit Workflows in DocumentsSystem Demonstrations2 citations
- Document-Level Machine Translation with Large-Scale Public Parallel CorporaLong2 citations
- Don’t Buy it! Reassessing the Ad Understanding Abilities of Contrastive Multimodal ModelsShort2 citations
- Efficient Domain Adaptation for Non-Autoregressive Machine TranslationFindings2 citations
- Enhanced Visual Instruction Tuning with Synthesized Image-Dialogue DataFindings2 citations
- Enhancing Adverse Drug Event Detection with Multimodal Dataset: Corpus Creation and Model DevelopmentFindings2 citations
- Enhancing Hyperbolic Knowledge Graph Embeddings via Lorentz TransformationsFindings2 citations
- Enhancing In-Context Learning via Implicit Demonstration AugmentationLong2 citations
- Evaluating Dynamic Topic ModelsLong2 citations
- Evaluating the Smooth Control of Attribute Intensity in Text Generation with LLMsFindings2 citations
- Exploring Chain-of-Thought for Multi-modal Metaphor DetectionLong2 citations
- Exploring Mathematical Extrapolation of Large Language Models with Synthetic DataFindings2 citations
- Exploring Ordinality in Text Classification: A Comparative Study of Explicit and Implicit TechniquesFindings2 citations
- Extreme Miscalibration and the Illusion of Adversarial RobustnessLong2 citations
- Fine-Grained Modeling of Narrative Context: A Coherence Perspective via Retrospective QuestionsLong2 citations
- Flexible Weight Tuning and Weight Fusion Strategies for Continual Named Entity RecognitionFindings2 citations
- FreeCtrl: Constructing Control Centers with Feedforward Layers for Learning-Free Controllable Text GenerationLong2 citations
- From One to Many: Expanding the Scope of Toxicity Mitigation in Language ModelsFindings2 citations
- From Tarzan to Tolkien: Controlling the Language Proficiency Level of LLMs for Content GenerationFindings2 citations
- GENDEX: Generative Data Augmentation Strategy Leveraging External Data for Abstractive Dialogue SummarizationFindings2 citations
- Generalisation First, Memorisation Second? Memorisation Localisation for Natural Language Classification TasksFindings2 citations
- Generating Harder Cross-document Event Coreference Resolution Datasets using Metaphoric ParaphrasingShort2 citations
- Hard Prompts Made Interpretable: Sparse Entropy Regularization for Prompt Tuning with RLLong2 citations
- Harnessing Toulmin’s theory for zero-shot argument explicationLong2 citations
- HeSum: a Novel Dataset for Abstractive Text Summarization in HebrewFindings2 citations
- HelloFresh: LLM Evalutions on Streams of Real-World Human Editorial Actions across X Community Notes and Wikipedia editsFindings2 citations
- Hierarchy-aware Biased Bound Margin Loss Function for Hierarchical Text ClassificationFindings2 citations
- How Do Moral Emotions Shape Political Participation? A Cross-Cultural Analysis of Online Petitions Using Language ModelsFindings2 citations
- How Far can 100 Samples Go? Unlocking Zero-Shot Translation with Tiny Multi-Parallel DataFindings2 citations
- How Proficient Are Large Language Models in Formal Languages? An In-Depth Insight for Knowledge Base Question AnsweringFindings2 citations
- How to Handle Different Types of Out-of-Distribution Scenarios in Computational Argumentation? A Comprehensive and Fine-Grained Field StudyLong2 citations
- HyCoRec: Hypergraph-Enhanced Multi-Preference Learning for Alleviating Matthew Effect in Conversational RecommendationLong2 citations
- ICC : Quantifying Image Caption Concreteness for Multimodal Dataset CurationFindings2 citations
- Implanting LLM’s Knowledge via Reading Comprehension Tree for Toxicity DetectionFindings2 citations
- Improving Grammatical Error Correction via Contextual Data AugmentationFindings2 citations
- Improving In-Context Learning with Prediction Feedback for Sentiment AnalysisFindings2 citations
- Improving LLM Generations via Fine-Grained Self-EndorsementFindings2 citations
- Improving Low-Resource Machine Translation for Formosan Languages Using Bilingual Lexical ResourcesFindings2 citations
- Improving Retrieval Augmented Open-Domain Question-Answering with Vectorized ContextsFindings2 citations
- InstructEval: Instruction-Tuned Text Evaluator from Human PreferenceFindings2 citations
- LCS: A Language Converter Strategy for Zero-Shot Neural Machine TranslationFindings2 citations
- LEIA: Facilitating Cross-lingual Knowledge Transfer in Language Models with Entity-based Data AugmentationFindings2 citations
- LLMBox: A Comprehensive Library for Large Language ModelsSystem Demonstrations2 citations
- LLMEmbed: Rethinking Lightweight LLM’s Genuine Function in Text ClassificationLong2 citations
- LangSuit·E: Planning, Controlling and Interacting with Large Language Models in Embodied Text EnvironmentsFindings2 citations
- Language Complexity and Speech Recognition Accuracy: Orthographic Complexity Hurts, Phonological Complexity Doesn’tLong2 citations
- Language-Informed Beam Search Decoding for Multilingual Machine TranslationFindings2 citations
- Learning Geometry-Aware Representations for New Intent DiscoveryLong2 citations
- Learning Global Controller in Latent Space for Parameter-Efficient Fine-TuningLong2 citations
- Leveraging Codebook Knowledge with NLI and ChatGPT for Zero-Shot Political Relation ClassificationLong2 citations
- Lightweight reranking for language model generationsLong2 citations
- Locating and Extracting Relational Concepts in Large Language ModelsFindings2 citations
- LogogramNLP: Comparing Visual and Textual Representations of Ancient Logographic Writing Systems for NLPLong2 citations
- M-QALM: A Benchmark to Assess Clinical Reading Comprehension and Knowledge Recall in Large Language Models via Question AnsweringFindings2 citations
- MEFT: Memory-Efficient Fine-Tuning through Sparse AdapterLong2 citations
- MELD-ST: An Emotion-aware Speech Translation DatasetFindings2 citations
- MELOV: Multimodal Entity Linking with Optimized Visual Features in Latent SpaceFindings2 citations
- MIST: Mutual Information Maximization for Short Text ClusteringLong2 citations
- Mass-Editing Memory with Attention in Transformers: A cross-lingual exploration of knowledgeFindings2 citations
- Measuring Retrieval Complexity in Question Answering SystemsFindings2 citations
- MediSwift: Efficient Sparse Pre-trained Biomedical Language ModelsFindings2 citations
- Mitigate Negative Transfer with Similarity Heuristic Lifelong Prompt TuningFindings2 citations
- MoE-SLU: Towards ASR-Robust Spoken Language Understanding via Mixture-of-ExpertsFindings2 citations
- Modeling Emotional Trajectories in Written Stories Utilizing Transformers and Weakly-Supervised LearningFindings2 citations
- Modeling Overregularization in Children with Small Language ModelsFindings2 citations
- Modelling Variability in Human Annotator SimulationFindings2 citations
- Multi-Modal Retrieval For Large Language Model Based Speech RecognitionFindings2 citations
- Multi-Objective Linguistic Control of Large Language ModelsFindings2 citations
- Multistage Collaborative Knowledge Distillation from a Large Language Model for Semi-Supervised Sequence GenerationLong2 citations
- Natural Language Satisfiability: Exploring the Problem Distribution and Evaluating Transformer-based Language ModelsLong2 citations
- NeuroPrune: A Neuro-inspired Topological Sparse Training Algorithm for Large Language ModelsFindings2 citations
- Noise Correction on Subjective DatasetsLong2 citations
- On Efficient and Statistical Quality Estimation for Data AnnotationLong2 citations
- PARADISE: Evaluating Implicit Planning Skills of Language Models with Procedural Warnings and Tips DatasetFindings2 citations
- Paraphrasing in Affirmative Terms Improves Negation UnderstandingShort2 citations
- Pareto Optimal Learning for Estimating Large Language Model ErrorsLong2 citations
- PartialFormer: Modeling Part Instead of Whole for Machine TranslationFindings2 citations
- PathReasoner: Modeling Reasoning Path with Equivalent Extension for Logical Question AnsweringLong2 citations
- Paying Attention to Deflections: Mining Pragmatic Nuances for Whataboutism Detection in Online DiscourseFindings2 citations
- Pro-Woman, Anti-Man? Identifying Gender Bias in Stance DetectionFindings2 citations
- Progressive Tuning: Towards Generic Sentiment Abilities for Large Language ModelsFindings2 citations
- Progressively Modality Freezing for Multi-Modal Entity AlignmentLong2 citations
- Pushing the Limits of Low-Resource NER Using LLM Artificial Data GenerationFindings2 citations
- Quantifying Generalizations: Exploring the Divide Between Human and LLMs’ Sensitivity to QuantificationLong2 citations
- RRNorm: A Novel Framework for Chinese Disease Diagnoses Normalization via LLM-Driven Terminology Component Recognition and ReconstructionFindings2 citations
- Raccoon: Prompt Extraction Benchmark of LLM-Integrated ApplicationsFindings2 citations
- RankMean: Module-Level Importance Score for Merging Fine-tuned LLM ModelsFindings2 citations
- Re3: A Holistic Framework and Dataset for Modeling Collaborative Document RevisionLong2 citations
- Refining and Synthesis: A Simple yet Effective Data Augmentation Framework for Cross-Domain Aspect-based Sentiment AnalysisFindings2 citations
- RetinaQA: A Robust Knowledge Base Question Answering Model for both Answerable and Unanswerable QuestionsLong2 citations
- SBAAM! Eliminating Transcript Dependency in Automatic SubtitlingLong2 citations
- SIP: Injecting a Structural Inductive Bias into a Seq2Seq Model by SimulationLong2 citations
- SMART: Submodular Data Mixture Strategy for Instruction TuningFindings2 citations
- SMR: State Memory Replay for Long Sequence ModelingFindings2 citations
- STREAM: Simplified Topic Retrieval, Exploration, and Analysis ModuleShort2 citations
- Scented-EAE: Stage-Customized Entity Type Embedding for Event Argument ExtractionFindings2 citations
- Self-Supervised Position Debiasing for Large Language ModelsFindings2 citations
- Self-Supervised Singing Voice Pre-Training towards Speech-to-Singing ConversionFindings2 citations
- Semantics or spelling? Probing contextual word embeddings with orthographic noiseFindings2 citations
- Simulated Misinformation Susceptibility (SMISTS): Enhancing Misinformation Research with Large Language Model SimulationsFindings2 citations
- SoftDedup: an Efficient Data Reweighting Method for Speeding Up Language Model Pre-trainingLong2 citations
- SparseFit: Few-shot Prompting with Sparse Fine-tuning for Jointly Generating Predictions and Natural Language ExplanationsLong2 citations
- Sparsity-Accelerated Training for Large Language ModelsFindings2 citations
- Spatially-Aware Speaker for Vision-and-Language Navigation Instruction GenerationLong2 citations
- Speaker Verification in Agent-generated ConversationsLong2 citations
- Split and Rephrase with Large Language ModelsLong2 citations
- StreamAtt: Direct Streaming Speech-to-Text Translation with Attention-based Audio History SelectionLong2 citations
- SymKGQA: Few-Shot Knowledge Graph Question Answering via Symbolic Program Generation and ExecutionLong2 citations
- Symmetric Dot-Product Attention for Efficient Training of BERT Language ModelsFindings2 citations
- Systematic Task Exploration with LLMs: A Study in Citation Text GenerationLong2 citations
- T2S-GPT: Dynamic Vector Quantization for Autoregressive Sign Language Production from TextLong2 citations
- TRAP: Targeted Random Adversarial Prompt Honeypot for Black-Box IdentificationFindings2 citations
- The MERSA Dataset and a Transformer-Based Approach for Speech Emotion RecognitionLong2 citations
- To be Continuous, or to be Discrete, Those are Bits of QuestionsLong2 citations
- Toucan: Many-to-Many Translation for 150 African Language PairsFindings2 citations
- Towards Real-world Scenario: Imbalanced New Intent DiscoveryLong2 citations
- Tracking the Newsworthiness of Public DocumentsLong2 citations
- Translation Deserves Better: Analyzing Translation Artifacts in Cross-lingual Visual Question AnsweringFindings2 citations
- UNIWIZ: A Unified Large Language Model Orchestrated Wizard for Safe Knowledge Grounded ConversationsFindings2 citations
- Understanding Fine-grained Distortions in Reports of Scientific FindingsFindings2 citations
- VeraCT Scan: Retrieval-Augmented Fake News Detection with Justifiable ReasoningSystem Demonstrations2 citations
- ViHateT5: Enhancing Hate Speech Detection in Vietnamese With a Unified Text-to-Text Transformer ModelFindings2 citations
- WebCiteS: Attributed Query-Focused Summarization on Chinese Web Search Results with CitationsLong2 citations
- What Are You Token About? Differentiable Perturbed Top-k Token Selection for Scientific Document SummarizationFindings2 citations
- X-ACE: Explainable and Multi-factor Audio Captioning EvaluationFindings2 citations
- XNLP: An Interactive Demonstration System for Universal Structured NLPSystem Demonstrations2 citations
- iSign: A Benchmark for Indian Sign Language ProcessingFindings2 citations
- wav2vec-S: Adapting Pre-trained Speech Models for StreamingFindings2 citations
- A + B: A General Generator-Reader Framework for Optimizing LLMs to Unleash Synergy PotentialFindings1 citations
- A Community-Centric Perspective for Characterizing and Detecting Anti-Asian Violence-Provoking SpeechLong1 citations
- A Curious Case of Searching for the Correlation between Training Data and Adversarial Robustness of Transformer Textual ModelsFindings1 citations
- A Grounded Preference Model for LLM AlignmentFindings1 citations
- A Unified Generative Framework for Bilingual Euphemism Detection and IdentificationFindings1 citations
- ABEX: Data Augmentation for Low-Resource NLU via Expanding Abstract DescriptionsLong1 citations
- AGB-DE: A Corpus for the Automated Legal Assessment of Clauses in German Consumer ContractsLong1 citations
- ALaRM: Align Language Models via Hierarchical Rewards ModelingFindings1 citations
- AS-ES Learning: Towards efficient CoT learning in small modelsFindings1 citations
- ATLAS: Improving Lay Summarisation with Attribute-based ControlShort1 citations
- ActionIE: Action Extraction from Scientific Literature with Programming LanguagesLong1 citations
- AlignRE: An Encoding and Semantic Alignment Approach for Zero-Shot Relation ExtractionFindings1 citations
- An Effective Pronunciation Assessment Approach Leveraging Hierarchical Transformers and Pre-training StrategiesLong1 citations
- An Information-Theoretic Approach to Analyze NLP Classification TasksLong1 citations
- Annotating FrameNet via Structure-Conditioned Language GenerationShort1 citations
- Arabic Diacritics in the Wild: Exploiting Opportunities for Improved DiacritizationLong1 citations
- Are Female Carpenters like Blue Bananas? A Corpus Investigation of Occupation Gender TypicalityFindings1 citations
- Argument-Based Sentiment Analysis on Forward-Looking StatementsFindings1 citations
- Assessing News Thumbnail Representativeness: Counterfactual text can enhance the cross-modal matching abilityFindings1 citations
- Automated Detection and Analysis of Data Practices Using A Real-World CorpusFindings1 citations
- Bayesian Prompt Ensembles: Model Uncertainty Estimation for Black-Box Large Language ModelsFindings1 citations
- Benchmarking Large Language Models on Communicative Medical Coaching: A Dataset and a Novel SystemFindings1 citations
- Better Late Than Never: Model-Agnostic Hallucination Post-Processing Framework Towards Clinical Text SummarizationFindings1 citations
- Beyond Text: Leveraging Multi-Task Learning and Cognitive Appraisal Theory for Post-Purchase Intention AnalysisFindings1 citations
- Born Differently Makes a Difference: Counterfactual Study of Bias in Biography Generation from a Data-to-Text PerspectiveShort1 citations
- BotEval: Facilitating Interactive Human EvaluationSystem Demonstrations1 citations
- CACL: Community-Aware Heterogeneous Graph Contrastive Learning for Social Media Bot DetectionFindings1 citations
- CF-TCIR: A Compositor-Free Framework for Hierarchical Text-Conditioned Image RetrievalFindings1 citations
- CQIL: Inference Latency Optimization with Concurrent Computation of Quasi-Independent LayersLong1 citations
- Can Large Language Models Mine Interpretable Financial Factors More Effectively? A Neural-Symbolic Factor Mining Agent ModelFindings1 citations
- Can We Achieve High-quality Direct Speech-to-Speech Translation without Parallel Speech Data?Long1 citations
- CausalCite: A Causal Formulation of Paper CitationsFindings1 citations
- Characterizing Similarities and Divergences in Conversational Tones in Humans and LLMs by Sampling with PeopleLong1 citations
- Chinese Spoken Named Entity Recognition in Real-world Scenarios: Dataset and ApproachesFindings1 citations
- Choose Your Transformer: Improved Transferability Estimation of Transformer Models on Classification TasksFindings1 citations
- CoCA: Fusing Position Embedding with Collinear Constrained Attention in Transformers for Long Context Window ExtendingLong1 citations
- CoELM: Construction-Enhanced Language ModelingLong1 citations
- Coconut: Contextualized Commonsense Unified Transformers for Graph-Based Commonsense Augmentation of Language ModelsFindings1 citations
- CodeInsight: A Curated Dataset of Practical Coding Solutions from Stack OverflowFindings1 citations
- CodeM: Less Data Yields More Versatility via Ability MatrixFindings1 citations
- Collaboration or Corporate Capture? Quantifying NLP’s Reliance on Industry Artifacts and ContributionsLong1 citations
- Combating Label Sparsity in Short Text Topic Modeling via Nearest Neighbor AugmentationFindings1 citations
- Comparing Data Augmentation Methods for End-to-End Task-Oriented Dialog SystemsFindings1 citations
- ConTempo: A Unified Temporally Contrastive Framework for Temporal Relation ExtractionFindings1 citations
- Concept-aware Data Construction Improves In-context Learning of Language ModelsFindings1 citations
- Consistency Training by Synthetic Question Generation for Conversational Question AnsweringShort1 citations
- Context Consistency between Training and Inference in Simultaneous Machine TranslationLong1 citations
- Controlled Text Generation for Black-box Language Models via Score-based Progressive EditorLong1 citations
- Critical Learning Periods: Leveraging Early Training Dynamics for Efficient Data PruningFindings1 citations
- Cyclical Contrastive Learning Based on Geodesic for Zero-shot Cross-lingual Spoken Language UnderstandingFindings1 citations
- DIMSIM: Distilled Multilingual Critics for Indic Text SimplificationFindings1 citations
- DMIN: A Discourse-specific Multi-granularity Integration Network for Conversational Aspect-based Sentiment Quadruple AnalysisFindings1 citations
- DPDLLM: A Black-box Framework for Detecting Pre-training Data from Large Language ModelsFindings1 citations
- Debiasing In-Context Learning by Instructing LLMs How to Follow DemonstrationsFindings1 citations
- Debiasing Large Language Models with Structured KnowledgeFindings1 citations
- Decomposing Argumentative Essay Generation via Dialectical Planning of Complex ReasoningFindings1 citations
- Decomposing Co-occurrence Matrices into Interpretable Components as Formal ConceptsFindings1 citations
- Decoupled Vocabulary Learning Enables Zero-Shot Translation from Unseen LanguagesLong1 citations
- Description Boosting for Zero-Shot Entity and Relation ClassificationFindings1 citations
- Designing Informative Metrics for Few-Shot Example SelectionFindings1 citations
- DictLLM: Harnessing Key-Value Data Structures with Large Language Models for Enhanced Medical DiagnosticsFindings1 citations
- DiffuCOMET: Contextual Commonsense Knowledge DiffusionLong1 citations
- DiffusPoll: Conditional Text Diffusion Model for Poll GenerationFindings1 citations
- Direct Metric Optimization for Image Captioning through Reward-Weighted Augmented Data UtilizationLong1 citations
- Disambiguate Words like Composing Them: A Morphology-Informed Approach to Enhance Chinese Word Sense DisambiguationLong1 citations
- Discourse Structure-Aware Prefix for Generation-Based End-to-End Argumentation MiningFindings1 citations
- Disentangled Learning with Synthetic Parallel Data for Text Style TransferLong1 citations
- Distantly-Supervised Joint Extraction with Noise-Robust LearningFindings1 citations
- DistillMIKE: Editing Distillation of Massive In-Context Knowledge Editing in Large Language ModelsFindings1 citations
- Distilling Robustness into Natural Language Inference Models with Domain-Targeted AugmentationFindings1 citations
- Diving Deep into the Motion Representation of Video-Text ModelsFindings1 citations
- Do Zombies Understand? A Choose-Your-Own-Adventure Exploration of Machine CognitionFindings1 citations
- Domain Adaptation for Subjective Induction Questions Answering on Products by Adversarial Disentangled LearningLong1 citations
- Domain-Aware k-Nearest-Neighbor Knowledge Distillation for Machine TranslationFindings1 citations
- DrugWatch: A Comprehensive Multi-Source Data Visualisation Platform for Drug Safety InformationSystem Demonstrations1 citations
- DynaSemble: Dynamic Ensembling of Textual and Structure-Based Models for Knowledge Graph CompletionShort1 citations
- ECoK: Emotional Commonsense Knowledge Graph for Mining Emotional GoldFindings1 citations
- ETAS: Zero-Shot Transformer Architecture Search via Network Trainability and ExpressivityFindings1 citations
- EVIT: Event-Oriented Instruction Tuning for Event ReasoningFindings1 citations
- EasyInstruct: An Easy-to-use Instruction Processing Framework for Large Language ModelsSystem Demonstrations1 citations
- EcoRank: Budget-Constrained Text Re-ranking Using Large Language ModelsFindings1 citations
- Effective In-Context Example Selection through Data CompressionFindings1 citations
- EmoTransKG: An Innovative Emotion Knowledge Graph to Reveal Emotion TransformationFindings1 citations
- Empowering Character-level Text Infilling by Eliminating Sub-TokensLong1 citations
- Encoding Hierarchical Schema via Concept Flow for Multifaceted Ideology DetectionFindings1 citations
- Enhancing Contrastive Learning with Noise-Guided Attack: Towards Continual Relation Extraction in the WildLong1 citations
- Enhancing Cross Text-Molecule Learning by Self-AugmentationFindings1 citations
- Enhancing Idiomatic Representation in Multiple Languages via an Adaptive Contrastive Triplet LossFindings1 citations
- Enhancing Numerical Reasoning with the Guidance of Reliable Reasoning ProcessesLong1 citations
- Enhancing Sentence Simplification in Portuguese: Leveraging Paraphrases, Context, and Linguistic FeaturesFindings1 citations
- Estimating the Level of Dialectness Predicts Inter-annotator Agreement in Multi-dialect Arabic DatasetsShort1 citations
- Evaluating Robustness of Generative Search Engine on Adversarial Factoid QuestionsFindings1 citations
- Evaluating Structural Generalization in Neural Machine TranslationFindings1 citations
- Ex3: Automatic Novel Writing by Extracting, Excelsior and ExpandingLong1 citations
- Explicating the Implicit: Argument Detection Beyond Sentence BoundariesLong1 citations
- Exploiting Intrinsic Multilateral Logical Rules for Weakly Supervised Natural Language Video LocalizationLong1 citations
- Exploiting Positional Bias for Query-Agnostic Generative Content in SearchFindings1 citations
- Exploring Alignment in Shared Cross-lingual SpacesLong1 citations
- Exploring the Potential of Dense Information in Multimodal AlignmentFindings1 citations
- Extracting and Encoding: Leveraging Large Language Models and Medical Knowledge to Enhance Radiological Text RepresentationFindings1 citations
- FRVA: Fact-Retrieval and Verification Augmented Entailment Tree Generation for Explainable Question AnsweringFindings1 citations
- Faithful Chart Summarization with ChaTS-PiLong1 citations
- FastFiD: Improve Inference Efficiency of Open Domain Question Answering via Sentence SelectionLong1 citations
- Feature-Adaptive and Data-Scalable In-Context LearningLong1 citations
- Fine-tuning Language Models for Joint Rewriting and Completion of Code with Potential BugsFindings1 citations
- Fine-tuning with HED-IT: The impact of human post-editing for dialogical language modelsFindings1 citations
- FragRel: Exploiting Fragment-level Relations in the External Memory of Large Language ModelsFindings1 citations
- Functional Overlap Reranking for Neural Code GenerationFindings1 citations
- Fundus: A Simple-to-Use News Scraper Optimized for High Quality ExtractionsSystem Demonstrations1 citations
- GATE X-E : A Challenge Set for Gender-Fair Translations from Weakly-Gendered LanguagesFindings1 citations
- GLIMPSE: Pragmatically Informative Multi-Document Summarization for Scholarly ReviewsLong1 citations
- GRADUAL: Granularity-aware Dual Prototype Learning for Better Few-Shot Relation ExtractionFindings1 citations
- GenGO: ACL Paper Explorer with Semantic FeaturesSystem Demonstrations1 citations
- Generating and Evaluating Plausible Explanations for Knowledge Graph CompletionLong1 citations
- Guidance-Based Prompt Data Augmentation in Specialized Domains for Named Entity RecognitionShort1 citations
- GunStance: Stance Detection for Gun Control and Gun RegulationLong1 citations
- Harvesting Events from Multiple Sources: Towards a Cross-Document Event Extraction ParadigmFindings1 citations
- How Good is Zero-Shot MT Evaluation for Low Resource Indian Languages?Short1 citations
- How Important is a Language Model for Low-resource ASR?Findings1 citations
- Hypergraph based Understanding for Document Semantic Entity RecognitionLong1 citations
- ITAKE: Interactive Unstructured Text Annotation and Knowledge Extraction System with LLMs and ModelOpsSystem Demonstrations1 citations
- Improving Multi-hop Logical Reasoning in Knowledge Graphs with Context-Aware Query Representation LearningFindings1 citations
- Improving Multilingual Neural Machine Translation by Utilizing Semantic and Linguistic FeaturesFindings1 citations
- Inducing Systematicity in Transformers by Attending to Structurally Quantized EmbeddingsLong1 citations
- Insert or Attach: Taxonomy Completion via Box EmbeddingLong1 citations
- InstructEd: Soft-Instruction Tuning for Model Editing with HopsFindings1 citations
- Integrating Multi-scale Contextualized Information for Byte-based Neural Machine TranslationFindings1 citations
- Into the Unknown: Generating Geospatial Descriptions for New EnvironmentsFindings1 citations
- Intuitive or Dependent? Investigating LLMs’ Behavior Style to Conflicting PromptsLong1 citations
- It takes two to borrow: a donor and a recipient. Who’s who?Findings1 citations
- JORA: JAX Tensor-Parallel LoRA Library for Retrieval Augmented Fine-TuningSystem Demonstrations1 citations
- KPEval: Towards Fine-Grained Semantic-Based Keyphrase EvaluationFindings1 citations
- LEMON: Reviving Stronger and Smaller LMs from Larger LMs with Linear Parameter FusionLong1 citations
- Label Augmentation for Zero-Shot Hierarchical Text ClassificationLong1 citations
- Language Model Adaption for Reinforcement Learning with Natural Language Action SpaceLong1 citations
- Language Models Don’t Learn the Physical Manifestation of LanguageLong1 citations
- Large Language Models can Share Images, Too!Findings1 citations
- Learning Job Title Representation from Job Description Aggregation NetworkFindings1 citations
- Learning Multimodal Contrast with Cross-modal Memory and Reinforced Contrast RecognitionFindings1 citations
- Length-aware Byte Pair Encoding for Mitigating Over-segmentation in Korean Machine TranslationFindings1 citations
- Leveraging Collection-Wide Similarities for Unsupervised Document Structure ExtractionFindings1 citations
- Lexicon-Level Contrastive Visual-Grounding Improves Language ModelingFindings1 citations
- Linguistically Conditioned Semantic Textual SimilarityLong1 citations
- MAP’s not dead yet: Uncovering true language model modes by conditioning away degeneracyLong1 citations
- MATTER: Memory-Augmented Transformer Using Heterogeneous Knowledge SourcesFindings1 citations
- MTP: A Dataset for Multi-Modal Turning Points in Casual ConversationsShort1 citations
- MULFE: A Multi-Level Benchmark for Free Text Model EditingLong1 citations
- MaskLID: Code-Switching Language Identification through Iterative MaskingShort1 citations
- Match More, Extract Better! Hybrid Matching Model for Open Domain Web Keyphrase ExtractionFindings1 citations
- Mitigating Data Scarcity in Semantic Parsing across Languages with the Multilingual Semantic Layer and its DatasetFindings1 citations
- MrRank: Improving Question Answering Retrieval System through Multi-Result Ranking ModelFindings1 citations
- Multi-Task Transfer Matters During Instruction-TuningFindings1 citations
- Navigating the Shadows: Unveiling Effective Disturbances for Modern AI Content DetectorsLong1 citations
- Non-Autoregressive Machine Translation as Constrained HMMFindings1 citations
- On Efficiently Representing Regular Languages as RNNsFindings1 citations
- On the Effect of (Near) Duplicate Subwords in Language ModellingFindings1 citations
- On the Semantic Latent Space of Diffusion-Based Text-To-Speech ModelsShort1 citations
- PACIT: Unlocking the Power of Examples for Better In-Context Instruction TuningFindings1 citations
- PITA: Prompting Task Interaction for Argumentation MiningLong1 citations
- POP-CEE: Position-oriented Prompt-tuning Model for Causal Emotion EntailmentFindings1 citations
- PPTSER: A Plug-and-Play Tag-guided Method for Few-shot Semantic Entity Recognition on Visually-rich DocumentsFindings1 citations
- Part-of-speech Tagging for Extremely Low-resource Indian LanguagesFindings1 citations
- Perspective Taking through Generating Responses to Conflict SituationsFindings1 citations
- Phased Instruction Fine-Tuning for Large Language ModelsFindings1 citations
- Picturing Ambiguity: A Visual Twist on the Winograd Schema ChallengeLong1 citations
- Pinpointing Diffusion Grid Noise to Enhance Aspect Sentiment Quad PredictionFindings1 citations
- Plan, Generate and Complicate: Improving Low-resource Dialogue State Tracking via Easy-to-Difficult Zero-shot Data AugmentationFindings1 citations
- Poor-Supervised Evaluation for SuperLLM via Mutual ConsistencyFindings1 citations
- Pouring Your Heart Out: Investigating the Role of Figurative Language in Online Expressions of EmpathyLong1 citations
- Prompted Aspect Key Point Analysis for Quantitative Review SummarizationLong1 citations
- Pruning Large Language Models to Intra-module Low-rank Architecture with Transitional ActivationsFindings1 citations
- RIFF: Learning to Rephrase Inputs for Few-shot Fine-tuning of Language ModelsFindings1 citations
- Refining Corpora from a Model Calibration Perspective for Chinese Spelling CorrectionFindings1 citations
- Representation Learning with Conditional Information Flow MaximizationLong1 citations
- Revisiting Interpolation Augmentation for Speech-to-Text GenerationFindings1 citations
- Revisiting Multimodal Transformers for Tabular Data with Text FieldsFindings1 citations
- Revisiting Parallel Context Windows: A Frustratingly Simple Alternative and Chain-of-Thought DeteriorationFindings1 citations
- S2GSL: Incorporating Segment to Syntactic Enhanced Graph Structure Learning for Aspect-based Sentiment AnalysisLong1 citations
- SAGA: A Participant-specific Examination of Story Alternatives and Goal Applicability for a Deeper Understanding of Complex EventsFindings1 citations
- SC2: Towards Enhancing Content Preservation and Style Consistency in Long Text Style TransferLong1 citations
- SDA: Semantic Discrepancy Alignment for Text-conditioned Image RetrievalFindings1 citations
- SPIN: Sparsifying and Integrating Internal Neurons in Large Language Models for Text ClassificationFindings1 citations
- SPOR: A Comprehensive and Practical Evaluation Method for Compositional Generalization in Data-to-Text GenerationLong1 citations
- STSPL-SSC: Semi-Supervised Few-Shot Short Text Clustering with Semantic text similarity Optimized Pseudo-LabelsFindings1 citations
- ScaLearn: Simple and Highly Parameter-Efficient Task Transfer by Learning to ScaleFindings1 citations
- Selective Prefix Tuning for Pre-trained Language ModelsFindings1 citations
- Semiparametric Token-Sequence Co-SupervisionLong1 citations
- Shoulders of Giants: A Look at the Degree and Utility of Openness in NLP ResearchShort1 citations
- Silent Signals, Loud Impact: LLMs for Word-Sense Disambiguation of Coded Dog WhistlesLong1 citations
- Space Decomposition for Sentence EmbeddingFindings1 citations
- Speech Sense Disambiguation: Tackling Homophone Ambiguity in End-to-End Speech TranslationLong1 citations
- Surgical Feature-Space Decomposition of LLMs: Why, When and How?Long1 citations
- Text Simplification via Adaptive TeachingFindings1 citations
- Textless Acoustic Model with Self-Supervised Distillation for Noise-Robust Expressive Speech-to-Speech TranslationFindings1 citations
- That’s Optional: A Contemporary Exploration of “that” Omission in English Subordinate ClausesShort1 citations
- The Power of Summary-Source AlignmentsFindings1 citations
- Thinking about how to extract: Energizing LLMs’ emergence capabilities for document-level event argument extractionFindings1 citations
- Token Alignment via Character Matching for Subword CompletionFindings1 citations
- Too Big to Fail: Larger Language Models are Disproportionately Resilient to Induction of Dementia-Related Linguistic AnomaliesFindings1 citations
- Toward Reliable Ad-hoc Scientific Information Extraction: A Case Study on Two Materials DatasetFindings1 citations
- Towards Better Understanding of Contrastive Sentence Representation Learning: A Unified Paradigm for GradientLong1 citations
- Towards Better Utilization of Multi-Reference Training Data for Chinese Grammatical Error CorrectionFindings1 citations
- Towards Multiple References Era – Addressing Data Leakage and Limited Reference Diversity in Machine Translation EvaluationFindings1 citations
- Towards Precise Localization of Critical Errors in Machine TranslationFindings1 citations
- Towards Unified Task Embeddings Across Multiple Models: Bridging the Gap for Prompt-Based Large Language Models and BeyondFindings1 citations
- Transitive Consistency Constrained Learning for Entity-to-Entity Stance DetectionLong1 citations
- Translation-based Lexicalization Generation and Lexical Gap Detection: Application to Kinship TermsLong1 citations
- Tree Transformer’s Disambiguation Ability of Prepositional Phrase Attachment and Garden Path EffectsLong1 citations
- Tree-Planted Transformers: Unidirectional Transformer Language Models with Implicit Syntactic SupervisionFindings1 citations
- Triple-Encoders: Representations That Fire Together, Wire TogetherLong1 citations
- Unexpected Phenomenon: LLMs’ Spurious Associations in Information ExtractionFindings1 citations
- Unsupervised Parsing by Searching for Frequent Word Sequences among Sentences with Equivalent Predicate-Argument StructuresFindings1 citations
- Unsupervised Sign Language Translation and GenerationFindings1 citations
- Unveiling the Art of Heading Design: A Harmonious Blend of Summarization, Neology, and AlgorithmFindings1 citations
- Unveiling the Power of Integration: Block Diagram Summarization through Local-Global FusionFindings1 citations
- Virtual Compiler Is All You Need For Assembly Code SearchLong1 citations
- What Makes Language Models Good-enough?Findings1 citations
- When Only Time Will Tell: Interpreting How Transformers Process Local Ambiguities Through the Lens of Restart-IncrementalityLong1 citations
- When Phrases Meet Probabilities: Enabling Open Relation Extraction with Cooperating Large Language ModelsLong1 citations
- Why Don’t Prompt-Based Fairness Metrics Correlate?Long1 citations
- XL-HeadTags: Leveraging Multimodal Retrieval Augmentation for the Multilingual Generation of News Headlines and TagsFindings1 citations
- Zero-shot Cross-lingual Alignment for Embedding InitializationFindings1 citations
- imapScore: Medical Fact Evaluation Made EasyFindings1 citations
- “Get Their Hands Dirty, Not Mine”: On Researcher-Annotator Collaboration and the Agency of AnnotatorsFindings1 citations
- A Causal Approach for Counterfactual Reasoning in NarrativesLong
- A Graph per Persona: Reasoning about Subjective Natural Language DescriptionsFindings
- A Large Collection of Model-generated Contradictory Responses for Consistency-aware Dialogue SystemsFindings
- A Tale of Two Revisions: Summarizing Changes Across Document VersionsFindings
- A Two-Agent Game for Zero-shot Relation Triplet ExtractionFindings
- Achilles-Bench: A Challenging Benchmark for Low-Resource EvaluationFindings
- Addressing Entity Translation Problem via Translation Difficulty and Context DiversityFindings
- Alignment-Based Decoding Policy for Low-Latency and Anticipation-Free Neural Japanese Input Method EditorsFindings
- All Languages Matter: On the Multilingual Safety of LLMsFindings
- American Sign Language Handshapes Reflect Pressures for Communicative EfficiencyLong
- An Ensemble-of-Experts Framework for Rehearsal-free Continual Relation ExtractionFindings
- Ancient Chinese Glyph Identification Powered by Radical SemanticsFindings
- Argument-Aware Approach To Event LinkingFindings
- BenchIE^FL: A Manually Re-Annotated Fact-Based Open Information Extraction BenchmarkFindings
- Beyond Recognising Entailment: Formalising Natural Language Inference from an Argumentative PerspectiveLong
- Beyond Scaling: Predicting Patent Approval with Domain-specific Fine-grained Claim Dependency GraphLong
- Bi-Chainer: Automated Large Language Models Reasoning with Bidirectional ChainingFindings
- Bi-Directional Multi-Granularity Generation Framework for Knowledge Graph-to-Text with Large Language ModelShort
- BinaryAlign: Word Alignment as Binary Sequence LabelingLong
- BloomVQA: Assessing Hierarchical Multi-modal ComprehensionFindings
- Boosting Textural NER with Synthetic Image and Instructive AlignmentFindings
- Bootstrapped Pre-training with Dynamic Identifier Prediction for Generative RetrievalFindings
- Bridging Word-Pair and Token-Level Metaphor Detection with Explainable Domain MiningLong
- CARE: A Clue-guided Assistant for CSRs to Read User ManualsLong
- CHARP: Conversation History AwaReness Probing for Knowledge-grounded Dialogue SystemsFindings
- CLASP: Cross-modal Alignment Using Pre-trained Unimodal ModelsFindings
- CMDL: A Large-Scale Chinese Multi-Defendant Legal Judgment Prediction DatasetFindings
- CR-LLM: A Dataset and Optimization for Concept Reasoning of Large Language ModelsFindings
- Chain-of-Question: A Progressive Question Decomposition Approach for Complex Knowledge Base Question AnsweringFindings
- Chain-of-Quizzes: Pedagogy-inspired Example Selection in In-Context-LearningFindings
- Character-Level Chinese Dependency Parsing via Modeling Latent Intra-Word StructureFindings
- Compositional Generalization with Grounded Language ModelsFindings
- Context-Aware Tracking and Dynamic Introduction for Incomplete Utterance Rewriting in Extended Multi-Turn DialoguesFindings
- ContextBLIP: Doubly Contextual Alignment for Contrastive Image Retrieval from Linguistically Complex DescriptionsFindings
- Continual Few-shot Relation Extraction via Adaptive Gradient Correction and Knowledge DecompositionFindings
- Conversational Question Answering with Language Models Generated Reformulations over Knowledge GraphFindings
- Crayon: Customized On-Device LLM via Instant Adapter Blending and Edge-Server Hybrid InferenceLong
- DADA: Distribution-Aware Domain Adaptation of PLMs for Information RetrievalFindings
- DBQR-QA: A Question Answering Dataset on a Hybrid of Database Querying and ReasoningFindings
- DDPrompt: Differential Diversity Prompting in Large Language ModelsShort
- DRAGIN: Dynamic Retrieval Augmented Generation based on the Real-time Information Needs of Large Language ModelsLong
- Data-Centric Explainable Debiasing for Improving Fairness in Pre-trained Language ModelsFindings
- Deep Exploration of Cross-Lingual Zero-Shot Generalization in Instruction TuningFindings
- Demonstrations Are All You Need: Advancing Offensive Content Paraphrasing using In-Context LearningFindings
- Dependency Transformer Grammars: Integrating Dependency Structures into Transformer Language ModelsLong
- Deterministic Reversible Data Augmentation for Neural Machine TranslationFindings
- Developing PUGG for Polish: A Modern Approach to KBQA, MRC, and IR Dataset ConstructionFindings
- Discovering influential text using convolutional neural networksFindings
- Discursive Socratic Questioning: Evaluating the Faithfulness of Language Models’ Understanding of Discourse RelationsLong
- Distributional Inclusion Hypothesis and Quantifications: Probing for Hypernymy in Functional Distributional SemanticsLong
- DocLens: Multi-aspect Fine-grained Medical Text EvaluationLong
- Don’t Rank, Combine! Combining Machine Translation Hypotheses Using Quality EstimationLong
- Dual-Stage Multi-Task Syntax-Oriented Pre-Training for Syntactically Controlled Paraphrase GenerationFindings
- EFSA: Towards Event-Level Financial Sentiment AnalysisLong
- EHR-SeqSQL : A Sequential Text-to-SQL Dataset For Interactively Exploring Electronic Health RecordsFindings
- ELLA: Empowering LLMs for Interpretable, Accurate and Informative Legal AdviceSystem Demonstrations
- Efficient Training of Language Models with Compact and Consistent Next Token DistributionsFindings
- Efficient k-Nearest-Neighbor Machine Translation with Dynamic RetrievalFindings
- Embodied Language Learning: Opportunities, Challenges, and Future DirectionsFindings
- End-to-End Emotion Semantic ParsingFindings
- Enhancing Reinforcement Learning with Label-Sensitive Reward for Natural Language UnderstandingLong
- Episodic Memory Retrieval from LLMs: A Neuromorphic Mechanism to Generate Commonsense Counterfactuals for Relation ExtractionFindings
- Estimating Agreement by Chance for Sequence AnnotationLong
- Exciting Mood Changes: A Time-aware Hierarchical Transformer for Change Detection ModellingFindings
- Exploiting Target Language Data for Neural Machine Translation Beyond Back TranslationFindings
- Exploring Conditional Variational Mechanism to Pinyin Input Method for Addressing One-to-Many Mappings in Low-Resource ScenariosShort
- Exploring Domain Robust Lightweight Reward Models based on Router MechanismFindings
- F-Eval: Asssessing Fundamental Abilities with Refined Evaluation MethodsLong
- Fast Randomized Low-Rank Adaptation of Pre-trained Language Models with PAC RegularizationFindings
- Favi-Score: A Measure for Favoritism in Automated Preference Ratings for Generative AI EvaluationLong
- Figuratively Speaking: Authorship Attribution via Multi-Task Figurative Language ModelingFindings
- Fooling the Textual Fooler via Randomizing Latent RepresentationsFindings
- Framing in the Presence of Supporting Data: A Case Study in U.S. Economic NewsLong
- From Model-centered to Human-Centered: Revision Distance as a Metric for Text Evaluation in LLMs-based ApplicationsFindings
- Generating Contrastive Narratives Using the Brownian Bridge Process for Narrative Coherence LearningLong
- Graph Language ModelsLong
- Growing Trees on Sounds: Assessing Strategies for End-to-End Dependency Parsing of SpeechShort
- Hide and Seek in Noise Labels: Noise-Robust Collaborative Active Learning with LLMs-Powered AssistanceLong
- How Much Does Nonverbal Communication Conform to Entropy Rate Constancy?: A Case Study on Listener Gaze in InteractionFindings
- How to Engage your Readers? Generating Guiding Questions to Promote Active ReadingLong
- Identifying and Mitigating Annotation Bias in Natural Language Understanding using Causal Mediation AnalysisFindings
- Impacts of Misspelled Queries on Translation and Product SearchLong
- Improving the Robustness of Distantly-Supervised Named Entity Recognition via Uncertainty-Aware Teacher Learning and Student-Student Collaborative LearningFindings
- InfiMM: Advancing Multimodal Understanding with an Open-Sourced Visual Language ModelFindings
- Intrinsic Task-based Evaluation for Referring Expression GenerationLong
- Investigating the Impact of Model Instability on Explanations and UncertaintyFindings
- It is Simple Sometimes: A Study On Improving Aspect-Based Sentiment Analysis PerformanceFindings
- KEEP CHATTING! An Attractive Dataset for Continuous Conversation AgentsFindings
- KOMBO: Korean Character Representations Based on the Combination Rules of SubcharactersFindings
- Knowledge-Driven Cross-Document Relation ExtractionFindings
- LIEDER: Linguistically-Informed Evaluation for Discourse Entity RecognitionLong
- LJPCheck: Functional Tests for Legal Judgment PredictionFindings
- Language Model Priors and Data Augmentation Strategies for Low-resource Machine Translation: A Case Study Using Finnish to Northern SámiFindings
- Large Language Models Can Learn Representation in Natural LanguageFindings
- Latent Learningscape Guided In-context LearningFindings
- LePaRD: A Large-Scale Dataset of Judicial Citations to PrecedentLong
- Learning Adverbs with Spectral Mixture KernelsFindings
- Learning Low-dimensional Multi-domain Knowledge Graph Embedding via Dual Archimedean SpiralsFindings
- Leveraging Entailment Judgements in Cross-Lingual SummarisationFindings
- Leveraging Entity Information for Cross-Modality Correlation Learning: The Entity-Guided Multimodal SummarizationFindings
- Light Up the Shadows: Enhance Long-Tailed Entity Grounding with Concept-Guided Vision-Language ModelsFindings
- Linear Cross-Lingual Mapping of Sentence EmbeddingsFindings
- MEEL: Multi-Modal Event Evolution LearningFindings
- MIDGARD: Self-Consistency Using Minimum Description Length for Structured Commonsense ReasoningLong
- MODABS: Multi-Objective Learning for Dynamic Aspect-Based SummarizationFindings
- MODDP: A Multi-modal Open-domain Chinese Dataset for Dialogue Discourse ParsingFindings
- Modelling Commonsense Commonalities with Multi-Facet Concept EmbeddingsFindings
- More frequent verbs are associated with more diverse valency frames: Efficient principles at the lexicon-grammar interfaceLong
- More than Minorities and Majorities: Understanding Multilateral Bias in Language GenerationFindings
- Multimodal Contextualized Semantic Parsing from SpeechLong
- Multipath parsing in the brainLong
- MusTQ: A Temporal Knowledge Graph Question Answering Dataset for Multi-Step Temporal ReasoningFindings
- NUMCoT: Numerals and Units of Measurement in Chain-of-Thought Reasoning using Large Language ModelsFindings
- Naming, Describing, and Quantifying Visual Objects in Humans and LLMsShort
- Non-compositional Expression Generation and its Continual LearningFindings
- OLIVE: Object Level In-Context Visual EmbeddingsLong
- OTTAWA: Optimal TransporT Adaptive Word Aligner for Hallucination and Omission Translation Errors DetectionFindings
- On the Hallucination in Simultaneous Machine TranslationShort
- On the Language Encoder of Contrastive Cross-modal ModelsFindings
- On the Relationship Between RNN Hidden-State Vectors and Semantic StructuresFindings
- On the Robustness of Document-Level Relation Extraction Models to Entity Name VariationsFindings
- Open Grounded Planning: Challenges and Benchmark ConstructionLong
- OpenVNA: A Framework for Analyzing the Behavior of Multimodal Language Understanding System under Noisy ScenariosSystem Demonstrations
- Overcoming Catastrophic Forgetting by Exemplar Selection in Task-oriented Dialogue SystemFindings
- P-TA: Using Proximal Policy Optimization to Enhance Tabular Data Augmentation via Large Language ModelsFindings
- P4: Plug-and-Play Discrete Prompting for Large Language Models PersonalizationFindings
- PAGED: A Benchmark for Procedural Graphs Extraction from DocumentsLong
- PEK: A Parameter-Efficient Framework for Knowledge-Grounded Dialogue GenerationFindings
- PairCFR: Enhancing Model Training on Paired Counterfactually Augmented Data through Contrastive LearningLong
- Perturbed examples reveal invariances shared by language modelsFindings
- PolCLIP: A Unified Image-Text Word Sense Disambiguation Model via Generating Multimodal Complementary RepresentationsLong
- Predicting Narratives of Climate Obstruction in Social Media AdvertisingFindings
- Predicting the Unpredictable: Uncertainty-Aware Reasoning over Temporal Knowledge Graphs via Diffusion ProcessFindings
- Probing the Uniquely Identifiable Linguistic Patterns of Conversational AI AgentsFindings
- PyFoma: a Python finite-state compiler moduleSystem Demonstrations
- REInstruct: Building Instruction Data from Unlabeled CorpusFindings
- RESEMO: A Benchmark Chinese Dataset for Studying Responsive Emotion from Social Media ContentFindings
- Ranking Entities along Conceptual Space Dimensions with LLMs: An Analysis of Fine-Tuning StrategiesFindings
- Rationales for Answers to Simple Math Word Problems Confuse Large Language ModelsFindings
- Re-Tuning: Overcoming the Compositionality Limits of Large Language Models with Recursive TuningLong
- RePALM: Popular Quote Tweet Generation via Auto-Response AugmentationFindings
- Real World Conversational Entity Linking Requires More Than Zero-ShotsFindings
- Resisting the Lure of the Skyline: Grounding Practices in Active Learning for Morphological InflectionShort
- Rethinking Efficient Multilingual Text Summarization Meta-EvaluationFindings
- Revisiting Structured Sentiment Analysis as Latent Dependency Graph ParsingLong
- Reward-based Input Construction for Cross-document Relation ExtractionLong
- SKGSum: Structured Knowledge-Guided Document SummarizationFindings
- SPZ: A Semantic Perturbation-based Data Augmentation Method with Zonal-Mixing for Alzheimer’s Disease DetectionLong
- Safety Alignment in NLP Tasks: Weakly Aligned Summarization as an In-Context AttackLong
- Selectively Answering Visual QuestionsFindings
- Self-Contrast: Better Reflection Through Inconsistent Solving PerspectivesLong
- Semantic Compression for Word and Sentence Embeddings using Discrete Wavelet TransformFindings
- Semantic Skill Grounding for Embodied Instruction-Following in Cross-Domain EnvironmentsFindings
- Semi-Supervised Spoken Language GlossificationLong
- Sign Language Translation with Sentence Embedding SupervisionShort
- Simplifying Translations for Children: Iterative Simplification Considering Age of Acquisition with LLMsFindings
- SparseFlow: Accelerating Transformers by Sparsifying Information FlowsLong
- Speech vs. Transcript: Does It Matter for Human Annotators in Speech Summarization?Long
- Stronger, Lighter, Better: Towards Life-Long Attribute Value Extraction for E-Commerce ProductsFindings
- Structural Optimization Ambiguity and Simplicity Bias in Unsupervised Neural Grammar InductionFindings
- Structured Tree Alignment for Evaluation of (Speech) Constituency ParsingLong
- SymTax: Symbiotic Relationship and Taxonomy Fusion for Effective Citation RecommendationFindings
- Synthesizing Conversations from Unlabeled Documents using Automatic Response SegmentationFindings
- TAME-RD: Text Assisted Replication of Image Multi-Adjustments for Reverse DesigningFindings
- TAMS: Translation-Assisted Morphological SegmentationLong
- Tailoring with Targeted Precision: Edit-Based Agents for Open-Domain Procedure CustomizationFindings
- Temporal Validity Change PredictionFindings
- Text2DB: Integration-Aware Information Extraction with Large Language Model AgentsFindings
- The PGNSC Benchmark: How Do We Predict Where Information Spreads?Findings
- The State of Relation Extraction Data Quality: Is Bigger Always Better?Findings
- Token-wise Influential Training Data Retrieval for Large Language ModelsLong
- Towards Better Graph-based Cross-document Relation Extraction via Non-bridge Entity Enhancement and Prediction DebiasingFindings
- Towards Multi-Relational Multi-Hop Reasoning over Dense Temporal Knowledge GraphsFindings
- Towards Understanding Task-agnostic Debiasing Through the Lenses of Intrinsic Bias and ForgetfulnessFindings
- Towards a new research agenda for multimodal enterprise document understanding: What are we missing?Findings
- Transition-based Opinion Generation for Aspect-based Sentiment AnalysisFindings
- Two-Pronged Human Evaluation of ChatGPT Self-Correction in Radiology Report SimplificationFindings
- UltraLink: An Open-Source Knowledge-Enhanced Multilingual Supervised Fine-tuning DatasetLong
- UltraSparseBERT: 99% Conditionally Sparse Language ModellingShort
- Uncertainty-Guided Modal Rebalance for Hateful Memes DetectionLong
- Understanding and Addressing the Under-Translation Problem from the Perspective of Decoding ObjectiveLong
- Unveiling Imitation Learning: Exploring the impact of Data Falsity to Large Language ModelFindings
- VAEGPT-Sim: Improving Sentence Representation with Limited Corpus Using Gradually-Denoising VAEFindings
- Visualizing Dialogues: Enhancing Image Selection through Dialogue Understanding with Large Language ModelsFindings
- WRP: Weight Recover Prune for Structured SparsityLong
- What Does Parameter-free Probing Really Uncover?Short
- What Have We Achieved on Non-autoregressive Translation?Findings
- Which Information Matters? Dissecting Human-written Multi-document Summaries with Partial Information DecompositionFindings
- Whose Preferences? Differences in Fairness Preferences and Their Impact on the Fairness of AI Utilizing Human FeedbackLong
- Word Sense Linking: Disambiguating Outside the SandboxFindings
- XMC-Agent : Dynamic Navigation over Scalable Hierarchical Index for Incremental Extreme Multi-label ClassificationFindings
- ZeroStance: Leveraging ChatGPT for Open-Domain Stance Detection via Dataset GenerationFindings
ACL accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.