ACL 2023 Accepted Papers
The full list of 2,052 papers accepted at ACL 2023 (Association for Computational Linguistics). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Long: 911Findings: 901Short: 164Industry: 76
- Self-Instruct: Aligning Language Models with Self-Generated InstructionsLong2,098 citations
- NusaCrowd: Open Source Initiative for Indonesian NLP ResourcesFindings1,114 citations
- Towards Reasoning in Large Language Models: A SurveyFindings818 citations
- Crosslingual Generalization through Multitask FinetuningLong770 citations
- Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve ThemFindings698 citations
- Can Large Language Models Be an Alternative to Human Evaluations?Long560 citations
- Distilling Step-by-Step! Outperforming Larger Language Models with Less Training Data and Smaller Model SizesFindings501 citations
- When Not to Trust Language Models: Investigating Effectiveness of Parametric and Non-Parametric MemoriesLong501 citations
- Why Can GPT Learn In-Context? Language Models Secretly Perform Gradient Descent as Meta-OptimizersFindings421 citations
- Interleaving Retrieval with Chain-of-Thought Reasoning for Knowledge-Intensive Multi-Step QuestionsLong382 citations
- MathPrompter: Mathematical Reasoning using Large Language ModelsIndustry344 citations
- DiffusionDB: A Large-scale Prompt Gallery Dataset for Text-to-Image Generative ModelsLong340 citations
- Large Language Models Are Reasoning TeachersLong338 citations
- Unnatural Instructions: Tuning Language Models with (Almost) No Human LaborLong329 citations
- Contrastive Decoding: Open-ended Text Generation as OptimizationLong322 citations
- LLM-Blender: Ensembling Large Language Models with Pairwise Ranking and Generative FusionLong321 citations
- Precise Zero-Shot Dense Retrieval without Relevance LabelsLong309 citations
- Reasoning with Language Model Prompting: A SurveyLong301 citations
- RARR: Researching and Revising What Language Models Say, Using Language ModelsLong297 citations
- Discovering Language Model Behaviors with Model-Written EvaluationsFindings290 citations
- One Embedder, Any Task: Instruction-Finetuned Text EmbeddingsFindings287 citations
- Teaching Small Language Models to ReasonShort265 citations
- From Pretraining Data to Language Models to Downstream Tasks: Tracking the Trails of Political Biases Leading to Unfair NLP ModelsLong256 citations
- Is GPT-3 a Good Data Annotator?Long256 citations
- Revisiting Relation Extraction in the era of Large Language ModelsLong240 citations
- Plan-and-Solve Prompting: Improving Zero-Shot Chain-of-Thought Reasoning by Large Language ModelsLong229 citations
- In-context Examples Selection for Machine TranslationFindings213 citations
- Do Large Language Models Know What They Don’t Know?Findings208 citations
- Knowledge Unlearning for Mitigating Privacy Risks in Language ModelsLong202 citations
- Evaluating Open-Domain Question Answering in the Era of Large Language ModelsLong198 citations
- On Second Thought, Let’s Not Think Step by Step! Bias and Toxicity in Zero-Shot ReasoningLong197 citations
- Making Language Models Better Reasoners with Step-Aware VerifierLong185 citations
- Marked Personas: Using Natural Language Prompts to Measure Stereotypes in Language ModelsLong180 citations
- Membership Inference Attacks against Language Models via Neighbourhood ComparisonFindings180 citations
- Large Language Models Meet NL2Code: A SurveyLong177 citations
- What the DAAM: Interpreting Stable Diffusion Using Cross AttentionLong171 citations
- Prompting PaLM for Translation: Assessing Strategies and PerformanceLong170 citations
- A Length-Extrapolatable TransformerLong166 citations
- A Systematic Study and Comprehensive Evaluation of ChatGPT on Benchmark DatasetsFindings165 citations
- AlignScore: Evaluating Factual Consistency with A Unified Alignment FunctionLong158 citations
- Verify-and-Edit: A Knowledge-Enhanced Chain-of-Thought FrameworkLong155 citations
- A Survey of Deep Learning for Mathematical ReasoningLong152 citations
- Self-Adaptive In-Context Learning: An Information Compression Perspective for In-Context Example Selection and OrderingLong151 citations
- Instruction Induction: From Few Examples to Natural Language Task DescriptionsLong148 citations
- Large Language Models with Controllable Working MemoryFindings148 citations
- Reasoning Implicit Sentiment with Chain-of-Thought PromptingShort145 citations
- Few-shot Fine-tuning vs. In-context Learning: A Fair Comparison and EvaluationFindings138 citations
- Diverse Demonstrations Improve In-context Compositional GeneralizationLong136 citations
- Distilling Reasoning Capabilities into Smaller Language ModelsFindings135 citations
- Increasing Diversity While Maintaining Accuracy: Text Data Generation with Large Language Models and Human InterventionsLong135 citations
- Analyzing Transformers in Embedding SpaceLong133 citations
- Unified Demonstration Retriever for In-Context LearningLong133 citations
- Revealing Single Frame Bias for Video-and-Language LearningLong132 citations
- Fact-Checking Complex Claims with Program-Guided ReasoningLong126 citations
- DiffusionBERT: Improving Generative Masked Language Models with Diffusion ModelsLong125 citations
- Symbolic Chain-of-Thought Distillation: Small Models Can Also “Think” Step-by-StepLong124 citations
- MASSIVE: A 1M-Example Multilingual Natural Language Understanding Dataset with 51 Typologically-Diverse LanguagesLong123 citations
- Self-Edit: Fault-Aware Code Editor for Code GenerationLong121 citations
- Evaluating the Factual Consistency of Large Language Models Through News SummarizationFindings118 citations
- NUWA-XL: Diffusion over Diffusion for eXtremely Long Video GenerationLong118 citations
- MultiInstruct: Improving Multi-Modal Zero-Shot Learning via Instruction TuningLong117 citations
- Parallel Context Windows for Large Language ModelsLong116 citations
- Revisiting the Gold Standard: Grounding Summarization Evaluation with Robust Human EvaluationLong116 citations
- SimLM: Pre-training with Representation Bottleneck for Dense Passage RetrievalLong114 citations
- Few-shot In-context Learning on Knowledge Base Question AnsweringLong113 citations
- Task-aware Retrieval with InstructionsFindings111 citations
- RL4F: Generating Natural Language Feedback with Reinforcement Learning for Repairing Model OutputsLong106 citations
- DePlot: One-shot visual language reasoning by plot-to-table translationFindings105 citations
- FedPETuning: When Federated Learning Meets the Parameter-Efficient Tuning Methods of Pre-trained Language ModelsFindings103 citations
- SCOTT: Self-Consistent Chain-of-Thought DistillationLong103 citations
- Sequence Parallelism: Long Sequence Training from System PerspectiveLong102 citations
- Unlearning Bias in Language Models by Partitioning GradientsFindings102 citations
- Don’t Generate, Discriminate: A Proposal for Grounding Language Models to Real-World EnvironmentsLong100 citations
- What In-Context Learning “Learns” In-Context: Disentangling Task Recognition and Task LearningFindings100 citations
- Knowledge of cultural moral norms in large language modelsLong98 citations
- Randomized Positional Encodings Boost Length Generalization of TransformersShort97 citations
- Solving Math Word Problems via Cooperative Reasoning induced Language ModelsLong97 citations
- Synthetic Text Generation with Differential Privacy: A Simple and Practical RecipeLong97 citations
- Towards Understanding Chain-of-Thought Prompting: An Empirical Study of What MattersLong95 citations
- Federated Learning of Gboard Language Models with Differential PrivacyIndustry94 citations
- MatCha: Enhancing Visual Language Pretraining with Math Reasoning and Chart DerenderingLong94 citations
- “Low-Resource” Text Classification: A Parameter-Free Classification Method with CompressorsFindings94 citations
- Code4Struct: Code Generation for Few-Shot Event Structure PredictionLong92 citations
- WinoQueer: A Community-in-the-Loop Benchmark for Anti-LGBTQ+ Bias in Large Language ModelsLong92 citations
- A Critical Evaluation of Evaluations for Long-form Question AnsweringLong91 citations
- GLUE-X: Evaluating Natural Language Understanding Models from an Out-of-Distribution Generalization PerspectiveFindings90 citations
- Scene Graph as Pivoting: Inference-time Image-free Unsupervised Multimodal Machine Translation with Visual Scene HallucinationLong90 citations
- Understanding Factual Errors in Summarization: Errors, Summarizers, Datasets, Error DetectorsLong89 citations
- A fine-grained comparison of pragmatic language understanding in humans and language modelsLong88 citations
- Glot500: Scaling Multilingual Corpora and Language Models to 500 LanguagesLong88 citations
- AVATAR: A Parallel Corpus for Java-Python Program TranslationFindings87 citations
- Information Screening whilst Exploiting! Multimodal Relation Extraction with Feature Denoising and Multimodal Topic ModelingLong87 citations
- ConFEDE: Contrastive Feature Decomposition for Multimodal Sentiment AnalysisLong86 citations
- LAMBADA: Backward Chaining for Automated Reasoning in Natural LanguageLong86 citations
- SSD-LM: Semi-autoregressive Simplex-based Diffusion Language Model for Text Generation and Modular ControlLong86 citations
- Do Androids Laugh at Electric Sheep? Humor “Understanding” Benchmarks from The New Yorker Caption ContestLong85 citations
- WebCPM: Interactive Web Search for Chinese Long-form Question AnsweringLong85 citations
- AltCLIP: Altering the Language Encoder in CLIP for Extended Language CapabilitiesFindings84 citations
- Complementary Explanations for Effective In-Context LearningFindings83 citations
- Accelerating Transformer Inference for Translation via Parallel DecodingLong82 citations
- Cognitive Reframing of Negative Thoughts through Human-Language Model InteractionLong82 citations
- Factually Consistent Summarization via Reinforcement Learning with Textual Entailment FeedbackLong82 citations
- Robust Multi-bit Natural Language Watermarking through Invariant FeaturesLong82 citations
- MolXPT: Wrapping Molecules with Text for Generative Pre-trainingShort81 citations
- VisText: A Benchmark for Semantically Rich Chart CaptioningLong81 citations
- CodeIE: Large Code Generation Models are Better Few-Shot Information ExtractorsLong79 citations
- Towards Benchmarking and Improving the Temporal Reasoning Capability of Large Language ModelsLong79 citations
- Minding Language Models’ (Lack of) Theory of Mind: A Plug-and-Play Multi-Character Belief TrackerLong77 citations
- Aligning Instruction Tasks Unlocks Large Language Models as Zero-Shot Relation ExtractorsFindings76 citations
- NLPositionality: Characterizing Design Biases of Datasets and ModelsLong76 citations
- DISCO: Distilling Counterfactuals with Large Language ModelsLong75 citations
- Element-aware Summarization with Large Language Models: Expert-aligned Evaluation and Chain-of-Thought MethodLong75 citations
- Can LMs Learn New Entities from Descriptions? Challenges in Propagating Injected KnowledgeLong74 citations
- DOC: Improving Long Story Coherence With Detailed Outline ControlLong73 citations
- Limitations of Language Models in Arithmetic and Symbolic InductionLong72 citations
- Prompted LLMs as Chatbot Modules for Long Open-domain ConversationFindings72 citations
- Towards Leaving No Indic Language Behind: Building Monolingual Corpora, Benchmark and Models for Indic LanguagesLong72 citations
- KGA: A General Machine Unlearning Framework Based on Knowledge Gap AlignmentLong71 citations
- Nonparametric Masked Language ModelingFindings71 citations
- Cross2StrA: Unpaired Cross-lingual Image Captioning with Cross-lingual Cross-modal Structure-pivoted AlignmentLong70 citations
- MvP: Multi-view Prompting Improves Aspect Sentiment Tuple PredictionLong70 citations
- Character-Aware Models Improve Visual Text RenderingLong67 citations
- Faithfulness Tests for Natural Language ExplanationsShort67 citations
- BLOOM+1: Adding Language Support to BLOOM for Zero-Shot PromptingLong66 citations
- DisentQA: Disentangling Parametric and Contextual Knowledge with Counterfactual Question AnsweringLong66 citations
- Multiview Identifiers Enhanced Generative RetrievalLong66 citations
- DiffusionNER: Boundary Diffusion for Named Entity RecognitionLong65 citations
- Data Curation Alone Can Stabilize In-context LearningLong64 citations
- Faking Fake News for Real Fake News Detection: Propaganda-Loaded Training Data GenerationLong64 citations
- LENS: A Learnable Evaluation Metric for Text SimplificationLong64 citations
- Mitigating Label Biases for In-context LearningLong64 citations
- Natural Language to Code Generation in Interactive Data Science NotebooksLong64 citations
- DiaASQ: A Benchmark of Conversational Aspect-based Sentiment Quadruple AnalysisFindings63 citations
- FactKG: Fact Verification via Reasoning on Knowledge GraphsLong62 citations
- Generating Visual Spatial Description via Holistic 3D Scene UnderstandingLong62 citations
- ReCode: Robustness Evaluation of Code Generation ModelsLong62 citations
- ML-LMCL: Mutual Learning and Large-Margin Contrastive Learning for Improving ASR Robustness in Spoken Language UnderstandingFindings61 citations
- Z-ICL: Zero-Shot In-Context Learning with Pseudo-DemonstrationsLong61 citations
- AugESC: Dialogue Augmentation with Large Language Models for Emotional Support ConversationFindings60 citations
- Augmentation-Adapted Retriever Improves Generalization of Language Models as Generic Plug-InLong60 citations
- Detecting and Mitigating Hallucinations in Machine Translation: Model Internal Workings Alone Do Well, Sentence Similarity Even BetterLong60 citations
- Supervised Adversarial Contrastive Learning for Emotion Recognition in ConversationsLong60 citations
- A Causal Framework to Quantify the Robustness of Mathematical Reasoning with Language ModelsLong59 citations
- Large Language Models are Built-in Autoregressive Search EnginesFindings59 citations
- Searching for Needles in a Haystack: On the Role of Incidental Bilingualism in PaLM’s Translation CapabilityLong59 citations
- Summarizing, Simplifying, and Synthesizing Medical Evidence using GPT-3 (with Varying Success)Short59 citations
- Modular Visual Question Answering via Code GenerationShort58 citations
- RHO: Reducing Hallucination in Open-domain Dialogues with Knowledge GroundingFindings58 citations
- Z-Code++: A Pre-trained Language Model Optimized for Abstractive SummarizationLong58 citations
- Better Zero-Shot Reasoning with Self-Adaptive PromptingFindings57 citations
- Coupling Large Language Models with Logic Programming for Robust and General Reasoning from TextFindings57 citations
- LeXFiles and LegalLAMA: Facilitating English Multinational Legal Language Model DevelopmentLong57 citations
- MMDialog: A Large-scale Multi-turn Dialogue Dataset Towards Multi-modal Open-domain ConversationLong57 citations
- Patton: Language Model Pretraining on Text-Rich NetworksLong57 citations
- Rethinking the Role of Scale for In-Context Learning: An Interpretability-based Case Study at 66 Billion ScaleLong57 citations
- ColD Fusion: Collaborative Descent for Distributed Multitask FinetuningLong56 citations
- Multi-target Backdoor Attacks for Code Pre-trained ModelsLong56 citations
- DualGATs: Dual Graph Attention Networks for Emotion Recognition in ConversationsLong55 citations
- Large Language Models Can be Lazy Learners: Analyze Shortcuts in In-Context LearningFindings55 citations
- Prompted Opinion Summarization with GPT-3.5Findings55 citations
- MultiEMO: An Attention-Based Correlation-Aware Multimodal Fusion Framework for Emotion Recognition in ConversationsLong54 citations
- Sentence Embedding Leaks More Information than You Expect: Generative Embedding Inversion Attack to Recover the Whole SentenceFindings54 citations
- A Close Look into the Calibration of Pre-trained Language ModelsLong53 citations
- ConvGQR: Generative Query Reformulation for Conversational SearchLong53 citations
- DrBERT: A Robust Pre-trained Model in French for Biomedical and Clinical domainsLong53 citations
- Towards Robust Ranker for Text RetrievalFindings53 citations
- A Survey for Efficient Open Domain Question AnsweringLong52 citations
- Causal Intervention and Counterfactual Reasoning for Multi-modal Fake News DetectionLong52 citations
- How Do In-Context Examples Affect Compositional Generalization?Long52 citations
- Parameter-Efficient Fine-Tuning without Introducing New LatencyLong52 citations
- An Embarrassingly Easy but Strong Baseline for Nested Named Entity RecognitionShort51 citations
- Are You Copying My Model? Protecting the Copyright of Large Language Models for EaaS via Backdoor WatermarkLong51 citations
- NOTABLE: Transferable Backdoor Attacks Against Prompt-based NLP ModelsLong51 citations
- Trillion Dollar Words: A New Financial Dataset, Task & Market AnalysisLong51 citations
- Dipping PLMs Sauce: Bridging Structure and Text for Effective Knowledge Graph Completion via Conditional Soft PromptingFindings50 citations
- Exploring the Effectiveness of Prompt Engineering for Legal Reasoning TasksFindings50 citations
- MeetingBank: A Benchmark Dataset for Meeting SummarizationLong50 citations
- The Decades Progress on Code-Switching Research in NLP: A Systematic Survey on Trends and ChallengesFindings50 citations
- Say What You Mean! Large Language Models Speak Too Positively about Negative Commonsense KnowledgeLong49 citations
- TECHS: Temporal Logical Graph Networks for Explainable Extrapolation ReasoningLong49 citations
- Task-Optimized Adapters for an End-to-End Task-Oriented Dialogue SystemFindings49 citations
- CASE: Aligning Coarse-to-Fine Cognition and Affection for Empathetic Response GenerationLong48 citations
- I Spy a Metaphor: Large Language Models and Diffusion Models Co-Create Visual MetaphorsFindings48 citations
- Making More of Little Data: Improving Low-Resource Automatic Speech Recognition Using Data AugmentationLong48 citations
- Multilingual Summarization with Factual Consistency EvaluationFindings48 citations
- NormBank: A Knowledge Bank of Situational Social NormsLong48 citations
- Pre-trained Language Models Can be Fully Zero-Shot LearnersLong48 citations
- UnitY: Two-pass Direct Speech-to-speech Translation with Discrete UnitsLong48 citations
- Enhancing Document-level Event Argument Extraction with Contextual Clues and Role RelevanceFindings47 citations
- Event Extraction as Question Generation and AnsweringShort47 citations
- Knowledge-enhanced Mixed-initiative Dialogue System for Emotional Support ConversationsLong47 citations
- PromptNER: Prompt Locating and Typing for Named Entity RecognitionLong47 citations
- Residual Prompt Tuning: improving prompt tuning with residual reparameterizationFindings47 citations
- Sequential Integrated Gradients: a simple but effective method for explaining language modelsFindings47 citations
- XL-LEXEME: WiC Pretrained Model for Cross-Lingual LEXical sEMantic changEShort47 citations
- Code Execution with Pre-trained Language ModelsFindings46 citations
- Detecting Edit Failures In Large Language Models: An Improved Specificity BenchmarkFindings46 citations
- Grokking of Hierarchical Structure in Vanilla TransformersShort46 citations
- Multi-VALUE: A Framework for Cross-Dialectal English NLPLong46 citations
- Multilingual LLMs are Better Cross-lingual In-context Learners with AlignmentLong46 citations
- Understanding In-Context Learning via Supportive Pretraining DataLong46 citations
- ChatGPT for Zero-shot Dialogue State Tracking: A Solution or an Opportunity?Short45 citations
- Distilling Script Knowledge from Large Language Models for Constrained Language PlanningLong45 citations
- Mixture-of-Domain-Adapters: Decoupling and Injecting Domain Knowledge to Pre-trained Language Models’ MemoriesLong45 citations
- Scientific Fact-Checking: A Survey of Resources and ApproachesFindings45 citations
- BertNet: Harvesting Knowledge Graphs with Arbitrary Relations from Pretrained Language ModelsFindings44 citations
- How poor is the stimulus? Evaluating hierarchical generalization in neural networks trained on child-directed speechLong44 citations
- Improving Gender Fairness of Pre-Trained Language Models without Catastrophic ForgettingShort44 citations
- Retrieve-and-Sample: Document-level Event Argument Extraction via Hybrid Retrieval AugmentationLong44 citations
- A Formal Perspective on Byte-Pair EncodingFindings43 citations
- BITE: Textual Backdoor Attacks with Iterative Trigger InjectionLong43 citations
- DarkBERT: A Language Model for the Dark Side of the InternetLong43 citations
- DiffuSum: Generation Enhanced Extractive Summarization with DiffusionFindings43 citations
- A Customized Text Sanitization Mechanism with Differential PrivacyFindings42 citations
- DP-BART for Privatized Text Rewriting under Local Differential PrivacyFindings42 citations
- Does GPT-3 Grasp Metaphors? Identifying Metaphor Mappings with Generative Language ModelsLong42 citations
- On Improving Summarization Factual Consistency from Natural Language FeedbackLong42 citations
- Pre-Training to Learn in ContextLong42 citations
- Cold-Start Data Selection for Better Few-shot Language Model Fine-tuning: A Prompt-based Uncertainty Propagation ApproachLong41 citations
- KoSBI: A Dataset for Mitigating Social Bias Risks Towards Safer Large Language Model ApplicationsIndustry41 citations
- Learning New Skills after Deployment: Improving open-domain internet-driven dialogue with human feedbackLong41 citations
- Pre-trained Language Model with Prompts for Temporal Knowledge Graph CompletionFindings41 citations
- Bridge the Gap Between CV and NLP! A Gradient-based Textual Adversarial Attack FrameworkFindings40 citations
- Causal-Debias: Unifying Debiasing in Pretrained Language Models and Fine-tuning via Causal Invariant LearningLong40 citations
- Considerations for meaningful sign language machine translation based on glossesShort40 citations
- CrossSum: Beyond English-Centric Cross-Lingual Summarization for 1,500+ Language PairsLong40 citations
- Dissecting Transformer Length Extrapolation via the Lens of Receptive Field AnalysisLong40 citations
- ERNIE-Code: Beyond English-Centric Cross-lingual Pretraining for Programming LanguagesFindings40 citations
- Entity Tracking in Language ModelsLong40 citations
- Exploring Zero and Few-shot Techniques for Intent ClassificationIndustry40 citations
- MMSD2.0: Towards a Reliable Multi-modal Sarcasm Detection SystemFindings40 citations
- On the Expressivity Role of LayerNorm in Transformers’ AttentionFindings40 citations
- Controlling the Extraction of Memorized Data from Large Language Models via Prompt-TuningShort39 citations
- Do Models Really Learn to Follow Instructions? An Empirical Study of Instruction TuningShort39 citations
- Gloss-Free End-to-End Sign Language TranslationLong39 citations
- Improving Contrastive Learning of Sentence Embeddings from AI FeedbackFindings39 citations
- Language Models Get a Gender Makeover: Mitigating Gender Bias with Few-Shot Data InterventionsShort39 citations
- NLPeer: A Unified Resource for the Computational Study of Peer ReviewLong39 citations
- Open-Domain Hierarchical Event Schema Induction by Incremental Prompting and VerificationLong39 citations
- SeeGULL: A Stereotype Benchmark with Broad Geo-Cultural Coverage Leveraging Generative ModelsLong39 citations
- Simplicity Bias in Transformers and their Ability to Learn Sparse Boolean FunctionsLong39 citations
- The Elephant in the Room: Analyzing the Presence of Big Tech in Natural Language Processing ResearchLong39 citations
- What Do NLP Researchers Believe? Results of the NLP Community MetasurveyLong39 citations
- Zero-shot Faithful Factual Error CorrectionLong39 citations
- AoM: Detecting Aspect-oriented Information for Multimodal Aspect-Based Sentiment AnalysisFindings38 citations
- Compounding Geometric Operations for Knowledge Graph CompletionLong38 citations
- FORK: A Bite-Sized Test Set for Probing Culinary Cultural Biases in Commonsense Reasoning ModelsFindings38 citations
- Learning Latent Relations for Temporal Knowledge Graph ReasoningLong38 citations
- Rehearsal-free Continual Language Learning via Efficient Parameter IsolationLong38 citations
- Tokenization and the Noiseless ChannelLong38 citations
- BIC: Twitter Bot Detection with Text-Graph Interaction and Semantic ConsistencyLong37 citations
- Detoxifying Text with MaRCo: Controllable Revision with Experts and Anti-ExpertsShort37 citations
- Dynamic Routing Transformer Network for Multimodal Sarcasm DetectionLong37 citations
- ETHICIST: Targeted Training Data Extraction Through Loss Smoothed Soft Prompting and Calibrated Confidence EstimationLong37 citations
- Learning In-context Learning for Named Entity RecognitionLong37 citations
- MVP: Multi-task Supervised Pre-training for Natural Language GenerationFindings37 citations
- On the Blind Spots of Model-Based Evaluation Metrics for Text GenerationLong37 citations
- AMPERE: AMR-Aware Prefix for Generation-Based Event Argument Extraction ModelLong36 citations
- Cross-Lingual Retrieval Augmented Prompt for Low-Resource LanguagesFindings36 citations
- Did You Read the Instructions? Rethinking the Effectiveness of Task Definitions in Instruction LearningLong36 citations
- Follow the Wisdom of the Crowd: Effective Text Generation via Minimum Bayes Risk DecodingFindings36 citations
- PAED: Zero-Shot Persona Attribute Extraction in DialoguesLong36 citations
- RankCSE: Unsupervised Sentence Representations Learning via Learning to RankLong36 citations
- Critic-Guided Decoding for Controlled Text GenerationFindings35 citations
- Cross-View Language Modeling: Towards Unified Cross-Lingual Cross-Modal Pre-trainingLong35 citations
- DT-Solver: Automated Theorem Proving with Dynamic-Tree Sampling Guided by Proof-level Value FunctionLong35 citations
- Graph Reasoning for Question Answering with Triplet RetrievalFindings35 citations
- Multi-granularity Temporal Question Answering over Knowledge GraphsLong35 citations
- ORGAN: Observation-Guided Radiology Report Generation via Tree ReasoningLong35 citations
- Speaking Multiple Languages Affects the Moral Bias of Language ModelsFindings35 citations
- Structured Pruning for Efficient Generative Pre-trained Language ModelsFindings35 citations
- Tab-CoT: Zero-shot Tabular Chain of ThoughtFindings35 citations
- The CRINGE Loss: Learning what language not to modelLong35 citations
- A Better Way to Do Masked Language Model ScoringShort34 citations
- ANALOGICAL - A Novel Benchmark for Long Text Analogy Evaluation in Large Language ModelsFindings34 citations
- Backdooring Neural Code SearchLong34 citations
- COBRA Frames: Contextual Reasoning about Effects and Harms of Offensive StatementsFindings34 citations
- Chain of Thought Prompting Elicits Knowledge AugmentationFindings34 citations
- ClarifyDelphi: Reinforced Clarification Questions with Defeasibility Rewards for Social and Moral SituationsLong34 citations
- DICE: Data-Efficient Clinical Event Extraction with Generative ModelsLong34 citations
- How Well Do Large Language Models Perform on Faux Pas Tests?Findings34 citations
- Improved Logical Reasoning of Language Models via Differentiable Symbolic ProgrammingFindings34 citations
- MatSci-NLP: Evaluating Scientific Language Models on Materials Science Language Tasks Using Text-to-Schema ModelingLong34 citations
- PromptRank: Unsupervised Keyphrase Extraction Using PromptLong34 citations
- Prompting Language Models for Linguistic StructureLong34 citations
- ReGen: Zero-Shot Text Classification via Training Data Generation with Progressive Dense RetrievalFindings34 citations
- SLUE Phase-2: A Benchmark Suite of Diverse Spoken Language Understanding TasksLong34 citations
- SpeechMatrix: A Large-Scale Mined Corpus of Multilingual Speech-to-Speech TranslationsLong34 citations
- Stereotypes and Smut: The (Mis)representation of Non-cisgender Identities by Text-to-Image ModelsFindings34 citations
- Tailor: A Soft-Prompt-Based Approach to Attribute-Based Controlled Text GenerationLong34 citations
- The Dangers of trusting Stochastic Parrots: Faithfulness and Trust in Open-domain Conversational Question AnsweringFindings34 citations
- This prompt is measuring <mask>: evaluating bias evaluation in language modelsFindings34 citations
- Toward Human-Like Evaluation for Natural Language Generation with Error AnalysisLong34 citations
- When Does Translation Require Context? A Data-driven, Multilingual ExplorationLong34 citations
- A Measure-Theoretic Characterization of Tight Language ModelsLong33 citations
- Ask an Expert: Leveraging Language Models to Improve Strategic Reasoning in Goal-Oriented Dialogue ModelsFindings33 citations
- CITADEL: Conditional Token Interaction via Dynamic Lexical Routing for Efficient and Effective Multi-Vector RetrievalLong33 citations
- DisorBERT: A Double Domain Adaptation Model for Detecting Signs of Mental Disorders in Social MediaLong33 citations
- Efficient Transformers with Dynamic Token PoolingLong33 citations
- Explaining How Transformers Use Context to Build PredictionsLong33 citations
- In-Context Analogical Reasoning with Pre-Trained Language ModelsLong33 citations
- Language acquisition: do children and language models follow similar learning stages?Findings33 citations
- MetaAdapt: Domain Adaptive Few-Shot Misinformation Detection via Meta LearningLong33 citations
- Multilingual Multifaceted Understanding of Online News in Terms of Genre, Framing, and Persuasion TechniquesLong33 citations
- UniTRec: A Unified Text-to-Text Transformer and Joint Contrastive Learning Framework for Text-based RecommendationShort33 citations
- Unsupervised Dense Retrieval with Relevance-Aware Contrastive Pre-TrainingFindings33 citations
- What Are You Token About? Dense Retrieval as Distributions Over the VocabularyLong33 citations
- A Cross-Modality Context Fusion and Semantic Refinement Network for Emotion Recognition in ConversationLong32 citations
- A Facial Expression-Aware Multimodal Multi-task Learning Framework for Emotion Recognition in Multi-party ConversationsLong32 citations
- Counterfactual Debiasing for Fact VerificationLong32 citations
- Direct Fact Retrieval from Knowledge Graphs without Entity LinkingLong32 citations
- Do PLMs Know and Understand Ontological Knowledge?Long32 citations
- Exploring Continual Learning for Code Generation ModelsShort32 citations
- FiDO: Fusion-in-Decoder optimized for stronger performance and faster inferenceFindings32 citations
- Gender-tuning: Empowering Fine-tuning for Debiasing Pre-trained Language ModelsFindings32 citations
- I2D2: Inductive Knowledge Distillation with NeuroLogic and Self-ImitationLong32 citations
- MM-SHAP: A Performance-agnostic Metric for Measuring Multimodal Contributions in Vision and Language Models & TasksLong32 citations
- RobuT: A Systematic Study of Table QA Robustness Against Human-Annotated Adversarial PerturbationsLong32 citations
- Small Data, Big Impact: Leveraging Minimal Data for Effective Machine TranslationLong32 citations
- T2IAT: Measuring Valence and Stereotypical Biases in Text-to-Image GenerationFindings32 citations
- Are Machine Rationales (Not) Useful to Humans? Measuring and Improving Human Utility of Free-text RationalesLong31 citations
- Credible without Credit: Domain Experts Assess Generative Language ModelsShort31 citations
- Don’t Lose Yourself! Empathetic Response Generation via Explicit Self-Other AwarenessFindings31 citations
- EfficientVLM: Fast and Accurate Vision-Language Models via Knowledge Distillation and Modal-adaptive PruningFindings31 citations
- Explainable Recommendation with Personalized Review Retrieval and Aspect LearningLong31 citations
- Grounded Multimodal Named Entity Recognition on Social MediaLong31 citations
- Learn over Past, Evolve for Future: Forecasting Temporal Trends for Fake News DetectionIndustry31 citations
- Measuring Inductive Biases of In-Context Learning with Underspecified DemonstrationsLong31 citations
- MixPAVE: Mix-Prompt Tuning for Few-shot Product Attribute Value ExtractionFindings31 citations
- PAL: Persona-Augmented Emotional Support Conversation GenerationFindings31 citations
- Prototype-Guided Pseudo Labeling for Semi-Supervised Text ClassificationLong31 citations
- S2ynRE: Two-stage Self-training with Synthetic data for Low-resource Relation ExtractionLong31 citations
- TOME: A Two-stage Approach for Model-based RetrievalLong31 citations
- TemplateGEC: Improving Grammatical Error Correction with Detection TemplateLong31 citations
- The Larger they are, the Harder they Fail: Language Models do not Recognize Identifier Swaps in PythonFindings31 citations
- ThinkSum: Probabilistic reasoning over sets using large language modelsLong31 citations
- An AMR-based Link Prediction Approach for Document-level Event Argument ExtractionLong30 citations
- CONE: An Efficient COarse-to-fiNE Alignment Framework for Long Video Temporal GroundingLong30 citations
- DecompX: Explaining Transformers Decisions by Propagating Token DecompositionLong30 citations
- DiscoPrompt: Path Prediction Prompt Tuning for Implicit Discourse Relation RecognitionFindings30 citations
- Emergent Modularity in Pre-trained TransformersFindings30 citations
- Environmental Claim DetectionShort30 citations
- FairPrism: Evaluating Fairness-Related Harms in Text GenerationLong30 citations
- HiTIN: Hierarchy-aware Tree Isomorphism Network for Hierarchical Text ClassificationLong30 citations
- Improving Generalization in Language Model-based Text-to-SQL Semantic Parsing: Two Simple Semantic Boundary-based TechniquesShort30 citations
- PuMer: Pruning and Merging Tokens for Efficient Vision Language ModelsLong30 citations
- RE-Matching: A Fine-Grained Semantic Matching Method for Zero-Shot Relation ExtractionLong30 citations
- Rethinking Masked Language Modeling for Chinese Spelling CorrectionLong30 citations
- Selecting Better Samples from Pre-trained LLMs: A Case Study on Question GenerationFindings30 citations
- Tackling Modality Heterogeneity with Multi-View Calibration Network for Multimodal Sentiment DetectionLong30 citations
- Towards a Common Understanding of Contributing Factors for Cross-Lingual Transfer in Multilingual Language Models: A ReviewLong30 citations
- A Synthetic Data Generation Framework for Grounded DialoguesLong29 citations
- An Effective Deployment of Contrastive Learning in Multi-label Text ClassificationFindings29 citations
- An Open Dataset and Model for Language IdentificationShort29 citations
- DLAMA: A Framework for Curating Culturally Diverse Facts for Probing the Knowledge of Pretrained Language ModelsFindings29 citations
- Do GPTs Produce Less Literal Translations?Short29 citations
- Exploring Large Language Models for Classical PhilologyLong29 citations
- Facilitating Multi-turn Emotional Support Conversation with Positive Emotion Elicitation: A Reinforcement Learning ApproachLong29 citations
- HINT: Hypernetwork Instruction Tuning for Efficient Zero- and Few-Shot GeneralisationLong29 citations
- KILM: Knowledge Injection into Encoder-Decoder Language ModelsLong29 citations
- MISGENDERED: Limits of Large Language Models in Understanding PronounsLong29 citations
- REDFM: a Filtered and Multilingual Relation Extraction DatasetLong29 citations
- Revisiting non-English Text Simplification: A Unified Multilingual BenchmarkLong29 citations
- Social-Group-Agnostic Bias Mitigation via the Stereotype Content ModelLong29 citations
- The Diminishing Returns of Masked Language Models to ScienceFindings29 citations
- CAT: A Contextualized Conceptualization and Instantiation Framework for Commonsense ReasoningLong28 citations
- CMOT: Cross-modal Mixup via Optimal Transport for Speech TranslationLong28 citations
- Ethical Considerations for Machine Translation of Indigenous Languages: Giving a Voice to the SpeakersLong28 citations
- FACTIFY-5WQA: 5W Aspect-based Fact Verification through Question AnsweringLong28 citations
- Improving Empathetic Dialogue Generation by Dynamically Infusing Commonsense KnowledgeFindings28 citations
- Interpretable Multimodal Misinformation Detection with Logic ReasoningFindings28 citations
- Not The End of Story: An Evaluation of ChatGPT-Driven Vulnerability Description MappingsFindings28 citations
- PMAES: Prompt-mapping Contrastive Learning for Cross-prompt Automated Essay ScoringLong28 citations
- RECAP: Retrieval-Enhanced Context-Aware Prefix Encoder for Personalized Dialogue Response GenerationLong28 citations
- Revisiting Event Argument Extraction: Can EAE Models Learn Better When Being Aware of Event Co-occurrences?Long28 citations
- Scaling in Cognitive Modelling: a Multilingual Approach to Human Reading TimesShort28 citations
- Text Augmented Open Knowledge Graph Completion via Pre-Trained Language ModelsFindings28 citations
- The Art of Prompting: Event Detection based on Type Specific PromptsShort28 citations
- Towards Unified Spoken Language Understanding Decoding via Label-aware Compact Linguistics RepresentationsFindings28 citations
- mCLIP: Multilingual CLIP via Cross-lingual TransferLong28 citations
- A Fused Gromov-Wasserstein Framework for Unsupervised Knowledge Graph Entity AlignmentFindings27 citations
- An Empirical Analysis of Parameter-Efficient Methods for Debiasing Pre-Trained Language ModelsLong27 citations
- Benchmarking Large Language Model Capabilities for Conditional GenerationLong27 citations
- ByGPT5: End-to-End Style-conditioned Poetry Generation with Token-free Language ModelsLong27 citations
- Chain-of-Skills: A Configurable Model for Open-Domain Question AnsweringLong27 citations
- DUB: Discrete Unit Back-translation for Speech TranslationFindings27 citations
- Extractive is not Faithful: An Investigation of Broad Unfaithfulness Problems in Extractive SummarizationLong27 citations
- FC-KBQA: A Fine-to-Coarse Composition Framework for Knowledge Base Question AnsweringLong27 citations
- HELP ME THINK: A Simple Prompting Strategy for Non-experts to Create Customized Content with ModelsFindings27 citations
- Hierarchical Verbalizer for Few-Shot Hierarchical Text ClassificationLong27 citations
- Is Anisotropy Truly Harmful? A Case Study on Text ClusteringShort27 citations
- LMentry: A Language Model Benchmark of Elementary Language TasksFindings27 citations
- Neural Machine Translation Methods for Translating Text to Sign Language GlossesLong27 citations
- ORCA: A Challenging Benchmark for Arabic Language UnderstandingFindings27 citations
- Prompt-Based Metric Learning for Few-Shot NERFindings27 citations
- SERENGETI: Massively Multilingual Language Models for AfricaFindings27 citations
- Tokenization Impacts Multilingual Language Modeling: Assessing Vocabulary Allocation and Overlap Across LanguagesFindings27 citations
- Understanding and Bridging the Modality Gap for Speech TranslationLong27 citations
- (QA)2: Question Answering with Questionable AssumptionsLong26 citations
- Augmenting Large Language Model Translators via Translation MemoriesFindings26 citations
- BLIND: Bias Removal With No DemographicsLong26 citations
- CHBias: Bias Evaluation and Mitigation of Chinese Conversational Language ModelsLong26 citations
- Click: Controllable Text Generation with Sequence Likelihood Contrastive LearningFindings26 citations
- ConKI: Contrastive Knowledge Injection for Multimodal Sentiment AnalysisFindings26 citations
- Controllable Mixed-Initiative Dialogue Generation through PromptingShort26 citations
- I Cast Detect Thoughts: Learning to Converse and Guide with Intents and Theory-of-Mind in Dungeons and DragonsLong26 citations
- Is Fine-tuning Needed? Pre-trained Language Models Are Near Perfect for Out-of-Domain DetectionLong26 citations
- LM-CPPF: Paraphrasing-Guided Data Augmentation for Contrastive Prompt-Based Few-Shot Fine-TuningShort26 citations
- Multi-lingual and Multi-cultural Figurative Language UnderstandingFindings26 citations
- MultiTool-CoT: GPT-3 Can Use Multiple External Tools with Chain of Thought PromptingShort26 citations
- Multitask Pre-training of Modular Prompt for Chinese Few-Shot LearningLong26 citations
- Neural Architecture Search for Parameter-Efficient Fine-tuning of Large Pre-trained Language ModelsFindings26 citations
- Structure-Aware Language Model Pretraining Improves Dense Retrieval on Structured DataFindings26 citations
- Tackling Ambiguity with Images: Improved Multimodal Machine Translation and Contrastive EvaluationLong26 citations
- TransESC: Smoothing Emotional Support Conversation via Turn-Level State TransitionFindings26 citations
- Which Examples Should be Multiply Annotated? Active Learning When Annotators May DisagreeFindings26 citations
- WhitenedCSE: Whitening-based Contrastive Learning of Sentence EmbeddingsLong26 citations
- Adaptive and Personalized Exercise Generation for Online Language LearningLong25 citations
- An Empirical Comparison of LM-based Question and Answer Generation MethodsFindings25 citations
- An Exploration of Encoder-Decoder Approaches to Multi-Label Classification for Legal and Biomedical TextFindings25 citations
- Backpack Language ModelsLong25 citations
- Consistent Prototype Learning for Few-Shot Continual Relation ExtractionLong25 citations
- Enhancing Personalized Dialogue Generation with Contrastive Latent Variables: Combining Sparse and Dense PersonaLong25 citations
- GeoDRL: A Self-Learning Framework for Geometry Problem Solving using Reinforcement Learning in Deductive ReasoningFindings25 citations
- Interpretable Word Sense Representations via Definition Generation: The Case of Semantic Change AnalysisLong25 citations
- Language Anisotropic Cross-Lingual Model EditingFindings25 citations
- MPCHAT: Towards Multimodal Persona-Grounded ConversationLong25 citations
- Prompt- and Trait Relation-aware Cross-prompt Essay Trait ScoringFindings25 citations
- Query-Efficient Black-Box Red Teaming via Bayesian OptimizationLong25 citations
- RQUGE: Reference-Free Metric for Evaluating Question Generation by Answering the QuestionFindings25 citations
- Reasoning in Large Language Models Through Symbolic Math Word ProblemsFindings25 citations
- Summary-Oriented Vision Modeling for Multimodal Abstractive SummarizationLong25 citations
- Towards Unifying Multi-Lingual and Cross-Lingual SummarizationLong25 citations
- Understanding Differential Search Index for Text RetrievalFindings25 citations
- A Survey on Asking Clarification Questions Datasets in Conversational SystemsLong24 citations
- An Annotated Dataset for Explainable Interpersonal Risk Factors of Mental Disturbance in Social Media PostsFindings24 citations
- Attributable and Scalable Opinion SummarizationLong24 citations
- CAME: Confidence-guided Adaptive Memory Efficient OptimizationLong24 citations
- Defending against Insertion-based Textual Backdoor Attacks via AttributionFindings24 citations
- Downstream Datasets Make Surprisingly Good Pretraining CorporaLong24 citations
- Enhancing Dialogue Generation via Dynamic Graph Knowledge AggregationLong24 citations
- Evaluating Embedding APIs for Information RetrievalIndustry24 citations
- FEDLEGAL: The First Real-World Federated Learning Benchmark for Legal NLPLong24 citations
- GENEVA: Benchmarking Generalizability for Event Argument Extraction with Hundreds of Event Types and Argument RolesLong24 citations
- GreenKGC: A Lightweight Knowledge Graph Completion MethodLong24 citations
- Hybrid Uncertainty Quantification for Selective Text Classification in Ambiguous TasksLong24 citations
- InfoMetIC: An Informative Metric for Reference-free Image Caption EvaluationLong24 citations
- Language Models for German Text Simplification: Overcoming Parallel Data Scarcity through Style-specific Pre-trainingFindings24 citations
- Mind the Biases: Quantifying Cognitive Biases in Language Model PromptingFindings24 citations
- Multimodal Relation Extraction with Cross-Modal Retrieval and SynthesisShort24 citations
- Naamapadam: A Large-Scale Named Entity Annotated Data for Indic LanguagesLong24 citations
- Non-Repeatable Experiments and Non-Reproducible Results: The Reproducibility Crisis in Human Evaluation in NLPFindings24 citations
- PaCE: Unified Multi-modal Dialogue Pre-training with Progressive and Compositional ExpertsLong24 citations
- Rogue ScoresLong24 citations
- Semantic Structure Enhanced Event Causality IdentificationLong24 citations
- Shrinking Embeddings for Hyper-Relational Knowledge GraphsLong24 citations
- TeAST: Temporal Knowledge Graph Embedding via Archimedean Spiral TimelineLong24 citations
- The Ecological Fallacy in Annotation: Modeling Human Label Variation goes beyond SociodemographicsShort24 citations
- The Tail Wagging the Dog: Dataset Construction Biases of Social Bias BenchmarksShort24 citations
- Transforming Visual Scene Graphs to Image CaptionsLong24 citations
- WACO: Word-Aligned Contrastive Learning for Speech TranslationLong24 citations
- What’s the Meaning of Superhuman Performance in Today’s NLU?Long24 citations
- A Comparative Study on the Impact of Model Compression Techniques on Fairness in Language ModelsLong23 citations
- Aerial Vision-and-Dialog NavigationFindings23 citations
- Attention as a Guide for Simultaneous Speech TranslationLong23 citations
- Counterspeeches up my sleeve! Intent Distribution Learning and Persistent Fusion for Intent-Conditioned Counterspeech GenerationLong23 citations
- Don’t Forget Your ABC’s: Evaluating the State-of-the-Art in Chat-Oriented Dialogue SystemsLong23 citations
- Enhancing Hierarchical Text Classification through Knowledge Graph IntegrationFindings23 citations
- Exploiting Biased Models to De-bias Text: A Gender-Fair Rewriting ModelLong23 citations
- From Dogwhistles to Bullhorns: Unveiling Coded Rhetoric with Language ModelsLong23 citations
- GanLM: Encoder-Decoder Pre-training with an Auxiliary DiscriminatorLong23 citations
- LMCap: Few-shot Multilingual Image Captioning by Retrieval Augmented Language Model PromptingFindings23 citations
- Language Model Analysis for Ontology Subsumption InferenceFindings23 citations
- Nonparametric Decoding for Generative RetrievalFindings23 citations
- OD-RTE: A One-Stage Object Detection Framework for Relational Triple ExtractionLong23 citations
- One Network, Many Masks: Towards More Parameter-Efficient Transfer LearningLong23 citations
- PropSegmEnt: A Large-Scale Corpus for Proposition-Level Segmentation and Entailment RecognitionFindings23 citations
- ReAugKD: Retrieval-Augmented Knowledge Distillation For Pre-trained Language ModelsShort23 citations
- Recursion of Thought: A Divide-and-Conquer Approach to Multi-Context Reasoning with Language ModelsFindings23 citations
- Rethinking Multimodal Entity and Relation Extraction from a Translation Point of ViewLong23 citations
- Robustness of Learning from Task InstructionsFindings23 citations
- Token-Level Self-Evolution Training for Sequence-to-Sequence LearningShort23 citations
- Weaker Than You Think: A Critical Look at Weakly Supervised LearningLong23 citations
- What about “em”? How Commercial Machine Translation Fails to Handle (Neo-)PronounsLong23 citations
- What does a Text Classifier Learn about Morality? An Explainable Method for Cross-Domain Comparison of Moral RhetoricLong23 citations
- A Multi-dimensional study on Bias in Vision-Language modelsFindings22 citations
- Client-Customized Adaptation for Parameter-Efficient Federated LearningFindings22 citations
- Contextualized Soft Prompts for Extraction of Event ArgumentsFindings22 citations
- Counterfactual reasoning: Testing language models’ understanding of hypothetical scenariosShort22 citations
- Cross-Domain Data Augmentation with Domain-Adaptive Language Modeling for Aspect-Based Sentiment AnalysisLong22 citations
- Dealing with Semantic Underspecification in Multimodal NLPLong22 citations
- Dialogue Planning via Brownian Bridge Stochastic Process for Goal-directed Proactive DialogueFindings22 citations
- Diverse Retrieval-Augmented In-Context Learning for Dialogue State TrackingFindings22 citations
- Dynamic Heterogeneous-Graph Reasoning with Language Models and Knowledge Representation Learning for Commonsense Question AnsweringLong22 citations
- End-to-end Knowledge Retrieval with Multi-modal QueriesLong22 citations
- FACTUAL: A Benchmark for Faithful and Consistent Textual Scene Graph ParsingFindings22 citations
- Few-shot Joint Multimodal Aspect-Sentiment Analysis Based on Generative Multimodal PromptFindings22 citations
- How to Plant Trees in Language Models: Data and Architectural Effects on the Emergence of Syntactic Inductive BiasesLong22 citations
- Improving Grammatical Error Correction with Multimodal Feature IntegrationFindings22 citations
- Improving Self-training for Cross-lingual Named Entity Recognition with Contrastive and Prototype LearningLong22 citations
- LayoutMask: Enhance Text-Layout Interaction in Multi-modal Pre-training for Document UnderstandingLong22 citations
- OASum: Large-Scale Open Domain Aspect-based SummarizationFindings22 citations
- OpenSR: Open-Modality Speech Recognition via Maintaining Multi-Modality AlignmentLong22 citations
- Optimal Transport for Unsupervised Hallucination Detection in Neural Machine TranslationLong22 citations
- Overcoming Catastrophic Forgetting in Massively Multilingual Continual LearningFindings22 citations
- Peek Across: Improving Multi-Document Modeling via Cross-Document Question-AnsweringLong22 citations
- Ranking-Enhanced Unsupervised Sentence Representation LearningLong22 citations
- Speech-to-Speech Translation for a Real-world Unwritten LanguageFindings22 citations
- TextObfuscator: Making Pre-trained Language Model a Privacy Protector via Obfuscating Word RepresentationsFindings22 citations
- Understanding Client Reactions in Online Mental Health CounselingLong22 citations
- UniS-MMC: Multimodal Classification via Unimodality-supervised Multimodal Contrastive LearningFindings22 citations
- UniSumm and SummZoo: Unified Model and Diverse Benchmark for Few-Shot SummarizationLong22 citations
- Zero-Shot and Few-Shot Stance Detection on Varied Topics via Conditional GenerationShort22 citations
- A Gradient Control Method for Backdoor Attacks on Parameter-Efficient TuningLong21 citations
- AD-KD: Attribution-Driven Knowledge Distillation for Language Model CompressionLong21 citations
- An Investigation of Evaluation Methods in Automatic Medical Note GenerationFindings21 citations
- Automated Metrics for Medical Multi-Document Summarization Disagree with Human EvaluationsLong21 citations
- BLASER: A Text-Free Speech-to-Speech Translation Evaluation MetricLong21 citations
- CLAPSpeech: Learning Prosody from Text Context with Contrastive Language-Audio Pre-TrainingLong21 citations
- Causes and Cures for Interference in Multilingual TranslationLong21 citations
- Context or Knowledge is Not Always Necessary: A Contrastive Learning Framework for Emotion Recognition in ConversationsFindings21 citations
- Discrete Prompt Optimization via Constrained Generation for Zero-shot Re-rankerFindings21 citations
- Double-Branch Multi-Attention based Graph Neural Network for Knowledge Graph CompletionLong21 citations
- FIREBALL: A Dataset of Dungeons and Dragons Actual-Play with Structured Game State InformationLong21 citations
- FolkScope: Intention Knowledge Graph Construction for E-commerce Commonsense DiscoveryFindings21 citations
- GDA: Generative Data Augmentation Techniques for Relation Extraction TasksFindings21 citations
- Learning by Analogy: Diverse Questions Generation in Math Word ProblemFindings21 citations
- MVP-Tuning: Multi-View Knowledge Retrieval with Prompt Tuning for Commonsense ReasoningLong21 citations
- Multi3NLU++: A Multilingual, Multi-Intent, Multi-Domain Dataset for Natural Language Understanding in Task-Oriented DialogueFindings21 citations
- On Evaluating and Mitigating Gender Biases in Multilingual SettingsFindings21 citations
- ParaLS: Lexical Substitution via Pretrained ParaphraserLong21 citations
- PeaCoK: Persona Commonsense Knowledge for Consistent and Engaging NarrativesLong21 citations
- Playing the Part of the Sharp Bully: Generating Adversarial Examples for Implicit Hate Speech DetectionFindings21 citations
- Plug-and-Play Knowledge Injection for Pre-trained Language ModelsLong21 citations
- RMSSinger: Realistic-Music-Score based Singing Voice SynthesisFindings21 citations
- Rethinking Semi-supervised Learning with Language ModelsFindings21 citations
- RetroMAE-2: Duplex Masked Auto-Encoder For Pre-Training Retrieval-Oriented Language ModelsLong21 citations
- Reward Gaming in Conditional Text GenerationLong21 citations
- Span-level Aspect-based Sentiment Analysis via Table FillingLong21 citations
- Teaching the Pre-trained Model to Generate Simple Texts for Text SimplificationFindings21 citations
- Text Adversarial Purification as Defense against Adversarial AttacksLong21 citations
- The Benefits of Bad Advice: Autocontrastive Decoding across Model LayersLong21 citations
- Automatic Table Union Search with Tabular Representation LearningFindings20 citations
- CREPE: Open-Domain Question Answering with False PresuppositionsLong20 citations
- CaPE: Contrastive Parameter Ensembling for Reducing Hallucination in Abstractive SummarizationFindings20 citations
- Can NLI Provide Proper Indirect Supervision for Low-resource Biomedical Relation Extraction?Long20 citations
- Conformal Nucleus SamplingFindings20 citations
- Cost-effective Distillation of Large Language ModelsFindings20 citations
- Counterfactual Active Learning for Out-of-Distribution GeneralizationLong20 citations
- Dataset Distillation with Attention Labels for Fine-tuning BERTShort20 citations
- Dialect-robust Evaluation of Generated TextLong20 citations
- DiffusEmp: A Diffusion Model-Based Framework with Multi-Grained Control for Empathetic Response GenerationLong20 citations
- Disentangled Phonetic Representation for Chinese Spelling CorrectionLong20 citations
- Expand, Rerank, and Retrieve: Query Reranking for Open-Domain Question AnsweringFindings20 citations
- Frustratingly Easy Label Projection for Cross-lingual TransferFindings20 citations
- Generative Zero-Shot Prompt Learning for Cross-Domain Slot Filling with Inverse PromptingFindings20 citations
- Improving Zero-shot Multilingual Neural Machine Translation by Leveraging Cross-lingual Consistency RegularizationFindings20 citations
- IndicMT Eval: A Dataset to Meta-Evaluate Machine Translation Metrics for Indian LanguagesLong20 citations
- LiveChat: A Large-Scale Personalized Dialogue Dataset Automatically Constructed from Live StreamingLong20 citations
- Log-linear Guardedness and its ImplicationsLong20 citations
- Measuring Progress in Fine-grained Vision-and-Language UnderstandingLong20 citations
- Modular and On-demand Bias Mitigation with Attribute-Removal SubnetworksFindings20 citations
- MoralDial: A Framework to Train and Evaluate Moral Dialogue Systems via Moral DiscussionsLong20 citations
- More than Classification: A Unified Framework for Event Temporal Relation ExtractionLong20 citations
- Multi-source Semantic Graph-based Multimodal Sarcasm Explanation GenerationLong20 citations
- Open-ended Long Text Generation via Masked Language ModelingLong20 citations
- PREADD: Prefix-Adaptive Decoding for Controlled Text GenerationFindings20 citations
- Socratic Pretraining: Question-Driven Pretraining for Controllable SummarizationLong20 citations
- Speech-Text Pre-training for Spoken Dialog Understanding with Explicit Cross-Modal AlignmentLong20 citations
- Targeted Data Generation: Finding and Fixing Model WeaknessesLong20 citations
- Towards Adaptive Prefix Tuning for Parameter-Efficient Language Model Fine-tuningShort20 citations
- Towards Imperceptible Document Manipulations against Neural Ranking ModelsFindings20 citations
- Towards standardizing Korean Grammatical Error Correction: Datasets and AnnotationLong20 citations
- Training Models to Generate, Recognize, and Reframe Unhelpful ThoughtsLong20 citations
- Trigger Warning Assignment as a Multi-Label Document Classification ProblemLong20 citations
- Wasserstein-Fisher-Rao Embedding: Logical Query Embeddings with Local Comparison and Global TransportFindings20 citations
- What Makes Pre-trained Language Models Better Zero-shot Learners?Long20 citations
- pNLP-Mixer: an Efficient all-MLP Architecture for LanguageIndustry20 citations
- BOLT: Fast Energy-based Controlled Text Generation with Tunable BiasesShort19 citations
- Beyond English-Centric Bitexts for Better Multilingual Language Representation LearningLong19 citations
- Bidirectional Generative Framework for Cross-domain Aspect-based Sentiment AnalysisLong19 citations
- CHEER: Centrality-aware High-order Event Reasoning Network for Document-level Event Causality IdentificationLong19 citations
- DEplain: A German Parallel Corpus with Intralingual Translations into Plain Language for Sentence and Document SimplificationLong19 citations
- Deeply Coupled Cross-Modal Prompt LearningFindings19 citations
- Divide, Conquer, and Combine: Mixture of Semantic-Independent Experts for Zero-Shot Dialogue State TrackingLong19 citations
- ESCOXLM-R: Multilingual Taxonomy-driven Pre-training for the Job Market DomainLong19 citations
- Hybrid Transducer and Attention based Encoder-Decoder Modeling for Speech-to-Text TasksLong19 citations
- Linear Classifier: An Often-Forgotten Baseline for Text ClassificationShort19 citations
- MANNER: A Variational Memory-Augmented Model for Cross Domain Few-Shot Named Entity RecognitionLong19 citations
- Memory-efficient NLLB-200: Language-specific Expert Pruning of a Massively Multilingual Machine Translation ModelLong19 citations
- MetaVL: Transferring In-Context Learning Ability From Language Models to Vision-Language ModelsShort19 citations
- Metaphor Detection via Explicit Basic Meanings ModellingShort19 citations
- Movie101: A New Movie Understanding BenchmarkLong19 citations
- PEIT: Bridging the Modality Gap with Pre-trained Models for End-to-End Image TranslationLong19 citations
- Prompt to be Consistent is Better than Self-Consistent? Few-Shot and Zero-Shot Fact Verification with Pre-trained Language ModelsFindings19 citations
- RFiD: Towards Rational Fusion-in-Decoder for Open-Domain Question AnsweringFindings19 citations
- SQuARe: A Large-Scale Dataset of Sensitive Questions and Acceptable Responses Created through Human-Machine CollaborationLong19 citations
- STT4SG-350: A Speech Corpus for All Swiss German Dialect RegionsShort19 citations
- Search-Oriented Conversational Query EditingFindings19 citations
- The Devil is in the Details: On the Pitfalls of Event Extraction EvaluationFindings19 citations
- The Magic of IF: Investigating Causal Reasoning Abilities in Large Language Models of CodeFindings19 citations
- Tree-Based Representation and Generation of Natural and Mathematical LanguageLong19 citations
- Uncertainty-Aware Unlikelihood Learning Improves Generative Aspect Sentiment Quad PredictionFindings19 citations
- Understanding Programs by Exploiting (Fuzzing) Test CasesFindings19 citations
- UniCoRN: Unified Cognitive Signal ReconstructioN bridging cognitive signals and human languageLong19 citations
- What Is Overlap Knowledge in Event Argument Extraction? APE: A Cross-datasets Transfer Learning Model for EAELong19 citations
- WikiHowQA: A Comprehensive Benchmark for Multi-Document Non-Factoid Question AnsweringLong19 citations
- A Diverse Set of Freely Available Linguistic Resources for TurkishLong18 citations
- A Static Evaluation of Code Completion by Large Language ModelsIndustry18 citations
- AV-TranSpeech: Audio-Visual Robust Speech-to-Speech TranslationLong18 citations
- BanglaBook: A Large-scale Bangla Dataset for Sentiment Analysis from Book ReviewsFindings18 citations
- C-STANCE: A Large Dataset for Chinese Zero-Shot Stance DetectionLong18 citations
- CFSum Coarse-to-Fine Contribution Network for Multimodal SummarizationLong18 citations
- Claim-Dissector: An Interpretable Fact-Checking System with Joint Re-ranking and Veracity PredictionFindings18 citations
- Controllable Text Generation via Probability Density Estimation in the Latent SpaceLong18 citations
- DIP: Dead code Insertion based Black-box Attack for Programming Language ModelLong18 citations
- Data-Efficient Finetuning Using Cross-Task Nearest NeighborsFindings18 citations
- Discriminative Reasoning with Sparse Event Representation for Document-level Event-Event Relation ExtractionLong18 citations
- Enhancing Grammatical Error Correction Systems with ExplanationsLong18 citations
- Entity-to-Text based Data Augmentation for various Named Entity Recognition TasksFindings18 citations
- Evaluating Open-Domain Dialogues in Latent Space with Next Sentence Prediction and Mutual InformationLong18 citations
- From Alignment to Entailment: A Unified Textual Entailment Framework for Entity AlignmentFindings18 citations
- Generating Structured Pseudo Labels for Noise-resistant Zero-shot Video Sentence LocalizationLong18 citations
- Generic Temporal Reasoning with Differential Analysis and ExplanationLong18 citations
- Global and Local Hierarchy-aware Contrastive Framework for Implicit Discourse Relation RecognitionFindings18 citations
- Joint Document-Level Event Extraction via Token-Token Bidirectional Event Completed GraphLong18 citations
- Layer-wise Fusion with Modality Independence Modeling for Multi-modal Emotion RecognitionLong18 citations
- Learning to Simulate Natural Language Feedback for Interactive Semantic ParsingLong18 citations
- Lego-MT: Learning Detachable Models for Massively Multilingual Machine TranslationFindings18 citations
- MGR: Multi-generator Based RationalizationLong18 citations
- MUSTIE: Multimodal Structural Transformer for Web Information ExtractionLong18 citations
- MultiTabQA: Generating Tabular Answers for Multi-Table Question AnsweringLong18 citations
- On the Difference of BERT-style and CLIP-style Text EncodersFindings18 citations
- Open-WikiTable : Dataset for Open Domain Question Answering with Complex Reasoning over TableFindings18 citations
- Prefix Propagation: Parameter-Efficient Tuning for Long SequencesShort18 citations
- Randomized Smoothing with Masked Inference for Adversarially Robust Text ClassificationsLong18 citations
- Rule By Example: Harnessing Logical Rules for Explainable Hate Speech DetectionLong18 citations
- Shielded Representations: Protecting Sensitive Attributes Through Iterative Gradient-Based ProjectionFindings18 citations
- Subset Retrieval Nearest Neighbor Machine TranslationLong18 citations
- Unified Language Representation for Question Answering over Text, Tables, and ImagesFindings18 citations
- miCSE: Mutual Information Contrastive Learning for Low-shot Sentence EmbeddingsLong18 citations
- ACLM: A Selective-Denoising based Generative Data Augmentation Approach for Low-Resource Complex NERLong17 citations
- Abductive Commonsense Reasoning Exploiting Mutually Exclusive ExplanationsLong17 citations
- Annotation-Inspired Implicit Discourse Relation Classification with Auxiliary Discourse Connective GenerationLong17 citations
- COLA: Contextualized Commonsense Causal Reasoning from the Causal Inference PerspectiveLong17 citations
- CREST: A Joint Framework for Rationalization and Counterfactual Text GenerationLong17 citations
- Causality-Guided Multi-Memory Interaction Network for Multivariate Stock Price Movement PredictionLong17 citations
- Check-COVID: Fact-Checking COVID-19 News Claims with Scientific EvidenceFindings17 citations
- CodePrompt: Task-Agnostic Prefix Tuning for Program and Language GenerationFindings17 citations
- Combo of Thinking and Observing for Outside-Knowledge VQALong17 citations
- DataFinder: Scientific Dataset Recommendation from Natural Language DescriptionsLong17 citations
- Document-Level Event Argument Extraction With a Chain Reasoning ParadigmLong17 citations
- Dual-Gated Fusion with Prefix-Tuning for Multi-Modal Relation ExtractionFindings17 citations
- EM Pre-training for Multi-party Dialogue Response GenerationLong17 citations
- Few-shot Reranking for Multi-hop QA via Language Model PromptingLong17 citations
- FluentSpeech: Stutter-Oriented Automatic Speech Editing with Context-Aware Diffusion ModelsFindings17 citations
- Generate then Select: Open-ended Visual Question Answering Guided by World KnowledgeFindings17 citations
- How do humans perceive adversarial text? A reality check on the validity and naturalness of word-based adversarial attacksLong17 citations
- HyperPELT: Unified Parameter-Efficient Language Model Tuning for Both Language and Vision-and-Language TasksFindings17 citations
- Interactive Concept Learning for Uncovering Latent Themes in Large Text CollectionsFindings17 citations
- Language model acceptability judgements are not always robust to contextLong17 citations
- Leveraging Training Data in Few-Shot Prompting for Numerical ReasoningFindings17 citations
- Mini-Model Adaptation: Efficiently Extending Pretrained Models to New Languages via Aligned Shallow TrainingFindings17 citations
- PESCO: Prompt-enhanced Self Contrastive Learning for Zero-shot Text ClassificationLong17 citations
- Prompt-Guided Retrieval Augmentation for Non-Knowledge-Intensive TasksFindings17 citations
- QUEST: A Retrieval Dataset of Entity-Seeking Queries with Implicit Set OperationsLong17 citations
- RHGN: Relation-gated Heterogeneous Graph Network for Entity Alignment in Knowledge GraphsFindings17 citations
- Recurrent Attention Networks for Long-text ModelingFindings17 citations
- Revisiting Token Dropping Strategy in Efficient BERT PretrainingLong17 citations
- TAVT: Towards Transferable Audio-Visual Text GenerationLong17 citations
- Text Style Transfer Back-TranslationLong17 citations
- Toward Expanding the Scope of Radiology Report Summarization to Multiple Anatomies and ModalitiesShort17 citations
- Two Heads Are Better Than One: Improving Fake News Video Detection by Correlating with NeighborsFindings17 citations
- Unsupervised Melody-to-Lyrics GenerationLong17 citations
- VLN-Trans: Translator for the Vision and Language Navigation AgentLong17 citations
- Werewolf Among Us: Multimodal Resources for Modeling Persuasion Behaviors in Social Deduction GamesFindings17 citations
- A Novel Table-to-Graph Generation Approach for Document-Level Joint Entity and Relation ExtractionLong16 citations
- A Probabilistic Framework for Discovering New IntentsLong16 citations
- A Systematic Study of Knowledge Distillation for Natural Language Generation with Pseudo-Target TrainingLong16 citations
- A Unified One-Step Solution for Aspect Sentiment Quad PredictionFindings16 citations
- Alleviating Over-smoothing for Unsupervised Sentence RepresentationLong16 citations
- Are Human Explanations Always Helpful? Towards Objective Evaluation of Human Natural Language ExplanationsLong16 citations
- Are Message Passing Neural Networks Really Helpful for Knowledge Graph Completion?Long16 citations
- AutoConv: Automatically Generating Information-seeking Conversations with Large Language ModelsShort16 citations
- BLEURT Has Universal Translations: An Analysis of Automatic Metrics by Minimum Risk TrainingLong16 citations
- Bias Beyond English: Counterfactual Tests for Bias in Sentiment Analysis in Four LanguagesFindings16 citations
- Boosting Distress Support Dialogue Responses with Motivational Interviewing StrategyFindings16 citations
- Class-Incremental Learning based on Label GenerationShort16 citations
- Composition-contrastive Learning for Sentence EmbeddingsLong16 citations
- DiSCoMaT: Distantly Supervised Composition Extraction from Tables in Materials Science ArticlesLong16 citations
- Do You Hear The People Sing? Key Point Analysis via Iterative Clustering and Abstractive SummarisationLong16 citations
- Exploring Better Text Image Translation with Multimodal CodebookLong16 citations
- Extrinsic Evaluation of Machine Translation MetricsLong16 citations
- Fine-tuning Happens in Tiny Subspaces: Exploring Intrinsic Task-specific Subspaces of Pre-trained Language ModelsLong16 citations
- Human-in-the-loop Abstractive Dialogue SummarizationFindings16 citations
- HyPe: Better Pre-trained Language Model Fine-tuning with Hidden Representation PerturbationLong16 citations
- Improving Continual Relation Extraction by Distinguishing Analogous SemanticsLong16 citations
- Improving Knowledge Graph Completion with Generative Hard Negative MiningFindings16 citations
- Incorporating Distributions of Discourse Structure for Long Document Abstractive SummarizationLong16 citations
- It Takes Two to Tango: Navigating Conceptualizations of NLP Tasks and Measurements of PerformanceFindings16 citations
- LightFormer: Light-weight Transformer Using SVD-based Weight Transfer and Parameter SharingFindings16 citations
- Multi-CLS BERT: An Efficient Alternative to Traditional EnsemblingLong16 citations
- Multi-hop Evidence Retrieval for Cross-document Relation ExtractionFindings16 citations
- MultiCapCLIP: Auto-Encoding Prompts for Zero-Shot Multilingual Visual CaptioningLong16 citations
- NLG Evaluation Metrics Beyond Correlation Analysis: An Empirical Metric Preference ChecklistLong16 citations
- On the Off-Target Problem of Zero-Shot Multilingual Neural Machine TranslationFindings16 citations
- On the Strength of Sequence Labeling and Generative Models for Aspect Sentiment Triplet ExtractionFindings16 citations
- One Cannot Stand for Everyone! Leveraging Multiple User Simulators to train Task-oriented Dialogue SystemsLong16 citations
- QAP: A Quantum-Inspired Adaptive-Priority-Learning Model for Multimodal Emotion RecognitionFindings16 citations
- Reliable and Interpretable Drift Detection in Streams of Short TextsIndustry16 citations
- TREA: Tree-Structure Reasoning Schema for Conversational RecommendationLong16 citations
- The Inside Story: Towards Better Understanding of Machine Translation Neural Evaluation MetricsShort16 citations
- The State of Profanity Obfuscation in Natural Language Processing Scientific PublicationsFindings16 citations
- Unifying Cross-Lingual and Cross-Modal Modeling Towards Weakly Supervised Multilingual Vision-Language Pre-trainingLong16 citations
- VCSUM: A Versatile Chinese Meeting Summarization DatasetFindings16 citations
- Where’s the Point? Self-Supervised Multilingual Punctuation-Agnostic Sentence SegmentationLong16 citations
- Why Does Zero-Shot Cross-Lingual Generation Fail? An Explanation and a SolutionFindings16 citations
- World-to-Words: Grounded Open Vocabulary Acquisition through Fast Mapping in Vision-Language ModelsLong16 citations
- Zero- and Few-Shot Event Detection via Prompt-Based Meta LearningLong16 citations
- A Match Made in Heaven: A Multi-task Framework for Hyperbole and Metaphor DetectionFindings15 citations
- A Sequence-to-Sequence&Set Model for Text-to-Table GenerationFindings15 citations
- A Universal Discriminator for Zero-Shot GeneralizationLong15 citations
- Annotating and Detecting Fine-grained Factual Errors for Dialogue SummarizationLong15 citations
- Bidirectional Transformer Reranker for Grammatical Error CorrectionFindings15 citations
- Can Diffusion Model Achieve Better Performance in Text Generation ? Bridging the Gap between Training and Inference !Findings15 citations
- Causality-aware Concept Extraction based on Knowledge-guided PromptingLong15 citations
- Coarse-to-fine Few-shot Learning for Named Entity RecognitionFindings15 citations
- Conflicts, Villains, Resolutions: Towards models of Narrative Media FramingLong15 citations
- ContraCLM: Contrastive Learning For Causal Language ModelLong15 citations
- Counterfactuals of Counterfactuals: a back-translation-inspired approach to analyse counterfactual editorsFindings15 citations
- E-NER: Evidential Deep Learning for Trustworthy Named Entity RecognitionFindings15 citations
- End-to-End Simultaneous Speech Translation with Differentiable SegmentationFindings15 citations
- Enhancing Continual Relation Extraction via Classifier DecompositionFindings15 citations
- Faithful Question Answering with Monte-Carlo PlanningLong15 citations
- HAHE: Hierarchical Attention for Hyper-Relational Knowledge Graphs in Global and Local LevelLong15 citations
- Improving Factuality of Abstractive Summarization without Sacrificing Summary QualityShort15 citations
- KALM: Knowledge-Aware Integration of Local, Document, and Global Contexts for Long Document UnderstandingLong15 citations
- Know What I don’t Know: Handling Ambiguous and Unknown Questions for Text-to-SQLFindings15 citations
- Large-scale Lifelong Learning of In-context Instructions and How to Tackle ItLong15 citations
- Learned Adapters Are Better Than Manually Designed AdaptersFindings15 citations
- Learning Language-Specific Layers for Multilingual Machine TranslationLong15 citations
- Learning to Generate Equitable Text in Dialogue from Biased Training DataLong15 citations
- Learning to Imagine: Visually-Augmented Natural Language GenerationLong15 citations
- Learning to Initialize: Can Meta Learning Improve Cross-task Generalization in Prompt Tuning?Long15 citations
- LexSym: Compositionality as Lexical SymmetryLong15 citations
- Modeling Cross-Cultural Pragmatic Inference with Codenames DuetFindings15 citations
- Multimodal Persona Based Generation of Comic DialogsLong15 citations
- On the Limitations of Simulating Active LearningFindings15 citations
- PAL to Lend a Helping Hand: Towards Building an Emotion Adaptive Polite and Empathetic Counseling Conversational AgentLong15 citations
- PTCSpell: Pre-trained Corrector Based on Character Shape and Pinyin for Chinese Spelling CorrectionFindings15 citations
- RobustQA: Benchmarking the Robustness of Domain Adaptation for Open-Domain Question AnsweringFindings15 citations
- S3HQA: A Three-Stage Approach for Multi-hop Text-Table Hybrid Question AnsweringShort15 citations
- SIMSUM: Document-level Text Simplification via Simultaneous SummarizationLong15 citations
- Self-adaptive Context and Modal-interaction Modeling For Multimodal Emotion RecognitionFindings15 citations
- Serial Contrastive Knowledge Distillation for Continual Few-shot Relation ExtractionFindings15 citations
- Simple and Effective Unsupervised Speech TranslationLong15 citations
- TART: Improved Few-shot Text Classification Using Task-Adaptive Reference TransformationLong15 citations
- Towards Boosting the Open-Domain Chatbot with Human FeedbackLong15 citations
- TransGEC: Improving Grammatical Error Correction with TranslationeseFindings15 citations
- UTC-IE: A Unified Token-pair Classification Architecture for Information ExtractionLong15 citations
- Won’t Get Fooled Again: Answering Questions with False PremisesLong15 citations
- Zero-Shot Text Classification via Self-Supervised TuningFindings15 citations
- 2*n is better than n2: Decomposing Event Coreference Resolution into Two Tractable ProblemsFindings14 citations
- A Multi-Modal Context Reasoning Approach for Conditional Inference on Joint Textual and Visual CluesLong14 citations
- A New Direction in Stance Detection: Target-Stance Extraction in the WildLong14 citations
- An (unhelpful) guide to selecting the best ASR architecture for your under-resourced languageShort14 citations
- Are Experts Needed? On Human Evaluation of Counselling Reflection GenerationLong14 citations
- BERM: Training the Balanced and Extractable Representation for Matching to Improve Generalization Ability of Dense RetrievalLong14 citations
- Characterization of Stigmatizing Language in Medical RecordsShort14 citations
- Continual Knowledge Distillation for Neural Machine TranslationLong14 citations
- DSEE: Dually Sparsity-embedded Efficient Tuning of Pre-trained Language ModelsLong14 citations
- Document-Level Multi-Event Extraction with Event Proxy Nodes and Hausdorff Distance MinimizationLong14 citations
- Fine-grained Artificial Neurons in Audio-transformers for Disentangling Neural Auditory EncodingFindings14 citations
- Forgotten Knowledge: Examining the Citational Amnesia in NLPLong14 citations
- Fourier Transformer: Fast Long Range Modeling by Removing Sequence Redundancy with FFT OperatorFindings14 citations
- From Key Points to Key Point Hierarchy: Structured and Expressive Opinion SummarizationLong14 citations
- Generating User-Engaging News HeadlinesLong14 citations
- Guide the Many-to-One Assignment: Open Information Extraction via IoU-aware Optimal TransportLong14 citations
- Improving Domain Generalization for Prompt-Aware Essay Scoring via Disentangled Representation LearningLong14 citations
- Improving Embedding-based Unsupervised Keyphrase Extraction by Incorporating Structural InformationFindings14 citations
- Improving the Robustness of Summarization Systems with Dual AugmentationLong14 citations
- Label-Aware Hyperbolic Embeddings for Fine-grained Emotion ClassificationLong14 citations
- Latent Positional Information is in the Self-Attention Variance of Transformer Language Models Without Positional EmbeddingsShort14 citations
- Learning Better Masking for Better Language Model Pre-trainingLong14 citations
- Learning Joint Structural and Temporal Contextualized Knowledge Embeddings for Temporal Knowledge Graph CompletionFindings14 citations
- Learning Multi-Step Reasoning by Solving Arithmetic TasksShort14 citations
- Learning from a Friend: Improving Event Extraction via Self-Training with Feedback from Abstract Meaning RepresentationFindings14 citations
- Local Interpretation of Transformer Based on Linear DecompositionLong14 citations
- MIL-Decoding: Detoxifying Language Models at Token-Level via Multiple Instance LearningLong14 citations
- MS-DETR: Natural Language Video Localization with Sampling Moment-Moment InteractionLong14 citations
- Measuring Your ASTE Models in The Wild: A Diversified Multi-domain Dataset For Aspect Sentiment Triplet ExtractionFindings14 citations
- Modeling What-to-ask and How-to-ask for Answer-unaware Conversational Question GenerationLong14 citations
- NaSGEC: a Multi-Domain Chinese Grammatical Error Correction Dataset from Native Speaker TextsFindings14 citations
- NoisywikiHow: A Benchmark for Learning with Real-world Noisy Labels in Natural Language ProcessingFindings14 citations
- NonFactS: NonFactual Summary Generation for Factuality Evaluation in Document SummarizationFindings14 citations
- Opinion Tree Parsing for Aspect-based Sentiment AnalysisFindings14 citations
- PAD-Net: An Efficient Framework for Dynamic NetworksLong14 citations
- ParaAMR: A Large-Scale Syntactically Diverse Paraphrase Dataset by AMR Back-TranslationLong14 citations
- Personality Understanding of Fictional Characters during Book ReadingLong14 citations
- Pre-Trained Language-Meaning Models for Multilingual Parsing and GenerationFindings14 citations
- Preserving Commonsense Knowledge from Pre-trained Language Models via Causal InferenceLong14 citations
- Privacy-Preserving Domain Adaptation of Semantic ParsersLong14 citations
- Program Chairs’ Report on Peer Review at ACL 2023Long14 citations
- Rethinking Document-Level Relation Extraction: A Reality CheckFindings14 citations
- Revisit Few-shot Intent Classification with PLMs: Direct Fine-tuning vs. Continual Pre-trainingFindings14 citations
- Robust Natural Language Understanding with Residual Attention DebiasingFindings14 citations
- SWiPE: A Dataset for Document-Level Simplification of Wikipedia PagesLong14 citations
- SimOAP: Improve Coherence and Consistency in Persona-based Dialogue Generation via Over-sampling and Post-evaluationLong14 citations
- Small Pre-trained Language Models Can be Fine-tuned as Large Models via Over-ParameterizationLong14 citations
- Text-to-SQL Error Correction with Language Models of CodeShort14 citations
- Topic-Guided Sampling For Data-Efficient Multi-Domain Stance DetectionLong14 citations
- Towards Faithful Dialogues via Focus LearningLong14 citations
- Towards Robust Personalized Dialogue Generation via Order-Insensitive Representation RegularizationFindings14 citations
- TwistList: Resources and Baselines for Tongue Twister GenerationShort14 citations
- What to Fuse and How to Fuse: Exploring Emotion and Personality Fusion Strategies for Explainable Mental Disorder DetectionFindings14 citations
- White-Box Multi-Objective Adversarial Attack on Dialogue GenerationLong14 citations
- Why Did the Chicken Cross the Road? Rephrasing and Analyzing Ambiguous Questions in VQALong14 citations
- A New Aligned Simple German CorpusLong13 citations
- B2T Connection: Serving Stability and Performance in Deep TransformersFindings13 citations
- Benchmarking Diverse-Modal Entity Linking with Generative ModelsFindings13 citations
- Beyond Positive Scaling: How Negation Impacts Scaling Trends of Language ModelsFindings13 citations
- COCKATIEL: COntinuous Concept ranKed ATtribution with Interpretable ELements for explaining neural net classifiers on NLPFindings13 citations
- Communication Efficient Federated Learning for Multilingual Neural Machine Translation with AdapterFindings13 citations
- Concept2Box: Joint Geometric Embeddings for Learning Two-View Knowledge GraphsFindings13 citations
- Connective Prediction for Implicit Discourse Relation Recognition via Knowledge DistillationLong13 citations
- Contrastive Error Attribution for Finetuned Language ModelsLong13 citations
- Cross-modal Attention Congruence Regularization for Vision-Language Relation AlignmentLong13 citations
- Deep Span Representations for Named Entity RecognitionFindings13 citations
- Deriving Language Models from Masked Language ModelsShort13 citations
- Do language models have coherent mental models of everyday things?Long13 citations
- Dual-Alignment Pre-training for Cross-lingual Sentence EmbeddingLong13 citations
- Efficient Out-of-Domain Detection for Sequence to Sequence ModelsFindings13 citations
- Enhancing Event Causality Identification with Counterfactual ReasoningShort13 citations
- Exploiting Pseudo Image Captions for Multimodal SummarizationFindings13 citations
- Exploring the Relationship between Alignment and Cross-lingual Transfer in Multilingual TransformersFindings13 citations
- FSUIE: A Novel Fuzzy Span Mechanism for Universal Information ExtractionLong13 citations
- Facilitating Fine-grained Detection of Chinese Toxic Language: Hierarchical Taxonomy, Resources, and BenchmarksLong13 citations
- FastDiff 2: Revisiting and Incorporating GANs and Diffusion Models in High-Fidelity Speech SynthesisFindings13 citations
- GKD: A General Knowledge Distillation Framework for Large-scale Pre-trained Language ModelIndustry13 citations
- Grounding Characters and Places in Narrative TextLong13 citations
- Hybrid Hierarchical Retrieval for Open-Domain Question AnsweringFindings13 citations
- Hybrid Knowledge Transfer for Improved Cross-Lingual Event Detection via Hierarchical Sample SelectionLong13 citations
- HyperMixer: An MLP-based Low Cost Alternative to TransformersLong13 citations
- Interpretable Automatic Fine-grained Inconsistency Detection in Text SummarizationFindings13 citations
- Just Like a Human Would, Direct Access to Sarcasm Augmented with Potential Result and ReactionLong13 citations
- Knowledge Transfer in Incremental Learning for Multilingual Neural Machine TranslationLong13 citations
- Large-Scale Correlation Analysis of Automated Metrics for Topic ModelsLong13 citations
- Learning Optimal Policy for Simultaneous Machine Translation via Binary SearchLong13 citations
- MIR-GAN: Refining Frame-Level Modality-Invariant Representations with Adversarial Network for Audio-Visual Speech RecognitionLong13 citations
- Multi-Dimensional Evaluation of Text Summarization with In-Context LearningFindings13 citations
- Multi-Document Summarization with Centroid-Based PretrainingShort13 citations
- Multi-Grained Knowledge Retrieval for End-to-End Task-Oriented DialogLong13 citations
- Post-Abstention: Towards Reliably Re-Attempting the Abstained Instances in QALong13 citations
- Product Question Answering in E-Commerce: A SurveyLong13 citations
- Rarely a problem? Language models exhibit inverse scaling in their predictions following few-type quantifiersFindings13 citations
- Replace and Report: NLP Assisted Radiology Report GenerationFindings13 citations
- Robust Representation Learning with Reliable Pseudo-labels Generation via Self-Adaptive Optimal Transport for Short Text ClusteringLong13 citations
- Similarity-Based Content Scoring - A more Classroom-Suitable Alternative to Instance-Based Scoring?Findings13 citations
- Translation-Enhanced Multilingual Text-to-Image GenerationLong13 citations
- Unbalanced Optimal Transport for Unbalanced Word AlignmentLong13 citations
- UniEX: An Effective and Efficient Framework for Unified Information Extraction via a Span-extractive PerspectiveLong13 citations
- Why Aren’t We NER Yet? Artifacts of ASR Errors in Named Entity Recognition in Spontaneous Speech TranscriptsLong13 citations
- Words as Gatekeepers: Measuring Discipline-specific Terms and Meanings in Scholarly PublicationsFindings13 citations
- vONTSS: vMF based semi-supervised neural topic modeling with optimal transportFindings13 citations
- A Unified Generative Approach to Product Attribute-Value IdentificationFindings12 citations
- ALERT: Adapt Language Models to Reasoning TasksLong12 citations
- An Empirical Study of Sentiment-Enhanced Pre-Training for Aspect-Based Sentiment AnalysisFindings12 citations
- AraMUS: Pushing the Limits of Data and Model Scale for Arabic Natural Language ProcessingFindings12 citations
- Are Fairy Tales Fair? Analyzing Gender Bias in Temporal Narrative Event Chains of Children’s Fairy TalesLong12 citations
- ArgU: A Controllable Factual Argument GeneratorLong12 citations
- Back Translation for Speech-to-text Translation Without TranscriptsLong12 citations
- Better Simultaneous Translation with Monotonic Knowledge DistillationLong12 citations
- Beyond Triplet: Leveraging the Most Data for Multimodal Machine TranslationFindings12 citations
- Bhasa-Abhijnaanam: Native-script and romanized Language Identification for 22 Indic languagesShort12 citations
- Context-Aware Document SimplificationFindings12 citations
- DSP: Discriminative Soft Prompts for Zero-Shot Entity and Relation ExtractionFindings12 citations
- Delving into the Openness of CLIPFindings12 citations
- Denoising Bottleneck with Mutual Information Maximization for Video Multimodal FusionLong12 citations
- Do CoNLL-2003 Named Entity Taggers Still Work Well in 2023?Long12 citations
- End-to-end Aspect-based Sentiment Analysis with Combinatory Categorial GrammarFindings12 citations
- Estimating the Uncertainty in Emotion Attributes using Deep Evidential RegressionLong12 citations
- Explanation-based Finetuning Makes Models More Robust to Spurious CuesLong12 citations
- FLamE: Few-shot Learning from Natural Language ExplanationsLong12 citations
- FashionKLIP: Enhancing E-Commerce Image-Text Retrieval with Fashion Multi-Modal Conceptual Knowledge GraphIndustry12 citations
- Few-Shot Document-Level Event Argument ExtractionLong12 citations
- FormNetV2: Multimodal Graph Contrastive Learning for Form Document Information ExtractionLong12 citations
- Going Beyond Sentence Embeddings: A Token-Level Matching Algorithm for Calculating Semantic Textual SimilarityShort12 citations
- Human-in-the-loop Evaluation for Early Misinformation Detection: A Case Study of COVID-19 TreatmentsLong12 citations
- Improved Visual Story Generation with Adaptive Context ModelingFindings12 citations
- Incorporating Graph Information in Transformer-based AMR ParsingFindings12 citations
- Infusing Hierarchical Guidance into Prompt Tuning: A Parameter-Efficient Framework for Multi-level Implicit Discourse Relation RecognitionLong12 citations
- Interpretable Math Word Problem Solution Generation via Step-by-step PlanningLong12 citations
- Language Agnostic Multilingual Information Retrieval with Contrastive LearningFindings12 citations
- Learn to Not Link: Exploring NIL Prediction in Entity LinkingFindings12 citations
- Linguistic representations for fewer-shot relation extraction across domainsLong12 citations
- Making Better Use of Training Corpus: Retrieval-based Aspect Sentiment Triplet Extraction via Label InterpolationFindings12 citations
- MidMed: Towards Mixed-Type Dialogues for Medical ConsultationLong12 citations
- MixCE: Training Autoregressive Language Models by Mixing Forward and Reverse Cross-EntropiesLong12 citations
- Multi-modal Action Chain Abductive ReasoningLong12 citations
- Multilingual Conceptual Coverage in Text-to-Image ModelsLong12 citations
- Multilingual Multi-Figurative Language DetectionFindings12 citations
- Nichelle and Nancy: The Influence of Demographic Attributes and Tokenization Length on First Name BiasesShort12 citations
- Nonlinear Structural Equation Model Guided Gaussian Mixture Hierarchical Topic ModelingLong12 citations
- Pay Attention to Implicit Attribute Values: A Multi-modal Generative Framework for AVE TaskFindings12 citations
- Prompt Tuning Pushes Farther, Contrastive Learning Pulls Closer: A Two-Stage Approach to Mitigate Social BiasesLong12 citations
- Reproducibility in NLP: What Have We Learned from the Checklist?Findings12 citations
- Resolving Ambiguities in Text-to-Image Generative ModelsLong12 citations
- Run Like a Girl! Sport-Related Gender Bias in Language and VisionFindings12 citations
- ScoNe: Benchmarking Negation Reasoning in Language Models With Fine-Tuning and In-Context LearningShort12 citations
- Speaking the Language of Your Listener: Audience-Aware Adaptation via Plug-and-Play Theory of MindFindings12 citations
- Structured Persuasive Writing Support in Legal Education: A Model and Tool for German Legal Case SolutionsFindings12 citations
- Tell2Design: A Dataset for Language-Guided Floor Plan GenerationLong12 citations
- Towards Building a Robust Toxicity PredictorIndustry12 citations
- Towards Parameter-Efficient Integration of Pre-Trained Language Models In Temporal Video GroundingFindings12 citations
- Two Birds One Stone: Dynamic Ensemble for OOD Intent ClassificationLong12 citations
- Uncertainty Guided Label Denoising for Document-level Distant Relation ExtractionLong12 citations
- Unsupervised Semantic Variation Prediction using the Distribution of Sibling EmbeddingsFindings12 citations
- Unsupervised Task Graph Generation from Instructional Video TranscriptsFindings12 citations
- Vision Language Pre-training by Contrastive Learning with Cross-Modal Similarity RegulationLong12 citations
- WebIE: Faithful and Robust Information Extraction on the WebLong12 citations
- What, When, and How to Ground: Designing User Persona-Aware Conversational Agents for Engaging DialogueIndustry12 citations
- Wukong-Reader: Multi-modal Pre-training for Fine-grained Visual Document UnderstandingLong12 citations
- Zero-shot Visual Question Answering with Language Model FeedbackFindings12 citations
- kNN-TL: k-Nearest-Neighbor Transfer Learning for Low-Resource Neural Machine TranslationLong12 citations
- A Call for Standardization and Validation of Text Style Transfer EvaluationFindings11 citations
- A Needle in a Haystack: An Analysis of High-Agreement Workers on MTurk for SummarizationLong11 citations
- A Simple and Effective Framework for Strict Zero-Shot Hierarchical ClassificationShort11 citations
- Aligning Offline Metrics and Human Judgments of Value for Code Generation ModelsFindings11 citations
- An Extensible Plug-and-Play Method for Multi-Aspect Controllable Text GenerationLong11 citations
- An Inner Table Retriever for Robust Table Question AnsweringLong11 citations
- Are Synonym Substitution Attacks Really Synonym Substitution Attacks?Findings11 citations
- Binary and Ternary Natural Language GenerationLong11 citations
- Compositional Data Augmentation for Abstractive Conversation SummarizationLong11 citations
- Content Moderation for Evolving Policies using Binary Question AnsweringIndustry11 citations
- Controlling Styles in Neural Machine Translation with Activation PromptFindings11 citations
- D-CALM: A Dynamic Clustering-based Active Learning Approach for Mitigating BiasFindings11 citations
- DIONYSUS: A Pre-trained Model for Low-Resource Dialogue SummarizationLong11 citations
- Decouple knowledge from paramters for plug-and-play language modelingFindings11 citations
- Dialogue Summarization with Static-Dynamic Structure Fusion GraphLong11 citations
- DiffuDetox: A Mixed Diffusion Model for Text DetoxificationFindings11 citations
- Discourse-Level Representations can Improve Prediction of Degree of AnxietyShort11 citations
- Elaboration-Generating Commonsense Question Answering at ScaleLong11 citations
- Enhancing Event Causality Identification with Event Causal Label and Event Pair Interaction GraphFindings11 citations
- Enhancing Neural Topic Model with Multi-Level Supervisions from Seed WordsFindings11 citations
- Evaluation for ChangeFindings11 citations
- Exploring Lottery Prompts for Pre-trained Language ModelsLong11 citations
- Faithful Low-Resource Data-to-Text Generation through Cycle TrainingLong11 citations
- Farewell to Aimless Large-scale Pretraining: Influential Subset Selection for Language ModelFindings11 citations
- Focus-aware Response Generation in Inquiry ConversationFindings11 citations
- Forecasting Earnings Surprises from Conference Call TranscriptsFindings11 citations
- General-to-Specific Transfer Labeling for Domain Adaptable Keyphrase GenerationFindings11 citations
- Hearing Lips in Noise: Universal Viseme-Phoneme Mapping and Transfer for Robust Audio-Visual Speech RecognitionLong11 citations
- Improving Long Dialogue Summarization with Semantic Graph RepresentationFindings11 citations
- KG-FLIP: Knowledge-guided Fashion-domain Language-Image Pre-training for E-commerceIndustry11 citations
- Know Where You’re Going: Meta-Learning for Parameter-Efficient Fine-TuningFindings11 citations
- KoRC: Knowledge Oriented Reading Comprehension Benchmark for Deep Text UnderstandingFindings11 citations
- Language Detoxification with Attribute-Discriminative Latent SpaceLong11 citations
- Mars: Modeling Context & State Representations with Contrastive Learning for End-to-End Task-Oriented DialogFindings11 citations
- MasakhaPOS: Part-of-Speech Tagging for Typologically Diverse African languagesLong11 citations
- Medical Dialogue Generation via Dual Flow ModelingFindings11 citations
- Moving Beyond Downstream Task Accuracy for Information Retrieval BenchmarkingFindings11 citations
- NAG-NER: a Unified Non-Autoregressive Generation Framework for Various NER TasksIndustry11 citations
- NewsMet : A ‘do it all’ Dataset of Contemporary Metaphors in News HeadlinesFindings11 citations
- NollySenti: Leveraging Transfer Learning and Machine Translation for Nigerian Movie Sentiment ClassificationShort11 citations
- On Isotropy, Contextualization and Learning Dynamics of Contrastive-based Sentence Representation LearningFindings11 citations
- On the Efficacy of Sampling AdaptersLong11 citations
- PLUE: Language Understanding Evaluation Benchmark for Privacy Policies in EnglishShort11 citations
- Pay More Attention to Relation Exploration for Knowledge Base Question AnsweringFindings11 citations
- RMLM: A Flexible Defense Framework for Proactively Mitigating Word-level Adversarial AttacksLong11 citations
- Rethinking Round-Trip Translation for Machine Translation EvaluationFindings11 citations
- SESCORE2: Learning Text Generation Evaluation via Synthesizing Realistic MistakesLong11 citations
- Score It All Together: A Multi-Task Learning Study on Automatic Scoring of Argumentative EssaysFindings11 citations
- Self-Evolution Learning for Discriminative Language Model PretrainingFindings11 citations
- Sentiment Knowledge Enhanced Self-supervised Learning for Multimodal Sentiment AnalysisFindings11 citations
- Similarity-weighted Construction of Contextualized Commonsense Knowledge Graphs for Knowledge-intense Argumentation TasksLong11 citations
- StoryTrans: Non-Parallel Story Author-Style Transfer with Discourse Representations and Content EnhancingLong11 citations
- TADA : Task Agnostic Dialect Adapters for EnglishFindings11 citations
- TAGPRIME: A Unified Framework for Relational Structure ExtractionLong11 citations
- TableVLM: Multi-modal Pre-training for Table Structure RecognitionLong11 citations
- Tailoring Instructions to Student’s Learning Levels Boosts Knowledge DistillationLong11 citations
- Target-Side Augmentation for Document-Level Machine TranslationLong11 citations
- Towards Better Hierarchical Text Classification with Data GenerationFindings11 citations
- Transformed Protoform ReconstructionShort11 citations
- U-CREAT: Unsupervised Case Retrieval using Events extrAcTionLong11 citations
- Unsupervised Keyphrase Extraction by Learning Neural Keyphrase Set FunctionFindings11 citations
- A Crosslingual Investigation of Conceptualization in 1335 LanguagesLong10 citations
- A Multi-modal Debiasing Model with Dynamical Constraint for Robust Visual Question AnsweringFindings10 citations
- A Two-Stage Decoder for Efficient ICD CodingFindings10 citations
- APOLLO: A Simple Approach for Adaptive Pretraining of Language Models for Logical ReasoningLong10 citations
- Actively Supervised Clustering for Open Relation ExtractionLong10 citations
- Adaptive Contrastive Knowledge Distillation for BERT CompressionFindings10 citations
- Adversarial Multi-task Learning for End-to-end Metaphor DetectionFindings10 citations
- Adversarial Robustness of Prompt-based Few-Shot Learning for Natural Language UnderstandingFindings10 citations
- BADGE: Speeding Up BERT Inference after Deployment via Block-wise Bypasses and Divergence-based Early ExitingIndustry10 citations
- Better Language Models of Code through Self-ImprovementFindings10 citations
- Byte-Level Grammatical Error Correction Using Synthetic and Curated CorporaLong10 citations
- CKDST: Comprehensively and Effectively Distill Knowledge from Machine Translation to End-to-End Speech TranslationFindings10 citations
- Causal interventions expose implicit situation models for commonsense language understandingFindings10 citations
- CoAD: Automatic Diagnosis through Symptom and Disease Collaborative GenerationLong10 citations
- Commonsense Knowledge Graph Completion Via Contrastive Pretraining and Node ClusteringFindings10 citations
ACL accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.