NAACL 2022 Accepted Papers
The full list of 705 papers accepted at NAACL 2022 (North American Chapter of the Association for Computational Linguistics). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Long: 442Findings: 209Industry: 40System Demonstrations: 14
- Learning To Retrieve Prompts for In-Context LearningLong700 citations
- FNet: Mixing Tokens with Fourier TransformsLong646 citations
- MetaICL: Learning to Learn In ContextLong510 citations
- ColBERTv2: Effective and Efficient Retrieval via Lightweight Late InteractionLong497 citations
- Do Prompt-Based Models Really Understand the Meaning of Their Prompts?Long405 citations
- Symbolic Knowledge Distillation: from General Language Models to Commonsense ModelsLong349 citations
- LongT5: Efficient Text-To-Text Transformer for Long SequencesFindings344 citations
- Annotators with Attitudes: How Annotator Beliefs And Identities Bias Toxic Language DetectionLong289 citations
- DiffCSE: Difference-based Contrastive Learning for Sentence EmbeddingsLong241 citations
- TRUE: Re-evaluating Factual Consistency EvaluationLong239 citations
- QAFactEval: Improved QA-Based Factual Consistency Evaluation for SummarizationLong211 citations
- Template-free Prompt Tuning for Few-shot NERLong207 citations
- On the Origin of Hallucinations in Conversational Models: Is it the Datasets or the Models?Long193 citations
- BanglaBERT: Language Model Pretraining and Benchmarks for Low-Resource Language Understanding Evaluation in BanglaFindings190 citations
- DEGREE: A Data-Efficient Generation-Based Event Extraction ModelLong185 citations
- KAT: A Knowledge Augmented Transformer for Vision-and-LanguageLong185 citations
- NeuroLogic A*esque Decoding: Constrained Text Generation with Lookahead HeuristicsLong182 citations
- GPL: Generative Pseudo Labeling for Unsupervised Domain Adaptation of Dense RetrievalLong177 citations
- Two Contrasting Data Annotation Paradigms for Subjective NLP TasksLong175 citations
- On Transferability of Prompt Tuning for Natural Language ProcessingLong161 citations
- Reframing Human-AI Collaboration for Generating Free-Text ExplanationsLong161 citations
- Textless Speech-to-Speech Translation on Real DataLong157 citations
- A Survey on Stance Detection for Mis- and Disinformation IdentificationFindings155 citations
- QuALITY: Question Answering with Long Input Texts, Yes!Long149 citations
- FedNLP: Benchmarking Federated Learning Methods for Natural Language Processing TasksFindings147 citations
- Re2G: Retrieve, Rerank, GenerateLong145 citations
- SSEGCN: Syntactic and Semantic Enhanced Graph Convolutional Network for Aspect-based Sentiment AnalysisLong145 citations
- Measure and Improve Robustness in NLP Models: A SurveyLong141 citations
- Good Visual Guidance Make A Better Extractor: Hierarchical Visual Prefix for Multimodal Entity and Relation ExtractionFindings138 citations
- Lifelong Pretraining: Continually Adapting Language Models to Emerging CorporaLong138 citations
- COGMEN: COntextualized GNN based Multimodal Emotion recognitioNLong137 citations
- UniK-QA: Unified Representations of Structured and Unstructured Knowledge for Open-Domain Question AnsweringFindings137 citations
- DEMix Layers: Disentangling Domains for Modular Language ModelingLong133 citations
- Measuring Fairness with Biased Rulers: A Comparative Study on Bias Metrics for Pre-trained Language ModelsLong127 citations
- Few-Shot Self-Rationalization with Natural Language PromptsFindings121 citations
- On the Use of Bert for Automated Essay Scoring: Joint Learning of Multi-Scale Essay RepresentationLong108 citations
- ReFinED: An Efficient Zero-shot-capable Approach to End-to-End Entity LinkingIndustry102 citations
- SKILL: Structured Knowledge Infusion for Large Language ModelsLong100 citations
- CoMPM: Context Modeling with Speaker’s Pre-trained Memory Tracking for Emotion Recognition in ConversationLong99 citations
- Fine-grained Image Captioning with CLIP RewardFindings98 citations
- On the Effect of Pretraining Corpora on In-context Learning by a Large-scale Language ModelLong98 citations
- MuCGEC: a Multi-Reference Multi-Source Evaluation Dataset for Chinese Grammatical Error CorrectionLong97 citations
- Is Neural Topic Modelling Better than Clustering? An Empirical Study on Clustering with Contextual Embeddings for TopicsLong96 citations
- CLMLF:A Contrastive Learning and Multi-Layer Fusion Method for Multimodal Sentiment DetectionFindings93 citations
- Cross-modal Contrastive Learning for Speech TranslationLong93 citations
- Time Waits for No One! Analysis and Challenges of Temporal MisalignmentLong93 citations
- MWP-BERT: Numeracy-Augmented Pre-training for Math Word Problem SolvingFindings91 citations
- Exploring the Universal Vulnerability of Prompt-based Learning ParadigmFindings90 citations
- Identifying and Mitigating Spurious Correlations for Improving Robustness in NLP ModelsFindings89 citations
- Quality-Aware Decoding for Neural Machine TranslationLong87 citations
- WECHSEL: Effective initialization of subword embeddings for cross-lingual transfer of monolingual language modelsLong86 citations
- Benchmarking Intersectional Biases in NLPLong85 citations
- GenIE: Generative Information ExtractionLong84 citations
- JointLK: Joint Reasoning with Language Models and Knowledge Graphs for Commonsense Question AnsweringLong84 citations
- POLITICS: Pretraining with Same-story Article Comparison for Ideology Prediction and Stance DetectionFindings83 citations
- A Study of the Attention Abnormality in Trojaned BERTsLong81 citations
- MultiVerS: Improving scientific claim verification with weak supervision and full-document contextFindings81 citations
- Triggerless Backdoor Attack for NLP Tasks with Clean LabelsLong81 citations
- Improving Compositional Generalization with Latent Structure and Data AugmentationLong80 citations
- Learning Rich Representation of Keyphrases from TextFindings79 citations
- SkillSpan: Hard and Soft Skill Extraction from English Job PostingsLong76 citations
- Cross-Domain Detection of GPT-2-Generated Technical TextLong75 citations
- Testing the Ability of Language Models to Interpret Figurative LanguageLong75 citations
- OmniTab: Pretraining with Natural and Synthetic Data for Few-shot Table-based Question AnsweringLong74 citations
- Hierarchical Transformers Are More Efficient Language ModelsFindings73 citations
- All You May Need for VQA are Image CaptionsLong72 citations
- Few-Shot Semantic Parsing with Language Models Trained on CodeLong72 citations
- Great Power, Great Responsibility: Recommendations for Reducing Energy for Training Language ModelsFindings72 citations
- CONFIT: Toward Faithful Dialogue Summarization with Linguistically-Informed Contrastive Fine-tuningLong71 citations
- Detect Rumors in Microblog Posts for Low-Resource Domains via Adversarial Contrastive LearningFindings71 citations
- Gender Bias in Masked Language Models for Multiple LanguagesLong71 citations
- A Two-Stream AMR-enhanced Model for Document-level Event Argument ExtractionLong70 citations
- FactPEGASUS: Factuality-Aware Pre-training and Fine-tuning for Abstractive SummarizationLong70 citations
- Less is More: Learning to Refine Dialogue History for Personalized Dialogue GenerationLong69 citations
- Selective Differential Privacy for Language ModelingLong69 citations
- Hatemoji: A Test Suite and Adversarially-Generated Dataset for Benchmarking and Detecting Emoji-Based HateLong68 citations
- Delving Deep into Regularity: A Simple but Effective Method for Chinese Named Entity RecognitionFindings67 citations
- SAIS: Supervising and Augmenting Intermediate Steps for Document-Level Relation ExtractionLong67 citations
- An Enhanced Span-based Decomposition Method for Few-Shot Sequence LabelingLong66 citations
- BlonDe: An Automatic Evaluation Metric for Document-level Machine TranslationLong66 citations
- ConfliBERT: A Pre-trained Language Model for Political Conflict and ViolenceLong64 citations
- MoEBERT: from BERT to Mixture-of-Experts via Importance-Guided AdaptationLong64 citations
- SemAttack: Natural Textual Attacks via Different Semantic SpacesFindings63 citations
- Efficient Hierarchical Domain Adaptation for Pretrained Language ModelsLong62 citations
- Evidentiality-guided Generation for Knowledge-Intensive NLP TasksLong62 citations
- TaCL: Improving BERT Pre-training with Token-aware Contrastive LearningFindings62 citations
- Temporal Attention for Language ModelsFindings62 citations
- Can Rationalization Improve Robustness?Long61 citations
- Domain-matched Pre-training Tasks for Dense RetrievalFindings61 citations
- In-BoXBART: Get Instructions into Biomedical Multi-Task LearningFindings61 citations
- Knowledge Inheritance for Pre-trained Language ModelsLong61 citations
- Knowledge-Grounded Dialogue Generation with a Unified Knowledge RepresentationLong61 citations
- Aligning Generative Language Models with Human ValuesFindings60 citations
- FactGraph: Evaluating Factuality in Summarization with Semantic Graph RepresentationsLong60 citations
- IDPG: An Instance-Dependent Prompt Generation MethodLong59 citations
- Learning to Retrieve Passages without SupervisionLong59 citations
- Meta Learning for Natural Language Processing: A SurveyLong57 citations
- MixQG: Neural Question Generation with Mixed Answer TypesFindings57 citations
- Theory-Grounded Measurement of U.S. Social Stereotypes in English Language ModelsLong57 citations
- Transparent Human Evaluation for Image CaptioningLong57 citations
- Overcoming Catastrophic Forgetting During Domain Adaptation of Seq2seq Language GenerationLong56 citations
- Diagnosing Vision-and-Language Navigation: What Really MattersLong55 citations
- Exploring Neural Models for Query-Focused SummarizationFindings55 citations
- MultiSpanQA: A Dataset for Multi-Span Question AnsweringLong55 citations
- A Few Thousand Translations Go a Long Way! Leveraging Pre-trained Models for African News TranslationLong54 citations
- Generative Biomedical Entity Linking via Knowledge Base-Guided Pre-training and Synonyms-Aware Fine-tuningLong53 citations
- SeaD: End-to-end Text-to-SQL Generation with Schema-aware DenoisingFindings53 citations
- The Limits of Word Level Differential PrivacyFindings53 citations
- AdapterBias: Parameter-efficient Token-dependent Representation Shift for Adapters in NLP TasksFindings52 citations
- Hate Speech and Counter Speech Detection: Conversational Context Does MatterLong52 citations
- MultiCite: Modeling realistic citations requires moving beyond the single-sentence single-label settingLong52 citations
- Building a Role Specified Open-Domain Dialogue System Leveraging Large-Scale Language ModelsLong51 citations
- Pretrained Models for Multilingual Federated LearningLong51 citations
- Challenges in Generalization in Open Domain Question AnsweringFindings50 citations
- Global Entity Disambiguation with BERTLong50 citations
- Robust (Controlled) Table-to-Text Generation with Structure-Aware Equivariance LearningLong50 citations
- SEQZERO: Few-shot Compositional Semantic Parsing with Sequential Prompts and Zero-shot ModelsFindings50 citations
- Should We Rely on Entity Mentions for Relation Extraction? Debiasing Relation Extraction with Counterfactual AnalysisLong50 citations
- Towards Efficient NLP: A Standard Evaluation and A Strong BaselineLong50 citations
- Improving Conversational Recommendation Systems’ Quality with Context-Aware Item Meta-InformationFindings49 citations
- Learning to Transfer Prompts for Text GenerationLong49 citations
- MultiNERD: A Multilingual, Multi-Genre and Fine-Grained Dataset for Named Entity Recognition (and Disambiguation)Findings48 citations
- CHAI: A CHatbot AI for Task-Oriented Dialogue with Offline Reinforcement LearningLong47 citations
- ITA: Image-Text Alignments for Multi-Modal Named Entity RecognitionLong47 citations
- Learning to Execute Actions or Ask Clarification QuestionsFindings47 citations
- Visual Commonsense in Pretrained Unimodal and Multimodal ModelsLong47 citations
- A Robustly Optimized BMRC for Aspect Sentiment Triplet ExtractionLong46 citations
- Analyzing Modality Robustness in Multimodal Sentiment AnalysisLong46 citations
- Context-Aware Abbreviation Expansion Using Large Language ModelsLong46 citations
- Joint Extraction of Entities, Relations, and Events via Modeling Inter-Instance and Inter-Label DependenciesLong46 citations
- Textual Entailment for Event Argument Extraction: Zero- and Few-Shot with Multi-Source LearningFindings46 citations
- Entity Cloze By Date: What LMs Know About Unseen EntitiesFindings45 citations
- Falsesum: Generating Document-level NLI Examples for Recognizing Factual Inconsistency in SummarizationLong45 citations
- KALA: Knowledge-Augmented Language Model AdaptationLong45 citations
- Socially Aware Bias Measurements for Hindi Language RepresentationsLong45 citations
- A Generative Language Model for Few-shot Aspect-Based Sentiment AnalysisFindings44 citations
- Aligning to Social Norms and Values in Interactive NarrativesLong44 citations
- Entailment Tree Explanations via Iterative Retrieval-Generation ReasonerFindings44 citations
- Literature-Augmented Clinical Outcome PredictionFindings44 citations
- When is BERT Multilingual? Isolating Crucial Ingredients for Cross-lingual TransferLong44 citations
- CHEF: A Pilot Chinese Dataset for Evidence-Based Fact-CheckingLong43 citations
- Cross-Domain Classification of Moral ValuesFindings43 citations
- DocEE: A Large-Scale and Fine-grained Benchmark for Document-level Event ExtractionLong43 citations
- EmpHi: Generating Empathetic Responses with Human-like IntentsLong43 citations
- HiURE: Hierarchical Exemplar Contrastive Learning for Unsupervised Relation ExtractionLong43 citations
- Meet Your Favorite Character: Open-domain Chatbot Mimicking Fictional Characters with only a Few UtterancesLong43 citations
- Neural Language Taskonomy: Which NLP Tasks are the most Predictive of fMRI Brain Activity?Long43 citations
- Contrastive Learning for Prompt-based Few-shot Language LearnersLong42 citations
- FRUIT: Faithfully Reflecting Updated Information in TextLong42 citations
- Multi-Vector Models with Textual Guidance for Fine-Grained Scientific Document SimilarityLong42 citations
- Query2Particles: Knowledge Graph Reasoning with Particle EmbeddingsFindings42 citations
- The Role of Context in Detecting Previously Fact-Checked ClaimsFindings42 citations
- Analyzing Encoded Concepts in Transformer Language ModelsLong41 citations
- EmRel: Joint Representation of Entities and Embedded Relations for Multi-triple ExtractionLong41 citations
- Frustratingly Easy System Combination for Grammatical Error CorrectionLong41 citations
- RAAT: Relation-Augmented Attention Transformer for Relation Modeling in Document-Level Event ExtractionLong41 citations
- Re-Examining System-Level Correlations of Automatic Summarization Evaluation MetricsLong41 citations
- AIT-QA: Question Answering Dataset over Complex Tables in the Airline IndustryIndustry40 citations
- BAD-X: Bilingual Adapters Improve Zero-Shot Cross-Lingual TransferLong40 citations
- Bidimensional Leaderboards: Generate and Evaluate Language Hand in HandLong40 citations
- Learning to repair: Repairing model output errors after deployment using a dynamic memory of feedbackFindings40 citations
- RESIN-11: Schema-guided Event Prediction for 11 Newsworthy ScenariosSystem Demonstrations40 citations
- Zero-shot Sonnet Generation with Discourse-level Planning and Aesthetics FeaturesLong40 citations
- ALLSH: Active Learning Guided by Local Sensitivity and HardnessFindings39 citations
- Models in the Loop: Aiding Crowdworkers with Generative Annotation AssistantsLong39 citations
- UserIdentifier: Implicit User Representations for Simple and Effective Personalized Sentiment AnalysisLong39 citations
- CODE-MVP: Learning to Represent Source Code from Multiple Views with Contrastive Pre-TrainingFindings38 citations
- DUCK: Rumour Detection on Social Media by Modelling User and Comment Propagation NetworksLong38 citations
- DialoKG: Knowledge-Structure Aware Task-Oriented Dialogue GenerationFindings38 citations
- EASE: Entity-Aware Contrastive Learning of Sentence EmbeddingLong38 citations
- Entity Linking via Explicit Mention-Mention Coreference ModelingLong38 citations
- Generative Cross-Domain Data Augmentation for Aspect and Opinion Co-ExtractionLong38 citations
- GlobEnc: Quantifying Global Token Attribution by Incorporating the Whole Encoder Layer in TransformersLong38 citations
- Informativeness and Invariance: Two Perspectives on Spurious Correlations in Natural LanguageLong38 citations
- KETOD: Knowledge-Enriched Task-Oriented DialogueFindings38 citations
- METGEN: A Module-Based Entailment Tree Generation Framework for Answer ExplanationFindings38 citations
- ProQA: Structural Prompt-based Pre-training for Unified Question AnsweringLong38 citations
- DialSummEval: Revisiting Summarization Evaluation for DialoguesLong37 citations
- End-to-end Spoken Conversational Question Answering: Task, Dataset and ModelFindings37 citations
- How Gender Debiasing Affects Internal Model Representations, and Why It MattersLong37 citations
- Improving the Faithfulness of Abstractive Summarization via Entity Coverage ControlFindings37 citations
- MCSE: Multimodal Contrastive Learning of Sentence EmbeddingsLong37 citations
- Maximum Bayes Smatch Ensemble Distillation for AMR ParsingLong37 citations
- DISARM: Detecting the Victims Targeted by Harmful MemesFindings36 citations
- Deconstructing NLG Evaluation: Evaluation Practices, Assumptions, and Their ImplicationsLong36 citations
- PCEE-BERT: Accelerating BERT Inference via Patient and Confident Early ExitingFindings36 citations
- TWEETSPIN: Fine-grained Propaganda Detection in Social Media Using Multi-View RepresentationsLong36 citations
- Counterfactually Augmented Data and Unintended Bias: The Case of Sexism and Hate Speech DetectionLong35 citations
- Document-Level Relation Extraction with Sentences Importance Estimation and FocusingLong35 citations
- Fine-tuning Pre-trained Language Models for Few-shot Intent Detection: Supervised Pre-training and IsotropizationLong35 citations
- Imagination-Augmented Natural Language UnderstandingLong35 citations
- Multi2WOZ: A Robust Multilingual Dataset and Conversational Pretraining for Task-Oriented DialogLong35 citations
- NLU++: A Multi-Label, Slot-Rich, Generalisable Dataset for Natural Language Understanding in Task-Oriented DialogueFindings35 citations
- On the Diversity and Limits of Human ExplanationsLong35 citations
- PPL-MCTS: Constrained Textual Generation Through Discriminator-Guided MCTS DecodingLong35 citations
- A Holistic Framework for Analyzing the COVID-19 Vaccine DebateLong34 citations
- Learning Cross-Lingual IR from an English RetrieverLong34 citations
- Mapping the Design Space of Human-AI Interaction in Text SummarizationLong34 citations
- Show, Don’t Tell: Demonstrations Outperform Descriptions for Schema-Guided Task-Oriented DialogueLong34 citations
- A Word is Worth A Thousand Dollars: Adversarial Attack on Tweets Fools Stock PredictionLong33 citations
- Hyperbolic Relevance Matching for Neural Keyphrase ExtractionLong33 citations
- Many Hands Make Light Work: Using Essay Traits to Automatically Score EssaysLong33 citations
- Proposition-Level Clustering for Multi-Document SummarizationLong33 citations
- Robust Conversational Agents against Imperceptible Toxicity TriggersLong33 citations
- TVShowGuess: Character Comprehension in Stories as Speaker GuessingLong33 citations
- Cross-document Misinformation Detection based on Event Graph ReasoningLong32 citations
- Empathetic Persuasion: Reinforcing Empathy and Persuasiveness in Dialogue SystemsFindings32 citations
- Exposing the Limits of Video-Text Models through Contrast SetsLong32 citations
- KD-VLP: Improving End-to-End Vision-and-Language Pretraining with Object Knowledge DistillationFindings32 citations
- Phrase-level Textual Adversarial Attack with Label PreservationFindings32 citations
- Provably Confidential Language ModellingLong32 citations
- Same Neurons, Different Languages: Probing Morphosyntax in Multilingual Pre-trained ModelsLong32 citations
- Zero-Shot Event Detection Based on Ordered Contrastive Learning and Prompt-Based PredictionFindings32 citations
- Connecting the Dots between Audio and Text without Parallel Data through Visual Knowledge TransferLong31 citations
- EA2E: Improving Consistency with Event Awareness for Document-Level Argument ExtractionFindings31 citations
- Enhancing Knowledge Selection for Grounded Dialogues via Document Semantic GraphsLong31 citations
- ExSum: From Local Explanations to Model UnderstandingLong31 citations
- Explaining Toxic Text via Knowledge Enhanced Text GenerationLong31 citations
- Extreme Zero-Shot Learning for Extreme Text ClassificationLong31 citations
- Features or Spurious Artifacts? Data-centric Baselines for Fair and Robust Hate Speech DetectionLong31 citations
- Improving In-Context Few-Shot Learning via Self-Supervised TrainingLong31 citations
- MTG: A Benchmark Suite for Multilingual Text GenerationFindings31 citations
- On the Limitations of Dataset Balancing: The Lost Battle Against Spurious CorrelationsFindings31 citations
- Inducing and Using Alignments for Transition-based AMR ParsingLong30 citations
- Tricks for Training Sparse Translation ModelsLong30 citations
- Am I Me or You? State-of-the-Art Dialogue Models Cannot Maintain an IdentityFindings29 citations
- AmbiPun: Generating Humorous Puns with Ambiguous ContextLong29 citations
- Clues Before Answers: Generation-Enhanced Multiple-Choice QALong29 citations
- Extracting Temporal Event Relation with Syntax-guided Graph TransformerFindings29 citations
- FOAM: A Follower-aware Speaker Model For Vision-and-Language NavigationLong29 citations
- How Conservative are Language Models? Adapting to the Introduction of Gender-Neutral PronounsLong29 citations
- Necessity and Sufficiency for Explaining Text Classifiers: A Case Study in Hate Speech DetectionLong29 citations
- NewsEdits: A News Article Revision Dataset and a Novel Document-Level Reasoning ChallengeLong29 citations
- Relation-Specific Attentions over Entity Mentions for Enhanced Document-Level Relation ExtractionLong29 citations
- Simple Local Attentions Remain Competitive for Long-Context TasksLong29 citations
- Towards Process-Oriented, Modular, and Versatile Question Generation that Meets Educational NeedsLong29 citations
- TreeMix: Compositional Constituency-based Data Augmentation for Natural Language UnderstandingLong29 citations
- Cross-Lingual Event Detection via Optimized Adversarial TrainingLong28 citations
- Privacy-Preserving Text Classification on BERT Embeddings with Homomorphic EncryptionLong28 citations
- Twitter-COMMs: Detecting Climate, COVID, and Military Multimodal MisinformationLong28 citations
- Unified Semantic Typing with Meaningful Label InferenceLong28 citations
- Using Natural Sentence Prompts for Understanding Biases in Language ModelsLong28 citations
- You Don’t Know My Favorite Color: Preventing Dialogue Representations from Revealing Speakers’ Private PersonasLong28 citations
- A Shoulder to Cry on: Towards A Motivational Virtual Assistant for Assuaging Mental AgonyLong27 citations
- Automatic Multi-Label Prompting: Simple and Interpretable Few-Shot ClassificationLong27 citations
- BORT: Back and Denoising Reconstruction for End-to-End Task-Oriented DialogFindings27 citations
- Context-Aware Language Modeling for Goal-Oriented Dialogue SystemsFindings27 citations
- DISAPERE: A Dataset for Discourse Structure in Peer Review DiscussionsLong27 citations
- Long Context Question Answering via Supervised Contrastive LearningLong27 citations
- Optimising Equal Opportunity Fairness in Model TrainingLong27 citations
- PaddleSpeech: An Easy-to-Use All-in-One Speech ToolkitSystem Demonstrations27 citations
- PromptGen: Automatically Generate Prompts using Generative ModelsFindings27 citations
- Quiz Design Task: Helping Teachers Create Quizzes with Automated Question GenerationFindings27 citations
- Semantic Diversity in Dialogue with Natural Language InferenceLong27 citations
- StATIK: Structure and Text for Inductive Knowledge Graph CompletionFindings27 citations
- When a sentence does not introduce a discourse entity, Transformer-based models still sometimes refer to itLong27 citations
- Adaptable AdaptersLong26 citations
- Crossroads, Buildings and Neighborhoods: A Dataset for Fine-grained Location RecognitionLong26 citations
- LUNA: Learning Slot-Turn Alignment for Dialogue State TrackingLong26 citations
- On Measuring Social Biases in Prompt-Based Multi-Task LearningFindings26 citations
- RAIL-KD: RAndom Intermediate Layer Mapping for Knowledge DistillationFindings26 citations
- What do tokens know about their characters and how do they know it?Long26 citations
- Causal Distillation for Language ModelsLong25 citations
- Commonsense and Named Entity Aware Knowledge Grounded Dialogue GenerationLong25 citations
- Hero-Gang Neural Model For Named Entity RecognitionLong25 citations
- KCD: Knowledge Walks and Textual Cues Enhanced Political Perspective Detection in News MediaLong25 citations
- Probing via PromptingLong25 citations
- PubHealthTab: A Public Health Table-based Dataset for Evidence-based Fact CheckingFindings25 citations
- RCL: Relation Contrastive Learning for Zero-Shot Relation ExtractionFindings25 citations
- SwahBERT: Language Model of SwahiliLong25 citations
- VGNMN: Video-grounded Neural Module Networks for Video-Grounded Dialogue SystemsLong25 citations
- Yes, No or IDK: The Challenge of Unanswerable Yes/No QuestionsLong25 citations
- A Balanced Data Approach for Evaluating Cross-Lingual Transfer: Mapping the Linguistic Blood BankLong24 citations
- Cryptocurrency Bubble Detection: A New Stock Market Dataset, Financial Task & Hyperbolic ModelsLong24 citations
- Learn from Relation Information: Towards Prototype Representation Rectification for Few-Shot Relation ExtractionFindings24 citations
- Machine-in-the-Loop Rewriting for Creative Image CaptioningLong24 citations
- One Reference Is Not Enough: Diverse Distillation with Reference Selection for Non-Autoregressive TranslationLong24 citations
- Persona-Guided Planning for Controlling the Protagonist’s Persona in Story GenerationLong24 citations
- Cross-Lingual Cross-Modal Consolidation for Effective Multilingual Video Corpus Moment RetrievalFindings23 citations
- DREAM: Improving Situational QA by First Elaborating the SituationLong23 citations
- Domain-Oriented Prefix-Tuning: Towards Efficient and Generalizable Fine-tuning for Zero-Shot Dialogue SummarizationLong23 citations
- Dynamic Gazetteer Integration in Multilingual Models for Cross-Lingual and Cross-Domain Named Entity RecognitionLong23 citations
- Fuse It More Deeply! A Variational Transformer with Layer-Wise Latent Variable Inference for Text GenerationLong23 citations
- ID10M: Idiom Identification in 10 LanguagesFindings23 citations
- Improving Entity Disambiguation by Reasoning over a Knowledge BaseLong23 citations
- Intent Detection and Discovery from User Logs via Deep Semi-Supervised Contrastive ClusteringLong23 citations
- MM-Claims: A Dataset for Multimodal Claim Detection in Social MediaFindings23 citations
- Measuring and Improving Compositional Generalization in Text-to-SQL via Component AlignmentFindings23 citations
- Multi-Hop Open-Domain Question Answering over Structured and Unstructured KnowledgeFindings23 citations
- PARADISE: Exploiting Parallel Data for Multilingual Sequence-to-Sequence PretrainingLong23 citations
- Target-Guided Dialogue Response Generation Using Commonsense and Data AugmentationFindings23 citations
- What company do words keep? Revisiting the distributional semantics of J.R. Firth & Zellig HarrisLong23 citations
- textless-lib: a Library for Textless Spoken Language ProcessingSystem Demonstrations23 citations
- A Dataset for N-ary Relation Extraction of Drug CombinationsLong22 citations
- A Dual-Channel Framework for Sarcasm Recognition by Detecting Sentiment ConflictFindings22 citations
- A Label-Aware Autoregressive Framework for Cross-Domain NERFindings22 citations
- Beyond Emotion: A Multi-Modal Dataset for Human Desire UnderstandingLong22 citations
- Few-shot Subgoal Planning with Language ModelsLong22 citations
- Improving Multi-Document Summarization through Referenced Flexible Extraction with Credit-AwarenessLong22 citations
- LEA: Meta Knowledge-Driven Self-Attentive Document Embedding for Few-Shot Text ClassificationLong22 citations
- Learning Dialogue Representations from Consecutive UtterancesLong22 citations
- Models In a Spelling Bee: Language Models Implicitly Learn the Character Composition of TokensLong22 citations
- On the Use of External Data for Spoken Named Entity RecognitionLong22 citations
- Prompt Augmented Generative Replay via Supervised Contrastive Learning for Lifelong Intent DetectionFindings22 citations
- Prompt Waywardness: The Curious Case of Discretized Interpretation of Continuous PromptsLong22 citations
- User-Centric Gender RewritingLong22 citations
- User-Driven Research of Medical Note Generation SoftwareLong22 citations
- AcTune: Uncertainty-Based Active Self-Training for Active Fine-Tuning of Pretrained Language ModelsLong21 citations
- Analytical Reasoning of TextFindings21 citations
- Aspect Is Not You Need: No-aspect Differential Sentiment Framework for Aspect-based Sentiment AnalysisLong21 citations
- Emp-RFT: Empathetic Response Generation via Recognizing Feature Transitions between UtterancesLong21 citations
- From spoken dialogue to formal summary: An utterance rewriting for dialogue summarizationLong21 citations
- Guiding Visual Question GenerationLong21 citations
- Label Anchored Contrastive Learning for Language UnderstandingLong21 citations
- Nearest Neighbor Knowledge Distillation for Neural Machine TranslationLong21 citations
- Towards Computationally Feasible Deep Active LearningFindings21 citations
- Training Mixed-Domain Translation Models via Federated LearningLong21 citations
- Boosted Dense RetrieverLong20 citations
- CoCoA-MT: A Dataset and Benchmark for Contrastive Controlled MT with Application to FormalityFindings20 citations
- Database Search Results Disambiguation for Task-Oriented Dialog SystemsLong20 citations
- Event Schema Induction with Double Graph AutoencodersLong20 citations
- Exploring the Role of Task Transferability in Large-Scale Multi-Task LearningLong20 citations
- Go Back in Time: Generating Flashbacks in Stories with Event Temporal PromptsLong20 citations
- Investigating Crowdsourcing Protocols for Evaluating the Factual Consistency of SummariesLong20 citations
- LMTurk: Few-Shot Learners as Crowdsourcing Workers in a Language-Model-as-a-Service FrameworkFindings20 citations
- Learn To Remember: Transformer with Recurrent Memory for Document-Level Machine TranslationFindings20 citations
- MOVER: Mask, Over-generate and Rank for Hyperbole GenerationLong20 citations
- Robust Self-Augmentation for Named Entity Recognition with Meta ReweightingLong20 citations
- SUBS: Subtree Substitution for Compositional Semantic ParsingLong20 citations
- Semantically Informed Slang InterpretationLong20 citations
- An End-to-End Dialogue Summarization System for Sales CallsIndustry19 citations
- BLINK with Elasticsearch for Efficient Entity Linking in Business ConversationsIndustry19 citations
- DocTime: A Document-level Temporal Dependency Graph ParserLong19 citations
- Domain Confused Contrastive Learning for Unsupervised Domain AdaptationLong19 citations
- Dual-Channel Evidence Fusion for Fact Verification over Texts and TablesLong19 citations
- Early Rumor Detection Using Neural Hawkes Process with a New Benchmark DatasetLong19 citations
- KroneckerBERT: Significant Compression of Pre-trained Language Models Through Kronecker Decomposition and Knowledge DistillationLong19 citations
- Non-Autoregressive Machine Translation: It’s Not as Fast as it SeemsLong19 citations
- OTExtSum: Extractive Text Summarisation with Optimal TransportFindings19 citations
- Revisit Overconfidence for OOD Detection: Reassigned Contrastive Learning with Adaptive Class-dependent ThresholdLong19 citations
- Sentence-Level Resampling for Named Entity RecognitionLong19 citations
- Weakly Supervised Text Classification using Supervision Signals from a Language ModelFindings19 citations
- Data Augmentation for Low-Resource Dialogue SummarizationFindings18 citations
- Efficient Few-Shot Fine-Tuning for Opinion SummarizationFindings18 citations
- Improving negation detection with negation-focused pre-trainingLong18 citations
- MINION: a Large-Scale and Diverse Dataset for Multilingual Event DetectionLong18 citations
- Retrieval-Augmented Multilingual Keyphrase Generation with Retriever-Generator Iterative TrainingFindings18 citations
- The Why and The How: A Survey on Natural Language Interaction in VisualizationLong18 citations
- Towards Open-Domain Topic ClassificationSystem Demonstrations18 citations
- ATP: AMRize Then Parse! Enhancing AMR Parsing with PseudoAMRsFindings17 citations
- An Exploration of Post-Editing Effectiveness in Text SummarizationLong17 citations
- Bi-SimCut: A Simple Strategy for Boosting Neural Machine TranslationLong17 citations
- Consistency Training with Virtual Adversarial Discrete PerturbationLong17 citations
- Denoising Neural Network for News Recommendation with Positive and Negative Implicit FeedbackFindings17 citations
- Explore More Guidance: A Task-aware Instruction Network for Sign Language Translation Enhanced with Data AugmentationFindings17 citations
- Identifying Implicitly Abusive Remarks about Identity Groups using a Linguistically Informed ApproachLong17 citations
- Improving Few-Shot Relation Classification by Prototypical Representation Learning with Definition TextFindings17 citations
- Mitigating Toxic Degeneration with Empathetic Data: Exploring the Relationship Between Toxicity and EmpathyLong17 citations
- NER-MQMRC: Formulating Named Entity Recognition as Multi Question Machine Reading ComprehensionIndustry17 citations
- On Curriculum Learning for Commonsense ReasoningLong17 citations
- On the Machine Learning of Ethical Judgments from Natural LanguageLong17 citations
- On the Robustness of Reading Comprehension Models to Entity RenamingLong17 citations
- Quantifying Language Variation Acoustically with Few ResourcesLong17 citations
- Shedding New Light on the Language of the Dark WebLong17 citations
- Towards Debiasing Translation ArtifactsLong17 citations
- Towards Understanding Large-Scale Discourse Structures in Pre-Trained and Fine-Tuned Language ModelsLong17 citations
- A Corpus for Understanding and Generating Moral StoriesLong16 citations
- AnswerSumm: A Manually-Curated Dataset and Pipeline for Answer SummarizationLong16 citations
- Ask Me Anything in Your Native LanguageLong16 citations
- CREATER: CTR-driven Advertising Text Generation with Controlled Pre-Training and Contrastive Fine-TuningIndustry16 citations
- Disentangled Learning of Stance and Aspect Topics for Vaccine Attitude Detection in Social MediaLong16 citations
- Incorporating Centering Theory into Neural Coreference ResolutionLong16 citations
- Language Models for Code-switch Detection of te reo Māori and English in a Low-resource SettingFindings16 citations
- Modularized Transfer Learning with Multiple Knowledge Graphs for Zero-shot Commonsense ReasoningLong16 citations
- OPERA: Operation-Pivoted Discrete Reasoning over TextLong16 citations
- A New Concept of Knowledge based Question Answering (KBQA) System for Multi-hop ReasoningLong15 citations
- CLEAR: Improving Vision-Language Navigation with Cross-Lingual, Environment-Agnostic RepresentationsFindings15 citations
- CORWA: A Citation-Oriented Related Work Annotation DatasetLong15 citations
- CS1QA: A Dataset for Assisting Code-based Question Answering in an Introductory Programming CourseLong15 citations
- ChapterBreak: A Challenge Dataset for Long-Range Language ModelsLong15 citations
- Compositional Task-Oriented Parsing as Abstractive Question AnsweringLong15 citations
- DACSA: A large-scale Dataset for Automatic summarization of Catalan and Spanish newspaper ArticlesLong15 citations
- Easy and Efficient Transformer: Scalable Inference Solution For Large NLP ModelIndustry15 citations
- Enhance Incomplete Utterance Restoration by Joint Learning Token Extraction and Text GenerationLong15 citations
- FAMIE: A Fast Active Learning Framework for Multilingual Information ExtractionSystem Demonstrations15 citations
- Few-Shot Document-Level Relation ExtractionLong15 citations
- Great~Truths~are ~Always ~Simple: A Rather Simple Knowledge Encoder for Enhancing the Commonsense Reasoning Capacity of Pre-Trained ModelsFindings15 citations
- Interpretable Proof Generation via Iterative Backward ReasoningLong15 citations
- Joint Learning-based Heterogeneous Graph Attention Network for Timeline SummarizationLong15 citations
- LM-CORE: Language Models with Contextually Relevant External KnowledgeFindings15 citations
- One Size Does Not Fit All: The Case for Personalised Word Complexity ModelsFindings15 citations
- Political Ideology and Polarization: A Multi-dimensional ApproachLong15 citations
- Putting the Con in Context: Identifying Deceptive Actors in the Game of MafiaLong15 citations
- Quantifying Adaptability in Pre-trained Language Models with 500 TasksLong15 citations
- Recognition of They/Them as Singular Personal Pronouns in Coreference ResolutionLong15 citations
- ScAN: Suicide Attempt and Ideation Events DatasetLong15 citations
- Teaching BERT to Wait: Balancing Accuracy and Latency for Streaming Disfluency DetectionLong15 citations
- Unsupervised Slot Schema Induction for Task-oriented DialogLong15 citations
- Weakly Supervised Text-to-SQL Parsing through Question DecompositionFindings15 citations
- A Dog Is Passing Over The Jet? A Text-Generation Dataset for Korean Commonsense Reasoning and EvaluationFindings14 citations
- CompactIE: Compact Facts in Open Information ExtractionLong14 citations
- Federated Learning with Noisy User FeedbackLong14 citations
- Interactive Query-Assisted Summarization via Deep Reinforcement LearningLong14 citations
- Modeling Multi-Granularity Hierarchical Features for Relation ExtractionLong14 citations
- Modeling Task Interactions in Document-Level Joint Entity and Relation ExtractionLong14 citations
- Multimodal Dialogue State TrackingLong14 citations
- Original or Translated? A Causal Analysis of the Impact of Translationese on Machine Translation PerformanceLong14 citations
- PerKGQA: Question Answering over Personalized Knowledge GraphsFindings14 citations
- Progressive Class Semantic Matching for Semi-supervised Text ClassificationLong14 citations
- Reference-free Summarization Evaluation via Semantic Correlation and Compression RatioLong14 citations
- Self-Training with Differentiable TeacherFindings14 citations
- Unbiased Math Word Problems Benchmark for Mitigating Solving BiasFindings14 citations
- XLTime: A Cross-Lingual Knowledge Transfer Framework for Temporal Expression ExtractionFindings14 citations
- CCQA: A New Web-Scale Question Answering Dataset for Model Pre-TrainingFindings13 citations
- Controllable Sentence Simplification via Operation ClassificationFindings13 citations
- Empowering parameter-efficient transfer learning by recognizing the kernel structure in self-attentionFindings13 citations
- Event Detection for Suicide UnderstandingFindings13 citations
- GRAM: Fast Fine-tuning of Pre-trained Language Models for Content-based Collaborative FilteringLong13 citations
- Generalized Quantifiers as a Source of Error in Multilingual NLU BenchmarksLong13 citations
- Learning to Embed Multi-Modal Contexts for Situated Conversational AgentsFindings13 citations
- Modeling Ideological Salience and Framing in Polarized Online Groups with Graph Neural Networks and Structured SparsityFindings13 citations
- Partner Personas Generation for Dialogue Response GenerationLong13 citations
- Practice Makes a Solver Perfect: Data Augmentation for Math Word Problem SolversLong13 citations
- Seed-Guided Topic Discovery with Out-of-Vocabulary SeedsLong13 citations
- Syn2Vec: Synset Colexification Graphs for Lexical Semantic SimilarityLong13 citations
- ZS4IE: A toolkit for Zero-Shot Information Extraction with simple VerbalizationsSystem Demonstrations13 citations
- A Double-Graph Based Framework for Frame Semantic ParsingLong12 citations
- Dynamic Multistep Reasoning based on Video Scene Graph for Video Question AnsweringLong12 citations
- EPiDA: An Easy Plug-in Data Augmentation Framework for High Performance Text ClassificationLong12 citations
- End-to-End Chinese Speaker IdentificationLong12 citations
- GMN: Generative Multi-modal Network for Practical Document Information ExtractionLong12 citations
- Medical Coding with Biomedical Transformer Ensembles and Zero/Few-shot LearningIndustry12 citations
- Multimodal Intent Discovery from Livestream VideosFindings12 citations
- RoViST: Learning Robust Metrics for Visual StorytellingFindings12 citations
- A Study of Syntactic Multi-Modality in Non-Autoregressive Machine TranslationLong11 citations
- Attention Fusion: a light yet efficient late fusion mechanism for task adaptation in NLUFindings11 citations
- Conceptualizing Treatment Leakage in Text-based Causal InferenceLong11 citations
- Cooperative Self-training of Machine Reading ComprehensionLong11 citations
- Document-Level Event Argument Extraction by Leveraging Redundant Information and Closed Boundary LossLong11 citations
- Forecasting COVID-19 Caseloads Using Unsupervised Embedding Clusters of Social Media PostsLong11 citations
- HUE: Pretrained Model and Dataset for Understanding Hanja Documents of Ancient KoreaFindings11 citations
- Jam or Cream First? Modeling Ambiguity in Neural Machine Translation with SCONESLong11 citations
- Learning to Win Lottery Tickets in BERT Transfer via Task-agnostic Mask TrainingLong11 citations
- Linguistic Frameworks Go Toe-to-Toe at Neuro-Symbolic Language ModelingLong11 citations
- Make The Most of Prior Data: A Solution for Interactive Text Summarization with Preference FeedbackFindings11 citations
- Massive-scale Decoding for Text Generation using LatticesLong11 citations
- Mining Clues from Incomplete Utterance: A Query-enhanced Network for Incomplete Utterance RewritingLong11 citations
- Multi-Domain Targeted Sentiment AnalysisLong11 citations
- On Synthetic Data for Back TranslationLong11 citations
- On the Effectiveness of Sentence Encoding for Intent Detection Meta-LearningLong11 citations
- Opportunities for Human-centered Evaluation of Machine Translation SystemsFindings11 citations
- Partial-input baselines show that NLI models can ignore context, but they don’t.Long11 citations
- Post-Training Dialogue Summarization using Pseudo-ParaphrasingFindings11 citations
- Probing the Role of Positional Information in Vision-Language ModelsFindings11 citations
- Residue-Based Natural Language Adversarial Attack DetectionLong11 citations
- Stylized Knowledge-Grounded Dialogue Generation via Disentangled Template RewritingLong11 citations
- A Computational Acquisition Model for Multimodal Word CategorizationLong10 citations
- A Data Cartography based MixUp for Pre-trained Language ModelsLong10 citations
- An Information-Theoretic Approach and Dataset for Probing Gender Stereotypes in Multilingual Masked Language ModelsFindings10 citations
- Building Multilingual Machine Translation Systems That Serve Arbitrary XY TranslationsLong10 citations
- Constraint-based Multi-hop Question Answering with Knowledge GraphIndustry10 citations
- Contrastive Representation Learning for Cross-Document Coreference Resolution of Events and EntitiesLong10 citations
- DOCmT5: Document-Level Pretraining of Multilingual Language ModelsFindings10 citations
- Dangling-Aware Entity Alignment with Mixed High-Order ProximitiesFindings10 citations
- Diversifying Neural Dialogue Generation via Negative DistillationLong10 citations
- Easy Adaptation to Mitigate Gender Bias in Multilingual Text ClassificationLong10 citations
- Explaining Dialogue Evaluation Metrics using Adversarial Behavioral AnalysisLong10 citations
- Extending Multi-Text Sentence Fusion Resources via Pyramid AnnotationsLong10 citations
- FPI: Failure Point Isolation in Large-scale Conversational AssistantsIndustry10 citations
- Instilling Type Knowledge in Language Models via Multi-Task QAFindings10 citations
- Learning Natural Language Generation with Truncated Reinforcement LearningLong10 citations
- Modeling Exemplification in Long-form Question Answering via RetrievalLong10 citations
- Non-Autoregressive Neural Machine Translation with Consistency Regularization Optimized Variational FrameworkLong10 citations
- Opponent Modeling in Negotiation Dialogues by Related Data AdaptationFindings10 citations
- Paragraph-based Transformer Pre-training for Multi-Sentence InferenceLong10 citations
- Representation Learning for Conversational Data using Discourse Mutual Information MaximizationLong10 citations
- Towards a Progression-Aware Autonomous Dialogue AgentLong10 citations
- Uncertainty-Aware Cross-Lingual Transfer with Pseudo Partial LabelsFindings10 citations
- Unsupervised Domain Adaptation for Question Generation with DomainData Selection and Self-trainingFindings10 citations
- What Makes a Good and Useful Summary? Incorporating Users in Automatic Summarization ResearchLong10 citations
- When Does Syntax Mediate Neural Language Model Performance? Evidence from Dropout ProbesLong10 citations
- A Framework to Generate High-Quality Datapoints for Multiple Novel Intent DetectionFindings9 citations
- Batch-Softmax Contrastive Loss for Pairwise Sentence Scoring TasksLong9 citations
- Beyond Distributional Hypothesis: Let Language Models Learn Meaning-Text CorrespondenceFindings9 citations
- Bridging the Gap between Training and Inference: Multi-Candidate Optimization for Diverse Neural Machine TranslationFindings9 citations
- CL-ReLKT: Cross-lingual Language Knowledge Transfer for Multilingual Retrieval Question AnsweringFindings9 citations
- CRUSH: Contextually Regularized and User anchored Self-supervised Hate speech DetectionFindings9 citations
- Data Augmentation with Dual Training for Offensive Span DetectionLong9 citations
- Design Challenges for a Multi-Perspective Search EngineFindings9 citations
- DocAMR: Multi-Sentence AMR Representation and EvaluationLong9 citations
- ErAConD: Error Annotated Conversational Dialog Dataset for Grammatical Error CorrectionLong9 citations
- Explaining Why: How Instructions and User Interfaces Impact Annotator Rationales When Labeling Text DataLong9 citations
- Fast Bilingual Grapheme-To-Phoneme ConversionIndustry9 citations
- Improving Few-Shot Image Classification Using Machine- and User-Generated Natural Language DescriptionsFindings9 citations
- Language Model Augmented Monotonic Attention for Simultaneous TranslationLong9 citations
- Learning Structural Information for Syntax-Controlled Paraphrase GenerationFindings9 citations
- LiST: Lite Prompted Self-training Makes Parameter-efficient Few-shot LearnersFindings9 citations
- Low Resource Style Transfer via Domain Adaptive Meta LearningLong9 citations
- MGIMN: Multi-Grained Interactive Matching Network for Few-shot Text ClassificationLong9 citations
- Masked Measurement Prediction: Learning to Jointly Predict Quantities and Units from Textual ContextFindings9 citations
- Masked Summarization to Generate Factually Inconsistent Summaries for Improved Factual Consistency CheckingFindings9 citations
- Multi-Relational Graph Transformer for Automatic Short Answer GradingLong9 citations
- Natural Language Inference with Self-Attention for Veracity Assessment of Pandemic ClaimsLong9 citations
- Negative Sample is Negative in Its Own Way: Tailoring Negative Sentences for Image-Text RetrievalFindings9 citations
- Non-Autoregressive Chinese ASR Error Correction with Phonological TrainingLong9 citations
- Permutation Invariant Strategy Using Transformer Encoders for Table UnderstandingFindings9 citations
- QLEVR: A Diagnostic Dataset for Quantificational Language and Elementary Visual ReasoningFindings9 citations
- Reducing Disambiguation Biases in NMT by Leveraging Explicit Word Sense InformationLong9 citations
- Self-Supervised Contrastive Learning with Adversarial Perturbations for Defending Word Substitution-based AttacksFindings9 citations
- Social Norms Guide Reference ResolutionLong9 citations
- Text Style Transfer via Optimal TransportLong9 citations
- The Devil is in the Details: On the Pitfalls of Vocabulary Selection in Neural Machine TranslationLong9 citations
- ValCAT: Variable-Length Contextualized Adversarial Transformations Using Encoder-Decoder Language ModelLong9 citations
- Zero-shot Entity Linking with Less DataFindings9 citations
- Augmenting Poetry Composition with Verse by VerseIndustry8 citations
- Bridging the Gap between Language Models and Cross-Lingual Sequence LabelingLong8 citations
- Combining Humor and Sarcasm for Improving Political Parody DetectionLong8 citations
- Crake: Causal-Enhanced Table-Filler for Question Answering over Large Scale Knowledge BaseFindings8 citations
- Curriculum: A Broad-Coverage Benchmark for Linguistic Phenomena in Natural Language UnderstandingLong8 citations
- D2GCLF: Document-to-Graph Classifier for Legal Document ClassificationFindings8 citations
- DadmaTools: Natural Language Processing Toolkit for Persian LanguageSystem Demonstrations8 citations
- Dependency Position Encoding for Relation ExtractionFindings8 citations
- Disentangled Action Recognition with Knowledge BasesLong8 citations
- ElitePLM: An Empirical Study on General Language Ability Evaluation of Pretrained Language ModelsLong8 citations
- Enhancing Self-Attention with Knowledge-Assisted Attention MapsLong8 citations
- Exploiting Numerical-Contextual Knowledge to Improve Numerical Reasoning in Question AnsweringFindings8 citations
- GraphCache: Message Passing as Caching for Sentence-Level Relation ExtractionFindings8 citations
- Identifying Corporate Credit Risk Sentiments from Financial NewsIndustry8 citations
- Label Definitions Improve Semantic Role LabelingLong8 citations
- Label Refinement via Contrastive Learning for Distantly-Supervised Named Entity RecognitionFindings8 citations
- Learning as Conversation: Dialogue Systems Reinforced for Information AcquisitionLong8 citations
- Learning to Express in Knowledge-Grounded ConversationLong8 citations
- NeuS: Neutral Multi-News Summarization for Mitigating Framing BiasLong8 citations
- Por Qué Não Utiliser Alla Språk? Mixed Training with Gradient Optimization in Few-Shot Cross-Lingual TransferFindings8 citations
- SentSpace: Large-Scale Benchmarking and Evaluation of Text using Cognitively Motivated Lexical, Syntactic, and Semantic FeaturesSystem Demonstrations8 citations
- To Answer or Not To Answer? Improving Machine Reading Comprehension Model with Span-based Contrastive LearningFindings8 citations
- Understand before Answer: Improve Temporal Reading Comprehension via Precise Question UnderstandingLong8 citations
- What Factors Should Paper-Reviewer Assignments Rely On? Community Perspectives on Issues and Ideals in Conference Peer-ReviewLong8 citations
- Zero-shot Cross-lingual Conversational Semantic Role LabelingFindings8 citations
- Automatic Correction of Human TranslationsLong7 citations
- BitextEdit: Automatic Bitext Editing for Improved Low-Resource Machine TranslationFindings7 citations
- Collective Relevance Labeling for Passage RetrievalLong7 citations
- Combating the Curse of Multilinguality in Cross-Lingual WSD by Aligning Sparse Contextualized Word RepresentationsLong7 citations
- D2U: Distance-to-Uniform Learning for Out-of-Scope DetectionLong7 citations
- DecBERT: Enhancing the Language Understanding of BERT with Causal Attention MasksFindings7 citations
- Detecting Narrative Elements in Informational TextFindings7 citations
- Distantly Supervised Aspect Clustering And Naming For E-Commerce ReviewsIndustry7 citations
- Do Deep Neural Nets Display Human-like Attention in Short Answer Scoring?Long7 citations
- Does Pre-training Induce Systematic Inference? How Masked Language Models Acquire Commonsense KnowledgeLong7 citations
- Generating Authentic Adversarial Examples beyond Meaning-preserving with Doubly Round-trip TranslationLong7 citations
- Improve Discourse Dependency Parsing with Contextualized RepresentationsFindings7 citations
- Lacuna Reconstruction: Self-Supervised Pre-Training for Low-Resource Historical Document TranscriptionFindings7 citations
- Neighbors Are Not Strangers: Improving Non-Autoregressive Translation under Low-Frequency Lexical ConstraintsLong7 citations
- RSTGen: Imbuing Fine-Grained Interpretable Control into Long-FormText GeneratorsLong7 citations
- Sketching as a Tool for Understanding and Accelerating Self-attention for Long SequencesLong7 citations
- Syntax Controlled Knowledge Graph-to-Text Generation with Order and Semantic ConsistencyFindings7 citations
- Towards Robust and Semantically Organised Latent Representations for Unsupervised Text Style TransferLong7 citations
- TurkishDelightNLP: A Neural Turkish NLP ToolkitSystem Demonstrations7 citations
- A Structured Span SelectorLong6 citations
- AISFG: Abundant Information Slot Filling GeneratorLong6 citations
- Abstraction not Memory: BERT and the English Article SystemLong6 citations
- Capturing Conversational Interaction for Question Answering via Global History ReasoningFindings6 citations
- Controlled Data Generation via Insertion Operations for NLUIndustry6 citations
- Developing a Production System for Purpose of Call Detection in Business Phone ConversationsIndustry6 citations
- Does it Really Generalize Well on Unseen Data? Systematic Evaluation of Relational Triple Extraction MethodsLong6 citations
- Dynamic Programming in Rank Space: Scaling Structured Inference with Low-Rank HMMs and PCFGsLong6 citations
- How to Translate Your Samples and Choose Your Shots? Analyzing Translate-train & Few-shot Cross-lingual TransferFindings6 citations
- Improving Neural Models for Radiology Report Retrieval with Lexicon-based Automated AnnotationLong6 citations
- Is “My Favorite New Movie” My Favorite Movie? Probing the Understanding of Recursive Noun PhrasesLong6 citations
- Knowledge Extraction From Texts Based on WikidataIndustry6 citations
- Leaner and Faster: Two-Stage Model Compression for Lightweight Text-Image RetrievalLong6 citations
- Learning to Selectively Learn for Weakly Supervised Paraphrase Generation with Model-based Reinforcement LearningLong6 citations
- On Systematic Style Differences between Unsupervised and Supervised MT and an Application for High-Resource Machine TranslationLong6 citations
- Quantifying Synthesis and Fusion and their Impact on Machine TranslationLong6 citations
- Semantic-Preserving Abstractive Text Summarization with Siamese Generative Adversarial NetFindings6 citations
- TSTR: Too Short to Represent, Summarize with Details! Intro-Guided Extended Summary GenerationLong6 citations
- Using Paraphrases to Study Properties of Contextual EmbeddingsLong6 citations
- What do Toothbrushes do in the Kitchen? How Transformers Think our World is StructuredLong6 citations
- When do Contrastive Word Alignments Improve Many-to-many Neural Machine Translation?Findings6 citations
- ”Diversity and Uncertainty in Moderation” are the Key to Data Selection for Multilingual Few-shot TransferFindings6 citations
- Anti-Overestimation Dialogue Policy Learning for Task-Completion Dialogue SystemFindings5 citations
- CTM - A Model for Large-Scale Multi-View Tweet Topic ClassificationIndustry5 citations
- CoSIm: Commonsense Reasoning for Counterfactual Scene ImaginationLong5 citations
- CoSe-Co: Text Conditioned Generative CommonSense ContextualizerLong5 citations
- Disentangling Indirect Answers to Yes-No Questions in Real ConversationsLong5 citations
- Does Summary Evaluation Survive Translation to Other Languages?Long5 citations
- Embedding Hallucination for Few-shot Language Fine-tuningLong5 citations
- Empathic Machines: Using Intermediate Features as Levers to Emulate Emotions in Text-To-Speech SystemsLong5 citations
- Exact Paired-Permutation Testing for Structured Test StatisticsLong5 citations
- Exploiting Inductive Bias in Transformers for Unsupervised Disentanglement of Syntax and Semantics with VAEsLong5 citations
- Flowstorm: Open-Source Platform with Hybrid Dialogue ArchitectureSystem Demonstrations5 citations
- Improving Contextual Representation with Gloss Regularized Pre-trainingFindings5 citations
- Interactive Symbol Grounding with Complex Referential ExpressionsLong5 citations
- Knowledge extraction from aeronautical messages (NOTAMs) with self-supervised language models for aircraft pilotsIndustry5 citations
- LaMemo: Language Modeling with Look-Ahead MemoryLong5 citations
- Lightweight Transformers for Conversational AIIndustry5 citations
- Long-term Control for Dialogue Generation: Methods and EvaluationLong5 citations
- Restoring Hebrew Diacritics Without a DictionaryFindings5 citations
- SETSum: Summarization and Visualization of Student Evaluations of TeachingSystem Demonstrations5 citations
- Seeing the wood for the trees: a contrastive regularization method for the low-resource Knowledge Base Question AnsweringFindings5 citations
- TANet: Thread-Aware Pretraining for Abstractive Conversational SummarizationFindings5 citations
- TEAM: A multitask learning based Taxonomy Expansion approach for Attach and MergeFindings5 citations
- Temporal Generalization for Spoken Language UnderstandingIndustry5 citations
- The USMLE® Step 2 Clinical Skills Patient Note CorpusLong5 citations
- A Question-Answer Driven Approach to Reveal Affirmative Interpretations from Verbal NegationsFindings4 citations
- A Versatile Adaptive Curriculum Learning Framework for Task-oriented Dialogue Policy LearningFindings4 citations
- Answer Consolidation: Formulation and BenchmarkingLong4 citations
- Asynchronous Convergence in Multi-Task Learning via Knowledge Distillation from Converged TasksIndustry4 citations
- Balancing Multi-Domain Corpora Learning for Open-Domain Response GenerationFindings4 citations
- BehancePR: A Punctuation Restoration Dataset for Livestreaming Video TranscriptFindings4 citations
- Disentangling Categorization in Multi-agent Emergent CommunicationLong4 citations
- Don’t sweat the small stuff, classify the rest: Sample Shielding to protect text classifiers against adversarial attacksLong4 citations
- EVI: Multilingual Spoken Dialogue Tasks and Dataset for Knowledge-Based Enrolment, Verification, and IdentificationFindings4 citations
- Generating Repetitions with Appropriate Repeated WordsLong4 citations
- Improving Constituent Representation with Hypertree Neural NetworksLong4 citations
- Intent Discovery for Enterprise Virtual Assistants: Applications of Utterance Embedding and Clustering to Intent MiningIndustry4 citations
- Jointly Learning Guidance Induction and Faithful Summary Generation via Conditional Variational AutoencodersFindings4 citations
- Latent Group Dropout for Multilingual and Multidomain Machine TranslationFindings4 citations
- Locally Aggregated Feature Attribution on Natural Language Model UnderstandingLong4 citations
- Modal Dependency Parsing via Language Model PrimingLong4 citations
- Pruning Adatperfusion with Lottery Ticket HypothesisFindings4 citations
- Self-supervised Product Title Rewrite for Product Listing AdsIndustry4 citations
- Speeding Up EntmaxFindings4 citations
- Towards Job-Transition-Tag Graph for a Better Job Title Representation LearningFindings4 citations
- WiC = TSV = WSD: On the Equivalence of Three Semantic TasksLong4 citations
- Adversarial Text NormalizationIndustry3 citations
- Aspect-based Analysis of Advertising Appeals for Search Engine AdvertisingIndustry3 citations
- CERES: Pretraining of Graph-Conditioned Transformer for Semi-Structured Session DataLong3 citations
- CIAug: Equipping Interpolative Augmentation with Curriculum LearningLong3 citations
- Challenging America: Modeling language in longer time scalesFindings3 citations
- Do Trajectories Encode Verb Meaning?Long3 citations
- Efficient Constituency Tree based Encoding for Natural Language to Bash TranslationLong3 citations
- Efficient Learning of Multiple NLP Tasks via Collective Weight Factorization on BERTFindings3 citations
- Grapheme-to-Phoneme Conversion for Thai using Neural Regression ModelsLong3 citations
- Hierarchical Relation-Guided Type-Sentence Alignment for Long-Tail Relation Extraction with Distant SupervisionFindings3 citations
- Learning from Bootstrapping and Stepwise Reinforcement Reward: A Semi-Supervised Framework for Text Style TransferFindings3 citations
- Low-resource Entity Set Expansion: A Comprehensive Study on User-generated TextFindings3 citations
- Pathway2Text: Dataset and Method for Biomedical Pathway Description GenerationFindings3 citations
- Penn-Helsinki Parsed Corpus of Early Modern English: First Parsing Results and AnalysisFindings3 citations
- RGL: A Simple yet Effective Relation Graph Augmented Prompt-based Tuning Approach for Few-Shot LearningFindings3 citations
- Scalable and Robust Self-Learning for Skill Routing in Large-Scale Conversational AI SystemsIndustry3 citations
- Self-Aware Feedback-Based Self-Learning in Large-Scale Conversational AIIndustry3 citations
- Sort by Structure: Language Model Ranking as Dependency ProbingLong3 citations
- Specializing Pre-trained Language Models for Better Relational Reasoning via Network PruningFindings3 citations
- TIE: Topological Information Enhanced Structural Reading Comprehension on Web PagesLong3 citations
- The Case for a Single Model that can Both Generate Continuations and Fill-in-the-BlankFindings3 citations
- What Do Users Care About? Detecting Actionable Insights from User FeedbackIndustry3 citations
- Word Tour: One-dimensional Word Embeddings via the Traveling Salesman ProblemLong3 citations
- A Self-supervised Joint Training Framework for Document RerankingFindings2 citations
- All Information is Valuable: Question Matching over Full Information Transmission NetworkFindings2 citations
- An Item Response Theory Framework for PersuasionFindings2 citations
- Analyzing the Intensity of Complaints on Social MediaFindings2 citations
- Are All the Datasets in Benchmark Necessary? A Pilot Study of Dataset Evaluation for Text ClassificationLong2 citations
- Augmenting Training Data for Massive Semantic Matching Models in Low-Traffic E-commerce StoresIndustry2 citations
- Cheat Codes to Quantify Missing Source Information in Neural Machine TranslationLong2 citations
- Continual Machine Reading Comprehension via Uncertainty-aware Fixed Memory and Adversarial Domain AdaptationFindings2 citations
- DynamicTOC: Persona-based Table of Contents for Consumption of Long DocumentsLong2 citations
- Embarrassingly Simple Performance Prediction for Abductive Natural Language InferenceLong2 citations
- Even the Simplest Baseline Needs Careful Re-investigation: A Case Study on XML-CNNLong2 citations
- FAtNet: Cost-Effective Approach Towards Mitigating the Linguistic Bias in Speaker Verification SystemsFindings2 citations
- FreeTransfer-X: Safe and Label-Free Cross-Lingual Transfer from Off-the-Shelf ModelsFindings2 citations
- From Cognitive to Computational Modeling: Text-based Risky Decision-Making Guided by Fuzzy Trace TheoryFindings2 citations
- Harmless Transfer Learning for Item EmbeddingsFindings2 citations
- Implicit n-grams Induced by RecurrenceLong2 citations
- Improving Code-Switching Dependency Parsing with Semi-Supervised Auxiliary TasksFindings2 citations
- Learning Discriminative Representations for Open Relation Extraction with Instance Ranking and Label CalibrationFindings2 citations
- Learning to Generate Examples for Semantic Processing TasksLong2 citations
- Masked Part-Of-Speech Model: Does Modeling Long Context Help Unsupervised POS-tagging?Long2 citations
- Minimally-Supervised Relation Induction from Pre-trained Language ModelFindings2 citations
- Parameter-efficient Continual Learning Framework in Industrial Real-time Text Classification SystemIndustry2 citations
- Retrieval Based Response Letter Generation For a Customer Care SettingIndustry2 citations
- SHARP: Search-Based Adversarial Attack for Structured PredictionFindings2 citations
- SURF: Semantic-level Unsupervised Reward Function for Machine TranslationLong2 citations
- Sparse Distillation: Speeding Up Text Classification by Using Bigger Student ModelsLong2 citations
- SueNes: A Weakly Supervised Approach to Evaluating Single-Document Summarization via Negative SamplingLong2 citations
- Unsupervised Paraphrasability Prediction for Compound NominalizationsLong2 citations
- Unsupervised Stem-based Cross-lingual Part-of-Speech Tagging for Morphologically Rich Low-Resource LanguagesLong2 citations
- WALNUT: A Benchmark on Semi-weakly Supervised Learning for Natural Language UnderstandingLong2 citations
- What kinds of errors do reference resolution models make and what can we learn from them?Findings2 citations
- White-box Testing of NLP models with Mask Neuron CoverageFindings2 citations
- A Human-machine Interface for Few-shot Rule Synthesis for Information ExtractionSystem Demonstrations1 citations
- Bilingual Tabular Inference: A Case Study on Indic LanguagesLong1 citations
- CULG: Commercial Universal Language GenerationIndustry1 citations
- Contrastive Explanations of Text Classifiers as a ServiceSystem Demonstrations1 citations
- Efficient Semi-supervised Consistency Training for Natural Language UnderstandingIndustry1 citations
- Explaining the Effectiveness of Multi-Task Learning for Efficient Knowledge Extraction from Spine MRI ReportsIndustry1 citations
- Exploring the Value of Multi-View Learning for Session-Aware Query RepresentationFindings1 citations
- LITE: Intent-based Task Representation Learning Using Weak SupervisionLong1 citations
- Learning the Ordering of Coordinate Compounds and Elaborate Expressions in Hmong, Lahu, and ChineseLong1 citations
- MuCPAD: A Multi-Domain Chinese Predicate-Argument DatasetLong1 citations
- Multi-stage Distillation Framework for Cross-Lingual Semantic Similarity MatchingFindings1 citations
- On the Economics of Multilingual Few-shot Learning: Modeling the Cost-Performance Trade-offs of Machine Translated and Manual DataLong1 citations
- Q2R: A Query-to-Resolution System for Natural-Language QueriesIndustry1 citations
- Revisiting Generative Commonsense Reasoning: A Pre-Ordering ApproachFindings1 citations
- A Timestep aware Sentence Embedding and Acme Coverage for Brief but Informative Title GenerationFindings
- AB/BA analysis: A framework for estimating keyword spotting recall improvement while maintaining audio privacyIndustry
- Constraining word alignments with posterior regularization for label transferIndustry
- Don’t Take It Literally: An Edit-Invariant Sequence Loss for Text GenerationLong
- Fast and Light-Weight Answer Text Retrieval in Dialogue SystemsIndustry
- Generic and Trend-aware Curriculum Learning for Relation ExtractionLong
- Learning to Borrow– Relation Representation for Without-Mention Entity-Pairs for Knowledge Graph CompletionLong
- Lifting the Curse of Multilinguality by Pre-training Modular TransformersLong
- Local-to-global learning for iterative training of production SLU models on new featuresIndustry
- Unsupervised Cross-Lingual Transfer of Structured Predictors without Source DataLong
- Web-based Annotation Interface for Derivational MorphologySystem Demonstrations
NAACL accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.