EMNLP 2021 Accepted Papers
The full list of 1,311 papers accepted at EMNLP 2021 (Conference on Empirical Methods in Natural Language Processing). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Main: 847finding: 422System Demonstrations: 42
- The Power of Scale for Parameter-Efficient Prompt TuningMain4,341 citations
- SimCSE: Simple Contrastive Learning of Sentence EmbeddingsMain3,717 citations
- CodeT5: Identifier-aware Unified Pre-trained Encoder-Decoder Models for Code Understanding and GenerationMain1,707 citations
- CLIPScore: A Reference-free Evaluation Metric for Image CaptioningMain1,494 citations
- Retrieval Augmentation Reduces Hallucination in Conversationfinding762 citations
- Transformer Feed-Forward Layers Are Key-Value MemoriesMain734 citations
- VideoCLIP: Contrastive Pre-training for Zero-shot Video-Text UnderstandingMain632 citations
- Documenting Large Webtext Corpora: A Case Study on the Colossal Clean Crawled CorpusMain523 citations
- Editing Factual Knowledge in Language ModelsMain486 citations
- PICARD: Parsing Incrementally for Constrained Auto-Regressive Decoding from Language ModelsMain397 citations
- Improving Multimodal Fusion with Hierarchical Mutual Information Maximization for Multimodal Sentiment AnalysisMain394 citations
- REBEL: Relation Extraction By End-to-end Language generationfinding362 citations
- Datasets: A Community Library for Natural Language ProcessingSystem Demonstrations325 citations
- FinQA: A Dataset of Numerical Reasoning over Financial DataMain316 citations
- Muppet: Massive Multi-task Representations with Pre-FinetuningMain305 citations
- ONION: A Simple and Effective Defense Against Textual Backdoor AttacksMain293 citations
- Want To Reduce Labeling Cost? GPT-3 Can Helpfinding291 citations
- QuestEval: Summarization Asks for Fact-based EvaluationMain281 citations
- RocketQAv2: A Joint Training Method for Dense Passage Retrieval and Passage Re-rankingMain276 citations
- Masked Language Modeling and the Distributional Hypothesis: Order Word Matters Pre-training for LittleMain275 citations
- AdapterDrop: On the Efficiency of Adapters in TransformersMain268 citations
- Condenser: a Pre-training Architecture for Dense RetrievalMain265 citations
- GPT3Mix: Leveraging Large-scale Language Models for Text Augmentationfinding264 citations
- Challenges in Detoxifying Language Modelsfinding256 citations
- TSDAE: Using Transformer-based Sequential Denoising Auto-Encoderfor Unsupervised Sentence Embedding Learningfinding254 citations
- Latent Hatred: A Benchmark for Understanding Implicit Hate SpeechMain249 citations
- Fast WordPiece TokenizationMain247 citations
- Aspect Sentiment Quad Prediction as Paraphrase GenerationMain243 citations
- Gradient-based Adversarial Attacks against Text TransformersMain240 citations
- Block Pruning For Faster TransformersMain238 citations
- Generating Datasets with Pretrained Language ModelsMain237 citations
- Entity-Based Knowledge Conflicts in Question AnsweringMain227 citations
- Surface Form Competition: Why the Highest Probability Answer Isn’t Always RightMain227 citations
- Active Learning by Acquiring Contrastive ExamplesMain217 citations
- AEDA: An Easier Data Augmentation Technique for Text Classificationfinding210 citations
- Raise a Child in Large Language Model: Towards Effective and Generalizable Fine-tuningMain202 citations
- Fighting the COVID-19 Infodemic: Modeling the Perspective of Journalists, Fact-Checkers, Social Media Platforms, Policy Makers, and the Societyfinding194 citations
- CLIFF: Contrastive Learning for Improving Faithfulness and Factuality in Abstractive SummarizationMain191 citations
- Explaining Answers with Entailment TreesMain191 citations
- Mind the Style of Text! Adversarial and Backdoor Attacks Based on Text Style TransferMain191 citations
- Q2: Evaluating Factual Consistency in Knowledge-Grounded Dialogues via Question Generation and Question AnsweringMain191 citations
- Retrieval Augmented Code Generation and Summarizationfinding190 citations
- TimeTraveler: Reinforcement Learning for Temporal Knowledge Graph ForecastingMain190 citations
- Measuring Association Between Labels and Free-Text RationalesMain188 citations
- Harms of Gender Exclusivity and Challenges in Non-Binary Representation in Language TechnologiesMain185 citations
- A Partition Filter Network for Joint Entity and Relation ExtractionMain176 citations
- Visually Grounded Reasoning across Languages and CulturesMain175 citations
- Adapting Language Models for Zero-shot Learning by Meta-tuning on Dataset and Prompt Collectionsfinding173 citations
- Contrastive Code Representation LearningMain167 citations
- CrossFit: A Few-shot Learning Challenge for Cross-task Generalization in NLPMain167 citations
- Simple Entity-Centric Questions Challenge Dense RetrieversMain167 citations
- XTREME-R: Towards More Challenging and Nuanced Multilingual EvaluationMain163 citations
- Moral Stories: Situated Reasoning about Norms, Intents, Actions, and their ConsequencesMain159 citations
- Neural Path Hunter: Reducing Hallucination in Dialogue Systems via Path GroundingMain158 citations
- Towards Improving Adversarial Training of NLP Modelsfinding158 citations
- Improving and Simplifying Pattern Exploiting TrainingMain156 citations
- Text2Mol: Cross-Modal Molecule Retrieval with Natural Language QueriesMain155 citations
- Understanding and Overcoming the Challenges of Efficient Transformer QuantizationMain153 citations
- Sustainable Modular Debiasing of Language Modelsfinding148 citations
- Backdoor Attacks on Pre-trained Models by Layerwise Weight PoisoningMain143 citations
- The Devil is in the Detail: Simple Tricks Improve Systematic Generalization of TransformersMain142 citations
- Few-Shot Text Generation with Natural Language InstructionsMain140 citations
- Generate & Rank: A Multi-task Framework for Math Word Problemsfinding138 citations
- Learning Neural Ordinary Equations for Forecasting Future Links on Temporal Knowledge GraphsMain138 citations
- Label Verbalization and Entailment for Effective Zero and Few-Shot Relation ExtractionMain137 citations
- Dialogue State Tracking with a Language Model using Schema-Driven PromptingMain136 citations
- MOMENTA: A Multimodal Framework for Detecting Harmful Memes and Their Targetsfinding136 citations
- The Perils of Using Mechanical Turk to Evaluate Open-Ended Text GenerationMain136 citations
- Learning Implicit Sentiment in Aspect-based Sentiment Analysis with Supervised Contrastive Pre-TrainingMain135 citations
- Visual News: Benchmark and Challenges in News Image CaptioningMain134 citations
- Continual Learning in Task-Oriented Dialogue SystemsMain133 citations
- FastIF: Scalable Influence Functions for Efficient Model Interpretation and DebuggingMain133 citations
- TransferNet: An Effective and Transparent Framework for Multi-hop Question Answering over Relation GraphMain133 citations
- MSˆ2: Multi-Document Summarization of Medical StudiesMain132 citations
- N-LTP: An Open-source Neural Language Technology Platform for ChineseSystem Demonstrations131 citations
- What Changes Can Large-scale Language Models Bring? Intensive Study on HyperCLOVA: Billions-scale Korean Generative Pretrained TransformersMain130 citations
- HittER: Hierarchical Transformers for Knowledge Graph EmbeddingsMain126 citations
- Fast, Effective, and Self-Supervised: Transforming Masked Language Models into Universal Lexical and Sentence EncodersMain125 citations
- Mitigating Language-Dependent Ethnic Bias in BERTMain125 citations
- TURINGBENCH: A Benchmark Environment for Turing Test in the Age of Neural Text Generationfinding125 citations
- Joint Multi-modal Aspect-Sentiment Analysis with Auxiliary Cross-modal Relation DetectionMain124 citations
- SituatedQA: Incorporating Extra-Linguistic Contexts into QAMain124 citations
- Cross-Attention is All You Need: Adapting Pretrained Transformers for Machine TranslationMain123 citations
- Beyond Distillation: Task-level Mixture-of-Experts for Efficient Inferencefinding122 citations
- WhiteningBERT: An Easy Unsupervised Sentence Embedding Approachfinding122 citations
- Evaluating the Robustness of Neural Language Models to Input PerturbationsMain119 citations
- Narrative Theory for Computational Narrative UnderstandingMain119 citations
- All Bark and No Bite: Rogue Dimensions in Transformer Language Models Obscure Representational QualityMain118 citations
- Progressive Transformer-Based Generation of Radiology Reportsfinding118 citations
- RAP: Robustness-Aware Perturbations for Defending against Backdoor Attacks on NLP ModelsMain118 citations
- The Stem Cell Hypothesis: Dilemma behind Multi-Task Learning with Transformer EncodersMain118 citations
- Contrastive Explanations for Model InterpretabilityMain117 citations
- Do Transformer Modifications Transfer Across Implementations and Applications?Main117 citations
- How to Train BERT with an Academic BudgetMain117 citations
- A Plug-and-Play Method for Controlled Text Generationfinding116 citations
- Improving Empathetic Response Generation by Recognizing Emotion Cause in Conversationsfinding116 citations
- MultiEURLEX - A multi-lingual and multi-label legal document classification dataset for zero-shot cross-lingual transferMain116 citations
- Few-Shot Named Entity Recognition: An Empirical Baseline StudyMain114 citations
- ERNIE-M: Enhanced Multilingual Representation by Aligning Cross-lingual Semantics with Monolingual CorporaMain112 citations
- What to Pre-Train on? Efficient Intermediate Task SelectionMain112 citations
- Efficient Nearest Neighbor Language ModelsMain111 citations
- ContractNLI: A Dataset for Document-level Natural Language Inference for Contractsfinding110 citations
- Agreeing to Disagree: Annotating Offensive Language Datasets with Annotators’ DisagreementMain108 citations
- Competency Problems: On Finding and Removing Artifacts in Language DataMain108 citations
- UNKs Everywhere: Adapting Multilingual Language Models to New ScriptsMain108 citations
- Past, Present, and Future: Conversational Emotion Recognition through Structural Modeling of Psychological Knowledgefinding107 citations
- Word-Level Coreference ResolutionMain107 citations
- SIMMC 2.0: A Task-oriented Dialog Dataset for Immersive Multimodal ConversationsMain106 citations
- WikiNEuRal: Combined Neural and Knowledge-based Silver Data Creation for Multilingual NERfinding106 citations
- Building and Evaluating Open-Domain Dialogue Corpora with Clarifying QuestionsMain105 citations
- Can Language Models be Biomedical Knowledge Bases?Main105 citations
- Contrastive Out-of-Distribution Detection for Pretrained TransformersMain105 citations
- Natural SQL: Making SQL Easier to Infer from Natural Language Specificationsfinding104 citations
- Improving Question Answering Model Robustness with Synthetic Adversarial Data GenerationMain103 citations
- Are Gender-Neutral Queries Really Gender-Neutral? Mitigating Gender Bias in Image SearchMain102 citations
- NewsCLIPpings: Automatic Generation of Out-of-Context Multimodal MediaMain100 citations
- Not All Negatives are Equal: Label-Aware Contrastive Loss for Fine-grained Text ClassificationMain100 citations
- Types of Out-of-Distribution Texts and How to Detect ThemMain100 citations
- Aspect-Controllable Opinion SummarizationMain99 citations
- IndoNLG: Benchmark and Resources for Evaluating Indonesian Natural Language GenerationMain98 citations
- Paraphrase Generation: A Survey of the State of the ArtMain98 citations
- A Novel Global Feature-Oriented Relational Triple Extraction Model based on Table FillingMain97 citations
- Evidence-based Fact-Checking of Health-related Claimsfinding96 citations
- SciCap: Generating Captions for Scientific Figuresfinding96 citations
- Balancing Methods for Multi-label Text Classification with Long-Tailed Class DistributionMain95 citations
- Data and Parameter Scaling Laws for Neural Machine TranslationMain95 citations
- Just Say No: Analyzing the Stance of Neural Dialogue Generation in Offensive ContextsMain95 citations
- Vision-and-Language or Vision-for-Language? On Cross-Modal Influence in Multimodal TransformersMain94 citations
- BERT, mBERT, or BiBERT? A Study on Contextualized Embeddings for Neural Machine TranslationMain93 citations
- BERT4GCN: Using BERT Intermediate Layers to Augment GCN for Aspect-based Sentiment ClassificationMain93 citations
- Less is More: Pretrain a Strong Siamese Encoder for Dense Text Retrieval Using a Weak DecoderMain93 citations
- MATE: Multi-view Attention for Table Transformer EfficiencyMain93 citations
- MultiDoc2Dial: Modeling Dialogues Grounded in Multiple DocumentsMain93 citations
- Learning Compact Metrics for MTMain92 citations
- Exploring Task Difficulty for Few-Shot Relation ExtractionMain91 citations
- Few-Shot Intent Detection via Contrastive Pre-Training and Fine-TuningMain91 citations
- On Pursuit of Designing Multi-modal Transformer for Video GroundingMain91 citations
- Phrase-BERT: Improved Phrase Embeddings from BERT with an Application to Corpus ExplorationMain91 citations
- Revisiting the Uniform Information Density HypothesisMain90 citations
- TAG: Gradient Attack on Transformer-based Language Modelsfinding90 citations
- BARThez: a Skilled Pretrained French Sequence-to-Sequence ModelMain89 citations
- Exploring Underexplored Limitations of Cross-Domain Text-to-SQL GeneralizationMain89 citations
- IndoBERTweet: A Pretrained Language Model for Indonesian Twitter with Effective Domain-Specific Vocabulary InitializationMain88 citations
- Semi-supervised Relation Extraction via Incremental Meta Self-Trainingfinding88 citations
- MAD-G: Multilingual Adapter Generation for Efficient Cross-Lingual Transferfinding87 citations
- Weakly Supervised Contrastive Learning for Chest X-Ray Report Generationfinding87 citations
- mT6: Multilingual Pretrained Text-to-Text Transformer with Translation PairsMain87 citations
- ConSeC: Word Sense Disambiguation as Continuous Sense ComprehensionMain86 citations
- Cross-Domain Label-Adaptive Stance DetectionMain86 citations
- Pushing on Text Readability Assessment: A Transformer Meets Handcrafted Linguistic FeaturesMain86 citations
- Vision Guided Generative Pre-trained Language Models for Multimodal Abstractive SummarizationMain85 citations
- WebSRC: A Dataset for Web-Based Structural Reading ComprehensionMain85 citations
- ConvAbuse: Data, Analysis, and Benchmarks for Nuanced Abuse Detection in Conversational AIMain84 citations
- Neural Media Bias Detection Using Distant Supervision With BABE - Bias Annotations By Expertsfinding84 citations
- Perspective-taking and Pragmatics for Generating Empathetic Responses Focused on Emotion CausesMain84 citations
- Plan-then-Generate: Controlled Data-to-Text Generation via Planningfinding84 citations
- A Simple and Effective Positional Encoding for TransformersMain83 citations
- Rumor Detection on Twitter with Claim-Guided Hierarchical Graph Attention NetworksMain83 citations
- Probing Across Time: What Does RoBERTa Know and When?finding82 citations
- Case-based Reasoning for Natural Language Queries over Knowledge BasesMain81 citations
- Constrained Language Models Yield Few-Shot Semantic ParsersMain80 citations
- Incorporating medical knowledge in BERT for clinical relation extractionMain80 citations
- Solving Aspect Category Sentiment Analysis as a Text Generation TaskMain80 citations
- ECONET: Effective Continual Pretraining of Language Models for Event Temporal ReasoningMain79 citations
- From Alignment to Assignment: Frustratingly Simple Unsupervised Entity AlignmentMain79 citations
- Consistent Accelerated Inference via Confident Adaptive TransformersMain78 citations
- Distantly-Supervised Named Entity Recognition with Noise-Robust Learning and Language Model Augmented Self-TrainingMain78 citations
- Do Long-Range Language Models Actually Use Long-Range Context?Main78 citations
- Efficient-FedRec: Efficient Federated Learning Framework for Privacy-Preserving News RecommendationMain78 citations
- Learning and Evaluating a Differentially Private Pre-trained Language Modelfinding78 citations
- SELFEXPLAIN: A Self-Explaining Architecture for Neural Text ClassifiersMain78 citations
- Compression, Transduction, and Creation: A Unified Framework for Evaluating Natural Language GenerationMain77 citations
- Deep Attention Diffusion Graph Neural Networks for Text ClassificationMain77 citations
- Frequency Effects on Syntactic Rule Learning in TransformersMain77 citations
- Structural Adapters in Pretrained Language Models for AMR-to-Text GenerationMain77 citations
- Diagnosing the First-Order Logical Reasoning Ability Through LogicNLIMain76 citations
- Weakly-Supervised Visual-Retriever-Reader for Knowledge-based Question AnsweringMain76 citations
- CDLM: Cross-Document Language Modelingfinding75 citations
- LayoutReader: Pre-training of Text and Layout for Reading Order DetectionMain75 citations
- Temporal Adaptation of BERT and Performance on Downstream Document Classification: Insights from Social Mediafinding75 citations
- Topic-Aware Contrastive Learning for Abstractive Dialogue Summarizationfinding75 citations
- MindCraft: Theory of Mind Modeling for Situated Dialogue in Collaborative TasksMain74 citations
- Collecting a Large-Scale Gender Bias Dataset for Coreference Resolution and Machine Translationfinding73 citations
- Machine Translation Decoding beyond Beam SearchMain73 citations
- Searching for an Effective Defender: Benchmarking Defense against Adversarial Word SubstitutionMain72 citations
- Unsupervised Keyphrase Extraction by Jointly Modeling Local and Global ContextMain72 citations
- Inconsistency Matters: A Knowledge-guided Dual-inconsistency Network for Multi-modal Rumor Detectionfinding71 citations
- Machine Reading Comprehension as Data Augmentation: A Case Study on Implicit Event Argument ExtractionMain71 citations
- PASTE: A Tagging-Free Decoding Framework Using Pointer Networks for Aspect Sentiment Triplet ExtractionMain71 citations
- Text Detoxification using Large Pre-trained Neural ModelsMain71 citations
- CAST: Enhancing Code Summarization with Hierarchical Splitting and Reconstruction of Abstract Syntax TreesMain70 citations
- Controllable Neural Dialogue Summarization with Personal Named Entity PlanningMain69 citations
- Open Aspect Target Sentiment Classification with Natural Language PromptsMain69 citations
- Residual Adapters for Parameter-Efficient ASR Adaptation to Atypical and Accented SpeechMain69 citations
- TDEER: An Efficient Translating Decoding Schema for Joint Extraction of Entities and RelationsMain69 citations
- A Large-Scale Dataset for Empathetic Response GenerationMain68 citations
- Document-level Entity-based Extraction as Template GenerationMain68 citations
- Graph Based Network with Contextualized Representations of Turns in DialogueMain68 citations
- Relational World Knowledge Representation in Contextual Language Models: A ReviewMain68 citations
- Zero-Shot Dialogue State Tracking via Cross-Task TransferMain68 citations
- CLASSIC: Continual and Contrastive Learning of Aspect Sentiment Classification TasksMain67 citations
- Leveraging Pretrained Models for Automatic Summarization of Doctor-Patient Conversationsfinding67 citations
- The Future is not One-dimensional: Complex Event Schema Induction by Graph Modeling for Event PredictionMain67 citations
- Universal Sentence Representation Learning with Conditional Masked Language ModelMain67 citations
- Weakly-supervised Text Classification Based on Keyword GraphMain67 citations
- ‘Just What do You Think You’re Doing, Dave?’ A Checklist for Responsible Data Use in NLPfinding67 citations
- Conditional probing: measuring usable information beyond a baselineMain66 citations
- When Attention Meets Fast Recurrence: Training Language Models with Reduced ComputeMain66 citations
- Discrete and Soft Prompting for Multilingual ModelsMain65 citations
- DuRecDial 2.0: A Bilingual Parallel Corpus for Conversational RecommendationMain65 citations
- Effective Convolutional Attention Network for Multi-label Clinical Document ClassificationMain65 citations
- Sequence Length is a Domain: Length-based Overfitting in Transformer ModelsMain65 citations
- AttentionRank: Unsupervised Keyphrase Extraction using Self and Cross AttentionsMain64 citations
- Gradient Imitation Reinforcement Learning for Low Resource Relation ExtractionMain64 citations
- Improving End-to-End Task-Oriented Dialog System with A Simple Auxiliary Taskfinding64 citations
- STraTA: Self-Training with Task Augmentation for Better Few-shot LearningMain64 citations
- Learning Universal Authorship RepresentationsMain63 citations
- Learning from Noisy Labels for Entity-Centric Information ExtractionMain63 citations
- NeuTral Rewriter: A Rule-Based and Neural Approach to Automatic Rewriting into Gender Neutral AlternativesMain63 citations
- OSCaR: Orthogonal Subspace Correction and Rectification of Biases in Word EmbeddingsMain63 citations
- Time-aware Graph Neural Network for Entity Alignment between Temporal Knowledge GraphsMain63 citations
- Automated Generation of Accurate & Fluent Medical X-ray ReportsMain62 citations
- Contextualized Query Embeddings for Conversational SearchMain62 citations
- Counter-Interference Adapter for Multilingual Machine Translationfinding62 citations
- fBERT: A Neural Transformer for Identifying Offensive Contentfinding62 citations
- Adaptive Proposal Generation Network for Temporal Sentence Localization in VideosMain61 citations
- CR-Walker: Tree-Structured Graph Reasoning and Dialog Acts for Conversational RecommendationMain61 citations
- Self-supervised Contrastive Cross-Modality Representation Learning for Spoken Question Answeringfinding61 citations
- SentNoB: A Dataset for Analysing Sentiment on Noisy Bangla Textsfinding61 citations
- An Exploratory Study on Long Dialogue Summarization: What Works and What’s Nextfinding60 citations
- Can NLI Models Verify QA Systems’ Predictions?finding60 citations
- Discretized Integrated Gradients for Explaining Language ModelsMain60 citations
- ExplaGraphs: An Explanation Graph Generation Task for Structured Commonsense ReasoningMain60 citations
- Relation-aware Video Reading Comprehension for Temporal Language GroundingMain60 citations
- Low Frequency Names Exhibit Bias and Overfitting in Contextualizing Language ModelsMain59 citations
- Pairwise Supervised Contrastive Learning of Sentence RepresentationsMain59 citations
- TransPrompt: Towards an Automatic Transferable Prompting Framework for Few-shot Text ClassificationMain59 citations
- Automatic Text Evaluation through the Lens of Wasserstein BarycentersMain58 citations
- Cross-lingual Aspect-based Sentiment Analysis with Aspect Term Code-SwitchingMain58 citations
- DWUG: A large Resource of Diachronic Word Usage Graphs in Four LanguagesMain58 citations
- Finetuning Pretrained Transformers into RNNsMain58 citations
- Language-Aligned Waypoint (LAW) Supervision for Vision-and-Language Navigation in Continuous EnvironmentsMain58 citations
- Back to Square One: Artifact Detection, Training and Commonsense Disentanglement in the Winograd SchemaMain57 citations
- Dimensional Emotion Detection from Categorical EmotionMain57 citations
- Document-Level Text Simplification: Dataset, Criteria and BaselineMain57 citations
- MassiveSumm: a very large-scale, very multilingual, news summarisation datasetMain57 citations
- Perturbation CheckLists for Evaluating NLG Evaluation MetricsMain57 citations
- The Low-Resource Double Bind: An Empirical Study of Pruning for Low-Resource Machine Translationfinding57 citations
- Artificial Text Detection via Examining the Topology of Attention MapsMain56 citations
- Dealing with Typos for BERT-based Passage Retrieval and RankingMain56 citations
- Knowledge-Aware Graph-Enhanced GPT-2 for Dialogue State TrackingMain56 citations
- Natural Language Video Localization with Learnable Moment ProposalsMain56 citations
- Synthetic Data Augmentation for Zero-Shot Cross-Lingual Question AnsweringMain56 citations
- A Discourse-Aware Graph Neural Network for Emotion Recognition in Multi-Party Conversationfinding55 citations
- English Machine Reading Comprehension Datasets: A SurveyMain55 citations
- Evaluating Debiasing Techniques for Intersectional BiasesMain55 citations
- Hierarchical Heterogeneous Graph Representation Learning for Short Text ClassificationMain55 citations
- LM-Critic: Language Models for Unsupervised Grammatical Error CorrectionMain55 citations
- AESOP: Paraphrase Generation with Adaptive Syntactic ControlMain54 citations
- Data Augmentation for Cross-Domain Named Entity RecognitionMain54 citations
- Integrating Visuospatial, Linguistic, and Commonsense Structure into Story VisualizationMain54 citations
- Phrase Retrieval Learns Passage Retrieval, TooMain54 citations
- BeliefBank: Adding Memory to a Pre-Trained Language Model for a Systematic Notion of BeliefMain53 citations
- Improving Unsupervised Question Answering via Summarization-Informed Question GenerationMain53 citations
- Models and Datasets for Cross-Lingual SummarisationMain53 citations
- Multimodal Phased Transformer for Sentiment AnalysisMain53 citations
- Broaden the Vision: Geo-Diverse Visual Commonsense ReasoningMain52 citations
- Effectiveness of Pre-training for Few-shot Intent Classificationfinding52 citations
- Factual Consistency Evaluation for Text Summarization via Counterfactual Estimationfinding52 citations
- FewshotQA: A simple framework for few-shot learning of question answering tasks using pre-trained text-to-text modelsMain52 citations
- Math Word Problem Generation with Mathematical Consistency and Problem Context ConstraintsMain52 citations
- Named Entity Recognition for Entity Linking: What Works and What’s Nextfinding52 citations
- Beyond Preserved Accuracy: Evaluating Loyalty and Robustness of BERT CompressionMain51 citations
- GooAQ: Open Question Answering with Diverse Answer Typesfinding51 citations
- Learning Neural Templates for Recommender Dialogue SystemMain51 citations
- Subformer: Exploring Weight Sharing for Parameter Efficiency in Generative Transformersfinding51 citations
- UniKER: A Unified Framework for Combining Embedding and Definite Horn Rule Reasoning for Knowledge Graph InferenceMain51 citations
- Answering Open-Domain Questions of Varying Reasoning Steps from TextMain50 citations
- CRFR: Improving Conversational Recommender Systems via Flexible Fragments Reasoning on Knowledge GraphsMain50 citations
- Parallel Refinements for Lexically Constrained Text Generation with BARTMain50 citations
- SpellBERT: A Lightweight Pretrained Model for Chinese Spelling CheckMain50 citations
- Improving Multimodal fusion via Mutual Dependency MaximisationMain49 citations
- Incorporating Residual and Normalization Layers into Analysis of Masked Language ModelsMain49 citations
- Progressive Self-Training with Discriminator for Aspect Term ExtractionMain49 citations
- Progressively Guide to Attend: An Iterative Alignment Framework for Temporal Sentence GroundingMain49 citations
- Sparse Attention with Linear UnitsMain49 citations
- Uncovering Main Causalities for Long-tailed Information ExtractionMain49 citations
- Zero-Shot Cross-Lingual Transfer of Neural Machine Translation with Multilingual Pretrained EncodersMain49 citations
- CascadeBERT: Accelerating Inference of Pre-trained Language Models via Calibrated Complete Models Cascadefinding48 citations
- Convex Aggregation for Opinion Summarizationfinding48 citations
- Cross Attention Augmented Transducer Networks for Simultaneous TranslationMain48 citations
- Effective Sequence-to-Sequence Dialogue State TrackingMain48 citations
- Neuro-Symbolic Reinforcement Learning with First-Order LogicMain48 citations
- Revisiting Self-training for Few-shot Learning of Language ModelMain48 citations
- AStitchInLanguageModels: Dataset and Methods for the Exploration of Idiomaticity in Pre-Trained Language Modelsfinding47 citations
- Controllable Semantic Parsing via Retrieval AugmentationMain47 citations
- Dynamic Knowledge Distillation for Pre-trained Language ModelsMain47 citations
- Finding a Balanced Degree of Automation for Summary EvaluationMain47 citations
- Multi-Class Grammatical Error Detection for Correction: A Tale of Two SystemsMain47 citations
- Multi-Modal Open-Domain DialogueMain47 citations
- Multilingual Unsupervised Neural Machine Translation with Denoising AdaptersMain47 citations
- NewsBERT: Distilling Pre-trained Language Model for Intelligent News Applicationfinding47 citations
- RockNER: A Simple Method to Create Adversarial Examples for Evaluating the Robustness of Named Entity Recognition ModelsMain47 citations
- Simple Conversational Data Augmentation for Semi-supervised Abstractive Dialogue SummarizationMain47 citations
- Speaker Turn Modeling for Dialogue Act Classificationfinding47 citations
- Transformer over Pre-trained Transformer for Neural Text Segmentation with Enhanced Topic Coherencefinding47 citations
- Unsupervised Paraphrasing with Pretrained Language ModelsMain47 citations
- When differential privacy meets NLP: The devil is in the detailMain47 citations
- “Let Your Characters Tell Their Story”: A Dataset for Character-Centric Narrative Understandingfinding47 citations
- Does Putting a Linguist in the Loop Improve NLU Data Collection?finding46 citations
- Improving Math Word Problems with Pre-trained Knowledge and Hierarchical ReasoningMain46 citations
- Structured Context and High-Coverage Grammar for Conversational Question Answering over Knowledge GraphsMain46 citations
- Utilizing Relative Event Time to Enhance Event-Event Temporal Relation ExtractionMain46 citations
- What Does Your Smile Mean? Jointly Detecting Multi-Modal Sarcasm and Sentiment Using Quantum Probabilityfinding46 citations
- BiQUE: Biquaternionic Embeddings of Knowledge GraphsMain45 citations
- CSDS: A Fine-Grained Chinese Dataset for Customer Service Dialogue SummarizationMain45 citations
- Diverse Distributions of Self-Supervised Tasks for Meta-Learning in NLPMain45 citations
- Does Pretraining for Summarization Require Knowledge Transfer?finding45 citations
- Fight Fire with Fire: Fine-tuning Hate Detectors using Large Samples of Generated Hate Speechfinding45 citations
- Improving Zero-Shot Cross-Lingual Transfer Learning via Robust TrainingMain45 citations
- Mixture-of-Partitions: Infusing Large Biomedical Knowledge Graphs into BERTMain45 citations
- Multiplex Graph Neural Network for Extractive Text SummarizationMain45 citations
- R2-D2: A Modular Baseline for Open-Domain Question Answeringfinding45 citations
- RuleBERT: Teaching Soft Rules to Pre-Trained Language ModelsMain45 citations
- SHAPE: Shifted Absolute Position Embedding for TransformersMain45 citations
- STANKER: Stacking Network based on Level-grained Attention-masked BERT for Rumor Detection on Social MediaMain45 citations
- Shortcutted Commonsense: Data Spuriousness in Deep Learning of Commonsense ReasoningMain45 citations
- Structure-aware Fine-tuning of Sequence-to-sequence Transformers for Transition-based AMR ParsingMain45 citations
- Text AutoAugment: Learning Compositional Augmentation Policy for Text ClassificationMain45 citations
- Zero-Shot Information Extraction as a Unified Text-to-Triple TranslationMain45 citations
- Cartography Active Learningfinding44 citations
- Learn Continually, Generalize Rapidly: Lifelong Knowledge Accumulation for Few-shot Learningfinding44 citations
- MapRE: An Effective Semantic Mapping Approach for Low-resource Relation ExtractionMain44 citations
- TWEETSUMM - A Dialog Summarization Dataset for Customer Servicefinding44 citations
- Visual Goal-Step Inference using wikiHowMain44 citations
- A Relation-Oriented Clustering Method for Open Relation ExtractionMain43 citations
- Adaptive Information Seeking for Open-Domain Question AnsweringMain43 citations
- An Iterative Multi-Knowledge Transfer Network for Aspect-Based Sentiment Analysisfinding43 citations
- Highly Parallel Autoregressive Entity Linking with Discriminative CorrectionMain43 citations
- Improving Multilingual Translation by Representation and Gradient RegularizationMain43 citations
- Lawyers are Dishonest? Quantifying Representational Harms in Commonsense Knowledge ResourcesMain43 citations
- Learning from Language Description: Low-shot Named Entity Recognition via Decomposed Frameworkfinding43 citations
- Robust Open-Vocabulary Translation from Visual Text RepresentationsMain43 citations
- Timeline Summarization based on Event Graph Compression via Time-Aware Optimal TransportMain43 citations
- Uncertainty-Aware Machine Translation Evaluationfinding43 citations
- Unpacking the Interdependent Systems of Discrimination: Ableist Bias in NLP Systems through an Intersectional Lensfinding43 citations
- Definition Modelling for Appropriate SpecificityMain42 citations
- Enriching and Controlling Global Semantics for Text SummarizationMain42 citations
- How much pretraining data do language models need to learn syntax?Main42 citations
- Implicit Sentiment Analysis with Event-centered Text RepresentationMain42 citations
- Jump-Starting Item Parameters for Adaptive Language TestsMain42 citations
- LightTag: Text Annotation PlatformSystem Demonstrations42 citations
- Low-Resource Dialogue Summarization with Domain-Agnostic Multi-Source PretrainingMain42 citations
- To be Closer: Learning to Link up Aspects with OpinionsMain42 citations
- Enhanced Language Representation with Label Knowledge for Span ExtractionMain41 citations
- Identifying Morality Frames in Political Tweets using Relational LearningMain41 citations
- Learning Logic Rules for Document-Level Relation ExtractionMain41 citations
- Model-based analysis of brain activity reveals the hierarchy of language in 305 subjectsfinding41 citations
- A Strong Baseline for Query Efficient Attacks in a Black Box SettingMain40 citations
- Contrastive Domain Adaptation for Question Answering using Limited Text CorporaMain40 citations
- Joint Passage Ranking for Diverse Multi-Answer RetrievalMain40 citations
- Knowledge-Interactive Network with Sentiment Polarity Intensity-Aware Multi-Task Learning for Emotion Recognition in Conversationsfinding40 citations
- Large-Scale Relation Learning for Question Answering over Knowledge Bases with Pre-trained Language ModelsMain40 citations
- Monolingual and Cross-Lingual Acceptability Judgments with the Italian CoLA corpusfinding40 citations
- Rationales for Sequential PredictionsMain40 citations
- AligNART: Non-autoregressive Neural Machine Translation by Jointly Learning to Estimate Alignment and TranslateMain39 citations
- An Edge-Enhanced Hierarchical Graph-to-Tree Network for Math Word Problem Solvingfinding39 citations
- Asking It All: Generating Contextualized Questions for any Semantic RoleMain39 citations
- Attribute Alignment: Controlling Text Generation from Pre-trained Language Modelsfinding39 citations
- ChemNER: Fine-Grained Chemistry Named Entity Recognition with Ontology-Guided Distant SupervisionMain39 citations
- Distilling Linguistic Context for Language Model CompressionMain39 citations
- Exploring Sentence Community for Document-Level Event Extractionfinding39 citations
- Hyperbolic Hierarchy-Aware Knowledge Graph Embedding for Link Predictionfinding39 citations
- Mathematical Word Problem Generation from Commonsense Knowledge Graph and EquationsMain39 citations
- Robust Retrieval Augmented Generation for Zero-shot Slot FillingMain39 citations
- Semantics-Preserved Data Augmentation for Aspect-Based Sentiment AnalysisMain39 citations
- StreamHover: Livestream Transcript Summarization and AnnotationMain39 citations
- A surprisal–duration trade-off across and within the world’s languagesMain38 citations
- Causal Direction of Data Collection Matters: Implications of Causal and Anticausal Learning for NLPMain38 citations
- Compositional Generalization via Semantic Taggingfinding38 citations
- DialogueCSE: Dialogue-based Contrastive Learning of Sentence EmbeddingsMain38 citations
- Everything Is All It Takes: A Multipronged Strategy for Zero-Shot Cross-Lingual Information ExtractionMain38 citations
- Generating Realistic Natural Language Counterfactualsfinding38 citations
- Influence Tuning: Demoting Spurious Correlations via Instance Attribution and Instance-Driven Updatesfinding38 citations
- Learning with Different Amounts of Annotation: From Zero to Many LabelsMain38 citations
- Multi-granularity Textual Adversarial Attack with Behavior CloningMain38 citations
- Topic-Guided Abstractive Multi-Document Summarizationfinding38 citations
- RollingLDA: An Update Algorithm of Latent Dirichlet Allocation to Construct Consistent Time Series from Textual Datafinding37 citations
- AVocaDo: Strategy for Adapting Vocabulary to Downstream DomainMain36 citations
- Honey or Poison? Solving the Trigger Curse in Few-shot Event Detection via Causal InterventionMain36 citations
- On the Complementarity between Pre-Training and Back-Translation for Neural Machine Translationfinding36 citations
- P-INT: A Path-based Interaction Model for Few-shot Knowledge Graph Completionfinding36 citations
- Recall and Learn: A Memory-augmented Solver for Math Word Problemsfinding36 citations
- Sorting through the noise: Testing robustness of information processing in pre-trained language modelsMain36 citations
- The World of an Octopus: How Reporting Bias Influences a Language Model’s Perception of ColorMain36 citations
- ConvFiT: Conversational Fine-Tuning of Pretrained Language ModelsMain35 citations
- DILBERT: Customized Pre-Training for Domain Adaptation with Category Shift, with an Application to Aspect ExtractionMain35 citations
- Data Augmentation with Hierarchical SQL-to-Question Generation for Cross-domain Text-to-SQL ParsingMain35 citations
- Decomposing Complex Questions Makes Multi-Hop QA Easier and More Interpretablefinding35 citations
- Does BERT Learn as Humans Perceive? Understanding Linguistic Styles through LexicaMain35 citations
- Euphemistic Phrase Detection by Masked Language Modelfinding35 citations
- Fairness-aware Class Imbalanced LearningMain35 citations
- HETFORMER: Heterogeneous Transformer with Sparse Attention for Long-Text Extractive SummarizationMain35 citations
- Improving Neural Machine Translation by Bidirectional TrainingMain35 citations
- IndoNLI: A Natural Language Inference Dataset for IndonesianMain35 citations
- KERS: A Knowledge-Enhanced Framework for Recommendation Dialog Systems with Multiple Subgoalsfinding35 citations
- Low-resource Taxonomy Enrichment with Pretrained Language ModelsMain35 citations
- ReasonBERT: Pre-trained to Reason with Distant SupervisionMain35 citations
- Rethinking Data Augmentation for Low-Resource Neural Machine Translation: A Multi-Task Learning ApproachMain35 citations
- Tiered Reasoning for Intuitive Physics: Toward Verifiable Commonsense Language Understandingfinding35 citations
- A Thorough Evaluation of Task-Specific Pretraining for SummarizationMain34 citations
- Corpus-based Open-Domain Event Type InductionMain34 citations
- Effects of Parameter Norm Growth During Transformer Training: Inductive Bias from Gradient DescentMain34 citations
- Efficient Test Time Adapter Ensembling for Low-resource Language Varietiesfinding34 citations
- Entity Relation Extraction as Dependency Parsing in Visually Rich DocumentsMain34 citations
- Extracting Event Temporal Relations via Hyperbolic GeometryMain34 citations
- Fine-grained Entity Typing via Label ReasoningMain34 citations
- Importance Estimation from Multiple Perspectives for Keyphrase ExtractionMain34 citations
- Improved Word Sense Disambiguation with Enhanced Sense Representationsfinding34 citations
- Language Models are Few-Shot ButlersMain34 citations
- Learning Opinion Summarizers by Selecting Informative ReviewsMain34 citations
- Learning Prototype Representations Across Few-Shot Tasks for Event DetectionMain34 citations
- Lifelong Event Detection with Knowledge TransferMain34 citations
- Parameter-Efficient Domain Knowledge Integration from Multiple Sources for Biomedical Pre-trained Language Modelsfinding34 citations
- Universal Simultaneous Machine Translation with Mixture-of-Experts Wait-k PolicyMain34 citations
- fairseq Sˆ2: A Scalable and Integrable Speech Synthesis ToolkitSystem Demonstrations34 citations
- Abstract, Rationale, Stance: A Joint Model for Scientific Claim VerificationMain33 citations
- Assessing the Reliability of Word Embedding Gender Bias MeasuresMain33 citations
- BERT might be Overkill: A Tiny but Effective Biomedical Entity Linker based on Residual Convolutional Neural Networksfinding33 citations
- Combining Curriculum Learning and Knowledge Distillation for Dialogue Generationfinding33 citations
- DIALKI: Knowledge Identification in Conversational Systems through Dialogue-Document ContextualizationMain33 citations
- Distilling Knowledge for Empathy Detectionfinding33 citations
- Does Vision-and-Language Pretraining Improve Lexical Grounding?finding33 citations
- Few-Shot Table-to-Text Generation with Prototype Memoryfinding33 citations
- Moving on from OntoNotes: Coreference Resolution Model TransferMain33 citations
- Multi-stage Training with Improved Negative Contrast for Neural Passage RetrievalMain33 citations
- Multilingual and Cross-Lingual Intent Detection from Spoken DataMain33 citations
- Predicting Anti-Asian Hateful Users on Twitter during COVID-19finding33 citations
- Sentence Bottleneck Autoencoders from Transformer Language ModelsMain33 citations
- TIAGE: A Benchmark for Topic-Shift Aware Dialog Modelingfinding33 citations
- Wav-BERT: Cooperative Acoustic and Linguistic Representation Learning for Low-Resource Speech Recognitionfinding33 citations
- A Bag of Tricks for Dialogue SummarizationMain32 citations
- An Empirical Study on Leveraging Position Embeddings for Target-oriented Opinion Words ExtractionMain32 citations
- Asking Questions Like Educational Experts: Automatically Generating Question-Answer Pairs on Real-World Examination DataMain32 citations
- CAPE: Context-Aware Private Embeddings for Private Language LearningMain32 citations
- Crosslingual Transfer Learning for Relation and Event Extraction via Word Category and Class AlignmentsMain32 citations
- Evaluating the Evaluation Metrics for Style Transfer: A Case Study in Multilingual Formality TransferMain32 citations
- Exposure Bias versus Self-Recovery: Are Distortions Really Incremental for Autoregressive Text Generation?Main32 citations
- Flexible Generation of Natural Language DeductionsMain32 citations
- Frustratingly Simple Pretraining Alternatives to Masked Language ModelingMain32 citations
- Iterative GNN-based Decoder for Question GenerationMain32 citations
- Joint Multimedia Event Extraction from Video and Articlefinding32 citations
- Language Modeling, Lexical Translation, Reordering: The Training Process of NMT through the Lens of Classical SMTMain32 citations
- Learning to Rewrite for Non-Autoregressive Neural Machine TranslationMain32 citations
- MLEC-QA: A Chinese Multi-Choice Biomedical Question Answering DatasetMain32 citations
- Measuring Sentence-Level and Aspect-Level (Un)certainty in Science CommunicationsMain32 citations
- Modeling Document-Level Context for Event Detection via Important Context SelectionMain32 citations
- RICA: Evaluating Robust Inference Capabilities Based on Commonsense AxiomsMain32 citations
- Refine and Imitate: Reducing Repetition and Inconsistency in Persuasion Dialogues via Reinforcement Learning and Human Demonstrationfinding32 citations
- Refocusing on Relevance: Personalization in NLGMain32 citations
- Rethinking Why Intermediate-Task Fine-Tuning Worksfinding32 citations
- Thinking Clearly, Talking Fast: Concept-Guided Non-Autoregressive Generation for Open-Domain Dialogue SystemsMain32 citations
- Aligning Cross-lingual Sentence Representations with Dual Momentum ContrastMain31 citations
- Avoiding Inference Heuristics in Few-shot Prompt-based FinetuningMain31 citations
- Bridge to Target Domain by Prototypical Contrastive Learning and Label Confusion: Re-explore Zero-Shot Learning for Slot FillingMain31 citations
- Hierarchical Multi-label Text Classification with Horizontal and Vertical Category CorrelationsMain31 citations
- Improving Stance Detection with Multi-Dataset Learning and Knowledge DistillationMain31 citations
- Inducing Transformer’s Compositional Generalization Ability via Auxiliary Sequence Prediction TasksMain31 citations
- KLMo: Knowledge Graph Enhanced Pretrained Language Model with Fine-Grained Relationshipsfinding31 citations
- Learning Kernel-Smoothed Machine Translation with Retrieved ExamplesMain31 citations
- Neural News Recommendation with Collaborative News Encoding and Structural User Encodingfinding31 citations
- Perceived and Intended Sarcasm Detection with Graph Attention Networksfinding31 citations
- SPECTRA: Sparse Structured Text RationalizationMain31 citations
- Seeking Common but Distinguishing Difference, A Joint Aspect-based Sentiment Analysis ModelMain31 citations
- Think about it! Improving defeasible reasoning by first modeling the question scenario.Main31 citations
- A Model of Cross-Lingual Knowledge-Grounded Response Generation for Open-Domain Dialogue Systemsfinding30 citations
- A Three-Stage Learning Framework for Low-Resource Knowledge-Grounded Dialogue GenerationMain30 citations
- Adversarial Examples for Evaluating Math Word Problem Solversfinding30 citations
- AfroMT: Pretraining Strategies and Reproducible Benchmarks for Translation of 8 African LanguagesMain30 citations
- An Unsupervised Method for Building Sentence Simplification Corpora in Multiple Languagesfinding30 citations
- BFClass: A Backdoor-free Text Classification Frameworkfinding30 citations
- BPM_MT: Enhanced Backchannel Prediction Model using Multi-Task LearningMain30 citations
- Context-aware Entity Typing in Knowledge Graphsfinding30 citations
- Controlling Machine Translation for Multiple Attributes with Additive InterventionsMain30 citations
- Cost-effective End-to-end Information Extraction for Semi-structured Document ImagesMain30 citations
- CrossVQA: Scalably Generating Benchmarks for Systematically Testing VQA GeneralizationMain30 citations
- Data-QuestEval: A Referenceless Metric for Data-to-Text Semantic EvaluationMain30 citations
- Dense Hierarchical Retrieval for Open-domain Question Answeringfinding30 citations
- Document Graph for Neural Machine TranslationMain30 citations
- Effect of Visual Extensions on Natural Language Understanding in Vision-and-Language ModelsMain30 citations
- Few-Shot Emotion Recognition in Conversation with Sequential Prototypical NetworksMain30 citations
- GOLD: Improving Out-of-Scope Detection in Dialogues using Data AugmentationMain30 citations
- How Does Counterfactually Augmented Data Impact Models for Social Computing Constructs?Main30 citations
- Is Everything in Order? A Simple Way to Order SentencesMain30 citations
- Journalistic Guidelines Aware News Image CaptioningMain30 citations
- Knowledge Enhanced Fine-Tuning for Better Handling Unseen Entities in Dialogue GenerationMain30 citations
- Optimal Neural Program Synthesis from Multimodal Specificationsfinding30 citations
- Uncovering the Limits of Text-based Emotion Detectionfinding30 citations
- Which is Making the Contribution: Modulating Unimodal and Cross-modal Dynamics for Multimodal Sentiment Analysisfinding30 citations
- A Bayesian Framework for Information-Theoretic ProbingMain29 citations
- A Generative Framework for Simultaneous Machine TranslationMain29 citations
- A Large-Scale Study of Machine Translation in Turkic LanguagesMain29 citations
- Achieving Model Robustness through Discrete Adversarial TrainingMain29 citations
- Constructing Emotional Consensus and Utilizing Unpaired Data for Empathetic Dialogue Generationfinding29 citations
- Cross-Domain Data Integration for Named Entity Disambiguation in Biomedical Textfinding29 citations
- Cross-Modal Retrieval Augmentation for Multi-Modal Classificationfinding29 citations
- Exploiting Reasoning Chains for Multi-hop Science Question Answeringfinding29 citations
- FiD-Ex: Improving Sequence-to-Sequence Models for Extractive Rationale GenerationMain29 citations
- Global Explainability of BERT-Based Evaluation Metrics by Disentangling along Linguistic FactorsMain29 citations
- HyperExpan: Taxonomy Expansion with Hyperbolic Representation Learningfinding29 citations
- Integrating Deep Event-Level and Script-Level Information for Script Event PredictionMain29 citations
- MTAdam: Automatic Balancing of Multiple Training Loss TermsMain29 citations
- MURAL: Multimodal, Multitask Representations Across Languagesfinding29 citations
- MeLT: Message-Level Transformer with Masked Document Representations as Pre-Training for Stance Detectionfinding29 citations
- Mutual-Learning Improves End-to-End Speech TranslationMain29 citations
- Non-Parametric Unsupervised Domain Adaptation for Neural Machine Translationfinding29 citations
- Pre-train or Annotate? Domain Adaptation with a Constrained BudgetMain29 citations
- Self-Attention Graph Residual Convolutional Networks for Event Detection with dependency relationsfinding29 citations
- Simple and Effective Unsupervised Redundancy Elimination to Compress Dense Vectors for Passage RetrievalMain29 citations
- Universal-KD: Attention-based Output-Grounded Intermediate Layer Knowledge DistillationMain29 citations
- Wino-X: Multilingual Winograd Schemas for Commonsense Reasoning and Coreference ResolutionMain29 citations
- “Be nice to your wife! The restaurants are closed”: Can Gender Stereotype Detection Improve Sexism Classification?finding29 citations
- Adversarial Attacks on Knowledge Graph Embeddings via Instance Attribution MethodsMain28 citations
- COVR: A Test-Bed for Visually Grounded Compositional Generalization with Real ImagesMain28 citations
- CodRED: A Cross-Document Relation Extraction Dataset for Acquiring Knowledge in the WildMain28 citations
- Exploring the Role of BERT Token Representations to Explain Sentence Probing ResultsMain28 citations
- Finding needles in a haystack: Sampling Structurally-diverse Training Sets from Synthetic Data for Compositional GeneralizationMain28 citations
- Human Rationales as Attribution Priors for Explainable Stance DetectionMain28 citations
- HypoGen: Hyperbole Generation with Commonsense and Counterfactual Knowledgefinding28 citations
- Improving Federated Learning for Aspect-based Sentiment Analysis via Topic MemoriesMain28 citations
- KFCNet: Knowledge Filtering and Contrastive Learning for Generative Commonsense Reasoningfinding28 citations
- More is Better: Enhancing Open-Domain Dialogue Generation via Multi-Source Heterogeneous KnowledgeMain28 citations
- Multitask Semi-Supervised Learning for Class-Imbalanced Discourse ClassificationMain28 citations
- On the Transferability of Adversarial Attacks against Neural Text ClassifierMain28 citations
- Self- and Pseudo-self-supervised Prediction of Speaker and Key-utterance for Multi-party Dialogue Reading Comprehensionfinding28 citations
- SeqAttack: On Adversarial Attacks for Named Entity RecognitionSystem Demonstrations28 citations
- Towards Zero-Shot Knowledge Distillation for Natural Language ProcessingMain28 citations
- Code-switched inspired losses for spoken dialog representationsMain27 citations
- Detect and Perturb: Neutral Rewriting of Biased and Sensitive Text via Gradient-based Decodingfinding27 citations
- Distilling Relation Embeddings from Pretrained Language ModelsMain27 citations
- Distributionally Robust Multilingual Machine TranslationMain27 citations
- EfficientBERT: Progressively Searching Multilayer Perceptron via Warm-up Knowledge Distillationfinding27 citations
- Genre as Weak Supervision for Cross-lingual Dependency ParsingMain27 citations
- Have You Seen That Number? Investigating Extrapolation in Question Answering ModelsMain27 citations
- I Wish I Would Have Loved This One, But I Didn’t – A Multilingual Dataset for Counterfactual Detection in Product ReviewMain27 citations
- Idiosyncratic but not Arbitrary: Learning Idiolects in Online Registers Reveals Distinctive yet Consistent Individual StylesMain27 citations
- Injecting Entity Types into Entity-Guided Text GenerationMain27 citations
- Neural Machine Translation Quality and Post-Editing PerformanceMain27 citations
- SD-QA: Spoken Dialectal Question Answering for the Real Worldfinding27 citations
- Single-dataset Experts for Multi-dataset Question AnsweringMain27 citations
- Stepmothers are mean and academics are pretentious: What do pretrained language models learn about you?Main27 citations
- TEMP: Taxonomy Expansion with Dynamic Margin Loss through Taxonomy-PathsMain27 citations
- Unsupervised Conversation Disentanglement through Co-TrainingMain27 citations
- Unsupervised Data Augmentation with Naive Augmentation and without Unlabeled DataMain27 citations
- ValNorm Quantifies Semantics to Reveal Consistent Valence Biases Across Languages and Over CenturiesMain27 citations
- What happens if you treat ordinal ratings as interval data? Human evaluations in NLP are even more under-powered than you thinkMain27 citations
- What’s in a Name? Answer Equivalence For Open-Domain Question AnsweringMain27 citations
- A Semantic Feature-Wise Transformation Relation Network for Automatic Short Answer GradingMain26 citations
- ActiveEA: Active Learning for Neural Entity AlignmentMain26 citations
- Aligning Actions Across Recipe GraphsMain26 citations
- Allocating Large Vocabulary Capacity for Cross-Lingual Language Model Pre-TrainingMain26 citations
- Beta Distribution Guided Aspect-aware Graph for Aspect Category Sentiment Analysis with Affective KnowledgeMain26 citations
- CoLV: A Collaborative Latent Variable Model for Knowledge-Grounded Dialogue GenerationMain26 citations
- CodeQA: A Question Answering Dataset for Source Code Comprehensionfinding26 citations
- ConRPG: Paraphrase Generation using Contexts as RegularizerMain26 citations
- Cross-lingual Sentence Embedding using Multi-Task LearningMain26 citations
- Efficient Contrastive Learning via Novel Data Augmentation and Curriculum LearningMain26 citations
- Exploring Decomposition for Table-based Fact Verificationfinding26 citations
- Filling the Gaps in Ancient Akkadian Texts: A Masked Language Modelling ApproachMain26 citations
- ForumSum: A Multi-Speaker Conversation Summarization Datasetfinding26 citations
- Heterogeneous Graph Neural Networks for Keyphrase GenerationMain26 citations
- Learning Constraints and Descriptive Segmentation for Subevent DetectionMain26 citations
- Multilingual Translation via Grafting Pre-trained Language Modelsfinding26 citations
- PDALN: Progressive Domain Adaptation over a Pre-trained Model for Low-Resource Cross-Domain Named Entity RecognitionMain26 citations
- Project Debater APIs: Decomposing the AI Grand ChallengeSystem Demonstrations26 citations
- RoR: Read-over-Read for Long Document Machine Reading Comprehensionfinding26 citations
- Say ‘YES’ to Positivity: Detecting Toxic Language in Workplace Communicationsfinding26 citations
- Speechformer: Reducing Information Loss in Direct Speech TranslationMain26 citations
- T3-Vis: visual analytic for Training and fine-Tuning Transformers in NLPSystem Demonstrations26 citations
- Transductive Learning for Unsupervised Text Style TransferMain26 citations
- We Need to Talk About train-dev-test SplitsMain26 citations
- BiSECT: Learning to Split and Rephrase Sentences with BitextsMain25 citations
- Coarse2Fine: Fine-grained Text Classification on Coarsely-grained Annotated DataMain25 citations
- Compositional Networks Enable Systematic Generalization for Grounded Language Understandingfinding25 citations
- Data Efficient Masked Language Modeling for Vision and Languagefinding25 citations
- Disentangling Generative Factors in Natural Language with Discrete Variational Autoencodersfinding25 citations
- HAConvGNN: Hierarchical Attention Based Convolutional Graph Neural Network for Code Documentation Generation in Jupyter Notebooksfinding25 citations
- How much coffee was consumed during EMNLP 2019? Fermi Problems: A New Reasoning Challenge for AIMain25 citations
- Is Multi-Hop Reasoning Really Explainable? Towards Benchmarking Reasoning InterpretabilityMain25 citations
- Numeracy enhances the Literacy of Language ModelsMain25 citations
- Relation Extraction with Word Graphs from N-gramsMain25 citations
- Span Pointer Networks for Non-Autoregressive Task-Oriented Semantic Parsingfinding25 citations
- Systematic Generalization on gSCAN: What is Nearly Solved and What is Next?Main25 citations
- Time-dependent Entity Embedding is not All You Need: A Re-evaluation of Temporal Knowledge Graph Completion Models under a Unified FrameworkMain25 citations
- To Protect and To Serve? Analyzing Entity-Centric Framing of Police Violencefinding25 citations
- Translate & Fill: Improving Zero-Shot Multilingual Semantic Parsing with Synthetic Datafinding25 citations
- VeeAlign: Multifaceted Context Representation Using Dual Attention for Ontology AlignmentMain25 citations
- Vision Matters When It Should: Sanity Checking Multimodal Machine Translation ModelsMain25 citations
- Will this Question be Answered? Question Filtering via Answer Model Distillation for Efficient Question AnsweringMain25 citations
- A Computational Exploration of Pejorative Language in Social Mediafinding24 citations
- A Secure and Efficient Federated Learning Framework for NLPMain24 citations
- CRYPTOGRU: Low Latency Privacy-Preserving Text Analysis With GRUMain24 citations
- DiscoDVT: Generating Long Text with Discourse-Aware Discrete Variational TransformerMain24 citations
- Discovering the Unknown Knowns: Turning Implicit Knowledge in the Dataset into Explicit Training Examples for Visual Question AnsweringMain24 citations
- Disentangling Representations of Text by Masking TransformersMain24 citations
- End-to-End Entity Resolution and Question Answering Using Differentiable Knowledge GraphsMain24 citations
- Hyperbolic Geometry is Not Necessary: Lightweight Euclidean-Based Models for Low-Dimensional Knowledge Graph Embeddingsfinding24 citations
- Improving Distantly-Supervised Named Entity Recognition with Self-Collaborative Denoising LearningMain24 citations
- Investigating Robustness of Dialog Models to Popular Figurative Language ConstructsMain24 citations
- Knowing False Negatives: An Adversarial Training Method for Distantly Supervised Relation ExtractionMain24 citations
- ODIST: Open World Classification via Distributionally Shifted Instancesfinding24 citations
- SgSum:Transforming Multi-document Summarization into Sub-graph SelectionMain24 citations
- Simulated Chats for Building Dialog Systems: Learning to Generate Conversations from Instructionsfinding24 citations
- The Topic Confusion Task: A Novel Evaluation Scenario for Authorship Attributionfinding24 citations
- Towards Automatic Evaluation of Dialog Systems: A Model-Free Off-Policy Evaluation ApproachMain24 citations
- Uni-FedRec: A Unified Privacy-Preserving News Recommendation Framework for Model Training and Online Servingfinding24 citations
- Using Question Answering Rewards to Improve Abstractive Summarizationfinding24 citations
- An Explicit-Joint and Supervised-Contrastive Learning Framework for Few-Shot Intent Classification and Slot Fillingfinding23 citations
- Benchmarking Commonsense Knowledge Base Population with an Effective Evaluation DatasetMain23 citations
- Bidirectional Hierarchical Attention Networks based on Document-level Context for Emotion Cause Extractionfinding23 citations
- Caption Enriched Samples for Improving Hateful Memes DetectionMain23 citations
- Comparative Opinion Quintuple Extraction from Product ReviewsMain23 citations
- Connecting Attributions and QA Model Behavior on Realistic CounterfactualsMain23 citations
- Considering Nested Tree Structure in Sentence Extractive Summarization with Pre-trained TransformerMain23 citations
- Contrastive Conditioning for Assessing Disambiguation in MT: A Case Study of Distilled BiasMain23 citations
- Eliminating Sentiment Bias for Aspect-Level Sentiment Classification with Unsupervised Opinion Extractionfinding23 citations
- Encouraging Lexical Translation Consistency for Document-Level Neural Machine TranslationMain23 citations
- Exploring Methods for Generating Feedback Comments for Writing LearningMain23 citations
- FLiText: A Faster and Lighter Semi-Supervised Text Classification with Convolution NetworksMain23 citations
- Integrating Semantic Scenario and Word Relations for Abstractive Sentence SummarizationMain23 citations
- Layer-wise Model Pruning based on Mutual InformationMain23 citations
- Modeling Concentrated Cross-Attention for Neural Machine Translation with Gaussian Mixture Modelfinding23 citations
- Patterns of Polysemy and Homonymy in Contextualised Language Modelsfinding23 citations
- ReGen: Reinforcement Learning for Text and Knowledge Base Generation using Pretrained Language ModelsMain23 citations
- Reference-Centric Models for Grounded Collaborative DialogueMain23 citations
- Rethinking Zero-shot Neural Machine Translation: From a Perspective of Latent Variablesfinding23 citations
- A Simple and Effective Method To Eliminate the Self Language Bias in Multilingual RepresentationsMain22 citations
- AMuSE-WSD: An All-in-one Multilingual System for Easy Word Sense DisambiguationSystem Demonstrations22 citations
- Argument Pair Extraction with Mutual Guidance and Inter-sentence Relation GraphMain22 citations
- Aspect-based Sentiment Analysis in Question Answering Forumsfinding22 citations
- Back to the Basics: A Quantitative Analysis of Statistical and Graph-Based Term Weighting Schemes for Keyword ExtractionMain22 citations
- CATE: A Contrastive Pre-trained Model for Metaphor Detection with Semi-supervised LearningMain22 citations
- Detecting Community Sensitive Norm Violations in Online Conversationsfinding22 citations
- Do We Know What We Don’t Know? Studying Unanswerable Questions beyond SQuAD 2.0finding22 citations
- Efficient Multi-Task Auxiliary Learning: Selecting Auxiliary Data by Feature SimilarityMain22 citations
- Extracting Fine-Grained Knowledge Graphs of Scientific Claims: Dataset and Transformer-Based ResultsMain22 citations
- GAML-BERT: Improving BERT Early Exiting by Gradient Aligned Mutual LearningMain22 citations
- Improving Abstractive Dialogue Summarization with Hierarchical Pretraining and Topic Segmentfinding22 citations
- K-PLUG: Knowledge-injected Pre-trained Language Model for Natural Language Understanding and Generation in E-Commercefinding22 citations
- LMdiff: A Visual Diff Tool to Compare Language ModelsSystem Demonstrations22 citations
- Learning to Answer Psychological Questionnaire for Personality Detectionfinding22 citations
- Memory and Knowledge Augmented Language Models for Inferring Salience in Long-Form StoriesMain22 citations
- Micromodels for Efficient, Explainable, and Reusable Systems: A Case Study on Mental Healthfinding22 citations
- NOAHQA: Numerical Reasoning with Interpretable Graph Question Answering Datasetfinding22 citations
- Natural Language Processing Meets Quantum Physics: A Survey and CategorizationMain22 citations
- Neuro-Symbolic Approaches for Text-Based Policy LearningMain22 citations
- Not Just Classification: Recognizing Implicit Discourse Relation on Joint Modeling of Classification and GenerationMain22 citations
- Open Knowledge Graphs Canonicalization using Variational AutoencodersMain22 citations
- Reinforced Counterfactual Data Augmentation for Dual Sentiment ClassificationMain22 citations
- Role of Language Relatedness in Multilingual Fine-tuning of Language Models: A Case Study in Indo-Aryan LanguagesMain22 citations
- Rˆ3Net:Relation-embedded Representation Reconstruction Network for Change CaptioningMain22 citations
- Salience-Aware Event Chain Modeling for Narrative UnderstandingMain22 citations
- Sociolectal Analysis of Pretrained Language ModelsMain22 citations
- Table-based Fact Verification With Salience-aware Learningfinding22 citations
- Towards Realistic Few-Shot Relation ExtractionMain22 citations
- Unsupervised Paraphrasing Consistency Training for Low Resource Named Entity RecognitionMain22 citations
- iFacetSum: Coreference-based Interactive Faceted Summarization for Multi-Document ExplorationSystem Demonstrations22 citations
- A Scalable Framework for Learning From Implicit User Feedback to Improve Natural Language Understanding in Large-Scale Conversational AI SystemsMain21 citations
- APIRecX: Cross-Library API Recommendation via Pre-Trained Language ModelMain21 citations
- Attention Weights in Transformer NMT Fail Aligning Words Between Sequences but Largely Explain Model Predictionsfinding21 citations
- Beyond Reptile: Meta-Learned Dot-Product Maximization between Gradients for Improved Single-Task Regularizationfinding21 citations
- Comparing Feature-Engineering and Feature-Learning Approaches for Multilingual Translationese ClassificationMain21 citations
- Detecting Frames in News Headlines and Lead Images in U.S. Gun Violence Coveragefinding21 citations
- End-to-End Learning of Flowchart Grounded Task-Oriented DialogsMain21 citations
- Enjoy the Salience: Towards Better Transformer-based Faithful Explanations with Word SalienceMain21 citations
- Expanding End-to-End Question Answering on Differentiable Knowledge Graphs with IntersectionMain21 citations
- Exploring Strategies for Generalizable Commonsense Reasoning with Pre-trained ModelsMain21 citations
- Frame Semantic-Enhanced Sentence Modeling for Sentence-level Extractive Text SummarizationMain21 citations
- Generalization in Text-based Games via Hierarchical Reinforcement Learningfinding21 citations
- Geo-BERT Pre-training Model for Query Rewriting in POI Searchfinding21 citations
- How Does Fine-tuning Affect the Geometry of Embedding Space: A Case Study on Isotropyfinding21 citations
- Improving Query Graph Generation for Complex Question Answering over Knowledge BaseMain21 citations
- Improving Simultaneous Translation by Incorporating Pseudo-References with Fewer ReorderingsMain21 citations
- Investigating Numeracy Learning Ability of a Text-to-Text Transfer Modelfinding21 citations
- Is BERT a Cross-Disciplinary Knowledge Learner? A Surprising Finding of Pre-trained Models’ Transferabilityfinding21 citations
- Language-agnostic Representation from Multilingual Sentence Encoders for Cross-lingual Similarity EstimationMain21 citations
- Neural Attention-Aware Hierarchical Topic ModelMain21 citations
- Open-domain clarification question generation without question examplesMain21 citations
- RAST: Domain-Robust Dialogue Rewriting as Sequence TaggingMain21 citations
- Ultra-High Dimensional Sparse Representations with Binarization for Efficient Text RetrievalMain21 citations
- Using Optimal Transport as Alignment Objective for fine-tuning Multilingual Contextualized Embeddingsfinding21 citations
- WIKIBIAS: Detecting Multi-Span Subjective Biases in Languagefinding21 citations
- You should evaluate your language model on marginal likelihood over tokenisationsMain21 citations
- (Mis)alignment Between Stance Expressed in Social Media Data and Public Opinion SurveysMain20 citations
- Active Learning for Rumor Identification on Social Mediafinding20 citations
- Are Factuality Checkers Reliable? Adversarial Meta-evaluation of Factuality in Summarizationfinding20 citations
- CTAL: Pre-training Cross-modal Transformer for Audio-and-Language RepresentationsMain20 citations
- Char2Subword: Extending the Subword Embedding Space Using Robust Character Compositionalityfinding20 citations
- Conversational Multi-Hop Reasoning with Neural Commonsense Knowledge and Symbolic Logic RulesMain20 citations
- Debiasing Methods in Natural Language Understanding Make Bias More AccessibleMain20 citations
- Detecting Speaker Personas from Conversational TextsMain20 citations
- Don’t be Contradicted with Anything! CI-ToD: Towards Benchmarking Consistency for Task-oriented Dialogue SystemMain20 citations
- Fine-grained Semantic Alignment Network for Weakly Supervised Temporal Language Groundingfinding20 citations
- Focus on what matters: Applying Discourse Coherence Theory to Cross Document CoreferenceMain20 citations
- How May I Help You? Using Neural Text Simplification to Improve Downstream NLP Tasksfinding20 citations
- Improving Sequence-to-Sequence Pre-training via Sequence Span RewritingMain20 citations
- Is Information Density Uniform in Task-Oriented Dialogues?Main20 citations
- Keyphrase Generation with Fine-Grained Evaluation-Guided Reinforcement Learningfinding20 citations
- Leveraging Information Bottleneck for Scientific Document Summarizationfinding20 citations
- Logic-level Evidence Retrieval and Graph-based Verification Network for Table-based Fact VerificationMain20 citations
- Neural Unification for Logic Reasoning over Natural Languagefinding20 citations
- On the Effects of Transformer Size on In- and Out-of-Domain Calibrationfinding20 citations
- SciXGen: A Scientific Paper Dataset for Context-Aware Text Generationfinding20 citations
- Self Question-answering: Aspect-based Sentiment Analysis by Role Flipped Machine Reading Comprehensionfinding20 citations
- Total Recall: a Customized Continual Learning Method for Neural Semantic ParsersMain20 citations
- Towards Incremental Transformers: An Empirical Analysis of Transformer Models for Incremental NLUMain20 citations
- Uncertain Local-to-Global Networks for Document-Level Event Factuality IdentificationMain20 citations
- Understanding Politics via Contextualized Discourse ProcessingMain20 citations
- “Was it “stated” or was it “claimed”?: How linguistic bias affects generative language modelsMain20 citations
- A Label-Aware BERT Attention Network for Zero-Shot Multi-Intent Detection in Spoken Language UnderstandingMain19 citations
- Back-Training excels Self-Training at Unsupervised Domain Adaptation of Question Generation and Passage RetrievalMain19 citations
- Contextualize Knowledge Bases with Transformer for End-to-end Task-Oriented Dialogue SystemsMain19 citations
- Conundrums in Event Coreference Resolution: Making Sense of the State of the ArtMain19 citations
- Discovering Explanatory Sentences in Legal Case Decisions Using Pre-trained Language Modelsfinding19 citations
- Don’t Go Far Off: An Empirical Study on Neural Poetry TranslationMain19 citations
- Extracting Topics with Simultaneous Word Co-occurrence and Semantic Correlation Graphs: Neural Topic Modeling for Short Textsfinding19 citations
- Generic resources are what you need: Style transfer tasks without task-specific parallel training dataMain19 citations
- Knowledge Graph Representation Learning using Ordinary Differential EquationsMain19 citations
- Learning to Ground Visual Objects for Visual Dialogfinding19 citations
- MIRTT: Learning Multimodal Interaction Representations from Trilinear Transformers for Visual Question Answeringfinding19 citations
- Maximal Clique Based Non-Autoregressive Open Information ExtractionMain19 citations
- Modeling Mathematical Notation Semantics in Academic Papersfinding19 citations
- Multilingual AMR Parsing with Noisy Knowledge Distillationfinding19 citations
- Neural Natural Logic Inference for Interpretable Question AnsweringMain19 citations
- PermuteFormer: Efficient Relative Position Encoding for Long SequencesMain19 citations
- Probing Commonsense Explanation in Dialogue Response Generationfinding19 citations
- QA-Align: Representing Cross-Text Content Overlap by Aligning Question-Answer PropositionsMain19 citations
- Scheduled Sampling Based on Decoding Steps for Neural Machine TranslationMain19 citations
- Self-training with Few-shot RationalizationMain19 citations
- SupCL-Seq: Supervised Contrastive Learning for Downstream Optimized Sequence Representationsfinding19 citations
- Text Counterfactuals via Latent Optimization and Shapley-Guided SearchMain19 citations
- Towards Making the Most of Dialogue Characteristics for Neural Chat TranslationMain19 citations
- Transferable Persona-Grounded Dialogues via Grounded Minimal EditsMain19 citations
- Unseen Entity Handling in Complex Question Answering over Knowledge Base via Language Generationfinding19 citations
- YASO: A Targeted Sentiment Analysis Evaluation Dataset for Open-Domain ReviewsMain19 citations
- AM2iCo: Evaluating Word Meaning in Context across Low-Resource Languages with Adversarial ExamplesMain18 citations
- Adversarial Scrubbing of Demographic Information for Text ClassificationMain18 citations
- Aligning Multidimensional Worldviews and Discovering Ideological DifferencesMain18 citations
- Bandits Don’t Follow Rules: Balancing Multi-Facet Machine Translation with Multi-Armed Banditsfinding18 citations
- Beyond Text: Incorporating Metadata and Label Structure for Multi-Label Document Classification using Heterogeneous GraphsMain18 citations
- Certified Robustness to Programmable Transformations in LSTMsMain18 citations
- Cross-lingual Intermediate Fine-tuning improves Dialogue State TrackingMain18 citations
- DomiKnowS: A Library for Integration of Symbolic Domain Knowledge in Deep LearningSystem Demonstrations18 citations
- Exploring a Unified Sequence-To-Sequence Transformer for Medical Product Safety Monitoring in Social Mediafinding18 citations
- How Suitable Are Subword Segmentation Strategies for Translating Non-Concatenative Morphology?finding18 citations
- IGA: An Intent-Guided Authoring AssistantMain18 citations
- Inflate and Shrink:Enriching and Reducing Interactions for Fast Text-Image RetrievalMain18 citations
- Putting Words in BERT’s Mouth: Navigating Contextualized Vector Spaces with PseudowordsMain18 citations
- RankNAS: Efficient Neural Architecture Search by Pairwise RankingMain18 citations
- Robustness Evaluation of Entity Disambiguation Using Prior Probes: the Case of Entity OvershadowingMain18 citations
- Self-Supervised Curriculum Learning for Spelling Error CorrectionMain18 citations
- Semi-Supervised Exaggeration Detection of Health Science Press ReleasesMain18 citations
- Synchronous Dual Network with Cross-Type Attention for Joint Entity and Relation ExtractionMain18 citations
- Unsupervised Relation Extraction: A Variational Autoencoder ApproachMain18 citations
- Adapting Entities across Languages and Culturesfinding17 citations
- Adversarial Attack against Cross-lingual Knowledge Graph AlignmentMain17 citations
- COUGH: A Challenge Dataset and Models for COVID-19 FAQ RetrievalMain17 citations
- Enlivening Redundant Heads in Multi-head Self-attention for Machine TranslationMain17 citations
- GMH: A General Multi-hop Reasoning Model for KG CompletionMain17 citations
- GeneSis: A Generative Approach to Substitutes in ContextMain17 citations
- Mixup Decoding for Diverse Machine Translationfinding17 citations
- Multivalent Entailment Graphs for Question AnsweringMain17 citations
- NDH-Full: Learning and Evaluating Navigational Agents on Full-Length DialogueMain17 citations
- Open-Domain Question-Answering for COVID-19 and Other Emergent DomainsSystem Demonstrations17 citations
- QACE: Asking Questions to Evaluate an Image Captionfinding17 citations
- Self-Supervised Detection of Contextual Synonyms in a Multi-Class Setting: Phenotype Annotation Use CaseMain17 citations
- Simple or Complex? Complexity-controllable Question Generation with Soft Templates and Deep Mixture of Experts Modelfinding17 citations
- Summarize-then-Answer: Generating Concise Explanations for Multi-hop Reading ComprehensionMain17 citations
- Unsupervised Multi-View Post-OCR Error Correction With Language ModelsMain17 citations
- mDAPT: Multilingual Domain Adaptive Pretraining in a Single Modelfinding17 citations
- An Empirical Study on Multiple Information Sources for Zero-Shot Fine-Grained Entity TypingMain16 citations
- An Information-Theoretic Characterization of Morphological FusionMain16 citations
- Boosting Cross-Lingual Transfer via Self-Learning with Uncertainty EstimationMain16 citations
- Context-Aware Interaction Network for Question MatchingMain16 citations
- Controlled Neural Sentence-Level Reframing of News Articlesfinding16 citations
- Domain-Lifelong Learning for Dialogue State Tracking via Knowledge Preservation NetworksMain16 citations
- Grammatical Error Correction with Contrastive Learning in Low Error Density Domainsfinding16 citations
- Is this the end of the gold standard? A straightforward reference-less grammatical error correction metricMain16 citations
- Linguistic Dependencies and Statistical DependenceMain16 citations
- Mining the Cause of Political Decision-Making from Social Media: A Case Study of COVID-19 Policies across the US Statesfinding16 citations
- Multi-Vector Attention Models for Deep Re-rankingMain16 citations
- Nearest Neighbour Few-Shot Learning for Cross-lingual ClassificationMain16 citations
- NegatER: Unsupervised Discovery of Negatives in Commonsense Knowledge BasesMain16 citations
- PRIDE: Predicting Relationships in ConversationsMain16 citations
- PhoMT: A High-Quality and Large-Scale Benchmark Dataset for Vietnamese-English Machine TranslationMain16 citations
- Question Answering over Electronic Devices: A New Benchmark Dataset and a Multi-Task Learning based QA Frameworkfinding16 citations
- SPARQLing Database Queries from Intermediate Question DecompositionsMain16 citations
- Self-training Improves Pre-training for Few-shot Learning in Task-oriented Dialog SystemsMain16 citations
- Sequential Cross-Document Coreference ResolutionMain16 citations
- Set Generation Networks for End-to-End Knowledge Base PopulationMain16 citations
- Smelting Gold and Silver for Improved Multilingual AMR-to-Text GenerationMain16 citations
- Structure-Augmented Keyphrase GenerationMain16 citations
- Towards Developing a Multilingual and Code-Mixed Visual Question Answering System by Knowledge Distillationfinding16 citations
- Towards Document-Level Paraphrase Generation with Sentence Rewriting and Reorderingfinding16 citations
- Treasures Outside Contexts: Improving Event Detection via Global StatisticsMain16 citations
- Uncertainty-Aware Balancing for Multilingual and Multi-Domain Neural Machine Translation TrainingMain16 citations
- When in Doubt: Improving Classification Performance with Alternating Normalizationfinding16 citations
- #HowYouTagTweets: Learning User Hashtagging Preferences via Personalized Topic AttentionMain15 citations
- Automatically Exposing Problems with Neural Dialog ModelsMain15 citations
- Box Embeddings: An open-source library for representation learning using geometric structuresSystem Demonstrations15 citations
- Chandler: An Explainable Sarcastic Response GeneratorSystem Demonstrations15 citations
- Competence-based Curriculum Learning for Multilingual Machine Translationfinding15 citations
- Constructing a Psychometric Testbed for Fair Natural Language ProcessingMain15 citations
- Cryptonite: A Cryptic Crossword Benchmark for Extreme Ambiguity in LanguageMain15 citations
- Decision-Focused SummarizationMain15 citations
- Dynamic Forecasting of Conversation DerailmentMain15 citations
- EARL: Informative Knowledge-Grounded Conversation Generation with Entity-Agnostic Representation LearningMain15 citations
- Emotion Inference in Multi-Turn Conversations with Addressee-Aware Module and Ensemble StrategyMain15 citations
- End-to-End Conversational Search for Online Shopping with Utterance TransferMain15 citations
- Graphine: A Dataset for Graph-aware Terminology Definition GenerationMain15 citations
- HypMix: Hyperbolic Interpolative Data AugmentationMain15 citations
- IR like a SIR: Sense-enhanced Information Retrieval for Multiple LanguagesMain15 citations
- Implicit Premise Generation with Discourse-aware Commonsense Knowledge ModelsMain15 citations
- Improving Graph-based Sentence Ordering with Iteratively Predicted Pairwise OrderingsMain15 citations
- InVeRo-XL: Making Cross-Lingual Semantic Role Labeling Accessible with Intelligible Verbs and RolesSystem Demonstrations15 citations
- Knowledge-Enhanced Evidence Retrieval for Counterargument Generationfinding15 citations
- Leveraging Word-Formation Knowledge for Chinese Word Sense Disambiguationfinding15 citations
- Meta-LMTC: Meta-Learning for Large-Scale Multi-Label Text ClassificationMain15 citations
- MuVER: Improving First-Stage Entity Retrieval with Multi-View Entity RepresentationsMain15 citations
- Multi-Task Dense Retrieval via Model Uncertainty Fusion for Open-Domain Question Answeringfinding15 citations
- Numerical reasoning in machine reading comprehension tasks: are we there yet?Main15 citations
- On Classifying whether Two Texts are on the Same Side of an ArgumentMain15 citations
- OpenFraming: Open-sourced Tool for Computational Framing Analysis of Multilingual DataSystem Demonstrations15 citations
- Point-of-Interest Type Prediction using Text and ImagesMain15 citations
- Re-embedding Difficult Samples via Mutual Information Constrained Semantically Oversampling for Imbalanced Text ClassificationMain15 citations
- Reconstruction Attack on Instance Encoding for Language UnderstandingMain15 citations
- Sometimes We Want Ungrammatical Translationsfinding15 citations
- Style Pooling: Automatic Text Style Obfuscation for Improved Classification FairnessMain15 citations
- TEBNER: Domain Specific Named Entity Recognition with Type Expanded Boundary-aware NetworkMain15 citations
- Transformer-based Lexically Constrained Headline GenerationMain15 citations
- A Finer-grain Universal Dialogue Semantic Structures based Model For Abstractive Dialogue Summarizationfinding14 citations
- Analysis of Language Change in Collaborative Instruction Followingfinding14 citations
- COSMic: A Coherence-Aware Generation Metric for Image Descriptionsfinding14 citations
- Contrastive Representation Learning for Exemplar-Guided Paraphrase Generationfinding14 citations
- Finnish Dialect Identification: The Effect of Audio and TextMain14 citations
- GupShup: Summarizing Open-Domain Code-Switched ConversationsMain14 citations
- HiTRANS: A Hierarchical Transformer Network for Nested Named Entity Recognitionfinding14 citations
- Inducing Stereotypical Character Roles from Plot StructureMain14 citations
- Japanese Zero Anaphora Resolution Can Benefit from Parallel Texts Through Neural Transfer Learningfinding14 citations
- Language Clustering for Multilingual Named Entity Recognitionfinding14 citations
- Learn to Copy from the Copying History: Correlational Copy Network for Abstractive SummarizationMain14 citations
- Looking for Confirmations: An Effective and Human-Like Visual Dialogue StrategyMain14 citations
- MetaTS: Meta Teacher-Student Network for Multilingual Sequence Labeling with Minimal SupervisionMain14 citations
- Modeling Human Sentence Processing with Left-Corner Recurrent Neural Network GrammarsMain14 citations
- Multi-task Learning to Enable Location Mention Identification in the Early Hours of a Crisis Eventfinding14 citations
- Novel Natural Language Summarization of Program Code via Leveraging Multiple Input Representationsfinding14 citations
- Pseudo Zero Pronoun Resolution Improves Zero Anaphora ResolutionMain14 citations
- Self-Supervised Quality Estimation for Machine TranslationMain14 citations
- Semantic Novelty Detection in Natural Language DescriptionsMain14 citations
- Sent2Span: Span Detection for PICO Extraction in the Biomedical Text without Span Annotationsfinding14 citations
- Sentence-Permuted Paragraph GenerationMain14 citations
- SummerTime: Text Summarization Toolkit for Non-expertsSystem Demonstrations14 citations
- Task-adaptive Pre-training and Self-training are Complementary for Natural Language Understandingfinding14 citations
- Translation-based Supervision for Policy Generation in Simultaneous Neural Machine TranslationMain14 citations
- Wine is not v i n. On the Compatibility of Tokenizations across Languagesfinding14 citations
- WinoLogic: A Zero-Shot Logic-based Diagnostic Dataset for Winograd Schema ChallengeMain14 citations
- XLEnt: Mining a Large Cross-lingual Entity Dataset with Lexical-Semantic-Phonetic Word AlignmentMain14 citations
- A Language Model-based Generative Classifier for Sentence-level Discourse ParsingMain13 citations
- An Empirical Investigation of Word Alignment Supervision for Zero-Shot Multilingual Neural Machine TranslationMain13 citations
- CVAE-based Re-anchoring for Implicit Discourse Relation Classificationfinding13 citations
- Constructing contrastive samples via summarization for text classification with limited annotationsfinding13 citations
- Detecting Polarized Topics Using Partisanship-aware Contextualized Topic Embeddingsfinding13 citations
- Distantly Supervised Relation Extraction in Federated Settingsfinding13 citations
- Distantly Supervised Relation Extraction using Multi-Layer Revision Network and Confidence-based Multi-Instance LearningMain13 citations
- Does It Capture STEL? A Modular, Similarity-based Linguistic Style Evaluation FrameworkMain13 citations
- Efficient Dialogue Complementary Policy Learning via Deep Q-network Policy and Episodic Memory PolicyMain13 citations
- Enhancing Visual Dialog Questioner with Entity-based Strategy Learning and Augmented Guesserfinding13 citations
- ExcavatorCovid: Extracting Events and Relations from Text Corpora for Temporal and Causal Analysis for COVID-19System Demonstrations13 citations
- Foreseeing the Benefits of Incidental SupervisionMain13 citations
- Improving Pre-trained Vision-and-Language Embeddings for Phrase GroundingMain13 citations
- Incorporating Circumstances into Narrative Event Predictionfinding13 citations
- Knowledge-Guided Paraphrase Identificationfinding13 citations
- Open-Domain Contextual Link Prediction and its Complementarity with Entailment Graphsfinding13 citations
- Reasoning Visual Dialog with Sparse Graph Learning and Knowledge Transferfinding13 citations
- Retrieve, Discriminate and Rewrite: A Simple and Effective Framework for Obtaining Affective Response in Retrieval-Based Chatbotsfinding13 citations
- STaCK: Sentence Ordering with Temporal Commonsense KnowledgeMain13 citations
- Sequential Randomized Smoothing for Adversarially Robust Speech RecognitionMain13 citations
- Studying word order through iterative shufflingMain13 citations
- TWT: Table with Written Text for Controlled Data-to-Text Generationfinding13 citations
- Thermostat: A Large Collection of NLP Model Explanations and Analysis ToolsSystem Demonstrations13 citations
- To Share or not to Share: Predicting Sets of Sources for Model Transfer LearningMain13 citations
- Uncertainty Measures in Neural Belief Tracking and the Effects on Dialogue Policy PerformanceMain13 citations
- WhyAct: Identifying Action Reasons in Lifestyle VlogsMain13 citations
- A Collaborative Multi-agent Reinforcement Learning Framework for Dialog Action DecompositionMain12 citations
- A Differentiable Relaxation of Graph Segmentation and Alignment for AMR ParsingMain12 citations
- A Graph-Based Neural Model for End-to-End Frame Semantic ParsingMain12 citations
- A Pretraining Numerical Reasoning Model for Ordinal Constrained Question Answering on Knowledge Basefinding12 citations
- A Semantic Filter Based on Relations for Knowledge Graph CompletionMain12 citations
- A multilabel approach to morphosyntactic probingfinding12 citations
- An unsupervised framework for tracing textual sources of moral changefinding12 citations
- Athena 2.0: Contextualized Dialogue Management for an Alexa Prize SocialBotSystem Demonstrations12 citations
- Beyond Grammatical Error Correction: Improving L1-influenced research writing in English using pre-trained encoder-decoder modelsfinding12 citations
- Conditional Poisson Stochastic BeamsMain12 citations
- Continual Few-Shot Learning for Text ClassificationMain12 citations
- Contrasting Human- and Machine-Generated Word-Level Adversarial Examples for Text ClassificationMain12 citations
- DIRECT: Direct and Indirect Responses in Conversational Text Corpusfinding12 citations
- Discovering Representation Sprachbund For Multilingual Pre-Trainingfinding12 citations
- Distantly-Supervised Dense Retrieval Enables Open-Domain Question Answering without Evidence AnnotationMain12 citations
- Efficient Inference for Multilingual Neural Machine TranslationMain12 citations
- Enhancing Dual-Encoders with Question and Answer Cross-Embeddings for Answer Retrievalfinding12 citations
- Entity-level Cross-modal Learning Improves Multi-modal Machine Translationfinding12 citations
- Exploring Multitask Learning for Low-Resource Abstractive Summarizationfinding12 citations
- GFST: Gender-Filtered Self-Training for More Accurate Gender in TranslationMain12 citations
- GenerativeRE: Incorporating a Novel Copy Mechanism and Pretrained Model for Joint Entity and Relation Extractionfinding12 citations
- Give the Truth: Incorporate Semantic Slot into Abstractive Dialogue Summarizationfinding12 citations
- Glyph Enhanced Chinese Character Pre-Training for Lexical Sememe Predictionfinding12 citations
- LMSOC: An Approach for Socially Sensitive Pretrainingfinding12 citations
- Learning Numeracy: A Simple Yet Effective Number Embedding Approach Using Knowledge Graphfinding12 citations
- Mapping probability word problems to executable representationsMain12 citations
- NB-MLM: Efficient Domain Adaptation of Masked Language Models for Sentiment AnalysisMain12 citations
- On the Influence of Masking Policies in Intermediate Pre-trainingMain12 citations
- Paired Examples as Indirect Supervision in Latent Decision ModelsMain12 citations
- Probing Pre-trained Language Models for Semantic Attributes and their Valuesfinding12 citations
- SYSML: StYlometry with Structure and Multitask Learning: Implications for Darknet Forum Migrant AnalysisMain12 citations
- Self-Supervised Neural Topic Modelingfinding12 citations
- Stream-level Latency Evaluation for Simultaneous Machine Translationfinding12 citations
- Summary Explorer: Visualizing the State of the Art in Text SummarizationSystem Demonstrations12 citations
- Topic Transferable Table Question AnsweringMain12 citations
- Bayesian Topic Regression for Causal InferenceMain11 citations
- CHoRaL: Collecting Humor Reaction Labels from Millions of Social Media UsersMain11 citations
- CoPHE: A Count-Preserving Hierarchical Evaluation Metric in Large-Scale Multi-Label Text ClassificationMain11 citations
- Detect and Classify – Joint Span Detection and Classification for Health OutcomesMain11 citations
- Detecting Compositionally Out-of-Distribution Examples in Semantic Parsingfinding11 citations
- ET: A Workstation for Querying, Editing and Evaluating Annotated CorporaSystem Demonstrations11 citations
- Evaluation Paradigms in Question AnsweringMain11 citations
- Explore Better Relative Position Embeddings from Encoding Perspective for Transformer ModelsMain11 citations
- Fine-grained Factual Consistency Assessment for Abstractive Summarization ModelsMain11 citations
- Generation and Extraction Combined Dialogue State Tracking with Hierarchical Ontology IntegrationMain11 citations
- Grounded Graph Decoding improves Compositional Generalization in Question Answeringfinding11 citations
- Learning with Instance Bundles for Reading ComprehensionMain11 citations
- MiRANews: Dataset and Benchmarks for Multi-Resource-Assisted News Summarizationfinding11 citations
- Mind the Context: The Impact of Contextualization in Neural Module Networks for Grounding Visual Referring ExpressionsMain11 citations
- Model Selection for Cross-lingual TransferMain11 citations
- Modeling Users and Online Communities for Abuse Detection: A Position on Ethics and Explainabilityfinding11 citations
- On the Challenges of Evaluating Compositional Explanations in Multi-Hop Inference: Relevance, Completeness, and Expert RatingsMain11 citations
- Profiling News Discourse Structure Using Explicit Subtopic Structures Guided Criticsfinding11 citations
- RW-KD: Sample-wise Loss Terms Re-Weighting for Knowledge Distillationfinding11 citations
- Recurrent Attention for Neural Machine TranslationMain11 citations
- Structured abbreviation expansion in contextfinding11 citations
- Towards Automatic Bias Detection in Knowledge Graphsfinding11 citations
- Towards Label-Agnostic Emotion EmbeddingsMain11 citations
- Winnowing Knowledge for Multi-choice Question Answeringfinding11 citations
- A Massively Multilingual Analysis of Cross-linguality in Shared Embedding SpaceMain10 citations
- A Neural Graph-based Local Coherence Modelfinding10 citations
- Adversarial Regularization as Stackelberg Game: An Unrolled Optimization ApproachMain10 citations
- Analyzing the Surprising Variability in Word Embedding Stability Across LanguagesMain10 citations
- Attend, Memorize and Generate: Towards Faithful Table-to-Text Generation in Few Shotsfinding10 citations
- Automatic rule generation for time expression normalizationfinding10 citations
- Calibrate your listeners! Robust communication-based training for pragmatic speakersfinding10 citations
- ClauseRec: A Clause Recommendation Framework for AI-aided Contract AuthoringMain10 citations
- Connect-the-Dots: Bridging Semantics between Words and Definitions via Aligning Word Sense InventoriesMain10 citations
- Coupling Context Modeling with Zero Pronoun Recovering for Document-Level Natural Language GenerationMain10 citations
- DRIFT: A Toolkit for Diachronic Analysis of Scientific LiteratureSystem Demonstrations10 citations
- Detecting Health Advice in Medical Research LiteratureMain10 citations
- Effective Fine-Tuning Methods for Cross-lingual AdaptationMain10 citations
- Evaluating the Morphosyntactic Well-formedness of Generated TextsMain10 citations
- Exploiting Curriculum Learning in Unsupervised Neural Machine Translationfinding10 citations
- Generalised Unsupervised Domain Adaptation of Neural Machine Translation with Cross-Lingual Data SelectionMain10 citations
- GraphMR: Graph Neural Network for Mathematical ReasoningMain10 citations
- Improved Latent Tree Induction with Distant Supervision via Span ConstraintsMain10 citations
- Improving Knowledge Graph Embedding Using Affine Transformations of Entities Corresponding to Each Relationfinding10 citations
- Instance-adaptive training with noise-robust losses against noisy labelsMain10 citations
- Integrating Personalized PageRank into Neural Word Sense DisambiguationMain10 citations
- Lexicon-Based Graph Convolutional Network for Chinese Word Segmentationfinding10 citations
- Long-Range Modeling of Source Code Files with eWASH: Extended Window Access by Syntax HierarchyMain10 citations
- Low-Rank Subspaces for Unsupervised Entity LinkingMain10 citations
- Mitigating Data Poisoning in Text Classification with Differential Privacyfinding10 citations
- Modular Self-Supervision for Document-Level Relation ExtractionMain10 citations
- Perhaps PTLMs Should Go to School – A Task to Assess Open Book and Closed Book QAMain10 citations
- Revisiting Robust Neural Machine Translation: A Transformer Case Studyfinding10 citations
- SPRING Goes Online: End-to-End AMR Parsing and GenerationSystem Demonstrations10 citations
- Skim-Attention: Learning to Focus via Document Layoutfinding10 citations
- Subword Mapping and Anchoring across Languagesfinding10 citations
- Using Sociolinguistic Variables to Reveal Changing Attitudes Towards Sexuality and GenderMain10 citations
- What’s in Your Head? Emergent Behaviour in Multi-Task Transformer ModelsMain10 citations
- kFolden: k-Fold Ensemble for Out-Of-Distribution DetectionMain10 citations
- Augmenting BERT-style Models with Predictive Coding to Improve Discourse-level RepresentationsMain9 citations
- Building Adaptive Acceptability Classifiers for Neural NLGMain9 citations
- CNNBiF: CNN-based Bigram Features for Named Entity Recognitionfinding9 citations
- CSAGN: Conversational Structure Aware Graph Network for Conversational Semantic Role LabelingMain9 citations
- Can We Improve Model Robustness through Secondary Attribute Counterfactuals?Main9 citations
- Contextual Rephrase Detection for Reducing Friction in Dialogue SystemsMain9 citations
- Data-to-text Generation by Splicing Together Nearest NeighborsMain9 citations
- Diversity and Consistency: Exploring Visual Question-Answer Pair Generationfinding9 citations
- Enhancing Multiple-choice Machine Reading Comprehension by Punishing Illogical InterpretationsMain9 citations
- Enhancing the Context Representation in Similarity-based Word Sense DisambiguationMain9 citations
- Entity-Based Semantic Adequacy for Data-to-Text Generationfinding9 citations
- Event Graph based Sentence FusionMain9 citations
- Exploiting Twitter as Source of Large Corpora of Weakly Similar Pairs for Semantic Sentence EmbeddingsMain9 citations
- Extract, Integrate, Compete: Towards Verification Style Reading Comprehensionfinding9 citations
EMNLP accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.