ACL 2022 Accepted Papers
The full list of 1,031 papers accepted at ACL 2022 (Association for Computational Linguistics). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Long: 603Findings: 331Short: 97
- TruthfulQA: Measuring How Models Mimic Human FalsehoodsLong1,725 citations
- GLM: General Language Model Pretraining with Autoregressive Blank InfillingLong1,644 citations
- P-Tuning: Prompt Tuning Can Be Comparable to Fine-tuning Across Scales and TasksShort1,517 citations
- BitFit: Simple Parameter-efficient Fine-tuning for Transformer-based Masked Language-modelsShort1,295 citations
- Fantastically Ordered Prompts and Where to Find Them: Overcoming Few-Shot Prompt Order SensitivityLong1,172 citations
- Language-agnostic BERT Sentence EmbeddingLong1,081 citations
- Cross-Task Generalization via Natural Language Crowdsourcing InstructionsLong697 citations
- UniXcoder: Unified Cross-Modal Pre-training for Code RepresentationLong659 citations
- Deduplicating Training Data Makes Language Models BetterLong656 citations
- ChartQA: A Benchmark for Question Answering about Charts with Visual and Logical ReasoningFindings617 citations
- Knowledge Neurons in Pretrained TransformersLong600 citations
- Sentence-T5: Scalable Sentence Encoders from Pre-trained Text-to-Text ModelsFindings553 citations
- PPT: Pre-trained Prompt Tuning for Few-shot LearningLong503 citations
- Unified Structure Generation for Universal Information ExtractionLong484 citations
- ToxiGen: A Large-Scale Machine-Generated Dataset for Adversarial and Implicit Hate Speech DetectionLong461 citations
- LinkBERT: Pretraining Language Models with Document LinksLong411 citations
- Knowledgeable Prompt-tuning: Incorporating Knowledge into Prompt Verbalizer for Text ClassificationLong410 citations
- BBQ: A hand-built bias benchmark for question answeringFindings392 citations
- Internet-Augmented Dialogue GenerationLong391 citations
- Generated Knowledge Prompting for Commonsense ReasoningLong361 citations
- Unsupervised Corpus Aware Language Model Pre-training for Dense Passage RetrievalLong351 citations
- BRIO: Bringing Order to Abstractive SummarizationLong334 citations
- SPoT: Better Frozen Model Adaptation through Soft Prompt TransferLong308 citations
- Beyond Goldfish Memory: Long-Term Open-Domain ConversationLong291 citations
- LexGLUE: A Benchmark Dataset for Legal Language Understanding in EnglishLong280 citations
- SpeechT5: Unified-Modal Encoder-Decoder Pre-Training for Spoken Language ProcessingLong271 citations
- SimKGC: Simple Contrastive Knowledge Graph Completion with Pre-trained Language ModelsLong256 citations
- Structured Pruning Learns Compact and Accurate ModelsLong253 citations
- Noisy Channel Language Model Prompting for Few-Shot Text ClassificationLong221 citations
- CBLUE: A Chinese Biomedical Language Understanding Evaluation BenchmarkLong218 citations
- Cutting Down on Prompts and Parameters: Simple Few-Shot Learning with Language ModelsFindings215 citations
- Reframing Instructional Prompts to GPTk’s LanguageFindings215 citations
- CONTaiNER: Few-Shot Named Entity Recognition via Contrastive LearningLong211 citations
- An Empirical Survey of the Effectiveness of Debiasing Techniques for Pre-trained Language ModelsLong208 citations
- PRIMERA: Pyramid-based Masked Sentence Pre-training for Multi-document SummarizationLong203 citations
- UniPELT: A Unified Framework for Parameter-Efficient Language Model TuningLong202 citations
- Auto-Debias: Debiasing Masked Language Models with Automated Biased PromptsLong199 citations
- Multi-Task Pre-Training for Plug-and-Play Task-Oriented Dialogue SystemLong197 citations
- Sequence-to-Sequence Knowledge Graph Completion and Question AnsweringLong191 citations
- A Recipe for Arbitrary Text Style Transfer with Large Language ModelsShort186 citations
- Is GPT-3 Text Indistinguishable from Human Text? Scarecrow: A Framework for Scrutinizing Machine TextLong183 citations
- Direct Speech-to-Speech Translation With Discrete UnitsLong182 citations
- Data Contamination: From Memorization to ExploitationShort181 citations
- A Good Prompt Is Worth Millions of Parameters: Low-resource Prompt-based Learning for Vision-Language ModelsLong178 citations
- An Information-theoretic Approach to Prompt Engineering Without Ground Truth LabelsLong177 citations
- Packed Levitated Marker for Entity and Relation ExtractionLong172 citations
- Enhanced Multi-Channel Graph Convolutional Network for Aspect Sentiment Triplet ExtractionLong164 citations
- RNG-KBQA: Generation Augmented Iterative Ranking for Knowledge Base Question AnsweringLong161 citations
- LiLT: A Simple yet Effective Language-Independent Layout Transformer for Structured Document UnderstandingLong160 citations
- Prompt for Extraction? PAIE: Prompting Argument Interaction for Event Argument ExtractionLong159 citations
- CLIP Models are Few-Shot Learners: Empirical Studies on VQA and Visual EntailmentLong155 citations
- Hallucinated but Factual! Inspecting the Factuality of Hallucinations in Abstractive SummarizationLong152 citations
- Meta-learning via Language Model In-context TuningLong152 citations
- Chart-to-Text: A Large-Scale Benchmark for Chart SummarizationLong151 citations
- Systematic Inequalities in Language Technology Performance across the World’s LanguagesLong146 citations
- A Token-level Reference-free Hallucination Detection Benchmark for Free-form Text GenerationLong145 citations
- Multi-Modal Sarcasm Detection via Cross-Modal Graph Convolutional NetworkLong140 citations
- ReACC: A Retrieval-Augmented Code Completion FrameworkLong140 citations
- Subgraph Retrieval Enhanced Model for Multi-hop Knowledge Base Question AnsweringLong140 citations
- Composable Sparse Fine-Tuning for Cross-Lingual TransferLong139 citations
- Document-Level Relation Extraction with Adaptive Focal Loss and Knowledge DistillationFindings139 citations
- SummScreen: A Dataset for Abstractive Screenplay SummarizationLong138 citations
- Text-Free Prosody-Aware Generative Spoken Language ModelingLong136 citations
- Vision-and-Language Navigation: A Survey of Tasks, Methods, and Future DirectionsLong136 citations
- XLM-E: Cross-lingual Language Model Pre-training via ELECTRALong136 citations
- ReCLIP: A Strong Zero-Shot Baseline for Referring Expression ComprehensionLong135 citations
- Incorporating Hierarchy into Text Encoder: a Contrastive Learning Approach for Hierarchical Text ClassificationLong134 citations
- MISC: A Mixed Strategy-Aware Model integrating COMET for Emotional Support ConversationLong132 citations
- Is Attention Explanation? An Introduction to the DebateLong131 citations
- Boundary Smoothing for Named Entity RecognitionLong130 citations
- MoEfication: Transformer Feed-forward Layers are Mixtures of ExpertsFindings130 citations
- KG-FiD: Infusing Knowledge Graph in Fusion-in-Decoder for Open-Domain Question AnsweringLong128 citations
- Debiased Contrastive Learning of Unsupervised Sentence RepresentationsLong124 citations
- RelationPrompt: Leveraging Prompts to Generate Synthetic Data for Zero-Shot Relation Triplet ExtractionFindings124 citations
- TableFormer: Robust Transformer Modeling for Table-Text EncodingLong124 citations
- Fully Hyperbolic Neural NetworksLong123 citations
- Skill Induction and Planning with Latent LanguageLong123 citations
- KQA Pro: A Dataset with Explicit Compositional Programs for Complex Question Answering over Knowledge BaseLong122 citations
- Complex Evolutional Pattern Learning for Temporal Knowledge Graph ReasoningShort119 citations
- Long Time No See! Open-Domain Conversation with Long-Term Persona MemoryFindings118 citations
- Graph Pre-training for AMR Parsing and GenerationLong116 citations
- DeepStruct: Pretraining of Language Models for Structure PredictionFindings114 citations
- Dynamic Prefix-Tuning for Generative Template-based Event ExtractionLong114 citations
- SummaReranker: A Multi-Task Mixture-of-Experts Re-ranking Framework for Abstractive SummarizationLong114 citations
- Training Data is More Valuable than You Think: A Simple and Effective Method by Retrieving from Training DataLong112 citations
- Discrete Opinion Tree Induction for Aspect-based Sentiment AnalysisLong111 citations
- MultiHiertt: Numerical Reasoning over Multi Hierarchical Tabular and Textual DataLong111 citations
- Prototypical Verbalizer for Prompt-based Few-shot TuningLong110 citations
- Do Pre-trained Models Benefit Knowledge Graph Completion? A Reliable Evaluation and a Reasonable ApproachFindings109 citations
- Enabling Multimodal Generation on CLIP via Vision-Language Knowledge DistillationFindings109 citations
- MELM: Data Augmentation with Masked Entity Language Modeling for Low-Resource NERLong109 citations
- EmoCaps: Emotion Capsule based Model for Conversational Emotion RecognitionFindings108 citations
- IndicBART: A Pre-trained Model for Indic Natural Language GenerationFindings108 citations
- SummN: A Multi-Stage Summarization Framework for Long Input Dialogues and DocumentsLong108 citations
- VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic PhenomenaLong108 citations
- Vision-Language Pre-Training for Multimodal Aspect-Based Sentiment AnalysisLong108 citations
- Decomposed Meta-Learning for Few-Shot Named Entity RecognitionFindings107 citations
- HiTab: A Hierarchical Table Dataset for Question Answering and Natural Language GenerationLong107 citations
- THE-X: Privacy-Preserving Transformer Inference with Homomorphic EncryptionFindings107 citations
- Label Semantics for Few Shot Named Entity RecognitionFindings106 citations
- STEMM: Self-learning with Speech-text Manifold Mixup for Speech TranslationLong106 citations
- SUPERB-SG: Enhanced Speech processing Universal PERformance Benchmark for Semantic and Generative CapabilitiesLong105 citations
- The Moral Integrity Corpus: A Benchmark for Ethical Dialogue SystemsLong104 citations
- Sharpness-Aware Minimization Improves Language Model GeneralizationLong103 citations
- Fantastic Questions and Where to Find Them: FairytaleQA – An Authentic Dataset for Narrative ComprehensionLong102 citations
- Reinforced Cross-modal Alignment for Radiology Report GenerationFindings102 citations
- Compression of Generative Pre-trained Language Models via QuantizationLong101 citations
- NumGLUE: A Suite of Fundamental yet Challenging Mathematical Reasoning TasksLong101 citations
- Controllable Natural Language Generation with Contrastive PrefixesFindings100 citations
- On the Intrinsic and Extrinsic Fairness Evaluation Metrics for Contextualized Language RepresentationsShort99 citations
- FlipDA: Effective and Robust Data Augmentation for Few-Shot LearningLong98 citations
- One Country, 700+ Languages: NLP Challenges for Underrepresented Languages and Dialects in IndonesiaLong97 citations
- Extracting Latent Steering Vectors from Pretrained Language ModelsFindings96 citations
- Identifying the Human Values behind ArgumentsLong96 citations
- PromDA: Prompt-based Data Augmentation for Low-Resource NLU TasksLong96 citations
- BERT Learns to Teach: Knowledge Distillation with Meta LearningLong95 citations
- Effective Token Graph Modeling using a Novel Labeling Strategy for Structured Sentiment AnalysisLong93 citations
- Learning to Reason Deductively: Math Word Problem Solving as Complex Relation ExtractionLong93 citations
- Adaptive Testing and Debugging of NLP ModelsLong92 citations
- Making Transformers Solve Compositional TasksLong92 citations
- S2SQL: Injecting Syntax to Question-Schema Interaction Graph Encoder for Text-to-SQL ParsersFindings92 citations
- Unified Speech-Text Pre-training for Speech Translation and RecognitionLong92 citations
- Upstream Mitigation Is Not All You Need: Testing the Bias Transfer Hypothesis in Pre-Trained Language ModelsLong92 citations
- Good Examples Make A Faster Learner: Simple Demonstration-based Learning for Low-resource NERLong91 citations
- AmericasNLI: Evaluating Zero-shot Natural Language Understanding of Pretrained Multilingual Models in Truly Low-resource LanguagesLong90 citations
- Code Synonyms Do Matter: Multiple Synonyms Matching Network for Automatic ICD CodingShort90 citations
- Revisiting Uncertainty-based Query Strategies for Active Learning with TransformersFindings89 citations
- AraT5: Text-to-Text Transformers for Arabic Language GenerationLong88 citations
- French CrowS-Pairs: Extending a challenge dataset for measuring social bias in masked language models to a language other than EnglishLong88 citations
- Zoom Out and Observe: News Environment Perception for Fake News DetectionLong88 citations
- BiSyn-GAT+: Bi-Syntax Aware Graph Attention Network for Aspect-based Sentiment AnalysisFindings87 citations
- FormNet: Structural Encoding beyond Sequential Modeling in Form Document Information ExtractionLong87 citations
- Legal Judgment Prediction via Event Extraction with ConstraintsLong87 citations
- MINER: Multi-Interest Matching Network for News RecommendationFindings87 citations
- Adversarial Soft Prompt Tuning for Cross-Domain Sentiment AnalysisLong86 citations
- JointCL: A Joint Contrastive Learning Framework for Zero-Shot Stance DetectionLong86 citations
- Tailor: Generating and Perturbing Text with Semantic ControlsLong86 citations
- bert2BERT: Towards Reusable Pretrained Language ModelsLong86 citations
- Seq2Path: Generating Sentiment Tuples as Paths of a TreeFindings85 citations
- Contrastive Learning-Enhanced Nearest Neighbor Mechanism for Multi-Label Text ClassificationShort84 citations
- Generating Data to Mitigate Spurious Correlations in Natural Language Inference DatasetsLong84 citations
- Incorporating Dynamic Semantics into Pre-Trained Language Model for Aspect-based Sentiment AnalysisFindings84 citations
- On the Safety of Conversational Models: Taxonomy, Dataset, and BenchmarkFindings84 citations
- ParaDetox: Detoxification with Parallel DataLong84 citations
- Evaluating Extreme Hierarchical Multi-label ClassificationLong83 citations
- The Paradox of the Compositionality of Natural Language: A Neural Machine Translation Case StudyLong83 citations
- Eider: Empowering Document-level Relation Extraction with Efficient Evidence Extraction and Inference-stage FusionFindings81 citations
- FiNER: Financial Numeric Entity Recognition for XBRL TaggingLong81 citations
- Mix and Match: Learning-free Controllable Text Generationusing Energy Language ModelsLong81 citations
- ClarET: Pre-training a Correlation-Aware Context-To-Event Transformer for Event-Centric Generation and ClassificationLong80 citations
- KNN-Contrastive Learning for Out-of-Domain Intent ClassificationLong80 citations
- XFUND: A Benchmark Dataset for Multilingual Visually Rich Form UnderstandingFindings80 citations
- Dict-BERT: Enhancing Language Model Pre-training with DictionaryFindings78 citations
- Faithful or Extractive? On Mitigating the Faithfulness-Abstractiveness Trade-off in Abstractive SummarizationLong78 citations
- Parallel Instance Query Network for Named Entity RecognitionLong78 citations
- Prompt-free and Efficient Few-shot Learning with Language ModelsLong78 citations
- StableMoE: Stable Routing Strategy for Mixture of ExpertsLong78 citations
- DYLE: Dynamic Latent Extraction for Abstractive Long-Input SummarizationLong77 citations
- Logic-Driven Context Extension and Data Augmentation for Logical Reasoning of TextFindings77 citations
- The Past Mistake is the Future Wisdom: Error-driven Contrastive Probability Optimization for Chinese Spell CheckingFindings77 citations
- LEVEN: A Large-Scale Chinese Legal Event Detection DatasetFindings76 citations
- Overcoming a Theoretical Limitation of Self-AttentionLong76 citations
- Rethinking Document-level Neural Machine TranslationFindings76 citations
- ∞-former: Infinite Memory TransformerLong75 citations
- DialFact: A Benchmark for Fact-Checking in DialogueLong74 citations
- Evaluating Factuality in Text SimplificationLong74 citations
- Compilable Neural Code Generation with Compiler FeedbackFindings73 citations
- A Closer Look at How Fine-tuning Changes BERTLong72 citations
- Efficient Classification of Long Documents Using TransformersShort72 citations
- Your fairness may vary: Pretrained language model fairness in toxic text classificationFindings72 citations
- Continual Prompt Tuning for Dialog State TrackingLong70 citations
- Query and Extract: Refining Event Extraction as Type-oriented Binary DecodingFindings70 citations
- Revisiting Over-Smoothness in Text to SpeechLong70 citations
- Fast Nearest Neighbor Machine TranslationFindings69 citations
- A Contrastive Framework for Learning Sentence Representations from Pairwise and Triple-wise Perspective in Angular SpaceLong68 citations
- Entropy-based Attention Regularization Frees Unintended Bias Mitigation from ListsFindings67 citations
- M3ED: Multi-modal Multi-scene Multi-label Emotional Dialogue DatabaseLong67 citations
- New Intent Discovery with Pre-training and Contrastive LearningLong67 citations
- RotateQVS: Representing Temporal Information as Rotations in Quaternion Vector Space for Temporal Knowledge Graph CompletionLong67 citations
- Seeking Patterns, Not just Memorizing Procedures: Contrastive Learning for Solving Math Word ProblemsFindings67 citations
- Text-to-Table: A New Way of Information ExtractionLong67 citations
- UniTE: Unified Translation EvaluationLong67 citations
- Can Transformer be Too Compositional? Analysing Idiom Processing in Neural Machine TranslationLong66 citations
- ELLE: Efficient Lifelong Pre-training for Emerging DataFindings66 citations
- Expanding Pretrained Models to Thousands More Languages via Lexicon-based AdaptationLong66 citations
- HiStruct+: Improving Extractive Text Summarization with Hierarchical Structure InformationFindings66 citations
- Improving the Generalizability of Depression Detection by Leveraging Clinical QuestionnairesLong65 citations
- MDERank: A Masked Document Embedding Rank Approach for Unsupervised Keyphrase ExtractionFindings65 citations
- Metaphors in Pre-Trained Language Models: Probing and Generalization Across Datasets and LanguagesLong65 citations
- Multi-View Document Representation Learning for Open-Domain Dense RetrievalLong65 citations
- Nested Named Entity Recognition with Span-level GraphsLong65 citations
- ExtEnD: Extractive Entity DisambiguationLong64 citations
- Memorisation versus Generalisation in Pre-trained Language ModelsLong64 citations
- Multilingual Generative Language Models for Zero-Shot Cross-Lingual Event Argument ExtractionLong64 citations
- On Vision Features in Multimodal Machine TranslationLong64 citations
- Fusing Heterogeneous Factors with Triaffine Mechanism for Nested Named Entity RecognitionFindings63 citations
- Generating Scientific Claims for Zero-Shot Scientific Fact CheckingLong63 citations
- Local Languages, Third Spaces, and other High-Resource ScenariosLong63 citations
- MarkupLM: Pre-training of Text and Markup Language for Visually Rich Document UnderstandingLong63 citations
- Problems with Cosine as a Measure of Embedding Similarity for High Frequency WordsShort63 citations
- xGQA: Cross-Lingual Visual Question AnsweringFindings63 citations
- MemSum: Extractive Summarization of Long Documents Using Multi-Step Episodic Markov Decision ProcessesLong62 citations
- SafetyKit: First Aid for Measuring Safety in Open-domain Conversational SystemsLong62 citations
- Understanding Iterative Revision from Human-Written TextLong62 citations
- KinyaBERT: a Morphology-aware Kinyarwanda Language ModelLong61 citations
- The AI Doctor Is In: A Survey of Task-Oriented Dialogue Systems for Healthcare ApplicationsLong61 citations
- FairLex: A Multilingual Benchmark for Evaluating Fairness in Legal Text ProcessingLong60 citations
- NoisyTune: A Little Noise Can Help You Finetune Pretrained Language Models BetterShort60 citations
- UCTopic: Unsupervised Contrastive Learning for Phrase Representations and Topic MiningLong60 citations
- CAKE: A Scalable Commonsense-Aware Framework For Multi-View Knowledge Graph CompletionLong59 citations
- OpenHands: Making Sign Language Recognition Accessible with Pose-based Pretrained Models across LanguagesLong59 citations
- Probing for the Usage of Grammatical NumberLong59 citations
- Prompt-Based Rule Discovery and Boosting for Interactive Weakly-Supervised LearningLong59 citations
- Bag-of-Words vs. Graph vs. Sequence in Text Classification: Questioning the Necessity of Text-Graphs and the Surprising Strength of a Wide MLPLong58 citations
- Challenges and Strategies in Cross-Cultural NLPLong58 citations
- Consistent Representation Learning for Continual Relation ExtractionFindings57 citations
- Continual Few-shot Relation Learning via Embedding Space Regularization and Data AugmentationLong57 citations
- Tackling Fake News Detection by Continually Improving Social Context Representations using Graph Neural NetworksLong57 citations
- Think Before You Speak: Explicitly Generating Implicit Commonsense Knowledge for Response GenerationLong57 citations
- ASPECTNEWS: Aspect-Oriented Summarization of News DocumentsLong55 citations
- DoCoGen: Domain Counterfactual Generation for Low Resource Domain AdaptationLong55 citations
- Graph Enhanced Contrastive Learning for Radiology Findings SummarizationLong55 citations
- Inferring Rewards from Language in ContextLong55 citations
- Investigating Selective Prediction Approaches Across Several Tasks in IID, OOD, and Adversarial SettingsFindings55 citations
- Multi-Granularity Structural Knowledge Distillation for Language Model CompressionLong55 citations
- Multimodal Dialogue Response GenerationLong55 citations
- Program Transfer for Answering Complex Questions over Knowledge BasesLong55 citations
- An Investigation of the (In)effectiveness of Counterfactually Augmented DataLong54 citations
- Detection of Adversarial Examples in Text Classification: Benchmark and Baseline via Robust Density EstimationFindings54 citations
- How Pre-trained Language Models Capture Factual Knowledge? A Causal-Inspired AnalysisFindings54 citations
- Human Evaluation and Correlation with Automatic Metrics in Consultation Note GenerationLong54 citations
- Leveraging Unimodal Self-Supervised Learning for Multimodal Audio-Visual Speech RecognitionLong54 citations
- CICERO: A Dataset for Contextualized Commonsense Inference in DialoguesLong53 citations
- De-Bias for Generative Extraction in Unified NER TaskLong53 citations
- Multi-Stage Prompting for Knowledgeable Dialogue GenerationFindings53 citations
- Read before Generate! Faithful Long Form Question Answering with Machine ReadingFindings53 citations
- Using Pre-Trained Language Models for Producing Counter Narratives Against Hate Speech: a Comparative StudyFindings53 citations
- A Comparative Study of Faithfulness Metrics for Model Interpretability MethodsLong52 citations
- Inducing Positive Perspectives with Text ReframingLong52 citations
- MSP: Multi-Stage Prompting for Making Pre-trained Language Models Better TranslatorsLong52 citations
- Quality Controlled Paraphrase GenerationLong52 citations
- Understanding and Improving Sequence-to-Sequence Pretraining for Neural Machine TranslationLong52 citations
- A Simple yet Effective Relation Information Guided Approach for Few-Shot Relation ExtractionFindings51 citations
- Cross-Modal Discrete Representation LearningLong51 citations
- DialogVED: A Pre-trained Latent Variable Encoder-Decoder Model for Dialog Response GenerationLong51 citations
- Dynamic Schema Graph Fusion Network for Multi-Domain Dialogue State TrackingLong51 citations
- It is AI’s Turn to Ask Humans a Question: Question-Answer Pair Generation for Children’s Story BooksLong51 citations
- Mitigating Gender Bias in Distilled Language Models via Counterfactual Role ReversalFindings51 citations
- Token Dropping for Efficient BERT PretrainingLong51 citations
- Turning Tables: Generating Examples from Semi-structured Tables for Endowing Language Models with Reasoning SkillsLong51 citations
- mLUKE: The Power of Entity Representations in Multilingual Pretrained Language ModelsLong51 citations
- Bottom-Up Constituency Parsing and Nested Named Entity Recognition with Pointer NetworksLong50 citations
- Dialogue Summaries as Dialogue States (DS2), Template-Guided Summarization for Few-shot Dialogue State TrackingFindings50 citations
- Ensembling and Knowledge Distilling of Large Sequence Taggers for Grammatical Error CorrectionLong50 citations
- Fine-Grained Controllable Text Generation Using Non-Residual PromptingLong50 citations
- Improving Time Sensitivity for Question Answering over Temporal Knowledge GraphsLong50 citations
- Make the Best of Cross-lingual Transfer: Evidence from POS Tagging with over 100 LanguagesLong50 citations
- Continual Sequence Generation with Adaptive Compositional ModulesLong49 citations
- Few-shot Named Entity Recognition with Self-describing NetworksLong49 citations
- LaPraDoR: Unsupervised Pretrained Dense Retriever for Zero-Shot Text RetrievalFindings49 citations
- Things not Written in Text: Exploring Spatial Commonsense from Visual SignalsLong49 citations
- Uncertainty Estimation of Transformer Predictions for Misclassification DetectionLong49 citations
- Word Order Does Matter and Shuffled Language Models Know ItLong49 citations
- Zero-Shot Dense Retrieval with Momentum Adversarial Domain Invariant RepresentationsFindings49 citations
- A Model-agnostic Data Manipulation Method for Persona-based Dialogue GenerationLong48 citations
- From text to talk: Harnessing conversational corpora for humane and diversity-aware language technologyLong48 citations
- Nested Named Entity Recognition as Latent Lexicalized Constituency ParsingLong48 citations
- Achieving Reliable Human Assessment of Open-Domain Dialogue SystemsLong47 citations
- DQ-BART: Efficient Sequence-to-Sequence Model via Joint Distillation and QuantizationShort47 citations
- Educational Question Generation of Children Storybooks via Question Type Distribution Learning and Event-centric SummarizationLong47 citations
- HIBRIDS: Attention with Hierarchical Biases for Structure-aware Long Document SummarizationLong47 citations
- Hypergraph Transformer: Weakly-Supervised Multi-hop Reasoning for Knowledge-based Visual Question AnsweringLong47 citations
- Revisiting Automatic Evaluation of Extractive Summarization Task: Can We Do Better than ROUGE?Findings47 citations
- The Dangers of Underclaiming: Reasons for Caution When Reporting How NLP Systems FailLong47 citations
- A Simple Hash-Based Early Exiting Approach For Language Understanding and GenerationFindings46 citations
- An Embarrassingly Simple Method to Mitigate Undesirable Properties of Pretrained Language Model TokenizersShort46 citations
- IMPLI: Investigating NLI Models’ Performance on Figurative LanguageLong46 citations
- Label Semantic Aware Pre-training for Few-shot Text ClassificationLong46 citations
- MERIt: Meta-Path Guided Contrastive Learning for Logical ReasoningFindings46 citations
- Multilingual Knowledge Graph Completion with Self-Supervised Adaptive Graph AlignmentLong46 citations
- Open Domain Question Answering with A Unified Knowledge InterfaceLong46 citations
- When did you become so smart, oh wise one?! Sarcasm Explanation in Multi-modal Multi-party DialoguesLong46 citations
- An Analysis of Negation in Natural Language Understanding CorporaShort45 citations
- Ethics Sheets for AI TasksLong45 citations
- Modular and Parameter-Efficient Multimodal Fusion with PromptingFindings45 citations
- A Variational Hierarchical Model for Neural Cross-Lingual SummarizationLong44 citations
- Coloring the Blank Slate: Pre-training Imparts a Hierarchical Inductive Bias to Sequence-to-sequence ModelsFindings44 citations
- HiCLRE: A Hierarchical Contrastive Learning Framework for Distantly Supervised Relation ExtractionFindings44 citations
- Learning Disentangled Textual Representations via Statistical Measures of SimilarityLong44 citations
- Misinfo Reaction Frames: Reasoning about Readers’ Reactions to News HeadlinesLong44 citations
- SaFeRDialogues: Taking Feedback Gracefully after Conversational Safety FailuresLong44 citations
- The Grammar-Learning Trajectories of Neural Language ModelsLong44 citations
- Coherence boosting: When your pretrained language model is not paying enough attentionLong43 citations
- Combining Feature and Instance Attribution to Detect ArtifactsFindings43 citations
- Discriminative Marginalized Probabilistic Neural Method for Multi-Document Summarization of Medical LiteratureLong43 citations
- Few-Shot Class-Incremental Learning for Named Entity RecognitionLong43 citations
- Kronecker Decomposition for GPT CompressionShort43 citations
- Overcoming Catastrophic Forgetting beyond Continual Learning: Balanced Training for Neural Machine TranslationLong43 citations
- Transkimmer: Transformer Learns to Layer-wise SkimLong43 citations
- VALUE: Understanding Dialect Disparity in NLULong43 citations
- Exploring the Impact of Negative Samples of Contrastive Learning: A Case Study of Sentence EmbeddingFindings42 citations
- GL-CLeF: A Global–Local Contrastive Learning Framework for Cross-lingual Spoken Language UnderstandingLong42 citations
- MMCoQA: Conversational Question Answering over Text, Tables, and ImagesLong42 citations
- Measuring and Mitigating Name Biases in Neural Machine TranslationLong42 citations
- Multilingual Molecular Representation Learning via Contrastive Pre-trainingLong42 citations
- Neural Machine Translation with Phrase-Level Universal Visual RepresentationsLong42 citations
- PLANET: Dynamic Content Planning in Autoregressive Transformers for Long-form Text GenerationLong42 citations
- A Feasibility Study of Answer-Agnostic Question Generation for EducationFindings41 citations
- Analyzing Dynamic Adversarial Training Data in the LimitFindings41 citations
- Disentangled Sequence to Sequence Learning for Compositional GeneralizationLong41 citations
- Diversifying Content Generation for Commonsense Reasoning with Mixture of Knowledge Graph ExpertsFindings41 citations
- Efficient Cluster-Based k-Nearest-Neighbor Machine TranslationLong41 citations
- End-to-End Modeling via Information Tree for One-Shot Natural Language Spatial Video GroundingLong41 citations
- Few-Shot Learning with Siamese Networks and Label TuningLong41 citations
- Generating Scientific Definitions with Controllable ComplexityLong41 citations
- GlobalWoZ: Globalizing MultiWoZ to Develop Multilingual Task-Oriented Dialogue SystemsLong41 citations
- Image Retrieval from Contextual DescriptionsLong41 citations
- MReD: A Meta-Review Dataset for Structure-Controllable Text GenerationFindings41 citations
- Training Text-to-Text Transformers with Privacy GuaranteesFindings41 citations
- Do Transformer Models Show Similar Attention Patterns to Task-Specific Human Gaze?Long40 citations
- MDCSpell: A Multi-task Detector-Corrector Framework for Chinese Spelling CorrectionFindings40 citations
- Multi-Granularity Semantic Aware Graph Model for Reducing Position Bias in Emotion Cause Pair ExtractionFindings40 citations
- On the Importance of Effectively Adapting Pretrained Language Models for Active LearningShort40 citations
- Question Generation for Reading Comprehension Assessment by Modeling How and What to AskFindings40 citations
- The Power of Prompt Tuning for Low-Resource Semantic ParsingShort40 citations
- Towards Learning (Dis)-Similarity of Source Code from Program ContrastsLong40 citations
- e-CARE: a New Dataset for Exploring Explainable Causal ReasoningLong40 citations
- A Neural Pairwise Ranking Model for Readability AssessmentFindings39 citations
- A Rationale-Centric Framework for Human-in-the-loop Machine LearningLong39 citations
- A Statutory Article Retrieval Dataset in FrenchLong39 citations
- CRASpell: A Contextual Typo Robust Approach to Improve Chinese Spelling CorrectionFindings39 citations
- Can Prompt Probe Pretrained Language Models? Understanding the Invisible Risks from a Causal ViewLong39 citations
- FaiRR: Faithful and Robust Deductive Reasoning over Natural LanguageLong39 citations
- Pre-training to Match for Unified Low-shot Relation ExtractionLong39 citations
- Quantified Reproducibility Assessment of NLP ResultsLong39 citations
- SalesBot: Transitioning from Chit-Chat to Task-Oriented DialoguesLong39 citations
- Dynamic Global Memory for Document-level Argument ExtractionLong38 citations
- Enhancing Cross-lingual Natural Language Inference by Prompt-learning from Cross-lingual TemplatesLong38 citations
- Language-Agnostic Meta-Learning for Low-Resource Text-to-Speech with Articulatory FeaturesLong38 citations
- MTRec: Multi-Task Learning over BERT for News RecommendationFindings38 citations
- Neural reality of argument structure constructionsLong38 citations
- Perturbations in the Wild: Leveraging Human-Written Text Perturbations for Realistic Adversarial Attack and DefenseFindings38 citations
- Square One Bias in NLP: Towards a Multi-Dimensional Exploration of the Research ManifoldFindings38 citations
- Training Dynamics for Text Summarization ModelsFindings38 citations
- AlephBERT: Language Model Pre-training and Evaluation from Sub-Word to Sentence LevelLong37 citations
- ConditionalQA: A Complex Reading Comprehension Dataset with Conditional AnswersLong37 citations
- DEAM: Dialogue Coherence Evaluation using AMR-based Semantic ManipulationsLong37 citations
- Divide and Conquer: Text Semantic Matching with Disentangled Keywords and IntentsFindings37 citations
- Hierarchical Sketch Induction for Paraphrase GenerationLong37 citations
- Identifying Moments of Change from Longitudinal User TextLong37 citations
- Improving Personalized Explanation Generation through VisualizationLong37 citations
- Length Control in Abstractive Summarization by Pretraining Information SelectionLong37 citations
- Pretraining with Artificial Language: Studying Transferable Knowledge in Language ModelsLong37 citations
- Primum Non Nocere: Before working with Indigenous data, the ACL must confront ongoing colonialismShort37 citations
- Prompt-Driven Neural Machine TranslationFindings37 citations
- RoCBert: Robust Chinese Bert with Multimodal Contrastive PretrainingLong37 citations
- SciNLI: A Corpus for Natural Language Inference on Scientific TextLong37 citations
- The Moral Debater: A Study on the Computational Generation of Morally Framed ArgumentsLong37 citations
- An Isotropy Analysis in the Multilingual BERT Embedding SpaceFindings36 citations
- DiBiMT: A Novel Benchmark for Measuring Word Sense Disambiguation Biases in Machine TranslationLong36 citations
- HeterMPC: A Heterogeneous Graph Neural Network for Response Generation in Multi-Party ConversationsLong36 citations
- Improving Word Translation via Two-Stage Contrastive LearningLong36 citations
- Interpretability for Language Learners Using Example-Based Grammatical Error CorrectionLong36 citations
- Neural Pipeline for Zero-Shot Data-to-Text GenerationLong36 citations
- Visual-Language Navigation Pretraining via Prompt-based Environmental Self-explorationLong36 citations
- latent-GLAT: Glancing at Latent Variables for Parallel Text GenerationLong36 citations
- Alignment-Augmented Consistent Translation for Multilingual Open Information ExtractionLong35 citations
- Assessing Multilingual Fairness in Pre-trained Multimodal RepresentationsFindings35 citations
- Distantly Supervised Named Entity Recognition via Confidence-Based Multi-Class Positive and Unlabeled LearningLong35 citations
- E-KAR: A Benchmark for Rationalizing Natural Language Analogical ReasoningFindings35 citations
- FORTAP: Using Formulas for Numerical-Reasoning-Aware Table PretrainingLong35 citations
- FewNLU: Benchmarking State-of-the-Art Methods for Few-Shot Natural Language UnderstandingLong35 citations
- Flooding-X: Improving BERT’s Resistance to Adversarial Attacks via Loss-Restricted Fine-TuningLong35 citations
- Generalized but not Robust? Comparing the Effects of Data Modification Methods on Out-of-Domain Generalization and Adversarial RobustnessFindings35 citations
- HIE-SQL: History Information Enhanced Network for Context-Dependent Text-to-SQL Semantic ParsingFindings35 citations
- HLDC: Hindi Legal Documents CorpusFindings35 citations
- How can NLP Help Revitalize Endangered Languages? A Case Study and Roadmap for the Cherokee LanguageLong35 citations
- Knowledge Enhanced Reflection Generation for Counseling DialoguesLong35 citations
- Learn and Review: Enhancing Continual Named Entity Recognition via Reviewing Synthetic SamplesFindings35 citations
- Leveraging Similar Users for Personalized Language Modeling with Limited DataLong35 citations
- On the Sensitivity and Stability of Model Interpretations in NLPLong35 citations
- Rare Tokens Degenerate All Tokens: Improving Neural Text Generation via Adaptive Gradient Gating for Rare Token EmbeddingsLong35 citations
- Redistributing Low-Frequency Words: Making the Most of Monolingual Data in Non-Autoregressive TranslationLong35 citations
- Requirements and Motivations of Low-Resource Speech Synthesis for Language RevitalizationLong35 citations
- Towards Robustness of Text-to-SQL Models Against Natural and Realistic Adversarial Table PerturbationLong35 citations
- “That Is a Suspicious Reaction!”: Interpreting Logits Variation to Detect NLP Adversarial AttacksLong35 citations
- A Well-Composed Text is Half Done! Composition Sampling for Diverse Conditional GenerationLong34 citations
- AdapLeR: Speeding up Inference by Adaptive Length ReductionLong34 citations
- CQG: A Simple and Effective Controlled Generation Framework for Multi-hop Question GenerationLong34 citations
- Does Recommend-Revise Produce Reliable Annotations? An Analysis on Missing Instances in DocREDLong34 citations
- FaVIQ: FAct Verification from Information-seeking QuestionsLong34 citations
- Improving the Adversarial Robustness of NLP Models by Information BottleneckFindings34 citations
- Nibbling at the Hard Core of Word Sense DisambiguationLong34 citations
- Saliency as Evidence: Event Detection with Trigger Saliency AttributionLong34 citations
- Spurious Correlations in Reference-Free Evaluation of Text GenerationLong34 citations
- Universal Conditional Masked Language Pre-training for Neural Machine TranslationLong34 citations
- Why don’t people use character-level machine translation?Findings34 citations
- ConTinTin: Continual Learning from Task InstructionsLong33 citations
- Learning to Generalize to More: Continuous Semantic Augmentation for Neural Machine TranslationLong33 citations
- MINER: Improving Out-of-Vocabulary Named Entity Recognition from an Information Theoretic PerspectiveLong33 citations
- Modality-specific Learning Rates for Effective Multimodal Additive Late-fusionFindings33 citations
- Not always about you: Prioritizing community needs when developing endangered language technologyLong33 citations
- On the Calibration of Pre-trained Language Models using Mixup Guided by Area Under the Margin and SaliencyLong33 citations
- Pre-Trained Multilingual Sequence-to-Sequence Models: A Hope for Low-Resource Language Translation?Findings33 citations
- Prompt Tuning for Discriminative Pre-trained Language ModelsFindings33 citations
- QAConv: Question Answering on Informative ConversationsLong33 citations
- Revisiting the Compositional Generalization Abilities of Neural Sequence ModelsShort33 citations
- Show Me More Details: Discovering Hierarchies of Procedures from Semi-structured Web DataLong33 citations
- Sparse Progressive Distillation: Resolving Overfitting under Pretrain-and-Finetune ParadigmLong33 citations
- Unsupervised Extractive Opinion Summarization Using Sparse CodingLong33 citations
- When classifying grammatical role, BERT doesn’t care about word order... except when it mattersShort33 citations
- Your Answer is Incorrect... Would you like to know why? Introducing a Bilingual Short Answer Feedback DatasetLong33 citations
- Adapting Coreference Resolution Models through Active LearningLong32 citations
- Clickbait Spoiling via Question Answering and Passage RetrievalLong32 citations
- Distributed NLI: Learning to Predict Human Opinion Distributions for Language ReasoningFindings32 citations
- Investigating Failures of Automatic Translationin the Case of Unambiguous GenderLong32 citations
- Sample, Translate, Recombine: Leveraging Audio Alignments for Data Augmentation in End-to-end Speech TranslationShort32 citations
- When to Use Multi-Task Learning vs Intermediate Fine-Tuning for Pre-Trained Encoder Transfer LearningShort32 citations
- AdaLoGN: Adaptive Logic Graph Network for Reasoning-Based Machine Reading ComprehensionLong31 citations
- CTRLEval: An Unsupervised Reference-Free Metric for Evaluating Controlled Text GenerationLong31 citations
- Event-Event Relation Extraction using Probabilistic Box EmbeddingShort31 citations
- Factual Consistency of Multilingual Pretrained Language ModelsFindings31 citations
- ODE Transformer: An Ordinary Differential Equation-Inspired Model for Sequence GenerationLong31 citations
- SRL4E – Semantic Role Labeling for Emotions: A Unified Evaluation FrameworkLong31 citations
- There Are a Thousand Hamlets in a Thousand People’s Eyes: Enhancing Knowledge-grounded Dialogue with Personal MemoryLong31 citations
- Towards Large-Scale Interpretable Knowledge Graph Reasoning for Dialogue SystemsFindings31 citations
- Analyzing Generalization of Vision and Language Navigation to Unseen Outdoor AreasLong30 citations
- CRAFT: A Benchmark for Causal Reasoning About Forces and inTeractionsFindings30 citations
- Canary Extraction in Natural Language Understanding ModelsShort30 citations
- End-to-End Segmentation-based News SummarizationFindings30 citations
- GPT-D: Inducing Dementia-related Linguistic Anomalies by Deliberate Degradation of Artificial Neural Language ModelsLong30 citations
- Improving Event Representation via Simultaneous Weakly Supervised Contrastive Learning and ClusteringLong30 citations
- Improving Relation Extraction through Syntax-induced Pre-training with Dependency MaskingFindings30 citations
- IsoScore: Measuring the Uniformity of Embedding Space UtilizationFindings30 citations
- Modeling Hierarchical Syntax Structure with Triplet Position for Source Code SummarizationLong30 citations
- Mukayese: Turkish NLP Strikes BackFindings30 citations
- Other Roles Matter! Enhancing Role-Oriented Dialogue Summarization via Role InteractionsLong30 citations
- Probing for Predicate Argument Structures in Pretrained Language ModelsLong30 citations
- ProtoTEx: Explaining Model Decisions with Prototype TensorsLong30 citations
- Retrieval-guided Counterfactual Generation for QALong30 citations
- Simple and Effective Knowledge-Driven Query Expansion for QA-Based Product Attribute ExtractionShort30 citations
- Towards Making the Most of Cross-Lingual Transfer for Zero-Shot Neural Machine TranslationLong30 citations
- Under the Morphosyntactic Lens: A Multifaceted Evaluation of Gender Bias in Speech TranslationLong30 citations
- Cross-domain Named Entity Recognition via Graph MatchingFindings29 citations
- EntSUM: A Data Set for Entity-Centric Extractive SummarizationLong29 citations
- IAM: A Comprehensive and Large-Scale Dataset for Integrated Argument Mining TasksLong29 citations
- Improved Multi-label Classification under Temporal Concept Drift: Rethinking Group-Robust Algorithms in a Label-Wise SettingFindings29 citations
- Improving Meta-learning for Low-resource Text Classification and Generation via Memory ImitationLong29 citations
- Just Rank: Rethinking Evaluation with Word and Sentence SimilaritiesLong29 citations
- Learning to Imagine: Integrating Counterfactual Thinking in Neural Discrete ReasoningLong29 citations
- NEWTS: A Corpus for News Topic-Focused SummarizationFindings29 citations
- PriMock57: A Dataset Of Primary Care Mock ConsultationsShort29 citations
- Sentiment Word Aware Multimodal Refinement for Multimodal Sentiment Analysis with ASR ErrorsFindings29 citations
- Text Smoothing: Enhance Various Data Augmentation Methods on Text Classification TasksShort29 citations
- UniTranSeR: A Unified Transformer Semantic Representation Framework for Multimodal Task-Oriented Dialog SystemLong29 citations
- Why Exposure Bias Matters: An Imitation Learning Perspective of Error Accumulation in Language GenerationFindings29 citations
- DARER: Dual-task Temporal Relational Recurrent Reasoning Network for Joint Dialog Sentiment Classification and Act RecognitionFindings28 citations
- End-to-End Speech Translation for Code Switched SpeechFindings28 citations
- Guided Attention Multimodal Multitask Financial Forecasting with Inter-Company Relationships and Global and Local NewsLong28 citations
- Hyperlink-induced Pre-training for Passage Retrieval in Open-domain Question AnsweringLong28 citations
- Modeling Multi-hop Question Answering as Single Sequence PredictionLong28 citations
- SCD: Self-Contrastive Decorrelation of Sentence EmbeddingsShort28 citations
- Sense Embeddings are also Biased – Evaluating Social Biases in Static and Contextualised Sense EmbeddingsLong28 citations
- The Trade-offs of Domain Adaptation for Neural Language ModelsLong28 citations
- Using Interactive Feedback to Improve the Accuracy and Explainability of Question Answering Systems Post-DeploymentFindings28 citations
- Virtual Augmentation Supported Contrastive Learning of Sentence RepresentationsFindings28 citations
- Zero-Shot Cross-lingual Semantic ParsingLong28 citations
- ASSIST: Towards Label Noise-Robust Dialogue State TrackingFindings27 citations
- An Unsupervised Multiple-Task and Multiple-Teacher Model for Cross-lingual Named Entity RecognitionLong27 citations
- Are Prompt-based Models Clueless?Long27 citations
- BiTIIMT: A Bilingual Text-infilling Method for Interactive Machine TranslationLong27 citations
- C3KG: A Chinese Commonsense Conversation Knowledge GraphFindings27 citations
- Cluster & Tune: Boost Cold Start Performance in Text ClassificationLong27 citations
- Continual Pre-training of Language Models for Math Problem Understanding with Syntax-Aware Memory NetworkLong27 citations
- Improving Compositional Generalization with Self-Training for Data-to-Text GenerationLong27 citations
- Learning Disentangled Semantic Representations for Zero-Shot Cross-Lingual Transfer in Multilingual Machine Reading ComprehensionLong27 citations
- MetaWeighting: Learning to Weight Tasks in Multi-Task LearningFindings27 citations
- Multimodal Sarcasm Target Identification in TweetsLong27 citations
- PARE: A Simple and Strong Baseline for Monolingual and Multilingual Distantly Supervised Relation ExtractionShort27 citations
- Probing as Quantifying Inductive BiasLong27 citations
- Sentence-level Privacy for Document EmbeddingsLong27 citations
- Slangvolution: A Causal Analysis of Semantic Change and Frequency Dynamics in SlangLong27 citations
- An Effective and Efficient Entity Alignment Decoding Algorithm via Third-Order Tensor IsomorphismLong26 citations
- An Imitation Learning Curriculum for Text Editing with Non-Autoregressive ModelsLong26 citations
- Can a Transformer Pass the Wug Test? Tuning Copying Bias in Neural Morphological Inflection ModelsShort26 citations
- Few-shot Controllable Style Transfer for Low-Resource Multilingual SettingsLong26 citations
- First the Worst: Finding Better Gender Translations During Beam SearchFindings26 citations
- How does the pre-training objective affect what large language models learn about linguistic properties?Short26 citations
- HybriDialogue: An Information-Seeking Dialogue Dataset Grounded on Tabular and Textual DataFindings26 citations
- Learning When to Translate for Streaming SpeechLong26 citations
- On Continual Model Refinement in Out-of-Distribution Data StreamsLong26 citations
- Prior Knowledge and Memory Enriched Transformer for Sign Language TranslationFindings26 citations
- RST Discourse Parsing with Second-Stage EDU-Level Pre-trainingLong26 citations
- Sentence-aware Contrastive Learning for Open-Domain Passage RetrievalLong26 citations
- SkipBERT: Efficient Inference with Shallow Layer SkippingLong26 citations
- Towards Collaborative Neural-Symbolic Graph Semantic Parsing via UncertaintyFindings26 citations
- Two Birds with One Stone: Unified Model Learning for Both Recall and Ranking in News RecommendationFindings26 citations
- UNIMO-2: End-to-End Unified Vision-Language Grounded LearningFindings26 citations
- What to Learn, and How: Toward Effective Learning from RationalesFindings26 citations
- AMR-DA: Data Augmentation by Abstract Meaning RepresentationFindings25 citations
- BPE vs. Morphological Segmentation: A Case Study on Machine Translation of Four Polysynthetic LanguagesFindings25 citations
- Bridging the Data Gap between Training and Inference for Unsupervised Neural Machine TranslationLong25 citations
- Can Explanations Be Useful for Calibrating Black Box Models?Long25 citations
- CipherDAug: Ciphertext based Data Augmentation for Neural Machine TranslationLong25 citations
- Comparative Opinion Summarization via Collaborative DecodingFindings25 citations
- DEEP: DEnoising Entity Pre-training for Neural Machine TranslationLong25 citations
- Fully-Semantic Parsing and Generation: the BabelNet Meaning RepresentationLong25 citations
- GCPG: A General Framework for Controllable Paraphrase GenerationFindings25 citations
- Impact of Evaluation Methodologies on Code SummarizationLong25 citations
- Improving Generalizability in Implicitly Abusive Language Detection with Concept Activation VectorsLong25 citations
- Improving Zero-Shot Cross-lingual Transfer Between Closely Related Languages by Injecting Character-Level NoiseFindings25 citations
- Learning Confidence for Transformer-based Neural Machine TranslationLong25 citations
- Learning Non-Autoregressive Models from Search for Unsupervised Sentence SummarizationLong25 citations
- LexSubCon: Integrating Knowledge from Lexical Resources into Contextual Embeddings for Lexical SubstitutionLong25 citations
- Modeling Persuasive Discourse to Adaptively Support Students’ Argumentative WritingLong25 citations
- Morphosyntactic Tagging with Pre-trained Language Models for Arabic and its DialectsFindings25 citations
- On the probability–quality paradox in language generationShort25 citations
- Question Answering Infused Pre-training of General-Purpose Contextualized RepresentationsFindings25 citations
- Robust Lottery Tickets for Pre-trained Language ModelsLong25 citations
- Structural Characterization for Dialogue DisentanglementLong25 citations
- The impact of lexical and grammatical processing on generating code from natural languageFindings25 citations
- Toward Interpretable Semantic Textual Similarity via Optimal Transport-based Contrastive Sentence LearningLong25 citations
- Using Context-to-Vector with Graph Retrofitting to Improve Word EmbeddingsLong25 citations
- Zero-shot Learning for Grapheme to Phoneme Conversion with Language EnsembleFindings25 citations
- A Taxonomy of Empathetic Questions in Social DialogsLong24 citations
- As Little as Possible, as Much as Necessary: Detecting Over- and Undertranslations with Contrastive ConditioningShort24 citations
- Contextual Representation Learning beyond Masked Language ModelingLong24 citations
- Dataset Geography: Mapping Language Data to Language UsersLong24 citations
- Decoding Part-of-Speech from Human EEG SignalsLong24 citations
- Imputing Out-of-Vocabulary Embeddings with LOVE Makes LanguageModels Robust with Little CostLong24 citations
- SHIELD: Defending Textual Neural Networks against Multiple Black-Box Adversarial Attacks with Stochastic Multi-Expert PatcherLong24 citations
- Semantically Distributed Robust Optimization for Vision-and-Language InferenceFindings24 citations
- The patient is more dead than alive: exploring the current state of the multi-document summarisation of the biomedical literatureLong24 citations
- Towards Unifying the Label Space for Aspect- and Sentence-based Sentiment AnalysisFindings24 citations
- Type-Driven Multi-Turn Corrections for Grammatical Error CorrectionFindings24 citations
- Beyond the Granularity: Multi-Perspective Dialogue Collaborative Selection for Dialogue State TrackingLong23 citations
- Can Unsupervised Knowledge Transfer from Social Discussions Help Argument Mining?Long23 citations
- Context Matters: A Pragmatic Study of PLMs’ Negation UnderstandingLong23 citations
- Disentangled Knowledge Transfer for OOD Intent Discovery with Unified Contrastive LearningShort23 citations
- Ditch the Gold Standard: Re-evaluating Conversational Question AnsweringLong23 citations
- Good Night at 4 pm?! Time Expressions in Different CulturesFindings23 citations
- Listening to Affected Communities to Define Extreme Speech: Dataset and ExperimentsFindings23 citations
- MSCTD: A Multimodal Sentiment Chat Translation DatasetLong23 citations
- Modeling Dual Read/Write Paths for Simultaneous Machine TranslationLong23 citations
- Overlap-based Vocabulary Generation Improves Cross-lingual Transfer Among Related LanguagesLong23 citations
- Understanding Multimodal Procedural Knowledge by Sequencing Multimodal Instructional ManualsLong23 citations
- “Is Whole Word Masking Always Better for Chinese BERT?”: Probing on Chinese Grammatical Error CorrectionFindings23 citations
- (Un)solving Morphological Inflection: Lemma Overlap Artificially Inflates Models’ PerformanceShort22 citations
- AbductionRules: Training Transformers to Explain Unexpected InputsFindings22 citations
- Attention Temperature Matters in Abstractive Summarization DistillationLong22 citations
- Co-VQA : Answering by Interactive Sub Question SequenceFindings22 citations
- From the Detection of Toxic Spans in Online Discussions to the Analysis of Toxic-to-Civil TransferLong22 citations
- How Do Seq2Seq Models Perform on End-to-End Data-to-Text Generation?Long22 citations
- Human Language ModelingFindings22 citations
- Learn to Adapt for Generalized Zero-Shot Text ClassificationLong22 citations
- Multi Task Learning For Zero Shot Performance Prediction of Multilingual ModelsLong22 citations
- Multitasking Framework for Unsupervised Simple Definition GenerationLong22 citations
- Perceiving the World: Question-guided Reinforcement Learning for Text-based GamesLong22 citations
- Plug-and-Play Adaptation for Continuously-updated QAFindings22 citations
- Word2Box: Capturing Set-Theoretic Semantics of Words using Box EmbeddingsLong22 citations
- A Multi-Document Coverage Reward for RELAXed Multi-Document SummarizationLong21 citations
- A Sentence is Worth 128 Pseudo Tokens: A Semantic-Aware Contrastive Learning Framework for Sentence EmbeddingsFindings21 citations
- ABC: Attention with Bounded-memory ControlLong21 citations
- An Empirical Study on Explanations in Out-of-Domain SettingsLong21 citations
- Answer Uncertainty and Unanswerability in Multiple-Choice Machine Reading ComprehensionFindings21 citations
- Automated Crossword SolvingLong21 citations
- Automatic Identification and Classification of Bragging in Social MediaLong21 citations
- CogTaskonomy: Cognitively Inspired Task Taxonomy Is Beneficial to Transfer Learning in NLPLong21 citations
- DS-TOD: Efficient Domain Specialization for Task-Oriented DialogFindings21 citations
- Dependency Parsing as MRC-based Span-Span PredictionLong21 citations
- Does BERT really agree ? Fine-grained Analysis of Lexical Dependence on a Syntactic TaskFindings21 citations
- FrugalScore: Learning Cheaper, Lighter and Faster Evaluation Metrics for Automatic Text GenerationLong21 citations
- Interpreting the Robustness of Neural NLP Models to Textual PerturbationsFindings21 citations
- Learned Incremental Representations for ParsingLong21 citations
- Learning Disentangled Representations of Negation and UncertaintyLong21 citations
- Leveraging Knowledge in Multilingual Commonsense ReasoningFindings21 citations
- Logic Traps in Evaluating Attribution ScoresLong21 citations
- Open Vocabulary Extreme Classification Using Generative ModelsFindings21 citations
- Pyramid-BERT: Reducing Complexity via Successive Core-set based Token SelectionLong21 citations
- Softmax Bottleneck Makes Language Models Unable to Represent Multi-mode Word DistributionsLong21 citations
- WatClaimCheck: A new Dataset for Claim Entailment and InferenceLong21 citations
- What is wrong with you?: Leveraging User Sentiment for Automatic Dialog EvaluationFindings21 citations
- WikiDiverse: A Multimodal Entity Linking Dataset with Diversified Contextual Topics and Entity TypesLong21 citations
- A Risk-Averse Mechanism for Suicidality Assessment on Social MediaShort20 citations
- Divide and Rule: Effective Pre-Training for Context-Aware Multi-Encoder Translation ModelsLong20 citations
- Do self-supervised speech models develop human-like perception biases?Long20 citations
- Fair and Argumentative Language Modeling for Computational ArgumentationLong20 citations
- Few-Shot Tabular Data Enrichment Using Fine-Tuned Transformer ArchitecturesLong20 citations
- ILDAE: Instance-Level Difficulty Analysis of Evaluation DataLong20 citations
- Improving Candidate Retrieval with Entity Profile Generation for Wikidata Entity LinkingFindings20 citations
- Inverse is Better! Fast and Accurate Prompt for Few-shot Slot TaggingFindings20 citations
- Learning Adaptive Segmentation Policy for End-to-End Simultaneous TranslationLong20 citations
- Local Structure Matters Most: Perturbation Study in NLUFindings20 citations
- MIMICause: Representation and automatic extraction of causal relation types from clinical notesFindings20 citations
- On the Importance of Data Size in Probing Fine-tuned ModelsFindings20 citations
- Predicting Difficulty and Discrimination of Natural Language QuestionsShort20 citations
- Richer Countries and Richer RepresentationsFindings20 citations
- Sequence-to-sequence AMR Parsing with Ancestor InformationShort20 citations
- A Novel Framework Based on Medical Concept Driven Attention for Explainable Medical Code Prediction via External KnowledgeFindings19 citations
- Adjusting the Precision-Recall Trade-Off with Align-and-Predict Decoding for Grammatical Error CorrectionShort19 citations
- An Accurate Unsupervised Method for Joint Entity Alignment and Dangling Entity DetectionFindings19 citations
- An Empirical Study of Memorization in NLPLong19 citations
- Answer-level Calibration for Free-form Multiple Choice Question AnsweringLong19 citations
- Bias Mitigation in Machine Translation Quality EstimationLong19 citations
- CoCoLM: Complex Commonsense Enhanced Language Model with Discourse RelationsFindings19 citations
- Confidence Based Bidirectional Global Context Aware Training Framework for Neural Machine TranslationLong19 citations
- DiS-ReX: A Multilingual Dataset for Distantly Supervised Relation ExtractionShort19 citations
- Gaussian Multi-head Attention for Simultaneous Machine TranslationFindings19 citations
- Graph Refinement for Coreference ResolutionFindings19 citations
- Have my arguments been replied to? Argument Pair Extraction as Machine Reading ComprehensionShort19 citations
- Hierarchical Curriculum Learning for AMR ParsingShort19 citations
- Match the Script, Adapt if Multilingual: Analyzing the Effect of Multilingual Pretraining on Cross-lingual TransferabilityLong19 citations
- OCR Improves Machine Translation for Low-Resource LanguagesFindings19 citations
- One Agent To Rule Them All: Towards Multi-agent Conversational AIFindings19 citations
- Predicate-Argument Based Bi-Encoder for Paraphrase IdentificationLong19 citations
- Probing Simile Knowledge from Pre-trained Language ModelsLong19 citations
- Rethinking Negative Sampling for Handling Missing Entity AnnotationsLong19 citations
- Rethinking and Refining the Distinct MetricShort19 citations
- A Natural Diet: Towards Improving Naturalness of Machine Translation OutputFindings18 citations
- Accelerating Code Search with Deep Hashing and Code ClassificationLong18 citations
- Attention as Grounding: Exploring Textual and Cross-Modal Attention on Entities and Relations in Language-and-Vision TransformerFindings18 citations
- Better Language Model with Hypernym Class PredictionLong18 citations
- ClusterFormer: Neural Clustering Attention for Efficient and Effective TransformerLong18 citations
- Comprehensive Multi-Modal Interactions for Referring Image SegmentationFindings18 citations
- Controllable Dictionary Example Generation: Generating Example Sentences for Specific Targeted AudiencesLong18 citations
- Deep Inductive Logic Reasoning for Multi-Hop Reading ComprehensionLong18 citations
- Deep Reinforcement Learning for Entity AlignmentFindings18 citations
- Efficient Unsupervised Sentence Compression by Fine-tuning Transformers with Reinforcement LearningLong18 citations
- Encoding and Fusing Semantic Connection and Linguistic Evidence for Implicit Discourse Relation RecognitionFindings18 citations
- Learning Bias-reduced Word Embeddings Using Dictionary DefinitionsFindings18 citations
- Learning to Robustly Aggregate Labeling Functions for Semi-supervised Data ProgrammingFindings18 citations
- Read Top News First: A Document Reordering Approach for Multi-Document News SummarizationFindings18 citations
- Reducing Position Bias in Simultaneous Machine Translation with Length-Aware FrameworkLong18 citations
- Rewire-then-Probe: A Contrastive Recipe for Probing Biomedical Knowledge of Pre-trained Language ModelsLong18 citations
- Table-based Fact Verification with Self-adaptive Mixture of ExpertsFindings18 citations
- The Change that Matters in Discourse Parsing: Estimating the Impact of Domain Shift on Parser ErrorFindings18 citations
- To be or not to be an Integer? Encoding Variables for Mathematical TextFindings18 citations
- Toward Annotator Group Bias in CrowdsourcingLong18 citations
- What does it take to bake a cake? The RecipeRef corpus and anaphora resolution in procedural textFindings18 citations
- A Graph Enhanced BERT Model for Event PredictionFindings17 citations
- BenchIE: A Framework for Multi-Faceted Fact-Based Open Information Extraction EvaluationLong17 citations
- Breaking Down Multilingual Machine TranslationFindings17 citations
- Bridging the Generalization Gap in Text-to-SQL Parsing with Schema ExpansionLong17 citations
- CARETS: A Consistency And Robustness Evaluative Test Suite for VQALong17 citations
- Challenges to Open-Domain Constituency ParsingFindings17 citations
- Conditional Bilingual Mutual Information Based Adaptive Training for Neural Machine TranslationLong17 citations
- Document-Level Event Argument Extraction via Optimal TransportFindings17 citations
- DuReadervis: A Chinese Dataset for Open-domain Document Visual Question AnsweringFindings17 citations
- Entailment Graph Learning with Textual Entailment and Soft TransitivityLong17 citations
- FIBER: Fill-in-the-Blanks as a Challenging Video Understanding Evaluation FrameworkLong17 citations
- How Do We Answer Complex Questions: Discourse Structure of Long-form AnswersLong17 citations
- Lacking the Embedding of a Word? Look it up into a Traditional DictionaryFindings17 citations
- Learning the Beauty in Songs: Neural Singing Voice BeautifierLong17 citations
- MILIE: Modular & Iterative Multilingual Open Information ExtractionLong17 citations
- Meta-Learning for Fast Cross-Lingual Adaptation in Dependency ParsingLong17 citations
- Multi-Party Empathetic Dialogue Generation: A New Task for Dialog SystemsLong17 citations
- Multilingual Mix: Example Interpolation Improves Multilingual Neural Machine TranslationLong17 citations
- Multilingual Pre-training with Language and Task Adaptation for Multilingual Text Style TransferShort17 citations
- Multimodal fusion via cortical network inspired lossesLong17 citations
- QuoteR: A Benchmark of Quote Recommendation for WritingLong17 citations
- Synthetic Question Value Estimation for Domain Adaptation of Question AnsweringLong17 citations
- Towards Better Characterization of ParaphrasesLong17 citations
- Translate-Train Embracing Translationese ArtifactsShort17 citations
- Unsupervised Natural Language Inference Using PHL Triplet GenerationFindings17 citations
- WLASL-LEX: a Dataset for Recognising Phonological Properties in American Sign LanguageShort17 citations
- [CASPI] Causal-aware Safe Policy Improvement for Task-oriented DialogueLong17 citations
- Automatic Song Translation for Tonal LanguagesFindings16 citations
- Buy Tesla, Sell Ford: Assessing Implicit Stock Market Preference in Pre-trained Language ModelsShort16 citations
- Cross-Lingual Contrastive Learning for Fine-Grained Entity Typing for Low-Resource LanguagesLong16 citations
- CrossAligner & Co: Zero-Shot Transfer Methods for Task-Oriented Cross-lingual Natural Language UnderstandingFindings16 citations
- Does BERT Know that the IS-A Relation Is Transitive?Short16 citations
- GRS: Combining Generation and Revision in Unsupervised Sentence SimplificationFindings16 citations
- How reparametrization trick broke differentially-private text representation learningShort16 citations
- Modeling Intensification for Sign Language Generation: A Computational ApproachFindings16 citations
- Morphological Processing of Low-Resource Languages: Where We Are and What’s NextFindings16 citations
- Non-neural Models Matter: a Re-evaluation of Neural Referring Expression Generation SystemsLong16 citations
- Probing BERT’s priors with serial reproduction chainsFindings16 citations
- Rethinking Self-Supervision Objectives for Generalizable Coherence ModelingLong16 citations
- Semi-Supervised Formality Style Transfer with Consistency TrainingLong16 citations
- Toward More Meaningful Resources for Lower-resourced LanguagesFindings16 citations
- Translation Error Detection as Rationale ExtractionFindings16 citations
- Unsupervised multiple-choice question generation for out-of-domain Q&A fine-tuningShort16 citations
- VISITRON: Visual Semantics-Aligned Interactively Trained Object-NavigatorFindings16 citations
- What Makes Reading Comprehension Questions Difficult?Long16 citations
- Can Pre-trained Language Models Interpret Similes as Smart as Human?Long15 citations
- Contextual Fine-to-Coarse Distillation for Coarse-grained Response Selection in Open-Domain ConversationsLong15 citations
- Differentiable Multi-Agent Actor-Critic for Multi-Step Radiology Report SummarizationLong15 citations
- ED2LM: Encoder-Decoder to Language Model for Faster Document Re-ranking InferenceFindings15 citations
- Efficient Argument Structure Extraction with Transfer Learning and Active LearningFindings15 citations
- Efficient, Uncertainty-based Moderation of Neural Networks Text ClassifiersFindings15 citations
- Generative Pretraining for Paraphrase EvaluationLong15 citations
- Hey AI, Can You Solve Complex Tasks by Talking to Agents?Findings15 citations
- Improving Controllable Text Generation with Position-Aware Weighted DecodingFindings15 citations
- Integrating Vectorized Lexical Constraints for Neural Machine TranslationLong15 citations
- Large Scale Substitution-based Word Sense InductionLong15 citations
- Learning and Evaluating Character Representations in NovelsFindings15 citations
- Multilingual Document-Level Translation Enables Zero-Shot Transfer From Sentences to DocumentsLong15 citations
- Prediction Difference Regularization against Perturbation for Neural Machine TranslationLong15 citations
- Prix-LM: Pretraining for Multilingual Knowledge Base ConstructionLong15 citations
- RELiC: Retrieving Evidence for Literary ClaimsLong15 citations
- Situated Dialogue Learning through Procedural Environment GenerationLong15 citations
- Towards Few-shot Entity Recognition in Document Images: A Label-aware Sequence-to-Sequence FrameworkFindings15 citations
- Towards Responsible Natural Language Annotation for the Varieties of ArabicFindings15 citations
- Towards Transparent Interactive Semantic Parsing via Step-by-Step CorrectionFindings15 citations
- Where to Go for the Holidays: Towards Mixed-Type Dialogs for Clarification of User GoalsLong15 citations
- A Simple but Effective Pluggable Entity Lookup Table for Pre-trained Language ModelsShort14 citations
- An Interpretable Neuro-Symbolic Reasoning Framework for Task-Oriented Dialogue GenerationLong14 citations
- Analyzing Wrap-Up Effects through an Information-Theoretic LensShort14 citations
- Automatic Error Analysis for Document-level Information ExtractionLong14 citations
- Contrastive Visual Semantic Pretraining Magnifies the Semantics of Natural Language RepresentationsLong14 citations
- Keywords and Instances: A Hierarchical Contrastive Learning Framework Unifying Hybrid Granularities for Text GenerationLong14 citations
- Measuring the Impact of (Psycho-)Linguistic and Readability Features and Their Spill Over Effects on the Prediction of Eye Movement PatternsLong14 citations
- On The Ingredients of an Effective Zero-shot Semantic ParserLong14 citations
- Open Relation Modeling: Learning to Define Relations between EntitiesFindings14 citations
- ProphetChat: Enhancing Dialogue Generation with Simulation of Future ConversationLong14 citations
- Rare and Zero-shot Word Sense Disambiguation using Z-ReweightingLong14 citations
- Reports of personal experiences and stories in argumentation: datasets and analysisLong14 citations
- Scheduled Multi-task Learning for Neural Chat TranslationLong14 citations
- Updated Headline Generation: Creating Updated Summaries for Evolving News StoriesLong14 citations
- What does the sea say to the shore? A BERT based DST style approach for speaker to dialogue attribution in novelsLong14 citations
- A Meta-framework for Spatiotemporal Quantity Extraction from TextLong13 citations
- A Slot Is Not Built in One Utterance: Spoken Language Dialogs with Sub-SlotsFindings13 citations
- Alternative Input Signals Ease Transfer in Multilingual Machine TranslationLong13 citations
- Answering Open-Domain Multi-Answer Questions via a Recall-then-Verify FrameworkLong13 citations
- Automatic Speech Recognition and Query By Example for Creole Languages DocumentationFindings13 citations
- Cross-Lingual Ability of Multilingual Masked Language Models: A Study of Language StructureLong13 citations
- Cross-Modal Cloze Task: A New Task to Brain-to-Word DecodingFindings13 citations
- Detecting Various Types of Noise for Neural Machine TranslationFindings13 citations
- Efficient Hyper-parameter Search for Knowledge Graph EmbeddingLong13 citations
- Exploring and Adapting Chinese GPT to Pinyin Input MethodLong13 citations
- Identifying Chinese Opinion Expressions with Extremely-Noisy Crowdsourcing AnnotationsLong13 citations
- Incorporating Stock Market Signals for Twitter Stance DetectionLong13 citations
- Learning From Failure: Data Capture in an Australian Aboriginal CommunityLong13 citations
- Learning to Mediate Disparities Towards Pragmatic CommunicationLong13 citations
- On the Robustness of Offensive Language ClassifiersLong13 citations
- Reinforcement Guided Multi-Task Learning Framework for Low-Resource Stereotype DetectionLong13 citations
- Right for the Right Reason: Evidence Extraction for Trustworthy Tabular ReasoningLong13 citations
- RoMe: A Robust Metric for Evaluating Natural Language GenerationLong13 citations
- Should We Trust This Summary? Bayesian Abstractive Summarization to The RescueFindings13 citations
- Simulating Bandit Learning from User Feedback for Extractive Question AnsweringLong13 citations
- There’s a Time and Place for Reasoning Beyond the ImageLong13 citations
- Towards Consistent Document-level Entity Linking: Joint Models for Entity Linking and Coreference ResolutionShort13 citations
- UniGDD: A Unified Generative Framework for Goal-Oriented Document-Grounded DialogueShort13 citations
- Voxel-informed Language GroundingShort13 citations
- When Chosen Wisely, More Data Is What You Need: A Universal Sample-Efficient Strategy For Data AugmentationFindings13 citations
- “You might think about slightly revising the title”: Identifying Hedges in Peer-tutoring InteractionsLong13 citations
- A Comparison of Strategies for Source-Free Domain AdaptationLong12 citations
- A Novel Perspective to Look At Attention: Bi-level Attention-based Explainable Topic Modeling for News ClassificationFindings12 citations
- Are Shortest Rationales the Best Explanations for Human Understanding?Short12 citations
- ChatMatch: Evaluating Chatbots by Autonomous Chat TournamentsLong12 citations
- Constructing Open Cloze Tests Using Generation and Discrimination Capabilities of TransformersFindings12 citations
- Controlled Text Generation Using Dictionary Prior in Variational AutoencodersFindings12 citations
- Cree Corpus: A Collection of nêhiyawêwin ResourcesLong12 citations
- Divide and Denoise: Learning from Noisy Labels in Fine-Grained Entity Typing with Cluster-Wise Loss CorrectionLong12 citations
- Doctor Recommendation in Online Health Forums via Expertise LearningLong12 citations
- Domain Generalisation of NMT: Fusing Adapters with Leave-One-Domain-Out TrainingFindings12 citations
- Extract-Select: A Span Selection Framework for Nested Named Entity Recognition with Generative Adversarial TrainingFindings12 citations
- Improving Chinese Grammatical Error Detection via Data augmentation by Conditional Error GenerationFindings12 citations
- Improving Machine Reading Comprehension with Contextualized Commonsense KnowledgeLong12 citations
- Improving Robustness of Language Models from a Geometry-aware PerspectiveFindings12 citations
- Metadata Shaping: A Simple Approach for Knowledge-Enhanced Language ModelsFindings12 citations
- Probing for Labeled Dependency TreesLong12 citations
- S4-Tuning: A Simple Cross-lingual Sub-network Tuning MethodShort12 citations
- SDR: Efficient Neural Re-ranking using Succinct Document RepresentationLong12 citations
- Syntax-guided Contrastive Learning for Pre-trained Language ModelFindings12 citations
- TegTok: Augmenting Text Generation via Task-specific and Open-world KnowledgeFindings12 citations
- Towards Abstractive Grounded Summarization of Podcast TranscriptsLong12 citations
- Towards Comprehensive Patent Approval Predictions:Beyond Traditional Document ClassificationLong12 citations
- Bilingual alignment transfers to multilingual alignment for unsupervised parallel text miningLong11 citations
- CLUES: A Benchmark for Learning Classifiers using Natural Language ExplanationsLong11 citations
- Distributionally Robust Finetuning BERT for Covariate Drift in Spoken Language UnderstandingLong11 citations
- E-LANG: Energy-Based Joint Inferencing of Super and Swift Language ModelsLong11 citations
- EPT-X: An Expression-Pointer Transformer model that generates eXplanations for numbersLong11 citations
- Enhancing Chinese Pre-trained Language Model via Heterogeneous Linguistics GraphLong11 citations
- Entity-based Neural Local Coherence ModelingLong11 citations
- Event Transition Planning for Open-ended Text GenerationFindings11 citations
- Finding the Dominant Winning Ticket in Pre-Trained Language ModelsFindings11 citations
- From Simultaneous to Streaming Machine Translation by Leveraging Streaming HistoryLong11 citations
- Headed-Span-Based Projective Dependency ParsingLong11 citations
- Improving Multi-label Malevolence Detection in Dialogues through Multi-faceted Label Correlation EnhancementLong11 citations
- Incremental Intent Detection for Medical Domain with Contrast Replay NetworksFindings11 citations
- Learning to Describe Solutions for Bug Reports Based on Developer DiscussionsFindings11 citations
- Learning to Generate Programs for Table Fact Verification via Structure-Aware Semantic ParsingLong11 citations
- Leveraging Visual Knowledge in Language Tasks: An Empirical Study on Intermediate Pre-training for Cross-Modal Knowledge TransferLong11 citations
- Measuring Fairness of Text Classifiers via Prediction SensitivityLong11 citations
- Measuring the Language of Self-Disclosure across CorporaFindings11 citations
- Multilingual Detection of Personal Employment Status on TwitterLong11 citations
- OIE@OIA: an Adaptable and Efficient Open Information Extraction FrameworkLong11 citations
- Pre-training and Fine-tuning Neural Topic Model: A Simple yet Effective Approach to Incorporating External KnowledgeLong11 citations
- Predicting Sentence Deletions for Text Simplification Using a Functional Discourse StructureShort11 citations
- Probing the Robustness of Trained Metrics for Conversational Dialogue SystemsShort11 citations
- Striking a Balance: Alleviating Inconsistency in Pre-trained Models for Symmetric Classification TasksFindings11 citations
- Substructure Distribution Projection for Zero-Shot Cross-Lingual Dependency ParsingLong11 citations
- TABi: Type-Aware Bi-Encoders for Open-Domain Entity RetrievalFindings11 citations
- Textomics: A Dataset for Genomics Data Summary GenerationLong11 citations
- Towards Fair Evaluation of Dialogue State Tracking by Flexible Incorporation of Turn-level PerformancesShort11 citations
- ePiC: Employing Proverbs in Context as a Benchmark for Abstract Language UnderstandingLong11 citations
- A Few-Shot Semantic Parser for Wizard-of-Oz Dialogues with the Precise ThingTalk RepresentationFindings10 citations
- A Neural Network Architecture for Program Understanding Inspired by Human BehaviorsLong10 citations
- Augmenting Document Representations for Dense Retrieval with Interpolation and PerturbationShort10 citations
- Capture Human Disagreement Distributions by Calibrated Networks for Natural Language InferenceFindings10 citations
- Characterizing Idioms: Conventionality and ContingencyLong10 citations
- Classification without (Proper) Representation: Political Heterogeneity in Social Media and Its Implications for Classification and Behavioral AnalysisFindings10 citations
- Combining Static and Contextualised Multilingual EmbeddingsFindings10 citations
- Compact Token Representations with Contextual Quantization for Efficient Document Re-rankingLong10 citations
- Computational Historical Linguistics and Language Diversity in South AsiaLong10 citations
- DMix: Adaptive Distance-aware Interpolative MixupShort10 citations
- Direct parsing to sentiment graphsShort10 citations
- Domain Knowledge Transferring for Pre-trained Language Model via Calibrated Activation Boundary DistillationLong10 citations
- Estimating the Entropy of Linguistic DistributionsShort10 citations
- Explanation Graph Generation via Pre-trained Language Models: An Empirical Study with Contrastive LearningLong10 citations
- Finding Structural Knowledge in Multimodal-BERTLong10 citations
- Fire Burns, Sword Cuts: Commonsense Inductive Bias for Exploration in Text-based GamesShort10 citations
- Improving Neural Political Statement Classification with Class Hierarchical InformationFindings10 citations
- Investigating Non-local Features for Neural Constituency ParsingLong10 citations
- KenMeSH: Knowledge-enhanced End-to-end Biomedical Text LabellingLong10 citations
- Learning from Sibling Mentions with Scalable Graph Inference in Fine-Grained Entity TypingLong10 citations
- Learning to Rank Visual Stories From Human Ranking DataLong10 citations
- Leveraging Wikipedia article evolution for promotional tone detectionLong10 citations
- Mismatch between Multi-turn Dialogue and its Evaluation Metric in Dialogue State TrackingShort10 citations
- Premise-based Multimodal Reasoning: Conditional Inference on Joint Textual and Visual CluesLong10 citations
- Principled Paraphrase Generation with Parallel CorporaLong10 citations
- RNSum: A Large-Scale Dataset for Automatic Release Note Generation via Commit Logs SummarizationLong10 citations
- Should a Chatbot be Sarcastic? Understanding User Preferences Towards Sarcasm GenerationLong10 citations
- Sparsifying Transformer Models with Trainable Representation PoolingLong10 citations
- Structural Supervision for Word Alignment and Machine TranslationFindings10 citations
- Towards Adversarially Robust Text Classifiers by Learning to Reweight Clean ExamplesFindings10 citations
- Uncertainty Determines the Adequacy of the Mode and the Tractability of Decoding in Sequence-to-Sequence ModelsLong10 citations
- Understanding Game-Playing Agents with Natural Language AnnotationsShort10 citations
- Understanding Gender Bias in Knowledge Base EmbeddingsLong10 citations
- Automatic Detection of Entity-Manipulated Text using Factual KnowledgeShort9 citations
- Calibration of Machine Reading Systems at ScaleFindings9 citations
- Compressing Sentence Representation for Semantic Retrieval via Homomorphic Projective DistillationFindings9 citations
- Explaining Classes through Stable Word AttributionsFindings9 citations
- KaFSP: Knowledge-Aware Fuzzy Semantic Parsing for Conversational Question Answering over a Large-Scale Knowledge BaseLong9 citations
- LAGr: Label Aligned Graphs for Better Systematic Generalization in Semantic ParsingLong9 citations
- Learning Reasoning Patterns for Relational Triple Extraction with Mutual Generation of Text and GraphFindings9 citations
- Mitigating Contradictions in Dialogue Based on Contrastive LearningFindings9 citations
- Morphological Reinflection with Multiple Arguments: An Extended Annotation schema and a Georgian Case StudyShort9 citations
- N-Shot Learning for Augmenting Task-Oriented Dialogue State TrackingFindings9 citations
- On Efficiently Acquiring Annotations for Multilingual ModelsShort9 citations
- On the Effect of Isotropy on VAE Representations of TextShort9 citations
- Online Semantic Parsing for Latency Reduction in Task-Oriented DialogueLong9 citations
- Probing Factually Grounded Content Transfer with Factual AblationFindings9 citations
- Relevant CommonSense Subgraphs for “What if...” Procedural ReasoningFindings9 citations
- Sememe Prediction for BabelNet Synsets using Multilingual and Multimodal InformationFindings9 citations
- Speaker Information Can Guide Models to Better Inductive Biases: A Case Study On Predicting Code-SwitchingLong9 citations
- Systematicity, Compositionality and Transitivity of Deep NLP Models: a Metamorphic Testing PerspectiveFindings9 citations
- Zero-Shot Dependency Parsing with Worst-Case Aware Automated Curriculum LearningShort9 citations
- A Transformational Biencoder with In-Domain Negative Sampling for Zero-Shot Entity LinkingFindings8 citations
- Active Evaluation: Efficient NLG Evaluation with Few Pairwise ComparisonsLong8 citations
- Better Quality Estimation for Low Resource Corpus MiningFindings8 citations
- Compositional Generalization in Dependency ParsingLong8 citations
- Constrained Multi-Task Learning for Bridging ResolutionLong8 citations
- Counterfactual Explanations for Natural Language InterfacesShort8 citations
- Cross-lingual Inference with A Chinese Entailment GraphFindings8 citations
- Discontinuous Constituency and BERT: A Case Study of DutchFindings8 citations
- Dynamically Refined Regularization for Improving Cross-corpora Hate Speech DetectionFindings8 citations
- ECO v1: Towards Event-Centric Opinion MiningFindings8 citations
- Early Stopping Based on Unlabeled Samples in Text ClassificationLong8 citations
- Enhancing Natural Language Representation with Large-Scale Out-of-Domain CommonsenseFindings8 citations
- Extracting Person Names from User Generated Text: Named-Entity Recognition for Combating Human TraffickingFindings8 citations
- Fact-Tree Reasoning for N-ary Question Answering over Knowledge GraphsFindings8 citations
- Flow-Adapter Architecture for Unsupervised Machine TranslationLong8 citations
- Graph Neural Networks for Multiparallel Word AlignmentFindings8 citations
- Learning from Missing Relations: Contrastive Learning with Commonsense Knowledge Graphs for Commonsense InferenceFindings8 citations
- Leveraging Expert Guided Adversarial Augmentation For Improving Generalization in Named Entity RecognitionFindings8 citations
- Life after BERT: What do Other Muppets Understand about Language?Long8 citations
- Long-range Sequence Modeling with Predictable Sparse AttentionLong8 citations
- Low-Rank Softmax Can Have Unargmaxable Classes in Theory but Rarely in PracticeLong8 citations
- Machine Translation for Livonian: Catering to 20 SpeakersShort8 citations
- Meta-XNLG: A Meta-Learning Approach Based on Language Clustering for Zero-Shot Cross-Lingual Transfer and GenerationFindings8 citations
- Multi-task Learning for Paraphrase Generation With Keyword and Part-of-Speech ReconstructionFindings8 citations
- Selecting Stickers in Open-Domain Dialogue through Multitask LearningFindings8 citations
- SyMCoM - Syntactic Measure of Code Mixing A Study Of English-Hindi Code-MixingFindings8 citations
- Tracing Origins: Coreference-aware Machine Reading ComprehensionLong8 citations
- Unsupervised Dependency Graph NetworkLong8 citations
- Variational Graph Autoencoding as Cheap Supervision for AMR Coreference ResolutionLong8 citations
- ZiNet: Linking Chinese Characters Spanning Three Thousand YearsFindings8 citations
- k-Rater Reliability: The Correct Unit of Reliability for Aggregated Human AnnotationsShort8 citations
- Benchmarking Answer Verification Methods for Question Answering-Based Summarization Evaluation MetricsFindings7 citations
- Chinese Synesthesia Detection: New Dataset and ModelsFindings7 citations
- Cross-Utterance Conditioned VAE for Non-Autoregressive Text-to-SpeechLong7 citations
- DU-VLG: Unifying Vision-and-Language Generation via Dual Sequence-to-Sequence Pre-trainingFindings7 citations
- Data Augmentation and Learned Layer Aggregation for Improved Multilingual Language Understanding in DialogueFindings7 citations
- EICO: Improving Few-Shot Text Classification via Explicit and Implicit Consistency RegularizationFindings7 citations
- EnCBP: A New Benchmark Dataset for Finer-Grained Cultural Background Prediction in EnglishFindings7 citations
- Exploring the Capacity of a Large-scale Masked Language Model to Recognize Grammatical ErrorsFindings7 citations
- Fine- and Coarse-Granularity Hybrid Self-Attention for Efficient BERTLong7 citations
- Going “Deeper”: Structured Sememe Prediction via Transformer with Tree AttentionFindings7 citations
- HOLM: Hallucinating Objects with Language Models for Referring Expression Recognition in Partially-Observed ScenesLong7 citations
- Hybrid Semantics for Goal-Directed Natural Language GenerationLong7 citations
- Interpreting Character Embeddings With Perceptual Representations: The Case of Shape, Sound, and ColorLong7 citations
- Modeling Temporal-Modal Entity Graph for Procedural Multimodal Machine ComprehensionLong7 citations
- Multilingual unsupervised sequence segmentation transfers to extremely low-resource languagesLong7 citations
- Neural Label Search for Zero-Shot Multi-Lingual Extractive SummarizationLong7 citations
- Phone-ing it in: Towards Flexible Multi-Modal Language Model Training by Phonetic Representations of DataLong7 citations
- Probing Multilingual Cognate Prediction ModelsFindings7 citations
- RuCCoN: Clinical Concept Normalization in RussianFindings7 citations
- Triangular Transfer: Freezing the Pivot for Triangular Machine TranslationShort7 citations
- TwittIrish: A Universal Dependencies Treebank of Tweets in Modern IrishLong7 citations
- Which side are you on? Insider-Outsider classification in conspiracy-theoretic social mediaLong7 citations
- Adversarial Authorship Attribution for DeobfuscationLong6 citations
- C-MORE: Pretraining to Answer Open-Domain Questions by Consulting Millions of ReferencesShort6 citations
- CAMERO: Consistency Regularized Ensemble of Perturbed Language Models with Weight SharingLong6 citations
- CUE Vectors: Modular Training of Language Models Conditioned on Diverse Contextual SignalsFindings6 citations
- Can Synthetic Translations Improve Bitext Quality?Long6 citations
- Combining (Second-Order) Graph-Based and Headed-Span-Based Projective Dependency ParsingFindings6 citations
- Cross-Lingual Phrase RetrievalLong6 citations
- Detecting Unassimilated Borrowings in Spanish: An Annotated Corpus and Approaches to ModelingLong6 citations
- Developmental Negation Processing in Transformer Language ModelsShort6 citations
- Dual Context-Guided Continuous Prompt Tuning for Few-Shot LearningFindings6 citations
- Flexible Generation from Fragmentary Linguistic InputLong6 citations
- Focus on the Target’s Vocabulary: Masked Label Smoothing for Machine TranslationShort6 citations
- From Stance to Concern: Adaptation of Propositional Analysis to New Tasks and DomainsFindings6 citations
- Implicit Relation Linking for Question Answering over Knowledge GraphFindings6 citations
- KSAM: Infusing Multi-Source Knowledge into Dialogue Generation via Knowledge Source Aware Multi-Head DecodingFindings6 citations
- Knowledge Graph Embedding by Adaptive Limit Scoring Loss Using Dynamic Weighting StrategyFindings6 citations
- Letters From the Past: Modeling Historical Sound Change Through Diachronic Character EmbeddingsLong6 citations
- Lexical Knowledge Internalization for Neural Dialog GenerationLong6 citations
- MPII: Multi-Level Mutual Promotion for Inference and InterpretationLong6 citations
- Mitigating the Inconsistency Between Word Saliency and Model Confidence with Pathological Contrastive TrainingFindings6 citations
- Modeling U.S. State-Level Policies by Extracting Winners and Losers from Legislative TextsLong6 citations
- On the data requirements of probingFindings6 citations
- Phoneme transcription of endangered languages: an evaluation of recent ASR architectures in the single speaker scenarioFindings6 citations
- Ranking-Constrained Learning with Rationales for Text ClassificationFindings6 citations
- Rewarding Semantic Similarity under Optimized Alignments for AMR-to-Text GenerationShort6 citations
- Searching for fingerspelled content in American Sign LanguageLong6 citations
- Thai Nested Named Entity Recognition CorpusFindings6 citations
- Weakly Supervised Word Segmentation for Computational Language DocumentationLong6 citations
- Aligned Weight Regularizers for Pruning Pretrained Neural NetworksFindings5 citations
- Auxiliary tasks to boost Biaffine Semantic Dependency ParsingFindings5 citations
- CoDA21: Evaluating Language Understanding Capabilities of NLP Models With Context-Definition AlignmentShort5 citations
- Distinguishing Non-natural from Natural Adversarial Samples for More Robust Pre-trained Language ModelFindings5 citations
- Down and Across: Introducing Crossword-Solving as a New NLP BenchmarkLong5 citations
- Exploiting Language Model Prompts Using Similarity Measures: A Case Study on the Word-in-Context TaskShort5 citations
- From BERT‘s Point of View: Revealing the Prevailing Contextual DifferencesFindings5 citations
- How Can Cross-lingual Knowledge Contribute Better to Fine-Grained Entity Typing?Findings5 citations
- Leveraging Explicit Lexico-logical Alignments in Text-to-SQL ParsingShort5 citations
- Modeling Syntactic-Semantic Dependency Correlations in Semantic Role Labeling Using Mixture ModelsLong5 citations
- Multi-Scale Distribution Deep Variational Autoencoder for Explanation GenerationFindings5 citations
- OneAligner: Zero-shot Cross-lingual Transfer with One Rich-Resource Language Pair for Low-Resource Sentence RetrievalFindings5 citations
- Predicting Intervention Approval in Clinical Trials through Multi-Document SummarizationLong5 citations
- Rethinking Offensive Text Detection as a Multi-Hop Reasoning ProblemFindings5 citations
- Semi-supervised Domain Adaptation for Dependency Parsing with Dynamic Matching NetworkLong5 citations
- Single Model Ensemble for Subword Regularized Models in Low-Resource Machine TranslationFindings5 citations
- That Slepen Al the Nyght with Open Ye! Cross-era Sequence Segmentation with Switch-memoryLong5 citations
- To Find Waldo You Need Contextual Cues: Debiasing Who’s WaldoShort5 citations
- Transfer Learning and Prediction Consistency for Detecting Offensive Spans of TextFindings5 citations
- Transformers in the loop: Polarity in neural models of languageLong5 citations
- Unsupervised Chinese Word Segmentation with BERT Oriented Probing and TransformationFindings5 citations
- Using NLP to quantify the environmental cost and diversity benefits of in-person NLP conferencesFindings5 citations
- Weighted self Distillation for Chinese word segmentationFindings5 citations
- CaMEL: Case Marker Extraction without LabelsLong4 citations
- Can Visual Dialogue Models Do Scorekeeping? Exploring How Dialogue Representations Incrementally Encode Shared KnowledgeShort4 citations
- Composing Structure-Aware Batches for Pairwise Sentence ClassificationFindings4 citations
- Controlling the Focus of Pretrained Language Generation ModelsFindings4 citations
- Cross-Lingual UMLS Named Entity Linking using UMLS Dictionary Fine-TuningFindings4 citations
- Domain Adaptation in Multilingual and Multi-Domain Monolingual Settings for Complex Word IdentificationLong4 citations
- EAG: Extract and Generate Multi-way Aligned Corpus for Complete Multi-lingual Neural Machine TranslationLong4 citations
- Feeding What You Need by Understanding What You LearnedLong4 citations
- Focus on the Action: Learning to Highlight and Summarize Jointly for Email To-Do Items SummarizationFindings4 citations
- HYPHEN: Hyperbolic Hawkes Attention For Text StreamsShort4 citations
- How Distributed are Distributed Representations? An Observation on the Locality of Syntactic Information in Verb Agreement TasksShort4 citations
- Input-specific Attention Subnetworks for Adversarial DetectionFindings4 citations
- Interactive Word Completion for Plains CreeLong4 citations
- Investigating Data Variance in Evaluations of Automatic Machine Translation MetricsFindings4 citations
- Investigating person-specific errors in chat-oriented dialogue systemsShort4 citations
- Learning-by-Narrating: Narrative Pre-Training for Zero-Shot Dialogue ComprehensionShort4 citations
- Leveraging Relaxed Equilibrium by Lazy Transition for Sequence ModelingLong4 citations
- Lite Unified Modeling for Discriminative Reading ComprehensionLong4 citations
- On Length Divergence Bias in Textual Matching ModelsFindings4 citations
- Pixie: Preference in Implicit and Explicit ComparisonsShort4 citations
- Probing Structured Pruning on Multilingual Pre-trained Models: Settings, Algorithms, and EfficiencyLong4 citations
- Self-supervised Semantic-driven Phoneme Discovery for Zero-resource Speech RecognitionLong4 citations
- Sub-Word Alignment is Still Useful: A Vest-Pocket Method for Enhancing Low-Resource Machine TranslationShort4 citations
- Task-guided Disentangled Tuning for Pretrained Language ModelsFindings4 citations
- TopWORDS-Seg: Simultaneous Text Segmentation and Word Discovery for Open-Domain Chinese Texts via Bayesian InferenceLong4 citations
- Two-Step Question Retrieval for Open-Domain QAFindings4 citations
- Word-level Perturbation Considering Word Length and Compositional SubwordsFindings4 citations
- A Copy-Augmented Generative Model for Open-Domain Question AnsweringShort3 citations
- A Flexible Multi-Task Model for BERT ServingShort3 citations
- Addressing Resource and Privacy Constraints in Semantic Parsing Through Data AugmentationFindings3 citations
- Attention Mechanism with Energy-Friendly OperationsFindings3 citations
- CaM-Gen: Causally Aware Metric-Guided Text GenerationFindings3 citations
- Co-training an Unsupervised Constituency Parser with Weak SupervisionFindings3 citations
- Dependency-based Mixture Language ModelsLong3 citations
- Hierarchical Inductive Transfer for Continual Dialogue LearningFindings3 citations
- Interpretable Research Replication Prediction via Variational Contextual Consistency Sentence MaskingFindings3 citations
- LM-BFF-MS: Improving Few-Shot Fine-tuning of Language Models based on Multiple Soft Demonstration MemoryShort3 citations
- More Than Words: Collocation Retokenization for Latent Dirichlet Allocation ModelsFindings3 citations
- On Controlling Fallback Responses for Grounded Dialogue GenerationFindings3 citations
- Region-dependent temperature scaling for certainty calibration and application to class-imbalanced token classificationShort3 citations
- Revisiting the Effects of Leakage on Dependency ParsingFindings3 citations
- Suum Cuique: Studying Bias in Taboo Detection with a Community PerspectiveFindings3 citations
- Synchronous Refinement for Neural Machine TranslationFindings3 citations
- Visualizing the Relationship Between Encoded Linguistic Information and Task PerformanceFindings3 citations
- XDBERT: Distilling Visual Information to BERT from Cross-Modal Systems to Improve Language UnderstandingShort3 citations
- ASCM: An Answer Space Clustered Prompting Method without Answer EngineeringFindings2 citations
- Accurate Online Posterior Alignments for Principled Lexically-Constrained DecodingLong2 citations
ACL accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.