EMNLP 2022 Accepted Papers
The full list of 1,439 papers accepted at EMNLP 2022 (Conference on Empirical Methods in Natural Language Processing). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Main: 826finding: 548Industry: 65
- Red Teaming Language Models with Language ModelsMain685 citations
- Super-NaturalInstructions: Generalization via Declarative Instructions on 1600+ NLP TasksMain582 citations
- MedCLIP: Contrastive Learning from Unpaired Medical Images and TextMain478 citations
- Large language models are few-shot clinical information extractorsMain448 citations
- Large Dual Encoders Are Generalizable RetrieversMain418 citations
- RLPrompt: Optimizing Discrete Text Prompts with Reinforcement LearningMain362 citations
- Transformer Feed-Forward Layers Build Predictions by Promoting Concepts in the Vocabulary SpaceMain328 citations
- Can language models learn from explanations in context?finding301 citations
- Towards a Unified Multi-Dimensional Evaluator for Text GenerationMain242 citations
- WANLI: Worker and AI Collaboration for Natural Language Inference Dataset Creationfinding230 citations
- Neural Theory-of-Mind? On the Limits of Social Intelligence in Large LMsMain226 citations
- Translation between Molecules and Natural LanguageMain225 citations
- UnifiedSKG: Unifying and Multi-Tasking Structured Knowledge Grounding with Text-to-Text Language ModelsMain214 citations
- The “Problem” of Human Label Variation: On Ground Truth in Data, Modeling and EvaluationMain212 citations
- Language Models as Agent Modelsfinding205 citations
- Language Models of Code are Few-Shot Commonsense LearnersMain205 citations
- PromptBERT: Improving BERT Sentence Embeddings with PromptsMain205 citations
- ZeroGen: Efficient Zero-shot Learning via Dataset GenerationMain204 citations
- UniMSE: Towards Unified Multimodal Sentiment Analysis and Emotion RecognitionMain194 citations
- Are Large Pre-Trained Language Models Leaking Your Personal Information?finding191 citations
- Re3: Generating Longer Stories With Recursive Reprompting and RevisionMain188 citations
- Active Example Selection for In-Context LearningMain186 citations
- Quantifying Privacy Risks of Masked Language Models Using Membership Inference AttacksMain177 citations
- Prompt-learning for Fine-grained Entity Typingfinding172 citations
- ASQA: Factoid Questions Meet Long-Form AnswersMain170 citations
- RetroMAE: Pre-Training Retrieval-oriented Language Models Via Masked Auto-EncoderMain170 citations
- Large-Scale Differentially Private BERTfinding162 citations
- Thinking about GPT-3 In-Context Learning for Biomedical IE? Think Againfinding162 citations
- “I’m sorry to hear that”: Finding New Biases in Language Models with a Holistic Descriptor DatasetMain162 citations
- CTRLsum: Towards Generic Controllable Text SummarizationMain161 citations
- Improving Passage Retrieval with Zero-Shot Question GenerationMain157 citations
- BOOKSUM: A Collection of Datasets for Long-form Narrative Summarizationfinding151 citations
- MuRAG: Multimodal Retrieval-Augmented Generator for Open Question Answering over Images and TextMain148 citations
- Efficient Large Scale Language Modeling with Mixtures of ExpertsMain146 citations
- The Optimal BERT Surgeon: Scalable and Accurate Second-Order Pruning for Large Language ModelsMain146 citations
- AdaMix: Mixture-of-Adaptations for Parameter-efficient Model TuningMain145 citations
- SCROLLS: Standardized CompaRison Over Long Language SequencesMain145 citations
- mPLUG: Effective and Efficient Vision-Language Learning by Cross-modal Skip-connectionsMain145 citations
- Training Language Models with Memory AugmentationMain140 citations
- Memory-assisted prompt editing to improve GPT-3 after deploymentMain136 citations
- When FLUE Meets FLANG: Benchmarks and Large Pretrained Language Model for Financial DomainMain132 citations
- In-Context Learning for Few-Shot Dialogue State Trackingfinding129 citations
- LILA: A Unified Benchmark for Mathematical ReasoningMain129 citations
- ScienceWorld: Is your Agent Smarter than a 5th Grader?Main126 citations
- Language Models that Seek for Knowledge: Modular Search & Generation for Dialogue and Prompt Completionfinding124 citations
- What Language Model to Train if You Have One Million GPU Hours?finding124 citations
- Iteratively Prompt Pre-trained Language Models for Chain of ThoughtMain122 citations
- Plug-and-Play VQA: Zero-shot VQA by Conjoining Large Pretrained Models with Zero Trainingfinding122 citations
- A Survey of Active Learning for Natural Language ProcessingMain119 citations
- Transformer Language Models without Positional Encodings Still Learn Positional Informationfinding119 citations
- Calibrating Factual Knowledge in Pretrained Language Modelsfinding118 citations
- MAGMA – Multimodal Augmentation of Generative Models through Adapter-based Finetuningfinding116 citations
- Text-Only Training for Image Captioning using Noise-Injected CLIPfinding116 citations
- ProsocialDialog: A Prosocial Backbone for Conversational AgentsMain114 citations
- Natural Language to Code Translation with ExecutionMain112 citations
- Successive Prompting for Decomposing Complex QuestionsMain111 citations
- UniGeo: Unifying Geometry Logical Reasoning via Reformulating Mathematical ExpressionMain111 citations
- Fine-tuned Language Models are Continual LearnersMain108 citations
- ATTEMPT: Parameter-Efficient Multi-task Tuning via Attentional Mixtures of Soft PromptsMain107 citations
- RASAT: Integrating Relational Structures into Pretrained Seq2Seq Model for Text-to-SQLMain107 citations
- Video Question Answering: Datasets, Algorithms and ChallengesMain107 citations
- ConvFinQA: Exploring the Chain of Numerical Reasoning in Conversational Finance Question AnsweringMain105 citations
- Perturbation Augmentation for Fairer NLPMain103 citations
- Supervised Prototypical Contrastive Learning for Emotion Recognition in ConversationMain103 citations
- COLD: A Benchmark for Chinese Offensive Language DetectionMain102 citations
- Revisiting Parameter-Efficient Tuning: Are We Really There Yet?Main100 citations
- Interpreting Language Models with Contrastive ExplanationsMain99 citations
- How well can Text-to-Image Generative Models understand Ethical Natural Language Interventions?Main98 citations
- Towards Multi-Modal Sarcasm Detection via Hierarchical Congruity Modeling with Knowledge EnhancementMain93 citations
- Ground-Truth Labels Matter: A Deeper Look into Input-Label DemonstrationsMain92 citations
- TemporalWiki: A Lifelong Benchmark for Training and Evaluating Ever-Evolving Language ModelsMain92 citations
- Revisiting DocRED - Addressing the False Negative Problem in Relation ExtractionMain91 citations
- TIARA: Multi-grained Retrieval for Robust Question Answering over Large Knowledge BaseMain91 citations
- Generative Knowledge Graph Construction: A ReviewMain90 citations
- Revisiting Transformer-based Models for Long Document Classificationfinding90 citations
- Neighborhood Contrastive Learning for Scientific Document Representations with Citation EmbeddingsMain89 citations
- An Empirical Analysis of Memorization in Fine-tuned Autoregressive Language ModelsMain88 citations
- BBTv2: Towards a Gradient-Free Future with Large Language ModelsMain88 citations
- Few-shot Learning with Multilingual Generative Language ModelsMain88 citations
- Logical Fallacy Detectionfinding88 citations
- Bitext Mining Using Distilled Sentence Representations for Low-Resource Languagesfinding87 citations
- SparseAdapter: An Easy Approach for Improving the Parameter-Efficiency of Adaptersfinding87 citations
- ERNIE-Layout: Layout Knowledge Enhanced Pre-training for Visually-rich Document Understandingfinding86 citations
- Prompting for Multimodal Hateful Meme ClassificationMain86 citations
- Towards Tracing Knowledge in Language Models Back to the Training Datafinding85 citations
- Uncertainty Quantification with Pre-trained Language Models: A Large-Scale Empirical Analysisfinding84 citations
- Entity-centered Cross-document Relation ExtractionMain83 citations
- Finding Skill Neurons in Pre-trained Transformer-based Language ModelsMain83 citations
- InstructDial: Improving Zero and Few-shot Generalization in Dialogue through Instruction TuningMain81 citations
- Rich Knowledge Sources Bring Complex Knowledge Conflicts: Recalibrating Models to Reflect Conflicting EvidenceMain81 citations
- Tomayto, Tomahto. Beyond Token-level Answer Equivalence for Question Answering EvaluationMain81 citations
- Prompt Consistency for Zero-Shot Task Generalizationfinding80 citations
- The Devil in Linear TransformerMain79 citations
- Prompt Compression and Contrastive Conditioning for Controllability and Toxicity Reduction in Language Modelsfinding78 citations
- Retrieval Augmented Visual Question Answering with Outside KnowledgeMain77 citations
- Generating Natural Language Proofs with Verifier-Guided SearchMain76 citations
- FLUTE: Figurative Language Understanding through Textual ExplanationsMain75 citations
- Help me write a poem: Instruction Tuning as a Vehicle for Collaborative Poetry WritingMain74 citations
- Improving the Factual Correctness of Radiology Report Generation with Semantic Rewardsfinding73 citations
- Language Contamination Helps Explains the Cross-lingual Capabilities of English Pretrained ModelsMain73 citations
- When Language Model Meets Private Libraryfinding73 citations
- A Systematic Investigation of Commonsense Knowledge in Large Language ModelsMain72 citations
- Generating Literal and Implied Subquestions to Fact-check Complex ClaimsMain72 citations
- CONQRR: Conversational Query Rewriting for Retrieval with Reinforcement LearningMain71 citations
- Salient Phrase Aware Dense Retrieval: Can a Dense Retriever Imitate a Sparse One?finding71 citations
- Making Science Simple: Corpora for the Lay Summarisation of Scientific LiteratureMain70 citations
- Textless Speech Emotion Conversion using Discrete & Decomposed RepresentationsMain70 citations
- Truncation Sampling as Language Model Desmoothingfinding70 citations
- GPS: Genetic Prompt Search for Efficient Few-Shot LearningMain69 citations
- ProGen: Progressive Zero-shot Dataset Generation via In-context Feedbackfinding69 citations
- “Will You Find These Shortcuts?” A Protocol for Evaluating the Faithfulness of Input Salience Methods for Text ClassificationMain69 citations
- Prompt-and-Rerank: A Method for Zero-Shot and Few-Shot Arbitrary Textual Style Transfer with Small Language ModelsMain68 citations
- SQuALITY: Building a Long-Document Summarization Dataset the Hard WayMain68 citations
- ClinicalT5: A Generative Language Model for Clinical Textfinding67 citations
- Crossmodal-3600: A Massively Multilingual Multimodal Evaluation DatasetMain66 citations
- UniRel: Unified Representation and Interaction for Joint Relational Triple ExtractionMain66 citations
- Zero-Shot Text Classification with Self-TrainingMain66 citations
- RankGen: Improving Text Generation with Large Ranking ModelsMain65 citations
- Reasoning Like Program ExecutorsMain65 citations
- Autoregressive Structured Prediction with Language Modelsfinding64 citations
- GeoMLAMA: Geo-Diverse Commonsense Probing on Multilingual Pre-Trained Language ModelsMain64 citations
- Improving Multi-turn Emotional Support Dialogue Generation with Lookahead Strategy PlanningMain64 citations
- Keep Me Updated! Memory Management in Long-term Conversationsfinding64 citations
- Overcoming Catastrophic Forgetting in Zero-Shot Cross-Lingual GenerationMain64 citations
- RL with KL penalties is better viewed as Bayesian inferencefinding64 citations
- SciFact-Open: Towards open-domain scientific claim verificationfinding64 citations
- HPT: Hierarchy-aware Prompt Tuning for Hierarchical Text ClassificationMain63 citations
- How Large Language Models are Transforming Machine-Paraphrase PlagiarismMain63 citations
- COCO-DR: Combating the Distribution Shift in Zero-Shot Dense Retrieval with Contrastive and Distributionally Robust LearningMain62 citations
- BERTScore is Unfair: On Social Bias in Language Model-Based Metrics for Text GenerationMain61 citations
- Empowering Language Models with Knowledge Graph Reasoning for Open-Domain Question AnsweringMain61 citations
- META-GUI: Towards Multi-modal Conversational Agents on Mobile GUIMain61 citations
- Open-Domain Sign Language Translation Learned from Online VideoMain61 citations
- Improving Aspect Sentiment Quad Prediction via Template-Order Data AugmentationMain60 citations
- Just Fine-tune Twice: Selective Differential Privacy for Large Language ModelsMain60 citations
- Maieutic Prompting: Logically Consistent Reasoning with Recursive ExplanationsMain60 citations
- Rainier: Reinforced Knowledge Introspector for Commonsense Question AnsweringMain60 citations
- The Geometry of Multilingual Language Model RepresentationsMain59 citations
- Entailer: Answering Questions with Faithful and Truthful Chains of ReasoningMain58 citations
- Improving Sharpness-Aware Minimization with Fisher Mask for Better Generalization on Language Modelsfinding58 citations
- SpeechUT: Bridging Speech and Text with Hidden-Unit for Encoder-Decoder Based Speech-Text Pre-trainingMain58 citations
- MAVEN-ERE: A Unified Large-scale Dataset for Event Coreference, Temporal, Causal, and Subevent Relation ExtractionMain57 citations
- Why is Winoground Hard? Investigating Failures in Visuolinguistic CompositionalityMain57 citations
- Evaluating the Impact of Model Scale for Compositional Generalization in Semantic ParsingMain56 citations
- Knowledge Injected Prompt Based Fine-tuning for Multi-label Few-shot ICD Codingfinding56 citations
- Stop Measuring Calibration When Humans DisagreeMain56 citations
- A Span-level Bidirectional Network for Aspect Sentiment Triplet ExtractionMain55 citations
- AdaPrompt: Adaptive Model Training for Prompt-based NLPfinding54 citations
- Gradient-based Constrained Sampling from Language ModelsMain54 citations
- Named Entity and Relation Extraction with Multi-Modal Retrievalfinding54 citations
- Nearest Neighbor Zero-Shot InferenceMain54 citations
- On the Evaluation Metrics for Paraphrase GenerationMain54 citations
- SynGEC: Syntax-Enhanced Grammatical Error Correction with a Tailored GEC-Oriented ParserMain54 citations
- Boundary-Driven Table-Filling for Aspect Sentiment Triplet ExtractionMain53 citations
- Generative Language Models for Paragraph-Level Question GenerationMain53 citations
- Measuring the Mixing of Contextual Information in the TransformerMain53 citations
- Exploring Document-Level Literary Machine Translation with Parallel Paragraphs from World LiteratureMain52 citations
- KOLD: Korean Offensive Language DatasetMain52 citations
- Mutual Information Alleviates Hallucinations in Abstractive SummarizationMain52 citations
- PACIFIC: Towards Proactive Conversational Question Answering over Tabular and Textual Data in FinanceMain52 citations
- Summarization as Indirect Supervision for Relation Extractionfinding52 citations
- PEVL: Position-enhanced Pre-training and Prompt Tuning for Vision-language ModelsMain51 citations
- An Efficient Memory-Augmented Transformer for Knowledge-Intensive NLP TasksMain50 citations
- Correcting Diverse Factual Errors in Abstractive Summarization via Post-Editing and Language Model InfillingMain50 citations
- Generative Aspect-Based Sentiment Analysis with Contrastive Learning and Expressive Structurefinding50 citations
- Mixture of Attention Heads: Selecting Attention Heads Per TokenMain50 citations
- Natural Language Deduction through Search over Statement Compositionsfinding50 citations
- Open-ended Knowledge Tracing for Computer Science EducationMain50 citations
- OpenCQA: Open-ended Question Answering with ChartsMain50 citations
- Towards Opening the Black Box of Neural Machine Translation: Source and Target Interpretations of the TransformerMain50 citations
- Why Should Adversarial Perturbations be Imperceptible? Rethink the Research Paradigm in Adversarial NLPMain50 citations
- Automatic Generation of Socratic Subquestions for Teaching Math Word ProblemsMain49 citations
- Balancing out Bias: Achieving Fairness Through Balanced TrainingMain49 citations
- ClidSum: A Benchmark Dataset for Cross-Lingual Dialogue SummarizationMain49 citations
- Differentially Private Language Models for Secure Data SharingMain49 citations
- HEGEL: Hypergraph Transformer for Long Document SummarizationMain49 citations
- Prompt-Based Meta-Learning For Few-shot Text ClassificationMain49 citations
- Dungeons and Dragons as a Dialog Challenge for Artificial IntelligenceMain48 citations
- ECTSum: A New Benchmark Dataset For Bullet Point Summarization of Long Earnings Call TranscriptsMain48 citations
- Face-Sensitive Image-to-Emotional-Text Cross-modal Translation for Multimodal Aspect-based Sentiment AnalysisMain48 citations
- MoSE: Modality Split and Ensemble for Multimodal Knowledge Graph CompletionMain48 citations
- RACE: Retrieval-augmented Commit Message GenerationMain48 citations
- Readability Controllable Biomedical Document Summarizationfinding48 citations
- Reason first, then respond: Modular Generation for Knowledge-infused Dialoguefinding48 citations
- TeleMelody: Lyric-to-Melody Generation with a Template-Based Two-Stage MethodMain48 citations
- COPEN: Probing Conceptual Knowledge in Pre-trained Language ModelsMain47 citations
- Enhancing Self-Consistency and Performance of Pre-Trained Language Models through Natural Language InferenceMain47 citations
- Is a Question Decomposition Unit All We Need?Main47 citations
- Retrieval-Augmented Generative Question Answering for Event Argument ExtractionMain47 citations
- Controllable Dialogue Simulation with In-context Learningfinding46 citations
- Handling and Presenting Harmful Text in NLP Researchfinding46 citations
- HiSMatch: Historical Structure Matching based Temporal Knowledge Graph Reasoningfinding46 citations
- Improved Universal Sentence Embeddings with Prompt-based Contrastive Learning and Energy-based Learningfinding46 citations
- Linguistic Rules-Based Corpus Generation for Native Chinese Grammatical Error Correctionfinding46 citations
- A Survey of Computational Framing Analysis ApproachesMain45 citations
- Co-guiding Net: Achieving Mutual Guidances between Multiple Intent Detection and Slot Filling via Heterogeneous Semantics-Label GraphsMain45 citations
- EUR-Lex-Sum: A Multi- and Cross-lingual Dataset for Long-form Summarization in the Legal DomainMain45 citations
- Knowledge-Rich Self-Supervision for Biomedical Entity Linkingfinding45 citations
- Missing Counter-Evidence Renders NLP Fact-Checking Unrealistic for MisinformationMain45 citations
- Stretching Sentence-pair NLI Models to Reason over Long Documents and Clustersfinding45 citations
- Bernice: A Multilingual Pre-trained Encoder for TwitterMain44 citations
- Context Limitations Make Neural Language Models More Human-LikeMain44 citations
- Exploiting Global and Local Hierarchies for Hierarchical Text ClassificationMain44 citations
- Abstract Visual Reasoning with Tangram ShapesMain43 citations
- Continual Training of Language Models for Few-Shot LearningMain43 citations
- Fixing Model Bugs with Natural Language PatchesMain43 citations
- Grape: Knowledge Graph Enhanced Passage Reader for Open-domain Question Answeringfinding43 citations
- Mitigating Data Sparsity for Short Text Topic Modeling by Topic-Semantic Contrastive LearningMain43 citations
- PASTA: Table-Operations Aware Fact Verification via Sentence-Table Cloze Pre-trainingMain43 citations
- The better your Syntax, the better your Semantics? Probing Pretrained Language Models for the English Comparative CorrelativeMain43 citations
- AlphaTuning: Quantization-Aware Parameter-Efficient Adaptation of Large-Scale Pre-Trained Language Modelsfinding42 citations
- EdiT5: Semi-Autoregressive Text Editing with T5 Warm-Startfinding42 citations
- Efficient Federated Learning on Knowledge Graphs via Privacy-preserving Relation Embedding Aggregationfinding42 citations
- Evaluating the Faithfulness of Importance Measures in NLP by Recursively Masking Allegedly Important Tokens and Retrainingfinding42 citations
- Knowledge Graph Generation From Textfinding42 citations
- PHEE: A Dataset for Pharmacovigilance Event Extraction from TextMain42 citations
- Toward Unifying Text Segmentation and Long Document SummarizationMain42 citations
- CodeRetriever: A Large Scale Contrastive Pre-Training Method for Code SearchMain41 citations
- Human-Machine Collaboration Approaches to Build a Dialogue Dataset for Hate Speech CounteringMain41 citations
- Outlier Dimensions that Disrupt Transformers are Driven by Frequencyfinding41 citations
- Towards Climate Awareness in NLP ResearchMain41 citations
- Fine-mixing: Mitigating Backdoors in Fine-tuned Language Modelsfinding40 citations
- Graph Hawkes Transformer for Extrapolated Reasoning on Temporal Knowledge GraphsMain40 citations
- Learning from the Dictionary: Heterogeneous Knowledge Guided Fine-tuning for Chinese Spell Checkingfinding40 citations
- On the Limitations of Reference-Free Evaluations of Generated TextMain40 citations
- Retrieval as Attention: End-to-end Learning of Retrieval and Reading within a Single TransformerMain40 citations
- SafeText: A Benchmark for Exploring Physical Safety in Language ModelsMain40 citations
- SimANS: Simple Ambiguous Negatives Sampling for Dense Text RetrievalIndustry40 citations
- SpanProto: A Two-stage Span-based Prototypical Network for Few-shot Named Entity RecognitionMain40 citations
- Are Neural Topic Models Broken?finding39 citations
- Empathetic Dialogue Generation via Sensitive Emotion Recognition and Sensible Knowledge Selectionfinding39 citations
- MABEL: Attenuating Gender Bias using Textual Entailment DataMain39 citations
- XPrompt: Exploring the Extreme of Prompt TuningMain39 citations
- Does Corpus Quality Really Matter for Low-Resource Languages?Main38 citations
- Inferring the Reader: Guiding Automated Story Generation with Commonsense Reasoningfinding38 citations
- Information-Transport-based Policy for Simultaneous TranslationMain38 citations
- MedicalSum: A Guided Clinical Abstractive Summarization Model for Generating Medical Reports from Patient-Doctor Conversationsfinding38 citations
- PCL: Peer-Contrastive Learning with Diverse Augmentations for Unsupervised Sentence EmbeddingsMain38 citations
- Towards Unified Prompt Tuning for Few-shot Text Classificationfinding38 citations
- XRICL: Cross-lingual Retrieval-Augmented In-Context Learning for Cross-lingual Text-to-SQL Semantic Parsingfinding38 citations
- CONDAQA: A Contrastive Reading Comprehension Dataset for Reasoning about NegationMain37 citations
- DisCup: Discriminator Cooperative Unlikelihood Prompt-tuning for Controllable Text GenerationMain37 citations
- Sentence-level Media Bias Analysis Informed by Discourse StructuresMain37 citations
- Adversarial Concept Erasure in Kernel SpaceMain36 citations
- Assisting the Human Fact-Checkers: Detecting All Previously Fact-Checked Claims in a Documentfinding36 citations
- Sampling-Based Approximations to Minimum Bayes Risk Decoding for Neural Machine TranslationMain36 citations
- Towards Teachable Reasoning Systems: Using a Dynamic Memory of User Feedback for Continual System ImprovementMain36 citations
- Are All Spurious Features in Natural Language Alike? An Analysis through a Causal LensMain35 citations
- GammaE: Gamma Embeddings for Logical Queries on Knowledge GraphsMain35 citations
- InfoCSE: Information-aggregated Contrastive Learning of Sentence Embeddingsfinding35 citations
- LightEA: A Scalable, Robust, and Interpretable Entity Alignment Framework via Three-view Label PropagationMain35 citations
- SlovakBERT: Slovak Masked Language Modelfinding35 citations
- SpaBERT: A Pretrained Language Model from Geographic Data for Geo-Entity Representationfinding35 citations
- A Distributional Lens for Multi-Aspect Controllable Text GenerationMain34 citations
- English Contrastive Learning Can Learn Universal Cross-lingual Sentence EmbeddingsMain34 citations
- Improving Chinese Spelling Check by Character Pronunciation Prediction: The Effects of Adaptivity and GranularityMain34 citations
- IndicNLG Benchmark: Multilingual Datasets for Diverse NLG Tasks in Indic LanguagesMain34 citations
- Learning to Model Editing Processesfinding34 citations
- Learning to Revise References for Faithful Summarizationfinding34 citations
- SNaC: Coherence Error Detection for Narrative SummarizationMain34 citations
- Salience Allocation as Guidance for Abstractive SummarizationMain34 citations
- BioReader: a Retrieval-Enhanced Text-to-Text Transformer for Biomedical LiteratureMain33 citations
- CORE: A Retrieve-then-Edit Framework for Counterfactual Data Generationfinding33 citations
- Character-centric Story Visualization via Visual Planning and Token AlignmentMain33 citations
- Character-level White-Box Adversarial Attacks against Transformers via Attachable Subwords SubstitutionMain33 citations
- Chunk-based Nearest Neighbor Machine TranslationMain33 citations
- Context Matters for Image Descriptions for Accessibility: Challenges for Referenceless Evaluation MetricsMain33 citations
- Distilled Dual-Encoder Model for Vision-Language UnderstandingMain33 citations
- Diving Deep into Modes of Fact Hallucinations in Dialogue Systemsfinding33 citations
- Efficient (Soft) Q-Learning for Text Generation with Limited Good Datafinding33 citations
- Enhancing Joint Multiple Intent Detection and Slot Filling with Global Intent-Slot Co-occurrenceMain33 citations
- LogicSolver: Towards Interpretable Math Word Problem Solving with Logical Prompt-enhanced Learningfinding33 citations
- Mask-then-Fill: A Flexible and Effective Data Augmentation Framework for Event Extractionfinding33 citations
- Multitask Instruction-based Prompting for Fallacy RecognitionMain33 citations
- Polyglot Prompt: Multilingual Multitask Prompt TrainingMain33 citations
- Probing for Constituency Structure in Neural Language Modelsfinding33 citations
- Table-To-Text generation and pre-training with TabT5finding33 citations
- Towards Robust Visual Question Answering: Making the Most of Biased Samples via Contrastive Learningfinding33 citations
- Faithful to the Document or to the World? Mitigating Hallucinations via Entity-Linked Knowledge in Abstractive Summarizationfinding32 citations
- How Far are We from Robust Long Abstractive Summarization?Main32 citations
- Leveraging Locality in Abstractive Text SummarizationMain32 citations
- Life is a Circus and We are the Clowns: Automatically Finding Analogies between Situations and ProcessesMain32 citations
- MT-GenEval: A Counterfactual and Contextual Dataset for Evaluating Gender Accuracy in Machine TranslationMain32 citations
- SMaLL-100: Introducing Shallow Multilingual Machine Translation Model for Low-Resource LanguagesMain32 citations
- Saving Dense Retriever from Shortcut Dependency in Conversational SearchMain32 citations
- BERT Meets CTC: New Formulation of End-to-End Speech Recognition with Pre-trained Masked Language Modelfinding31 citations
- COM-MRC: A COntext-Masked Machine Reading Comprehension Framework for Aspect Sentiment Triplet ExtractionMain31 citations
- DEMETR: Diagnosing Evaluation Metrics for TranslationMain31 citations
- How Much Does Attention Actually Attend? Questioning the Importance of Attention in Pretrained Transformersfinding31 citations
- MasakhaNER 2.0: Africa-centric Transfer Learning for Named Entity RecognitionMain31 citations
- QUILL: Query Intent with Large Language Models using Retrieval Augmentation and Multi-stage DistillationIndustry31 citations
- ReasTAP: Injecting Table Reasoning Skills During Pre-training via Synthetic Reasoning ExamplesMain31 citations
- Tiny-NewsRec: Effective and Efficient PLM-based News RecommendationMain31 citations
- Whose Language Counts as High Quality? Measuring Language Ideologies in Text Data SelectionMain31 citations
- You can’t pick your neighbors, or can you? When and How to Rely on Retrieval in the kNN-LMfinding31 citations
- Zero-shot Cross-lingual Transfer of Prompt-based Tuning with a Unified Multilingual PromptMain31 citations
- CrossRE: A Cross-Domain Dataset for Relation Extractionfinding30 citations
- Directions for NLP Practices Applied to Online Hate Speech DetectionMain30 citations
- Reflect, Not Reflex: Inference-Based Common Ground Improves Dialogue Response QualityMain30 citations
- Symptom Identification for Interpretable Detection of Multiple Mental Disorders on Social MediaMain30 citations
- Towards Identifying Social Bias in Dialog Systems: Framework, Dataset, and Benchmarkfinding30 citations
- AfroLID: A Neural Language Identification Tool for African LanguagesMain29 citations
- Analyzing the Mono- and Cross-Lingual Pretraining Dynamics of Multilingual Language ModelsMain29 citations
- Better Few-Shot Relation Extraction with Label Prompt DropoutMain29 citations
- Concadia: Towards Image-Based Text Generation with a PurposeMain29 citations
- Debiasing Pretrained Text Encoders by Paying Attention to Paying AttentionMain29 citations
- Hyper-X: A Unified Hypernetwork for Multi-Task Multilingual TransferMain29 citations
- Improving Low-Resource Languages in Pre-Trained Multilingual Language ModelsMain29 citations
- IndicXNLI: Evaluating Multilingual Inference for Indian LanguagesMain29 citations
- PLOG: Table-to-Logic Pretraining for Logical Table-to-Text GenerationMain29 citations
- STAR: SQL Guided Pre-Training for Context-dependent Text-to-SQL Parsingfinding29 citations
- Towards Interactivity and Interpretability: A Rationale-based Legal Judgment Prediction FrameworkMain29 citations
- Transfer Learning with Synthetic Corpora for Spatial Role Labeling and ReasoningMain29 citations
- Deconfounding Legal Judgment Prediction for European Court of Human Rights Cases Towards Better Alignment with ExpertsMain28 citations
- Late Prompt Tuning: A Late Prompt Could Be Better Than Many Promptsfinding28 citations
- Revisiting Pre-trained Language Models and their Evaluation for Arabic Natural Language ProcessingMain28 citations
- ToKen: Task Decomposition and Knowledge Infusion for Few-Shot Hate Speech DetectionMain28 citations
- You Only Need One Model for Open-domain Question AnsweringMain28 citations
- ZeroPrompt: Scaling Prompt-Based Pretraining to 1,000 Tasks Improves Zero-Shot Generalizationfinding28 citations
- A Unified Dialogue User Simulator for Few-shot Data Augmentationfinding27 citations
- Bi-Directional Iterative Prompt-Tuning for Event Argument ExtractionMain27 citations
- CEFR-Based Sentence Difficulty Annotation and AssessmentMain27 citations
- CPL: Counterfactual Prompt Learning for Vision and Language ModelsMain27 citations
- FCGEC: Fine-Grained Corpus for Chinese Grammatical Error Correctionfinding27 citations
- Facilitating Contrastive Learning of Discourse Relational Senses by Exploiting the Hierarchy of Sense RelationsMain27 citations
- Generative Multi-hop RetrievalMain27 citations
- Generative Prompt Tuning for Relation Classificationfinding27 citations
- Hyperdecoders: Instance-specific decoders for multi-task NLPfinding27 citations
- Knowledge Prompting in Pre-trained Language Model for Natural Language UnderstandingMain27 citations
- PromptEHR: Conditional Electronic Healthcare Records Generation with Prompt LearningMain27 citations
- Reinforced Question Rewriting for Conversational Question AnsweringIndustry27 citations
- Scientific and Creative Analogies in Pretrained Language Modelsfinding27 citations
- Should We Ban English NLP for a Year?Main27 citations
- Unobserved Local Structures Make Compositional Generalization HardMain27 citations
- A Critical Reflection and Forward Perspective on Empathy and Natural Language Processingfinding26 citations
- Analogical Math Word Problems Solving with Enhanced Problem-Solution AssociationMain26 citations
- ConvTrans: Transforming Web Search Sessions for Conversational Dense RetrievalMain26 citations
- Expose Backdoors on the Way: A Feature-Based Efficient Defense against Textual Backdoor Attacksfinding26 citations
- Fair NLP Models with Differentially Private Text Encodersfinding26 citations
- Language Prior Is Not the Only Shortcut: A Benchmark for Shortcut Learning in VQAfinding26 citations
- Mitigating Inconsistencies in Multimodal Sentiment Analysis under Uncertain Missing ModalitiesMain26 citations
- NewsClaims: A New Benchmark for Claim Detection from News with Attribute KnowledgeMain26 citations
- PoeLM: A Meter- and Rhyme-Controllable Language Model for Unsupervised Poetry Generationfinding26 citations
- Retrieval Augmentation for Commonsense Reasoning: A Unified ApproachMain26 citations
- RuCoLA: Russian Corpus of Linguistic AcceptabilityMain26 citations
- SALTED: A Framework for SAlient Long-tail Translation Error Detectionfinding26 citations
- SQUIRE: A Sequence-to-sequence Framework for Multi-hop Knowledge Graph ReasoningMain26 citations
- The Authenticity Gap in Human EvaluationMain26 citations
- Towards Robust k-Nearest-Neighbor Machine TranslationMain26 citations
- Uni-Parser: Unified Semantic Parser for Question Answering on Knowledge Base and DatabaseMain26 citations
- Varifocal Question Generation for Fact-checkingMain26 citations
- Active Learning for Abstractive Text Summarizationfinding25 citations
- Adaptive Contrastive Learning on Multimodal Transformer for Review Helpfulness PredictionMain25 citations
- Augmenting Operations Research with Auto-Formulation of Optimization Models From Problem DescriptionsIndustry25 citations
- Beyond prompting: Making Pre-trained Language Models Better Zero-shot Learners by Clustering RepresentationsMain25 citations
- ComFact: A Benchmark for Linking Contextual Commonsense Knowledgefinding25 citations
- ConsistTL: Modeling Consistency in Transfer Learning for Low-Resource Neural Machine TranslationMain25 citations
- D4: a Chinese Dialogue Dataset for Depression-Diagnosis-Oriented ChatMain25 citations
- Discovering Language-neutral Sub-networks in Multilingual Language ModelsMain25 citations
- Exploring Mode Connectivity for Pre-trained Language ModelsMain25 citations
- Fast Vocabulary Transfer for Language Model CompressionIndustry25 citations
- GENIE: Toward Reproducible and Standardized Human Evaluation for Text GenerationMain25 citations
- Group is better than individual: Exploiting Label Topologies and Label Relations for Joint Multiple Intent Detection and Slot FillingMain25 citations
- Re-Examining Calibration: The Case of Question Answeringfinding25 citations
- Sentiment-Aware Word and Sentence Level Pre-training for Sentiment AnalysisMain25 citations
- TaCube: Pre-computing Data Cubes for Answering Numerical-Reasoning Questions over Tabular DataMain25 citations
- Acceptability Judgements via Examining the Topology of Attention Mapsfinding24 citations
- Adapting a Language Model While Preserving its General KnowledgeMain24 citations
- Affective Knowledge Enhanced Multiple-Graph Fusion Networks for Aspect-based Sentiment AnalysisMain24 citations
- Analyzing and Evaluating Faithfulness in Dialogue SummarizationMain24 citations
- CROP: Zero-shot Cross-lingual Named Entity Recognition with Multilingual Labeled Sequence Translationfinding24 citations
- Challenges and Opportunities in Information Manipulation Detection: An Examination of Wartime Russian Mediafinding24 citations
- Detect-Localize-Repair: A Unified Framework for Learning to Debug with CodeT5finding24 citations
- Entropy- and Distance-Based Predictors From GPT-2 Attention Patterns Predict Reading Times Over and Above GPT-2 SurprisalMain24 citations
- Generate, Discriminate and Contrast: A Semi-Supervised Sentence Representation Learning FrameworkMain24 citations
- GraphQ IR: Unifying the Semantic Parsing of Graph Query Languages with One Intermediate RepresentationMain24 citations
- How “Multi” is Multi-Document Summarization?Main24 citations
- Multi-View Reasoning: Consistent Contrastive Learning for Math Word Problemfinding24 citations
- Multilingual Machine Translation with Hyper-AdaptersMain24 citations
- NeuroCounterfactuals: Beyond Minimal-Edit Counterfactuals for Richer Data Augmentationfinding24 citations
- Prompt Conditioned VAE: Enhancing Generative Replay for Lifelong Learning in Task-Oriented DialogueMain24 citations
- SYGMA: A System for Generalizable and Modular Question Answering Over Knowledge Basesfinding24 citations
- Structural generalization is hard for sequence-to-sequence modelsMain24 citations
- Textual Backdoor Attacks Can Be More Harmful via Two Simple TricksMain24 citations
- Zero-Shot Learners for Natural Language Understanding via a Unified Multiple Choice PerspectiveMain24 citations
- Accelerating Learned Sparse Indexes Via Term Impact Decompositionfinding23 citations
- AfriCLIRMatrix: Enabling Cross-Lingual Information Retrieval for African LanguagesMain23 citations
- ArtELingo: A Million Emotion Annotations of WikiArt with Emphasis on Diversity over Language and CultureMain23 citations
- Bloom Library: Multimodal Datasets in 300+ Languages for a Variety of Downstream TasksMain23 citations
- DuReader-Retrieval: A Large-scale Chinese Benchmark for Passage Retrieval from Web Search EngineMain23 citations
- EdgeFormer: A Parameter-Efficient Transformer for On-Device Seq2seq GenerationMain23 citations
- Evaluating Token-Level and Passage-Level Dense Retrieval Models for Math Information Retrievalfinding23 citations
- Exploring Predictive Uncertainty and Calibration in NLP: A Study on the Impact of Method & Data Scarcityfinding23 citations
- Exploring Representation-level Augmentation for Code SearchMain23 citations
- Improving the Sample Efficiency of Prompt Tuning with Domain Adaptationfinding23 citations
- Injecting Domain Knowledge in Language Models for Task-oriented Dialogue SystemsMain23 citations
- Less is More: Summary of Long Instructions is Better for Program SynthesisMain23 citations
- M2D2: A Massively Multi-Domain Language Modeling DatasetMain23 citations
- On the Transformation of Latent Space in Fine-Tuned NLP ModelsMain23 citations
- Prompt-Tuning Can Be Much Better Than Fine-Tuning on Cross-lingual Understanding With Multilingual Language Modelsfinding23 citations
- ReaRev: Adaptive Reasoning for Question Answering over Knowledge Graphsfinding23 citations
- StoryER: Automatic Story Evaluation via Ranking, Rating and ReasoningMain23 citations
- Transforming Sequence Tagging Into A Seq2Seq TaskMain23 citations
- arXivEdits: Understanding the Human Revision Process in Scientific WritingMain23 citations
- Backdoor Attacks in Federated Learning by Rare Embeddings and Gradient EnsemblingMain22 citations
- CDGP: Automatic Cloze Distractor Generation based on Pre-trained Language Modelfinding22 citations
- ConNER: Consistency Training for Cross-lingual Named Entity RecognitionMain22 citations
- Controlling Bias Exposure for Fair Interpretable Predictionsfinding22 citations
- DIGAT: Modeling News Recommendation with Dual-Graph Interactionfinding22 citations
- Detecting Label Errors by Using Pre-Trained Language ModelsMain22 citations
- Entity-level Interaction via Heterogeneous Graph for Multimodal Named Entity Recognitionfinding22 citations
- Explicit Query Rewriting for Conversational Dense RetrievalMain22 citations
- Extractive Summarization of Legal Decisions using Multi-task Learning and Maximal Marginal Relevancefinding22 citations
- FigMemes: A Dataset for Figurative Language Identification in Politically-Opinionated MemesMain22 citations
- Improving Factual Consistency in Summarization with Compression-Based Post-EditingMain22 citations
- Improving Temporal Generalization of Pre-trained Language Models with Lexical Semantic ChangeMain22 citations
- Learning Robust Representations for Continual Relation Extraction via Adversarial Class AugmentationMain22 citations
- Model Cascading: Towards Jointly Improving Efficiency and Accuracy of NLP SystemsMain22 citations
- Multimodal Contrastive Learning via Uni-Modal Coding and Cross-Modal Prediction for Multimodal Sentiment Analysisfinding22 citations
- Neural Machine Translation with Contrastive Translation MemoriesMain22 citations
- Rethinking the Video Sampling and Reasoning Strategies for Temporal Sentence Groundingfinding22 citations
- Revisiting Grammatical Error Correction Evaluation and BeyondMain22 citations
- A Unified Positive-Unlabeled Learning Framework for Document-Level Relation Extraction with Different Levels of LabelingMain21 citations
- APEACH: Attacking Pejorative Expressions with Analysis on Crowd-Generated Hate Speech Evaluation Datasetsfinding21 citations
- Distilling Causal Effect from Miscellaneous Other-Class for Continual Named Entity RecognitionMain21 citations
- Don’t Stop Fine-Tuning: On Training Regimes for Few-Shot Cross-Lingual Transfer with Multilingual Language ModelsMain21 citations
- EtriCA: Event-Triggered Context-Aware Story Generation Augmented by Cross Attentionfinding21 citations
- Fine-grained Category Discovery under Coarse-grained supervision with Hierarchical Weighted Self-contrastive LearningMain21 citations
- Hidden State Variability of Pretrained Language Models Can Guide Computation Reduction for Transfer Learningfinding21 citations
- Inductive Relation Prediction with Logical Reasoning Using Contrastive RepresentationsMain21 citations
- Investigating the Benefits of Free-Form Rationalesfinding21 citations
- LOPS: Learning Order Inspired Pseudo-Label Selection for Weakly Supervised Text Classificationfinding21 citations
- LVP-M3: Language-aware Visual Prompt for Multilingual Multimodal Machine TranslationMain21 citations
- Long Text and Multi-Table Summarization: Dataset and Methodfinding21 citations
- Open-domain Question Answering via Chain of Reasoning over Heterogeneous Knowledgefinding21 citations
- Pair-Based Joint Encoding with Relational Graph Convolutional Networks for Emotion-Cause Pair ExtractionMain21 citations
- T-Modules: Translation Modules for Zero-Shot Cross-Modal Machine TranslationMain21 citations
- Transformer-based Entity Typing in Knowledge GraphsMain21 citations
- UniRPG: Unified Discrete Reasoning over Table and Text as Program GenerationMain21 citations
- Visual Named Entity Linking: A New Dataset and A Baselinefinding21 citations
- Z-LaVI: Zero-Shot Language Solver Fueled by Visual ImaginationMain21 citations
- “It’s Not Just Hate”: A Multi-Dimensional Perspective on Detecting Harmful Speech OnlineMain21 citations
- A Few More Examples May Be Worth Billions of Parametersfinding20 citations
- ASDOT: Any-Shot Data-to-Text Generation with Pretrained Language Modelsfinding20 citations
- Abstractive Summarization Guided by Latent Hierarchical Document StructureMain20 citations
- An Adaptive Logical Rule Embedding Model for Inductive Reasoning over Temporal Knowledge GraphsMain20 citations
- Benchmarking Language Models for Code Syntax Understandingfinding20 citations
- BioLORD: Learning Ontological Representations from Definitions for Biomedical Concepts and their Textual Descriptionsfinding20 citations
- DSM: Question Generation over Knowledge Base via Modeling Diverse Subgraphs with Meta-learnerMain20 citations
- Data Selection Curriculum for Neural Machine Translationfinding20 citations
- Debiasing Masks: A New Framework for Shortcut Mitigation in NLUMain20 citations
- Distillation-Resistant Watermarking for Model Protection in NLPfinding20 citations
- Does Simultaneous Speech Translation need Simultaneous Models?finding20 citations
- ELMER: A Non-Autoregressive Pre-trained Language Model for Efficient and Effective Text GenerationMain20 citations
- Exploring Dual Encoder Architectures for Question AnsweringMain20 citations
- Exploring The Landscape of Distributional Robustness for Question Answering Modelsfinding20 citations
- GREENER: Graph Neural Networks for News Media ProfilingMain20 citations
- Guiding Neural Story Generation with Reader Modelsfinding20 citations
- Improving Zero-Shot Multilingual Translation with Universal Representations and Cross-Mappingfinding20 citations
- Learning Inter-Entity-Interaction for Few-Shot Knowledge Graph CompletionMain20 citations
- MedJEx: A Medical Jargon Extraction Model with Wiki’s Hyperlink Span and Contextualized Masked Language Model ScoreMain20 citations
- Natural Language Deduction with Incomplete InformationMain20 citations
- Rethinking Positional Encoding in Tree Transformer for Code RepresentationMain20 citations
- SHARE: a System for Hierarchical Assistive Recipe EditingMain20 citations
- Soft-Labeled Contrastive Pre-Training for Function-Level Code Representationfinding20 citations
- TextFusion: Privacy-Preserving Pre-trained Model Inference via Token FusionMain20 citations
- Train Flat, Then Compress: Sharpness-Aware Minimization Learns More Compressible Modelsfinding20 citations
- Trial2Vec: Zero-Shot Clinical Trial Document Similarity Search using Self-Supervisionfinding20 citations
- WR-One2Set: Towards Well-Calibrated Keyphrase GenerationMain20 citations
- A Neural-Symbolic Approach to Natural Language Understandingfinding19 citations
- Clip-Tuning: Towards Derivative-free Prompt Learning with a Mixture of Rewardsfinding19 citations
- Contrastive Learning with Prompt-derived Virtual Semantic Prototypes for Unsupervised Sentence Embeddingfinding19 citations
- Data-Efficient Strategies for Expanding Hate Speech Detection into Under-Resourced LanguagesMain19 citations
- Do Vision-and-Language Transformers Learn Grounded Predicate-Noun Dependencies?Main19 citations
- Does Your Model Classify Entities Reasonably? Diagnosing and Mitigating Spurious Correlations in Entity TypingMain19 citations
- Geographic Citation Gaps in NLP ResearchMain19 citations
- Hierarchical Multi-Label Classification of Scientific DocumentsMain19 citations
- Improving Iterative Text Revision by Learning Where to Edit from Other Revision TasksMain19 citations
- Information-Theoretic Text Hallucination Reduction for Video-grounded DialogueMain19 citations
- Invariant Language ModelingMain19 citations
- KECP: Knowledge Enhanced Contrastive Prompting for Few-shot Extractive Question AnsweringMain19 citations
- Learning to Decompose: Hypothetical Question Decomposition Based on Comparable TextsMain19 citations
- Leveraging QA Datasets to Improve Generative Data AugmentationMain19 citations
- MetaTKG: Learning Evolutionary Meta-Knowledge for Temporal Knowledge Graph ReasoningMain19 citations
- Multilingual Relation Classification via Efficient and Effective PromptingMain19 citations
- On the Calibration of Massively Multilingual Language ModelsMain19 citations
- Reproducibility in Computational Linguistics: Is Source Code Enough?Main19 citations
- SMARTAVE: Structured Multimodal Transformer for Product Attribute Value Extractionfinding19 citations
- TextHacker: Learning based Hybrid Local Search Algorithm for Text Hard-label Adversarial Attackfinding19 citations
- Textual Manifold-based Defense Against Natural Language Adversarial ExamplesMain19 citations
- Tiny-Attention Adapter: Contexts Are More Important Than the Number of ParametersMain19 citations
- Topic Modeling by Clustering Language Model Embeddings: Human Validation on an Industry DatasetIndustry19 citations
- TranS: Transition-based Knowledge Graph Embedding with Synthetic Relation Representationfinding19 citations
- Why Do You Feel This Way? Summarizing Triggers of Emotions in Social Media PostsMain19 citations
- A Unified Neural Network Model for Readability Assessment with Feature Projection and Length-Balanced LossMain18 citations
- BERT in Plutarch’s ShadowsMain18 citations
- Eliciting Knowledge from Large Pre-Trained Models for Unsupervised Knowledge-Grounded ConversationMain18 citations
- Entity-Focused Dense Passage Retrieval for Outside-Knowledge Visual Question AnsweringMain18 citations
- Fine-Tuning Pre-trained Transformers into Decaying Fast WeightsMain18 citations
- Graph-based Model Generation for Few-Shot Relation ExtractionMain18 citations
- LiteVL: Efficient Video-Language Learning with Enhanced Spatial-Temporal ModelingMain18 citations
- Metric-guided Distillation: Distilling Knowledge from the Metric to Ranker and Retriever for Generative Commonsense ReasoningMain18 citations
- One size does not fit all: Investigating strategies for differentially-private learning across NLP tasksMain18 citations
- Open-Vocabulary Argument Role Prediction For Event Extractionfinding18 citations
- Pre-training Transformer Models with Sentence-Level Objectives for Answer Sentence SelectionMain18 citations
- Prompting ELECTRA: Few-Shot Learning with Discriminative Pre-Trained ModelsMain18 citations
- Stanceosaurus: Classifying Stance Towards Multicultural MisinformationMain18 citations
- Token-level Sequence Labeling for Spoken Language Understanding using Compositional End-to-End Modelsfinding18 citations
- Unifying Data Perspectivism and Personalization: An Application to Social NormsMain18 citations
- Wait-info Policy: Balancing Source and Target at Information Level for Simultaneous Machine Translationfinding18 citations
- Beyond Counting Datasets: A Survey of Multilingual Dataset Construction and Necessary Resourcesfinding17 citations
- Bridging Fairness and Environmental Sustainability in Natural Language ProcessingMain17 citations
- CDConv: A Benchmark for Contradiction Detection in Chinese ConversationsMain17 citations
- CTL++: Evaluating Generalization on Never-Seen Compositional Patterns of Known Functions, and Compatibility of Neural RepresentationsMain17 citations
- Capturing Global Structural Information in Long Document Question Answering with Compressive Graph Selector NetworkMain17 citations
- Chaining Simultaneous Thoughts for Numerical Reasoningfinding17 citations
- Context-Situated Pun GenerationMain17 citations
- Distill The Image to Nowhere: Inversion Knowledge Distillation for Multimodal Machine TranslationMain17 citations
- Efficient Zero-shot Event Extraction with Context-Definition Alignmentfinding17 citations
- Efficiently Tuned Parameters Are Task EmbeddingsMain17 citations
- FETA: A Benchmark for Few-Sample Task Transfer in Open-Domain DialogueMain17 citations
- Factorizing Content and Budget Decisions in Abstractive Summarization of Long DocumentsMain17 citations
- FiE: Building a Global Probability Space by Leveraging Early Fusion in Encoder for Open-Domain Question AnsweringMain17 citations
- From Spelling to Grammar: A New Framework for Chinese Grammatical Error Correctionfinding17 citations
- Generative Entity Typing with Curriculum LearningMain17 citations
- MBTI Personality Prediction for Fictional Characters Using Movie Scriptsfinding17 citations
- MEE: A Novel Multilingual Event Extraction DatasetMain17 citations
- Model and Data Transfer for Cross-Lingual Sequence Labelling in Zero-Resource Settingsfinding17 citations
- PAIR: Prompt-Aware margIn Ranking for Counselor Reflection Scoring in Motivational InterviewingMain17 citations
- Q-TOD: A Query-driven Task-oriented Dialogue SystemMain17 citations
- R2D2: Robust Data-to-Text with Replacement DetectionMain17 citations
- SLING: Sino Linguistic Evaluation of Large Language ModelsMain17 citations
- Sequentially Controlled Text Generationfinding17 citations
- Task Compass: Scaling Multi-task Pre-training with Task Prefixfinding17 citations
- Understanding Jargon: Combining Extraction and Generation for Definition ModelingMain17 citations
- A Benchmark and Dataset for Post-OCR text correction in Sanskritfinding16 citations
- A Template-based Method for Constrained Neural Machine TranslationMain16 citations
- A Two-Stage Approach towards Generalization in Knowledge Base Question Answeringfinding16 citations
- An Error-Guided Correction Model for Chinese Spelling Error Correctionfinding16 citations
- Assist Non-native Viewers: Multimodal Cross-Lingual Summarization for How2 VideosMain16 citations
- AutoCAD: Automatically Generate Counterfactuals for Mitigating Shortcut Learningfinding16 citations
- BotsTalk: Machine-sourced Framework for Automatic Curation of Large-scale Multi-skill Dialogue DatasetsMain16 citations
- CODER: An efficient framework for improving retrieval through COntextual Document Embedding RerankingMain16 citations
- CiteSum: Citation Text-guided Scientific Extreme Summarization and Domain Adaptation with Limited SupervisionMain16 citations
- Don’t Prompt, Search! Mining-based Zero-Shot Learning with Language ModelsMain16 citations
- Enhancing Multilingual Language Model with Massive Multilingual Knowledge TriplesMain16 citations
- Evidence > Intuition: Transferability Estimation for Encoder SelectionMain16 citations
- Graph Embeddings for Argumentation Quality Assessmentfinding16 citations
- HCL-TAT: A Hybrid Contrastive Learning Method for Few-shot Event Detection with Task-Adaptive Thresholdfinding16 citations
- Improved grammatical error correction by ranking elementary editsMain16 citations
- InforMask: Unsupervised Informative Masking for Language Model PretrainingMain16 citations
- Lexi: Self-Supervised Learning of the UI Languagefinding16 citations
- Low-resource Interactive Active Labeling for Fine-tuning Language Modelsfinding16 citations
- Non-Parametric Domain Adaptation for End-to-End Speech TranslationMain16 citations
- Not All Errors are Equal: Learning Text Generation Metrics using Stratified Error Synthesisfinding16 citations
- Referee: Reference-Free Sentence Summarization with Sharper Controllability through Symbolic Knowledge DistillationMain16 citations
- Reproducibility Issues for BERT-based Evaluation MetricsMain16 citations
- Robustness of Demonstration-based Learning Under Limited Data ScenarioMain16 citations
- The Curious Case of Absolute Position Embeddingsfinding16 citations
- Towards Summary Candidates FusionMain16 citations
- Towards Table-to-Text Generation with Pretrained Language Model: A Table Structure Understanding and Text Deliberating ApproachMain16 citations
- Watch the Neighbors: A Unified K-Nearest Neighbor Contrastive Learning Framework for OOD Intent DiscoveryMain16 citations
- Weakly-Supervised Temporal Article GroundingMain16 citations
- m4 Adapter: Multilingual Multi-Domain Adaptation for Machine Translation with a Meta-Adapterfinding16 citations
- A Span-based Multimodal Variational Autoencoder for Semi-supervised Multimodal Named Entity RecognitionMain15 citations
- BanglaRQA: A Benchmark Dataset for Under-resourced Bangla Language Reading Comprehension-based Question Answering with Diverse Question-Answer Typesfinding15 citations
- CARE: Causality Reasoning for Empathetic Responses by Conditional Graph Generationfinding15 citations
- CAT-probing: A Metric-based Approach to Interpret How Pre-trained Models for Programming Language Attend Code Structurefinding15 citations
- CGoDial: A Large-Scale Benchmark for Chinese Goal-oriented Dialog EvaluationMain15 citations
- CRIPP-VQA: Counterfactual Reasoning about Implicit Physical Properties via Video Question AnsweringMain15 citations
- Can Transformers Reason in Fragments of Natural Language?Main15 citations
- Conditional Supervised Contrastive Learning for Fair Text Classificationfinding15 citations
- Counterfactual Data Augmentation via Perspective Transition for Open-Domain DialoguesMain15 citations
- DANLI: Deliberative Agent for Following Natural Language InstructionsMain15 citations
- DEER: Descriptive Knowledge Graph for Explaining Entity RelationshipsMain15 citations
- DRLK: Dynamic Hierarchical Reasoning with Language Model and Knowledge Graph for Question AnsweringMain15 citations
- Dim-Krum: Backdoor-Resistant Federated Learning for NLP with Dimension-wise Krum-Based Aggregationfinding15 citations
- Does Self-Rationalization Improve Robustness to Spurious Correlations?Main15 citations
- EDIN: An End-to-end Benchmark and Pipeline for Unknown Entity Discovery and IndexingMain15 citations
- ER-Test: Evaluating Explanation Regularization Methods for Language Modelsfinding15 citations
- Estimating Soft Labels for Out-of-Domain Intent DetectionMain15 citations
- Extending Logic Explained Networks to Text ClassificationMain15 citations
- Federated Continual Learning for Text Classification via Selective Inter-client Transferfinding15 citations
- Fine-grained Contrastive Learning for Relation ExtractionMain15 citations
- FineD-Eval: Fine-grained Automatic Dialogue-Level EvaluationMain15 citations
- Formulating Few-shot Fine-tuning Towards Language Model Pre-training: A Pilot Study on Named Entity Recognitionfinding15 citations
- Is MultiWOZ a Solved Task? An Interactive TOD Evaluation Framework with User Simulatorfinding15 citations
- Joint Completion and Alignment of Multilingual Knowledge GraphsMain15 citations
- KPDROP: Improving Absent Keyphrase Generationfinding15 citations
- Logical Reasoning with Span-Level Predictions for Interpretable and Robust NLI ModelsMain15 citations
- Mask the Correct Tokens: An Embarrassingly Simple Approach for Error CorrectionMain15 citations
- Modeling Information Change in Science Communication with Semantically Matched ParaphrasesMain15 citations
- MuGER2: Multi-Granularity Evidence Retrieval and Reasoning for Hybrid Question Answeringfinding15 citations
- Scaling Laws Under the Microscope: Predicting Transformer Performance from Small Scale Experimentsfinding15 citations
- Search to Pass Messages for Temporal Knowledge Graph Completionfinding15 citations
- Self-supervised Graph Masking Pre-training for Graph-to-Text GenerationMain15 citations
- Speaker Overlap-aware Neural Diarization for Multi-party Meeting AnalysisMain15 citations
- Structure-Unified M-Tree Coding Solver for Math Word ProblemMain15 citations
- System 1 + System 2 = Better World: Neural-Symbolic Chain of Logic Reasoningfinding15 citations
- TRIPS: Efficient Vision-and-Language Pre-training with Text-Relevant Image Patch SelectionMain15 citations
- Towards Knowledge-Intensive Text-to-SQL Semantic Parsing with Formulaic KnowledgeMain15 citations
- Visual Spatial Description: Controlled Spatial-Oriented Image-to-Text GenerationMain15 citations
- Viterbi Decoding of Directed Acyclic Transformer for Non-Autoregressive Machine Translationfinding15 citations
- WeDef: Weakly Supervised Backdoor Defense for Text ClassificationMain15 citations
- A Unified Encoder-Decoder Framework with Entity MemoryMain14 citations
- A Unified Framework for Pun Generation with Humor Principlesfinding14 citations
- Are Hard Examples also Harder to Explain? A Study with Human and Model-Generated ExplanationsMain14 citations
- Discovering Low-rank Subspaces for Language-agnostic Multilingual RepresentationsMain14 citations
- Disentangling Uncertainty in Machine Translation EvaluationMain14 citations
- Efficient Nearest Neighbor Search for Cross-Encoder Models using Matrix FactorizationMain14 citations
- Empowering the Fact-checkers! Automatic Identification of Claim Spans on TwitterMain14 citations
- Entity-level Sentiment Analysis in Contact Center Telephone ConversationsIndustry14 citations
- FaD-VLP: Fashion Vision-and-Language Pre-training towards Unified Retrieval and CaptioningMain14 citations
- Fast-R2D2: A Pretrained Recursive Neural Network based on Pruned CKY for Grammar Induction and Text RepresentationMain14 citations
- Few-Shot Anaphora Resolution in Scientific Protocols via Mixtures of In-Context Expertsfinding14 citations
- Generating Information-Seeking Conversations from Unlabeled DocumentsMain14 citations
- History-Aware Hierarchical Transformer for Multi-session Open-domain Dialogue Systemfinding14 citations
- Improving Bilingual Lexicon Induction with Cross-Encoder Rerankingfinding14 citations
- Improving Machine Translation with Phrase Pair Injection and Corpus FilteringMain14 citations
- Knowledge Stimulated Contrastive Prompting for Low-Resource Stance Detectionfinding14 citations
- Label-aware Multi-level Contrastive Learning for Cross-lingual Spoken Language UnderstandingMain14 citations
- Learning with Rejection for Abstractive Text SummarizationMain14 citations
- Measuring and Improving Semantic Diversity of Dialogue Generationfinding14 citations
- Multilingual Multimodal Learning with Machine Translated Textfinding14 citations
- Numerical Optimizations for Weighted Low-rank Estimation on Language ModelsMain14 citations
- Parameter-Efficient Tuning Makes a Good Classification HeadMain14 citations
- ReSel: N-ary Relation Extraction from Scientific Text and Tables by Learning to Retrieve and SelectMain14 citations
- Representation Learning for Resource-Constrained Keyphrase Generationfinding14 citations
- RobustLR: A Diagnostic Benchmark for Evaluating Logical Robustness of Deductive ReasonersMain14 citations
- Style Transfer as Data Augmentation: A Case Study on Named Entity RecognitionMain14 citations
- Systematicity in GPT-3’s Interpretation of Novel English Noun Compoundsfinding14 citations
- TASA: Deceiving Question Answering Models by Twin Answer Sentences AttackMain14 citations
- Unsupervised Multi-Granularity Summarizationfinding14 citations
- A Dataset for Hyper-Relational Extraction and a Cube-Filling ApproachMain13 citations
- A Simple and Strong Baseline for End-to-End Neural RST-style Discourse Parsingfinding13 citations
- Attention weights accurately predict language representations in the brainfinding13 citations
- BioNLI: Generating a Biomedical NLI Dataset Using Lexico-semantic Constraints for Adversarial Examplesfinding13 citations
- Breaking the Representation Bottleneck of Chinese Characters: Neural Machine Translation with Stroke Sequence ModelingMain13 citations
- Complex Hyperbolic Knowledge Graph Embeddings with Fast Fourier TransformMain13 citations
- Don’t Copy the Teacher: Data and Model Challenges in Embodied DialogueMain13 citations
- Efficient Pre-training of Masked Language Model via Concept-based Curriculum MaskingMain13 citations
- Evaluating and Improving Factuality in Multimodal Abstractive SummarizationMain13 citations
- Event-Centric Question Answering via Contrastive Learning and Invertible Event Transformationfinding13 citations
- Few-Shot Out-of-Domain Transfer Learning of Natural Language Explanations in a Label-Abundant Setupfinding13 citations
- Finding Dataset Shortcuts with Grammar InductionMain13 citations
- G3: Geolocation via Guidebook Groundingfinding13 citations
- Gender Bias in Meta-Embeddingsfinding13 citations
- Generative Data Augmentation with Contrastive Learning for Zero-Shot Stance DetectionMain13 citations
- Hypoformer: Hybrid Decomposition Transformer for Edge-friendly Neural Machine TranslationMain13 citations
- Improving Event Coreference Resolution Using Document-level and Topic-level InformationMain13 citations
- Improving Generalization of Pre-trained Language Models via Stochastic Weight Averagingfinding13 citations
- Increasing Visual Awareness in Multimodal Neural Machine Translation from an Information Theoretic PerspectiveMain13 citations
- Inferring Implicit Relations in Complex Questions with Language Modelsfinding13 citations
- Is anisotropy really the cause of BERT embeddings not being semantic?finding13 citations
- JamPatoisNLI: A Jamaican Patois Natural Language Inference Datasetfinding13 citations
- Label-Driven Denoising Framework for Multi-Label Few-Shot Aspect Category Detectionfinding13 citations
- Learning Instructions with Unlabeled Data for Zero-Shot Cross-Task GeneralizationMain13 citations
- Linguistic Corpus Annotation for Automatic Text Simplification EvaluationMain13 citations
- MM-Align: Learning Optimal Transport-based Alignment Dynamics for Fast and Accurate Inference on Missing Modality SequencesMain13 citations
- Measurement Extraction with Natural Language Processing: A Reviewfinding13 citations
- Mitigating Spurious Correlation in Natural Language Understanding with Counterfactual InferenceMain13 citations
- Mixed-modality Representation Learning and Pre-training for Joint Table-and-Text Retrieval in OpenQAfinding13 citations
- Model Criticism for Long-Form Text GenerationMain13 citations
- Natural Logic-guided Autoregressive Multi-hop Document Retrieval for Fact VerificationMain13 citations
- Open Relation and Event Type Discovery with Type AbstractionMain13 citations
- PAR: Political Actor Representation Learning with Social Context and Expert KnowledgeMain13 citations
- PAUQ: Text-to-SQL in Russianfinding13 citations
- PcMSP: A Dataset for Scientific Action Graphs Extraction from Polycrystalline Materials Synthesis Procedure Textfinding13 citations
- PreQuEL: Quality Estimation of Machine Translation Outputs in AdvanceMain13 citations
- Probing for Incremental Parse States in Autoregressive Language Modelsfinding13 citations
- Prompt-based Distribution Alignment for Domain Generalization in Text ClassificationMain13 citations
- RLET: A Reinforcement Learning Based Approach for Explainable QA with Entailment TreesMain13 citations
- SMiLE: Schema-augmented Multi-level Contrastive Learning for Knowledge Graph Link Predictionfinding13 citations
- Sparse Mixers: Combining MoE and Mixing to build a more efficient BERTfinding13 citations
- Structural Contrastive Representation Learning for Zero-shot Multi-label Text Classificationfinding13 citations
- Towards Better Document-level Relation Extraction via Iterative InferenceMain13 citations
- Towards Intention Understanding in Suicidal Risk Assessment with Natural Language Processingfinding13 citations
- Towards Realistic Low-resource Relation Extraction: A Benchmark with Empirical Baseline Studyfinding13 citations
- TyDiP: A Dataset for Politeness Classification in Nine Typologically Diverse Languagesfinding13 citations
- Using Commonsense Knowledge to Answer Why-QuestionsMain13 citations
- What Do Compressed Multilingual Machine Translation Models Forget?finding13 citations
- When Can Transformers Ground and Compose: Insights from Compositional Generalization BenchmarksMain13 citations
- XDoc: Unified Pre-training for Cross-Format Document Understandingfinding13 citations
- A Fine-grained Chinese Software Privacy Policy Dataset for Sequence Labeling and Regulation Compliant IdentificationMain12 citations
- A Framework for Adapting Pre-Trained Language Models to Knowledge Graph CompletionMain12 citations
- Back to the Future: Bidirectional Information Decoupling Network for Multi-turn Dialogue ModelingMain12 citations
- CGF: Constrained Generation Framework for Query Rewriting in Conversational AIIndustry12 citations
- CISLR: Corpus for Indian Sign Language RecognitionMain12 citations
- Continual Learning of Neural Machine Translation within Low Forgetting Risk RegionsMain12 citations
- Curriculum Prompt Learning with Self-Training for Abstractive Dialogue SummarizationMain12 citations
- Dependency Parsing via Sequence Generationfinding12 citations
- Discovering Differences in the Representation of People using Contextualized Semantic AxesMain12 citations
- DivEMT: Neural Machine Translation Post-Editing Effort Across Typologically Diverse LanguagesMain12 citations
- Doc2Bot: Accessing Heterogeneous Documents via Conversational Botsfinding12 citations
- DropMix: A Textual Data Augmentation Combining Dropout with MixupMain12 citations
- Eliciting and Understanding Cross-task Skills with Task-level Mixture-of-Expertsfinding12 citations
- EnDex: Evaluation of Dialogue Engagingness at Scalefinding12 citations
- Evaluating the Knowledge Dependency of QuestionsMain12 citations
- Few-Shot (Dis)Agreement Identification in Online Discussions with Regularized and Augmented Meta-Learningfinding12 citations
- Finding Memo: Extractive Memorization in Constrained Sequence Generation Tasksfinding12 citations
- G-MAP: General Memory-Augmented Pre-trained Language Model for Domain TasksMain12 citations
- HydraSum: Disentangling Style Features in Text Summarization with Multi-Decoder ModelsMain12 citations
- IDK-MRC: Unanswerable Questions for Indonesian Machine Reading ComprehensionMain12 citations
- Improving Complex Knowledge Base Question Answering via Question-to-Action and Question-to-Question AlignmentMain12 citations
- Invernet: An Inversion Attack Framework to Infer Fine-Tuning Datasets through Word Embeddingsfinding12 citations
- Knowledge-Enhanced Self-Supervised Prototypical Network for Few-Shot Event Detectionfinding12 citations
- Learning Cross-Task Dependencies for Joint Extraction of Entities, Events, Event Arguments, and RelationsMain12 citations
- MGDoc: Pre-training with Multi-granular Hierarchy for Document Image UnderstandingMain12 citations
- MICO: A Multi-alternative Contrastive Learning Framework for Commonsense Knowledge Representationfinding12 citations
- Meta-Learning Fast Weight Language ModelsMain12 citations
- Multi-Label Intent Detection via Contrastive Task Specialization of Sentence EncodersMain12 citations
- Multimodal Knowledge Learning for Named Entity Disambiguationfinding12 citations
- Normalized Contrastive Learning for Text-Video RetrievalMain12 citations
- On the Impact of Temporal Concept Drift on Model Explanationsfinding12 citations
- Pre-training Language Models with Deterministic Factual KnowledgeMain12 citations
- RED-ACE: Robust Error Detection for ASR using Confidence EmbeddingsMain12 citations
- Robots-Dont-Cry: Understanding Falsely Anthropomorphic Utterances in Dialog SystemsMain12 citations
- Robust Question Answering against Distribution Shifts with Test-Time Adaption: An Empirical Studyfinding12 citations
- Scientific Paper Extractive Summarization Enhanced by Citation GraphsMain12 citations
- Self-supervised Cross-modal Pretraining for Speech Emotion Recognition and Sentiment Analysisfinding12 citations
- SetGNER: General Named Entity Recognition as Entity Set GenerationMain12 citations
- Simple Questions Generate Named Entity Recognition DatasetsMain12 citations
- Syntactic Multi-view Learning for Open Information ExtractionMain12 citations
- Towards relation extraction from speechMain12 citations
- Turning Fixed to Adaptive: Integrating Post-Evaluation into Simultaneous Machine Translationfinding12 citations
- Two is Better than Many? Binary Classification as an Effective Approach to Multi-Choice Question AnsweringMain12 citations
- Unsupervised Syntactically Controlled Paraphrase Generation with Abstract Meaning Representationsfinding12 citations
- WeTS: A Benchmark for Translation SuggestionMain12 citations
- X-FACTOR: A Cross-metric Evaluation of Factual Correctness in Abstractive SummarizationMain12 citations
- Yes-Yes-Yes: Proactive Data Collection for ACL Rolling Review and Beyondfinding12 citations
- A Multilingual Perspective Towards the Evaluation of Attribution Methods in Natural Language InferenceMain11 citations
- Ask-and-Verify: Span Candidate Generation and Verification for Attribute Value ExtractionIndustry11 citations
- CQR-SQL: Conversational Question Reformulation Enhanced Context-Dependent Text-to-SQL Parsersfinding11 citations
- Constructing Highly Inductive Contexts for Dialogue Safety through Controllable Reverse Generationfinding11 citations
- Controlled Text ReductionMain11 citations
- Counterfactual Recipe Generation: Exploring Compositional Generalization in a Realistic ScenarioMain11 citations
- Cross-document Event Coreference Search: Task, Dataset and ModelingMain11 citations
- Discord Questions: A Computational Approach To Diversity Analysis in News Coveragefinding11 citations
- Enhancing Automatic Readability Assessment with Pre-training and Soft Labels for Ordinal Regressionfinding11 citations
- Enhancing Out-of-Distribution Detection in Natural Language Understanding via Implicit Layer Ensemblefinding11 citations
- EvEntS ReaLM: Event Reasoning of Entity States via Language ModelsMain11 citations
- ExPUNations: Augmenting Puns with Keywords and ExplanationsMain11 citations
- FRSUM: Towards Faithful Abstractive Summarization via Enhancing Factual Robustnessfinding11 citations
- Focus! Relevant and Sufficient Context Selection for News Image Captioningfinding11 citations
- How sensitive are translation systems to extra contexts? Mitigating gender bias in Neural Machine Translation models through relevant contexts.finding11 citations
- Improving Semantic Matching through Dependency-Enhanced Pre-trained Model with Adaptive Fusionfinding11 citations
- Keyphrase Generation Beyond the Boundaries of Title and Abstractfinding11 citations
- Let the CAT out of the bag: Contrastive Attributed explanations for TextMain11 citations
- Looking at the Overlooked: An Analysis on the Word-Overlap Bias in Natural Language InferenceMain11 citations
- MetaASSIST: Robust Dialogue State Tracking with Meta LearningMain11 citations
- Mind Your Bias: A Critical Review of Bias Detection Methods for Contextual Language Modelsfinding11 citations
- Neural-based Mixture Probabilistic Query Embedding for Answering FOL queries on Knowledge GraphsMain11 citations
- Opening up Minds with Argumentative Dialoguesfinding11 citations
- QRelScore: Better Evaluating Generated Questions with Deeper Understanding of Context-aware RelevanceMain11 citations
- Quadapter: Adapter for GPT-2 Quantizationfinding11 citations
- RAPO: An Adaptive Ranking Paradigm for Bilingual Lexicon InductionMain11 citations
- SAT: Improving Semi-Supervised Text Classification with Simple Instance-Adaptive Self-Trainingfinding11 citations
- SensePOLAR: Word sense aware interpretability for pre-trained contextual word embeddingsfinding11 citations
- SocioProbe: What, When, and Where Language Models Learn about SociodemographicsMain11 citations
- Textual Enhanced Contrastive Learning for Solving Math Word Problemsfinding11 citations
- Topical Segmentation of Spoken Narratives: A Test Case on Holocaust Survivor TestimoniesMain11 citations
- TranSHER: Translating Knowledge Graph Embedding with Hyper-Ellipsoidal RestrictionMain11 citations
- Understanding and Improving Knowledge Distillation for Quantization Aware Training of Large Transformer EncodersMain11 citations
- Unsupervised Text Deidentificationfinding11 citations
- Vector-Quantized Input-Contextualized Soft Prompts for Natural Language UnderstandingMain11 citations
- Wider & Closer: Mixture of Short-channel Distillers for Zero-shot Cross-lingual Named Entity RecognitionMain11 citations
- Adapters for Enhanced Modeling of Multilingual Knowledge and Textfinding10 citations
- Adaptive Label Smoothing with Self-Knowledge in Natural Language GenerationMain10 citations
- Are representations built from the ground up? An empirical examination of local composition in language modelsMain10 citations
- Argument Mining for Review Helpfulness PredictionMain10 citations
- Automatic Document Selection for Efficient Encoder PretrainingMain10 citations
- Better Hit the Nail on the Head than Beat around the Bush: Removing Protected Attributes with a Single ProjectionMain10 citations
- CANarEx: Contextually Aware Narrative Extraction for Semantically Rich Text-as-data Applicationsfinding10 citations
- Calibrating Imbalanced Classifiers with Focal Loss: An Empirical StudyIndustry10 citations
- Calibrating Trust of Multi-Hop Question Answering Systems with Decompositional Probesfinding10 citations
- Conditional set generation using Seq2seq modelsMain10 citations
- Contrastive Demonstration Tuning for Pre-trained Language Modelsfinding10 citations
- Controllable Fake Document Infilling for Cyber Deceptionfinding10 citations
- CrisisLTLSum: A Benchmark for Local Crisis Event Timeline Extraction and Summarizationfinding10 citations
- Cross-Linguistic Syntactic Difference in Multilingual BERT: How Good is It and How Does It Affect Transfer?Main10 citations
- Decoding a Neural Retriever’s Latent Space for Query SuggestionMain10 citations
- Dial2vec: Self-Guided Contrastive Learning of Unsupervised Dialogue EmbeddingsMain10 citations
- Do Charge Prediction Models Learn Legal Theory?finding10 citations
- Do Language Models Understand Measurements?finding10 citations
- Efficient Adversarial Training with Robust Early-Bird TicketsMain10 citations
- EntityCS: Improving Zero-Shot Cross-lingual Transfer with Entity-Centric Code Switchingfinding10 citations
- Experimental Standards for Deep Learning in Natural Language Processing Researchfinding10 citations
- ExpertPLM: Pre-training Expert Representation for Expert Findingfinding10 citations
- Factual Accuracy is not Enough: Planning Consistent Description Order for Radiology Report GenerationMain10 citations
- Few-shot Query-Focused Summarization with Prefix-MergingMain10 citations
- Holistic Sentence Embeddings for Better Out-of-Distribution Detectionfinding10 citations
- How to disagree well: Investigating the dispute tactics used on WikipediaMain10 citations
- Improving HowNet-Based Chinese Word Sense Disambiguation with Translationsfinding10 citations
- Knowledge-augmented Self-training of A Question Rewriter for Conversational Knowledge Base Question Answeringfinding10 citations
- LADIS: Language Disentanglement for 3D Shape Editingfinding10 citations
- Language Models Are Poor Learners of Directional Inferencefinding10 citations
- MatchPrompt: Prompt-based Open Relation Extraction with Semantic Consistency Guided ClusteringMain10 citations
- Modal-specific Pseudo Query Generation for Video Corpus Moment RetrievalMain10 citations
- Multilingual SubEvent Relation Extraction: A Novel Dataset and Structure Induction Methodfinding10 citations
- Mutual Exclusivity Training and Primitive Augmentation to Induce CompositionalityMain10 citations
- PM2F2N: Patient Multi-view Multi-modal Feature Fusion Networks for Clinical Outcome Predictionfinding10 citations
- PaCo: Preconditions Attributed to Commonsense Knowledgefinding10 citations
- Passage-Mask: A Learnable Regularization Strategy for Retriever-Reader ModelsMain10 citations
- Predicting Fine-Tuning Performance with ProbingMain10 citations
- Query-based Instance Discrimination Network for Relational Triple ExtractionMain10 citations
- Residual Learning of Neural Text Generation with n-gram Language Modelfinding10 citations
- Sarcasm Detection is Way Too Easy! An Empirical Comparison of Human and Machine Sarcasm Detectionfinding10 citations
- Semi-supervised New Slot Discovery with Incremental Clusteringfinding10 citations
- Simple but Challenging: Natural Language Inference Models Fail on Simple Sentencesfinding10 citations
- SubeventWriter: Iterative Sub-event Sequence Generation with Coherence ControllerMain10 citations
- TABS: Efficient Textual Adversarial Attack for Pre-trained NL Code Model Using Semantic Beam SearchMain10 citations
- The Undesirable Dependence on Frequency of Gender Bias Metrics Based on Word Embeddingsfinding10 citations
- Time-aware Prompting for Text Generationfinding10 citations
- Title2Event: Benchmarking Open Event Extraction with a Large-scale Chinese Title DatasetMain10 citations
- Toward the Limitation of Code-Switching in Cross-Lingual TransferMain10 citations
- Towards Robust NLG Bias Evaluation with Syntactically-diverse Promptsfinding10 citations
- TransLIST: A Transformer-Based Linguistically Informed Sanskrit Tokenizerfinding10 citations
- Transfer Learning from Semantic Role Labeling to Event Argument Extraction with Template-based Slot QueryingMain10 citations
- Unifying the Convergences in Multilingual Neural Machine TranslationMain10 citations
- Unsupervised Boundary-Aware Language Model Pretraining for Chinese Sequence LabelingMain10 citations
- Variational Autoencoder with Disentanglement Priors for Low-Resource Task-Specific Natural Language GenerationMain10 citations
- What Makes Instruction Learning Hard? An Investigation and a New Challenge in a Synthetic EnvironmentMain10 citations
- When does Parameter-Efficient Transfer Learning Work for Machine Translation?Main10 citations
- You Truly Understand What I Need : Intellectual and Friendly Dialog Agents grounding Persona and Knowledgefinding10 citations
- AEG: Argumentative Essay Generation via A Dual-Decoder Model with Content PlanningMain9 citations
- Augmenting Multi-Turn Text-to-SQL Datasets with Self-Playfinding9 citations
- Beyond Additive Fusion: Learning Non-Additive Multimodal Interactionsfinding9 citations
- Bilingual Synchronization: Restoring Translational Relationships with Editing OperationsMain9 citations
- Boosting Natural Language Generation from Instructions with Meta-LearningMain9 citations
- Breakpoint Transformers for Modeling and Tracking Intermediate BeliefsMain9 citations
- Candidate Soups: Fusing Candidate Results Improves Translation Quality for Non-Autoregressive TranslationMain9 citations
- Code Generation From Flowcharts with Texts: A Benchmark Dataset and An Approachfinding9 citations
- Conditioned Masked Language and Image Modeling for Image-Text Dense Retrievalfinding9 citations
- Conversation Disentanglement with Bi-Level Contrastive Learningfinding9 citations
- Cross-Domain Sentiment Classification using Semantic Representationfinding9 citations
- DocInfer: Document-level Natural Language Inference using Optimal Evidence SelectionMain9 citations
- Don’t Just Clean It, Proxy Clean It: Mitigating Bias by Proxy in Pre-Trained Modelsfinding9 citations
- Ethics consideration sections in natural language processing papersMain9 citations
- Extracted BERT Model Leaks More Information than You Think!Main9 citations
- Full-Stack Information Extraction System for Cybersecurity IntelligenceIndustry9 citations
- Gendered Mental Health Stigma in Masked Language ModelsMain9 citations
- Generalizing over Long Tail Concepts for Medical Term NormalizationMain9 citations
- Guiding Neural Entity Alignment with CompatibilityMain9 citations
- GuoFeng: A Benchmark for Zero Pronoun Recovery and TranslationMain9 citations
- Hierarchical Phrase-Based Sequence-to-Sequence LearningMain9 citations
- HumSet: Dataset of Multilingual Information Extraction and Classification for Humanitarian Crises Responsefinding9 citations
- Improving Large-scale Paraphrase Acquisition and GenerationMain9 citations
- Improving Stability of Fine-Tuning Pretrained Language Models via Component-Wise Gradient Norm ClippingMain9 citations
- Influence Functions for Sequence Tagging Modelsfinding9 citations
- Intriguing Properties of Compression on Multilingual ModelsMain9 citations
- IsoVec: Controlling the Relative Isomorphism of Word Embedding SpacesMain9 citations
- JDDC 2.1: A Multimodal Chinese Dialogue Dataset with Joint Tasks of Query Rewriting, Response Generation, Discourse Parsing, and SummarizationMain9 citations
- Joint Multilingual Knowledge Graph Completion and Alignmentfinding9 citations
- KE-GCL: Knowledge Enhanced Graph Contrastive Learning for Commonsense Question Answeringfinding9 citations
- Kernel-Whitening: Overcome Dataset Bias with Isotropic Sentence EmbeddingMain9 citations
- Knowledge Transfer from Answer Ranking to Answer GenerationMain9 citations
- LPC: A Logits and Parameter Calibration Framework for Continual Learningfinding9 citations
- Learning to Generate Question by Asking Question: A Primal-Dual Approach with Uncommon Word GenerationMain9 citations
- Learning to Perform Complex Tasks through Compositional Fine-Tuning of Language Modelsfinding9 citations
- Leveraging Training Dynamics and Self-Training for Text Classificationfinding9 citations
- M3: Multi-level dataset for Multi-document summarisation of Medical studiesfinding9 citations
- MANTa: Efficient Gradient-Based Tokenization for End-to-End Robust Language Modelingfinding9 citations
- Multi-Granularity Optimization for Non-Autoregressive TranslationMain9 citations
- Multilingual Sentence Transformer as A Multilingual Word Alignerfinding9 citations
- NMTScore: A Multilingual Analysis of Translation-based Text Similarity Measuresfinding9 citations
- Non-Autoregressive Neural Machine Translation: A Call for ClarityMain9 citations
- On the Role of Bidirectionality in Language Model Pre-Trainingfinding9 citations
- Probing Structural Knowledge from Pre-trained Language Model for Argumentation Relation Classificationfinding9 citations
- QASem Parsing: Text-to-text Modeling of QA-based SemanticsMain9 citations
- Questioning the Validity of Summarization Datasets and Improving Their Factual ConsistencyMain9 citations
- ROSE: Robust Selective Fine-tuning for Pre-trained Language ModelsMain9 citations
- RaP: Redundancy-aware Video-language Pre-training for Text-Video Retrievalfinding9 citations
- Rescue Implicit and Long-tail Cases: Nearest Neighbor Relation ExtractionMain9 citations
- Rethinking Task-Specific Knowledge Distillation: Contextualized Corpus as Better TextbookMain9 citations
- Revisiting and Advancing Chinese Natural Language Understanding with Accelerated Heterogeneous Knowledge Pre-trainingIndustry9 citations
- STGN: an Implicit Regularization Method for Learning with Noisy Labels in Natural Language ProcessingMain9 citations
- SentBS: Sentence-level Beam Search for Controllable SummarizationMain9 citations
- Simplified Graph Learning for Inductive Short Text ClassificationMain9 citations
- The (Undesired) Attenuation of Human Biases by MultilingualityMain9 citations
- Three Real-World Datasets and Neural Computational Models for Classification Tasks in Patent LandscapingMain9 citations
- Topic-Aware Response Generation in Task-Oriented Dialogue with Unstructured Knowledge Accessfinding9 citations
- Towards Intelligent Clinically-Informed Language Analyses of People with Bipolar Disorder and Schizophreniafinding9 citations
- VarMAE: Pre-training of Variational Masked Autoencoder for Domain-adaptive Language Understandingfinding9 citations
- A Good Neighbor, A Found Treasure: Mining Treasured Neighbors for Knowledge Graph Entity TypingMain8 citations
- Aligning Recommendation and Conversation via Dual ImitationMain8 citations
- AssistSR: Task-oriented Video Segment Retrieval for Personal AI Assistantfinding8 citations
- Bilingual Lexicon Induction for Low-Resource Languages using Graph Matching via Optimal TransportMain8 citations
- Calibration Meets Explanation: A Simple and Effective Approach for Model Confidence EstimatesMain8 citations
- Can Language Models Serve as Temporal Knowledge Bases?finding8 citations
- CapOnImage: Context-driven Dense-Captioning on ImageMain8 citations
- Cards Against AI: Predicting Humor in a Fill-in-the-blank Party Gamefinding8 citations
- Certified Error Control of Candidate Set Pruning for Two-Stage Relevance RankingMain8 citations
- CodeExp: Explanatory Code Document Generationfinding8 citations
- Communication breakdown: On the low mutual intelligibility between human and neural captioningMain8 citations
- ConGen: Unsupervised Control and Generalization Distillation For Sentence Representationfinding8 citations
- ConReader: Exploring Implicit Relations in Contracts for Contract Clause ExtractionMain8 citations
- Cross-Align: Modeling Deep Cross-lingual Interactions for Word AlignmentMain8 citations
- Developing Prefix-Tuning Models for Hierarchical Text ClassificationIndustry8 citations
- DialogueGAT: A Graph Attention Network for Financial Risk Prediction by Modeling the Dialogues in Earnings Conference Callsfinding8 citations
- Efficient Nearest Neighbor Emotion Classification with BERT-whiteningMain8 citations
- Empowering Dual-Encoder with Query Generator for Cross-Lingual Dense RetrievalMain8 citations
- Ensemble Transformer for Efficient and Accurate Ranking Tasks: an Application to Question Answering Systemsfinding8 citations
- Exploiting domain-slot related keywords description for Few-Shot Cross-Domain Dialogue State TrackingMain8 citations
- Exploring Methods for Building Dialects-Mandarin Code-Mixing Corpora: A Case Study in Taiwanese Hokkienfinding8 citations
- Generating Multiple-Length Summaries via Reinforcement Learning for Unsupervised Sentence Summarizationfinding8 citations
- Generative Entity-to-Entity Stance Detection with Knowledge Graph AugmentationMain8 citations
- Graph-Based Multilingual Label Propagation for Low-Resource Part-of-Speech TaggingMain8 citations
- He Said, She Said: Style Transfer for Shifting the Perspective of Dialoguesfinding8 citations
- Human Guided Exploitation of Interpretable Attention Patterns in Summarization and Topic SegmentationMain8 citations
- Improving Multi-task Stance Detection with Multi-task Interaction NetworkMain8 citations
- Inducer-tuning: Connecting Prefix-tuning and Adapter-tuningMain8 citations
- Interventional Training for Out-Of-Distribution Natural Language UnderstandingMain8 citations
- It’s Better to Teach Fishing than Giving a Fish: An Auto-Augmented Structure-aware Generative Model for Metaphor Detectionfinding8 citations
- Joint Audio/Text Training for Transformer Rescorer of Streaming Speech Recognitionfinding8 citations
- Know Thy Strengths: Comprehensive Dialogue State Tracking Diagnosticsfinding8 citations
- Language as a fingerprint: Self-supervised learning of user encodings using transformersfinding8 citations
- Learning Semantic Textual Similarity via Topic-informed Discrete Latent VariablesMain8 citations
- MCPG: A Flexible Multi-Level Controllable Framework for Unsupervised Paraphrase Generationfinding8 citations
- Mask More and Mask Later: Efficient Pre-training of Masked Language Models by Disentangling the [MASK] Tokenfinding8 citations
- Multi-View Active Learning for Short Text Classification in User-Generated Datafinding8 citations
- Narrate Dialogues for Better Summarizationfinding8 citations
- On Measuring the Intrinsic Few-Shot Hardness of DatasetsMain8 citations
- PALT: Parameter-Lite Transfer of Language Models for Knowledge Graph Completionfinding8 citations
- Probing Relational Knowledge in Language Models via Word Analogiesfinding8 citations
- PseudoReasoner: Leveraging Pseudo Labels for Commonsense Knowledge Base Populationfinding8 citations
- RelCLIP: Adapting Language-Image Pretraining for Visual Relationship Detection via Relational Contrastive LearningMain8 citations
- Robustness of Fusion-based Multimodal Classifiers to Cross-Modal Content DilutionsMain8 citations
- SPE: Symmetrical Prompt Enhancement for Fact ProbingMain8 citations
- Self-Distillation with Meta Learning for Knowledge Graph Completionfinding8 citations
- Semi-Supervised Lifelong Language Learningfinding8 citations
- Sharpness-Aware Minimization with Dynamic Reweightingfinding8 citations
- Social-aware Sparse Attention Network for Session-based Social Recommendationfinding8 citations
- Subword Evenness (SuE) as a Predictor of Cross-lingual Transfer to Low-resource LanguagesMain8 citations
- VIRT: Improving Representation-based Text Matching via Virtual InteractionMain8 citations
- You Are My Type! Type Embeddings for Pre-trained Language Modelsfinding8 citations
- monoQA: Multi-Task Learning of Reranking and Answer Extraction for Open-Retrieval Conversational Question AnsweringMain8 citations
- A Federated Approach to Predicting Emojis in Hindi TweetsMain7 citations
- A Generative Model for End-to-End Argument Mining with Reconstructed Positional Encoding and Constrained Pointer MechanismMain7 citations
- A Hierarchical N-Gram Framework for Zero-Shot Link Predictionfinding7 citations
- A Multi-Modal Knowledge Graph for Classical Chinese Poetryfinding7 citations
- A Multifaceted Framework to Evaluate Evasion, Content Preservation, and Misattribution in Authorship Obfuscation TechniquesMain7 citations
- A Second Wave of UD Hebrew Treebanking and Cross-Domain ParsingMain7 citations
- A Sequential Flow Control Framework for Multi-hop Knowledge Base Question AnsweringMain7 citations
- Attention and Edge-Label Guided Graph Convolutional Networks for Named Entity RecognitionMain7 citations
- Beyond Model Interpretability: On the Faithfulness and Adversarial Robustness of Contrastive Textual Explanationsfinding7 citations
- Boosting Document-Level Relation Extraction by Mining and Injecting Logical RulesMain7 citations
- CONSISTENT: Open-Ended Question Generation From News Articlesfinding7 citations
- Cascading Biases: Investigating the Effect of Heuristic Annotation Strategies on Data and ModelsMain7 citations
- CoCoa: An Encoder-Decoder Model for Controllable Code-switched GenerationMain7 citations
- Code Vulnerability Detection via Nearest Neighbor Mechanismfinding7 citations
- Consultation Checklists: Standardising the Human Evaluation of Medical Note GenerationIndustry7 citations
- Context-aware Information-theoretic Causal De-biasing for Interactive Sequence Labelingfinding7 citations
- Cross-stitching Text and Knowledge Graph Encoders for Distantly Supervised Relation ExtractionMain7 citations
- Curriculum Learning Meets Weakly Supervised Multimodal Correlation LearningMain7 citations
- DORE: Document Ordered Relation Extraction based on Generative Frameworkfinding7 citations
- Data-Efficient Concept Extraction from Pre-trained Language Models for Commonsense Explanation Generationfinding7 citations
- Data-Efficient Playlist Captioning With Musical and Linguistic KnowledgeMain7 citations
- DebiasGAN: Eliminating Position Bias in News Recommendation with Adversarial Learningfinding7 citations
- Differentiable Data Augmentation for Contrastive Sentence Representation LearningMain7 citations
- Dimension Reduction for Efficient Dense Retrieval via Conditional AutoencoderMain7 citations
- Discourse-Aware Soft Prompting for Text GenerationMain7 citations
- Disentangling Task Relations for Few-shot Text Classification via Self-Supervised Hierarchical Task Clusteringfinding7 citations
- DuQM: A Chinese Dataset of Linguistically Perturbed Natural Questions for Evaluating the Robustness of Question Matching ModelsMain7 citations
- Efficient Document Retrieval by End-to-End Refining and Quantizing BERT Embedding with Contrastive Product QuantizationMain7 citations
- Entropy-Based Vocabulary Substitution for Incremental Learning in Multilingual Neural Machine TranslationMain7 citations
- Faithful Knowledge Graph Explanations in Commonsense Question AnsweringMain7 citations
- FocusQA: Open-Domain Question Answering with a Context in Focusfinding7 citations
- Gaining Insights into Unrecognized User Utterances in Task-Oriented Dialog SystemsIndustry7 citations
- Hardness-guided domain adaptation to recognise biomedical named entities under low-resource scenariosMain7 citations
- Improve Interpretability of Neural Networks via Sparse Contrastive Codingfinding7 citations
- Keyphrase Generation via Soft and Hard Semantic CorrectionsMain7 citations
- Knowledge Distillation based Contextual Relevance Matching for E-commerce Product SearchIndustry7 citations
- LEMON: Language-Based Environment Manipulation via Execution-Guided Pre-trainingfinding7 citations
- Late Fusion with Triplet Margin Objective for Multimodal Ideology Prediction and AnalysisMain7 citations
- Learning to Infer from Unlabeled Data: A Semi-supervised Learning Approach for Robust Natural Language Inferencefinding7 citations
- Leveraging Data Recasting to Enhance Tabular Reasoningfinding7 citations
- Linearizing Transformer with Key-Value MemoryMain7 citations
- Making Pretrained Language Models Good Long-tailed LearnersMain7 citations
- Mitigating Covertly Unsafe Text within Natural Language Systemsfinding7 citations
- Modeling Label Correlations for Ultra-Fine Entity Typing with Neural Pairwise Conditional Random FieldMain7 citations
- Not Just Plain Text! Fuel Document-Level Relation Extraction with Explicit Syntax Refinement and Subsentence Modelingfinding7 citations
- OTSeq2Set: An Optimal Transport Enhanced Sequence-to-Set Model for Extreme Multi-label Text ClassificationMain7 citations
- PLM-based World Models for Text-based GamesMain7 citations
- Prototype-Representations for Training Data Filtering in Weakly-Supervised Information ExtractionIndustry7 citations
- Reduce Catastrophic Forgetting of Dense Retrieval Training with Teleportation NegativesMain7 citations
- Robust Task-Oriented Dialogue Generation with Contrastive Pre-training and Adversarial Filteringfinding7 citations
- SMASH: Improving SMAll Language Models’ Few-SHot Ability with Prompt-Based Distillationfinding7 citations
- Sentence Representation Learning with Generative Objective rather than Contrastive ObjectiveMain7 citations
- SepLL: Separating Latent Class Labels from Weak Supervision Noisefinding7 citations
- SimQA: Detecting Simultaneous MT Errors through Word-by-Word Question AnsweringMain7 citations
- Sparse Teachers Can Be Dense with KnowledgeMain7 citations
- TAPE: Assessing Few-shot Russian Language Understandingfinding7 citations
- Teaching Broad Reasoning Skills for Multi-Step QA by Generating Hard ContextsMain7 citations
- The Aligned Multimodal Movie Treebank: An audio, video, dependency-parse treebankMain7 citations
- The Architectural Bottleneck PrincipleMain7 citations
- The Importance of Being Parameters: An Intra-Distillation Method for Serious GainsMain7 citations
- Topic Modeling With Topological Data AnalysisMain7 citations
- Towards Generalizable and Robust Text-to-SQL Parsingfinding7 citations
- Tracing Semantic Variation in SlangMain7 citations
- ULN: Towards Underspecified Vision-and-Language NavigationMain7 citations
EMNLP accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.