ACL 2023 Accepted Papers
The full list of 2,052 papers accepted at ACL 2023 (Association for Computational Linguistics). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Long: 911Findings: 901Short: 164Industry: 76
- Computer says “No”: The Case Against Empathetic Conversational AIFindings10 citations
- Dense-ATOMIC: Towards Densely-connected ATOMIC with High Knowledge Coverage and Massive Multi-hop PathsLong10 citations
- Did the Models Understand Documents? Benchmarking Models for Language Understanding in Document-Level Relation ExtractionLong10 citations
- Distill or Annotate? Cost-Efficient Fine-Tuning of Compact ModelsLong10 citations
- Distilling Calibrated Knowledge for Stance DetectionFindings10 citations
- Distractor Generation based on Text2Text Language Models with Pseudo Kullback-Leibler Divergence RegulationFindings10 citations
- Don’t Retrain, Just Rewrite: Countering Adversarial Perturbations by Rewriting TextLong10 citations
- Dual Class Knowledge Propagation Network for Multi-label Few-shot Intent DetectionLong10 citations
- Dynamic Structured Neural Topic Model with Self-Attention MechanismFindings10 citations
- Dynamic Transformers Provide a False Sense of EfficiencyLong10 citations
- Easy-to-Hard Learning for Information ExtractionFindings10 citations
- Enhancing Cross-lingual Natural Language Inference by Soft Prompting with Multilingual VerbalizerFindings10 citations
- Feature Interactions Reveal Linguistic Structure in Language ModelsFindings10 citations
- FiD-ICL: A Fusion-in-Decoder Approach for Efficient In-Context LearningLong10 citations
- Fighting Bias With Bias: Promoting Model Robustness by Amplifying Dataset BiasesFindings10 citations
- Focused Prefix Tuning for Controllable Text GenerationShort10 citations
- Generating EDU Extracts for Plan-Guided Summary Re-RankingLong10 citations
- Gradient-based Intra-attention Pruning on Pre-trained Language ModelsLong10 citations
- HistRED: A Historical Document-Level Relation Extraction DatasetLong10 citations
- Holographic CCG ParsingLong10 citations
- Honey, I Shrunk the Language: Language Model Behavior at Reduced Scale.Findings10 citations
- How to Distill your BERT: An Empirical Study on the Impact of Weight Initialisation and Distillation ObjectivesShort10 citations
- Improving Gradient Trade-offs between Tasks in Multi-task Text ClassificationLong10 citations
- Investigating Glyph-Phonetic Information for Chinese Spell Checking: What Works and What’s Next?Findings10 citations
- Large Scale Generative Multimodal Attribute Extraction for E-commerce AttributesIndustry10 citations
- Less Likely Brainstorming: Using Language Models to Generate Alternative HypothesesFindings10 citations
- Local Byte Fusion for Neural Machine TranslationLong10 citations
- Long-Tailed Question Answering in an Open WorldLong10 citations
- MDACE: MIMIC Documents Annotated with Code EvidenceLong10 citations
- MeetingQA: Extractive Question-Answering on Meeting TranscriptsLong10 citations
- Modeling Adversarial Attack on Pre-trained Language Models as Sequential Decision MakingFindings10 citations
- Modeling Appropriate Language in ArgumentationLong10 citations
- Multi-Level Knowledge Distillation for Out-of-Distribution Detection in TextLong10 citations
- Noisy Positive-Unlabeled Learning with Self-Training for Speculative Knowledge Graph ReasoningFindings10 citations
- Numeric Magnitude Comparison Effects in Large Language ModelsFindings10 citations
- On Text-based Personality Computing: Challenges and Future DirectionsFindings10 citations
- On the Role of Parallel Data in Cross-lingual Transfer LearningFindings10 citations
- Prompter: Zero-shot Adaptive Prefixes for Dialogue State Tracking Domain AdaptationLong10 citations
- Prompts Can Play Lottery Tickets Well: Achieving Lifelong Information Extraction via Lottery Prompt TuningLong10 citations
- Query Structure Modeling for Inductive Logical Reasoning Over Knowledge GraphsLong10 citations
- Reference Matters: Benchmarking Factual Error Correction for Dialogue Summarization with Fine-grained Evaluation FrameworkLong10 citations
- SLABERT Talk Pretty One Day: Modeling Second Language Acquisition with BERTLong10 citations
- Second Language Acquisition of Neural Language ModelsFindings10 citations
- Single Sequence Prediction over Reasoning Graphs for Multi-hop QALong10 citations
- Substitution-based Semantic Change Detection using Contextual EmbeddingsShort10 citations
- Synthesize, Prompt and Transfer: Zero-shot Conversational Question Generation with Pre-trained Language ModelLong10 citations
- Text Augmentation Using Dataset Reconstruction for Low-Resource ClassificationFindings10 citations
- The Web Can Be Your Oyster for Improving Language ModelsFindings10 citations
- The economic trade-offs of large language models: A case studyIndustry10 citations
- To Revise or Not to Revise: Learning to Detect Improvable Claims for Argumentative Writing SupportLong10 citations
- Training Trajectories of Language Models Across ScalesLong10 citations
- Transformer Language Models Handle Word Frequency in Prediction HeadFindings10 citations
- Varta: A Large-Scale Headline-Generation Dataset for Indic LanguagesFindings10 citations
- WeCheck: Strong Factual Consistency Checker via Weakly Supervised LearningLong10 citations
- A Benchmark on Extremely Weakly Supervised Text Classification: Reconcile Seed Matching and Prompting ApproachesFindings9 citations
- A Cognitive Stimulation Dialogue System with Multi-source Knowledge Fusion for Elders with Cognitive ImpairmentLong9 citations
- A dynamic programming algorithm for span-based nested named-entity recognition in O(n2)Long9 citations
- AQE: Argument Quadruplet Extraction via a Quad-Tagging Augmented Generative ApproachFindings9 citations
- Alleviating Exposure Bias via Multi-level Contrastive Learning and Deviation Simulation in Abstractive SummarizationFindings9 citations
- Are Sample-Efficient NLP Models More Robust?Short9 citations
- Attractive Storyteller: Stylized Visual Storytelling with Unpaired TextLong9 citations
- BREAK: Breaking the Dialogue State Tracking Barrier with Beam Search and Re-rankingLong9 citations
- Boost Transformer-based Language Models with GPU-Friendly Sparsity and QuantizationFindings9 citations
- Breeding Machine Translations: Evolutionary approach to survive and thrive in the world of automated evaluationLong9 citations
- CDA: A Contrastive Data Augmentation Method for Alzheimer’s Disease DetectionFindings9 citations
- Can Language Models Be Specific? How?Findings9 citations
- Causal Intervention for Mitigating Name Bias in Machine Reading ComprehensionFindings9 citations
- Clustering-Aware Negative Sampling for Unsupervised Sentence RepresentationFindings9 citations
- Concise Answers to Complex Questions: Summarization of Long-form AnswersLong9 citations
- Consistency Regularization Training for Compositional GeneralizationLong9 citations
- Contrastive Learning with Generated Representations for Inductive Knowledge Graph EmbeddingFindings9 citations
- Cross-lingual Continual LearningLong9 citations
- Decker: Double Check with Heterogeneous Knowledge for Commonsense Fact VerificationFindings9 citations
- Digging out Discrimination Information from Generated Samples for Robust Visual Question AnsweringFindings9 citations
- DimonGen: Diversified Generative Commonsense Reasoning for Explaining Concept RelationshipsLong9 citations
- Distinguish Before Answer: Generating Contrastive Explanation as Knowledge for Commonsense Question AnsweringFindings9 citations
- Do Question Answering Modeling Improvements Hold Across Benchmarks?Long9 citations
- Dynamic and Efficient Inference for Text Generation via BERT FamilyLong9 citations
- ECOLA: Enhancing Temporal Knowledge Embeddings with Contextualized Language RepresentationsFindings9 citations
- ELQA: A Corpus of Metalinguistic Questions and Answers about EnglishLong9 citations
- EPIC: Multi-Perspective Annotation of a Corpus of IronyLong9 citations
- Early Exit with Disentangled Representation and Equiangular Tight FrameFindings9 citations
- Explicit Syntactic Guidance for Neural Text GenerationLong9 citations
- Few-shot Classification with Hypersphere Modeling of PrototypesFindings9 citations
- Few-shot Event Detection: An Empirical Study and a Unified ViewLong9 citations
- Finding the Pillars of Strength for Multi-Head AttentionLong9 citations
- Finding the SWEET Spot: Analysis and Improvement of Adaptive Inference in Low Resource SettingsLong9 citations
- GNN-SL: Sequence Labeling Based on Nearest Examples via GNNFindings9 citations
- Generating Deep Questions with Commonsense Reasoning Ability from the Text by Disentangled Adversarial InferenceFindings9 citations
- ISLTranslate: Dataset for Translating Indian Sign LanguageFindings9 citations
- Impact of Adversarial Training on Robustness and Generalizability of Language ModelsFindings9 citations
- Improved Instruction Ordering in Recipe-Grounded ConversationLong9 citations
- Improving Radiology Summarization with Radiograph and Anatomy PromptsFindings9 citations
- Improving the robustness of NLI models with minimax trainingLong9 citations
- Incorporating Attribution Importance for Improving Faithfulness MetricsLong9 citations
- Inducing Character-level Structure in Subword-based Language Models with Type-level Interchange Intervention TrainingFindings9 citations
- Knowledgeable Parameter Efficient Tuning Network for Commonsense Question AnsweringLong9 citations
- Language Modeling with Latent SituationsFindings9 citations
- Learning Event-aware Measures for Event Coreference ResolutionFindings9 citations
- Learning to Leverage High-Order Medical Knowledge Graph for Joint Entity and Relation ExtractionFindings9 citations
- Learning to Substitute Spans towards Improving Compositional GeneralizationLong9 citations
- Learning “O” Helps for Learning More: Handling the Unlabeled Entity Problem for Class-incremental NERLong9 citations
- Mapping Brains with Language Models: A SurveyFindings9 citations
- Matching Pairs: Attributing Fine-Tuned Models to their Pre-Trained Large Language ModelsLong9 citations
- Measuring Intersectional Biases in Historical DocumentsFindings9 citations
- MoNET: Tackle State Momentum via Noise-Enhanced Training for Dialogue State TrackingFindings9 citations
- Modeling Structural Similarities between Documents for Coherence Assessment with Graph Convolutional NetworksLong9 citations
- Modeling User Satisfaction Dynamics in Dialogue via Hawkes ProcessLong9 citations
- Multimedia Generative Script Learning for Task PlanningFindings9 citations
- On Prefix-tuning for Lightweight Out-of-distribution DetectionLong9 citations
- Parameter-efficient Weight Ensembling Facilitates Task-level Knowledge TransferShort9 citations
- Plug-and-Play Document Modules for Pre-trained ModelsLong9 citations
- Probing Physical Reasoning with Counter-Commonsense ContextShort9 citations
- Question-Answering in a Low-resourced Language: Benchmark Dataset and Models for TigrinyaLong9 citations
- RADE: Reference-Assisted Dialogue Evaluation for Open-Domain DialogueLong9 citations
- Retrieval-Based Transformer for Table AugmentationFindings9 citations
- Revisiting Automated Prompting: Are We Actually Doing Better?Short9 citations
- SANTA: Separate Strategies for Inaccurate and Incomplete Annotation Noise in Distantly-Supervised Named Entity RecognitionFindings9 citations
- SCCS: Semantics-Consistent Cross-domain Summarization via Optimal Transport AlignmentFindings9 citations
- SaFER: A Robust and Efficient Framework for Fine-tuning BERT-based Classifier with Noisy LabelsIndustry9 citations
- Sequential Path Signature Networks for Personalised Longitudinal Language ModelingFindings9 citations
- Should you marginalize over possible tokenizations?Short9 citations
- Split-NER: Named Entity Recognition via Two Question-Answering-based ClassificationsShort9 citations
- Surface-Based Retrieval Reduces Perplexity of Retrieval-Augmented Language ModelsShort9 citations
- Synthetic Pre-Training Tasks for Neural Machine TranslationFindings9 citations
- The Role of Global and Local Context in Named Entity RecognitionShort9 citations
- Towards Generative Event Factuality PredictionFindings9 citations
- Towards Higher Pareto Frontier in Multilingual Machine TranslationLong9 citations
- USSA: A Unified Table Filling Scheme for Structured Sentiment AnalysisLong9 citations
- Using Collostructional Analysis to evaluate BERT’s representation of linguistic constructionsFindings9 citations
- VSTAR: A Video-grounded Dialogue Dataset for Situated Semantic Understanding with Scene and Topic TransitionsLong9 citations
- Visually-augmented pretrained language models for NLP tasks without imagesLong9 citations
- What is the Real Intention behind this Question? Dataset Collection and Intention ClassificationLong9 citations
- What social attitudes about gender does BERT encode? Leveraging insights from psycholinguisticsLong9 citations
- WikiBio: a Semantic Resource for the Intersectional Analysis of Biographical EventsLong9 citations
- World Models for Math Story ProblemsFindings9 citations
- X-RiSAWOZ: High-Quality End-to-End Multilingual Dialogue Datasets and Few-shot AgentsFindings9 citations
- Zemi: Learning Zero-Shot Semi-Parametric Language Models from Multiple TasksFindings9 citations
- Zero-Shot Prompting for Implicit Intent Prediction and Recommendation with Commonsense ReasoningFindings9 citations
- Zero-shot Approach to Overcome Perturbation Sensitivity of PromptsLong9 citations
- f-Divergence Minimization for Sequence-Level Knowledge DistillationLong9 citations
- A Dataset of Argumentative Dialogues on Scientific PapersLong8 citations
- A Method for Studying Semantic Construal in Grammatical Constructions with Interpretable Contextual Embedding SpacesLong8 citations
- A New Dataset and Empirical Study for Sentence Simplification in ChineseLong8 citations
- A Study on Knowledge Distillation from Weak Teacher for Scaling Up Pre-trained Language ModelsFindings8 citations
- A Study on the Efficiency and Generalization of Light Hybrid RetrieversShort8 citations
- AMR-TST: Abstract Meaning Representation-based Text Style TransferFindings8 citations
- Abstractive Text Summarization Using the BRIO Training ParadigmFindings8 citations
- Accurate Training of Web-based Question Answering Systems with Feedback from Ranked UsersIndustry8 citations
- Adaptation Approaches for Nearest Neighbor Language ModelsFindings8 citations
- Additive manifesto decomposition: A policy domain aware method for understanding party positioningFindings8 citations
- Aggregating Multiple Heuristic Signals as Supervision for Unsupervised Automated Essay ScoringLong8 citations
- Answering Ambiguous Questions via Iterative PromptingLong8 citations
- BUMP: A Benchmark of Unfaithful Minimal Pairs for Meta-Evaluation of Faithfulness MetricsLong8 citations
- Character Coreference Resolution in Movie ScreenplaysFindings8 citations
- Commonsense Knowledge Transfer for Pre-trained Language ModelsFindings8 citations
- DITTO: Data-efficient and Fair Targeted Subset Selection for ASR Accent AdaptationLong8 citations
- Data Augmentation for Low-Resource Keyphrase GenerationFindings8 citations
- Data-Efficient French Language Modeling with CamemBERTaFindings8 citations
- Debiasing Generative Named Entity Recognition by Calibrating Sequence LikelihoodShort8 citations
- Diable: Efficient Dialogue State Tracking as Operations on TablesFindings8 citations
- Disagreement Matters: Preserving Label Diversity by Jointly Modeling Item and Annotator Label Distributions with DisCoFindings8 citations
- Effective Contrastive Weighting for Dense Query ExpansionLong8 citations
- Exploiting Rich Textual User-Product Context for Improving Personalized Sentiment AnalysisFindings8 citations
- Exploring and Verbalizing Academic Ideas by Concept Co-occurrenceLong8 citations
- Exploring the Impact of Layer Normalization for Zero-shot Neural Machine TranslationShort8 citations
- Few-shot Low-resource Knowledge Graph Completion with Reinforced Task GenerationFindings8 citations
- Fixing MoE Over-Fitting on Low-Resource Languages in Multilingual Machine TranslationFindings8 citations
- From Characters to Words: Hierarchical Pre-trained Language Model for Open-vocabulary Language UnderstandingLong8 citations
- From chocolate bunny to chocolate crocodile: Do Language Models Understand Noun Compounds?Findings8 citations
- GEC-DePenD: Non-Autoregressive Grammatical Error Correction with Decoupled Permutation and DecodingLong8 citations
- GIFT: Graph-Induced Fine-Tuning for Multi-Party Conversation UnderstandingLong8 citations
- GRACE: Gradient-guided Controllable Retrieval for Augmenting Attribute-based Text GenerationFindings8 citations
- Hence, Socrates is mortal: A Benchmark for Natural Language Syllogistic ReasoningFindings8 citations
- Hexatagging: Projective Dependency Parsing as TaggingShort8 citations
- IDOL: Indicator-oriented Logic Pre-training for Logical ReasoningFindings8 citations
- INK: Injecting kNN Knowledge in Nearest Neighbor Machine TranslationLong8 citations
- Improving Automatic Quotation Attribution in Literary NovelsShort8 citations
- Improving Low-resource Named Entity Recognition with Graph Propagated Data AugmentationShort8 citations
- LAIT: Efficient Multi-Segment Encoding in Transformers with Layer-Adjustable InteractionLong8 citations
- Learning Symbolic Rules over Abstract Meaning Representations for Textual Reinforcement LearningLong8 citations
- Learning with Partial Annotations for Event DetectionLong8 citations
- MURMUR: Modular Multi-Step Reasoning for Semi-Structured Data-to-Text GenerationFindings8 citations
- Maximum Entropy Loss, the Silver Bullet Targeting Backdoor Attacks in Pre-trained Language ModelsFindings8 citations
- Multitask Pretraining with Structured Knowledge for Text-to-SQL GenerationLong8 citations
- Non-Sequential Graph Script Induction via Multimedia GroundingLong8 citations
- On “Scientific Debt” in NLP: A Case for More Rigour in Language Model Pre-Training ResearchLong8 citations
- OpineSum: Entailment-based self-training for abstractive opinion summarizationFindings8 citations
- Peer-Label Assisted Hierarchical Text ClassificationLong8 citations
- PreQuant: A Task-agnostic Quantization Approach for Pre-trained Language ModelsFindings8 citations
- Putting Natural in Natural Language ProcessingFindings8 citations
- Python Code Generation by Asking Clarification QuestionsLong8 citations
- REV: Information-Theoretic Evaluation of Free-Text RationalesLong8 citations
- ReactIE: Enhancing Chemical Reaction Extraction with Weak SupervisionFindings8 citations
- Recyclable Tuning for Continual Pre-trainingFindings8 citations
- Revisiting Commonsense Reasoning in Machine Translation: Training, Evaluation and ChallengeLong8 citations
- Revisiting the Architectures like Pointer Networks to Efficiently Improve the Next Word Distribution, Summarization Factuality, and BeyondFindings8 citations
- Robustness-Aware Word Embedding Improves Certified Robustness to Adversarial Word SubstitutionsFindings8 citations
- SafeConv: Explaining and Correcting Conversational Unsafe BehaviorLong8 citations
- StoryWars: A Dataset and Instruction Tuning Baselines for Collaborative Story Understanding and GenerationLong8 citations
- TAPIR: Learning Adaptive Revision for Incremental Natural Language Understanding with a Two-Pass ModelFindings8 citations
- Task-Aware Specialization for Efficient and Robust Dense Retrieval for Open-Domain Question AnsweringShort8 citations
- The Coreference under Transformation Labeling Dataset: Entity Tracking in Procedural Texts Using Event ModelsFindings8 citations
- Transfer and Active Learning for Dissonance Detection: Addressing the Rare-Class ChallengeLong8 citations
- Typo-Robust Representation Learning for Dense RetrievalShort8 citations
- UPPAM: A Unified Pre-training Architecture for Political Actor Modeling based on LanguageLong8 citations
- Uncertainty-Aware Bootstrap Learning for Joint Extraction on Distantly-Supervised DataShort8 citations
- Unsupervised Extractive Summarization of Emotion TriggersLong8 citations
- Weakly-Supervised Spoken Video Grounding via Semantic Interaction LearningLong8 citations
- What Knowledge Is Needed? Towards Explainable Memory for kNN-MT Domain AdaptationFindings8 citations
- When Gradient Descent Meets Derivative-Free Optimization: A Match Made in Black-Box ScenarioFindings8 citations
- When and how to paraphrase for named entity recognition?Long8 citations
- When to Use What: An In-Depth Comparative Empirical Analysis of OpenIE Systems for Downstream ApplicationsLong8 citations
- With a Little Push, NLI Models can Robustly and Efficiently Predict FaithfulnessShort8 citations
- XDailyDialog: A Multilingual Parallel Dialogue CorpusLong8 citations
- Zero-shot Cross-lingual Transfer With Learned Projections Using Unlabeled Target-Language DataShort8 citations
- “Let’s not Quote out of Context”: Unified Vision-Language Pretraining for Context Assisted Image CaptioningIndustry8 citations
- A Natural Bias for Language Generation ModelsShort7 citations
- A Neural Divide-and-Conquer Reasoning Framework for Image Retrieval from Linguistically Complex TextLong7 citations
- A Simple Yet Strong Domain-Agnostic De-bias Method for Zero-Shot Sentiment ClassificationFindings7 citations
- A Simple, Yet Effective Approach to Finding Biases in Code GenerationFindings7 citations
- Adaptive Attention for Sparse-based Long-sequence TransformerFindings7 citations
- An Ordinal Latent Variable Model of Conflict IntensityLong7 citations
- AxomiyaBERTa: A Phonologically-aware Transformer Model for AssameseFindings7 citations
- BUCA: A Binary Classification Approach to Unsupervised Commonsense Question AnsweringShort7 citations
- BigVideo: A Large-scale Video Subtitle Translation Dataset for Multimodal Machine TranslationFindings7 citations
- Boosting Event Extraction with Denoised Structure-to-Text AugmentationFindings7 citations
- Boosting Transformers and Language Models for Clinical Prediction in ImmunotherapyIndustry7 citations
- Boosting Zero-shot Cross-lingual Retrieval by Training on Artificially Code-Switched DataFindings7 citations
- Bridging the Domain Gaps in Context Representations for k-Nearest Neighbor Neural Machine TranslationLong7 citations
- Bridging the Granularity Gap for Acoustic ModelingFindings7 citations
- CTC-based Non-autoregressive Speech TranslationLong7 citations
- CoRRPUS: Code-based Structured Prompting for Neurosymbolic Story UnderstandingFindings7 citations
- CocaCLIP: Exploring Distillation of Fully-Connected Knowledge Interaction Graph for Lightweight Text-Image RetrievalIndustry7 citations
- Continual Contrastive Finetuning Improves Low-Resource Relation ExtractionLong7 citations
- Contrastive Novelty-Augmented Learning: Anticipating Outliers with Large Language ModelsLong7 citations
- Cross-Lingual Knowledge Distillation for Answer Sentence Selection in Low-Resource LanguagesFindings7 citations
- Cross-Lingual Transfer with Target Language-Ready Task AdaptersFindings7 citations
- Define, Evaluate, and Improve Task-Oriented Cognitive Capabilities for Instruction Generation ModelsFindings7 citations
- DialoGPS: Dialogue Path Sampling in Continuous Semantic Space for Data Augmentation in Multi-Turn ConversationsLong7 citations
- Diffusion Theory as a Scalpel: Detecting and Purifying Poisonous Dimensions in Pre-trained Language Models Caused by Backdoor or BiasFindings7 citations
- Discourse-Centric Evaluation of Document-level Machine Translation with a New Densely Annotated Parallel Corpus of NovelsLong7 citations
- Distantly Supervised Course Concept Extraction in MOOCs with Academic DisciplineLong7 citations
- DuNST: Dual Noisy Self Training for Semi-Supervised Controllable Text GenerationLong7 citations
- Echoes from Alexandria: A Large Resource for Multilingual Book SummarizationFindings7 citations
- Empowering Cross-lingual Behavioral Testing of NLP Models with Typological FeaturesLong7 citations
- End-to-End Task-Oriented Dialogue Systems Based on SchemaFindings7 citations
- Enhancing Cross-lingual Transfer via Phonemic Transcription IntegrationFindings7 citations
- Evaluate AMR Graph Similarity via Self-supervised LearningLong7 citations
- Exclusive Supermask Subnetwork Training for Continual LearningFindings7 citations
- Exploiting Abstract Meaning Representation for Open-Domain Question AnsweringFindings7 citations
- Exploring Speaker-Related Information in Spoken Language Understanding for Better Speaker DiarizationFindings7 citations
- Extract and Attend: Improving Entity Translation in Neural Machine TranslationFindings7 citations
- Financial Numeric Extreme Labelling: A dataset and benchmarkingFindings7 citations
- FutureTOD: Teaching Future Knowledge to Pre-trained Language Model for Task-Oriented DialogueLong7 citations
- Generalizing Backpropagation for Gradient-Based InterpretabilityLong7 citations
- Gradient-Boosted Decision Tree for Listwise Context Model in Multimodal Review Helpfulness PredictionFindings7 citations
- HaVQA: A Dataset for Visual Question Answering and Multimodal Research in Hausa LanguageFindings7 citations
- HiPool: Modeling Long Documents Using Graph Neural NetworksShort7 citations
- History repeats: Overcoming catastrophic forgetting for event-centric temporal knowledge graph completionFindings7 citations
- How About Kind of Generating Hedges using End-to-End Neural Models?Long7 citations
- How does the brain process syntactic structure while listening?Findings7 citations
- Importance of Synthesizing High-quality Data for Text-to-SQL ParsingFindings7 citations
- Improving the Detection of Multilingual Online Attacks with Rich Social Media Data from SingaporeLong7 citations
- Joint Constrained Learning with Boundary-adjusting for Emotion-Cause Pair ExtractionLong7 citations
- Joint Generator-Ranker Learning for Natural Language GenerationFindings7 citations
- Jointprop: Joint Semi-supervised Learning for Entity and Relation Extraction with Heterogeneous Graph-based PropagationLong7 citations
- Learning Dynamic Contextualised Word Embeddings via Template-based Temporal AdaptationLong7 citations
- Listen, Decipher and Sign: Toward Unsupervised Speech-to-Sign Language RecognitionFindings7 citations
- MOSPC: MOS Prediction Based on Pairwise ComparisonShort7 citations
- MTGP: Multi-turn Target-oriented Dialogue Guided by Generative Global Path with Flexible TurnsFindings7 citations
- Measuring the Effect of Influential Messages on Varying PersonasShort7 citations
- Meta-training with Demonstration Retrieval for Efficient Few-shot LearningFindings7 citations
- Multi-Source Test-Time Adaptation as Dueling Bandits for Extractive Question AnsweringLong7 citations
- Multi-modal Sarcasm Generation: Dataset and SolutionFindings7 citations
- MultiTACRED: A Multilingual Version of the TAC Relation Extraction DatasetLong7 citations
- Neural Machine Translation for Mathematical FormulaeLong7 citations
- Neural Unsupervised Reconstruction of Protolanguage Word FormsLong7 citations
- NewsDialogues: Towards Proactive News Grounded ConversationFindings7 citations
- NormMark: A Weakly Supervised Markov Model for Socio-cultural Norm DiscoveryFindings7 citations
- On Dataset Transferability in Active Learning for TransformersFindings7 citations
- Optimizing Test-Time Query Representations for Dense RetrievalFindings7 citations
- PIP: Parse-Instructed Prefix for Syntactically Controlled Paraphrase GenerationFindings7 citations
- PeerDA: Data Augmentation via Modeling Peer Relation for Span Identification TasksLong7 citations
- PragmatiCQA: A Dataset for Pragmatic Question Answering in ConversationsFindings7 citations
- PromptAttack: Probing Dialogue State Trackers with Adversarial PromptsFindings7 citations
- Prosody-TTS: Improving Prosody with Masked Autoencoder and Conditional Diffusion Model For Expressive Text-to-SpeechFindings7 citations
- Pruning Pre-trained Language Models Without Fine-TuningLong7 citations
- QueryForm: A Simple Zero-shot Form Entity Query FrameworkFindings7 citations
- RadLing: Towards Efficient Radiology Report UnderstandingIndustry7 citations
- Reasoning over Hierarchical Question Decomposition Tree for Explainable Question AnsweringLong7 citations
- Revisiting Cross-Lingual Summarization: A Corpus-based Study and A New Benchmark with Improved AnnotationLong7 citations
- SEAG: Structure-Aware Event Causality GenerationFindings7 citations
- SciReviewGen: A Large-scale Dataset for Automatic Literature Review GenerationFindings7 citations
- Similarizing the Influence of Words with Contrastive Learning to Defend Word-level Adversarial Text AttackFindings7 citations
- Smart Word Suggestions for Writing AssistanceFindings7 citations
- StoryARG: a corpus of narratives and personal experiences in argumentative textsLong7 citations
- Subword Segmental Machine Translation: Unifying Segmentation and Target Sentence GenerationFindings7 citations
- TADA: Efficient Task-Agnostic Domain Adaptation for TransformersFindings7 citations
- TEPrompt: Task Enlightenment Prompt Learning for Implicit Discourse Relation RecognitionFindings7 citations
- TimelineQA: A Benchmark for Question Answering over TimelinesFindings7 citations
- To Copy Rather Than Memorize: A Vertical Learning Paradigm for Knowledge Graph CompletionLong7 citations
- Towards Argument-Aware Abstractive Summarization of Long Legal Opinions with Summary RerankingFindings7 citations
- Towards Diverse and Effective Question-Answer Pair Generation from Children StorybooksFindings7 citations
- Towards Stable Natural Language Understanding via Information Entropy Guided DebiasingLong7 citations
- Training-free Neural Architecture Search for RNNs and TransformersLong7 citations
- TranSFormer: Slow-Fast Transformer for Machine TranslationFindings7 citations
- UMRSpell: Unifying the Detection and Correction Parts of Pre-trained Models towards Chinese Missing, Redundant, and Spelling CorrectionLong7 citations
- UniCOQE: Unified Comparative Opinion Quintuple Extraction As A SetFindings7 citations
- VendorLink: An NLP approach for Identifying & Linking Vendor Migrants & Potential Aliases on Darknet MarketsLong7 citations
- Visual Coherence Loss for Coherent and Visually Grounded Story GenerationFindings7 citations
- WSPAlign: Word Alignment Pre-training via Large-Scale Weakly Supervised Span PredictionLong7 citations
- We Understand Elliptical Sentences, and Language Models should Too: A New Dataset for Studying Ellipsis and its Interaction with Thematic FitLong7 citations
- XSemPLR: Cross-Lingual Semantic Parsing in Multiple Natural Languages and Meaning RepresentationsLong7 citations
- xPQA: Cross-Lingual Product Question Answering in 12 LanguagesIndustry7 citations
- xSIM++: An Improved Proxy to Bitext Mining Performance for Low-Resource LanguagesShort7 citations
- A Language-First Approach for Procedure PlanningFindings6 citations
- A Memory Model for Question Answering from Streaming Data Supported by Rehearsal and Anticipation of Coreference InformationFindings6 citations
- A Simple Concatenation can Effectively Improve Speech TranslationShort6 citations
- A Simple and Flexible Modeling for Mental Disorder Detection by Learning from Clinical QuestionnairesLong6 citations
- A Survey on Zero Pronoun TranslationLong6 citations
- ACCENT: An Automatic Event Commonsense Evaluation Metric for Open-Domain Dialogue SystemsLong6 citations
- ACROSS: An Alignment-based Framework for Low-Resource Many-to-One Cross-Lingual SummarizationFindings6 citations
- AUGUST: an Automatic Generation Understudy for Synthesizing Conversational Recommendation DatasetsFindings6 citations
- Abstractive Summarizers are Excellent Extractive SummarizersShort6 citations
- ActiveAED: A Human in the Loop Improves Annotation Error DetectionFindings6 citations
- An Extensive Exploration of Back-Translation in 60 LanguagesFindings6 citations
- ArgAnalysis35K : A large-scale dataset for Argument Quality AnalysisLong6 citations
- Aspect-aware Unsupervised Extractive Opinion SummarizationFindings6 citations
- AtTGen: Attribute Tree Generation for Real-World Attribute Joint ExtractionLong6 citations
- AutoMoE: Heterogeneous Mixture-of-Experts with Adaptive Computation for Efficient Neural Machine TranslationFindings6 citations
- Best-k Search Algorithm for Neural Text GenerationLong6 citations
- Black-box language model explanation by context length probingShort6 citations
- Bridging the Gap between Decision and Logits in Decision-based Knowledge Distillation for Pre-trained Language ModelsLong6 citations
- CLIPText: A New Paradigm for Zero-shot Text ClassificationFindings6 citations
- Compositional Generalization without Trees using Multiset Tagging and Latent PermutationsLong6 citations
- Contextual Knowledge Learning for Dialogue GenerationLong6 citations
- Contrastive Token-Wise Meta-Learning for Unseen Performer Visual Temporal-Aligned TranslationFindings6 citations
- Cross-lingual Science Journalism: Select, Simplify and Rewrite Summaries for Non-expert ReadersLong6 citations
- DSRM: Boost Textual Adversarial Training with Distribution Shift Risk MinimizationLong6 citations
- DaMSTF: Domain Adversarial Learning Enhanced Meta Self-Training for Domain AdaptationLong6 citations
- Decoder Tuning: Efficient Language Understanding as DecodingLong6 citations
- Decoupling Pseudo Label Disambiguation and Representation Learning for Generalized Intent DiscoveryLong6 citations
- Diversity-Aware Coherence Loss for Improving Neural Topic ModelsShort6 citations
- Efficient Document Embeddings via Self-Contrastive Bregman Divergence LearningFindings6 citations
- Efficient Semiring-Weighted Earley ParsingLong6 citations
- End-to-End Argument Mining over Varying Rhetorical StructuresFindings6 citations
- Enhancing Few-shot Cross-lingual Transfer with Target Language Peculiar ExamplesFindings6 citations
- Entailment as Robust Self-LearnerLong6 citations
- Evaluating Paraphrastic Robustness in Textual Entailment ModelsShort6 citations
- Figurative Language Processing: A Linguistically Informed Feature Analysis of the Behavior of Language Models and HumansFindings6 citations
- Focal Training and Tagger Decouple for Grammatical Error CorrectionFindings6 citations
- From Adversarial Arms Race to Model-centric Evaluation: Motivating a Unified Automatic Robustness Evaluation FrameworkFindings6 citations
- G3R: A Graph-Guided Generate-and-Rerank Framework for Complex and Cross-domain Text-to-SQL GenerationFindings6 citations
- Hard Sample Aware Prompt-TuningLong6 citations
- Hints on the data for language modeling of synthetic languages with transformersLong6 citations
- Images in Language Space: Exploring the Suitability of Large Language Models for Vision & Language TasksFindings6 citations
- In-sample Curriculum Learning by Sequence Completion for Natural Language GenerationLong6 citations
- Is Continuous Prompt a Combination of Discrete Prompts? Towards a Novel View for Interpreting Continuous PromptsFindings6 citations
- Joint Speech Transcription and Translation: Pseudo-Labeling with Out-of-Distribution DataFindings6 citations
- LMs stand their Ground: Investigating the Effect of Embodiment in Figurative Language Interpretation by Language ModelsFindings6 citations
- Layerwise universal adversarial attack on NLP modelsFindings6 citations
- Learning to Generalize for Cross-domain QAFindings6 citations
- Low-Rank Updates of pre-trained Weights for Multi-Task LearningFindings6 citations
- MAD-TSC: A Multilingual Aligned News Dataset for Target-dependent Sentiment ClassificationLong6 citations
- MTCue: Learning Zero-Shot Control of Extra-Textual Attributes by Leveraging Unstructured Context in Neural Machine TranslationFindings6 citations
- Multi-Row, Multi-Span Distant Supervision For Table+Text Question AnsweringLong6 citations
- Multimodal Prompt Learning for Product Title Generation with Extremely Limited LabelsFindings6 citations
- No clues good clues: out of context Lexical Relation ClassificationLong6 citations
- Noise-Robust Training with Dynamic Loss and Contrastive Learning for Distantly-Supervised Named Entity RecognitionFindings6 citations
- Not Enough Data to Pre-train Your Language Model? MT to the Rescue!Findings6 citations
- On Complementarity Objectives for Hybrid RetrievalLong6 citations
- On Evaluating Multilingual Compositional Generalization with Translated DatasetsLong6 citations
- PRAM: An End-to-end Prototype-based Representation Alignment Model for Zero-resource Cross-lingual Named Entity RecognitionFindings6 citations
- Parameter-Efficient Finetuning for Robust Continual Multilingual LearningFindings6 citations
- Pre-trained Personalized Review Summarization with Effective Salience EstimationFindings6 citations
- Predicting Customer Satisfaction with Soft Labels for Ordinal ClassificationIndustry6 citations
- Pretrained Bidirectional Distillation for Machine TranslationLong6 citations
- RAMP: Retrieval and Attribute-Marking Enhanced Prompting for Attribute-Controlled TranslationShort6 citations
- RC3: Regularized Contrastive Cross-lingual Cross-modal Pre-trainingFindings6 citations
- Reinforcement Learning for Topic ModelsFindings6 citations
- Rethinking Translation Memory Augmented Neural Machine TranslationFindings6 citations
- Retrieval-free Knowledge Injection through Multi-Document Traversal for Dialogue ModelsLong6 citations
- Retrieving Multimodal Prompts for Generative Visual Question AnsweringFindings6 citations
- Retrieving Relevant Context to Align Representations for Cross-lingual Event DetectionFindings6 citations
- SConE: Simplified Cone Embeddings with Symbolic Operators for Complex Logical QueriesFindings6 citations
- SamToNe: Improving Contrastive Loss for Dual Encoder Retrieval Models with Same Tower NegativesFindings6 citations
- Scene-robust Natural Language Video Localization via Learning Domain-invariant RepresentationsFindings6 citations
- Schema-Guided User Satisfaction Modeling for Task-Oriented DialoguesLong6 citations
- Segment-Level and Category-Oriented Network for Knowledge-Based Referring Expression ComprehensionFindings6 citations
- Sentiment Analysis using the Relationship between Users and ProductsFindings6 citations
- Songs Across Borders: Singable and Controllable Neural Lyric TranslationLong6 citations
- Span-Selective Linear Attention Transformers for Effective and Robust Schema-Guided Dialogue State TrackingLong6 citations
- Structure-Discourse Hierarchical Graph for Conditional Question Answering on Long DocumentsFindings6 citations
- Subjective Crowd Disagreements for Subjective Data: Uncovering Meaningful CrowdOpinion with Population-level LearningLong6 citations
- Taxonomy of Problems in Lexical SemanticsFindings6 citations
- Teamwork Is Not Always Good: An Empirical Study of Classifier Drift in Class-incremental Information ExtractionFindings6 citations
- TempLM: Distilling Language Models into Template-Based GeneratorsFindings6 citations
- Text Style Transfer with Contrastive Transfer Pattern MiningLong6 citations
- Towards Alleviating the Object Bias in Prompt Tuning-based Factual Knowledge ExtractionFindings6 citations
- Towards Open-Domain Twitter User Profile InferenceFindings6 citations
- Towards Open-World Product Attribute Mining: A Lightly-Supervised ApproachLong6 citations
- Towards Zero-Shot Persona Dialogue Generation with In-Context LearningFindings6 citations
- Trade-Offs Between Fairness and Privacy in Language ModelingFindings6 citations
- Transferring General Multimodal Pretrained Models to Text RecognitionFindings6 citations
- Trigger-Argument based Explanation for Event DetectionFindings6 citations
- Two-Stage Fine-Tuning for Improved Bias and Variance for Large Pretrained Language ModelsLong6 citations
- Understanding and Improving the Robustness of Terminology Constraints in Neural Machine TranslationLong6 citations
- UniLG: A Unified Structure-aware Framework for Lyrics GenerationLong6 citations
- Universal Information Extraction with Meta-Pretrained Self-RetrievalFindings6 citations
- Verifying Annotation Agreement without Multiple Experts: A Case Study with Gujarati SNACSFindings6 citations
- WYWEB: A NLP Evaluation Benchmark For Classical ChineseFindings6 citations
- What are the Desired Characteristics of Calibration Sets? Identifying Correlates on Long Form Scientific SummarizationLong6 citations
- When Does Aggregating Multiple Skills with Multi-Task Learning Work? A Case Study in Financial NLPLong6 citations
- With Prejudice to None: A Few-Shot, Multilingual Transfer Learning Approach to Detect Social Bias in Low Resource LanguagesFindings6 citations
- Your spouse needs professional help: Determining the Contextual Appropriateness of Messages through Modeling Social RelationshipsLong6 citations
- A Cautious Generalization Goes a Long Way: Learning Morphophonological RulesLong5 citations
- A Confidence-based Partial Label Learning Model for Crowd-Annotated Named Entity RecognitionFindings5 citations
- A Fast Algorithm for Computing Prefix ProbabilitiesShort5 citations
- A Theory of Unsupervised Speech RecognitionLong5 citations
- A Weakly Supervised Classifier and Dataset of White Supremacist LanguageShort5 citations
- AI Coach Assist: An Automated Approach for Call Recommendation in Contact Centers for Agent CoachingIndustry5 citations
- AMRs Assemble! Learning to Ensemble with Autoregressive Models for AMR ParsingShort5 citations
- Ambiguity Meets Uncertainty: Investigating Uncertainty Estimation for Word Sense DisambiguationFindings5 citations
- Ambiguous Learning from Retrieval: Towards Zero-shot Semantic ParsingLong5 citations
- An Invariant Learning Characterization of Controlled Text GenerationLong5 citations
- Answering Unanswered Questions through Semantic Reformulations in Spoken QAIndustry5 citations
- AttenWalker: Unsupervised Long-Document Question Answering via Attention-based Graph WalkingFindings5 citations
- Automated Refugee Case Analysis: An NLP Pipeline for Supporting Legal PractitionersFindings5 citations
- Automatic Annotation of Direct Speech in Written French NarrativesLong5 citations
- Automatic Readability Assessment for Closely Related LanguagesFindings5 citations
- BIG-C: a Multimodal Multi-Purpose Dataset for BembaLong5 citations
- Balancing Lexical and Semantic Quality in Abstractive SummarizationShort5 citations
- Beyond Contrastive Learning: A Variational Generative Model for Multilingual RetrievalLong5 citations
- CFL: Causally Fair Language Models Through Token-level Attribute Controlled GenerationFindings5 citations
- CORE: Cooperative Training of Retriever-Reranker for Effective Dialogue Response SelectionLong5 citations
- CausalDialogue: Modeling Utterance-level Causality in ConversationsFindings5 citations
- Class-Adaptive Self-Training for Relation Extraction with Incompletely Annotated Training DataFindings5 citations
- CoLaDa: A Collaborative Label Denoising Framework for Cross-lingual Named Entity RecognitionLong5 citations
- Common Law Annotations: Investigating the Stability of Dialog System Output AnnotationsFindings5 citations
- Compositional Mathematical Encoding for Math Word ProblemsFindings5 citations
- Connectivity Patterns are Task EmbeddingsFindings5 citations
- Context-Aware Query Rewriting for Improving Users’ Search Experience on E-commerce WebsitesIndustry5 citations
- Contextual Distortion Reveals Constituency: Masked Language Models are Implicit ParsersLong5 citations
- Controlling Learned Effects to Reduce Spurious Correlations in Text ClassifiersLong5 citations
- Counterfactual Multihop QA: A Cause-Effect Approach for Reducing Disconnected ReasoningLong5 citations
- Cross Encoding as Augmentation: Towards Effective Educational Text ClassificationFindings5 citations
- Cross-Modal Attribute Insertions for Assessing the Robustness of Vision-and-Language LearningLong5 citations
- Dating Greek Papyri with Text RegressionLong5 citations
- Dependency resolution at the syntax-semantics interface: psycholinguistic and computational insights on control dependenciesLong5 citations
- Detecting Contradictory COVID-19 Drug Efficacy Claims from Biomedical LiteratureShort5 citations
- Disentangling Aspect and Stance via a Siamese Autoencoder for Aspect Clustering of Vaccination OpinionsFindings5 citations
- Disentangling Reasoning Capabilities from Language Models with Compositional Reasoning TransformersFindings5 citations
- Domain Incremental Lifelong Learning in an Open WorldFindings5 citations
- Dual Cache for Long Document Neural Coreference ResolutionLong5 citations
- Efficient Shapley Values Estimation by Amortization for Text ClassificationLong5 citations
- EmbedTextNet: Dimension Reduction with Weighted Reconstruction and Correlation Losses for Efficient Text EmbeddingFindings5 citations
- Entropy-guided Vocabulary Augmentation of Multilingual Language Models for Low-resource TasksFindings5 citations
- Envisioning Future from the Past: Hierarchical Duality Learning for Multi-Turn Dialogue GenerationLong5 citations
- Exploiting Hierarchically Structured Categories in Fine-grained Chinese Named Entity RecognitionFindings5 citations
- Exploring How Generative Adversarial Networks Learn Phonological RepresentationsLong5 citations
- Exploring the Capacity of Pretrained Language Models for Reasoning about Actions and ChangeLong5 citations
- Federated Domain Adaptation for Named Entity Recognition via Distilling with Heterogeneous Tag SetsFindings5 citations
- Federated Learning for Semantic Parsing: Task Formulation, Evaluation Setup, New AlgorithmsLong5 citations
- Fixed Input Parameterization for Efficient PromptingFindings5 citations
- Follow the leader(board) with confidence: Estimating p-values from a single test set with item and response varianceFindings5 citations
- Free Lunch: Robust Cross-Lingual Transfer via Model Checkpoint AveragingLong5 citations
- GUMSum: Multi-Genre Data and Evaluation for English Abstractive SummarizationFindings5 citations
- Generate-then-Retrieve: Intent-Aware FAQ Retrieval in Product SearchIndustry5 citations
- Generating Hashtags for Short-form Videos with Guided SignalsLong5 citations
- Generating Labeled Data for Relation Extraction: A Meta Learning Approach with Joint GPT-2 TrainingFindings5 citations
- Guiding Computational Stance Detection with Expanded Stance Triangle FrameworkLong5 citations
- Guiding Dialogue Agents to Complex Semantic Targets by Dynamically Completing Knowledge GraphFindings5 citations
- HeGeL: A Novel Dataset for Geo-Location from Hebrew TextFindings5 citations
- Helping a Friend or Supporting a Cause? Disentangling Active and Passive Cosponsorship in the U.S. CongressLong5 citations
- HiFi: High-Information Attention Heads Hold for Parameter-Efficient Model AdaptationLong5 citations
- How Many Answers Should I Give? An Empirical Study of Multi-Answer Reading ComprehensionFindings5 citations
- How Well Apply Simple MLP to Incomplete Utterance Rewriting?Short5 citations
- IDRISI-RA: The First Arabic Location Mention Recognition Dataset of Disaster TweetsLong5 citations
- IM-TQA: A Chinese Table Question Answering Dataset with Implicit and Multi-type Table StructuresLong5 citations
- Ideology Prediction from Scarce and Biased Supervision: Learn to Disregard the “What” and Focus on the “How”!Long5 citations
- Implicit Memory Transformer for Computationally Efficient Simultaneous Speech TranslationFindings5 citations
- Improving Named Entity Recognition via Bridge-based Domain AdaptationFindings5 citations
- Improving Pretraining Techniques for Code-Switched NLPLong5 citations
- Improving Translation Quality Estimation with Bias MitigationLong5 citations
- KAFA: Rethinking Image Ad Understanding with Knowledge-Augmented Feature Adaptation of Vision-Language ModelsIndustry5 citations
- LET: Leveraging Error Type Information for Grammatical Error CorrectionFindings5 citations
- Label Agnostic Pre-training for Zero-shot Text ClassificationFindings5 citations
- Label efficient semi-supervised conversational intent classificationIndustry5 citations
- Language of BargainingLong5 citations
- Learning Action Conditions from Instructional Manuals for Instruction UnderstandingLong5 citations
- Learning Answer Generation using Supervision from Automatic Question Answering EvaluatorsLong5 citations
- Learning to Predict Persona Information for Dialogue Personalization without Explicit Persona DescriptionFindings5 citations
- MEMEX: Detecting Explanatory Evidence for Memes via Knowledge-Enriched ContextualizationLong5 citations
- ManagerTower: Aggregating the Insights of Uni-Modal Experts for Vision-Language Representation LearningLong5 citations
- Modality Adaption or Regularization? A Case Study on End-to-End Speech TranslationShort5 citations
- Modularized Zero-shot VQA with Pre-trained ModelsFindings5 citations
- Morphological Inflection: A Reality CheckLong5 citations
- Multi-Domain Dialogue State Tracking with Disentangled Domain-Slot AttentionFindings5 citations
- Multilingual Event Extraction from Historical Newspaper AdvertsLong5 citations
- Multilingual Knowledge Graph Completion with Language-Sensitive Multi-Graph AttentionLong5 citations
- NEUROSTRUCTURAL DECODING: Neural Text Generation with Structural ConstraintsLong5 citations
- On Degrees of Freedom in Defining and Testing Natural Language UnderstandingFindings5 citations
- PMI-Align: Word Alignment With Point-Wise Mutual Information Without Requiring Parallel Training DataFindings5 citations
- PV2TEA: Patching Visual Modality to Textual-Established Information ExtractionFindings5 citations
- PVGRU: Generating Diverse and Relevant Dialogue Responses via Pseudo-Variational MechanismLong5 citations
- Parallel Data Helps Neural Entity Coreference ResolutionFindings5 citations
- Phrase Retrieval for Open Domain Conversational Question Answering with Conversational Dependency Modeling via Contrastive LearningFindings5 citations
- Pivotal Role of Language Modeling in Recommender Systems: Enriching Task-specific and Task-agnostic Representation LearningLong5 citations
- Pragmatic Inference with a CLIP Listener for Contrastive CaptioningFindings5 citations
- Prompt Tuning for Unified Multimodal Pretrained ModelsFindings5 citations
- Prototype-Based Interpretability for Legal Citation PredictionFindings5 citations
- Real-World Compositional Generalization with Disentangled Sequence-to-Sequence LearningFindings5 citations
- Reimagining Retrieval Augmented Language Models for Answering QueriesFindings5 citations
- Reinforced Active Learning for Low-Resource, Domain-Specific, Multi-Label Text ClassificationFindings5 citations
- Response-conditioned Turn-taking PredictionFindings5 citations
- Responsibility Perspective Transfer for Italian Femicide NewsFindings5 citations
- Revisiting Sample Size Determination in Natural Language UnderstandingFindings5 citations
- Revisiting Sentence Union Generation as a Testbed for Text ConsolidationFindings5 citations
- SETI: Systematicity Evaluation of Textual InferenceFindings5 citations
- SIMMC-VR: A Task-oriented Multimodal Dialog Dataset with Situated and Immersive VR StreamsLong5 citations
- SPEECH: Structured Prediction with Energy-Based Event-Centric HyperspheresLong5 citations
- SPM: A Split-Parsing Method for Joint Multi-Intent Detection and Slot FillingIndustry5 citations
- Search Query Spell Correction with Weak Supervision in E-commerceIndustry5 citations
- Seen to Unseen: Exploring Compositional Generalization of Multi-Attribute Controllable Dialogue GenerationLong5 citations
- Semantic-conditioned Dual Adaptation for Cross-domain Query-based Visual SegmentationFindings5 citations
- Semi-Supervised Domain Adaptation for Emotion-Related TasksFindings5 citations
- So many design choices: Improving and interpreting neural agent communication in signaling gamesFindings5 citations
- StructSP: Efficient Fine-tuning of Task-Oriented Dialog System by Using Structure-aware Boosting and Grammar ConstraintsFindings5 citations
- Stubborn Lexical Bias in Data and ModelsFindings5 citations
- Test-time Adaptation for Machine Translation Evaluation by Uncertainty MinimizationLong5 citations
- To Adapt or to Annotate: Challenges and Interventions for Domain Adaptation in Open-Domain Question AnsweringLong5 citations
- Token-wise Decomposition of Autoregressive Language Model Hidden States for Analyzing Model PredictionsLong5 citations
- Towards Better Entity Linking with Multi-View Enhanced DistillationLong5 citations
- Towards Domain-Agnostic and Domain-Adaptive Dementia Detection from Spoken LanguageLong5 citations
- Towards Fewer Hallucinations in Knowledge-Grounded Dialogue Generation via Augmentative and Contrastive Knowledge-DialogueShort5 citations
- Towards Identifying Fine-Grained Depression Symptoms from MemesLong5 citations
- Towards Reference-free Text Simplification Evaluation with a BERT Siamese Network ArchitectureFindings5 citations
- Tucker Decomposition with Frequency Attention for Temporal Knowledge Graph CompletionFindings5 citations
- UMSE: Unified Multi-scenario Summarization EvaluationFindings5 citations
- Uncovering and Categorizing Social Biases in Text-to-SQLLong5 citations
- Uni-Encoder: A Fast and Accurate Response Selection Paradigm for Generation-Based Dialogue SystemsFindings5 citations
- Unified Contextual Query RewritingIndustry5 citations
- Using Domain Knowledge to Guide Dialog Structure Induction via Neural Probabilistic Soft LogicLong5 citations
- When to Read Documents or QA History: On Unified and Selective Open-domain QAFindings5 citations
- Zero-Shot Classification by Logical Reasoning on Natural Language ExplanationsFindings5 citations
- “A Little is Enough”: Few-Shot Quality Estimation based Corpus Filtering improves Machine TranslationFindings5 citations
- A Class-Rebalancing Self-Training Framework for Distantly-Supervised Named Entity RecognitionFindings4 citations
- A Set Prediction Network For Extractive SummarizationFindings4 citations
- Adaptive Ordered Information Extraction with Deep Reinforcement LearningFindings4 citations
- Adversarial Training for Low-Resource Disfluency CorrectionFindings4 citations
- AlignSTS: Speech-to-Singing Conversion via Cross-Modal AlignmentFindings4 citations
- An Integrated Approach for Political Bias Prediction and Explanation Based on Discursive StructureFindings4 citations
- AnaMeta: A Table Understanding Dataset of Field Metadata Knowledge Shared by Multi-dimensional Data Analysis TasksFindings4 citations
- Are Pre-trained Language Models Useful for Model Ensemble in Chinese Grammatical Error Correction?Short4 citations
- Asymmetric feature interaction for interpreting model predictionsFindings4 citations
- Attribute Controlled Dialogue PromptingFindings4 citations
- Automatic Creation of Named Entity Recognition Datasets by Querying Phrase RepresentationsLong4 citations
- Back to Patterns: Efficient Japanese Morphological Analysis with Feature-Sequence TrieShort4 citations
- Balancing the Effect of Training Dataset Distribution of Multiple Styles for Multi-Style Text TransferFindings4 citations
- CASN:Class-Aware Score Network for Textual Adversarial DetectionLong4 citations
- CLCL: Non-compositional Expression Detection with Contrastive Learning and Curriculum LearningLong4 citations
- Characterizing the Impacts of Instances on RobustnessFindings4 citations
- Chemical Language Understanding BenchmarkIndustry4 citations
- ClaimDiff: Comparing and Contrasting Claims on Contentious IssuesFindings4 citations
- Clinical Note Owns its Hierarchy: Multi-Level Hypergraph Neural Networks for Patient-Level Representation LearningLong4 citations
- Coherent or Not? Stressing a Neural Language Model for Discourse Coherence in Multiple LanguagesFindings4 citations
- Constructing Code-mixed Universal Dependency Forest for Unbiased Cross-lingual Relation ExtractionFindings4 citations
- Context-Aware Transformer Pre-Training for Answer Sentence SelectionShort4 citations
- Contrastive Learning with Adversarial Examples for Alleviating Pathology of Language ModelLong4 citations
- Controlled Text Generation with Hidden Representation TransformationsFindings4 citations
- Curriculum Learning for Graph Neural Networks: A Multiview Competence-based ApproachLong4 citations
- Debiasing should be Good and Bad: Measuring the Consistency of Debiasing Techniques in Language ModelsFindings4 citations
- Decoding Symbolism in Language ModelsLong4 citations
- DecompEval: Evaluating Generated Texts as Unsupervised Decomposed Question AnsweringLong4 citations
- Denoising Enhanced Distantly Supervised Ultrafine Entity TypingFindings4 citations
- Detecting Adversarial Samples through Sharpness of Loss LandscapeFindings4 citations
- Disambiguated Lexically Constrained Neural Machine TranslationFindings4 citations
- Disentangling Text Representation With Counter-Template For Unsupervised Opinion SummarizationFindings4 citations
- Disfluency Generation for More Robust Dialogue SystemsFindings4 citations
- DivHSK: Diverse Headline Generation using Self-Attention based Keyword SelectionFindings4 citations
- Do I have the Knowledge to Answer? Investigating Answerability of Knowledge Base QuestionsLong4 citations
- Don’t Parse, Choose Spans! Continuous and Discontinuous Constituency Parsing via Autoregressive Span SelectionLong4 citations
- Duplex Diffusion Models Improve Speech-to-Speech TranslationFindings4 citations
- Eliciting Affective Events from Language Models by Multiple View Co-promptingFindings4 citations
- Enhancing Language Representation with Constructional Information for Natural Language UnderstandingLong4 citations
- Evaluating pragmatic abilities of image captioners on A3DSShort4 citations
- Exploring Non-Verbal Predicates in Semantic Role Labeling: Challenges and OpportunitiesFindings4 citations
- Exploring the Impact of Vision Features in News Image CaptioningFindings4 citations
- FAA: Fine-grained Attention Alignment for Cascade Document RankingLong4 citations
- Factual or Contextual? Disentangling Error Types in Entity Description GenerationLong4 citations
- Few-shot Adaptation Works with UnpredicTable DataLong4 citations
- Focusing, Bridging and Prompting for Few-shot Nested Named Entity RecognitionFindings4 citations
- Foveate, Attribute, and Rationalize: Towards Physically Safe and Trustworthy AIFindings4 citations
- Geo-Seq2seq: Twitter User Geolocation on Noisy Data through Sequence to Sequence LearningFindings4 citations
- Graph-based Relation Mining for Context-free Out-of-vocabulary Word Embedding LearningLong4 citations
- HermEs: Interactive Spreadsheet Formula Prediction via Hierarchical Formulet ExpansionLong4 citations
- Hidden Schema NetworksLong4 citations
- HuCurl: Human-induced Curriculum DiscoveryLong4 citations
- HuaSLIM: Human Attention Motivated Shortcut Learning Identification and Mitigation for Large Language modelsFindings4 citations
- HyHTM: Hyperbolic Geometry-based Hierarchical Topic ModelFindings4 citations
- I run as fast as a rabbit, can you? A Multilingual Simile Dialogues DatasetsFindings4 citations
- Improving Language Model Integration for Neural Machine TranslationFindings4 citations
- Incomplete Utterance Rewriting by A Two-Phase Locate-and-Fill RegimeFindings4 citations
- Incorporating Factuality Inference to Identify Document-level Event FactualityFindings4 citations
- InfoSync: Information Synchronization across Multilingual Semi-structured TablesFindings4 citations
- Injecting knowledge into language generation: a case study in auto-charting after-visit care instructions from medical dialogueLong4 citations
- Introducing Semantics into Speech EncodersLong4 citations
- Jointly Reparametrized Multi-Layer Adaptation for Efficient and Private TuningFindings4 citations
- KNOW How to Make Up Your Mind! Adversarially Detecting and Alleviating Inconsistencies in Natural Language ExplanationsShort4 citations
- KNSE: A Knowledge-aware Natural Language Inference Framework for Dialogue Symptom Status RecognitionFindings4 citations
- LI-RAGE: Late Interaction Retrieval Augmented Generation with Explicit Signals for Open-Domain Table Question AnsweringShort4 citations
- Large Language Models Are Partially Primed in Pronoun InterpretationFindings4 citations
- Leveraging Denoised Abstract Meaning Representation for Grammatical Error CorrectionFindings4 citations
- MISMATCH: Fine-grained Evaluation of Machine-generated Text with Mismatch Error TypesFindings4 citations
- Masked Latent Semantic Modeling: an Efficient Pre-training Alternative to Masked Language ModelingFindings4 citations
- Measuring Consistency in Text-based Financial Forecasting ModelsLong4 citations
- Measuring and Mitigating Local Instability in Deep Neural NetworksFindings4 citations
- Modular Transformers: Compressing Transformers into Modularized Layers for Flexible Efficient InferenceFindings4 citations
- Multi-Relational Probabilistic Event Representation Learning via Projected Gaussian EmbeddingFindings4 citations
- Multilingual Knowledge Graph Completion from Pretrained Language Models with Knowledge ConstraintsFindings4 citations
- Multilingual Sequence-to-Sequence Models for Hebrew NLPFindings4 citations
- Multimodal Recommendation Dialog with Subjective Preference: A New Challenge and BenchmarkFindings4 citations
- NLP Reproducibility For All: Understanding Experiences of BeginnersLong4 citations
- Nano: Nested Human-in-the-Loop Reward Learning for Few-shot Language Model ControlFindings4 citations
- NarrowBERT: Accelerating Masked Language Model Pretraining and InferenceShort4 citations
- NatLogAttack: A Framework for Attacking Natural Language Inference Models with Natural LogicLong4 citations
- Neighboring Words Affect Human Interpretation of Saliency ExplanationsFindings4 citations
- Node Placement in Argument Maps: Modeling Unidirectional Relations in High & Low-Resource ScenariosLong4 citations
- Open-World Factually Consistent Question GenerationFindings4 citations
- Query Enhanced Knowledge-Intensive Conversation via Unsupervised Joint ModelingLong4 citations
- Race, Gender, and Age Biases in Biomedical Masked Language ModelsFindings4 citations
- Rapid Diffusion: Building Domain-Specific Text-to-Image Synthesizers with Fast Inference SpeedIndustry4 citations
- Resolving Indirect Referring Expressions for Entity SelectionLong4 citations
- Sampling Better Negatives for Distantly Supervised Named Entity RecognitionFindings4 citations
- Scaling Laws for BERT in Low-Resource SettingsFindings4 citations
- Sentence Ordering with a Coherence VerifierFindings4 citations
- Separating Context and Pattern: Learning Disentangled Sentence Representations for Low-Resource Extractive SummarizationFindings4 citations
- Silver Syntax Pre-training for Cross-Domain Relation ExtractionFindings4 citations
- SkillQG: Learning to Generate Question for Reading Comprehension AssessmentFindings4 citations
- Soft Language Clustering for Multilingual Model Pre-trainingLong4 citations
- Temporal Relation Classification using Boolean Question AnsweringFindings4 citations
- The Best of Both Worlds: Combining Human and Machine Translations for Multilingual Semantic Parsing with Active LearningLong4 citations
- Theory-Grounded Computational Text AnalysisShort4 citations
- Tokenization with Factorized Subword EncodingFindings4 citations
- Topic and Style-aware Transformer for Multimodal Emotion RecognitionFindings4 citations
- Towards Accurate Translation via Semantically Appropriate Application of Lexical ConstraintsFindings4 citations
- Towards Distribution-shift Robust Text Classification of Emotional ContentFindings4 citations
- Transferable and Efficient: Unifying Dynamic Multi-Domain Product CategorizationIndustry4 citations
- Understanding the Cooking Process with English Recipe TextFindings4 citations
- Unsupervised Discontinuous Constituency Parsing with Mildly Context-Sensitive GrammarsLong4 citations
- Unsupervised Selective Rationalization with Noise InjectionLong4 citations
- Vision Meets Definitions: Unsupervised Visual Word Sense Disambiguation Incorporating Gloss InformationLong4 citations
- What is the best recipe for character-level encoder-only modelling?Long4 citations
- Word sense extensionLong4 citations
- XtremeCLIP: Extremely Parameter-efficient Tuning for Low-resource Vision Language UnderstandingFindings4 citations
- ZeroAE: Pre-trained Language Model based Autoencoder for Transductive Zero-shot Text ClassificationFindings4 citations
- “Knowledge is Power”: Constructing Knowledge Graph of Abdominal Organs and Using Them for Automatic Radiology Report GenerationIndustry4 citations
- A Compare-and-contrast Multistage Pipeline for Uncovering Financial Signals in Financial ReportsLong3 citations
- A Diffusion Model for Event Skeleton GenerationFindings3 citations
- A Hierarchical Explanation Generation Method Based on Feature Interaction DetectionFindings3 citations
- A Statistical Exploration of Text Partition Into Constituents: The Case of the Priestly Source in the Books of Genesis and ExodusFindings3 citations
- A Textual Dataset for Situated Proactive Response SelectionLong3 citations
- Advancing Multi-Criteria Chinese Word Segmentation Through Criterion Classification and DenoisingLong3 citations
- Align-then-Enhance: Multilingual Entailment Graph Enhancement with Soft Predicate AlignmentFindings3 citations
- BLOCSUM: Block Scope-based Source Code Summarization via Shared Block RepresentationFindings3 citations
- Bi-level Finetuning with Task-dependent Similarity Structure for Low-resource TrainingFindings3 citations
- Boosting Text Augmentation via Hybrid Instance Filtering FrameworkFindings3 citations
- Bring More Attention to Syntactic Symmetry for Automatic Postediting of High-Quality Machine TranslationsShort3 citations
- CELDA: Leveraging Black-box Language Model as Enhanced Classifier without LabelsLong3 citations
- Can Language Models Make Fun? A Case Study in Chinese Comical CrosstalkLong3 citations
- Class Lifelong Learning for Intent Detection via Structure Consolidation NetworksFindings3 citations
- Constructing Procedural Graphs with Multiple Dependency Relations: A New Dataset and BaselineFindings3 citations
- Contrastive Learning of Sociopragmatic Meaning in Social MediaFindings3 citations
- Controllable Conversation Generation with Conversation Structures via Diffusion ModelsFindings3 citations
- Counterfactual Probing for the Influence of Affect and Specificity on Intergroup BiasFindings3 citations
- Cross-Domain Argument Quality EstimationFindings3 citations
- Cross-lingual AMR Aligner: Paying Attention to Cross-AttentionFindings3 citations
- DEnsity: Open-domain Dialogue Evaluation Metric using Density EstimationFindings3 citations
- DMLM: Descriptive Masked Language ModelingFindings3 citations
- Dialog-Post: Multi-Level Self-Supervised Objectives and Hierarchical Model for Dialogue Post-TrainingLong3 citations
- Distilling Efficient Language-Specific Models for Cross-Lingual TransferFindings3 citations
- Domain Aligned Prefix Averaging for Domain Generalization in Abstractive SummarizationFindings3 citations
- Domain Generalization via Switch Knowledge Distillation for Robust Review RepresentationFindings3 citations
- DynaMiTE: Discovering Explosive Topic Evolutions with User GuidanceFindings3 citations
- Dynamic Regularization in UDA for Transformers in Multimodal ClassificationLong3 citations
- Enhancing Cross-lingual Prompting with Dual Prompt AugmentationFindings3 citations
- Enhancing Out-of-Vocabulary Estimation with Subword AttentionFindings3 citations
- Evaluating Factuality in Cross-lingual SummarizationFindings3 citations
- ExplainMeetSum: A Dataset for Explainable Meeting Summarization Aligned with Human IntentLong3 citations
- Exploiting Commonsense Knowledge about Objects for Visual Activity RecognitionFindings3 citations
- Exploring Anisotropy and Outliers in Multilingual Language Models for Cross-Lingual Semantic Sentence SimilarityFindings3 citations
- Exploring Robust Overfitting for Pre-trained Language ModelsFindings3 citations
- Fantastic Expressions and Where to Find Them: Chinese Simile Generation with Multiple ConstraintsLong3 citations
- Few Shot Rationale Generation using Self-Training with Dual TeachersFindings3 citations
- Free Lunch for Efficient Textual Commonsense Integration in Language ModelsLong3 citations
- From Ultra-Fine to Fine: Fine-tuning Ultra-Fine Entity Typing Models to Fine-grainedLong3 citations
- GVdoc - Graph-based Visual DOcument ClassificationFindings3 citations
- Gradient Ascent Post-training Enhances Language Model GeneralizationShort3 citations
- Grounding the Lexical Substitution Task in EntailmentFindings3 citations
- HAUSER: Towards Holistic and Automatic Evaluation of Simile GenerationLong3 citations
- Holistic Prediction on a Time-Evolving Attributed GraphLong3 citations
- I am PsyAM: Modeling Happiness with Cognitive Appraisal DimensionsFindings3 citations
- Improving Classroom Dialogue Act Recognition from Limited Labeled Data with Self-Supervised Contrastive Learning ClassifiersFindings3 citations
- Improving Diachronic Word Sense Induction with a Nonparametric Bayesian methodFindings3 citations
- In and Out-of-Domain Text Adversarial Robustness via Label SmoothingShort3 citations
- Incomplete Utterance Rewriting as Sequential Greedy TaggingFindings3 citations
- Injecting Comparison Skills in Task-Oriented Dialogue Systems for Database Search Results DisambiguationFindings3 citations
- It is a Bird Therefore it is a Robin: On BERT’s Internal Consistency Between Hypernym Knowledge and Logical WordsFindings3 citations
- Joint End-to-end Semantic Proto-role LabelingShort3 citations
- K-pop and fake facts: from texts to smart alerting for maritime securityIndustry3 citations
- Kanbun-LM: Reading and Translating Classical Chinese in Japanese Methods by Language ModelsFindings3 citations
- Knowing-how & Knowing-that: A New Task for Machine Comprehension of User ManualsFindings3 citations
- LEDA: a Large-Organization Email-Based Decision-Dialogue-Act Analysis DatasetFindings3 citations
- Laziness Is a Virtue When It Comes to Compositionality in Neural Semantic ParsingLong3 citations
- Learning Non-linguistic Skills without Sacrificing Linguistic ProficiencyLong3 citations
- Learning to Rank Utterances for Query-Focused Meeting SummarizationFindings3 citations
- Leveraging Prefix Transfer for Multi-Intent Text RevisionShort3 citations
- MIReAD: Simple Method for Learning High-quality Representations from Scientific DocumentsShort3 citations
- MedNgage: A Dataset for Understanding Engagement in Patient-Nurse ConversationsFindings3 citations
- Modeling Instance Interactions for Joint Information Extraction with Neural High-Order Conditional Random FieldLong3 citations
- Multilingual Pre-training with Self-supervision from Global Co-occurrence InformationFindings3 citations
- Negation Scope Refinement via Boundary Shift LossFindings3 citations
- Neural Topic Modeling based on Cycle Adversarial Training and Contrastive LearningFindings3 citations
- On Search Strategies for Document-Level Neural Machine TranslationFindings3 citations
- On the Interpretability and Significance of Bias Metrics in Texts: a PMI-based ApproachShort3 citations
- Open Set Relation Extraction via Unknown-Aware TrainingLong3 citations
- Pre-training Multi-party Dialogue Models with Latent Discourse InferenceLong3 citations
- Prediction and Calibration: Complex Reasoning over Knowledge Graph with Bi-directional Directed Acyclic Graph Neural NetworkFindings3 citations
- Probing Graph Decomposition for Argument Pair ExtractionFindings3 citations
- Pruning Pre-trained Language Models with Principled Importance and Self-regularizationFindings3 citations
- Pseudo Outlier Exposure for Out-of-Distribution Detection using Pretrained TransformersFindings3 citations
- Recall, Expand, and Multi-Candidate Cross-Encode: Fast and Accurate Ultra-Fine Entity TypingLong3 citations
- Reducing Sensitivity on Speaker Names for Text Generation from DialoguesFindings3 citations
- Rethinking Dictionaries and Glyphs for Chinese Language Pre-trainingFindings3 citations
- Rethinking the Word-level Quality Estimation for Machine Translation from Human JudgementFindings3 citations
- Retrieval-augmented Video Encoding for Instructional CaptioningFindings3 citations
- Revisiting Non-Autoregressive Translation at ScaleFindings3 citations
- Scale-Invariant Infinite Hierarchical Topic ModelFindings3 citations
- Script Normalization for Unconventional Writing of Under-Resourced Languages in Bilingual CommunitiesLong3 citations
- Self-Distilled Quantization: Achieving High Compression Rates in Transformer-Based Language ModelsShort3 citations
- SenteCon: Leveraging Lexicons to Learn Human-Interpretable Language RepresentationsFindings3 citations
- Structural Contrastive Pretraining for Cross-Lingual ComprehensionFindings3 citations
- TACR: A Table Alignment-based Cell Selection Method for HybridQAFindings3 citations
- Tab-CQA: A Tabular Conversational Question Answering Dataset on Financial ReportsIndustry3 citations
- Tab-Cleaner: Weakly Supervised Tabular Data Cleaning via Pre-training for E-commerce CatalogIndustry3 citations
- Take a Break in the Middle: Investigating Subgoals towards Hierarchical Script GenerationFindings3 citations
- Teacher and Student Models of Offensive Language in Social MediaFindings3 citations
- Text Generation Model Enhanced with Semantic Information in Aspect Category Sentiment AnalysisFindings3 citations
- TextVerifier: Robustness Verification for Textual Classifiers with Certifiable GuaranteesFindings3 citations
- The Role of Output Vocabulary in T2T LMs for SPARQL Semantic ParsingFindings3 citations
- The Whole Truth and Nothing But the Truth: Faithful and Controllable Dialogue Response Generation with Dataflow Transduction and Constrained DecodingFindings3 citations
- Topic-Guided Self-Introduction Generation for Social Media UsersFindings3 citations
- Toward Interactive DictationLong3 citations
- Toward More Accurate and Generalizable Evaluation Metrics for Task-Oriented DialogsIndustry3 citations
- Towards Understanding Omission in Dialogue SummarizationLong3 citations
- Tracing Linguistic Markers of Influence in a Large Online OrganisationShort3 citations
- Transcribing Vocal Communications of Domestic Shiba lnu DogsFindings3 citations
- Transitioning from benchmarks to a real-world case of information-seeking in Scientific PublicationsFindings3 citations
- Triggering Multi-Hop Reasoning for Question Answering in Language Models using Soft Prompts and Random WalksFindings3 citations
- UniEvent: Unified Generative Model with Multi-Dimensional Prefix for Zero-Shot Event-Relational ReasoningLong3 citations
- Unsupervised Graph-Text Mutual Conversion with a Unified Pretrained Language ModelLong3 citations
- Unsupervised Subtitle Segmentation with Masked Language ModelsShort3 citations
- Unsupervised Summarization Re-rankingFindings3 citations
- Weighted Contrastive Learning With False Negative Control to Help Long-tailed Product ClassificationIndustry3 citations
- What does the Failure to Reason with “Respectively” in Zero/Few-Shot Settings Tell Us about Language Models?Long3 citations
- bgGLUE: A Bulgarian General Language Understanding Evaluation BenchmarkLong3 citations
- mPMR: A Multilingual Pre-trained Machine Reader at ScaleShort3 citations
- A Holistic Approach to Reference-Free Evaluation of Machine TranslationShort2 citations
- A New Task and Dataset on Detecting Attacks on Human Rights DefendersFindings2 citations
- A Pilot Study on Dialogue-Level Dependency Parsing for ChineseFindings2 citations
- A Self-Supervised Integration Method of Pretrained Language Models and Word DefinitionsFindings2 citations
- A Unified Knowledge Graph Augmentation Service for Boosting Domain-specific NLP TasksFindings2 citations
- AVEN-GR: Attribute Value Extraction and Normalization using product GRaphsIndustry2 citations
- Acquiring Frame Element Knowledge with Deep Metric Learning for Semantic Frame InductionFindings2 citations
- An Exploratory Study on Model Compression for Text-to-SQLFindings2 citations
- Analyzing and Reducing the Performance Gap in Cross-Lingual Transfer with Fine-tuning Slow and FastLong2 citations
- Application-Agnostic Language Modeling for On-Device ASRIndustry2 citations
- Are Intermediate Layers and Labels Really Necessary? A General Language Model Distillation MethodFindings2 citations
- Assessing Word Importance Using Models Trained for Semantic TasksFindings2 citations
- Automatic Named Entity Obfuscation in SpeechFindings2 citations
- Bootstrapping Neural Relation and Explanation ClassifiersShort2 citations
- CATS: A Pragmatic Chinese Answer-to-Sequence Dataset with Large Scale and High QualityLong2 citations
- CIF-PT: Bridging Speech and Text Representations for Spoken Language Understanding via Continuous Integrate-and-Fire Pre-TrainingFindings2 citations
- COGEN: Abductive Commonsense Language GenerationShort2 citations
- CSS: A Large-scale Cross-schema Chinese Text-to-SQL Medical DatasetFindings2 citations
- Causal Matching with Text Embeddings: A Case Study in Estimating the Causal Effects of Peer Review PoliciesFindings2 citations
- Characterizing and Measuring Linguistic Dataset DriftLong2 citations
- Class based Influence Functions for Error DetectionShort2 citations
- CoMave: Contrastive Pre-training with Multi-scale Masking for Attribute Value ExtractionFindings2 citations
- Code-Switched Text Synthesis in Unseen Language PairsFindings2 citations
- Consistent Text Categorization using Data Augmentation in e-CommerceIndustry2 citations
- Constrained Policy Optimization for Controlled Self-Learning in Conversational AI SystemsIndustry2 citations
- Contextualized Semantic Distance between Highly Overlapped TextsFindings2 citations
- Contrastive Training Improves Zero-Shot Classification of Semi-structured DocumentsFindings2 citations
- Correction of Errors in Preference Ratings from Automated Metrics for Text GenerationFindings2 citations
- Covering Uncommon Ground: Gap-Focused Question Generation for Answer AssessmentShort2 citations
- Curating Datasets for Better Performance with Example Training DynamicsFindings2 citations
- DAMP: Doubly Aligned Multilingual Parser for Task-Oriented DialogueLong2 citations
- Deep Equilibrium Non-Autoregressive Sequence LearningFindings2 citations
- Deep Model Compression Also Helps Models Capture AmbiguityLong2 citations
- Detection and Mitigation of the Negative Impact of Dataset Extractivity on Abstractive SummarizationFindings2 citations
- DiMS: Distilling Multiple Steps of Iterative Non-Autoregressive Transformers for Machine TranslationFindings2 citations
- Distributed Marker Representation for Ambiguous Discourse Markers and Entangled RelationsLong2 citations
- ECG-QALM: Entity-Controlled Synthetic Text Generation using Contextual Q&A for NERFindings2 citations
- Easy Guided Decoding in Providing Suggestions for Interactive Machine TranslationLong2 citations
- Efficient Diagnosis Assignment Using Unstructured Clinical NotesShort2 citations
- Ellipsis-Dependent Reasoning: a New Challenge for Large Language ModelsShort2 citations
- Emotion Cause Extraction on Social Media without Human AnnotationFindings2 citations
- Encoder and Decoder, Not One Less for Pre-trained Language Model Sponsored NMTFindings2 citations
- Evaluation of Question Generation Needs More ReferencesFindings2 citations
- Event-Centric Query Expansion in Web SearchIndustry2 citations
- EventOA: An Event Ontology Alignment Benchmark Based on FrameNet and WikidataFindings2 citations
- Explanation Regeneration via Information BottleneckFindings2 citations
- Exploring Schema Generalizability of Text-to-SQLFindings2 citations
- Exploring the Compositional Generalization in Context Dependent Text-to-SQL ParsingFindings2 citations
- FERMAT: An Alternative to Accuracy for Numerical ReasoningLong2 citations
- From the One, Judge of the Whole: Typed Entailment Graph Construction with Predicate GenerationLong2 citations
- Fusion or Defusion? Flexible Vision-and-Language Pre-TrainingFindings2 citations
- G-Tuning: Improving Generalization of Pre-trained Language Models with Generative Adversarial NetworkFindings2 citations
- Grammar-based Decoding for Improved Compositional Generalization in Semantic ParsingFindings2 citations
- History Semantic Graph Enhanced Conversational KBQA with Temporal Information ModelingLong2 citations
- HonestBait: Forward References for Attractive but Faithful Headline GenerationFindings2 citations
- How does the task complexity of masked pretraining objectives affect downstream performance?Findings2 citations
- How effective is machine translation on low-resource code-switching? A case study comparing human and automatic metricsFindings2 citations
- Human Inspired Progressive Alignment and Comparative Learning for Grounded Word AcquisitionLong2 citations
- Hunt for Buried Treasures: Extracting Unclaimed Embodiments from Patent SpecificationsIndustry2 citations
- Hybrid and Collaborative Passage RerankingFindings2 citations
- Hypothetical Training for Robust Machine Reading Comprehension of Tabular ContextFindings2 citations
- Improving Autoregressive Grammatical Error Correction with Non-autoregressive ModelsFindings2 citations
- Improving Cross-task Generalization of Unified Table-to-text Models with Compositional Task ConfigurationsFindings2 citations
- Improving Syntactic Probing Correctness and Robustness with Control TasksShort2 citations
- Interpreting Positional Information in Perspective of Word OrderLong2 citations
- Investigating the Saliency of Sentiment Expressions in Aspect-Based Sentiment AnalysisFindings2 citations
- K-UniMorph: Korean Universal Morphology and its Feature SchemaFindings2 citations
- Knowledge Graph Embeddings using Neural Ito Process: From Multiple Walks to Stochastic TrajectoriesFindings2 citations
- LR-Sum: Summarization for Less-Resourced LanguagesFindings2 citations
- LaSQuE: Improved Zero-Shot Classification from Explanations Through Quantifier Modeling and Curriculum LearningFindings2 citations
- Learning Query Adaptive Anchor Representation for Inductive Relation PredictionFindings2 citations
- Learning from Children: Improving Image-Caption Pretraining via CurriculumFindings2 citations
- Let Me Check the Examples: Enhancing Demonstration Learning via Explicit ImitationShort2 citations
- Leveraging Synthetic Targets for Machine TranslationFindings2 citations
- Local Temperature Beam Search: Avoid Neural Text DeGeneration via Enhanced CalibrationFindings2 citations
- Making Pre-trained Language Models Better Learn Few-Shot Spoken Language Understanding in More Practical ScenariosFindings2 citations
- Masked Audio Text Encoders are Effective Multi-Modal RescorersFindings2 citations
- Measuring the Instability of Fine-TuningLong2 citations
- Mind the Gap between the Application Track and the Real WorldShort2 citations
- Model Interpretability and Rationale Extraction by Input Mask OptimizationFindings2 citations
- Model-Generated Pretraining Signals Improves Zero-Shot Generalization of Text-to-Text TransformersLong2 citations
- Modeling the Q-Diversity in a Min-max Play Game for Robust OptimizationFindings2 citations
- Multi-doc Hybrid Summarization via Salient Representation LearningIndustry2 citations
- Multijugate Dual Learning for Low-Resource Task-Oriented Dialogue SystemFindings2 citations
- NatCS: Eliciting Natural Customer Support DialoguesFindings2 citations
- On the Correspondence between Compositionality and Imitation in Emergent Neural CommunicationFindings2 citations
- On the Universal Adversarial Perturbations for Efficient Data-free Adversarial DetectionFindings2 citations
- On-the-fly Cross-lingual Masking for Multilingual Pre-trainingLong2 citations
- OpenPI-C: A Better Benchmark and Stronger Baseline for Open-Vocabulary State TrackingFindings2 citations
- PLAtE: A Large-scale Dataset for List Page Web ExtractionIndustry2 citations
- Peeking inside the black box: A Commonsense-aware Generative Framework for Explainable Complaint DetectionLong2 citations
- People and Places of Historical Europe: Bootstrapping Annotation Pipeline and a New Corpus of Named Entities in Late Medieval TextsFindings2 citations
- Probabilistic Transformer: A Probabilistic Dependency Model for Contextual Word RepresentationFindings2 citations
- Question-Interlocutor Scope Realized Graph Modeling over Key Utterances for Dialogue Reading ComprehensionFindings2 citations
- RISE: Leveraging Retrieval Techniques for Summarization EvaluationFindings2 citations
- Reanalyzing L2 Preposition Learning with Bayesian Mixed Effects and a Pretrained Language ModelLong2 citations
- Reconstruction ProbingFindings2 citations
- Reducing cohort bias in natural language understanding systems with targeted self-training schemeIndustry2 citations
- Referring to Screen Texts with Voice AssistantsIndustry2 citations
- Regression-Free Model Updates for Spoken Language UnderstandingIndustry2 citations
- Risks and NLP Design: A Case Study on Procedural Document QAFindings2 citations
- Simple Augmentations of Logical Rules for Neuro-Symbolic Knowledge Graph CompletionShort2 citations
- SlowBERT: Slow-down Attacks on Input-adaptive Multi-exit BERTFindings2 citations
- Soft Alignment Objectives for Robust Adaptation of Language GenerationLong2 citations
- Solving Cosine Similarity Underestimation between High Frequency Words by ℓ2 Norm DiscountingFindings2 citations
- SongRewriter: A Chinese Song Rewriting System with Controllable Content and Rhyme SchemeFindings2 citations
- Spontaneous gestures encoded by hand positions improve language models: An Information-Theoretic motivated studyFindings2 citations
- Stop Pre-Training: Adapt Visual-Language Models to Unseen LanguagesShort2 citations
- Structured Mean-Field Variational Inference for Higher-Order Span-Based Semantic Role LabelingFindings2 citations
- Table and Image Generation for Investigating Knowledge of Entities in Pre-trained Vision and Language ModelsShort2 citations
- Target-Based Offensive Language IdentificationShort2 citations
- Target-Oriented Relation Alignment for Cross-Lingual Stance DetectionFindings2 citations
- Task-adaptive Label Dependency Transfer for Few-shot Named Entity RecognitionFindings2 citations
- The KITMUS Test: Evaluating Knowledge Integration from Multiple SourcesLong2 citations
- Theory of Mind in Freely-Told Children’s Narratives: A Classification ApproachFindings2 citations
- Towards Open Environment Intent PredictionFindings2 citations
- Towards Robust Low-Resource Fine-Tuning with Multi-View Compressed RepresentationsLong2 citations
- Towards Zero-Shot Multilingual Transfer for Code-Switched ResponsesLong2 citations
- Type Enhanced BERT for Correcting NER ErrorsFindings2 citations
- Understanding Demonstration-based Learning from a Causal PerspectiveShort2 citations
- Using Neural Machine Translation for Generating Diverse Challenging Exercises for Language LearnerLong2 citations
- Using contradictions improves question answering systemsShort2 citations
- Using counterfactual contrast to improve compositional generalization for multi-step quantitative reasoningLong2 citations
- Weakly Supervised Vision-and-Language Pre-training with Relative RepresentationsLong2 citations
- Yes, this Way! Learning to Ground Referring Expressions into Actions with Intra-episodic Feedback from Supportive TeachersFindings2 citations
- infoVerse: A Universal Framework for Dataset Characterization with Multidimensional Meta-informationLong2 citations
- lilGym: Natural Language Visual Reasoning with Reinforcement LearningLong2 citations
- A Comparative Analysis of the Effectiveness of Rare Tokens on Creative Expression using ramBERTFindings1 citations
- A Multi-task Learning Framework for Quality EstimationFindings1 citations
- ACTC: Active Threshold Calibration for Cold-Start Knowledge Graph CompletionShort1 citations
- Abstract then Play: A Skill-centric Reinforcement Learning Framework for Text-based GamesFindings1 citations
- Analyzing Text Representations by Measuring Task AlignmentShort1 citations
- Annotating Research Infrastructure in Scientific Papers: An NLP-driven ApproachIndustry1 citations
- Another Dead End for Morphological Tags? Perturbed Inputs and ParsingFindings1 citations
- Are Layout-Infused Language Models Robust to Layout Distribution Shifts? A Case Study with Scientific DocumentsFindings1 citations
- Attend, Select and Eliminate: Accelerating Multi-turn Response Selection with Dual-attention-based Content EliminationFindings1 citations
- Automated Digitization of Unstructured Medical PrescriptionsIndustry1 citations
- Automatic Identification of Code-Switching Functions in Speech TranscriptsFindings1 citations
- Bridging The Gap: Entailment Fused-T5 for Open-retrieval Conversational Machine Reading ComprehensionLong1 citations
- Building Accurate Low Latency ASR for Streaming Voice Search in E-commerceIndustry1 citations
- C-XNLI: Croatian Extension of XNLI DatasetFindings1 citations
- CUPID: Curriculum Learning Based Real-Time Prediction using DistillationIndustry1 citations
- CWSeg: An Efficient and General Approach to Chinese Word SegmentationIndustry1 citations
- Categorial grammar induction from raw dataFindings1 citations
- CoMix: Guide Transformers to Code-Mix using POS structure and PhoneticsFindings1 citations
- Comparative evaluation of boundary-relaxed annotation for Entity Linking performanceLong1 citations
- Conjunct Lengths in English, Dependency Length Minimization, and Dependency Structure of CoordinationLong1 citations
- Constrained Tuple Extraction with Interaction-Aware NetworkLong1 citations
- Convergence and Diversity in the Control HierarchyLong1 citations
- Cross-task Knowledge Transfer for Extremely Weakly Supervised Text ClassificationFindings1 citations
- DARE: Towards Robust Text Explanations in Biomedical and Healthcare ApplicationsLong1 citations
- DSPM-NLG: A Dual Supervised Pre-trained Model for Few-shot Natural Language Generation in Task-oriented Dialogue SystemFindings1 citations
- Decomposed scoring of CCG dependenciesShort1 citations
- Deep Active Learning for Morphophonological ProcessingShort1 citations
- Differentiable Instruction Optimization for Cross-Task GeneralizationFindings1 citations
- Distinguishing Address vs. Reference Mentions of Personal Names in TextFindings1 citations
- Domain-Agnostic Neural Architecture for Class Incremental Continual Learning in Document Processing PlatformIndustry1 citations
- Domain-specific Attention with Distributional Signatures for Multi-Domain End-to-end Task-Oriented DialogueFindings1 citations
- Domain-specific transformer models for query translationIndustry1 citations
- DopplerBAS: Binaural Audio Synthesis Addressing Doppler EffectFindings1 citations
- Dramatic Conversation DisentanglementFindings1 citations
- EEL: Efficiently Encoding Lattices for RerankingLong1 citations
- Early Discovery of Disappearing Entities in MicroblogsLong1 citations
- Entity Contrastive Learning in a Large-Scale Virtual Assistant SystemIndustry1 citations
- Evaluating Zero-Shot Event Structures: Recommendations for Automatic Content Extraction (ACE) AnnotationsShort1 citations
- EvolveMT: an Ensemble MT Engine Improving Itself with Usage OnlyIndustry1 citations
- Explanation Graph Generation via Generative Pre-training over Synthetic GraphsFindings1 citations
- Exploring Variation of Results from Different Experimental ConditionsFindings1 citations
- Extracting Shopping Interest-Related Product Types from the WebFindings1 citations
- Few-Shot Data-to-Text Generation via Unified Representation and Multi-Source LearningLong1 citations
- Hybrid-Regressive Paradigm for Accurate and Speed-Robust Neural Machine TranslationFindings1 citations
- INTapt: Information-Theoretic Adversarial Prompt Tuning for Enhanced Non-Native Speech RecognitionFindings1 citations
- Imagination is All You Need! Curved Contrastive Learning for Abstract Sequence Modeling Utilized on Long Short-Term Dialogue PlanningFindings1 citations
- Improving Grammar-based Sequence-to-Sequence Modeling with Decomposition and ConstraintsShort1 citations
- Improving Knowledge Production Efficiency With Question Answering on ConversationIndustry1 citations
- Investigating Transformer-Guided Chaining for Interpretable Natural Logic ReasoningFindings1 citations
- Learning Neuro-Symbolic World Models with Conversational ProprioceptionShort1 citations
- Leveraging Explicit Procedural Instructions for Data-Efficient Action PredictionFindings1 citations
- Lexical Translation Inconsistency-Aware Document-Level Translation RepairFindings1 citations
- Listener Model for the PhotoBook Referential Game with CLIPScores as Implicit Reference ChainShort1 citations
- Logic-driven Indirect Supervision: An Application to Crisis CounselingLong1 citations
- Logical Transformers: Infusing Logical Structures into Pre-Trained Language ModelsFindings1 citations
- MTR: A Dataset Fusing Inductive, Deductive, and Defeasible ReasoningFindings1 citations
- Massively Multilingual Lexical Specialization of Multilingual TransformersLong1 citations
- Misleading Relation Classifiers by Substituting Words in TextsFindings1 citations
- Mitigating the Learning Bias towards Repetition by Self-Contrastive Training for Open-Ended GenerationFindings1 citations
- MobileNMT: Enabling Translation in 15MB and 30msIndustry1 citations
- Model Analysis & Evaluation for Ambiguous Question AnsweringFindings1 citations
- Model-Based Simulation for Optimising Smart ReplyLong1 citations
- Morphological Inflection with Phonological FeaturesShort1 citations
- Multi-Agent Language Learning: Symbolic MappingFindings1 citations
- Multi-armed bandits for resource efficient, online optimization of language model pre-training: the use case of dynamic maskingFindings1 citations
- My side, your side and the evidence: Discovering aligned actor groups and the narratives they weaveLong1 citations
- Neural Networks Against (and For) Self-Training: Classification with Small Labeled and Large Unlabeled SetsFindings1 citations
- On the Evaluation of Neural Selective Prediction Methods for Natural Language ProcessingLong1 citations
- PEER: Pre-training ELECTRA Extended by RankingFindings1 citations
- PairSpanBERT: An Enhanced Language Model for Bridging ResolutionLong1 citations
- Pre-training Language Model as a Multi-perspective Course LearnerFindings1 citations
- Predicting Human Translation Difficulty Using Automatic Word AlignmentFindings1 citations
- Predicting Numerals in Text Using Nearest Neighbor Language ModelsFindings1 citations
- PruMUX: Augmenting Data Multiplexing with Model CompressionFindings1 citations
- Quantifying Train-Evaluation Overlap with Nearest NeighborsFindings1 citations
- READIN: A Chinese Multi-Task Benchmark with Realistic and Diverse Input NoisesLong1 citations
- Re-appraising the Schema Linking for Text-to-SQLFindings1 citations
- Revisiting Pathologies of Neural Models under Input ReductionFindings1 citations
- Robust Learning for Multi-party Addressee Recognition with Discrete Addressee CodebookShort1 citations
- Robustness of Multi-Source MT to Transcription ErrorsFindings1 citations
- SORTIE: Dependency-Aware Symbolic Reasoning for Logical Data-to-text GenerationFindings1 citations
- Stochastic Bridges as Effective Regularizers for Parameter-Efficient TuningFindings1 citations
- Syntax and Geometry of InformationLong1 citations
- TeCS: A Dataset and Benchmark for Tense Consistency of Machine TranslationShort1 citations
- The Mechanical Bard: An Interpretable Machine Learning Approach to Shakespearean Sonnet GenerationShort1 citations
- Trading Syntax Trees for Wordpieces: Target-oriented Opinion Words Extraction with Wordpieces and Aspect EnhancementShort1 citations
- Two Examples are Better than One: Context Regularization for Gradient-based Prompt TuningFindings1 citations
- Typology Guided Multilingual Position Representations: Case on Dependency ParsingFindings1 citations
- UniFine: A Unified and Fine-grained Approach for Zero-shot Vision-Language UnderstandingFindings1 citations
- Unsupervised Open-domain Keyphrase GenerationLong1 citations
- Unsupervised Paraphrasing of Multiword ExpressionsFindings1 citations
- VoteTRANS: Detecting Adversarial Text without Training by Voting on Hard Labels of TransformationsFindings1 citations
- Weakly supervised hierarchical multi-task classification of customer questionsIndustry1 citations
- When to Use Efficient Self Attention? Profiling Text, Speech and Image Transformer VariantsShort1 citations
- mOKB6: A Multilingual Open Knowledge Base Completion BenchmarkShort1 citations
- A Robust Information-Masking Approach for Domain Counterfactual GenerationFindings
- A Semi-Autoregressive Graph Generative Model for Dependency Graph ParsingFindings
- A Unified Evaluation Framework for Novelty Detection and Accommodation in NLP with an Instantiation in Authorship AttributionFindings
- AMR-based Network for Aspect-based Sentiment AnalysisLong
- Adversarial Knowledge Stimulated Contrastive Prompting for Few-shot Language LearnersFindings
- Adversarial Textual Robustness on Visual DialogFindings
- An Empirical Analysis of Leveraging Knowledge for Low-Resource Task-Oriented Semantic ParsingFindings
- An Inclusive Notion of TextLong
- An Investigation of Noise in Morphological InflectionFindings
- An efficient method for Natural Language Querying on Structured DataIndustry
ACL accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.