COLING 2024 Accepted Papers
The full list of 1,554 papers accepted at COLING 2024 (International Conference on Computational Linguistics). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Main: 1,554
- ChatGPT Is a Knowledgeable but Inexperienced Solver: An Investigation of Commonsense Problem in Large Language ModelsMain137 citations
- GPTEval: A Survey on Assessments of ChatGPT and GPT-4Main125 citations
- Large Language Models for Generative Recommendation: A Survey and Visionary DiscussionsMain105 citations
- CulturaX: A Cleaned, Enormous, and Multilingual Dataset for Large Language Models in 167 LanguagesMain99 citations
- Tricking LLMs into Disobedience: Formalizing, Analyzing, and Detecting JailbreaksMain85 citations
- CoCoMIC: Code Completion by Jointly Modeling In-file and Cross-file ContextMain76 citations
- Calibrating LLM-Based EvaluatorMain73 citations
- BAMBOO: A Comprehensive Benchmark for Evaluating Long Text Modeling Capacities of Large Language ModelsMain69 citations
- A Family of Pretrained Transformer Language Models for RussianMain59 citations
- Federated Foundation Models: Privacy-Preserving and Collaborative Learning for Large ModelsMain59 citations
- Jump to Conclusions: Short-Cutting Transformers with Linear TransformationsMain52 citations
- Enhancing Zero-Shot Chain-of-Thought Reasoning in Large Language Models through LogicMain44 citations
- MedMT5: An Open-Source Multilingual Text-to-Text LLM for the Medical DomainMain44 citations
- Multi-perspective Improvement of Knowledge Graph Completion with Large Language ModelsMain43 citations
- A Zero-shot and Few-shot Study of Instruction-Finetuned Large Language Models Applied to Clinical and Biomedical TasksMain42 citations
- Tug-of-War between Knowledge: Exploring and Resolving Knowledge Conflicts in Retrieval-Augmented Language ModelsMain42 citations
- Is LLM a Reliable Reviewer? A Comprehensive Evaluation of LLM on Automatic Paper Reviewing TasksMain40 citations
- The Touché23-ValueEval Dataset for Identifying Human Values behind ArgumentsMain39 citations
- Can Multiple-choice Questions Really Be Useful in Detecting the Abilities of LLMs?Main36 citations
- Language Models for Text Classification: Is In-Context Learning Enough?Main35 citations
- HumanEval-XL: A Multilingual Code Generation Benchmark for Cross-lingual Natural Language GeneralizationMain34 citations
- CBBQ: A Chinese Bias Benchmark Dataset Curated with Human-AI Collaboration for Large Language ModelsMain33 citations
- Do Emergent Abilities Exist in Quantized Large Language Models: An Empirical StudyMain33 citations
- Large Language Models Offer an Alternative to the Traditional Approach of Topic ModellingMain32 citations
- AlphaFin: Benchmarking Financial Analysis with Retrieval-Augmented Stock-Chain FrameworkMain30 citations
- Can Large Language Models Automatically Score Proficiency of Written Essays?Main29 citations
- Navigating Prompt Complexity for Zero-Shot Classification: A Study of Large Language Models in Computational Social ScienceMain29 citations
- CLIcK: A Benchmark Dataset of Cultural and Linguistic Intelligence in KoreanMain27 citations
- Can GPT-4 Identify Propaganda? Annotation and Detection of Propaganda Spans in News ArticlesMain27 citations
- Take Care of Your Prompt Bias! Investigating and Mitigating Prompt Bias in Factual Knowledge ExtractionMain27 citations
- Uncovering the Potential of ChatGPT for Discourse Analysis in Dialogue: An Empirical StudyMain27 citations
- Generative Multimodal Entity LinkingMain26 citations
- LatEval: An Interactive LLMs Evaluation Benchmark with Incomplete Information from Lateral Thinking PuzzlesMain26 citations
- Emotion Analysis in NLP: Trends, Gaps and Roadmap for Future DirectionsMain25 citations
- Analyzing the Performance of Large Language Models on Code SummarizationMain24 citations
- How Large Language Models Encode Context Knowledge? A Layer-Wise Probing StudyMain24 citations
- WorldValuesBench: A Large-Scale Benchmark Dataset for Multi-Cultural Value Awareness of Language ModelsMain24 citations
- Analyzing the Dynamics of Climate Change Discourse on Twitter: A New Annotated Corpus and Multi-Aspect ClassificationMain23 citations
- CBT-LLM: A Chinese Large Language Model for Cognitive Behavioral Therapy-based Mental Health Question AnsweringMain23 citations
- Prompting Large Language Models for Counterfactual Generation: An Empirical StudyMain23 citations
- A New Massive Multilingual Dataset for High-Performance Language TechnologiesMain21 citations
- Analyzing Large Language Models’ Capability in Location PredictionMain21 citations
- Effective Distillation of Table-based Reasoning Ability from LLMsMain21 citations
- Improving the Robustness of Large Language Models via Consistency AlignmentMain21 citations
- Language Variety Identification with True LabelsMain21 citations
- BenLLM-Eval: A Comprehensive Evaluation into the Potentials and Pitfalls of Large Language Models on Bengali NLPMain20 citations
- Ethical Reasoning and Moral Value Alignment of LLMs Depend on the Language We Prompt Them inMain20 citations
- Large Language Models as Financial Data Annotators: A Study on Effectiveness and EfficiencyMain20 citations
- MinT: Boosting Generalization in Mathematical Reasoning via Multi-view Fine-tuningMain20 citations
- FaiMA: Feature-aware In-context Learning for Multi-domain Aspect-based Sentiment AnalysisMain19 citations
- Unleashing the Power of Imbalanced Modality Information for Multi-modal Knowledge Graph CompletionMain19 citations
- Controlled Generation with Prompt Insertion for Natural Language Explanations in Grammatical Error CorrectionMain18 citations
- Release of Pre-Trained Models for the Japanese LanguageMain18 citations
- ChartThinker: A Contextual Chain-of-Thought Approach to Optimized Chart SummarizationMain17 citations
- Evaluating Gender Bias of Pre-trained Language Models in Natural Language Inference by Considering All LabelsMain17 citations
- From Laughter to Inequality: Annotated Dataset for Misogyny Detection in Tamil and Malayalam MemesMain17 citations
- HAE-RAE Bench: Evaluation of Korean Knowledge in Language ModelsMain17 citations
- IT5: Text-to-text Pretraining for Italian Language Understanding and GenerationMain17 citations
- LlamaCare: An Instruction Fine-Tuned Large Language Model for Clinical NLPMain17 citations
- Mixture-of-LoRAs: An Efficient Multitask Tuning Method for Large Language ModelsMain17 citations
- Teaching Large Language Models to Translate on Low-resource Languages with Textbook PromptingMain17 citations
- Towards Robust In-Context Learning for Machine Translation with Large Language ModelsMain17 citations
- A Paradigm Shift: The Future of Machine Translation Lies with Large Language ModelsMain16 citations
- Evolving Knowledge Distillation with Large Language Models and Active LearningMain16 citations
- How Good Are LLMs at Out-of-Distribution Detection?Main16 citations
- Optimizing Language Augmentation for Multilingual Large Language Models: A Case Study on KoreanMain16 citations
- Recent Trends in Personalized Dialogue Generation: A Review of Datasets, Methodologies, and EvaluationsMain16 citations
- Retentive or Forgetful? Diving into the Knowledge Memorizing Mechanism of Language ModelsMain16 citations
- Zero- and Few-Shot Prompting with LLMs: A Comparative Study with Fine-tuned Models for Bangla Sentiment AnalysisMain16 citations
- ChatGPT Rates Natural Language Explanation Quality like Humans: But on Which Scales?Main15 citations
- GPT-3.5 for Grammatical Error CorrectionMain15 citations
- HealthFC: Verifying Health Claims with Evidence-Based Medical Fact-CheckingMain15 citations
- How Susceptible Are LLMs to Logical Fallacies?Main15 citations
- LayoutLLM: Large Language Model Instruction Tuning for Visually Rich Document UnderstandingMain15 citations
- Enhancing Code Generation Performance of Smaller Models by Distilling the Reasoning Ability of LLMsMain14 citations
- Factorized Learning Assisted with Large Language Model for Gloss-free Sign Language TranslationMain14 citations
- Zero-Shot Spoken Language Understanding via Large Language Models: A Preliminary StudyMain14 citations
- Common Ground Tracking in Multimodal DialogueMain13 citations
- Evaluating Prompting Strategies for Grammatical Error Correction Based on Language ProficiencyMain13 citations
- GreekBART: The First Pretrained Greek Sequence-to-Sequence ModelMain13 citations
- LoNAS: Elastic Low-Rank Adapters for Efficient Large Language ModelsMain13 citations
- MentalRiskES: A New Corpus for Early Detection of Mental Disorders in SpanishMain13 citations
- My Science Tutor (MyST)–a Large Corpus of Children’s Conversational SpeechMain13 citations
- Unlocking Instructive In-Context Learning with Tabular Prompting for Relational Triple ExtractionMain13 citations
- A Corpus for Sentence-Level Subjectivity Detection on English News ArticlesMain12 citations
- Argument Quality Assessment in the Age of Instruction-Following Large Language ModelsMain12 citations
- Assessing the Capabilities of Large Language Models in Coreference: An EvaluationMain12 citations
- Benchmarking Hallucination in Large Language Models Based on Unanswerable Math Word ProblemMain12 citations
- CLASSLA-web: Comparable Web Corpora of South Slavic Languages Enriched with Linguistic and Genre AnnotationMain12 citations
- ChatGPT Role-play Dataset: Analysis of User Motives and Model NaturalnessMain12 citations
- Detecting Hallucination and Coverage Errors in Retrieval Augmented Generation for Controversial TopicsMain12 citations
- Prefix-diffusion: A Lightweight Diffusion Model for Diverse Image CaptioningMain12 citations
- Qabas: An Open-Source Arabic Lexicographic DatabaseMain12 citations
- Self-Explanation Prompting Improves Dialogue Understanding in Large Language ModelsMain12 citations
- ToNER: Type-oriented Named Entity Recognition with Generative Language ModelMain12 citations
- m3P: Towards Multimodal Multilingual Translation with Multimodal PromptMain12 citations
- Beyond Full Fine-tuning: Harnessing the Power of LoRA for Multi-Task Instruction TuningMain11 citations
- Beyond the Known: Investigating LLMs Performance on Out-of-Domain Intent DetectionMain11 citations
- Clue-Instruct: Text-Based Clue Generation for Educational Crossword PuzzlesMain11 citations
- DEEM: Dynamic Experienced Expert Modeling for Stance DetectionMain11 citations
- DanteLLM: Let’s Push Italian LLM Research Forward!Main11 citations
- Deep Learning Based Named Entity Recognition Models for RecipesMain11 citations
- From Text to Source: Results in Detecting Large Language Model-Generated ContentMain11 citations
- ILLUMINER: Instruction-tuned Large Language Models as Few-shot Intent Classifier and Slot FillerMain11 citations
- Is It Possible to Modify Text to a Target Readability Level? An Initial Investigation Using Zero-Shot Large Language ModelsMain11 citations
- KC-GenRe: A Knowledge-constrained Generative Re-ranking Method Based on Large Language Models for Knowledge Graph CompletionMain11 citations
- LA-UCL: LLM-Augmented Unsupervised Contrastive Learning Framework for Few-Shot Text ClassificationMain11 citations
- LexDrafter: Terminology Drafting for Legislative Documents Using Retrieval Augmented GenerationMain11 citations
- Quite Good, but Not Enough: Nationality Bias in Large Language Models - a Case Study of ChatGPTMain11 citations
- Text Style Transfer Evaluation Using Large Language ModelsMain11 citations
- tasksource: A Large Collection of NLP tasks with a Structured Dataset Preprocessing FrameworkMain11 citations
- ASEM: Enhancing Empathy in Chatbot through Attention-based Sentiment and Emotion ModelingMain10 citations
- CoRelation: Boosting Automatic ICD Coding through Contextualized Code Relation LearningMain10 citations
- Creation and Analysis of an International Corpus of Privacy LawsMain10 citations
- DOSA: A Dataset of Social Artifacts from Different Indian Geographical SubculturesMain10 citations
- Difficulty-Focused Contrastive Learning for Knowledge Tracing with a Large Language Model-Based Difficulty PredictionMain10 citations
- Eliciting Motivational Interviewing Skill Codes in Psychotherapy with LLMs: A Bilingual Dataset and Analytical StudyMain10 citations
- Enhancing Text-to-SQL Capabilities of Large Language Models through Tailored PromptingsMain10 citations
- Extracting Social Determinants of Health from Pediatric Patient Notes Using Large Language Models: Novel Corpus and MethodsMain10 citations
- Humanizing Machine-Generated Content: Evading AI-Text Detection through Adversarial AttackMain10 citations
- LongDocFACTScore: Evaluating the Factuality of Long Document Abstractive SummarisationMain10 citations
- Lˆ2GC:Lorentzian Linear Graph Convolutional Networks for Node ClassificationMain10 citations
- NumHG: A Dataset for Number-Focused Headline GenerationMain10 citations
- On Zero-Shot Counterspeech Generation by LLMsMain10 citations
- PACAR: Automated Fact-Checking with Planning and Customized Action Reasoning Using Large Language ModelsMain10 citations
- PSYDIAL: Personality-based Synthetic Dialogue Generation Using Large Language ModelsMain10 citations
- Prompt-based Zero-shot Relation Extraction with Semantic Knowledge AugmentationMain10 citations
- Rapidly Developing High-quality Instruction Data and Evaluation Benchmark for Large Language Models with Minimal Human Effort: A Case Study on JapaneseMain10 citations
- ToolRerank: Adaptive and Hierarchy-Aware Reranking for Tool RetrievalMain10 citations
- Untangle the KNOT: Interweaving Conflicting Knowledge and Reasoning Skills in Large Language ModelsMain10 citations
- A Comparative Analysis of Word-Level Metric Differential Privacy: Benchmarking the Privacy-Utility Trade-offMain9 citations
- A Comparative Study of Explicit and Implicit Gender Biases in Large Language Models via Self-evaluationMain9 citations
- A Frustratingly Simple Decoding Method for Neural Text GenerationMain9 citations
- A Hybrid Approach to Aspect Based Sentiment Analysis Using Transfer LearningMain9 citations
- BEIR-PL: Zero Shot Information Retrieval Benchmark for the Polish LanguageMain9 citations
- BanglaAutoKG: Automatic Bangla Knowledge Graph Construction with Semantic Neural Graph FilteringMain9 citations
- Building a Broad Infrastructure for Uniform Meaning RepresentationsMain9 citations
- CHisIEC: An Information Extraction Corpus for Ancient Chinese HistoryMain9 citations
- CTSM: Combining Trait and State Emotions for Empathetic Response ModelMain9 citations
- Can Large Language Models Discern Evidence for Scientific Hypotheses? Case Studies in the Social SciencesMain9 citations
- Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-ThoughtMain9 citations
- Characteristic AI Agents via Large Language ModelsMain9 citations
- Constructions Are So Difficult That Even Large Language Models Get Them Right for the Wrong ReasonsMain9 citations
- EthioLLM: Multilingual Large Language Models for Ethiopian Languages with Task EvaluationMain9 citations
- Evaluating Code-Switching Translation with Large Language ModelsMain9 citations
- EventGround: Narrative Reasoning by Grounding to Eventuality-centric Knowledge GraphsMain9 citations
- FCDS: Fusing Constituency and Dependency Syntax into Document-Level Relation ExtractionMain9 citations
- FLOR: On the Effectiveness of Language AdaptationMain9 citations
- GERMS-AT: A Sexism/Misogyny Dataset of Forum Comments from an Austrian Online NewspaperMain9 citations
- Has It All Been Solved? Open NLP Research Questions Not Solved by Large Language ModelsMain9 citations
- Improving Faithfulness of Large Language Models in Summarization via Sliding Generation and Self-ConsistencyMain9 citations
- Logic Rules as Explanations for Legal Case RetrievalMain9 citations
- MMAD:Multi-modal Movie Audio DescriptionMain9 citations
- Make Prompt-based Black-Box Tuning Colorful: Boosting Model Generalization from Three Orthogonal PerspectivesMain9 citations
- Making Pre-trained Language Models Better Continual Few-Shot Relation ExtractorsMain9 citations
- Multilingual Turn-taking Prediction Using Voice Activity ProjectionMain9 citations
- SaGE: Evaluating Moral Consistency in Large Language ModelsMain9 citations
- Self-Improvement Programming for Temporal Knowledge Graph Question AnsweringMain9 citations
- Small Language Models Are Good Too: An Empirical Study of Zero-Shot ClassificationMain9 citations
- SoftMCL: Soft Momentum Contrastive Learning for Fine-grained Sentiment-aware Pre-trainingMain9 citations
- Submodular-based In-context Example Selection for LLMs-based Machine TranslationMain9 citations
- Tree-Instruct: A Preliminary Study of the Intrinsic Relationship between Complexity and AlignmentMain9 citations
- VietMed: A Dataset and Benchmark for Automatic Speech Recognition of Vietnamese in the Medical DomainMain9 citations
- Are Large Language Models Good at Lexical Semantics? A Case of Taxonomy LearningMain8 citations
- Autonomous Aspect-Image Instruction a2II: Q-Former Guided Multimodal Sentiment ClassificationMain8 citations
- Basque and Spanish Counter Narrative Generation: Data Creation and EvaluationMain8 citations
- Benchmarking GPT-4 on Algorithmic Problems: A Systematic Evaluation of Prompting StrategiesMain8 citations
- Benchmarking Large Language Models for Persian: A Preliminary Study Focusing on ChatGPTMain8 citations
- Building a Data Infrastructure for a Mid-Resource Language: The Case of CatalanMain8 citations
- CONAN-MT-SP: A Spanish Corpus for Counternarrative Using GPT ModelsMain8 citations
- ChatEL: Entity Linking with ChatbotsMain8 citations
- CollabKG: A Learnable Human-Machine-Cooperative Information Extraction Toolkit for (Event) Knowledge Graph ConstructionMain8 citations
- Dual Encoder: Exploiting the Potential of Syntactic and Semantic for Aspect Sentiment Triplet ExtractionMain8 citations
- ECtHR-PCR: A Dataset for Precedent Understanding and Prior Case Retrieval in the European Court of Human RightsMain8 citations
- EDDA: An Encoder-Decoder Data Augmentation Framework for Zero-Shot Stance DetectionMain8 citations
- Evaluating Text-to-Speech Synthesis from a Large Discrete Token-based Speech Language ModelMain8 citations
- HYRR: Hybrid Infused Reranking for Passage RetrievalMain8 citations
- JCoLA: Japanese Corpus of Linguistic AcceptabilityMain8 citations
- KazSAnDRA: Kazakh Sentiment Analysis Dataset of Reviews and AttitudesMain8 citations
- MARASTA: A Multi-dialectal Arabic Cross-domain Stance CorpusMain8 citations
- MCTS: A Multi-Reference Chinese Text Simplification DatasetMain8 citations
- MoZIP: A Multilingual Benchmark to Evaluate Large Language Models in Intellectual PropertyMain8 citations
- PLAES: Prompt-generalized and Level-aware Learning Framework for Cross-prompt Automated Essay ScoringMain8 citations
- Prompting-based Synthetic Data Generation for Few-Shot Question AnsweringMain8 citations
- RECIPE4U: Student-ChatGPT Interaction Dataset in EFL Writing EducationMain8 citations
- Revisiting the Self-Consistency Challenges in Multi-Choice Question Formats for Large Language Model EvaluationMain8 citations
- Robust and Scalable Model Editing for Large Language ModelsMain8 citations
- SOBR: A Corpus for Stylometry, Obfuscation, and Bias on RedditMain8 citations
- SciNews: From Scholarly Complexities to Public Narratives – a Dataset for Scientific News Report GenerationMain8 citations
- Stance Reasoner: Zero-Shot Stance Detection on Social Media with Explicit ReasoningMain8 citations
- Tackling Long Code Search with Splitting, Encoding, and AggregatingMain8 citations
- The Ethical Question – Use of Indigenous Corpora for Large Language ModelsMain8 citations
- The ParlaSent Multilingual Training Dataset for Sentiment Identification in Parliamentary ProceedingsMain8 citations
- Your Stereotypical Mileage May Vary: Practical Challenges of Evaluating Biases in Multiple Languages and Cultural ContextsMain8 citations
- Zero-Shot Cross-Lingual Document-Level Event Causality Identification with Heterogeneous Graph Contrastive Transfer LearningMain8 citations
- A Challenge Dataset and Effective Models for Conversational Stance DetectionMain7 citations
- CMDAG: A Chinese Metaphor Dataset with Annotated Grounds as CoT for Boosting Metaphor GenerationMain7 citations
- ChainLM: Empowering Large Language Models with Improved Chain-of-Thought PromptingMain7 citations
- Comprehensive Study on German Language Models for Clinical and Biomedical Text UnderstandingMain7 citations
- Decoding Probing: Revealing Internal Linguistic Structures in Neural Language Models Using Minimal PairsMain7 citations
- Development and Evaluation of Pre-trained Language Models for Historical Danish and Norwegian Literary TextsMain7 citations
- Distillation with Explanations from Large Language ModelsMain7 citations
- Distribution Aware Metrics for Conditional Natural Language GenerationMain7 citations
- EmoTrans: Emotional Transition-based Model for Emotion Recognition in ConversationMain7 citations
- Evaluation of Really Good Grammatical Error CorrectionMain7 citations
- Examining Temporalities on Stance Detection towards COVID-19 VaccinationMain7 citations
- Exploring and Mitigating Shortcut Learning for Generative Large Language ModelsMain7 citations
- Framed Multi30K: A Frame-Based Multimodal-Multilingual DatasetMain7 citations
- GlotScript: A Resource and Tool for Low Resource Writing System IdentificationMain7 citations
- Gos 2: A New Reference Corpus of Spoken SlovenianMain7 citations
- IDEATE: Detecting AI-Generated Text Using Internal and External Factual StructuresMain7 citations
- Improving Robustness of GNN-based Anomaly Detection by Graph Adversarial TrainingMain7 citations
- Little Red Riding Hood Goes around the Globe: Crosslingual Story Planning and Generation with Large Language ModelsMain7 citations
- OATS: A Challenge Dataset for Opinion Aspect Target Sentiment Joint Detection for Aspect-Based Sentiment AnalysisMain7 citations
- On the Scaling Laws of Geographical Representation in Language ModelsMain7 citations
- PolQA: Polish Question Answering DatasetMain7 citations
- Pre-Trained Language Models Represent Some Geographic Populations Better than OthersMain7 citations
- Reinforcement Retrieval Leveraging Fine-grained Feedback for Fact Checking News Claims with Black-Box LLMMain7 citations
- Scaling Data Diversity for Fine-Tuning Language Models in Human AlignmentMain7 citations
- Sinkhorn Distance Minimization for Knowledge DistillationMain7 citations
- Slot and Intent Detection Resources for Bavarian and Lithuanian: Assessing Translations vs Natural Queries to Digital AssistantsMain7 citations
- The SAMER Arabic Text Simplification CorpusMain7 citations
- Towards Explainability and Fairness in Swiss Judgement Prediction: Benchmarking on a Multilingual DatasetMain7 citations
- A CURATEd CATalog: Rethinking the Extraction of Pretraining Corpora for Mid-Resourced LanguagesMain6 citations
- A Dataset for Pharmacovigilance in German, French, and Japanese: Annotating Adverse Drug Reactions across LanguagesMain6 citations
- A Matter of Perspective: Building a Multi-Perspective Annotated Dataset for the Study of Literary QualityMain6 citations
- A Survey on Natural Language Processing for ProgrammingMain6 citations
- AdaKron: An Adapter-based Parameter Efficient Model Tuning with Kronecker ProductMain6 citations
- Analyzing the Understanding of Morphologically Complex Words in Large Language ModelsMain6 citations
- Asking and Answering Questions to Extract Event-Argument StructuresMain6 citations
- Automatic Annotation of Grammaticality in Child-Caregiver ConversationsMain6 citations
- Automatic Coding of Contingency in Child-Caregiver ConversationsMain6 citations
- BLN600: A Parallel Corpus of Machine/Human Transcribed Nineteenth Century Newspaper TextsMain6 citations
- CARE: Co-Attention Network for Joint Entity and Relation ExtractionMain6 citations
- CWTM: Leveraging Contextualized Word Embeddings from BERT for Neural Topic ModelingMain6 citations
- ChatUIE: Exploring Chat-based Unified Information Extraction Using Large Language ModelsMain6 citations
- Choice-75: A Dataset on Decision Branching in Script LearningMain6 citations
- DARIUS: A Comprehensive Learner Corpus for Argument Mining in German-Language EssaysMain6 citations
- Do Language Models Care about Text Quality? Evaluating Web-Crawled Corpora across 11 LanguagesMain6 citations
- Does ChatGPT Know That It Does Not Know? Evaluating the Black-Box Calibration of ChatGPTMain6 citations
- Domain-Agnostic Adapter Architecture for Deception Detection: Extensive Evaluations with the DIFrauD BenchmarkMain6 citations
- Dynamic Knowledge Prompt for Chest X-ray Report GenerationMain6 citations
- EsCoLA: Spanish Corpus of Linguistic AcceptabilityMain6 citations
- Examining the Limitations of Computational Rumor Detection Models Trained on Static DatasetsMain6 citations
- GPT-HateCheck: Can LLMs Write Better Functional Tests for Hate Speech Detection?Main6 citations
- HuLU: Hungarian Language Understanding Benchmark KitMain6 citations
- Improving Recall of Large Language Models: A Model Collaboration Approach for Relational Triple ExtractionMain6 citations
- In-Context Example Retrieval from Multi-Perspectives for Few-Shot Aspect-Based Sentiment AnalysisMain6 citations
- Inductive Knowledge Graph Completion with GNNs and Rules: An AnalysisMain6 citations
- Knowledge GeoGebra: Leveraging Geometry of Relation Embeddings in Knowledge Graph CompletionMain6 citations
- Knowledge-augmented Graph Neural Networks with Concept-aware Attention for Adverse Drug Event DetectionMain6 citations
- LFED: A Literary Fiction Evaluation Dataset for Large Language ModelsMain6 citations
- Large Language Models Are Echo ChambersMain6 citations
- Linear Cross-document Event Coreference Resolution with X-AMRMain6 citations
- Low-Rank Prune-And-Factorize for Language Model CompressionMain6 citations
- MaiBaam: A Multi-Dialectal Bavarian Universal Dependency TreebankMain6 citations
- MaintIE: A Fine-Grained Annotation Schema and Benchmark for Information Extraction from Maintenance Short TextsMain6 citations
- MentalHelp: A Multi-Task Dataset for Mental Health in Social MediaMain6 citations
- PECC: Problem Extraction and Coding ChallengesMain6 citations
- PWESuite: Phonetic Word Embeddings and Tasks They FacilitateMain6 citations
- PejorativITy: Disambiguating Pejorative Epithets to Improve Misogyny Detection in Italian TweetsMain6 citations
- Probing Multimodal Large Language Models for Global and Local Semantic RepresentationsMain6 citations
- SarcNet: A Multilingual Multimodal Sarcasm Detection DatasetMain6 citations
- Scansion-based Lyrics GenerationMain6 citations
- Step-by-Step: Controlling Arbitrary Style in Text with Large Language ModelsMain6 citations
- Towards Building the LEMI Readability Platform for Children’s Literature in the Romanian LanguageMain6 citations
- Towards Robust Temporal Activity Localization Learning with Noisy LabelsMain6 citations
- TransCoder: Towards Unified Transferable Code Representation Learning Inspired by Human SkillsMain6 citations
- ZAEBUC-Spoken: A Multilingual Multidialectal Arabic-English Speech CorpusMain6 citations
- A Collection of Pragmatic-Similarity Judgments over Spoken Dialog UtterancesMain5 citations
- A Computational Model of Latvian MorphologyMain5 citations
- A Construction Grammar Corpus of Varying Schematicity: A Dataset for the Evaluation of Abstractions in Language ModelsMain5 citations
- A Logical Pattern Memory Pre-trained Model for Entailment Tree GenerationMain5 citations
- APOLLO: An Optimized Training Approach for Long-form Numerical ReasoningMain5 citations
- Adaptive Simultaneous Sign Language Translation with Confident Translation Length EstimationMain5 citations
- Aggregation of Reasoning: A Hierarchical Framework for Enhancing Answer Selection in Large Language ModelsMain5 citations
- An LLM-Enhanced Adversarial Editing System for Lexical SimplificationMain5 citations
- Analyzing Effects of Learning Downstream Tasks on Moral Bias in Large Language ModelsMain5 citations
- Automatic Authorship Analysis in Human-AI Collaborative WritingMain5 citations
- BalsuTalka.lv - Boosting the Common Voice Corpus for Low-Resource LanguagesMain5 citations
- Building a Database of Conversational RoutinesMain5 citations
- CASIMIR: A Corpus of Scientific Articles Enhanced with Multiple Author-Integrated RevisionsMain5 citations
- CHICA: A Developmental Corpus of Child-Caregiver’s Face-to-face vs. Video Call Conversations in Middle ChildhoodMain5 citations
- CMNEE:A Large-Scale Document-Level Event Extraction Dataset Based on Open-Source Chinese Military NewsMain5 citations
- CamemBERT-bio: Leveraging Continual Pre-training for Cost-Effective Models on French Biomedical DataMain5 citations
- CoANZSE Audio: Creation of an Online Corpus for Linguistic and Phonetic Analysis of Australian and New Zealand EnglishesMain5 citations
- CroCoSum: A Benchmark Dataset for Cross-Lingual Code-Switched SummarizationMain5 citations
- Cross-Lingual Learning vs. Low-Resource Fine-Tuning: A Case Study with Fact-Checking in TurkishMain5 citations
- Curriculum Learning Meets Directed Acyclic Graph for Multimodal Emotion RecognitionMain5 citations
- DECM: Evaluating Bilingual ASR Performance on a Code-switching/mixing BenchmarkMain5 citations
- Data Collection Pipeline for Low-Resource Languages: A Case Study on Constructing a Tetun Text CorpusMain5 citations
- Deconstructing In-Context Learning: Understanding Prompts via CorruptionMain5 citations
- Depth-Wise Attention (DWAtt): A Layer Fusion Method for Data-Efficient ClassificationMain5 citations
- Discourse Structure for the Minecraft CorpusMain5 citations
- Diversifying Question Generation over Knowledge Base via External Natural QuestionsMain5 citations
- DuetSim: Building User Simulator with Dual Large Language Models for Task-Oriented DialoguesMain5 citations
- Evaluating the Quality of a Corpus Annotation Scheme Using Pretrained Language ModelsMain5 citations
- Frame2: A FrameNet-based Multimodal Dataset for Tackling Text-image Interactions in VideoMain5 citations
- From News to Summaries: Building a Hungarian Corpus for Extractive and Abstractive SummarizationMain5 citations
- GCNet: Global-and-Context Collaborative Learning for Aspect-Based Sentiment AnalysisMain5 citations
- Generating Multiple-choice Questions for Medical Question Answering with Distractors and Cue-maskingMain5 citations
- Human vs. Machine Perceptions on Immigration StereotypesMain5 citations
- Hyperbolic Graph Neural Network for Temporal Knowledge Graph CompletionMain5 citations
- Identifying Fine-grained Depression Signs in Social Media PostsMain5 citations
- Improving Language Model Reasoning with Self-motivated LearningMain5 citations
- InfoEnh: Towards Multimodal Sentiment Analysis via Information Bottleneck Filter and Optimal Transport AlignmentMain5 citations
- Intent-Aware and Hate-Mitigating Counterspeech Generation via Dual-Discriminator Guided LLMsMain5 citations
- KazParC: Kazakh Parallel Corpus for Machine TranslationMain5 citations
- Language Technologies as If People Mattered: Centering Communities in Language Technology DevelopmentMain5 citations
- Logging Keystrokes in Writing by English LearnersMain5 citations
- M2SA: Multimodal and Multilingual Model for Sentiment Analysis of TweetsMain5 citations
- MNER-MI: A Multi-image Dataset for Multimodal Named Entity Recognition in Social MediaMain5 citations
- MRC-based Nested Medical NER with Co-prediction and Adaptive Pre-trainingMain5 citations
- Mixture-of-Prompt-Experts for Multi-modal Semantic UnderstandingMain5 citations
- Multilingual Generation in Abstractive Summarization: A Comparative StudyMain5 citations
- NSina: A News Corpus for SinhalaMain5 citations
- NarrativeTime: Dense Temporal Annotation on a TimelineMain5 citations
- New Intent Discovery with Attracting and Dispersing PrototypeMain5 citations
- No Need for Large-Scale Search: Exploring Large Language Models in Complex Knowledge Base Question AnsweringMain5 citations
- Plots Made Quickly: An Efficient Approach for Generating Visualizations from Natural Language QueriesMain5 citations
- Question Answering over Tabular Data with DataBench: A Large-Scale Empirical Evaluation of LLMsMain5 citations
- Restoring Ancient Ideograph: A Multimodal Multitask Neural Network ApproachMain5 citations
- Revisiting Context Choices for Context-aware Machine TranslationMain5 citations
- Revisiting Data Reconstruction Attacks on Real-world Dataset for Federated Natural Language UnderstandingMain5 citations
- SciMRC: Multi-perspective Scientific Machine Reading ComprehensionMain5 citations
- Sequence-to-Sequence Spanish Pre-trained Language ModelsMain5 citations
- SmartTrim: Adaptive Tokens and Attention Pruning for Efficient Vision-Language ModelsMain5 citations
- Still All Greeklish to Me: Greeklish to Greek TransliterationMain5 citations
- The Challenges of Creating a Parallel Multilingual Hate Speech Corpus: An ExplorationMain5 citations
- The Influence of Automatic Speech Recognition on Linguistic Features and Automatic Alzheimer’s Disease Detection from Spontaneous SpeechMain5 citations
- TransERR: Translation-based Knowledge Graph Embedding via Efficient Relation RotationMain5 citations
- Trustworthiness and Self-awareness in Large Language Models: An Exploration through the Think-Solve-Verify FrameworkMain5 citations
- Unveiling Project-Specific Bias in Neural Code ModelsMain5 citations
- Verbing Weirds Language (Models): Evaluation of English Zero-Derivation in Five LLMsMain5 citations
- WikiFactDiff: A Large, Realistic, and Temporally Adaptable Dataset for Atomic Factual Knowledge Update in Causal Language ModelsMain5 citations
- nEMO: Dataset of Emotional Speech in PolishMain5 citations
- ÌròyìnSpeech: A Multi-purpose Yorùbá Speech CorpusMain5 citations
- A Benchmark for Recipe Understanding in Artificial AgentsMain4 citations
- A Computational Analysis of the Dehumanisation of Migrants from Syria and Ukraine in Slovene News MediaMain4 citations
- A Corpus of Spontaneous L2 English Speech for Real-situation Speaking AssessmentMain4 citations
- A Hong Kong Sign Language Corpus Collected from Sign-interpreted TV NewsMain4 citations
- A Multimodal French Corpus of Aligned Speech, Text, and Pictogram Sequences for Speech-to-Pictogram Machine TranslationMain4 citations
- A Semantic Mention Graph Augmented Model for Document-Level Event Argument ExtractionMain4 citations
- A Tulu Resource for Machine TranslationMain4 citations
- ALLIES: A Speech Corpus for Segmentation, Speaker Diarization, Speech Recognition and Speaker Change DetectionMain4 citations
- AcnEmpathize: A Dataset for Understanding Empathy in Dermatology ConversationsMain4 citations
- Align-to-Distill: Trainable Attention Alignment for Knowledge Distillation in Neural Machine TranslationMain4 citations
- Alignment before Awareness: Towards Visual Question Localized-Answering in Robotic Surgery via Optimal Transport and Answer SemanticsMain4 citations
- Assessing Online Writing Feedback Resources: Generative AI vs. Good SamaritansMain4 citations
- Attack Named Entity Recognition by Entity Boundary InterferenceMain4 citations
- Audiocite.net : A Large Spoken Read Dataset in FrenchMain4 citations
- Automatic Data Visualization Generation from Chinese Natural Language QuestionsMain4 citations
- Automatic Extraction of Language-Specific Biomarkers of Healthy Aging in IcelandicMain4 citations
- Backdoor NLP Models via AI-Generated TextMain4 citations
- Becoming a High-Resource Language in Speech: The Catalan Case in the Common Voice CorpusMain4 citations
- Beyond Binary: Towards Embracing Complexities in Cyberbullying Detection and Intervention - a Position PaperMain4 citations
- BlendX: Complex Multi-Intent Detection with Blended PatternsMain4 citations
- CM-Off-Meme: Code-Mixed Hindi-English Offensive Meme Detection with Multi-Task Learning by Leveraging Contextual KnowledgeMain4 citations
- COMET for Low-Resource Machine Translation Evaluation: A Case Study of English-Maltese and Spanish-BasqueMain4 citations
- Can We Learn Question, Answer, and Distractors All from an Image? A New Task for Multiple-choice Visual Question AnsweringMain4 citations
- Classifying Social Media Users before and after Depression Diagnosis via Their Language Usage: A Dataset and StudyMain4 citations
- Context Shapes Emergent Communication about Concepts at Different Levels of AbstractionMain4 citations
- Contextualizing Generated Citation TextsMain4 citations
- Conversational Grounding: Annotation and Analysis of Grounding Acts and Grounding UnitsMain4 citations
- CuRIAM: Corpus Re Interpretation and Metalanguage in U.S. Supreme Court OpinionsMain4 citations
- DC-MBR: Distributional Cooling for Minimum Bayesian Risk DecodingMain4 citations
- DISRPT: A Multilingual, Multi-domain, Cross-framework Benchmark for Discourse ProcessingMain4 citations
- Dataset of Quotation Attribution in German News ArticlesMain4 citations
- Detecting Cybercrimes in Accordance with Pakistani Law: Dataset and Evaluation Using PLMsMain4 citations
- Document-Level Event Extraction via Information Interaction Based on Event Relation and Argument CorrelationMain4 citations
- EcoVerse: An Annotated Twitter Dataset for Eco-Relevance Classification, Environmental Impact Analysis, and Stance DetectionMain4 citations
- Emotion Recognition in Conversation via Dynamic PersonalityMain4 citations
- Empowering Oneida Language Revitalization: Development of an Oneida Verb ConjugatorMain4 citations
- Enhanced Facet Generation with LLM EditingMain4 citations
- Evaluating ChatGPT against Functionality Tests for Hate Speech DetectionMain4 citations
- Evaluating Self-Supervised Speech Representations for Indigenous American LanguagesMain4 citations
- Evaluating Unsupervised Dimensionality Reduction Methods for Pretrained Sentence EmbeddingsMain4 citations
- Event Extraction in Basque: Typologically Motivated Cross-Lingual Transfer-Learning AnalysisMain4 citations
- Exploring the Potential of Large Language Models (LLMs) for Low-resource Languages: A Study on Named-Entity Recognition (NER) and Part-Of-Speech (POS) Tagging for Nepali LanguageMain4 citations
- Exploring the Usability of Persuasion Techniques for Downstream Misinformation-related Classification TasksMain4 citations
- Eye-Tracking Features Masking Transformer Attention in Question-Answering TasksMain4 citations
- FRASIMED: A Clinical French Annotated Resource Produced through Crosslingual BERT-Based Annotation ProjectionMain4 citations
- From Graph to Word Bag: Introducing Domain Knowledge to Confusing Charge PredictionMain4 citations
- GPT-SW3: An Autoregressive Language Model for the Scandinavian LanguagesMain4 citations
- GerDISDETECT: A German Multilabel Dataset for Disinformation DetectionMain4 citations
- German Parliamentary Corpus (GerParCor) ReloadedMain4 citations
- Hypergraph-Based Session Modeling: A Multi-Collaborative Self-Supervised Approach for Enhanced Recommender SystemsMain4 citations
- Incorporating Lexical and Syntactic Knowledge for Unsupervised Cross-Lingual TransferMain4 citations
- InteRead: An Eye Tracking Dataset of Interrupted ReadingMain4 citations
- Investigating the Robustness of Modelling Decisions for Few-Shot Cross-Topic Stance Detection: A Preregistered StudyMain4 citations
- Is Crowdsourcing Breaking Your Bank? Cost-Effective Fine-Tuning of Pre-trained Language Models with Proximal Policy OptimizationMain4 citations
- Is Summary Useful or Not? An Extrinsic Human Evaluation of Text Summaries on Downstream TasksMain4 citations
- JMultiWOZ: A Large-Scale Japanese Multi-Domain Task-Oriented Dialogue DatasetMain4 citations
- JoTR: A Joint Transformer and Reinforcement Learning Framework for Dialogue Policy LearningMain4 citations
- K-pop Lyric Translation: Dataset, Analysis, and Neural-ModellingMain4 citations
- Leveraging Syntactic Dependencies in Disambiguation: The Case of African American EnglishMain4 citations
- LexAbSumm: Aspect-based Summarization of Legal DecisionsMain4 citations
- MM-IGLU: Multi-Modal Interactive Grounded Language UnderstandingMain4 citations
- Malaysian English News Decoded: A Linguistic Resource for Named Entity and Relation ExtractionMain4 citations
- Modeling the Quality of Dialogical ExplanationsMain4 citations
- Motivational Interviewing Transcripts Annotated with Global ScoresMain4 citations
- Multilingual Coreference Resolution in Low-resource South Asian LanguagesMain4 citations
- Multimodal Language Models Show Evidence of Embodied SimulationMain4 citations
- Out-of-Domain Intent Detection Considering Multi-Turn Dialogue ContextsMain4 citations
- PIRB: A Comprehensive Benchmark of Polish Dense and Hybrid Text Retrieval MethodsMain4 citations
- Probe Then Retrieve and Reason: Distilling Probing and Reasoning Capabilities into Smaller Language ModelsMain4 citations
- QCAW 1.0: Building a Qatari Corpus of Student Argumentative WritingMain4 citations
- RankPrompt: Step-by-Step Comparisons Make Language Models Better ReasonersMain4 citations
- Reading Does Not Equal Reading: Comparing, Simulating and Exploiting Reading Behavior across PopulationsMain4 citations
- Reference-less Analysis of Context Specificity in Translation with Personalised Language ModelsMain4 citations
- Resolving Legalese: A Multilingual Exploration of Negation Scope Resolution in Legal DocumentsMain4 citations
- RuBia: A Russian Language Bias Detection DatasetMain4 citations
- SUK 1.0: A New Training Corpus for Linguistic Annotation of Modern Standard SloveneMain4 citations
- Segmentation of Complex Question Turns for Argument Mining: A Corpus-based Study in the Financial DomainMain4 citations
- SentiCSE: A Sentiment-aware Contrastive Sentence Embedding Framework with Sentiment-guided Textual SimilarityMain4 citations
- So Hateful! Building a Multi-Label Hate Speech Annotated Arabic DatasetMain4 citations
- Soft-Prompting with Graph-of-Thought for Multi-modal Representation LearningMain4 citations
- Step Feasibility-Aware and Error-Correctable Entailment Tree GenerationMain4 citations
- TacoERE: Cluster-aware Compression for Event Relation ExtractionMain4 citations
- Targeted Syntactic Evaluation on the Chomsky HierarchyMain4 citations
- Temporal Knowledge Graph Reasoning with Dynamic Hypergraph EmbeddingMain4 citations
- To Share or Not to Share: What Risks Would Laypeople Accept to Give Sensitive Data to Differentially-Private NLP Systems?Main4 citations
- Topic Detection and Tracking with Time-Aware Document EmbeddingsMain4 citations
- Towards Dog Bark Decoding: Leveraging Human Speech Processing for Automated Bark ClassificationMain4 citations
- Towards Multi-modal Sarcasm Detection via Disentangled Multi-grained Multi-modal DistillingMain4 citations
- Towards a Danish Semantic Reasoning Benchmark - Compiled from Lexical-Semantic Resources for Assessing Selected Language Understanding Capabilities of Large Language ModelsMain4 citations
- Towards a Framework for Evaluating Explanations in Automated Fact VerificationMain4 citations
- Towards a Zero-Data, Controllable, Adaptive Dialog SystemMain4 citations
- Towards an Ideal Tool for Learner Error AnnotationMain4 citations
- Triple-R: Automatic Reasoning for Fact Verification Using Language ModelsMain4 citations
- Two Counterexamples to Tokenization and the Noiseless ChannelMain4 citations
- UCxn: Typologically Informed Annotation of Constructions Atop Universal DependenciesMain4 citations
- Universal Anaphora: The First Three YearsMain4 citations
- Unmasking Biases: Exploring Gender Bias in English-Catalan Machine Translation through Tokenization Analysis and Novel DatasetMain4 citations
- UrduMASD: A Multimodal Abstractive Summarization Dataset for UrduMain4 citations
- Using Persuasive Writing Strategies to Explain and Detect Health MisinformationMain4 citations
- When Argumentation Meets Cohesion: Enhancing Automatic Feedback in Student WritingMain4 citations
- A Controlled Reevaluation of Coreference Resolution ModelsMain3 citations
- A Differentiable Integer Linear Programming Solver for Explanation-Based Natural Language InferenceMain3 citations
- A Multi-Label Dataset of French Fake News: Human and Machine InsightsMain3 citations
- A Novel Three-stage Framework for Few-shot Named Entity RecognitionMain3 citations
- A Preliminary Study of ChatGPT for Spanish E2R Text AdaptationMain3 citations
- A Single Linear Layer Yields Task-Adapted Low-Rank MatricesMain3 citations
- A Two-Stage Framework with Self-Supervised Distillation for Cross-Domain Text ClassificationMain3 citations
- A Two-Stage Prediction-Aware Contrastive Learning Framework for Multi-Intent NLUMain3 citations
- A Web Portal about the State of the Art of NLP Tasks in SpanishMain3 citations
- Active Learning Design Choices for NER with TransformersMain3 citations
- Agettivu, Aggitivu o Aghjettivu? POS Tagging Corsican DialectsMain3 citations
- An LCF-IDF Document Representation Model Applied to Long Document ClassificationMain3 citations
- An Untold Story of Preprocessing Task Evaluation: An Alignment-based Joint Evaluation ApproachMain3 citations
- Annotations on a Budget: Leveraging Geo-Data Similarity to Balance Model Performance and Annotation CostMain3 citations
- Automatic Identification of COVID-19-Related Conspiracy Narratives in German Telegram Channels and ChatsMain3 citations
- Beyond Static Evaluation: A Dynamic Approach to Assessing AI Assistants’ API Invocation CapabilitiesMain3 citations
- Beyond Words: Decoding Facial Expression Dynamics in Motivational InterviewingMain3 citations
- Biomedical Entity Linking as Multiple Choice Question AnsweringMain3 citations
- Bootstrapping UMR Annotations for Arapaho from Language Documentation ResourcesMain3 citations
- CAM 2.0: End-to-End Open Domain Comparative Question Answering SystemMain3 citations
- CB-Whisper: Contextual Biasing Whisper Using Open-Vocabulary Keyword-SpottingMain3 citations
- CEPT: A Contrast-Enhanced Prompt-Tuning Framework for Emotion Recognition in ConversationMain3 citations
- CLHA: A Simple Yet Effective Contrastive Learning Framework for Human AlignmentMain3 citations
- Can Large Language Models Learn Translation Robustness from Noisy-Source In-context Demonstrations?Main3 citations
- Challenging Negative Gender Stereotypes: A Study on the Effectiveness of Automated Counter-StereotypesMain3 citations
- Charting the Linguistic Landscape of Developing Writers: An Annotation Scheme for Enhancing Native Language ProficiencyMain3 citations
- Chinese Morpheme-informed Evaluation of Large Language ModelsMain3 citations
- Chinese Sequence Labeling with Semi-Supervised Boundary-Aware Language Model Pre-trainingMain3 citations
- Chitchat as Interference: Adding User Backstories to Task-Oriented DialoguesMain3 citations
- Code-Mixed Probes Show How Pre-Trained Models Generalise on Code-Switched TextMain3 citations
- Context Matters: Enhancing Metaphor Recognition in ProverbsMain3 citations
- Continual Few-shot Event Detection via Hierarchical Augmentation NetworksMain3 citations
- ContrastWSD: Enhancing Metaphor Detection with Word Sense Disambiguation Following the Metaphor Identification ProcedureMain3 citations
- CrossTune: Black-Box Few-Shot Classification with Label EnhancementMain3 citations
- Czech Dataset for Complex Aspect-Based Sentiment Analysis TasksMain3 citations
- DDxGym: Online Transformer Policies in a Knowledge Graph Based Natural Language EnvironmentMain3 citations
- DELAN: Dual-Level Alignment for Vision-and-Language Navigation by Cross-Modal Contrastive LearningMain3 citations
- DP-CRE: Continual Relation Extraction via Decoupled Contrastive Learning and Memory Structure PreservationMain3 citations
- Detecting Loanwords in Emakhuwa: An Extremely Low-Resource Bantu Language Exhibiting Significant Borrowing from PortugueseMain3 citations
- Detecting Offensive Language in an Open Chatbot PlatformMain3 citations
- DiffusionDialog: A Diffusion Model for Diverse Dialog Generation with Latent SpaceMain3 citations
- Distill, Fuse, Pre-train: Towards Effective Event Causality Identification with Commonsense-Aware Pre-trained ModelMain3 citations
- Doc2SoarGraph: Discrete Reasoning over Visually-Rich Table-Text Documents via Semantic-Oriented Hierarchical GraphsMain3 citations
- Does the Language Matter? Curriculum Learning over Neo-Latin LanguagesMain3 citations
- Domain Adaptation for Dense Retrieval and Conversational Dense Retrieval through Self-Supervision by Meticulous Pseudo-Relevance LabelingMain3 citations
- Domain Generalization via Causal Adjustment for Cross-Domain Sentiment AnalysisMain3 citations
- Dynamic Reward Adjustment in Multi-Reward Reinforcement Learning for Counselor Reflection GenerationMain3 citations
- EFTNAS: Searching for Efficient Language Models in First-Order Weight-Reordered Super-NetworksMain3 citations
- Educational Dialogue Systems for Visually Impaired Students: Introducing a Task-Oriented User-Agent CorpusMain3 citations
- Eesthetic: A Paralex Lexicon of Estonian ParadigmsMain3 citations
- EmoPrompt-ECPE: Emotion Knowledge-aware Prompt-tuning for Emotion-Cause Pair ExtractionMain3 citations
- EmpCRL: Controllable Empathetic Response Generation via In-Context Commonsense Reasoning and Reinforcement LearningMain3 citations
- End-to-end Parsing of Procedural Text into Flow GraphsMain3 citations
- Enhance Robustness of Language Models against Variation Attack through Graph IntegrationMain3 citations
- Enhancing Semantics in Multimodal Chain of Thought via Soft Negative SamplingMain3 citations
- Enhancing Writing Proficiency Classification in Developmental Education: The Quest for AccuracyMain3 citations
- Error-Robust Retrieval for Chinese Spelling CheckMain3 citations
- Evaluating the Potential of Language-family-specific Generative Models for Low-resource Data Augmentation: A Faroese Case StudyMain3 citations
- EvoGrad: A Dynamic Take on the Winograd Schema Challenge with Human AdversariesMain3 citations
- Exploring Interpretability of Independent Components of Word Embeddings with Automated Word Intruder TestMain3 citations
- Exploring the Generalization of Cancer Clinical Trial Eligibility Classifiers across DiseasesMain3 citations
- FalAI: A Dataset for End-to-end Spoken Language Understanding in a Low-Resource ScenarioMain3 citations
- FastSpell: The LangId Magic SpellMain3 citations
- Few-Shot Learning for Cold-Start RecommendationMain3 citations
- Few-shot Named Entity Recognition via Superposition Concept DiscriminationMain3 citations
- FlattenQuant: Breaking through the Inference Compute-bound for Large Language Models with Per-tensor QuantizationMain3 citations
- FoRC4CL: A Fine-grained Field of Research Classification and Annotated Dataset of NLP ArticlesMain3 citations
- Gendered Grammar or Ingrained Bias? Exploring Gender Bias in Icelandic Language ModelsMain3 citations
- Geographically-Informed Language IdentificationMain3 citations
- Good or Bad News? Exploring GPT-4 for Sentiment Analysis for Faroese on a Public News CorporaMain3 citations
- Gramble: A Tabular Programming Language for Collaborative Linguistic ModelingMain3 citations
- HYPERTTS: Parameter Efficient Adaptation in Text to Speech Using HypernetworksMain3 citations
- HarmPot: An Annotation Framework for Evaluating Offline Harm Potential of Social Media TextMain3 citations
- Hierarchical Selection of Important Context for Generative Event Causality Identification with Optimal TransportsMain3 citations
- How to Do Politics with Words: Investigating Speech Acts in Parliamentary DebatesMain3 citations
- Human in the Loop: How to Effectively Create Coherent Topics by Manually Labeling Only a Few Documents per ClassMain3 citations
- Humans Need Context, What about Machines? Investigating Conversational Context in Abusive Language DetectionMain3 citations
- Hybrid of Spans and Table-Filling for Aspect-Level Sentiment Triplet ExtractionMain3 citations
- Improved Neural Protoform Reconstruction via Reflex PredictionMain3 citations
- InaGVAD : A Challenging French TV and Radio Corpus Annotated for Speech Activity Detection and Speaker Gender SegmentationMain3 citations
- Interpretable Short Video Rumor Detection Based on Modality TamperingMain3 citations
- Interpreting Themes from Educational StoriesMain3 citations
- Intrinsic Subgraph Generation for Interpretable Graph Based Visual Question AnsweringMain3 citations
- J-CRe3: A Japanese Conversation Dataset for Real-world Reference ResolutionMain3 citations
- JDocQA: Japanese Document Question Answering Dataset for Generative Language ModelsMain3 citations
- JFLD: A Japanese Benchmark for Deductive Reasoning Based on Formal LogicMain3 citations
- Jargon: A Suite of Language Models and Evaluation Tasks for French Specialized DomainsMain3 citations
- KCL: Few-shot Named Entity Recognition with Knowledge Graph and Contrastive LearningMain3 citations
- KET-QA: A Dataset for Knowledge Enhanced Table Question AnsweringMain3 citations
- KazQAD: Kazakh Open-Domain Question Answering DatasetMain3 citations
- Know-Adapter: Towards Knowledge-Aware Parameter-Efficient Transfer Learning for Few-shot Named Entity RecognitionMain3 citations
- KoCoSa: Korean Context-aware Sarcasm Detection DatasetMain3 citations
- LLMR: Knowledge Distillation with a Large Language Model-Induced RewardMain3 citations
- LLMSegm: Surface-level Morphological Segmentation Using Large Language ModelMain3 citations
- Layer-wise Regularized Dropout for Neural Language ModelsMain3 citations
- Learning Strategies for Robust Argument Mining: An Analysis of Variations in Language and DomainMain3 citations
- Let’s Rectify Step by Step: Improving Aspect-based Sentiment Analysis with Diffusion ModelsMain3 citations
- Leveraging Linguistically Enhanced Embeddings for Open Information ExtractionMain3 citations
- Linguistic Knowledge Can Enhance Encoder-Decoder Models (If You Let It)Main3 citations
- Linguistic Survey of India and Polyglotta Africana: Two Retrostandardized Digital Editions of Large Historical Collections of Multilingual WordlistsMain3 citations
- Locally Differentially Private In-Context LearningMain3 citations
- MAGIC: Multi-Argument Generation with Self-Refinement for Domain Generalization in Automatic Fact-CheckingMain3 citations
- MedQA-SWE - a Clinical Question & Answer Dataset for SwedishMain3 citations
- Monolingual Paraphrase Detection Corpus for Low Resource Pashto Language at Sentence LevelMain3 citations
- Motion Generation from Fine-grained Textual DescriptionsMain3 citations
- Multi-Channel Spatio-Temporal Transformer for Sign Language ProductionMain3 citations
- Multilingual Brain Surgeon: Large Language Models Can Be Compressed Leaving No Language behindMain3 citations
- Multilingual Sentence-T5: Scalable Sentence Encoders for Multilingual ApplicationsMain3 citations
- Multilingual Substitution-based Word Sense InductionMain3 citations
- Multimodal Cross-Document Event Coreference Resolution Using Linear Semantic Transfer and Mixed-Modality EnsemblesMain3 citations
- NER-guided Comprehensive Hierarchy-aware Prompt Tuning for Hierarchical Text ClassificationMain3 citations
- Neural Machine Translation between Low-Resource Languages with Synthetic PivotingMain3 citations
- On an Intermediate Task for Classifying URL Citations on Scholarly PapersMain3 citations
- Opinion Mining Using Pre-Trained Large Language Models: Identifying the Type, Polarity, Intensity, Expression, and Source of Private StatesMain3 citations
- Phonetic Segmentation of the UCLA Phonetics Lab ArchiveMain3 citations
- PopALM: Popularity-Aligned Language Models for Social Media Trendy Response PredictionMain3 citations
- Positive and Risky Message Assessment for Music ProductsMain3 citations
- ProCQA: A Large-scale Community-based Programming Question Answering Dataset for Code SearchMain3 citations
- PromISe: Releasing the Capabilities of LLMs with Prompt Introspective SearchMain3 citations
- Prompt-based Generation of Natural Language Explanations of Synthetic Lethality for Cancer Drug DiscoveryMain3 citations
- Prompting Explicit and Implicit Knowledge for Multi-hop Question Answering Based on Human Reading ProcessMain3 citations
- Prompting for Numerical Sequences: A Case Study on Market Comment GenerationMain3 citations
- Pseudonymization Categories across Domain BoundariesMain3 citations
- Quantifying the Impact of Disfluency on Spoken Content SummarizationMain3 citations
- Reconstruction of Cuneiform Literary Texts as Text MatchingMain3 citations
- Reduce Redundancy Then Rerank: Enhancing Code Summarization with a Novel Pipeline FrameworkMain3 citations
- Rethinking Word-level Adversarial Attack: The Trade-off between Efficiency, Effectiveness, and ImperceptibilityMain3 citations
- Retrieval-Augmented Modular Prompt Tuning for Low-Resource Data-to-Text GenerationMain3 citations
- RoCode: A Dataset for Measuring Code Intelligence from Problem Definitions in RomanianMain3 citations
- SDA: Simple Discrete Augmentation for Contrastive Sentence Representation LearningMain3 citations
- SI-NLI: A Slovene Natural Language Inference Dataset and Its EvaluationMain3 citations
- Select High-quality Synthetic QA Pairs to Augment Training Data in MRC under the Reward Guidance of Generative Language ModelsMain3 citations
- Semantic Frame Extraction in Multilingual Olfactory EventsMain3 citations
- SignBLEU: Automatic Evaluation of Multi-channel Sign Language TranslationMain3 citations
- Social Orientation: A New Feature for Dialogue AnalysisMain3 citations
- Speech Analysis of Language Varieties in ItalyMain3 citations
- StyleFlow: Disentangle Latent Representations via Normalizing Flow for Unsupervised Text Style TransferMain3 citations
- SuperST: Superficial Self-Training for Few-Shot Text ClassificationMain3 citations
- TARIC-SLU: A Tunisian Benchmark Dataset for Spoken Language UnderstandingMain3 citations
- TECA: A Two-stage Approach with Controllable Attention Soft Prompt for Few-shot Nested Named Entity RecognitionMain3 citations
- TIGER: A Unified Generative Model Framework for Multimodal Dialogue Response GenerationMain3 citations
- TMFN: A Target-oriented Multi-grained Fusion Network for End-to-end Aspect-based Multimodal Sentiment AnalysisMain3 citations
- The Syntactic Acceptability Dataset (Preview): A Resource for Machine Learning and Linguistic Analysis of EnglishMain3 citations
- To Err Is Human, How about Medical Large Language Models? Comparing Pre-trained Language Models for Medical Assessment Errors and ReliabilityMain3 citations
- Token-length Bias in Minimal-pair Paradigm DatasetsMain3 citations
- Towards Algorithmic Fidelity: Mental Health Representation across Demographics in Synthetic vs. Human-generated DataMain3 citations
- Towards Equitable Natural Language Understanding Systems for Dialectal Cohorts: Debiasing Training DataMain3 citations
- Towards Few-shot Entity Recognition in Document Images: A Graph Neural Network Approach Robust to Image ManipulationMain3 citations
- Towards Human-aligned Evaluation for Linear Programming Word ProblemsMain3 citations
- Towards Realistic Few-Shot Relation Extraction: A New Meta Dataset and EvaluationMain3 citations
- Transferring BERT Capabilities from High-Resource to Low-Resource Languages Using Vocabulary MatchingMain3 citations
- UMTIT: Unifying Recognition, Translation, and Generation for Multimodal Text Image TranslationMain3 citations
- UQA: Corpus for Urdu Question AnsweringMain3 citations
- UniRetriever: Multi-task Candidates Selection for Various Context-Adaptive Conversational RetrievalMain3 citations
- Universal Dependencies: Extensions for Modern and Historical GermanMain3 citations
- Unsupervised Grouping of Public Procurement Similar Items: Which Text Representation Should I Use?Main3 citations
- Using Pre-Trained Language Models in an End-to-End Pipeline for Antithesis DetectionMain3 citations
- What Factors Influence LLMs’ Judgments? A Case Study on Question AnsweringMain3 citations
- When Your Cousin Has the Right Connections: Unsupervised Bilingual Lexicon Induction for Related Data-Imbalanced LanguagesMain3 citations
- 3AM: An Ambiguity-Aware Multi-Modal Machine Translation DatasetMain2 citations
- A Canonical Form for Flexible Multiword ExpressionsMain2 citations
- A Dataset for Named Entity Recognition and Entity Linking in Chinese Historical NewspapersMain2 citations
- A Decade of Scholarly Research on Open Knowledge GraphsMain2 citations
- A Gaze-grounded Visual Question Answering Dataset for Clarifying Ambiguous Japanese QuestionsMain2 citations
- A Knowledge Plug-and-Play Test Bed for Open-domain Dialogue GenerationMain2 citations
- A Lightweight Approach to a Giga-Corpus of Historical Periodicals: The Story of a Slovenian Historical Newspaper CollectionMain2 citations
- A Linguistically-Informed Annotation Strategy for Korean Semantic Role LabelingMain2 citations
- A Multi-layered Approach to Physical Commonsense Understanding: Creation and Evaluation of an Italian DatasetMain2 citations
- A Multimodal In-Context Tuning Approach for E-Commerce Product Description GenerationMain2 citations
- A Natural Approach for Synthetic Short-Form Text AnalysisMain2 citations
- A Novel Corpus of Annotated Medical Imaging Reports and Information Extraction Results Using BERT-based Language ModelsMain2 citations
- A Quantum-Inspired Matching Network with Linguistic Theories for Metaphor DetectionMain2 citations
- A Regularization-based Transfer Learning Method for Information Extraction via Instructed Graph DecoderMain2 citations
- Agent-based Modeling of Language Change in a Small-world NetworkMain2 citations
- An Unsupervised Framework for Adaptive Context-aware Simplified-Traditional Chinese Character ConversionMain2 citations
- Analyzing Homonymy Disambiguation Capabilities of Pretrained Language ModelsMain2 citations
- Anchor and Broadcast: An Efficient Concept Alignment Approach for Evaluation of Semantic GraphsMain2 citations
- AnnoTheia: A Semi-Automatic Annotation Toolkit for Audio-Visual Speech TechnologiesMain2 citations
- Annotation and Classification of Relevant Clauses in Terms-and-Conditions ContractsMain2 citations
- Announcing the Prague Discourse Treebank 3.0Main2 citations
- Appraisal Framework for Clinical Empathy: A Novel Application to Breaking Bad News ConversationsMain2 citations
- Arbitrary Time Information Modeling via Polynomial Approximation for Temporal Knowledge Graph EmbeddingMain2 citations
- AuRoRA: A One-for-all Platform for Augmented Reasoning and Refining with Task-Adaptive Chain-of-Thought PromptingMain2 citations
- Automatic Punctuation Model for Spanish Live TranscriptionsMain2 citations
- Automatic Speech Interruption Detection: Analysis, Corpus, and SystemMain2 citations
- Benchmarking the Performance of Machine Translation Evaluation Metrics with Chinese Multiword ExpressionsMain2 citations
- Benchmarking the Simplification of Dutch Municipal TextMain2 citations
- Beyond Canonical Fine-tuning: Leveraging Hybrid Multi-Layer Pooled Representations of BERT for Automated Essay ScoringMain2 citations
- Beyond Linguistic Cues: Fine-grained Conversational Emotion Recognition via Belief-Desire ModellingMain2 citations
- C-Journal: A Journaling Application for Detecting and Classifying Cognitive Distortions Using Deep-Learning Based on a Crowd-sourced DatasetMain2 citations
- CAGK: Collaborative Aspect Graph Enhanced Knowledge-based RecommendationMain2 citations
- CAMERA³: An Evaluation Dataset for Controllable Ad Text Generation in JapaneseMain2 citations
- CLEVR-POC: Reasoning-Intensive Visual Question Answering in Partially Observable EnvironmentsMain2 citations
- Camel Morph MSA: A Large-Scale Open-Source Morphological Analyzer for Modern Standard ArabicMain2 citations
- Can Humans Identify Domains?Main2 citations
- Causal Intersectionality and Dual Form of Gradient Descent for Multimodal Analysis: A Case Study on Hateful MemesMain2 citations
- ChainNet: Structured Metaphor and Metonymy in WordNetMain2 citations
- CoBaLD Annotation: The Enrichment of the Enhanced Universal Dependencies with the Semantical PatternMain2 citations
- CoNLL#: Fine-grained Error Analysis and a Corrected Test Set for CoNLL-03 EnglishMain2 citations
- Code Defect Detection Using Pre-trained Language Models with Encoder-Decoder via Line-Level Defect LocalizationMain2 citations
- Collecting Human-Agent Dialogue Dataset with Frontal Brain Signal toward Capturing Unexpressed SentimentMain2 citations
- Collecting Linguistic Resources for Assessing Children’s Pronunciation of Nordic LanguagesMain2 citations
- Combining Discourse Coherence with Large Language Models for More Inclusive, Equitable, and Robust Task-Oriented DialogueMain2 citations
- Common European Language Data SpaceMain2 citations
- Complex Word Identification: A Comparative Study between ChatGPT and a Dedicated Model for This TaskMain2 citations
- ConEC: Earnings Call Dataset with Real-world Contexts for Benchmarking Contextual Speech RecognitionMain2 citations
- Constructing Korean Learners’ L2 Speech Corpus of Seven Languages for Automatic Pronunciation AssessmentMain2 citations
- Constructing a Dependency Treebank for Second Language Learners of KoreanMain2 citations
- Construction of Paired Knowledge Graph - Text Datasets Informed by Cyclic EvaluationMain2 citations
- Controllable Paraphrase Generation for Semantic and Lexical SimilaritiesMain2 citations
- Counterfactual Dialog Mixing as Data Augmentation for Task-Oriented Dialog SystemsMain2 citations
- Croatian Idioms Integration: Enhancing the LIdioms Multilingual Linked Idioms DatasetMain2 citations
- Cross-type French Multiword Expression Identification with Pre-trained Masked Language ModelsMain2 citations
- CuSINeS: Curriculum-driven Structure Induced Negative Sampling for Statutory Article RetrievalMain2 citations
- DEIE: Benchmarking Document-level Event Information Extraction with a Large-scale Chinese News DatasetMain2 citations
- DMON: A Simple Yet Effective Approach for Argument Structure LearningMain2 citations
- DOC-RAG: ASR Language Model Personalization with Domain-Distributed Co-occurrence Retrieval AugmentationMain2 citations
- DRAMA: Dynamic Multi-Granularity Graph Estimate Retrieval over Tabular and Textual Question AnsweringMain2 citations
- Dataset for Identification of Homophobia and Transphobia for Telugu, Kannada, and GujaratiMain2 citations
- DeFaktS: A German Dataset for Fine-Grained Disinformation Detection through Social Media FramingMain2 citations
- Deep Reinforcement Learning-based Dialogue Policy with Graph Convolutional Q-networkMain2 citations
- Demonstration Retrieval-Augmented Generative Event Argument ExtractionMain2 citations
- Denoising Table-Text Retrieval for Open-Domain Question AnsweringMain2 citations
- Detection, Diagnosis, and Explanation: A Benchmark for Chinese Medial Hallucination EvaluationMain2 citations
- Developing a Rhetorical Structure Theory Treebank for CzechMain2 citations
- DiscoGeM 2.0: A Parallel Corpus of English, German, French and Czech Implicit Discourse RelationsMain2 citations
- Distilling Causal Effect of Data in Continual Few-shot Relation LearningMain2 citations
- Domain Transferable Semantic Frames for Expert Interview DialoguesMain2 citations
- Domain-aware and Co-adaptive Feature Transformation for Domain Adaption Few-shot Relation ExtractionMain2 citations
- Dr3: Ask Large Language Models Not to Give Off-Topic Answers in Open Domain Multi-Hop Question AnsweringMain2 citations
- Dual Complex Number Knowledge Graph EmbeddingsMain2 citations
- Dynamic Spatial-Temporal Aggregation for Skeleton-Aware Sign Language RecognitionMain2 citations
- ESDM: Early Sensing Depression Model in Social Media StreamsMain2 citations
- Effective Integration of Text Diffusion and Pre-Trained Language Models with Linguistic Easy-First ScheduleMain2 citations
- Efficient AMR Parsing with CLAP: Compact Linearization with an Adaptable ParserMain2 citations
- Emancipating Event Extraction from the Constraints of Long-Tailed Distribution Data Utilizing Large Language ModelsMain2 citations
- EmoProgress: Cumulated Emotion Progression Analysis in Dreams and Customer Service DialoguesMain2 citations
- Empowering Low-Resource Regional Languages with Lexicons : A Comparative Study of NLP Tools for Morphosyntactic AnalysisMain2 citations
- Empowering Tree-structured Entailment Reasoning: Rhetorical Perception and LLM-driven InterpretabilityMain2 citations
- Emstremo: Adapting Emotional Support Response with Enhanced Emotion-Strategy Integrated SelectionMain2 citations
- Enhancing Court View Generation with Knowledge Injection and GuidanceMain2 citations
- Enhancing Cross-Document Event Coreference Resolution by Discourse Structure and Semantic InformationMain2 citations
- Enhancing Low-Resource LLMs Classification with PEFT and Synthetic DataMain2 citations
- Enhancing Phrase Representation by Information Bottleneck Guided Text Diffusion Process for Keyphrase ExtractionMain2 citations
- Enhancing Scientific Document Summarization with Research Community Perspective and Background KnowledgeMain2 citations
- Enhancing Translation Ability of Large Language Models by Leveraging Task-Related LayersMain2 citations
- Ensembles of Hybrid and End-to-End Speech Recognition.Main2 citations
- Estimating Lexical Complexity from Document-Level DistributionsMain2 citations
- Evaluating Topic Model on Asymmetric and Multi-Domain Financial CorpusMain2 citations
- Evaluating Workflows for Creating Orthographic Transcripts for Oral Corpora by Transcribing from Scratch or Correcting ASR-OutputMain2 citations
- Evaluation Dataset for Lexical Translation Consistency in Chinese-to-English Document-level TranslationMain2 citations
- Event Representation Learning with Multi-Grained Contrastive Learning and Triple-Mixture of ExpertsMain2 citations
- Executing Natural Language-Described Algorithms with Large Language Models: An InvestigationMain2 citations
- Explaining Pre-Trained Language Models with Attribution Scores: An Analysis in Low-Resource SettingsMain2 citations
- Explicit over Implict: Explicit Diversity Conditions for Effective Question Answer GenerationMain2 citations
- Exploring Pathological Speech Quality Assessment with ASR-Powered Wav2Vec2 in Data-Scarce ContextMain2 citations
- Exploring the Synergy of Dual-path Encoder and Alignment Module for Better Graph-to-Text GenerationMain2 citations
- Extending AZee with Non-manual Gesture Rules for French Sign LanguageMain2 citations
- FaGANet: An Evidence-Based Fact-Checking Model with Integrated Encoder Leveraging Contextual InformationMain2 citations
- Feature Structure Matching for Multi-source Sentiment Analysis with Efficient Adaptive TuningMain2 citations
- Federated Document-Level Biomedical Relation Extraction with Localized Context ContrastMain2 citations
- Few-Shot Relation Extraction with Hybrid Visual EvidenceMain2 citations
- FinCorpus-DE10k: A Corpus for the German Financial DomainMain2 citations
- Finding Spoken Identifications: Using GPT-4 Annotation for an Efficient and Fast Dataset Creation PipelineMain2 citations
- Fisher Mask Nodes for Language Model MergingMain2 citations
- GLAMR: Augmenting AMR with GL-VerbNet Event StructureMain2 citations
- GMEG-EXP: A Dataset of Human- and LLM-Generated Explanations of Grammatical and Fluency EditsMain2 citations
- GOLEM: GOld Standard for Learning and Evaluation of MotifsMain2 citations
- German SRL: Corpus Construction and Model TrainingMain2 citations
- Grammatical Error Correction for Code-Switched Sentences by Learners of EnglishMain2 citations
- Hierarchical Graph Convolutional Network Approach for Detecting Low-Quality DocumentsMain2 citations
- High-order Joint Constituency and Dependency ParsingMain2 citations
- How Diplomats Dispute: The UN Security Council Conflict CorpusMain2 citations
- How Robust Are the QA Models for Hybrid Scientific Tabular Data? A Study Using Customized DatasetMain2 citations
- How to Encode Domain Information in Relation ClassificationMain2 citations
- How to Solve Few-Shot Abusive Content Detection Using the Data We Actually HaveMain2 citations
- I Remember You!: SUI Corpus for Remembering and Utilizing Users’ Information in Chat-oriented Dialogue SystemsMain2 citations
- IAD: In-Context Learning Ability Decoupler of Large Language Models in Meta-TrainingMain2 citations
- Identifying and Aligning Medical Claims Made on Social Media with Medical EvidenceMain2 citations
- Impoverished Language Technology: The Lack of (Social) Class in NLPMain2 citations
- Improving Content Recommendation: Knowledge Graph-Based Semantic Contrastive Learning for Diversity and Cold-Start UsersMain2 citations
- Improving Low-Resource Keyphrase Generation through Unsupervised Title Phrase GenerationMain2 citations
- Incorporating Word-level Phonemic Decoding into Readability AssessmentMain2 citations
- Indic-TEDST: Datasets and Baselines for Low-Resource Speech to Text TranslationMain2 citations
- IndicFinNLP: Financial Natural Language Processing for Indian LanguagesMain2 citations
- InferBR: A Natural Language Inference Dataset in PortugueseMain2 citations
- Intention and Face in DialogMain2 citations
- Interpretable Assessment of Speech Intelligibility Using Deep Learning: A Case Study on Speech Disorders Due to Head and Neck CancersMain2 citations
- Introducing CQuAE : A New French Contextualised Question-Answering Corpus for the Education DomainMain2 citations
- JEMHopQA: Dataset for Japanese Explainable Multi-Hop Question AnsweringMain2 citations
- JaParaPat: A Large-Scale Japanese-English Parallel Patent Application CorpusMain2 citations
- KazEmoTTS: A Dataset for Kazakh Emotional Text-to-Speech SynthesisMain2 citations
- Knowledge-Guided Cross-Topic Visual Question GenerationMain2 citations
- Korean Bio-Medical Corpus (KBMC) for Medical Named Entity RecognitionMain2 citations
- LANID: LLM-assisted New Intent DiscoveryMain2 citations
- LCGbank: A Corpus of Syntactic Analyses Based on Proof NetsMain2 citations
- LHMKE: A Large-scale Holistic Multi-subject Knowledge Evaluation Benchmark for Chinese Large Language ModelsMain2 citations
- LM-Combiner: A Contextual Rewriting Model for Chinese Grammatical Error CorrectionMain2 citations
- Language and Speech Technology for Central Kurdish VarietiesMain2 citations
- Latent vs Explicit Knowledge Representation: How ChatGPT Answers Questions about Low-Frequency EntitiesMain2 citations
- LeadEmpathy: An Expert Annotated German Dataset of Empathy in Written Leadership CommunicationMain2 citations
- Leveraging Social Context for Humor Recognition and Sense of Humor Evaluation in Social Media with a New Chinese Humor Corpus - HumorWBMain2 citations
- Linking Named Entities in Diderot’s Encyclopédie to WikidataMain2 citations
- Llama-VITS: Enhancing TTS Synthesis with Semantic AwarenessMain2 citations
- LocalTweets to LocalHealth: A Mental Health Surveillance Framework Based on Twitter DataMain2 citations
- Longform Multimodal Lay Summarization of Scientific Papers: Towards Automatically Generating Science Blogs from Research ArticlesMain2 citations
- Look before You Leap: Dual Logical Verification for Knowledge-based Visual Question GenerationMain2 citations
- MDS: A Fine-Grained Dataset for Multi-Modal Dialogue SummarizationMain2 citations
- MKeCL: Medical Knowledge-Enhanced Contrastive Learning for Few-shot Disease DiagnosisMain2 citations
- MLDSP-MA: Multidimensional Attention for Multi-Round Long Dialogue Sentiment PredictionMain2 citations
- MULTICOLLAB: A Multimodal Corpus of Dialogues for Analyzing Collaboration and Frustration in LanguageMain2 citations
- MaCmS: Magahi Code-mixed Dataset for Sentiment AnalysisMain2 citations
- Majority Rules Guided Aspect-Category Based Sentiment Analysis via Label Prior KnowledgeMain2 citations
- Making Sentence Embeddings Robust to User-Generated ContentMain2 citations
- Massively Multilingual Token-Based Typology Using the Parallel Bible CorpusMain2 citations
- MccSTN: Multi-Scale Contrast and Fine-Grained Feature Fusion Networks for Subject-driven Style TransferMain2 citations
- MiDe22: An Annotated Multi-Event Tweet Dataset for Misinformation DetectionMain2 citations
- Mitigating Translationese in Low-resource Languages: The Storyboard ApproachMain2 citations
- MixRED: A Mix-lingual Relation Extraction DatasetMain2 citations
- MoNMT: Modularly Leveraging Monolingual and Bilingual Knowledge for Neural Machine TranslationMain2 citations
- Modalities Should Be Appropriately Leveraged: Uncertainty Guidance for Multimodal Chinese Spelling CorrectionMain2 citations
- Model-Agnostic Cross-Lingual Training for Discourse Representation Structure ParsingMain2 citations
- Modeling Low-Resource Health Coaching Dialogues via Neuro-Symbolic Goal Summarization and Text-Units-Text GenerationMain2 citations
- Modeling Orthographic Variation Improves NLP Performance for Nigerian PidginMain2 citations
- Multi-Dimensional Machine Translation Evaluation: Model Evaluation and Resource for KoreanMain2 citations
- Multi-Stage Multi-Modal Pre-Training for Automatic Speech RecognitionMain2 citations
- Multi-domain Hate Speech Detection Using Dual Contrastive Learning and Paralinguistic FeaturesMain2 citations
- Multi-modal Semantic Understanding with Contrastive Cross-modal Feature AlignmentMain2 citations
- Multi-stream Information Fusion Framework for Emotional Support ConversationMain2 citations
- Neural Multimodal Topic Modeling: A Comprehensive EvaluationMain2 citations
- OLViT: Multi-Modal State Tracking via Attention-Based Embeddings for Video-Grounded DialogMain2 citations
- On Leveraging Encoder-only Pre-trained Language Models for Effective Keyphrase GenerationMain2 citations
- PAD: A Robustness Enhancement Ensemble Method via Promoting Attention DiversityMain2 citations
- PASUM: A Pre-training Architecture for Social Media User Modeling Based on Text GraphMain2 citations
- PDAMeta: Meta-Learning Framework with Progressive Data Augmentation for Few-Shot Text ClassificationMain2 citations
- PSE v1.0: The First Open Access Corpus of Public Service EncountersMain2 citations
- ParaNames 1.0: Creating an Entity Name Corpus for 400+ Languages Using WikidataMain2 citations
- Pater Incertus? There Is a Solution: Automatic Discrimination between Cognates and Borrowings for Romance LanguagesMain2 citations
- Persona-aware Multi-party Conversation Response GenerationMain2 citations
- Phonotactic Complexity across DialectsMain2 citations
- Pluggable Neural Machine Translation Models via Memory-augmented AdaptersMain2 citations
- Polish-ASTE: Aspect-Sentiment Triplet Extraction Datasets for PolishMain2 citations
- PolitiCause: An Annotation Scheme and Corpus for Causality in Political TextsMain2 citations
- Prior Relational Schema Assists Effective Contrastive Learning for Inductive Knowledge Graph CompletionMain2 citations
- Probing Large Language Models for Scalar Adjective Lexical Semantics and Scalar Diversity PragmaticsMain2 citations
- Prompt Tuning for Few-shot Relation Extraction via Modeling Global and Local GraphsMain2 citations
- Prophecy Distillation for Boosting Abstractive SummarizationMain2 citations
- QDMR-based Planning-and-Solving Prompting for Complex Reasoning TasksMain2 citations
- Qsnail: A Questionnaire Dataset for Sequential Question GenerationMain2 citations
- Query-driven Relevant Paragraph Extraction from Legal JudgmentsMain2 citations
- RENN: A Rule Embedding Enhanced Neural Network Framework for Temporal Knowledge Graph CompletionMain2 citations
- RU22Fact: Optimizing Evidence for Multilingual Explainable Fact-Checking on Russia-Ukraine ConflictMain2 citations
- Recognizing Social Cues in Crisis SituationsMain2 citations
- Recognizing Value Resonance with Resonance-Tuned RoBERTa Task Definition, Experimental Validation, and Robust ModelingMain2 citations
- Refining Idioms Semantics Comprehension via Contrastive Learning and Cross-AttentionMain2 citations
- Reflecting the Male Gaze: Quantifying Female Objectification in 19th and 20th Century NovelsMain2 citations
- Reflections & Resonance: Two-Agent Partnership for Advancing LLM-based Story AnnotationMain2 citations
- Relation between Cross-Genre and Cross-Topic Transfer in Dependency ParsingMain2 citations
- Replace, Paraphrase or Fine-tune? Evaluating Automatic Simplification for Medical Texts in SpanishMain2 citations
- Revisiting the Classics: A Study on Identifying and Rectifying Gender Stereotypes in Rhymes and PoemsMain2 citations
- Rewiring the Transformer with Depth-Wise LSTMsMain2 citations
- RoBERTa Low Resource Fine Tuning for Sentiment Analysis in AlbanianMain2 citations
- SCOUT: A Situated and Multi-Modal Human-Robot Dialogue CorpusMain2 citations
- SENTA: Sentence Simplification System for SloveneMain2 citations
- SIGA: A Naturalistic NLI Dataset of English Scalar Implicatures with Gradable AdjectivesMain2 citations
- SamróMur MilljóN: An ASR Corpus of One Million Verified Read Prompts in IcelandicMain2 citations
- Sarcasm Detection in a Disaster ContextMain2 citations
- Scale-VAE: Preventing Posterior Collapse in Variational AutoencoderMain2 citations
- Schema-based Data Augmentation for Event ExtractionMain2 citations
- SciDMT: A Large-Scale Corpus for Detecting Scientific MentionsMain2 citations
- Select and Reorder: A Novel Approach for Neural Sign Language ProductionMain2 citations
- Semantic Map-based Generation of Navigation InstructionsMain2 citations
- Semantic Role Labeling Guided Out-of-distribution DetectionMain2 citations
- Silver Retriever: Advancing Neural Passage Retrieval for Polish Question AnsweringMain2 citations
- SkOTaPA: A Dataset for Skepticism Detection in Online Text after Persuasion AttemptMain2 citations
- SlovakSum: A Large Scale Slovak Summarization DatasetMain2 citations
- Source-free Domain Adaptation for Aspect-based Sentiment AnalysisMain2 citations
- Sparse Logistic Regression with High-order Features for Automatic Grammar Rule Extraction from TreebanksMain2 citations
- Specifying Genericity through Inclusiveness and Abstractness Continuous ScalesMain2 citations
- Speech Corpus for Korean Children with Autism Spectrum Disorder: Towards Automatic Assessment SystemsMain2 citations
- Speech Recognition Corpus of the Khinalug Language for Documenting Endangered LanguagesMain2 citations
- SynPrompt: Syntax-aware Enhanced Prompt Engineering for Aspect-based Sentiment AnalysisMain2 citations
- Synergetic Interaction Network with Cross-task Attention for Joint Relational Triple ExtractionMain2 citations
- Synthetic Data Generation and Joint Learning for Robust Code-Mixed TranslationMain2 citations
- TACO – Twitter Arguments from COnversationsMain2 citations
- TP-Link: Fine-grained Pre-Training for Text-to-SQL Parsing with Linking InformationMain2 citations
- Target-Adaptive Consistency Enhanced Prompt-Tuning for Multi-Domain Stance DetectionMain2 citations
- Task-Oriented Paraphrase AnalyticsMain2 citations
- Task-agnostic Distillation of Encoder-Decoder Language ModelsMain2 citations
- Tell Me Again! a Large-Scale Dataset of Multiple Summaries for the Same StoryMain2 citations
- Text-to-Multimodal Retrieval with Bimodal Input Fusion in Shared Cross-Modal TransformerMain2 citations
- Text2Story Lusa: A Dataset for Narrative Analysis in European Portuguese News ArticlesMain2 citations
- Text360Nav: 360-Degree Image Captioning Dataset for Urban Pedestrians NavigationMain2 citations
- The Distracted Ear: How Listeners Shape Conversational DynamicsMain2 citations
- The Emergence of Semantic Units in Massively Multilingual ModelsMain2 citations
- The RIP Corpus of Collaborative Hypothesis-MakingMain2 citations
- The Swedish Parliament Corpus 1867 – 2022Main2 citations
- There’s Something New about the Italian Parliament: The IPSA CorpusMain2 citations
- To Drop or Not to Drop? Predicting Argument Ellipsis Judgments: A Case Study in JapaneseMain2 citations
- TopicDiff: A Topic-enriched Diffusion Approach for Multimodal Conversational Emotion DetectionMain2 citations
- Topics as Entity Clusters: Entity-based Topics from Large Language Models and Graph Neural NetworksMain2 citations
- Towards Answering Health-related Questions from Medical Videos: Datasets and ApproachesMain2 citations
- Towards Graph-hop Retrieval and Reasoning in Complex Question Answering over Textual DatabaseMain2 citations
- Towards Robust Evidence-Aware Fake News Detection via Improving Semantic PerceptionMain2 citations
- Towards Standardized Annotation and Parsing for Korean FrameNetMain2 citations
- Transformer-based Joint Modelling for Automatic Essay Scoring and Off-Topic DetectionMain2 citations
- TunArTTS: Tunisian Arabic Text-To-Speech CorpusMain2 citations
- UniPSDA: Unsupervised Pseudo Semantic Data Augmentation for Zero-Shot Cross-Lingual Natural Language UnderstandingMain2 citations
- Unpacking Bias: An Empirical Study of Bias Measurement Metrics, Mitigation Algorithms, and Their InteractionsMain2 citations
- Using Bibliodata LODification to Create Metadata-Enriched Literary Corpora in Line with FAIR PrinciplesMain2 citations
- UzbekVerbDetection: Rule-based Detection of Verbs in Uzbek TextsMain2 citations
- Vygotsky Distance: Measure for Benchmark Task SimilarityMain2 citations
- What Can Diachronic Contexts and Topics Tell Us about the Present-Day Compositionality of English Noun Compounds?Main2 citations
- What Do Transformers Know about Government?Main2 citations
- When Cohesion Lies in the Embedding Space: Embedding-Based Reference-Free Metrics for Topic SegmentationMain2 citations
- WikiSplit++: Easy Data Refinement for Split and RephraseMain2 citations
- XATU: A Fine-grained Instruction-based Benchmark for Explainable Text UpdatesMain2 citations
- text2story: A Python Toolkit to Extract and Visualize Story Components of Narrative TextMain2 citations
- A Benchmark Evaluation of Clinical Named Entity Recognition in FrenchMain1 citations
- A Call for Clarity in Beam Search: How It Works and When It StopsMain1 citations
- A Cause-Effect Look at Alleviating Hallucination of Knowledge-grounded Dialogue GenerationMain1 citations
- A Corpus of German Abstract Meaning Representation (DeAMR)Main1 citations
- A Document-Level Text Simplification Dataset for JapaneseMain1 citations
- A Generative Model for Lambek Categorial SequentsMain1 citations
- A Large Annotated Reference Corpus of New High German PoetryMain1 citations
- A Multilingual Parallel Corpus for AromanianMain1 citations
- A Streamlined Span-based Factorization Method for Few Shot Named Entity RecognitionMain1 citations
- A Study on How Attention Scores in the BERT Model Are Aware of Lexical Categories in Syntactic and Semantic Tasks on the GLUE BenchmarkMain1 citations
- A Treebank of Asia Minor GreekMain1 citations
- A Virtual Patient Dialogue System Based on Question-Answering on Clinical RecordsMain1 citations
- A Workflow for HTR-Postprocessing, Labeling and Classifying Diachronic and Regional Variation in Pre-Modern Slavic TextsMain1 citations
- ABLE: Agency-BeLiefs Embedding to Address Stereotypical Bias through Awareness Instead of ObliviousnessMain1 citations
- AMenDeD: Modelling Concepts by Aligning Mentions, Definitions and Decontextualised EmbeddingsMain1 citations
- ARBRES Kenstur: A Breton-French Parallel Corpus Rooted in Field LinguisticsMain1 citations
- ART: The Alternating Reading Task Corpus for Speech Entrainment and ImitationMain1 citations
- Access Control Framework for Language CollectionsMain1 citations
- Action and Reaction Go Hand in Hand! a Multi-modal Dialogue Act Aided Sarcasm IdentificationMain1 citations
- Adaptive Reinforcement Tuning Language Models as Hard Data Generators for Sentence RepresentationMain1 citations
- Adding SPICE to Life: Speaker Profiling in Multiparty ConversationsMain1 citations
- Advancing Semi-Supervised Learning for Automatic Post-Editing: Data-Synthesis by Mask-Infilling with Erroneous TermsMain1 citations
- Advancing Topic Segmentation and Outline Generation in Chinese Texts: The Paragraph-level Topic Representation, Corpus, and BenchmarkMain1 citations
- Agenda-Driven Question Generation: A Case Study in the Courtroom DomainMain1 citations
- An Empirical Study of Synthetic Data Generation for Implicit Discourse Relation RecognitionMain1 citations
- An Event-based Abductive Learning for Hard Time-sensitive Question AnsweringMain1 citations
- Analyzing Chain-of-thought Prompting in Black-Box Large Language Models via Estimated V-informationMain1 citations
- Analyzing Occupational Distribution Representation in Japanese Language ModelsMain1 citations
- Analyzing Symptom-based Depression Level Estimation through the Prism of Psychiatric ExpertiseMain1 citations
- Annotating Customer-Oriented Behaviour in Call Centre Sales DialoguesMain1 citations
- Annotation of Transition-Relevance Places and Interruptions for the Description of Turn-Taking in Conversations in French Media ContentMain1 citations
- Annotations for Exploring Food Tweets from Multiple AspectsMain1 citations
- AntCritic: Argument Mining for Free-Form and Visually-Rich Financial CommentsMain1 citations
- Arabic Diacritization Using Morphologically Informed Character-Level ModelMain1 citations
- Are Text Classifiers Xenophobic? A Country-Oriented Bias Detection Method with Least Confounding VariablesMain1 citations
- AssameseBackTranslit: Back Transliteration of Romanized Assamese Social Media TextMain1 citations
- Assessing the Efficacy of Grammar Error Correction: A Human Evaluation Approach in the Japanese ContextMain1 citations
- Automatic Animacy Classification for Romanian NounsMain1 citations
- Automatic Speech Recognition for Gascon and Languedocian Variants of OccitanMain1 citations
- Automatically Estimating Textual and Phonemic Complexity for Cued Speech: How to See the Sounds from French TextsMain1 citations
- BAN-PL: A Polish Dataset of Banned Harmful and Offensive Content from Wykop.pl Web ServiceMain1 citations
- BKEE: Pioneering Event Extraction in the Vietnamese LanguageMain1 citations
- Beyond Code: Evaluate Thought Steps for Complex Code GenerationMain1 citations
- BiVert: Bidirectional Vocabulary Evaluation Using Relations for Machine TranslationMain1 citations
- Biomedical Concept Normalization over Nested Entities with Partial UMLS Terminology in RussianMain1 citations
- Bits and Pieces: Investigating the Effects of Subwords in Multi-task Parsing across Languages and DomainsMain1 citations
- Breakthrough from Nuance and Inconsistency: Enhancing Multimodal Sarcasm Detection with Context-Aware Self-Attention Fusion and Word Weight Calculation.Main1 citations
- Bridging the Code Gap: A Joint Learning Framework across Medical Coding SystemsMain1 citations
- Bring Invariant to Variant: A Contrastive Prompt-based Framework for Temporal Knowledge Graph ForecastingMain1 citations
- Building Question-Answer Data Using Web Register IdentificationMain1 citations
- Building a Japanese Document-Level Relation Extraction Dataset Assisted by Cross-Lingual TransferMain1 citations
- CALAMR: Component ALignment for Abstract Meaning RepresentationMain1 citations
- CAMAL: A Novel Dataset for Multi-label Conversational Argument Move AnalysisMain1 citations
- CE-VDG: Counterfactual Entropy-based Bias Reduction for Video-grounded Dialogue GenerationMain1 citations
- CLAUSE-ATLAS: A Corpus of Narrative Information to Scale up Computational Literary AnalysisMain1 citations
- CORI: CJKV Benchmark with Romanization Integration - a Step towards Cross-lingual Transfer beyond Textual ScriptsMain1 citations
- Can Factual Statements Be Deceptive? The DeFaBel Corpus of Belief-based DeceptionMain1 citations
- Can Machine Translation Bridge Multilingual Pretraining and Cross-lingual Transfer Learning?Main1 citations
- CareCorpus: A Corpus of Real-World Solution-Focused Caregiver Strategies for Personalized Pediatric Rehabilitation Service DesignMain1 citations
- Challenges in Pre-Training Graph Neural Networks for Context-Based Fake News Detection: An Evaluation of Current Strategies and Resource LimitationsMain1 citations
- ChatASU: Evoking LLM’s Reflexion to Truly Understand Aspect Sentiment in DialoguesMain1 citations
- Claim-Centric and Sentiment Guided Graph Attention Network for Rumour DetectionMain1 citations
- Clarifying Completions: Evaluating How LLMs Respond to Incomplete QuestionsMain1 citations
- Class-Incremental Few-Shot Event DetectionMain1 citations
- Collecting and Analyzing Dialogues in a Tagline Co-Writing TaskMain1 citations
- Comparative Analysis of Sign Language Interpreting Agents Perception: A Study of the DeafMain1 citations
- Comparing Static and Contextual Distributional Semantic Models on Intrinsic Tasks: An Evaluation on Mandarin Chinese DatasetsMain1 citations
- Comparison of Conventional Hybrid and CTC/Attention Decoders for Continuous Visual Speech RecognitionMain1 citations
- Comparison of the Intimacy Process between Real and Acting-based Long-term Text ChatsMain1 citations
- Constructing Indonesian-English Travelogue DatasetMain1 citations
- Context-Aware Non-Autoregressive Document-Level Translation with Sentence-Aligned Connectionist Temporal ClassificationMain1 citations
- Continual Reinforcement Learning for Controlled Text GenerationMain1 citations
- ControversialQA: Exploring Controversy in Question AnsweringMain1 citations
- Converting Legacy Data to CLDF: A FAIR Exit Strategy for Linguistic Web AppsMain1 citations
- CookingSense: A Culinary Knowledgebase with Multidisciplinary AssertionsMain1 citations
- Correcting Language Model Bias for Text Classification in True Zero-Shot LearningMain1 citations
- Cross-Lingual NLU: Mitigating Language-Specific Impact in Embeddings Leveraging Adversarial LearningMain1 citations
- Cross-Lingual Transfer Robustness to Lower-Resource Languages on Adversarial DatasetsMain1 citations
- Cross-lingual Named Entity Corpus for Slavic LanguagesMain1 citations
- Cross-lingual Transfer or Machine Translation? On Data Augmentation for Monolingual Semantic Textual SimilarityMain1 citations
- Curation of Benchmark Templates for Measuring Gender Bias in Named Entity Recognition ModelsMain1 citations
- DACL: Disfluency Augmented Curriculum Learning for Fluent Text GenerationMain1 citations
- DADIT: A Dataset for Demographic Classification of Italian Twitter Users and a Comparison of Prediction MethodsMain1 citations
- DANCER: Entity Description Augmented Named Entity Corrector for Automatic Speech RecognitionMain1 citations
- DGS-Fabeln-1: A Multi-Angle Parallel Corpus of Fairy Tales between German Sign Language and German TextMain1 citations
- DGoT: Dynamic Graph of Thoughts for Scientific Abstract GenerationMain1 citations
- Data Drift in Clinical Outcome Prediction from Admission NotesMain1 citations
- Data-Informed Global Sparseness in Attention Mechanisms for Deep Neural NetworksMain1 citations
- Debiasing Multi-Entity Aspect-Based Sentiment Analysis with Norm-Based Data AugmentationMain1 citations
- Deciphering Emotional Landscapes in the Iliad: A Novel French-Annotated Dataset for Emotion RecognitionMain1 citations
- Decompose, Prioritize, and Eliminate: Dynamically Integrating Diverse Representations for Multimodal Named Entity RecognitionMain1 citations
- Denoising Labeled Data for Comment Moderation Using Active LearningMain1 citations
- Dependencies over Times and Tools (DoTT)Main1 citations
- Depth Aware Hierarchical Replay Continual Learning for Knowledge Based Question AnsweringMain1 citations
- Detecting Conceptual Abstraction in LLMsMain1 citations
- Detecting Impact Relevant Sections in Scientific ResearchMain1 citations
- Detecting Sexual Content at the Sentence Level in First Millennium Latin TextsMain1 citations
- Dialogue Systems Can Generate Appropriate Responses without the Use of Question Marks?– a Study of the Effects of “?” for Spoken Dialogue Systems –Main1 citations
- Discriminative Language Model as Semantic Consistency Scorer for Prompt-based Few-Shot Text ClassificationMain1 citations
- Distractor Generation Using Generative and Discriminative Capabilities of Transformer-based ModelsMain1 citations
- DocScript: Document-level Script Event PredictionMain1 citations
- Document Set Expansion with Positive-Unlabeled Learning Using Intractable Density EstimationMain1 citations
- Does the Generator Mind Its Contexts? An Analysis of Generative Model Faithfulness under Context TransferMain1 citations
- DrBenchmark: A Large Language Understanding Evaluation Benchmark for French Biomedical DomainMain1 citations
- ELLEN: Extremely Lightly Supervised Learning for Efficient Named Entity RecognitionMain1 citations
- EMAD: A Bridge Tagset for Unifying Arabic POS AnnotationsMain1 citations
- EMOLIS App and Dataset to Find Emotionally Close CartoonsMain1 citations
- EROS:Entity-Driven Controlled Policy Document SummarizationMain1 citations
- Efficiency and Effectiveness in Task-Oriented Dialogue: On Construction Repetition, Information Rate, and Task SuccessMain1 citations
- Efficient and Accurate Contextual Re-Ranking for Knowledge Graph Question AnsweringMain1 citations
- Empowering Small-Scale Knowledge Graphs: A Strategy of Leveraging General-Purpose Knowledge Graphs for Enriched EmbeddingsMain1 citations
- Endowing Neural Language Learners with Human-like Biases: A Case Study on Dependency Length MinimizationMain1 citations
- Enhanced Coherence-Aware Network with Hierarchical Disentanglement for Aspect-Category Sentiment AnalysisMain1 citations
- Enhancing Emotion Prediction in News Headlines: Insights from ChatGPT and Seq2Seq Models for Free-Text GenerationMain1 citations
- Enhancing Few-Shot Topic Classification with Verbalizers. a Study on Automatic Verbalizer and Ensemble MethodsMain1 citations
- Enhancing Hindi Feature Representation through Fusion of Dual-Script Word EmbeddingsMain1 citations
- Enhancing Knowledge Retrieval with Topic Modeling for Knowledge-Grounded DialogueMain1 citations
- Enhancing Taiwanese Hokkien Dual Translation by Exploring and Standardizing of Four Writing SystemsMain1 citations
- Enriching Word Usage Graphs with Cluster DefinitionsMain1 citations
- Enriching a Time-Domain Astrophysics Corpus with Named Entity, Coreference and Astrophysical Relationship AnnotationsMain1 citations
- Esposito: An English-Persian Scientific Parallel Corpus for Machine TranslationMain1 citations
- Estimating the Causal Effects of Natural Logic Features in Transformer-Based NLI ModelsMain1 citations
- European Language Grid: One Year afterMain1 citations
- Evaluating Generative Language Models in Information Extraction as Subjective Question CorrectionMain1 citations
- Evaluating Performance of Pre-trained Word Embeddings on Assamese, a Low-resource LanguageMain1 citations
- Evaluating Saliency Explanations in NLP by CrowdsourcingMain1 citations
- Evaluating Shortest Edit Script Methods for Contextual LemmatizationMain1 citations
- Evaluating Webcam-based Gaze Data as an Alternative for Human Rationale AnnotationsMain1 citations
- Evaluating the Efficacy of Large Acoustic Model for Documenting Non-Orthographic Tribal Languages in IndiaMain1 citations
- Evaluating the IWSLT2023 Speech Translation Tasks: Human Annotations, Automatic Metrics, and SegmentationMain1 citations
- Event-enhanced Retrieval in Real-time SearchMain1 citations
- Experiments on Speech Synthesis for Teochew, Can Taiwanese Help ?Main1 citations
- Explainable Multi-hop Question Generation: An End-to-End Approach without Intermediate Question LabelingMain1 citations
- Exploring Neural Topic Modeling on a Classical Latin CorpusMain1 citations
- Exploring the Impact of Human Evaluator Group on Chat-Oriented Dialogue EvaluationMain1 citations
- Extending the Discourse Analysis Tool Suite with Whiteboards for Visual Qualitative AnalysisMain1 citations
- Extracting Financial Events from Raw Texts via Matrix ChunkingMain1 citations
- Fast Adaptation via Prompted Data: An Efficient Cross-Domain Fine-tuning Method for Large Language ModelsMain1 citations
- Few-Shot Multimodal Named Entity Recognition Based on Mutlimodal Causal Intervention GraphMain1 citations
- Few-shot Link Prediction on Hyper-relational FactsMain1 citations
- Few-shot Temporal Pruning Accelerates Diffusion Models for Text GenerationMain1 citations
- First Steps Towards the Integration of Resources on Historical Glossing Traditions in the History of Chinese: A Collection of Standardized Fǎnqiè Spellings from the GuǎngyùnMain1 citations
- From Linguistic Linked Data to Big DataMain1 citations
- From Text to Historical Ecological Knowledge: The Construction and Application of the Shan Jing Knowledge BaseMain1 citations
- Fusion-in-T5: Unifying Variant Signals for Simple and Effective Document Ranking with Attention FusionMain1 citations
COLING accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.