COLING 2025 Accepted Papers
The full list of 848 papers accepted at COLING 2025 (International Conference on Computational Linguistics). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Main: 757Industry: 69System Demonstrations: 22
- Investigating the Factual Knowledge Boundary of Large Language Models with Retrieval AugmentationMain122 citations
- Style Over Substance: Evaluation Biases for Large Language ModelsMain72 citations
- InstructMol: Multi-Modal Integration for Building a Versatile and Reliable Molecular Assistant in Drug DiscoveryMain71 citations
- Cultural Alignment in Large Language Models: An Explanatory Analysis Based on Hofstede’s Cultural DimensionsMain63 citations
- MAC-SQL: A Multi-Agent Collaborative Framework for Text-to-SQLMain63 citations
- Intention Analysis Makes LLMs A Good Jailbreak DefenderMain58 citations
- MCS-SQL: Leveraging Multiple Prompts and Multiple-Choice Selection For Text-to-SQL GenerationMain42 citations
- LAiW: A Chinese Legal Large Language Models BenchmarkMain37 citations
- Investigating Bias in LLM-Based Bias Detection: Disparities between LLMs and Human PerceptionMain36 citations
- Exploring Concept Depth: How Large Language Models Acquire Knowledge and Concept at Different Layers?Main35 citations
- ToolEyes: Fine-Grained Evaluation for Tool Learning Capabilities of Large Language Models in Real-world ScenariosMain33 citations
- Efficient Tool Use with Chain-of-Abstraction ReasoningMain31 citations
- Rethinking Kullback-Leibler Divergence in Knowledge Distillation for Large Language ModelsMain30 citations
- ProSparse: Introducing and Enhancing Intrinsic Activation Sparsity within Large Language ModelsMain29 citations
- Scaffolding Coordinates to Promote Vision-Language Coordination in Large Multi-Modal ModelsMain29 citations
- sDPO: Don’t Use Your Data All at OnceIndustry27 citations
- What Makes for Good Visual Instructions? Synthesizing Complex Visual Reasoning Instructions for Visual Instruction TuningMain24 citations
- AI Hospital: Benchmarking Large Language Models in a Multi-agent Medical Interaction SimulatorMain23 citations
- Beyond Chain-of-Thought: A Survey of Chain-of-X Paradigms for LLMsMain22 citations
- ChatCite: LLM Agent with Human Workflow Guidance for Comparative Literature SummaryMain22 citations
- LoRA-drop: Efficient LoRA Parameter Pruning based on Output EvaluationMain20 citations
- ChartGemma: Visual Instruction-tuning for Chart Reasoning in the WildIndustry19 citations
- LLM-Personalize: Aligning LLM Planners with Human Preferences via Reinforced Self-Training for Housekeeping RobotsMain18 citations
- Persona-DB: Efficient Large Language Model Personalization for Response Prediction with Collaborative Data RefinementMain17 citations
- RichRAG: Crafting Rich Responses for Multi-faceted Queries in Retrieval-Augmented GenerationMain17 citations
- Benchmark Self-Evolving: A Multi-Agent Framework for Dynamic LLM EvaluationMain16 citations
- Less is More: A Simple yet Effective Token Reduction Method for Efficient Multi-modal LLMsMain15 citations
- Compress to Impress: Unleashing the Potential of Compressive Memory in Real-World Long-Term ConversationsMain14 citations
- Aligning LLMs with Individual Preferences via InteractionMain13 citations
- Does RAG Introduce Unfairness in LLMs? Evaluating Fairness in Retrieval-Augmented Generation SystemsMain13 citations
- Query-LIFE: Query-aware Language Image Fusion Embedding for E-Commerce RelevanceIndustry13 citations
- CMMaTH: A Chinese Multi-modal Math Skill Evaluation Benchmark for Foundation ModelsMain12 citations
- Let LLMs Take on the Latest Challenges! A Chinese Dynamic Question Answering BenchmarkMain12 citations
- MLaKE: Multilingual Knowledge Editing Benchmark for Large Language ModelsMain12 citations
- Mix-of-Granularity: Optimize the Chunking Granularity for Retrieval-Augmented GenerationMain12 citations
- PERSONA: A Reproducible Testbed for Pluralistic AlignmentMain12 citations
- Automated Clinical Data Extraction with Knowledge Conditioned LLMsIndustry11 citations
- CodeJudge-Eval: Can Large Language Models be Good Judges in Code Understanding?Main11 citations
- Exploring Backdoor Vulnerabilities of Chat ModelsMain11 citations
- FedMKT: Federated Mutual Knowledge Transfer for Large and Small Language ModelsMain11 citations
- LLMs Know What They Need: Leveraging a Missing Information Guided Framework to Empower Retrieval-Augmented GenerationMain11 citations
- SyntheT2C: Generating Synthetic Data for Fine-Tuning Large Language Models on the Text2Cypher TaskMain11 citations
- Why do language models perform worse for morphologically complex languages?Main11 citations
- ColBERT-XM: A Modular Multi-Vector Representation Model for Zero-Shot Multilingual Information RetrievalMain10 citations
- Counting-Stars: A Multi-evidence, Position-aware, and Scalable Benchmark for Evaluating Long-Context Large Language ModelsMain10 citations
- SKIntern: Internalizing Symbolic Knowledge for Distilling Better CoT Capabilities into Small Language ModelsMain10 citations
- Towards Consistent Natural-Language Explanations via Explanation-Consistency FinetuningMain10 citations
- A Review of Prominent Paradigms for LLM-Based Agents: Tool Use, Planning (Including RAG), and Feedback LearningMain9 citations
- Decoding Echo Chambers: LLM-Powered Simulations Revealing Polarization in Social NetworksMain9 citations
- Learning to Refuse: Towards Mitigating Privacy Risks in LLMsMain9 citations
- Look, Compare, Decide: Alleviating Hallucination in Large Vision-Language Models via Multi-View Multi-Path ReasoningMain9 citations
- Match, Compare, or Select? An Investigation of Large Language Models for Entity MatchingMain9 citations
- Taxonomy-Guided Zero-Shot Recommendations with LLMsMain9 citations
- medIKAL: Integrating Knowledge Graphs as Assistants of LLMs for Enhanced Clinical Diagnosis on EMRsMain9 citations
- Counterfactual Debating with Preset Stances for Hallucination Elimination of LLMsMain8 citations
- Edge-free but Structure-aware: Prototype-Guided Knowledge Distillation from GNNs to MLPsMain8 citations
- Efficient Solutions For An Intriguing Failure of LLMs: Long Context Window Does Not Mean LLMs Can Analyze Long Sequences FlawlesslyMain8 citations
- GraCoRe: Benchmarking Graph Comprehension and Complex Reasoning in Large Language ModelsMain8 citations
- HGCLIP: Exploring Vision-Language Models with Graph Representations for Hierarchical UnderstandingMain8 citations
- Making Large Language Models into World Models with Precondition and Effect KnowledgeMain8 citations
- AraDiCE: Benchmarks for Dialectal and Cultural Capabilities in LLMsMain7 citations
- Can Large Language Models perform Relation-based Argument Mining?Main7 citations
- Chain-of-Discussion: A Multi-Model Framework for Complex Evidence-Based Question AnsweringMain7 citations
- Do Large Language Models Mirror Cognitive Language Processing?Main7 citations
- Evaluating the Capabilities of Large Language Models for Multi-label Emotion UnderstandingMain7 citations
- Evaluating the Consistency of LLM EvaluatorsMain7 citations
- LLaMA-E: Empowering E-commerce Authoring with Object-Interleaved Instruction FollowingMain7 citations
- ManiTweet: A New Benchmark for Identifying Manipulation of News on Social MediaMain7 citations
- PreAct: Prediction Enhances Agent’s Planning AbilityMain7 citations
- Small Language Models can Outperform Humans in Short Creative Writing: A Study Comparing SLMs with Humans and LLMsMain7 citations
- Understanding the RoPE Extensions of Long-Context LLMs: An Attention PerspectiveMain7 citations
- What’s Wrong? Refining Meeting Summaries with LLM FeedbackMain7 citations
- AI-Press: A Multi-Agent News Generating and Feedback Simulation System Powered by Large Language ModelsSystem Demonstrations6 citations
- AsymKV: Enabling 1-Bit Quantization of KV Cache with Layer-Wise Asymmetric Quantization ConfigurationsMain6 citations
- Interaction Matters: An Evaluation Framework for Interactive Dialogue Assessment on English Second Language ConversationsMain6 citations
- Language Models Encode the Value of Numbers LinearlyMain6 citations
- LoRA Soups: Merging LoRAs for Practical Skill Composition TasksIndustry6 citations
- MBA-RAG: a Bandit Approach for Adaptive Retrieval-Augmented Generation through Question ComplexityMain6 citations
- Multilingual Knowledge Editing with Language-Agnostic Factual NeuronsMain6 citations
- Noise-powered Multi-modal Knowledge Graph Representation FrameworkMain6 citations
- QuickLLaMA: Query-aware Inference Acceleration for Large Language ModelsMain6 citations
- Alternate Preference Optimization for Unlearning Factual Knowledge in Large Language ModelsMain5 citations
- AraTrust: An Evaluation of Trustworthiness for LLMs in ArabicMain5 citations
- CONTRANS: Weak-to-Strong Alignment Engineering via Concept TransplantationMain5 citations
- Con-ReCall: Detecting Pre-training Data in LLMs via Contrastive DecodingMain5 citations
- Entropy Guided Extrapolative Decoding to Improve Factuality in Large Language ModelsMain5 citations
- Evolver: Chain-of-Evolution Prompting to Boost Large Multimodal Models for Hateful Meme DetectionMain5 citations
- Factual Dialogue Summarization via Learning from Large Language ModelsMain5 citations
- From Facts to Insights: A Study on the Generation and Evaluation of Analytical Reports for Deciphering Earnings CallsMain5 citations
- Get Confused Cautiously: Textual Sequence Memorization Erasure with Selective Entropy MaximizationMain5 citations
- How Likely Do LLMs with CoT Mimic Human Reasoning?Main5 citations
- How Well Can a Long Sequence Model Model Long Sequences? Comparing Architectural Inductive Biases on Long-Context AbilitiesMain5 citations
- Idea23D: Collaborative LMM Agents Enable 3D Model Generation from Interleaved Multimodal InputsMain5 citations
- InternLM-Law: An Open-Sourced Chinese Legal Large Language ModelMain5 citations
- JMedBench: A Benchmark for Evaluating Japanese Biomedical Large Language ModelsMain5 citations
- Let’s Focus on Neuron: Neuron-Level Supervised Fine-tuning for Large Language ModelMain5 citations
- Physics Reasoner: Knowledge-Augmented Reasoning for Solving Physics Problems with Large Language ModelsMain5 citations
- Revisiting Jailbreaking for Large Language Models: A Representation Engineering PerspectiveMain5 citations
- The Dark Side of Function Calling: Pathways to Jailbreaking Large Language ModelsMain5 citations
- Towards Data Contamination Detection for Modern Large Language Models: Limitations, Inconsistencies, and Oracle ChallengesMain5 citations
- Towards Understanding Multi-Task Learning (Generalization) of LLMs via Detecting and Exploring Task-Specific NeuronsMain5 citations
- Unveiling Language Competence Neurons: A Psycholinguistic Approach to Model InterpretabilityMain5 citations
- VisualRWKV: Exploring Recurrent Neural Networks for Visual Language ModelsMain5 citations
- Who Wrote This? The Key to Zero-Shot LLM-Generated Text Detection Is GECScoreMain5 citations
- AgriCLIP: Adapting CLIP for Agriculture and Livestock via Domain-Specialized Cross-Model AlignmentMain4 citations
- Automated Progressive Red TeamingMain4 citations
- Beyond Boundaries: Learning a Universal Entity Taxonomy across Datasets and Languages for Open Named Entity RecognitionMain4 citations
- Converging to a Lingua Franca: Evolution of Linguistic Regions and Semantics Alignment in Multilingual Large Language ModelsMain4 citations
- Decoding Decoded: Understanding Hyperparameter Effects in Open-Ended Text GenerationMain4 citations
- Detecting Conversational Mental Manipulation with Intent-Aware PromptingMain4 citations
- DnA-Eval: Enhancing Large Language Model Evaluation through Decomposition and AggregationMain4 citations
- Do LLMs Know When to NOT Answer? Investigating Abstention Abilities of Large Language ModelsMain4 citations
- EffiQA: Efficient Question-Answering with Strategic Multi-Model Collaboration on Knowledge GraphsMain4 citations
- Enhancing Retrieval-Augmented Generation: A Study of Best PracticesMain4 citations
- Grading Massive Open Online Courses Using Large Language ModelsMain4 citations
- LAW: Legal Agentic Workflows for Custody and Fund Services ContractsIndustry4 citations
- LLMs May Perform MCQA by Selecting the Least Incorrect OptionMain4 citations
- Linear Recency Bias During Training Improves Transformers’ Fit to Reading TimesMain4 citations
- Linguistic Minimal Pairs Elicit Linguistic Similarity in Large Language ModelsMain4 citations
- MuRAR: A Simple and Effective Multimodal Retrieval and Answer Refinement Framework for Multimodal Question AnsweringSystem Demonstrations4 citations
- Multimodal Fact-Checking with Vision Language Models: A Probing Classifier based Solution with Embedding StrategiesMain4 citations
- PropaInsight: Toward Deeper Understanding of Propaganda in Terms of Techniques, Appeals, and IntentMain4 citations
- Propulsion: Steering LLM with Tiny Fine-TuningMain4 citations
- RISCORE: Enhancing In-Context Riddle Solving in Language Models through Context-Reconstructed Example AugmentationMain4 citations
- SEED: Accelerating Reasoning Tree Construction via Scheduled Speculative DecodingMain4 citations
- Small Language Models Also Work With Small Vocabularies: Probing the Linguistic Abilities of Grapheme- and Phoneme-Based Baby LlamasMain4 citations
- SweetieChat: A Strategy-Enhanced Role-playing Framework for Diverse Scenarios Handling Emotional Support AgentMain4 citations
- Towards Boosting LLMs-driven Relevance Modeling with Progressive Retrieved Behavior-augmented PromptingIndustry4 citations
- Unifying Dual-Space Embedding for Entity Alignment via Contrastive LearningMain4 citations
- WER We Stand: Benchmarking Urdu ASR ModelsMain4 citations
- A Compressive Memory-based Retrieval Approach for Event Argument ExtractionMain3 citations
- ALIS: Aligned LLM Instruction Security Strategy for Unsafe Input PromptMain3 citations
- ALYMPICS: LLM Agents Meet Game TheoryMain3 citations
- AdaCQR: Enhancing Query Reformulation for Conversational Search via Sparse and Dense Retrieval AlignmentMain3 citations
- Assessing the Human Likeness of AI-Generated CounterspeechMain3 citations
- Awakening Augmented Generation: Learning to Awaken Internal Knowledge of Large Language Models for Question AnsweringMain3 citations
- BANER: Boundary-Aware LLMs for Few-Shot Named Entity RecognitionMain3 citations
- BackMATH: Towards Backward Reasoning for Solving Math Problems Step by StepIndustry3 citations
- BiLD: Bi-directional Logits Difference Loss for Large Language Model DistillationMain3 citations
- Boosting the Capabilities of Compact Models in Low-Data Contexts with Large Language Models and Retrieval-Augmented GenerationMain3 citations
- Breaking the Stage Barrier: A Novel Single-Stage Approach to Long Context Extension for Large Language ModelsMain3 citations
- CFSP: An Efficient Structured Pruning Framework for LLMs with Coarse-to-Fine Activation InformationMain3 citations
- Can Many-Shot In-Context Learning Help LLMs as Evaluators? A Preliminary Empirical StudyMain3 citations
- Charting the Future: Using Chart Question-Answering for Scalable Evaluation of LLM-Driven Data VisualizationsMain3 citations
- Collaborative Document Simplification Using Multi-Agent SystemsMain3 citations
- Cross-lingual Evaluation of Multilingual Text GenerationMain3 citations
- Debate-to-Write: A Persona-Driven Multi-Agent Framework for Diverse Argument GenerationMain3 citations
- Distance-Adaptive Quaternion Knowledge Graph Embedding with Bidirectional RotationMain3 citations
- Dynamic Graph Neural ODE Network for Multi-modal Emotion Recognition in ConversationMain3 citations
- Explaining Relationships Among Research PapersMain3 citations
- Exploiting the Index Gradients for Optimization-Based Jailbreaking on Large Language ModelsMain3 citations
- FS-DAG: Few Shot Domain Adapting Graph Networks for Visually Rich Document UnderstandingIndustry3 citations
- Federated Retrieval Augmented Generation for Multi-Product Question AnsweringIndustry3 citations
- Filter-then-Generate: Large Language Models with Structure-Text Adapter for Knowledge Graph CompletionMain3 citations
- Fine-tuning Large Language Models for Improving Factuality in Legal Question AnsweringMain3 citations
- FineRAG: Fine-grained Retrieval-Augmented Text-to-Image GenerationMain3 citations
- From Generalist to Specialist: A Survey of Large Language Models for ChemistryMain3 citations
- From Prejudice to Parity: A New Approach to Debiasing Large Language Model Word EmbeddingsMain3 citations
- GraphOTTER: Evolving LLM-based Graph Reasoning for Complex Table Question AnsweringMain3 citations
- How Transliterations Improve Crosslingual AlignmentMain3 citations
- Interactive Evaluation for Medical LLMs via Task-oriented Dialogue SystemMain3 citations
- Is Parameter Collision Hindering Continual Learning in LLMs?Main3 citations
- KG-FPQ: Evaluating Factuality Hallucination in LLMs with Knowledge Graph-based False Premise QuestionsMain3 citations
- KIA: Knowledge-Guided Implicit Vision-Language Alignment for Chest X-Ray Report GenerationMain3 citations
- Large Language Models are good multi-lingual learners : When LLMs meet cross-lingual promptsMain3 citations
- Leveraging Taxonomy and LLMs for Improved Multimodal Hierarchical ClassificationMain3 citations
- Lightweight Safety Guardrails Using Fine-tuned BERT EmbeddingsIndustry3 citations
- Luna: A Lightweight Evaluation Model to Catch Language Model Hallucinations with High Accuracy and Low CostIndustry3 citations
- META-LORA: Memory-Efficient Sample Reweighting for Fine-Tuning Large Language ModelsMain3 citations
- MOPO: Multi-Objective Prompt Optimization for Affective Text GenerationMain3 citations
- MQA-KEAL: Multi-hop Question Answering under Knowledge Editing for Arabic LanguageMain3 citations
- MURRE: Multi-Hop Table Retrieval with Removal for Open-Domain Text-to-SQLMain3 citations
- Multilingual and Explainable Text Detoxification with Parallel CorporaMain3 citations
- No Train but Gain: Language Arithmetic for training-free Language Adapters enhancementMain3 citations
- PMSS: Pretrained Matrices Skeleton Selection for LLM Fine-tuningMain3 citations
- Personalized Large Language Model Assistant with Evolving Conditional MemoryMain3 citations
- RAIDEN Benchmark: Evaluating Role-playing Conversational Agents with Measurement-Driven Custom DialoguesMain3 citations
- Revisiting Cosine Similarity via Normalized ICA-transformed EmbeddingsMain3 citations
- RoleBreak: Character Hallucination as a Jailbreak Attack in Role-Playing SystemsMain3 citations
- Scalability of Bayesian Network Structure Elicitation with Large Language Models: a Novel Methodology and Comparative AnalysisMain3 citations
- SelfPrompt: Autonomously Evaluating LLM Robustness via Domain-Constrained Knowledge Guidelines and Refined Adversarial PromptsMain3 citations
- StoryLLaVA: Enhancing Visual Storytelling with Multi-Modal Large Language ModelsMain3 citations
- TOOL-ED: Enhancing Empathetic Response Generation with the Tool Calling Capability of LLMMain3 citations
- Too Late to Train, Too Early To Use? A Study on Necessity and Viability of Low-Resource Bengali LLMsMain3 citations
- TransMI: A Framework to Create Strong Baselines from Multilingual Pretrained Language Models for Transliterated DataMain3 citations
- Zero-to-Strong Generalization: Eliciting Strong Capabilities of Large Language Models Iteratively without Gold LabelsMain3 citations
- “Not Aligned” is Not “Malicious”: Being Careful about Hallucinations of Large Language Models’ JailbreakMain3 citations
- A Novel Negative Sample Generation Method for Contrastive Learning in Hierarchical Text ClassificationMain2 citations
- AIGT: AI Generative Table Based on PromptMain2 citations
- Acquired TASTE: Multimodal Stance Detection with Textual and Structural EmbeddingsMain2 citations
- An Automatic Method to Estimate Correctness of RAGIndustry2 citations
- Aurora-M: Open Source Continual Pre-training for Multilingual Language and CodeIndustry2 citations
- Automatic Multiple-Choice Question Generation and Evaluation Systems Based on LLM: A Study Case With University ResolutionsMain2 citations
- BeefBot: Harnessing Advanced LLM and RAG Techniques for Providing Scientific and Technology Solutions to Beef ProducersSystem Demonstrations2 citations
- Beyond Surprisal: A Dual Metric Framework for Lexical Skill Acquisition in LLMsMain2 citations
- Bias Vector: Mitigating Biases in Language Models with Task Arithmetic ApproachMain2 citations
- CULTURALLY YOURS: A Reading Assistant for Cross-Cultural ContentSystem Demonstrations2 citations
- Can Large Language Models Serve as Effective Classifiers for Hierarchical Multi-Label Classification of Scientific Documents at Industrial Scale?Industry2 citations
- Can Large Language Models Understand You Better? An MBTI Personality Detection Dataset Aligned with Population TraitsMain2 citations
- Case2Code: Scalable Synthetic Data for Code GenerationMain2 citations
- CmEAA: Cross-modal Enhancement and Alignment Adapter for Radiology Report GenerationMain2 citations
- CoMIF: Modeling of Complex Multiple Interaction Factors for Conversation GenerationMain2 citations
- Cognitive Biases, Task Complexity, and Result Intepretability in Large Language ModelsMain2 citations
- Controlling Out-of-Domain Gaps in LLMs for Genre Classification and Generated Text DetectionMain2 citations
- Cross-Dialect Information Retrieval: Information Access in Low-Resource and High-Variance LanguagesMain2 citations
- Decompose-ToM: Enhancing Theory of Mind Reasoning in Large Language Models through Simulation and Task DecompositionMain2 citations
- Development of Numerical Error Detection Tasks to Analyze the Numerical Capabilities of Language ModelsMain2 citations
- DiffStyleTTS: Diffusion-based Hierarchical Prosody Modeling for Text-to-Speech with Diverse and Controllable StylesMain2 citations
- Do LLMs Play Dice? Exploring Probability Distribution Sampling in Large Language Models for Behavioral SimulationMain2 citations
- DynRank: Improve Passage Retrieval with Dynamic Zero-Shot Prompting Based on Question ClassificationMain2 citations
- ELITR-Bench: A Meeting Assistant Benchmark for Long-Context Language ModelsMain2 citations
- Egalitarian Language Representation in Language Models: It All Begins with TokenizersMain2 citations
- Enhancing Knowledge Distillation of Large Language Models through Efficient Multi-Modal Distribution AlignmentMain2 citations
- Enhancing Large Language Models for Scientific Multimodal Summarization with Multimodal OutputIndustry2 citations
- Enhancing Long-range Dependency with State Space Model and Kolmogorov-Arnold Networks for Aspect-based Sentiment AnalysisMain2 citations
- Enhancing Nursing and Elderly Care with Large Language Models: An AI-Driven FrameworkMain2 citations
- Enhancing Reranking for Recommendation with LLMs through User Preference RetrievalMain2 citations
- Enhancing Talk Moves Analysis in Mathematics Tutoring through Classroom Teaching DiscourseMain2 citations
- Enhancing the Reasoning Capabilities of Small Language Models via Solution Guidance Fine-TuningMain2 citations
- Exploring Language Model Generalization in Low-Resource Extractive QAMain2 citations
- Exploring the Limitations of Detecting Machine-Generated TextMain2 citations
- FIPO: Free-form Instruction-oriented Prompt Optimization with Preference Dataset and Modular Fine-tuning SchemaMain2 citations
- FinDABench: Benchmarking Financial Data Analysis Ability of Large Language ModelsMain2 citations
- From Chaotic OCR Words to Coherent Document: A Fine-to-Coarse Zoom-Out Network for Complex-Layout Document Image TranslationMain2 citations
- From Superficial to Deep: Integrating External Knowledge for Follow-up Question Generation Using Knowledge Graph and LLMMain2 citations
- From Traits to Empathy: Personality-Aware Multimodal Empathetic Response GenerationMain2 citations
- GAProtoNet: A Multi-head Graph Attention-based Prototypical Network for Interpretable Text ClassificationMain2 citations
- Gracefully Filtering Backdoor Samples for Generative Large Language Models without RetrainingMain2 citations
- GroUSE: A Benchmark to Evaluate Evaluators in Grounded Question AnsweringMain2 citations
- Hire Me or Not? Examining Language Model’s Behavior with Occupation AttributesMain2 citations
- Hit the Sweet Spot! Span-Level Ensemble for Large Language ModelsMain2 citations
- IberoBench: A Benchmark for LLM Evaluation in Iberian LanguagesMain2 citations
- Implicit Discourse Relation Classification For Nigerian PidginMain2 citations
- Imposter: Text and Frequency Guidance for Subject Driven Action Personalization using Diffusion ModelsMain2 citations
- Improving Automatic Grammatical Error Annotation for Chinese Through Linguistically-Informed Error TypologyMain2 citations
- Improving Multilingual Sign Language Translation with Automatically Clustered Language Family InformationMain2 citations
- Know Your RAG: Dataset Taxonomy and Generation Strategies for Evaluating RAG SystemsIndustry2 citations
- LLM-Friendly Knowledge Representation for Customer SupportIndustry2 citations
- LLMTreeRec: Unleashing the Power of Large Language Models for Cold-Start RecommendationsMain2 citations
- LOLA – An Open-Source Massively Multilingual Large Language ModelMain2 citations
- Large Language Models as an Indirect Reasoner: Contrapositive and Contradiction for Automated ReasoningMain2 citations
- Learning to Reason via Self-Iterative Process Feedback for Small Language ModelsMain2 citations
- Lexicography Saves Lives (LSL): Automatically Translating Suicide-Related LanguageMain2 citations
- Loki: An Open-Source Tool for Fact VerificationSystem Demonstrations2 citations
- LuxEmbedder: A Cross-Lingual Approach to Enhanced Luxembourgish Sentence EmbeddingsMain2 citations
- MIDLM: Multi-Intent Detection with Bidirectional Large Language ModelsMain2 citations
- Mitigating Language Confusion through Inference-time InterventionMain2 citations
- Mitigating Out-of-Entity Errors in Named Entity Recognition: A Sentence-Level StrategyMain2 citations
- MoSLD: An Extremely Parameter-Efficient Mixture-of-Shared LoRAs for Multi-Task LearningMain2 citations
- ModaFact: Multi-paradigm Evaluation for Joint Event Modality and Factuality DetectionMain2 citations
- Modal Feature Optimization Network with Prompt for Multimodal Sentiment AnalysisMain2 citations
- Montague semantics and modifier consistency measurement in neural language modelsMain2 citations
- Multimodal Aspect-Based Sentiment Analysis under Conditional RelationMain2 citations
- Multitask-Bench: Unveiling and Mitigating Safety Gaps in LLMs Fine-tuningMain2 citations
- NesTools: A Dataset for Evaluating Nested Tool Learning Abilities of Large Language ModelsMain2 citations
- NüshuRescue: Reviving the Endangered Nüshu Language with AIMain2 citations
- On Evaluation Protocols for Data Augmentation in a Limited Data ScenarioMain2 citations
- On the Effects of Fine-tuning Language Models for Text-Based Reinforcement LearningMain2 citations
- PARAPHRASUS: A Comprehensive Benchmark for Evaluating Paraphrase Detection ModelsMain2 citations
- Parameter-Efficient Fine-Tuning of Large Language Models via Deconvolution in SubspaceMain2 citations
- Persona-Consistent Dialogue Generation via Pseudo Preference TuningMain2 citations
- Piecing It All Together: Verifying Multi-Hop Multimodal ClaimsMain2 citations
- Prompting Large Language Models to Tackle the Full Software Development Lifecycle: A Case StudyMain2 citations
- RE-FIN: Retrieval-based Enrichment for Financial dataIndustry2 citations
- REVerSum: A Multi-staged Retrieval-Augmented Generation Method to Enhance Wikipedia Tail Biographies through Personal NarrativesIndustry2 citations
- Read Before Grounding: Scene Knowledge Visual Grounding via Multi-step ParsingMain2 citations
- RealSafe: Quantifying Safety Risks of Language Agents in Real-WorldMain2 citations
- Rethinking the Alignment of Psychotherapy Dialogue Generation with Motivational Interviewing StrategiesMain2 citations
- Retrieval Augmented Instruction Tuning for Open NER with Large Language ModelsMain2 citations
- SAGED: A Holistic Bias-Benchmarking Pipeline for Language Models with Customisable Fairness CalibrationMain2 citations
- SUMIE: A Synthetic Benchmark for Incremental Entity SummarizationMain2 citations
- Solid-SQL: Enhanced Schema-linking based In-context Learning for Robust Text-to-SQLMain2 citations
- T-MES: Trait-Aware Mix-of-Experts Representation Learning for Multi-trait Essay ScoringMain2 citations
- TEXT-CAKE: Challenging Language Models on Local Text CoherenceMain2 citations
- To Label or Not to Label: Hybrid Active Learning for Neural Machine TranslationMain2 citations
- Towards Real-World Rumor Detection: Anomaly Detection Framework with Graph Supervised Contrastive LearningMain2 citations
- Understanding Token Probability Encoding in Output EmbeddingsMain2 citations
- Unveiling Uncertainty: A Deep Dive into Calibration and Performance of Multimodal Large Language ModelsMain2 citations
- VeritasQA: A Truthfulness Benchmark Aimed at Multilingual TransferabilityMain2 citations
- WIKIGENBENCH:Exploring Full-length Wikipedia Generation under Real-World ScenarioMain2 citations
- Why Does ChatGPT “Delve” So Much? Exploring the Sources of Lexical Overrepresentation in Large Language ModelsMain2 citations
- A Context-Aware Approach for Enhancing Data Imputation with Pre-trained Language ModelsMain1 citations
- A Dual Contrastive Learning Framework for Enhanced Multimodal Conversational Emotion RecognitionMain1 citations
- A Flash in the Pan: Better Prompting Strategies to Deploy Out-of-the-Box LLMs as Conversational Recommendation SystemsMain1 citations
- A Framework for Effective Invocation Methods of Various LLM ServicesMain1 citations
- A Survey of Code-switched Arabic NLP: Progress, Challenges, and Future DirectionsMain1 citations
- A Survey of Generative Information ExtractionMain1 citations
- ADAPTIVE IE: Investigating the Complementarity of Human-AI Collaboration to Adaptively Extract Information on-the-flyMain1 citations
- AIDER: a Robust and Topic-Independent Framework for Detecting AI-Generated TextMain1 citations
- Aligning Large Language Models with Human Opinions through Persona Selection and Value–Belief–Norm ReasoningMain1 citations
- Aligning Retrieval with Reader Needs: Reader-Centered Passage Selection for Open-Domain Question AnsweringMain1 citations
- An Active Learning Framework for Inclusive Generation by Large Language ModelsMain1 citations
- An Efficient Retrieval-Based Method for Tabular Prediction with LLMMain1 citations
- An LLM-based Framework for Biomedical Terminology Normalization in Social Media via Multi-Agent CollaborationMain1 citations
- Analysing Zero-Shot Readability-Controlled Sentence SimplificationMain1 citations
- Analyzing the Attention Heads for Pronoun Disambiguation in Context-aware Machine Translation ModelsMain1 citations
- AutoProteinEngine: A Large Language Model Driven Agent Framework for Multimodal AutoML in Protein EngineeringIndustry1 citations
- Automatic Extraction of Metaphoric Analogies from Literary Texts: Task Formulation, Dataset Construction, and EvaluationMain1 citations
- BERT-based Classical Arabic Poetry Authorship AttributionMain1 citations
- Beyond Film Subtitles: Is YouTube the Best Approximation of Spoken Vocabulary?Main1 citations
- Biases in Large Language Model-Elicited Text: A Case Study in Natural Language InferenceMain1 citations
- Bilingual Evaluation of Language Models on General Knowledge in University Entrance Exams with Minimal ContaminationMain1 citations
- Building a Family of Data Augmentation Models for Low-cost LLM Fine-tuning on the CloudIndustry1 citations
- CAST: Cross-modal Alignment Similarity Test for Vision Language ModelsMain1 citations
- Can LLMs Help Create Grammar?: Automating Grammar Creation for Endangered Languages with In-Context LearningMain1 citations
- Can Large Language Models Differentiate Harmful from Argumentative Essays? Steps Toward Ethical Essay ScoringMain1 citations
- Can Model Uncertainty Function as a Proxy for Multiple-Choice Question Item Difficulty?Main1 citations
- Can We Afford The Perfect Prompt? Balancing Cost and Accuracy with the Economical Prompting IndexMain1 citations
- CarMem: Enhancing Long-Term Memory in LLM Voice Assistants through Category-BoundingIndustry1 citations
- CausalScore: An Automatic Reference-Free Metric for Assessing Response Relevance in Open-Domain Dialogue SystemsMain1 citations
- Chain-of-Specificity: Enhancing Task-Specific Constraint Adherence in Large Language ModelsMain1 citations
- Citation Amnesia: On The Recency Bias of NLP and Other Academic FieldsMain1 citations
- CoPrUS: Consistency Preserving Utterance Synthesis towards more realistic benchmark dialoguesMain1 citations
- CoSTA: Code-Switched Speech Translation using Aligned Speech-Text InterleavingMain1 citations
- Comparative Study of Multilingual Idioms and Similes in Large Language ModelsMain1 citations
- Confront Insider Threat: Precise Anomaly Detection in Behavior Logs Based on LLM Fine-TuningMain1 citations
- Context-Informed Machine Translation of Manga using Multimodal Large Language ModelsMain1 citations
- Continual Learning Using Only Large Language Model PromptingMain1 citations
- Cross-Refine: Improving Natural Language Explanation Generation by Learning in TandemMain1 citations
- DEGAP: Dual Event-Guided Adaptive Prefixes for Templated-Based Event Argument Extraction with Slot QueryingMain1 citations
- Data Augmentation for Cross-domain Parsing via Lightweight LLM Generation and Tree HybridizationMain1 citations
- Data Quality Enhancement on the Basis of Diversity with Large Language Models for Text Classification: Uncovered, Difficult, and NoisyMain1 citations
- DeTriever: Decoder-representation-based Retriever for Improving NL2SQL In-Context LearningMain1 citations
- DefVerify: Do Hate Speech Models Reflect Their Dataset’s Definition?Main1 citations
- Detecting Emotional Incongruity of Sarcasm by Commonsense ReasoningMain1 citations
- Dialectal and Low Resource Machine Translation for AromanianMain1 citations
- Discarding the Crutches: Adaptive Parameter-Efficient Expert Meta-Learning for Continual Semantic ParsingMain1 citations
- Distilling Rule-based Knowledge into Large Language ModelsMain1 citations
- Do Current Video LLMs Have Strong OCR Abilities? A Preliminary StudyMain1 citations
- Dr.ECI: Infusing Large Language Models with Causal Knowledge for Decomposed Reasoning in Event Causality IdentificationMain1 citations
- Dynamic-prototype Contrastive Fine-tuning for Continual Few-shot Relation Extraction with Unseen Relation DetectionMain1 citations
- E-Bench: Towards Evaluating the Ease-of-Use of Large Language ModelsMain1 citations
- Efficient Data Labeling by Hierarchical Crowdsourcing with Large Language ModelsMain1 citations
- Embedding-Informed Adaptive Retrieval-Augmented Generation of Large Language ModelsMain1 citations
- Engagement-driven Persona Prompting for Rewriting News TweetsMain1 citations
- Enhancing Arabic NLP Tasks through Character-Level Models and Data AugmentationMain1 citations
- Enhancing Discourse Parsing for Local Structures from Social Media with LLM-Generated DataMain1 citations
- Enhancing Factual Consistency in Text Summarization via Counterfactual DebiasingMain1 citations
- Enhancing Multi-party Dialogue Discourse Parsing with Explanation GenerationMain1 citations
- Enhancing multi-modal Relation Extraction with Reinforcement Learning Guided Graph Diffusion FrameworkMain1 citations
- Evaluating LLMs’ Capability to Identify Lexical Semantic Equivalence: Probing with the Word-in-Context TaskMain1 citations
- Evaluating Pixel Language Models on Non-Standardized LanguagesMain1 citations
- Evaluating Transformers for OCR Post-Correction in Early Modern Dutch TheatreMain1 citations
- EvoPrompt: Evolving Prompts for Enhanced Zero-Shot Named Entity Recognition with Large Language ModelsMain1 citations
- Explain-Analyze-Generate: A Sequential Multi-Agent Collaboration Method for Complex ReasoningMain1 citations
- Explanation Regularisation through the Lens of AttributionsMain1 citations
- Exploring the Impact of Language Switching on Personality Traits in LLMsMain1 citations
- Extracting the Essence and Discarding the Dross: Enhancing Code Generation with Contrastive Execution FeedbackMain1 citations
- Extrapolating to Unknown Opinions Using LLMsMain1 citations
- FarExStance: Explainable Stance Detection for FarsiMain1 citations
- Few-shot domain adaptation for named-entity recognition via joint constrained k-means and subspace selectionMain1 citations
- Fine-Grained Features-based Code Search for Precise Query-Code MatchingMain1 citations
- From Priest to Doctor: Domain Adaptation for Low-Resource Neural Machine TranslationMain1 citations
- GLoCIM: Global-view Long Chain Interest Modeling for news recommendationMain1 citations
- Generating Commonsense Reasoning Questions with Controllable Complexity through Multi-step Structural CompositionMain1 citations
- Gradient Inversion Attack in Federated Learning: Exposing Text Data through Discrete OptimizationMain1 citations
- Graph Representation Learning in Hyperbolic Space via Dual-MaskedMain1 citations
- How Well Can Large Language Models Reflect? A Human Evaluation of LLM-generated Reflections for Motivational Interviewing DialoguesMain1 citations
- How to Leverage Digit Embeddings to Represent Numbers?Main1 citations
- Human-Like Embodied AI Interviewer: Employing Android ERICA in Real International ConferenceSystem Demonstrations1 citations
- ICLEval: Evaluating In-Context Learning Ability of Large Language ModelsMain1 citations
- IRR: Image Review Ranking Framework for Evaluating Vision-Language ModelsMain1 citations
- Impromptu Cybercrime Euphemism DetectionMain1 citations
- Improved Sparse Upcycling for Instruction TuningMain1 citations
- Improvement in Sign Language Translation Using Text CTC AlignmentMain1 citations
- Improving Tool Retrieval by Leveraging Large Language Models for Query GenerationIndustry1 citations
- Inside-Outside Algorithm for Probabilistic Product-Free Lambek Categorial GrammarMain1 citations
- Integrating Visual Modalities with Large Language Models for Mental Health SupportMain1 citations
- Is Peer-Reviewing Worth the Effort?Main1 citations
- Is my Meeting Summary Good? Estimating Quality with a Multi-LLM EvaluatorIndustry1 citations
- It is not a piece of cake for GPT: Explaining Textual Entailment Recognition in the presence of Figurative LanguageMain1 citations
- Jump To Hyperspace: Comparing Euclidean and Hyperbolic Loss Functions for Hierarchical Multi-Label Text ClassificationMain1 citations
- KARRIEREWEGE: A large scale Career Path Prediction DatasetIndustry1 citations
- LLM Sensitivity Challenges in Abusive Language Detection: Instruction-Tuned vs. Human FeedbackMain1 citations
- LLMs on interactive feature collections with implicit dynamic decision strategyMain1 citations
- Language Adaptation of Large Language Models: An Empirical Study on LLaMA2Main1 citations
- Large Language Models are Good Annotators for Type-aware Data Augmentation in Grammatical Error CorrectionMain1 citations
- Large Language Models with Reinforcement Learning from Human Feedback Approach for Enhancing Explainable Sexism DetectionMain1 citations
- Learning to Verify Summary Facts with Fine-Grained LLM FeedbackMain1 citations
- Leveraging Explicit Reasoning for Inference Integration in Commonsense-Augmented Dialogue ModelsMain1 citations
- Leveraging LLM-Generated Schema Descriptions for Unanswerable Question Detection in Clinical DataMain1 citations
- Leveraging Language Models for Summarizing Mental State Examinations: A Comprehensive Evaluation and Dataset ReleaseMain1 citations
- Looks can be Deceptive: Distinguishing Repetition Disfluency from ReduplicationMain1 citations
- Low-Resource Fast Text Classification Based on Intra-Class and Inter-Class Distance CalculationMain1 citations
- Low-Resource Language Expansion and Translation Capacity Enhancement for LLM: A Study on the UyghurMain1 citations
- MIT-10M: A Large Scale Parallel Corpus of Multilingual Image TranslationMain1 citations
- MMD-ERE: Multi-Agent Multi-Sided Debate for Event Relation ExtractionMain1 citations
- MPID: A Modality-Preserving and Interaction-Driven Fusion Network for Multimodal Sentiment AnalysisMain1 citations
- MQM-APE: Toward High-Quality Error Annotation Predictors with Automatic Post-Editing in LLM Translation EvaluatorsMain1 citations
- MSG-LLM: A Multi-scale Interactive Framework for Graph-enhanced Large Language ModelsMain1 citations
- Making Task-Oriented Dialogue Datasets More Natural by Synthetically Generating Indirect User RequestsMain1 citations
- Measuring Contextual Informativeness in Child-Directed TextMain1 citations
- MiMoTable: A Multi-scale Spreadsheet Benchmark with Meta Operations for Table ReasoningMain1 citations
- MuKA: Multimodal Knowledge Augmented Visual Information-SeekingMain1 citations
- Multi-View Incongruity Learning for Multimodal Sarcasm DetectionMain1 citations
- Multilingual Continual Learning using Attention DistillationIndustry1 citations
- NYAYAANUMANA and INLEGALLLAMA: The Largest Indian Legal Judgment Prediction Dataset and Specialized Language Model for Enhanced Decision AnalysisMain1 citations
- NYT-Connections: A Deceptively Simple Text Classification Task that Stumps System-1 ThinkersMain1 citations
- No Size Fits All: The Perils and Pitfalls of Leveraging LLMs Vary with Company SizeIndustry1 citations
- Not Every Metric is Equal: Cognitive Models for Predicting N400 and P600 Components During Reading ComprehensionMain1 citations
- NovAScore: A New Automated Metric for Evaluating Document Level NoveltyMain1 citations
- OKG: On-the-Fly Keyword Generation in Sponsored Search AdvertisingIndustry1 citations
- Oddballness: universal anomaly detection with language modelsMain1 citations
- On Weaponization-Resistant Large Language Models with Prospect Theoretic AlignmentMain1 citations
- OpenFactCheck: Building, Benchmarking Customized Fact-Checking Systems and Evaluating the Factuality of Claims and LLMsMain1 citations
- OpenForecast: A Large-Scale Open-Ended Event Forecasting DatasetMain1 citations
- Optimizing Lifelong Fine-Tuning for Multiple Tasks via Dataless Distribution ReplayMain1 citations
- PADO: Personality-induced multi-Agents for Detecting OCEAN in human-generated textsMain1 citations
- PIRsuader: A Persuasive Chatbot for Mitigating Psychological Insulin Resistance in Type-2 Diabetic PatientsMain1 citations
- Part-Of-Speech Sensitivity of Routers in Mixture of Experts ModelsMain1 citations
- Planning with Multi-Constraints via Collaborative Language AgentsMain1 citations
- Position Information Emerges in Causal Transformers Without Positional Encodings via Similarity of Nearby EmbeddingsMain1 citations
- Positive Text Reframing under Multi-strategy OptimizationMain1 citations
- Post-Hoc Watermarking for Robust Detection in Text Generated by Large Language ModelsMain1 citations
- ProTOD: Proactive Task-oriented Dialogue System Based on Large Language ModelMain1 citations
- RUIE: Retrieval-based Unified Information Extraction using Large Language ModelMain1 citations
- Rationale-Guided Distillation for E-Commerce Relevance Classification: Bridging Large Language Models and Lightweight Cross-EncodersIndustry1 citations
- ReLayout: Towards Real-World Document Understanding via Layout-enhanced Pre-trainingMain1 citations
- Reasoning Graph Enhanced Exemplars Retrieval for In-Context LearningMain1 citations
- Refined Evaluation for End-to-End Grammatical Error Correction Using an Alignment-Based ApproachMain1 citations
- Rethinking Long Context Generation from the Continual Learning PerspectiveMain1 citations
- Retrieval-Augmented Generation for Large Language Model based Few-shot Chinese Spell CheckingMain1 citations
- Return of EM: Entity-driven Answer Set Expansion for QA EvaluationMain1 citations
- RoLargeSum: A Large Dialect-Aware Romanian News Dataset for Summary, Headline, and Keyword GenerationMain1 citations
- SCV: Light and Effective Multi-Vector Retrieval with Sequence Compressive VectorsIndustry1 citations
- STAND-Guard: A Small Task-Adaptive Content Moderation ModelIndustry1 citations
- Searching for Structure: Investigating Emergent Communication with Large Language ModelsMain1 citations
- Semantic Reshuffling with LLM and Heterogeneous Graph Auto-Encoder for Enhanced Rumor DetectionMain1 citations
- Sequential Fusion of Text-close and Text-far Representations for Multimodal Sentiment AnalysisMain1 citations
- Slender-Mamba: Fully Quantized Mamba in 1.58 Bits From Head to ToeMain1 citations
- Streamlining Biomedical Research with Specialized LLMsSystem Demonstrations1 citations
- SubRegWeigh: Effective and Efficient Annotation Weighing with Subword RegularizationMain1 citations
- Summarization of Opinionated Political Documents with Varied PerspectivesMain1 citations
- SynDARin: Synthesising Datasets for Automated Reasoning in Low-Resource LanguagesMain1 citations
- Synthetic Paths to Integral Truth: Mitigating Hallucinations Caused by Confirmation Bias with Synthetic DataMain1 citations
- TMATH A Dataset for Evaluating Large Language Models in Generating Educational Hints for Math Word ProblemsMain1 citations
- TermDiffuSum: A Term-guided Diffusion Model for Extractive Summarization of Legal DocumentsMain1 citations
- The Role of Natural Language Processing Tasks in Automatic Literary Character Network ConstructionMain1 citations
- Topology-of-Question-Decomposition: Enhancing Large Language Models with Information Retrieval for Knowledge-Intensive TasksMain1 citations
- Towards Faithful Multi-step Reasoning through Fine-Grained Causal-aware Attribution Reasoning DistillationMain1 citations
- Towards the Machine Translation of Scientific NeologismsMain1 citations
- URIEL+: Enhancing Linguistic Inclusion and Usability in a Typological and Multilingual Knowledge BaseMain1 citations
- Unlike “Likely”, “Unlike” is Unlikely: BPE-based Segmentation hurts Morphological Derivations in LLMsMain1 citations
- Unveiling Entity-Level Unlearning for Large Language Models: A Comprehensive AnalysisMain1 citations
- Unveiling Fake News with Adversarial Arguments Generated by Multimodal Large Language ModelsMain1 citations
- Unveiling Performance Challenges of Large Language Models in Low-Resource Healthcare: A Demographic Fairness PerspectiveMain1 citations
- Using Game Play to Investigate Multimodal and Conversational Grounding in Large Multimodal ModelsMain1 citations
- VLR-Bench: Multilingual Benchmark Dataset for Vision-Language Retrieval Augmented GenerationMain1 citations
- ViSoLex: An Open-Source Repository for Vietnamese Social Media Lexical NormalizationSystem Demonstrations1 citations
- Where do LLMs Encode the Knowledge to Assess the Ambiguity?Industry1 citations
- XFormParser: A Simple and Effective Multimodal Multilingual Semi-structured Form ParserMain1 citations
- Zero-shot Slot Filling in the Age of LLMs for Dialogue SystemsIndustry1 citations
- A Benchmark and Robustness Study of In-Context-Learning with Large Language Models in Music Entity DetectionMain
- A Benchmark of French ASR Systems Based on Error SeverityMain
- A Career Interview Dialogue System using Large Language Model-based Dynamic Slot GenerationMain
- A Chain-of-Task Framework for Instruction Tuning of LLMs Based on Chinese Grammatical Error CorrectionMain
- A Collaborative Reasoning Framework Powered by Reinforcement Learning and Large Language Models for Complex Questions Answering over Knowledge GraphMain
- A Combinatorial Approach to Neural Emergent CommunicationMain
- A Compliance Checking Framework Based on Retrieval Augmented GenerationMain
- A Dataset for Expert Reviewer Recommendation with Large Language Models as Zero-shot RankersMain
- A Graph Interaction Framework on Relevance for Multimodal Named Entity Recognition with Multiple ImagesMain
- A High-Quality Text-Rich Image Instruction Tuning Dataset via Hybrid Instruction GenerationMain
- A Knowledge Graph Reasoning-Based Model for Computerized Adaptive TestingMain
- A Probabilistic Toolkit for Multi-grained Word Segmentation in ChineseSystem Demonstrations
- A Recipe For Building a Compliant Real Estate ChatbotIndustry
- A Simple yet Efficient Prompt Compression Method for Text Classification Data Annotation Using LLMIndustry
- A Simple-Yet-Efficient Instruction Augmentation Method for Zero-Shot Sentiment ClassificationMain
- A Testset for Context-Aware LLM Translation in Korean-to-English Discourse Level TranslationMain
- A Text Embedding Model with Contrastive Example Mining for Point-of-Interest GeocodingMain
- ACE-M3: Automatic Capability Evaluator for Multimodal Medical ModelsMain
- ACL-rlg: A Dataset for Reading List GenerationMain
- AGCL: Aspect Graph Construction and Learning for Aspect-level Sentiment ClassificationMain
- AHVE-CNER: Aligned Hanzi Visual Encoding Enhance Chinese Named Entity Recognition with Multi-InformationMain
- AMAN: Agent for Mentoring and Assisting Newbies in MMORPGIndustry
- Acquiring Bidirectionality via Large and Small Language ModelsMain
- Adapters Selector: Cross-domains and Multi-tasks LoRA Modules Integration Usage MethodMain
- Addressing the Training-Inference Discrepancy in Discrete Diffusion for Text GenerationMain
- AdminSet and AdminBERT: a Dataset and a Pre-trained Language Model to Explore the Unstructured Maze of French Administrative DocumentsMain
- Aligning Complex Knowledge Graph Question Answering as Knowledge-Aware Constrained Code GenerationMain
- Ambiguity-aware Multi-level Incongruity Fusion Network for Multi-Modal Sarcasm DetectionMain
- An Efficient Dialogue Policy Agent with Model-Based Causal Reinforcement LearningMain
- Analyzing Continuous Semantic Shifts with Diachronic Word Similarity MatricesMain
- Analyzing Offensive Language Dataset Insights from Training Dynamics and Human Agreement LevelMain
- Annotating the French Wiktionary with supersenses for large scale lexical analysis: a use case to assess form-meaning relationships within the nominal lexiconMain
- Are Your Keywords Like My Queries? A Corpus-Wide Evaluation of Keyword Extractors with Real SearchesMain
- Argument Mining with Fine-Tuned Large Language ModelsMain
- Argumentation and Domain Discourse in Scholarly Articles on the Theory of International RelationsMain
- Aspect-Based Sentiment Analysis with Syntax-Opinion-Sentiment Reasoning ChainMain
- Attention-Seeker: Dynamic Self-Attention Scoring for Unsupervised Keyphrase ExtractionMain
- Automated Detection of Tropes In Short TextsMain
- Automated Molecular Concept Generation and Labeling with Large Language ModelsMain
- Automatic Evaluation of Language Generation Technology Based on Structure AlignmentMain
- Automatic Mathematic In-Context Example Generation for LLM Using Multi-Modal ConsistencyMain
- Autonomous Machine Learning-Based Peer Reviewer Selection SystemSystem Demonstrations
- BasqBBQ: A QA Benchmark for Assessing Social Biases in LLMs for Basque, a Low-Resource LanguageMain
- Benchmark Creation for Aspect-Based Sentiment Analysis in Low-Resource Odia Language and Evaluation through Fine-Tuning of Multilingual ModelsMain
- Best Practices for Distilling Large Language Models into BERT for Web Search RankingIndustry
- Beyond Dataset Creation: Critical View of Annotation Variation and Bias Probing of a Dataset for Online Radical Content DetectionMain
- Beyond Discrete Personas: Personality Modeling Through Journal Intensive ConversationsMain
- Beyond Visual Understanding Introducing PARROT-360V for Vision Language Model BenchmarkingIndustry
- BinarySelect to Improve Accessibility of Black-Box Attack ResearchMain
- Boosting Text-to-SQL through Multi-grained Error IdentificationMain
- Bridging Context Gaps: Enhancing Comprehension in Long-Form Social Conversations Through Contextualized ExcerptsMain
- Bridging Modality Gap for Effective Multimodal Sentiment Analysis in Fashion-related Social MediaMain
- Bridging the Language Gap: Dynamic Learning Strategies for Improving Multilingual Performance in LLMsMain
- C3LRSO: A Chinese Corpus for Complex Logical Reasoning in Sentence OrderingMain
- CACA: Context-Aware Cross-Attention Network for Extractive Aspect Sentiment Quad PredictionMain
- CASE: Large Scale Topic Exploitation for Decision Support SystemsSystem Demonstrations
- CDAˆ2: Counterfactual Diffusion Augmentation for Cross-Domain Adaptation in Low-Resource Sentiment AnalysisMain
- CE-DA: Custom Embedding and Dynamic Aggregation for Zero-Shot Relation ExtractionMain
- CEHA: A Dataset of Conflict Events in the Horn of AfricaMain
- CHIFRAUD: A Long-term Web Text Dataset for Chinese Fraud DetectionMain
- COF: Adaptive Chain of Feedback for Comparative Opinion Quintuple ExtractionMain
- CPsyExam: A Chinese Benchmark for Evaluating Psychology using ExaminationsMain
- CUTE: A Multilingual Dataset for Enhancing Cross-Lingual Knowledge Transfer in Low-Resource LanguagesMain
- CaDRL: Document-level Relation Extraction via Context-aware Differentiable Rule LearningMain
- Can LLMs Clarify? Investigation and Enhancement of Large Language Models on Argument Claim OptimizationMain
- CateEA: Enhancing Entity Alignment via Implicit Category SupervisionMain
- CharMoral: A Character Morality Dataset for Morally Dynamic Character Analysis in Long-Form NarrativesMain
- Chinese Automatic Readability Assessment Using Adaptive Pre-training and Linguistic Feature FusionMain
- Claim veracity assessment for explainable fake news detectionMain
- Clear Up Confusion: Iterative Differential Generation for Fine-grained Intent Detection with Contrastive FeedbackMain
- Close or Cloze? Assessing the Robustness of Large Language Models to Adversarial Perturbations via Word RecoveryMain
- Cognate Detection for Historical Language Reconstruction of Proto-Sabean Languages: the Case of Ge’ez, Tigrinya, and AmharicMain
- Comet: Dialog Context Fusion Mechanism for End-to-End Task-Oriented Dialog with Multi-task LearningMain
- Commonsense Subgraph for Inductive Relation Reasoning with Meta-learningMain
- CompUGE-Bench: Comparative Understanding and Generation Evaluation Benchmark for Comparative Question AnsweringSystem Demonstrations
- Conditional Semantic Textual Similarity via Conditional Contrastive LearningMain
- Consistency Rating of Semantic Transparency: an Evaluation Method for Metaphor Competence in Idiom Understanding TasksMain
- Context Filtering with Reward Modeling in Question AnsweringMain
- Contextual ASR Error Handling with LLMs Augmentation for Goal-Oriented Conversational AIIndustry
- Contextual Augmentation for Entity Linking using Large Language ModelsMain
- Courtroom-LLM: A Legal-Inspired Multi-LLM Framework for Resolving Ambiguous Text ClassificationsMain
- Cross Domain Classification of Education Talk TurnsMain
- Cross-Domain Fake News Detection based on Dual-Granularity Adversarial TrainingMain
- Cross-Lingual Knowledge Projection and Knowledge Enhancement for Zero-Shot Question Answering in Low-Resource LanguagesMain
- Cross-Lingual Sentence Compression for Length-Constrained Subtitles in Low-Resource SettingsMain
- Cross-lingual Social Misinformation Detector based on Hierarchical Mixture-of-Experts AdapterMain
- Cross-lingual Text Classification Transfer: The Case of UkrainianMain
- CryptOpiQA: A new Opinion and Question Answering dataset on CryptocurrencyMain
- CycleOIE: A Low-Resource Training Framework For Open Information ExtractionMain
- DAEA: Enhancing Entity Alignment in Real-World Knowledge Graphs Through Multi-Source Domain AdaptationMain
- DORA: Dynamic Optimization Prompt for Continuous Reflection of LLM-based AgentMain
- DP-FROST: Differentially Private Fine-tuning of Pre-trained Models with Freezing Model ParametersMain
- DROWN: Towards Tighter LiRPA-based Robustness CertificationMain
- DaCoM: Strategies to Construct Domain-specific Low-resource Language Machine Translation DatasetIndustry
- Debiasing by obfuscating with 007-classifiers promotes fairness in multi-community settingsMain
- Deploying Multi-task Online Server with Large Language ModelIndustry
- Detecting deepfakes and false ads through analysis of text and social engineering techniquesMain
- DialogueMMT: Dialogue Scenes Understanding Enhanced Multi-modal Multi-task Tuning for Emotion Recognition in ConversationsMain
- Discrete Subgraph Sampling for Interpretable Graph based Visual Question AnsweringMain
- Disentangle to Decay: Linear Attention with Trainable Decay FactorMain
- Disentangling Preference Representation and Text Generation for Efficient Individual Preference AlignmentMain
- Do language models practice what they preach? Examining language ideologies about gendered language reform encoded in LLMsMain
- Does Vision Accelerate Hierarchical Generalization in Neural Language Learners?Main
- Driving Chinese Spelling Correction from a Fine-Grained PerspectiveMain
- Dying or Departing? Euphemism Detection for Death Discourse in Historical TextsMain
- Dynamics of Instruction Fine-Tuning for Chinese Large Language ModelsMain
- ECC: Synergizing Emotion, Cause and Commonsense for Empathetic Dialogue GenerationMain
- EDAR: A pipeline for Emotion and Dialogue Act RecognitionIndustry
- EERPD: Leveraging Emotion and Emotion Regulation for Improving Personality DetectionMain
- ELAINE-medLLM: Lightweight English Japanese Chinese Trilingual Large Language Model for Bio-medical DomainMain
- EasyJudge: an Easy-to-use Tool for Comprehensive Response Evaluation of LLMsSystem Demonstrations
- Edit-Wise Preference Optimization for Grammatical Error CorrectionMain
- Efficient Architectures for High Resolution Vision-Language ModelsMain
- Efficient Cross-modal Prompt Learning with Semantic Enhancement for Domain-robust Fake News DetectionMain
- Efficient Vocabulary Reduction for Small Language ModelsIndustry
- Embedding Style Beyond Topics: Analyzing Dispersion Effects Across Different Language ModelsMain
- Empirical Study of Zero-shot Keyphrase Extraction with Large Language ModelsMain
- Empirical Study on Data Attributes Insufficiency of Evaluation Benchmarks for LLMsMain
- Enhancing Criminal Investigation Analysis with Summarization and Memory-based Retrieval-Augmented Generation: A Comprehensive Evaluation of Real Case DataMain
- Enhancing Emotional Support Conversations: A Framework for Dynamic Knowledge Filtering and Persona ExtractionMain
- Enhancing Event Causality Identification with LLM Knowledge and Concept-Level Event RelationsMain
- Enhancing Extractive Question Answering in Multiparty Dialogues with Logical Inference Memory NetworkMain
- Enhancing Future Link Prediction in Quantum Computing Semantic Networks through LLM-Initiated Node FeaturesIndustry
- Enhancing Large Language Models for Document-Level Translation Post-Editing Using Monolingual DataMain
- Enhancing Multimodal Named Entity Recognition through Adaptive Mixup Image AugmentationMain
- Enhancing One-Shot Pruned Pre-trained Language Models through Sparse-Dense-Sparse MechanismMain
- Enhancing Online Grooming Detection via Backtranslation AugmentationMain
- Enhancing Rhetorical Figure Annotation: An Ontology-Based Web Application with RAG IntegrationMain
- Enhancing Rumor Detection Methods with Propagation Structure Infused Language ModelMain
- Enhancing Zero-shot Chain of Thought Prompting via Uncertainty-Guided Strategy SelectionMain
- Evaluating Generalization Capability of Language Models across Abductive, Deductive and Inductive Logical ReasoningMain
- Evaluating Model Alignment with Human Perception: A Study on Shitsukan in LLMs and LVLMsMain
- Evaluating Open-Source ASR Systems: Performance Across Diverse Audio Conditions and Error Correction MethodsMain
- Evaluating Readability Metrics for German Medical Text SimplificationMain
- Exploring Content Predictability in Turn-Taking Through Different Computer-Mediated CommunicationsMain
- Exploring Fine-Grained Human Motion Video CaptioningMain
- Exploring Unified Training Framework for Multimodal User ProfilingMain
- Exploring the Impacts of Feature Fusion Strategy in Multi-modal Entity AlignmentMain
- Exploring the Reliability of Large Language Models as Customized Evaluators for Diverse NLP TasksMain
- Extending LLMs to New Languages: A Case Study of Llama and Persian AdaptationMain
- Extracting structure from an LLM - how to improve on surprisal-based models of Human Language ProcessingMain
- Extracting, Detecting, and Generating Research Questions for Scientific ArticlesMain
- FEAT-writing: An Interactive Training System for Argumentative WritingSystem Demonstrations
- FTFT: Efficient and Robust Fine-Tuning by Transferring Training DynamicsMain
- Factual Knowledge Assessment of Language Models Using DistractorsMain
- Faithful Inference Chains Extraction for Fact Verification over Multi-view Heterogeneous Graph with Causal InterventionMain
- FedCSR: A Federated Framework for Multi-Platform Cross-Domain Sequential Recommendation with Dual Contrastive LearningMain
- Federated Incremental Named Entity RecognitionMain
- Fine-Tuning Medium-Scale LLMs for Joint Intent Classification and Slot Filling: A Data-Efficient and Cost-Effective Solution for SMEsIndustry
- Finetuning LLMs for Comparative Assessment TasksMain
- Flashback: Memory Mechanism for Enhancing Memory Efficiency and Speed in Deep Sequential ModelsMain
- From Detection to Explanation: Effective Learning Strategies for LLMs in Online Abusive Language ResearchMain
- From Form to Meaning: The Case of Particles within the Prague Dependency Treebank Annotation SchemeMain
- From Multiple-Choice to Extractive QA: A Case Study for English and ArabicMain
- Fusion meets Function: The Adaptive Selection-Generation Approach in Event Argument ExtractionMain
- GADFA: Generator-Assisted Decision-Focused Approach for Opinion Expressing Timing IdentificationMain
- GEAR: A Simple GENERATE, EMBED, AVERAGE AND RANK Approach for Unsupervised Reverse DictionaryMain
- GECTurk WEB: An Explainable Online Platform for Turkish Grammatical Error Detection and CorrectionSystem Demonstrations
- GL-GAN: Perceiving and Integrating Global and Local Styles for Handwritten Text Generation with MambaMain
- GR-NLP-TOOLKIT: An Open-Source NLP Toolkit for Modern GreekSystem Demonstrations
- Gen-SQL: Efficient Text-to-SQL By Bridging Natural Language Question And Database Schema With Pseudo-SchemaMain
- GenWebNovel: A Genre-oriented Corpus of Entities in Chinese Web NovelsMain
- Generation-Augmented and Embedding Fusion in Document-Level Event Argument ExtractionMain
- Generation-Based and Emotion-Reflected Memory Update: Creating the KEEM Dataset for Better Long-Term ConversationMain
- Generics are puzzling. Can language models find the missing piece?Main
- Geo-Spatially Informed Models for Geocoding Unstructured AddressesIndustry
- Graph-Augmented Open-Domain Multi-Document SummarizationIndustry
- HLU: Human Vs LLM Generated Text Detection Dataset for Urdu at Multiple GranularitiesMain
- HYDEN: Hyperbolic Density Representations for Medical Images and ReportsMain
- Hands-off Image Editing: Language-guided Editing without any Task-specific Labeling, Masking or even TrainingMain
- HateBRXplain: A Benchmark Dataset with Human-Annotated Rationales for Explainable Hate Speech Detection in Brazilian PortugueseMain
- Hawkes based Representation Learning for Reasoning over Scale-free Community-structured Temporal Knowledge GraphsMain
- Hermit Kingdom Through the Lens of Multiple Perspectives: A Case Study of LLM Hallucination on North KoreaMain
- Hi-GEC: Hindi Grammar Error Correction in Low Resource ScenarioMain
- How Ambiguous Are the Rationales for Natural Language Reasoning? A Simple Approach to Handling Rationale UncertaintyMain
- How Credible Is an Answer From Retrieval-Augmented LLMs? Investigation and Evaluation With Multi-Hop QAMain
- How Many Languages Make Good Multilingual Instruction Tuning? A Case Study on BLOOMMain
- Human Interest Framing across Cultures: A Case Study on Climate ChangeMain
- HyperHatePrompt: A Hypergraph-based Prompting Fusion Model for Multimodal Hate DetectionMain
- HyperIDP: Customizing Temporal Hypergraph Neural Networks for Multi-Scale Information Diffusion PredictionMain
- IRUEX: A Study on Large Language Models Problem-Solving Skills in Iran’s University Entrance ExamMain
- ITERATE: Image-Text Enhancement, Retrieval, and Alignment for Transmodal Evolution with LLMsMain
- Improve Speech Translation Through Text RewriteIndustry
- Improving Accessibility of SCOTUS Opinions: A Benchmark Study and a New Dataset for Generic Heading Prediction and Specific Heading GenerationMain
- Improving Explainable Fact-Checking with Claim-Evidence CorrelationsMain
- Improving NMT Models by Retrofitting Quality Estimators into Trainable Energy LossMain
- Improving Relation Extraction by Sequence-to-sequence-based Dependency Parsing Pre-trainingMain
- Improving the Efficiency of Visually Augmented Language ModelsMain
- In-Context Reinforcement Learning with Retrieval-Augmented Generation for Text-to-SQLMain
- In-context Continual Learning Assisted by an External Continual LearnerMain
- Incorporating Review-missing Interactions for Generative Explainable RecommendationMain
- Incremental Transformer: Efficient Encoder for Incremented Text Over MRC and Conversation TasksMain
- Indigenous Languages Spoken in Argentina: A Survey of NLP and Speech ResourcesMain
- Inductive Link Prediction in N-ary Knowledge GraphsMain
- InstructGEC: Enhancing Unsupervised Grammatical Error Correction with Instruction TuningMain
- Integrating Group-based Preferences from Coarse to Fine for Cold-start Users RecommendationMain
- Intent Contrastive Learning Based on Multi-view Augmentation for Sequential RecommendationMain
- Interpreting Topic Models in Byte-Pair Encoding SpaceMain
- Investigating the Contextualised Word Embedding Dimensions Specified for Contextual and Temporal Semantic ChangesMain
- Investigating the Impact of Incremental Processing and Voice Activity Projection on Spoken Dialogue SystemsMain
- Iterative Structured Knowledge Distillation: Optimizing Language Models Through Layer-by-Layer DistillationMain
- It’s What You Say and How You Say It: Investigating the Effect of Linguistic vs. Behavioral Adaptation in Task-Oriented ChatbotsMain
- Just Read the Codebook! Make Use of Quality Codebooks in Zero-Shot Classification of Multilabel Frame DatasetsMain
- KG-TRICK: Unifying Textual and Relational Information Completion of Knowledge for Multilingual Knowledge GraphsMain
- KVFKT: A New Horizon in Knowledge Tracing with Attention-Based Embedding and Forgetting Curve IntegrationMain
- Know When to Fuse: Investigating Non-English Hybrid Retrieval in the Legal DomainMain
- Knowledge Graph Entity Typing with Curriculum Contrastive LearningMain
- Knowledge Graph Pooling and Unpooling for Concept AbstractionMain
- Knowledge Graph Unlearning with SchemaMain
- KnowledgePrompts: Exploring the Abilities of Large Language Models to Solve Proportional Analogies via Knowledge-Enhanced PromptingMain
- LASS: A Novel and Economical Data Augmentation Framework Based on Language Models for Debiasing Opinion SummarizationMain
- LENS: Learning Entities from Narratives of Skin CancerSystem Demonstrations
- LLM ContextBridge: A Hybrid Approach for Intent and Dialogue Understanding in IVSRIndustry
- LLM Evaluate: An Industry-Focused Evaluation Tool for Large Language ModelsIndustry
- LLM Sensitivity Evaluation Framework for Clinical DiagnosisMain
- LLM4RE: A Data-centric Feasibility Study for Relation ExtractionMain
- LLMs meet Bloom’s Taxonomy: A Cognitive View on Large Language Model EvaluationsMain
- LOG: A Local-to-Global Optimization Approach for Retrieval-based Explainable Multi-Hop Question AnsweringMain
- LTRS: Improving Word Sense Disambiguation via Learning to Rank SensesMain
- LUCE: A Dynamic Framework and Interactive Dashboard for Opinionated Text AnalysisSystem Demonstrations
- LaERC-S: Improving LLM-based Emotion Recognition in Conversation with Speaker CharacteristicsMain
- Language Models at the Syntax-Semantics Interface: A Case Study of the Long-Distance Binding of Chinese Reflexive ZijiMain
- Language Models over Large-Scale Knowledge Base: on Capacity, Flexibility and Reasoning for New FactsMain
- Large Language Model as a Teacher for Zero-shot Tagging at Extreme ScalesMain
- Large Language Model-Based Event Relation Extraction with RationalesMain
- Latent Space Interpretation for Stylistic Analysis and Explainable Authorship AttributionMain
- Learn from Failure: Causality-guided Contrastive Learning for Generalizable Implicit Hate Speech DetectionMain
- Learning Transition Patterns by Large Language Models for Sequential RecommendationMain
- Learning from Impairment: Leveraging Insights from Clinical Linguistics in Language Modelling ResearchMain
- Learning to Rewrite Negation Queries in Product SearchIndustry
- Leveraging Language-based Representations for Better Solving Symbol-related Problems with Large Language ModelsMain
- Leveraging Large Pre-trained Multilingual Models for High-Quality Speech-to-Text Translation on Industry ScenariosMain
- Leveraging Multilingual Models for Robust Grammatical Error Correction Across Low-Resource LanguagesIndustry
- Linguistic Features Extracted by GPT-4 Improve Alzheimer’s Disease Detection based on Spontaneous SpeechMain
- LionGuard: A Contextualized Moderation Classifier to Tackle Localized Unsafe ContentIndustry
- LlmLink: Dual LLMs for Dynamic Entity Linking on Long Narratives with Collaborative Memorisation and Prompt OptimisationMain
- LogiGraph: Logical Reasoning with Contrastive Learning and Lightweight Graph NetworksMain
- Looking at the Unseen: Effective Sampling of Non-Related Propositions for Argument MiningMain
- MAGRET: Machine-generated Text Detection with Rewritten TextsMain
- MDPO: Customized Direct Preference Optimization with a Metric-based Sampler for Question and Answer GenerationMain
- ME2-BERT: Are Events and Emotions what you need for Moral Foundation Prediction?Main
- MESAQA: A Dataset for Multi-Span Contextual and Evidence-Grounded Question AnsweringMain
- MIGRATE: Cross-Lingual Adaptation of Domain-Specific LLMs through Code-Switching and Embedding TransferMain
- MLD-EA: Check and Complete Narrative Coherence by Introducing Emotions and ActionsMain
- MLLM-I2W: Harnessing Multimodal Large Language Model for Zero-Shot Composed Image RetrievalMain
- MPPO: Multi Pair-wise Preference Optimization for LLMs with Arbitrary Negative SamplesMain
- MQM-Chat: Multidimensional Quality Metrics for Chat TranslationMain
- Measuring the Robustness of Reference-Free Dialogue Evaluation SystemsMain
- MedEx: Enhancing Medical Question-Answering with First-Order Logic based Reasoning and Knowledge InjectionMain
- Mining Word Boundaries from Speech-Text Parallel Data for Cross-domain Chinese Word SegmentationMain
- Mitigating Shortcut Learning via Smart Data Augmentation based on Large Language ModelMain
- Mitigating the Discrepancy Between Video and Text Temporal Sequences: A Time-Perception Enhanced Video Grounding method for LLMMain
- MoKA:Parameter Efficiency Fine-Tuning via Mixture of Kronecker Product AdaptionMain
- Momentum Posterior Regularization for Multi-hop Dense RetrievalMain
- Monte Carlo Tree Search Based Prompt Autogeneration for Jailbreak Attacks against LLMsMain
- MuPe Life Stories Dataset: Spontaneous Speech in Brazilian Portuguese with a Case Study Evaluation on ASR Bias against Speakers Groups and Topic ModelingMain
- Multi-Graph Co-Training for Capturing User Intent in Session-based RecommendationMain
- Multi-Layered Evaluation Using a Fusion of Metrics and LLMs as Judges in Open-Domain Question AnsweringMain
- Multi-Modal Entities Matter: Benchmarking Multi-Modal Entity AlignmentMain
- Multi-Modal Multi-Granularity Tokenizer for Chu Bamboo SlipsMain
- Multi-perspective Preference Alignment of LLMs for Programming-Community Question AnsweringMain
- Multilingual Supervision Improves Semantic Disambiguation of AdpositionsMain
- Multimodal Extraction and Recognition of Arabic Implicit Discourse RelationsMain
- NCRE: A Benchmark for Document-level Nominal Compound Relation ExtractionMain
- NLP for preserving Torlak, a vulnerable low-resource Slavic languageMain
- Neural Document Segmentation Using Weighted Sliding Windows with Transformer EncodersIndustry
- Non-Emotion-Centric Empathetic Dialogue GenerationMain
- Norm of Mean Contextualized Embeddings Determines their VarianceMain
- OVEL: Online Video Entity LinkingMain
- On Evaluating LLMs’ Capabilities as Functional Approximators: A Bayesian Evaluation FrameworkMain
- On the Human-level Performance of Visual Question AnsweringMain
- On the effective transfer of knowledge from English to Hindi WikipediaIndustry
- OptiPrune: Effective Pruning Approach for Every Target SparsityMain
- PDC & DM-SFT: A Road for LLM SQL Bug-Fix EnhancingIndustry
- PERC: Plan-As-Query Example Retrieval for Underrepresented Code GenerationMain
- PToco: Prefix-based Token-level Collaboration Enhances Reasoning for Multi-LLMsMain
- Page Stream Segmentation with LLMs: Challenges and Applications in Insurance Document AutomationIndustry
- Paraphrase Generation Evaluation Powered by an LLM: A Semantic Metric, Not a Lexical OneMain
- Paraphrase Makes Perfect: Leveraging Expression Paraphrase to Improve Implicit Sentiment LearningMain
- Partial Order-centered Hyperbolic Representation Learning for Few-shot Relation ExtractionMain
- Perceive the Passage of Time: A Systematic Evaluation of Large Language Model in Temporal RelativityMain
- Perturbation-driven Dual Auxiliary Contrastive Learning for Collaborative Filtering RecommendationMain
- PoemBERT: A Dynamic Masking Content and Ratio Based Semantic Language Model For Chinese Poem GenerationMain
- Poetry in Pixels: Prompt Tuning for Poem Image Generation via Diffusion ModelsMain
- PolyMinder: A Support System for Entity Annotation and Relation Extraction in Polymer Science DocumentsSystem Demonstrations
- Polysemy Interpretation and Transformer Language Models: A Case of Korean Adverbial Postposition -(u)loMain
- PrahokBART: A Pre-trained Sequence-to-Sequence Model for Khmer Natural Language GenerationMain
- Pre-trained Semantic Interaction based Inductive Graph Neural Networks for Text ClassificationMain
- Predicting Fine-tuned Performance on Larger Datasets Before Creating ThemIndustry
- ProsodyFlow: High-fidelity Text-to-Speech through Conditional Flow Matching and Prosody Modeling with Large Speech Language ModelsMain
- Pseudo-label Data Construction Method and Syntax-enhanced Model for Chinese Semantic Error RecognitionMain
- QABISAR: Query-Article Bipartite Interactions for Statutory Article RetrievalMain
- QUENCH: Measuring the gap between Indic and Non-Indic Contextual General Reasoning in LLMsMain
- Quality Beyond A Glance: Revealing Large Quality Differences Between Web-Crawled Parallel CorporaMain
- Quantifying the Influence of Evaluation Aspects on Long-Form Response AssessmentMain
- RA-MTR: A Retrieval Augmented Multi-Task Reader based Approach for Inspirational Quote Extraction from Long DocumentsMain
- RAGthoven: A Configurable Toolkit for RAG-enabled LLM ExperimentationSystem Demonstrations
- RAM2C: A Liberal Arts Educational Chatbot based on Retrieval-augmented Multi-role Multi-expert CollaborationMain
- RED-CT: A Systems Design Methodology for Using LLM-labeled Data to Train and Deploy Edge Linguistic ClassifiersIndustry
- RGR-KBQA: Generating Logical Forms for Question Answering Using Knowledge-Graph-Enhanced Large Language ModelMain
- ROUGE-SciQFS: A ROUGE-based Method to Automatically Create Datasets for Scientific Query-Focused SummarizationMain
- RRHF-V: Ranking Responses to Mitigate Hallucinations in Multimodal Large Language Models with Human FeedbackMain
- RUAccent: Advanced System for Stress Placement in Russian with Homograph ResolutionMain
- Ranking Over Scoring: Towards Reliable and Robust Automated Evaluation of LLM-Generated Medical Explanatory ArgumentsMain
- Re-Cent: A Relation-Centric Framework for Joint Zero-Shot Relation Triplet ExtractionMain
- Re-Examine Distantly Supervised NER: A New Benchmark and a Simple ApproachMain
- Reasoning with Trees: Faithful Question Answering over Knowledge GraphMain
- Reasoning-Oriented and Analogy-Based Methods for Locating and Editing in Zero-Shot Event-Relational ReasoningMain
- RecStream: Graph-aware Stream Management for Concurrent Recommendation Model Online ServingIndustry
- Refer to the Reference: Reference-focused Synthetic Automatic Post-Editing Data GenerationMain
- Relation Logical Reasoning and Relation-aware Entity Encoding for Temporal Knowledge Graph ReasoningMain
- Reliable, Reproducible, and Really Fast Leaderboards with EvalicaSystem Demonstrations
- Representation Purification for End-to-End Speech TranslationMain
- Representing the Under-Represented: Cultural and Core Capability Benchmarks for Developing Thai Large Language ModelsMain
- Resource-Efficient Anonymization of Textual Data via Knowledge Distillation from Large Language ModelsIndustry
- Rethinking Vocabulary Augmentation: Addressing the Challenges of Low-Resource Languages in Multilingual ModelsMain
- Rethinking-based Code Summarization with Chain of CommentsMain
- Revisiting Implicitly Abusive Language Detection: Evaluating LLMs in Zero-Shot and Few-Shot SettingsMain
- RoBGuard: Enhancing LLMs to Assess Risk of Bias in Clinical Trial DocumentsMain
- Robustness Evaluation of the German Extractive Question Answering TaskMain
- Rule-KBQA: Rule-Guided Reasoning for Complex Knowledge Base Question Answering with Large Language ModelsMain
- Rumor Detection on Social Media with Temporal Propagation Structure OptimizationMain
- SA-DETR:Span Aware Detection Transformer for Moment RetrievalMain
- SCCD: A Session-based Dataset for Chinese Cyberbullying DetectionMain
- SGMEA: Structure-Guided Multimodal Entity AlignmentMain
- SILC-EFSA: Self-aware In-context Learning Correction for Entity-level Financial Sentiment AnalysisMain
- SLAM: Towards Efficient Multilingual Reasoning via Selective Language AlignmentMain
- SLARD: A Chinese Superior Legal Article Retrieval DatasetMain
- SURE: Mutually Visible Objects and Self-generated Candidate Labels For Relation ExtractionMain
- SVD-GCL: A Noise-Augmented Hybrid Graph Contrastive Learning Framework for RecommendationMain
- Scene Graph and Dependency Grammar Enhanced Remote Sensing Change Caption Network (SGD-RSCCN)Main
- Seeing Beyond: Enhancing Visual Question Answering with Multi-Modal RetrievalIndustry
- Selected Languages are All You Need for Cross-lingual Truthfulness TransferMain
- Self-Evolution Knowledge Distillation for LLM-based Machine TranslationMain
- Semantic Captioning: Benchmark Dataset and Graph-Aware Few-Shot In-Context Learning for SQL2TextMain
- Semantic Role Labeling of NomBank PartitivesMain
- Semantic and Sentiment Dual-Enhanced Generative Model for Script Event PredictionMain
- Semi-Automated Construction of Sense-Annotated Datasets for Practically Any LanguageMain
- Should We Use a Fixed Embedding Size? Customized Dimension Sizes for Knowledge Graph EmbeddingMain
- Sibyl: Empowering Empathetic Dialogue Generation in Large Language Models via Sensible and Visionary Commonsense InferenceMain
- Simulating Dual-Process Thinking in Dialogue Topic Shift DetectionMain
- Speech Foundation Models and Crowdsourcing for Efficient, High-Quality Data CollectionMain
- Structured List-Grounded Question AnsweringMain
- Swift Cross-Dataset Pruning: Enhancing Fine-Tuning Efficiency in Natural Language UnderstandingMain
- TEEMIL : Towards Educational MCQ Difficulty Estimation in Indic LanguagesMain
- TEF: Causality-Aware Taxonomy Expansion via Front-Door CriterionMain
- TOP-Training: Target-Oriented Pretraining for Medical Extractive Question AnsweringMain
- TaCIE: Enhancing Instruction Comprehension in Large Language Models through Task-Centred Instruction EvolutionMain
- Task-Oriented Dialog Systems for the Senegalese Wolof LanguageMain
- Teaching-Inspired Integrated Prompting Framework: A Novel Approach for Enhancing Reasoning in Large Language ModelsIndustry
- Text-Attributed Graph Learning with Coupled AugmentationsMain
- The Gaps between Fine Tuning and In-context Learning in Bias Evaluation and DebiasingMain
- The Invalsi Benchmarks: measuring the Linguistic and Mathematical understanding of Large Language Models in ItalianMain
- The Only Way is Ethics: A Guide to Ethical Research with Large Language ModelsMain
- The PRECOM-SM Corpus: Gambling in Spanish Social MediaMain
- The Shift from Logic to Dialectic in Argumentation Theory: Implications for Computational Argument Quality AssessmentMain
- Tougher Text, Smarter Models: Raising the Bar for Adversarial Defence BenchmarksMain
- Towards Adaptive Mechanism Activation in Language AgentMain
- Towards Cross-Lingual Audio Abuse Detection in Low-Resource Settings with Few-Shot LearningMain
- Towards Database-Free Text-to-SQL Evaluation: A Graph-Based Metric for Functional CorrectnessMain
- Towards Efficient and Robust VQA-NLE Data Generation with Large Vision-Language ModelsMain
- Towards Human Understanding of Paraphrase Types in Large Language ModelsMain
- Towards Multilingual spoken Visual Question Answering system using Cross-AttentionMain
- Towards Robust Comparisons of NLP Models: A Case StudyMain
- Transformer-based Speech Model Learns Well as Infants and Encodes Abstractions through Exemplars in the Poverty of the Stimulus EnvironmentMain
- Transforming Code Understanding: Clustering-Based Retrieval for Improved Summarization in Domain-Specific LanguagesIndustry
- TriFine: A Large-Scale Dataset of Vision-Audio-Subtitle for Tri-Modal Machine Translation and Benchmark with Fine-Grained Annotated TagsMain
- Trucidator: Document-level Event Factuality Identification via Hallucination Enhancement and Cross-Document InferenceMain
- Two-stage Incomplete Utterance Rewriting on Editing OperationMain
- UCTG: A Unified Controllable Text Generation Framework for Query Auto-CompletionIndustry
- UR2N: Unified Retriever and ReraNkerIndustry
- Uchaguzi-2022: A Dataset of Citizen Reports on the 2022 Kenyan ElectionMain
- Uncertainty Modelling in Under-Represented Languages with Bayesian Deep Gaussian ProcessesMain
- Unified Grid Tagging Scheme for Aspect Sentiment Quad PredictionMain
- UnifiedGEC: Integrating Grammatical Error Correction Approaches for Multi-languages with a Unified FrameworkSystem Demonstrations
- Unmasking the Imposters: How Censorship and Domain Adaptation Affect the Detection of Machine-Generated TweetsMain
- Unraveling the Mystery: Defending Against Jailbreak Attacks Via Unearthing Real IntentionMain
- User Willingness-aware Sales Talk DatasetMain
- VEEF-Multi-LLM: Effective Vocabulary Expansion and Parameter Efficient Finetuning Towards Multilingual Large Language ModelsMain
- VaeDiff-DocRE: End-to-end Data Augmentation Framework for Document-level Relation ExtractionMain
- VideoQA-TA: Temporal-Aware Multi-Modal Video Question AnsweringMain
- Voice synthesis in Polish and English - analyzing prediction differences in speaker verification systemsMain
- VoxpopuliTTS: a large-scale multilingual TTS corpus for zero-shot speech generationMain
- What Makes Cryptic Crosswords Challenging for LLMs?Main
- What’s the most important value? INVP: INvestigating the Value Priorities of LLMs through Decision-making in Social ScenariosMain
- When Evolution Strategy Meets Language Models TuningMain
- Why should only High-Resource-Languages have all the fun? Pivot Based Evaluation in Low Resource SettingMain
- Word-level Cross-lingual Structure in Large Language ModelsMain
- XTR meets ColBERTv2: Adding ColBERTv2 Optimizations to XTRIndustry
- You Only Query Twice: Multimodal Rumor Detection via Evidential Evaluation from Dual PerspectivesMain
- Zero-Shot Entailment Learning for Ontology-Based Biomedical Annotation Without Explicit MentionsMain
- Zero-shot and Few-shot Learning with Instruction-following LLMs for Claim Matching in Automated Fact-checkingMain
- ZigZagKV: Dynamic KV Cache Compression for Long-context Modeling based on Layer UncertaintyMain
- data2lang2vec: Data Driven Typological Features CompletionMain
- t-HNE: A Text-guided Hierarchical Noise Eliminator for Multimodal Sentiment AnalysisMain
- “Stupid robot, I want to speak to a human!” User Frustration Detection in Task-Oriented Dialog SystemsIndustry
COLING accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.