AAAI 2026 Accepted Papers
The full list of 4,902 papers accepted at AAAI 2026 (Association for the Advancement of Artificial Intelligence Annual Conference on Artificial Intelligence). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Technical: 4,902
- 10 Open Challenges Steering the Future of Vision-Language-Action ModelsTechnical
- 2-ASP(Q) Solving Based on CEGARTechnical
- 2D Gaussians Spatial Transport for Point-supervised Density RegressionTechnical
- 2D-CrossScan Mamba: Enhancing State Space Models with Spatially Consistent Multi-Path 2D Information PropagationTechnical
- 360Explorer: Exploring 4D Controllable World in Panoramic VideosTechnical
- 3D Gaussian Splatting for Reconstructing Large Sparse Environments (Student Abstract)Technical
- 3D-ANC: Adaptive Neural Collapse for Robust 3D Point Cloud RecognitionTechnical
- 3D-DRES: Detailed 3D Referring Expression SegmentationTechnical
- 3D4D: An Interactive, Editable, 4D World Model via 3D Video GenerationTechnical
- 3DAlign-DAER: Dynamic Attention Policy and Efficient Retrieval Strategy for Fine-grained 3D-Text Alignment at ScaleTechnical
- 3DDM: Physically-based Anisotropic 3D Diffusion Model with 3D Gaussian for Point Cloud CompletionTechnical
- 3DTeethSAM: Taming SAM2 for 3D Teeth SegmentationTechnical
- 3One2: One-Step Regression plus One-Step Diffusion for One-Hot Modulation in Dual-Path Video Snapshot Compressive ImagingTechnical
- 4D Point Cloud Segmentation via Active Test-Time AdaptationTechnical
- 4D Scaffold Gaussian Splatting with Dynamic-Aware Anchor Growing for Efficient and High-Fidelity Dynamic Scene ReconstructionTechnical
- 4DSTR: Advancing Generative 4D Gaussians with Spatial-Temporal Rectification for High-Quality and Consistent 4D GenerationTechnical
- 6DAttack: Backdoor Attacks in the 6DoF Pose EstimationTechnical
- A Benchmark Dataset for Spatially Aligned Road Damage Assessment in Small Uncrewed Aerial Systems Disaster ImageryTechnical
- A Better Start: Sensitivity-Aware Warm-Up for Robust and Efficient Fine-TuningTechnical
- A Boundary Token Graph for Zero-Shot Relation Triplet Extraction Involving Discontinuous EntitiesTechnical
- A Brain-Inspired Saliency Prediction Framework for Human-AI Cognitive Consistency in AIGC Content via Multi-Region Liquid NeuronsTechnical
- A Catalyst Framework for the Quantum Linear System Problem via the Proximal Point AlgorithmTechnical
- A Causal Framework to Measure and Mitigate Non-binary Treatment DiscriminationTechnical
- A Causal Target for Learning to Defer Under Hidden ConfoundingTechnical
- A Closer Look at Knowledge Distillation in Spiking Neural Network TrainingTechnical
- A Compliant Robotic Leg Based on Fibre Jamming (Abstract Reprint)Technical
- A Compress-Expand Framework for Automatic Lesson Plan GenerationTechnical
- A Content-Preserving Secure Linguistic SteganographyTechnical
- A Course Correction in Steerability Evaluation: Revealing Miscalibration and Side Effects in LLMsTechnical
- A Data-Centric Analysis of the Impact of Training Data Quality vs. Quantity on P300 Brain-Computer Interface Performance (Student Abstract)Technical
- A Deployed Investigative AI Search Engine for Combating Human Trafficking at Web ScaleTechnical
- A Dialogue-Based Learning Analytics Framework for Collaborative Game-Based LearningTechnical
- A Differential Perspective on Distributional Reinforcement LearningTechnical
- A Disease-Aware Dual-Stage Framework for Chest X-ray Report GenerationTechnical
- A Domain-specific Heuristic for PDDL+-based Traffic Signal OptimisationTechnical
- A Fast Heuristic Search Approach for Energy-Optimal Profile Routing for Electric VehiclesTechnical
- A Flat Minima Perspective on Understanding Augmentations and Model RobustnessTechnical
- A Fortiori Case-Based Reasoning: From Theory to Data (Abstract Reprint)Technical
- A Foundation Model for Brain MRI with Dynamic Modality Integration (Student Abstract)Technical
- A Framework for Belief-based Programs and Their Verification (Abstract Reprint)Technical
- A GPU-based Constraint Programming SolverTechnical
- A General Anchor-Based Framework for Scalable Fair ClusteringTechnical
- A General Highly Accurate Online Planning Method Integrating Large Language Models into Nested Rollout Policy Adaptation for Dialogue TasksTechnical
- A Geometric Perspective on Optimizing Vector Quantized Latent Diffusion Model for Image RestorationTechnical
- A Graph-Theoretical Perspective on Law Design for Multiagent SystemsTechnical
- A Guardrail Framework for Sensitive Financial Information Protection: A Taxonomy-Driven ApproachTechnical
- A Human-AI Collaboration Mechanism Study on AIGC Assisted Image Production for Special CoverageTechnical
- A Human-Centric Pipeline for Aligning Large Language Models with Chinese Medical EthicsTechnical
- A Hybrid Space Model for Misaligned Multi-modality Image FusionTechnical
- A Knowledge Compilation Map for Quantum InformationTechnical
- A Lightweight Safety Helmet Compliance Detection via Multimodal Fusion (Student Abstract)Technical
- A Logical Analysis of an Information Filtering Architecture Based on Epistemic Trust InferenceTechnical
- A Metacognitive Architecture for Correcting LLM Errors in AI AgentsTechnical
- A More Efficient Reduction from Outlier-Aware to Outlier-Free k-MedianTechnical
- A Multi-Agent Conversational Bandit Approach to Online Evaluation and Selection of User-Aligned LLM ResponsesTechnical
- A Multi-Agent LLM Framework for Multi-Domain Low-Resource In-Context NER via Knowledge Retrieval, Disambiguation and Reflective AnalysisTechnical
- A Multi-Objective Optimization Framework for Adaptive Weighting in Physics-Informed Machine LearningTechnical
- A Multimodal EEG-Eye Movement Model for Automatic Depression DetectionTechnical
- A Natural-Gradient Approach for Nonlinear Stochastic Systems with Parameter UncertaintyTechnical
- A Network of Biologically Inspired Rectified Spectral Units (ReSUs) Learns Hierarchical Features Without Error BackpropagationTechnical
- A Novel Approach to Evaluating Evaluation Metrics for Multi-Output Structured PredictionTechnical
- A Novel Fine-Tuned CLIP-OOD Detection Method with Double Loss Constraint Through Optimal Transport Semantic AlignmentTechnical
- A Novel Retrieve-Read-Group Paradigm for Open Knowledge Base CanonicalizationTechnical
- A Novel Sliced Fused Gromov-Wasserstein DistanceTechnical
- A Paradigm Shift in High-Resolution Depth Estimation Using SPAD-Based LiDAR Histograms: From Signal Filtering to Lightweight Similarity LearningTechnical
- A Parallel CPU-GPU Framework for Batching Heuristic Operations in Depth-First Heuristic SearchTechnical
- A Phase Transition for Opinion Dynamics with Competing BiasesTechnical
- A Principle-Driven Adaptive Policy for Group Cognitive Stimulation Dialogue for Elderly with Cognitive ImpairmentTechnical
- A Pseudo-Label Optimization Method Based on Polar Coordinate Modeling and Prior ConstraintsTechnical
- A Reasoning Paradigm for Named Entity RecognitionTechnical
- A Retrieval Augmented Spatio-Temporal Framework for Traffic PredictionTechnical
- A Robust Unlearning Method with Adaptive Knowledge Guidance and Memory PreservationTechnical
- A Scalable and Exact Relaxation for Densest k-Subgraph via Error BoundsTechnical
- A Selective Under-Sampling (SUS) Method for Imbalanced Regression (Abstract Reprint)Technical
- A Simple Proof-Theoretic Characterization of Stable Models: Reduction to Difference Logic and Experiments (Abstract Reprint)Technical
- A Solution Space Transformation-Guided Co-Evolution for Energy-Saving Distributed Heterogeneous Flexible Job Shop SchedulingTechnical
- A Solver-in-the-Loop Framework for Improving LLMs on Answer Set Programming for Logic Puzzle SolvingTechnical
- A Stage-Aware Mixture of Experts Framework for Neurodegenerative Disease Progression ModellingTechnical
- A Study of Finetuning Video Transformers for Multi-view Geometry TasksTechnical
- A Switching Framework for Online Interval Scheduling with PredictionsTechnical
- A TSP-Based Algorithm for Multi-League Traveling TournamentTechnical
- A Tale of Two Identities: An Ethical Audit of AI-Crafted Synthetic PersonasTechnical
- A Text-Routed Sparse Mixture-of-Experts Model with Explanation and Temporal Alignment for Multi-Modal Sentiment AnalysisTechnical
- A Theoretical Analysis of Detecting Large Model-Generated Time SeriesTechnical
- A Theoretical Model for Grit in Pursuing Ambitious EndsTechnical
- A Theory of Adaptive Scaffolding for LLM-Based Pedagogical AgentsTechnical
- A Theory-Inspired Framework for Few-Shot Cross-Modal Sketch Person Re-IdentificationTechnical
- A Topological Rewriting of Tarski’s MereogeometryTechnical
- A Unified Convergence Analysis for Semi-Decentralized Learning: Sampled-to-Sampled vs. Sampled-to-All CommunicationTechnical
- A Unified Geospatial Clustering Framework to Identify Varying Density Clusters in E-Commerce LogisticsTechnical
- A Unified Self-Regulating Training Framework for Federated Deep Reinforcement LearningTechnical
- A Unified Shape-Aware Foundation Model for Time Series ClassificationTechnical
- A Visualized Framework for Event Cooperation with Generative AgentsTechnical
- A-FloPS: Accelerating Diffusion Models via Adaptive Flow Path SamplerTechnical
- A3D: Adaptive Affordance Assembly with Dual-Arm ManipulationTechnical
- ACID Test: A Benchmark for Cultural Safety and Alignment in LALMsTechnical
- ACID-Style: An Adaptive Condition Injection Diffusion Model for Arbitrary Style TransferTechnical
- AD-FM: Multimodal LLMs for Anomaly Detection via Multi-Stage Reasoning and Fine-Grained Reward OptimizationTechnical
- ADAPT: Adaptive Decentralized Architecture with Perception-Aligned Training for Structural Generalization in Multi-Agent RLTechnical
- AEDR: Training-Free AI-Generated Image Attribution via Autoencoder Double-ReconstructionTechnical
- AEFGL: Reverse Auction and Value Evaluation-Based Federated Graph Learning Incentive Mechanism (Student Abstract)Technical
- AEGIS: Toward Expert-in-the-loop Industrial Anomaly DetectionTechnical
- AHAMask: Reliable Task Specification for Large Audio Language Models Without InstructionsTechnical
- AHAN: Asymmetric Hierarchical Attention Network for Identical Twin Face VerificationTechnical
- AI Education Across the Curriculum: Design and Pilot Study of a Cross-Disciplinary Module SetTechnical
- AI Scholars Program: Scaling AI Literacy Through K-12 OutreachTechnical
- AI Unplugged: Embodied Interactions for AI Literacy in Higher EducationTechnical
- AI for Memory Preservation: Automated Restoration of Photographs Damaged by FloodsTechnical
- AI in the Wild: A Meta-Analytic Evaluation of Depression Detection from Social Media DataTechnical
- AI-Driven Marine Robotics: Emerging Trends in Underwater Perception and Ecosystem MonitoringTechnical
- AI-Driven Real-Time Acoustic Modelling for Better Audio Perception in Dynamic EnvironmentsTechnical
- AI-Salesman: Towards Reliable Large Language Model Driven TelemarketingTechnical
- AIM: Manifold-based Data Filtering for Representation FinetuningTechnical
- AIR-DR: Adaptive Image Retargeting with Instance Relocation and Dual-guidance RepaintingTechnical
- ALERT: Adversarial Learning Enhanced Stability-aware Routing Transformer for Adaptive Depression DetectionTechnical
- ALEX:A Light Editing-knowledge ExtractorTechnical
- ALPHA: Action-Based Learning for Pluralistic Human Alignment in Large Language ModelsTechnical
- ALTER: Asymmetric LoRA for Token-Entropy-Guided Unlearning of LLMsTechnical
- AMS-IO-Bench and AMS-IO-Agent: Benchmarking and Structured Reasoning for Analog and Mixed-Signal Integrated Circuit Input/Output DesignTechnical
- AMS-KV: Adaptive KV Caching in Multi-Scale Visual Autoregressive TransformersTechnical
- AMaPO: Adaptive Margin-attached Preference Optimization for Language Model AlignmentTechnical
- APEX-Q: Arbitrary-dimension Product-EXtension Quantization for Accelerated LLM Deployment (Student Abstract)Technical
- APT: Affine Prototype-Timestamp for Time Series Forecasting Under Distribution ShiftTechnical
- APVR: Hour-Level Long Video Understanding with Adaptive Pivot Visual Information RetrievalTechnical
- AR-Nav Benchmark: Augmented Reality Navigation with Vision and LanguageTechnical
- ARBench: Algorithmic Reasoner or API Alchemist? Evaluating LLMs Beyond API CallsTechnical
- ARCHE: A Novel Task to Evaluate LLMs on Latent Reasoning Chain ExtractionTechnical
- ARDiff: Anisotropic Residual Diffusion for Heterogeneous Graph LearningTechnical
- ARGH-Mark: Anchor-Synchronized Watermarking with Hamming Correction for Robust and Quality-Preserving LLM AttributionTechnical
- ARGUS: Towards End-to-End Argument Mining with Large Language ModelsTechnical
- ARIW-Framework: Adaptive Robust Iterative Watermarking FrameworkTechnical
- ARNS: Adaptive Relation-Aware Negative Sampling with Curriculum Learning for Inductive Knowledge Graph CompletionTechnical
- ARQUSUMM: Argument-aware Quantitative Summarization of Online ConversationsTechnical
- ARTEM: Enhancing Large Language Model Agents with Spatial-Temporal Episodic MemoryTechnical
- ASCD: Attention-Steerable Contrastive Decoding for Reducing Hallucination in MLLMTechnical
- ASKD: Reinforcement Learning-Style Knowledge Distillation with Quality-Adaptive SkewnessTechnical
- ASSIST-3D: Adapted Scene Synthesis for Class-Agnostic 3D Instance SegmentationTechnical
- AStar: Boosting Multimodal Reasoning with Automated Structured ThinkingTechnical
- AT-Field: Rethinking the Games in Adversarial TrainingTechnical
- AURA: Affordance-Understanding and Risk-aware Alignment Technique for Large Language ModelsTechnical
- AURA: Development and Validation of an Augmented Unplanned Removal Alert System Using Synthetic ICU VideosTechnical
- AURORA: Augmented Understanding via Structured Reasoning and Reinforcement Learning for Reference Audio-Visual SegmentationTechnical
- AUVIC: Adversarial Unlearning of Visual Concepts for Multi-modal Large Language ModelsTechnical
- AV-Edit: Multimodal Generative Sound Effect Editing via Audio-Visual Semantic Joint ControlTechnical
- AV-SSAN: Audio-Visual Selective DOA Estimation Through Explicit Multi-Band Semantic-Spatial AlignmentTechnical
- AVM: Towards Structure-Preserving Neural Response Modeling in the Visual Cortex Across Stimuli and IndividualsTechnical
- AXON: Action Characterization Through Cross-Modal Knowledge Distillation for Neurodiverse IndividualsTechnical
- AbductiveMLLM: Boosting Visual Abductive Reasoning Within MLLMsTechnical
- AccKV: Towards Efficient Audio-Video LLMs Inference via Adaptive-Focusing and Cross-Calibration KV Cache OptimizationTechnical
- Accelerating Controllable Generation via Hybrid-grained CacheTechnical
- Accelerating LLM Inference Throughput via Asynchronous KV Cache PrefetchingTechnical
- Accommodate Knowledge Conflicts in Retrieval-augmented LLMs: Towards Robust Response Generation in the WildTechnical
- Achieving Equilibrium Under Utility Heterogeneity: An Agent-Attention Framework for Multi-Agent Multi-Objective Reinforcement LearningTechnical
- Achieving Fairness Without Harm via Selective Demographic ExpertsTechnical
- AcoustoReinforce: Multi-Particle Acoustophoretic Path Planning with Deep Reinforcement LearningTechnical
- ActiShade: Activating Overshadowed Knowledge to Guide Multi-Hop Reasoning in Large Language ModelsTechnical
- Action-and-object Aware Alignment for Partially Relevant Video RetrievalTechnical
- Activating Visual Context and Commonsense Reasoning Through Masked Prediction in VLMsTechnical
- Activation Manipulation Attack: Penetrating and Harmful Jailbreak Attack Against Large Vision-Language ModelsTechnical
- Activation-wise Propagation: A One-Timestep Strategy for Spiking Neural NetworksTechnical
- Activations as Features: Probing LLMs for Generalizable Essay Scoring RepresentationsTechnical
- Active Learning for Animal Re-Identification with Ambiguity-Aware SamplingTechnical
- Active Learning of Symbolic Automata over Rational NumbersTechnical
- Active Multi-source Domain Adaptation for Multimodal Fake News DetectionTechnical
- Active3D: Active High-Fidelity 3D Reconstruction via Multi-Level Uncertainty QuantificationTechnical
- Actor-Critic for Continuous Action Chunks: A Reinforcement Learning Framework for Long-Horizon Robotic Manipulation with Sparse RewardTechnical
- AdaCuRL: Adaptive Curriculum Reinforcement Learning with Invalid Sample Mitigation and Historical RevisitingTechnical
- AdaDepth: Exploiting Inherent Scene Information for Self-Supervised Depth Estimation in Dynamic ScenesTechnical
- AdaField: Generalizable Surface Pressure Modeling with Physics-Informed Pre-training and Flow-Conditioned AdaptationTechnical
- AdaFuse: Accelerating Dynamic Adapter Inference via Token-Level Pre-Gating and Fused Kernel OptimizationTechnical
- AdaMCoT: Rethinking Cross-Lingual Factual Reasoning Through Adaptive Multilingual Chain-of-ThoughtTechnical
- AdaReason: Progressive Training of Multi-LoRA Adapters for Budget-Adaptive Language Reasoning ModelsTechnical
- AdaSpec: Adaptive Multilingual Speculative Decoding with Self-Synthesized Language-Aware Training and Vocabulary SimplificationTechnical
- Adapt Before Continual LearningTechnical
- Adapt-As-You-Walk Through the Clouds: Training-Free Online Test-Time Adaptation of 3D Vision-Language Foundation ModelsTechnical
- AdaptCLIP: Adapting CLIP for Universal Visual Anomaly DetectionTechnical
- AdaptDiff: Adaptive Guidance in Diffusion Models for Diverse and Identity-Consistent Face Synthesis (Student Abstract)Technical
- AdaptJobRec: Enhancing Conversational Career Recommendation Through an LLM-Powered Agentic SystemTechnical
- Adapting Hybrid Parallel-Head Large Language Models for Southeast AsiaTechnical
- Adaptive AI for Personalized Intercultural Communication Education: A Conversational Agent Powered by Retrieval-Augmented Generation (Student Abstract)Technical
- Adaptive Agent Selection and Interaction Network for Image-to-Point Cloud RegistrationTechnical
- Adaptive Compute Efficient Learning via Conceptual-Criticality (Student Abstract)Technical
- Adaptive Coopetition: Leveraging Coarse Verifier Signals for Resilient Multi-Agent LLM Reasoning (Student Abstract)Technical
- Adaptive Coreset Selection via Uncertainty-Density for Efficient Spam Detection (Student Abstract)Technical
- Adaptive Diffusion-based Augmentation for RecommendationTechnical
- Adaptive Dynamic Dehazing via Instruction-Driven and Task-Feedback Closed-Loop Optimization for Diverse Downstream Task AdaptationTechnical
- Adaptive Evidential Learning for Temporal-Semantic Robustness in Moment RetrievalTechnical
- Adaptive Evolutionary Fusion for Multi-View ClusteringTechnical
- Adaptive Fidelity Estimation for Quantum Programs with Graph-Guided Noise AwarenessTechnical
- Adaptive Frequency Pathways for Spatiotemporal ForecastingTechnical
- Adaptive Graph Attention Based Discrete Hashing for Incomplete Cross-modal RetrievalTechnical
- Adaptive Hallucination Alleviation in Multimodal Large Language Models: From Strategic Data Selection to Severity-Guided TrainingTechnical
- Adaptive Hyperbolic Kernels: Modulated Embedding in de Branges-Rovnyak SpacesTechnical
- Adaptive Initial Residual Connections for GNNs with Theoretical GuaranteesTechnical
- Adaptive KL Control for Direct Preference Optimization in Instruction-Following LLMsTechnical
- Adaptive LiDAR Scanning: Harnessing Temporal Cues for Efficient 3D Object Detection via Multi-Modal FusionTechnical
- Adaptive Momentum and EMA-weighted Modeling for Imbalanced Label Distribution LearningTechnical
- Adaptive Morph-Patch Transformer for Aortic Vessel SegmentationTechnical
- Adaptive Piecewise Distillation for Efficient LiDAR Data GenerationTechnical
- Adaptive Regulation via Dual-Layer Evolution (ARDE): A Multi-Agent Approach to Balancing Efficiency, Fairness, and Diversity in Crowdsourced PlatformsTechnical
- Adaptive Riemannian Graph Neural NetworksTechnical
- Adaptive Theory of Mind for LLM-based Multi-Agent CoordinationTechnical
- Adaptive and Asymptotic Mean-based Subclass Discriminant AnalysisTechnical
- Adaptive and Context-rich Generative Self-supervised Learning on GraphsTechnical
- Adaptive-Learngene: Continual Expansion and Task-Aware Selection of Learngenes for Dynamic EnvironmentsTechnical
- Adaptive-Smooth LiDAR-Camera Knowledge Distillation with Heterogeneous Fusion for Multi-View 3D Object DetectionTechnical
- Addressing Polarization and Unfairness in Performative PredictionTechnical
- AdvBDGen: A Robust Framework for Generating Adaptive and Stealthy Backdoors in LLM AlignmentTechnical
- Advanced Black-Box Tuning of Large Language Models with Limited API CallsTechnical
- Advancing Out-of-Distribution Detection Across Diverse ScenariosTechnical
- Advancing Protein Design via Multi-Agent Reinforcement Learning with Pareto-Based Collaborative OptimizationTechnical
- Advancing Safe Mechanical Ventilation Using Offline RL with Hybrid Actions and Clinically Aligned RewardsTechnical
- Adversarial Attack on Black-Box Multi-Agent by Adaptive PerturbationTechnical
- Adversarial Fair Incomplete Multi-View ClusteringTechnical
- Adversarial Generation and Collaborative Evolution of Safety-Critical Scenarios for Autonomous VehiclesTechnical
- Adversarial Perturbation Shield: Preventing Concept Bleed-through in Continual Learning of Personalized Generative ModelsTechnical
- AerialFusion: Co-Motion-Driven Unified Registration and Fusion on Multi-modal Data Streams from Aerial ViewTechnical
- AerialMind: Towards Referring Multi-Object Tracking in UAV ScenariosTechnical
- AerialVLA: A Vision-Language-Action Model for Aerial Navigation with Online DialogueTechnical
- Affordance-Guided Coarse-to-Fine Exploration for Base Placement in Open-Vocabulary Mobile ManipulationTechnical
- Affordance-R1: Reinforcement Learning for Generalizable Affordance Reasoning in Multimodal Large Language ModelsTechnical
- Agent Journey Beyond RGB: Hierarchical Semantic-Spatial Representation Enrichment for Vision-and-Language NavigationTechnical
- Agent-SAMA: State-Aware Mobile AssistantTechnical
- AgentCDM: Enhancing Multi-Agent Collaborative Decision-Making via ACH-Inspired Structured ReasoningTechnical
- AgentGraph: Trace-to-Graph Platform for Interactive Analysis and Robustness Testing in Agentic AI SystemsTechnical
- AgentMental: An Interactive Multi-Agent Framework for Explainable and Adaptive Mental Health AssessmentTechnical
- AgentODRL: A Large Language Model-based Multi-agent System for ODRL GenerationTechnical
- AgentSeer: Visualizing and Evaluating Temporal Actions in Agentic AI SystemsTechnical
- AgentSense: Virtual Sensor Data Generation Using LLM Agents in Simulated Home EnvironmentsTechnical
- AgentSwift: Efficient LLM Agent Design via Value-Guided Hierarchical SearchTechnical
- Agentic Design Review SystemTechnical
- Agentic Solutions for IT Financial OperationsTechnical
- Agentmandering: A Game-Theoretic Framework for Fair Redistricting via Large Language Model AgentsTechnical
- Aggregate-Combine-Readout GNNs Can Express Logical Classifiers Beyond the Logic C2Technical
- Aggregating Diverse Cue Experts for AI-Generated Image DetectionTechnical
- AgriEval: A Comprehensive Chinese Agricultural Benchmark for Large Language ModelsTechnical
- AgroAskAI: A Multi-Agentic AI Framework for Supporting Smallholder Farmers’ Enquiries GloballyTechnical
- AirCopBench: A Benchmark for Multi-drone Collaborative Embodied Perception and ReasoningTechnical
- AirDDE: Multifactor Neural Delay Differential Equations for Air Quality ForecastingTechnical
- AirNavigation: Let UAV Navigation Tell Its Own StoryTechnical
- AirWino: Optimized Winograd Convolution for Accelerating CNN Inference on ARMv8 ProcessorsTechnical
- Alfa: Attentive Low-Rank Filter Adaptation for Structure-Aware Cross-Domain Personalized Gaze EstimationTechnical
- Algorithms for Context Engineering in LLM Inference: Optimization of Placement, Compression, and SchedulingTechnical
- Algorithms for Structured Elections Under Thiele Voting RulesTechnical
- Align When They Want, Complement When They Need! Human-Centered Ensembles for Adaptive Human-AI CollaborationTechnical
- Align to Structure: Aligning Large Language Models with Structural InformationTechnical
- AlignCVC: Aligning Cross-View Consistency for Single-Image-to-3D GenerationTechnical
- AlignSurvey: A Comprehensive Benchmark for Human Preferences Alignment in Social SurveysTechnical
- AlignTrack: Top-Down Spatiotemporal Resolution Alignment for RGB-Event Visual TrackingTechnical
- AlignTree: Efficient Defense Against LLM Jailbreak AttacksTechnical
- Aligning Attention with Human Rationales for Self-Explaining Hate Speech DetectionTechnical
- Aligning Cross-View Visual Geometries in LVLMs Through Human-Like Reasoning LearningTechnical
- Aligning Generative Music AI with Human Preferences: Methods and ChallengesTechnical
- Aligning Machiavellian Agents: Behavior Steering via Test-Time Policy ShapingTechnical
- Aligning the True Semantics: Constrained Decoupling and Distribution Sampling for Cross-Modal AlignmentTechnical
- Align³GR: Unified Multi-Level Alignment for LLM-based Generative RecommendationTechnical
- Always Refuse: Steering LLMs Against Jailbreaks with Contrastive Activations (Student Abstract)Technical
- Ambiguity-Tolerant Cross-Modal Hashing with Partial LabelsTechnical
- Ambiguity-aware Truncated Flow Matching for Ambiguous Medical Image SegmentationTechnical
- Amplifying Discrepancies: Exploiting Macro and Micro Inconsistencies for Image Manipulation LocalizationTechnical
- An Adaptive Configuration-Aware Simulated Annealing for the Maximally Diverse Grouping ProblemTechnical
- An Adaptive Sampling Framework for Diffusion-based Dataset Distillation with High Fidelity and DiversityTechnical
- An Approach Towards Developing Relationally Intelligent Multimodal Framework for Stock Movement Prediction (Student Abstract)Technical
- An Efficient and Harmonized Framework for Balanced Cross-Domain Feature IntegrationTechnical
- An Epistemic Perspective on Agent AwarenessTechnical
- An Explanation-Based Classroom Response System for Real-Time Analysis of Undergraduate Students’ Natural Language ExplanationsTechnical
- An External Fairness Evaluation of LinkedIn Talent SearchTechnical
- An Improved Privacy and Utility Analysis of Differentially Private SGD with Bounded Domain and Smooth LossesTechnical
- An Information Theoretic Evaluation Metric for Strong UnlearningTechnical
- An Interactive Simulation Framework by Ensemble Imitation Learning Agents for Training Robust Trading PoliciesTechnical
- An Invariant Latent Space Perspective on Language Model InversionTechnical
- An LLM-based Quantitative Framework for Evaluating High-Stealthy Backdoor Risks in OSS Supply ChainsTechnical
- An LLM-based Simulation Framework for Embodied Conversational Agents in Psychological CounselingTechnical
- An MRP Formulation for Supervised Learning: Generalized Temporal Difference Learning Models (Abstract Reprint)Technical
- Analysing Satellite Imagery Classification Under Spatial Domain Shift Across Geographic Regions (Abstract Reprint)Technical
- Analysis of Motivations in Machine Learning TextbooksTechnical
- Analyze–Compose–Execute: A Dynamic Dialogue Framework for Multi-Agent DebateTechnical
- Analyzing and Mitigating Object Hallucination: A Training Bias PerspectiveTechnical
- Anatomical Region-Guided Contrastive Decoding: A Plug-and-Play Strategy for Mitigating Hallucinations in Medical VLMsTechnical
- Anchor Watermark: Robust Attribution for Diffusion-based Text-to-Audio ModelTechnical
- Anchor-Driven Nyström for Deep Graph-Level ClusteringTechnical
- Anchor-Guided Discriminative Subspace Alignment and Clustering for Cross-Scene Hyperspectral ImageryTechnical
- AnchorDS: Anchoring Dynamic Sources for Semantically Consistent Text-to-3D GenerationTechnical
- AnchorHOI: Zero-shot Generation of 4D Human-Object Interaction via Anchor-based Prior DistillationTechnical
- AncientBench: Towards Comprehensive Evaluation on Excavated and Transmitted Chinese CorporaTechnical
- Angular Gradient Sign Method: Uncovering Vulnerabilities in Hyperbolic NetworksTechnical
- AniTales: End-to-End Multimodal Story Generation Through Natural Language Prompting (Student Abstract)Technical
- Annealed Relaxation of Speculative Decoding for Faster Autoregressive Image GenerationTechnical
- AnoStyler: Text-Driven Localized Anomaly Generation via Lightweight Style TransferTechnical
- Anomagic: Crossmodal Prompt-driven Zero-shot Anomaly GenerationTechnical
- AnomalyMoE: Towards a Language-free Generalist Model for Unified Visual Anomaly DetectionTechnical
- AnomalyPainter: Vision-Language-Diffusion Synergy for Realistic and Diverse Unseen Industrial Anomaly SynthesisTechnical
- Answering the Unanswerable Is to Err Knowingly: Analyzing and Mitigating Abstention Failures in Large Reasoning ModelsTechnical
- Anti-Avatar: Protect Against Unauthorized 3D Head Avatar Generation via Dual-Space DivergenceTechnical
- Anti-adversarial Learning: Desensitizing Prompts for Large Language ModelTechnical
- AntiDote: Bi-level Adversarial Training for Tamper-Resistant LLMsTechnical
- Any-Optical-Model: A Universal Foundation Model for Optical Remote SensingTechnical
- Any2Critical: Safety-Critical Scenario Generation from Arbitrary Real-World Driving ContextsTechnical
- Any2RSI: Controllable Remote Sensing Text-to-Image Generation via Any Control and Enriched DescriptionTechnical
- Aperiodic Tiling and Rhythmic Canons: A CP JourneyTechnical
- Apo2Mol: 3D Molecule Generation via Dynamic Pocket-Aware Diffusion ModelsTechnical
- Appearance Discrepancy-guided Sequence Hybrid Masking for Robust Scene Text RecognitionTechnical
- Appearance-Motion Decomposed Alignment for Text-Video RetrievalTechnical
- Approximately Envy-free and Equitable Allocations of Indivisible Items for Non-monotone ValuationsTechnical
- Approximating Problems in Abstract Argumentation with Graph Convolutional Networks (Abstract Reprint)Technical
- Approximation Algorithm for Constrained k-Center Clustering: A Local Search ApproachTechnical
- AquaSentinel: Next-Generation AI System Integrating Sensor Networks for Urban Underground Water Pipeline Anomaly Detection via Collaborative MoE-LLM Agent ArchitectureTechnical
- AquaSplatting: A Hybrid 3D Representation for Robust Underwater Scene Reconstruction via Dual-Branch RenderingTechnical
- Arbitrary-Scale 3D Gaussian Super-ResolutionTechnical
- ArchRAG: Attributed Community-based Hierarchical Retrieval-Augmented GenerationTechnical
- ArchetypeTrader: Reinforcement Learning for Selecting and Refining Learnable Strategic Archetypes in Quantitative TradingTechnical
- Are Graph Transformers Necessary? Efficient Long-Range Message Passing with Fractal Nodes in MPNNsTechnical
- Are Language Models Any Good at Density Modeling?Technical
- Are We on the Right Way to Assess Document Retrieval-Augmented Generation?Technical
- Area-Optimal Control Strategies for Heterogeneous Multi-Agent PursuitTechnical
- Argumentative Debates for Transparent Bias DetectionTechnical
- Artificial Immune System of Secure Face Recognition Against Adversarial Attacks (Abstract Reprint)Technical
- AsFT: Anchoring Safety During LLM Fine-Tuning Within Narrow Safety BasinTechnical
- Assemble Your Crew: Automatic Multi-agent Communication Topology Design via Autoregressive Graph GenerationTechnical
- Assessing Automated Fact-Checking for Medical LLM Responses with Knowledge GraphsTechnical
- Assessing LLMs for Serendipity Discovery in Knowledge Graphs: A Case for Drug RepurposingTechnical
- Assessing the Capabilities of LLMs in Humor: A Multi-dimensional Analysis of Oogiri Generation and EvaluationTechnical
- Assessing the Quality of AI-Generated Exams: A Large-Scale Field StudyTechnical
- Assessing the Risk of Falls in Older Adults Living in the Community Using Machine Learning Models with Imputation (Student Abstract)Technical
- AssetOpsBench-Live: Privacy-Aware Online Evaluation of Multi-Agent Performance in Industrial OperationsTechnical
- Assignment Problems in Cost Function NetworksTechnical
- Asymmetric Cross-Modal Knowledge Distillation: Bridging Modalities with Weak Semantic ConsistencyTechnical
- Asymptotic and Finite Sample Analysis of Nonexpansive Stochastic Approximations with Markovian NoiseTechnical
- Atom-level Adaptive Receptive Fields: A Pruning-Based Encoder for 2D Molecular Graphs (Student Abstract)Technical
- Attack the Messages, Not the Agents: A Multi-round Adaptive Stealthy Tampering Framework for LLM-MASTechnical
- Attention Retention for Continual Learning with Vision TransformersTechnical
- Attention to Threat-Relevant Objects: Reasoning Detection in Autonomous Driving via Multimodal Large Language ModelsTechnical
- Attentive Keypoint Identification: Progressive Spatiotemporal Refinement for Video-based Human Pose EstimationTechnical
- Attribute-guided Dynamic Prompt Learning for Graph Neural NetworksTechnical
- Attribution Analysis-based Concept Alignment: A Human-in-the-loop Data Debugging FrameworkTechnical
- Audio-Assisted Face Video Restoration with Temporal and Identity Complementary LearningTechnical
- Audio-Thinker: Guiding Large Audio Language Model When and How to Think via Reinforcement LearningTechnical
- AuditAgent: LLM Agent for Risks Auditing in Recommender SystemsTechnical
- Augmentation-invariant Learning Strategy via Data Augmentation for Improving Model GeneralizationTechnical
- Augmented Runtime Collaboration for Self-Organizing Multi-Agent Systems: A Hybrid Bi-Criteria Routing ApproachTechnical
- Augmenting Human Creativity with Machine LearningTechnical
- Augmenting Intra-Modal Understanding in MLLMs for Robust Multimodal Keyphrase GenerationTechnical
- AuthSig: Safeguarding Scanned Signatures Against Unauthorized Reuse in Paperless WorkflowsTechnical
- Authority Backdoor: A Certifiable Backdoor Mechanism for Authoring DNNsTechnical
- Auto-BenchmarkCard: Automated Synthesis of Benchmark DocumentationTechnical
- Auto-PRE: An Automatic and Cost-Efficient Peer-Review Framework for Language Generation EvaluationTechnical
- AutoGameUI: Constructing High-Fidelity GameUI via Multimodal Correspondence MatchingTechnical
- AutoLink: Autonomous Schema Exploration and Expansion for Scalable Schema Linking in Text-to-SQL at ScaleTechnical
- AutoMalDesc: Large-Scale Script Analysis for Cyber Threat ResearchTechnical
- AutoPP: Towards Automated Product Poster Generation and OptimizationTechnical
- AutoSCORE: Enhancing Automated Scoring with Multi-Agent Large Language Models via Structured Component RecognitionTechnical
- AutoSchA: Automatic Hierarchical Music Representations via Multi-Relational Node IsolationTechnical
- AutoTool: Efficient Tool Selection for Large Language Model AgentsTechnical
- AutoTuneX: Interactive Automated Fine-Tuning for Large Language ModelsTechnical
- Automata-less Monitoring via Trace-CheckingTechnical
- Automated Creation and Enrichment Framework for Improved Invocation of Enterprise APIs as ToolsTechnical
- Automated Human Strategic Behavior Modeling via Large Language ModelsTechnical
- Automated Multi-Camera Inspection System for AircraftTechnical
- Automated Repair of Totally-Ordered Hierarchical Task Network Domains via Context-Free Grammars with Large Language Model SupportTechnical
- Automated Unified Reasoning with Vision-Language Models for Multi-modal Burn AssessmentTechnical
- Automatic Channel Pruning by Searching with Structure Embedding for Hash NetworkTechnical
- Automatic Funny Scene Extraction from Long-form Cinematic VideosTechnical
- Automatic Paper Reviewing with Heterogeneous Graph Reasoning over LLM-Simulated Reviewer-Author DebatesTechnical
- Automatic Translational Correction of Multi-View Coronary Angiography Based on Auto-Annotation Data GenerationTechnical
- Automating Complex Document Workflows via Stepwise and Rollback-Enabled Operation OrchestrationTechnical
- Autonomous Concept Drift Threshold DeterminationTechnical
- Autonomous Partner Selection for Cooperative Multi-Agent Reinforcement LearningTechnical
- Autonomous Vehicle Path Planning by Searching with Differentiable SimulationTechnical
- Auxiliary Gene Learning: Spatial Gene Expression Estimation by Auxiliary Gene SelectionTechnical
- Aware Distillation for Robust Vision-Language Tracking Under Linguistic SparsityTechnical
- Aware First, Think Less: Dynamic Boundary Self-Awareness Drives Significant Gains in Reasoning Efficiency in Large Language ModelsTechnical
- Axis-Aligned Document DewarpingTechnical
- A²Flow: Automating Agentic Workflow Generation via Self-Adaptive Abstraction OperatorsTechnical
- A²LC: Active and Automated Label Correction for Semantic SegmentationTechnical
- BAG: Benchmarking Anomaly Detection on Dynamic GraphsTechnical
- BAMAS: Structuring Budget-Aware Multi-Agent SystemsTechnical
- BAT: Learning Event-based Optical Flow with Bidirectional Adaptive Temporal CorrelationTechnical
- BATIS: Bayesian Approaches for Targeted Improvement of Species Distribution ModelsTechnical
- BCE3S: Binary Cross-Entropy Based Tripartite Synergistic Learning for Long-Tailed RecognitionTechnical
- BCWildfire: A Long-term Multi-factor Dataset and Deep Learning Benchmark for Boreal Wildfire Risk PredictionTechnical
- BD-Net: Has Depth-Wise Convolution Ever Been Applied in Binary Neural Networks?Technical
- BDD2Seq: Enabling Scalable Reversible-Circuit Synthesis via Graph-to-Sequence LearningTechnical
- BDI-based Opponent Modeling and Strategy Generation for Multi-Issue Negotiation (Student Abstract)Technical
- BDLF-Qwen3: Enhanced Cross-Architecture Binary Function Similarity Detection Through Binary Dynamic Layer FusionTechnical
- BEE-RAG: Balanced Entropy Engineering for Retrieval-Augmented GenerationTechnical
- BEVDilation: LiDAR-Centric Multi-Modal Fusion for 3D Object DetectionTechnical
- BIQ: Bisection Interval Quantization for Communication-efficient Federated LearningTechnical
- BLADE: A Behavior-Level Data Augmentation Framework with Dual Fusion Modeling for Multi-Behavior Sequential RecommendationTechnical
- BLM-Guard: Explainable Multimodal Ad Moderation with Chain-of-Thought and Policy-Aligned RewardsTechnical
- BOFA: Bridge-Layer Orthogonal Low-Rank Fusion for CLIP-Based Class-Incremental LearningTechnical
- BREPS: Bounding-Box Robustness Evaluation of Promptable SegmentationTechnical
- BRI-MH: Behavioral Risk Index for Mental Health — An Interpretable Multimodal LLM-Augmented Framework (Student Abstract)Technical
- BRIC: Bridging Kinematic Plans and Physical Control at Test TimeTechnical
- BSAN: Behavioral State Attention Network for Modeling Mosquito Host-Seeking BehaviorTechnical
- BTPG-max: Achieving Local Maximal Bidirectional Pairs for Bidirectional Temporal Plan GraphsTechnical
- Backdoor Attacks on Open Vocabulary Object Detectors via Multi-Modal Prompt TuningTechnical
- Backdooring RationalizationTechnical
- Backtrace Mamba: Reviving Critical Temporal Contexts via Hierarchical Memory Compression for Online Action DetectionTechnical
- BadThink: Triggered Overthinking Attacks on Chain-of-Thought Reasoning in Large Language ModelsTechnical
- Balanced Knowledge Distillation for Large Language Models with Mix-of-ExpertsTechnical
- Balancing Accuracy and Efficiency in Multi-Turn Intent Classification for LLM-Powered Dialog Systems in ProductionTechnical
- Balancing Multimodal Domain Generalization via Gradient Modulation and ProjectionTechnical
- Balancing Scaffolding and Autonomy: A Case Study in Designing a Scalable Undergraduate Machine Learning Research CourseTechnical
- Balancing Signal and Variance: Adaptive Offline RL Post-Training for VLA Flow ModelsTechnical
- Bandit Learning in Housing MarketsTechnical
- Bant: Byzantine Antidote via Trial Function and Trust ScoresTechnical
- Bayes-Optimal Fair Classification with Multiple Sensitive FeaturesTechnical
- BayesAgent: Bayesian Agentic Reasoning Under Uncertainty via Verbalized Probabilistic Graphical ModelingTechnical
- BayesVQA: Energy-Guided Bayesian Debiasing for Language-Bias-Robust Visual Question AnsweringTechnical
- Bayesian Network Structural Consensus via Greedy Min-Cut AnalysisTechnical
- Bayesian Neural Networks for One-to-Many Mapping in Image EnhancementTechnical
- BeDKD: Backdoor Defense Based on Directional Mapping Module and Adversarial Knowledge DistillationTechnical
- Beautiful Images, Toxic Words: Understanding and Addressing Offensive Text in Generated ImagesTechnical
- Beetrap-MC: A Minecraft-Based AI Literacy Tool for Teaching Filter Bubbles to Middle School StudentsTechnical
- Behavior Regularization with Flow Latent Policy for Offline Reinforcement LearningTechnical
- Behavior Tokens Speak Louder: Disentangled Explainable Recommendation with Behavior VocabularyTechnical
- Behavioral-Similarity and Clustering-Based Methods for Static Graph Estimation in Hybrid GNNs (Student Abstract)Technical
- Behaviour Policy Optimization: Provably Lower Variance Return Estimates for Off-Policy Reinforcement LearningTechnical
- Belief-Driven Value Alignment for Human-Robot CollaborationTechnical
- Benchmarking LLMs for Political Science: A United Nations PerspectiveTechnical
- Benchmarking LLMs’ Mathematical Reasoning with Unseen Random Variables QuestionsTechnical
- Benchmarking Multimodal Knowledge Conflict for Large Multimodal ModelsTechnical
- Benchmarking Reinforcement Learning Algorithms for ICU Ventilator Settings: An Interpretable and Probabilistic Patient Environment for Doctor AgentsTechnical
- Benchmarking Trustworthiness in Multimodal LLMs for Video UnderstandingTechnical
- Benchmarking Visual LLMs Resilience to Unanswerable Questions on Visually Rich DocumentsTechnical
- Benchmarking XAI Explanations with Human-Aligned EvaluationsTechnical
- Benchmarking and Enhancing Rule Knowledge-Driven Reasoning of Large Language ModelsTechnical
- Best Arm Identification with Biased ContextsTechnical
- Best of Both Worlds Guarantees for Equitable AllocationsTechnical
- Best-Effort Policies for Robust Markov Decision ProcessesTechnical
- Beta Distribution Learning for Reliable Roadway Crash Risk AssessmentTechnical
- Better Datasets Start from RefineLab: Automatic Optimization for High-Quality Dataset RefinementTechnical
- Better Matching, Less Forgetting: A Quality-Guided Matcher for Transformer-based Incremental Object DetectionTechnical
- Beware of Reasoning Overconfidence: Pitfalls in the Reasoning Process for Multi-solution TasksTechnical
- Beyond Accuracy: A Cognitive Load Framework for Mapping the Capability Boundaries of Tool-use AgentsTechnical
- Beyond Adapter Retrieval: Latent Geometry-Preserving Composition via Sparse Task ProjectionTechnical
- Beyond Binary Classification: A Semi-supervised Approach to Generalized AI-generated Image DetectionTechnical
- Beyond Binary Erasure: Soft-Weighted Unlearning for Fairness and RobustnessTechnical
- Beyond Boundaries: Leveraging Vision Foundation Models for Source-Free Object DetectionTechnical
- Beyond Chains: Bridging Large Language Models and Knowledge Bases in Complex Question AnsweringTechnical
- Beyond Conservation: Flexible Molecular Assembly with Unbalanced Diffusion BridgeTechnical
- Beyond Content: A Comprehensive Speech Toxicity Dataset and Detection Framework Incorporating Paralinguistic CuesTechnical
- Beyond Cosine Similarity: Magnitude-Aware CLIP for No-Reference Image Quality AssessmentTechnical
- Beyond Counting: Evaluating Abstract and Emotional Reasoning in Vision-Language ModelsTechnical
- Beyond Detection: Exploring Evidence-based Multi-Agent Debate for Misinformation Intervention and PersuasionTechnical
- Beyond Euclidean Assumptions: Geometry-Aware Adaptive Routing for Remote Sensing SegmentationTechnical
- Beyond Fact Retrieval: Episodic Memory for RAG with Generative Semantic WorkspacesTechnical
- Beyond Fixed Depth: Adaptive Graph Neural Networks for Node Classification Under Varying HomophilyTechnical
- Beyond Fixed Tasks: Unsupervised Environment Design for Task-Level PairsTechnical
- Beyond Fully Supervised Pixel Annotations: Scribble-Driven Weakly-Supervised Framework for Image Manipulation LocalizationTechnical
- Beyond Graph Priors: A Co-Evolving Framework Under Uncertainty for Enterprise Resilience AssessmentTechnical
- Beyond Illumination: Fine-Grained Detail Preservation in Extreme Dark Image RestorationTechnical
- Beyond Immediate Activation: Temporally Decoupled Backdoor Attacks on Time Series ForecastingTechnical
- Beyond I’m Sorry, I Can’t: Dissecting Large-Language-Model RefusalTechnical
- Beyond Local Patterns: Multiscale Inconsistency Learning for Graph Anomaly DetectionTechnical
- Beyond MSE: Ordinal Cross-Entropy for Probabilistic Time Series ForecastingTechnical
- Beyond Missing Data Imputation: Information-Theoretic Coupling of Missingness and Class Imbalance for Optimal Irregular Time Series ClassificationTechnical
- Beyond Monotonicity: Revisiting Factorization Principles in Multi-Agent Q-LearningTechnical
- Beyond N-grams: A Hierarchical Reward Learning Framework for Clinically-Aware Medical Report GenerationTechnical
- Beyond Neuron-Level Sparsity: Achieving Faithful and Interpretable LLMs with Mixture of DecodersTechnical
- Beyond Next Token Probabilities: Learnable, Fast Detection of Hallucinations and Data Contamination on LLM Output DistributionsTechnical
- Beyond Observations: Reconstruction Error-Guided Irregularly Sampled Time Series Representation LearningTechnical
- Beyond Passive Critical Thinking: Fostering Proactive Questioning to Enhance Human-AI CollaborationTechnical
- Beyond Patches: Mining Interpretable Part-Prototypes for Explainable AITechnical
- Beyond Perplexity: Let the Reader Select Retrieval Summaries via Spectrum Projection ScoreTechnical
- Beyond Plain Demos: A Demo-Centric Anchoring Paradigm for In-Context Learning in Alzheimer’s Disease DetectionTechnical
- Beyond Predictive Resampling: Learning Input-Agnostic Downsampling for Efficient Aligned Vision RecognitionTechnical
- Beyond Prompting: AI Safety Education in the Generative AI EraTechnical
- Beyond Quadratic: Linear-Time Change Detection with RWKVTechnical
- Beyond ReAct: A Planner-Centric Framework for Complex Tool-Augmented LLM ReasoningTechnical
- Beyond Retraining: Training-Free Unknown Class Filtering for Source-Free Open Set Domain Adaptation of Vision–Language ModelsTechnical
- Beyond Semantic Features: Pixel-level Mapping for Generalized AI-Generated Image DetectionTechnical
- Beyond Sharpness: A Flatness Decomposition Framework for Efficient Continual LearningTechnical
- Beyond Sharpness: The Role of Nonuniformity in GeneralizationTechnical
- Beyond Simple Edits: X-Planner for Complex Instruction-Based Image EditingTechnical
- Beyond Single Transactions: D-EMAML---Dual-Edge Motif Neural Networks for Enhanced Anti-Money Laundering DetectionTechnical
- Beyond Single-Point Perturbation: A Hierarchical, Manifold-Aware Approach to Diffusion AttacksTechnical
- Beyond Single-Speed Reasoning: Coordinating Fast and Slow Dynamics for Efficient World ModelingTechnical
- Beyond Single-Step Updates: Reinforcement Learning of Heuristics with Limited-Horizon SearchTechnical
- Beyond Static: Related Questions Retrieval Through Conversations in Community Question AnsweringTechnical
- Beyond Step Pruning: Information Theory Based Step-level Optimization for Self-Refining Large Language ModelsTechnical
- Beyond Superficial Forgetting: Thorough Unlearning Through Knowledge Density Estimation and Block Re-InsertionTechnical
- Beyond Tokens: Dynamic Latent Reasoning via Semantic Residual RefinementTechnical
- Beyond Training-time Poisoning: Component-level and Post-training Backdoors in Deep Reinforcement LearningTechnical
- Beyond Transcription: Mechanistic Interpretability in ASRTechnical
- Beyond Verdicts: Evaluating Language Model Moral CompetenceTechnical
- Beyond Wide-Angle Images: Structure-to-Detail Video Portrait Correction via Unsupervised Spatiotemporal AdaptationTechnical
- Beyond World Models: Rethinking Understanding in AI ModelsTechnical
- Beyond the Black Box: Demystifying Multi-Turn LLM Reasoning with VISTATechnical
- Beyond the Horizon: Decoupling Multi-View UAV Action Recognition via Partial Order TransferTechnical
- Beyond the Lower Bound: Bridging Regret Minimization and Best Arm Identification in Lexicographic BanditsTechnical
- Beyond the Mean: Fisher-Orthogonal Projection for Natural Gradient Descent in Large Batch TrainingTechnical
- BeyondSparse: Facilitating Mamba to Enhance Cross-Domain 3D Semantic Segmentation in Adverse WeatherTechnical
- BhashaKritika: Building Synthetic Pretraining Data at Scale for Indic LanguagesTechnical
- Bi-Level Contextual Bandits for Individualized Resource Allocation Under Delayed FeedbackTechnical
- Bi-Level Preference Optimization for Retrieval-Augmented Generation (Student Abstract)Technical
- Bi-Spectrum Distillation: Addressing Spectral Mismatch in ANN-SNN Knowledge TransferTechnical
- Bi-VLM: Binary Post-Training Quantization for Vision-Language ModelsTechnical
- Bi-level Personalization for Federated Foundation Models: A Task-vector Aggregation ApproachTechnical
- BiCA: Effective Biomedical Dense Retrieval with Citation-Aware Hard NegativesTechnical
- BiCycle: Group-wise Recursive Transformer Based on ASR MechanismTechnical
- BiHiTo: Biomolecular Hierarchy-inspired TokenizationTechnical
- BiO-HMC: Dynamic Human-Machine Collaboration for Consensus Decision-Making via Bilevel OptimizationTechnical
- BiST-Mamba: A Dual-branch Spatio-Temporal Mamba Network for Encrypted Traffic Classification (Student Abstract)Technical
- Bias Association Discovery Framework for Open-Ended LLM GenerationsTechnical
- Bias-Restrained Prefix Representation Finetuning for Mathematical ReasoningTechnical
- Bid Farewell to Seesaw: Towards Accurate Long-Tail Session-Based Recommendation via Dual Constraints of Hybrid IntentsTechnical
- BidMatch: Boosting Semi-Supervised Learning by Bi-Dimensional Sample Weight GuidanceTechnical
- Bidirectional Bounded-Suboptimal Heuristic Search with Consistent HeuristicsTechnical
- Bidirectional Channel-selective Semantic Interaction for Semi-Supervised Medical SegmentationTechnical
- Bidirectional Counterfactual Distillation for Review-Based RecommendationTechnical
- Bidirectional Noise Injection: Enhancing Diffusion Models via Coordinated Input-Output PerturbationTechnical
- Bilevel MCTS for Amortized O(1) Node Selection in Classical PlanningTechnical
- Binary Message Passing for Generalizable Semi-Supervised Graph Anomaly DetectionTechnical
- Binary Split Categorical Feature with Mean Absolute Error Criteria in CARTTechnical
- Binary-Gaussian: Compact and Progressive Representation for 3D Gaussian SegmentationTechnical
- BioDPP: Dynamic Prompt Policy Learning for Biomedical Vision-Language ModelsTechnical
- Biologically-Inspired Evolutionary Domain Symbiosis for Few-shot and Zero-shot Point Cloud Semantic SegmentationTechnical
- Bipartite Mode Matching for Vision Training Set Search from a Hierarchical Data ServerTechnical
- BitDP: Ultra-low-bit Communication for Data Parallelism in LLM TrainingTechnical
- Blessing of Dimensionality for Approximating Sobolev Classes on ManifoldsTechnical
- Blur-Robust Detection via Feature Restoration: An End-to-End Framework for Prior-Guided Infrared UAV Target DetectionTechnical
- BokehCrafter: Taming Video Diffusion Models for Controllable Bokeh RenderingTechnical
- BokehFlow: Depth-Free Controllable Bokeh Rendering via Flow MatchingTechnical
- Bolster Hallucination Detection via Prompt-Guided Data AugmentationTechnical
- Bonsai: Interpretable Tree-Adaptive Grounded ReasoningTechnical
- Boomda: Balanced Multi-objective Optimization for Multimodal Domain AdaptationTechnical
- Boosting ASR Robustness via Test-Time Reinforcement Learning with Audio-Text Semantic RewardsTechnical
- Boosting Adversarial Transferability via Ensemble Non-AttentionTechnical
- Boosting Cross-problem Generalization in Diffusion-Based Neural Combinatorial Solver via Inference Time AdaptationTechnical
- Boosting Fine-Grained Urban Flow Inference via Lightweight Architecture and Focalized OptimizationTechnical
- Boosting Noisy Correspondence Discrimination via Dynamic Neighborhood Semantic VerificationTechnical
- Boosting Resolution Generalization of Diffusion Transformers with Randomized Positional EncodingsTechnical
- Boosting the Robustness-Accuracy Trade-off of SNNs by Robust Temporal Self-EnsembleTechnical
- Bootstrapping LLMs via Preference-Based Policy OptimizationTechnical
- Bootstrapping Personalized Insulin Therapy via Model-Based Reinforcement Learning: An In Silico StudyTechnical
- Bot Blitz: A Scalable Hands-On Workshop for Teaching AI and Robotics Concepts Through Narrative-Driven Problem SolvingTechnical
- Bot Meets Shortcut: How Can LLMs Aid in Handling Unknown Invariance OOD Scenarios?Technical
- BraSTORM: A Dual-Branch Self-Supervised Framework for EEG Representation Learning via Input-Level Spatio-Temporal DecompositionTechnical
- BrainHGT: A Hierarchical Graph Transformer for Interpretable Brain Network AnalysisTechnical
- BrainLMM: A Label-Free Framework for Mapping Multi-Semantic Representation in the Human Visual CortexTechnical
- Brains vs. Algorithms? How Experts and Students See AI-Generated DistractorsTechnical
- Branch, or Layer? Zeroth-Order Optimization for Continual Learning of Vision-Language ModelsTechnical
- Breadth-First Search vs. Restarting Random Walks for Escaping Uninformed Heuristic RegionsTechnical
- Break the Tie: Learning Cluster-Customized Category Relationships for Categorical Data ClusteringTechnical
- Breakable Machine: A K–12 Classroom Game for Transformative AI Literacy Through Spoofing and eXplainable AI (XAI)Technical
- Breaking Alignment Barriers: TPS-Driven Semantic Correlation Learning for Alignment-Free RGB-T Salient Object DetectionTechnical
- Breaking Barriers, Finding Boundaries: Not Obviously Manipulable Budget-Feasible Mechanism DesignTechnical
- Breaking Cross-View Associations: Byzantine Model Poisoning Attack against Vertical Federated LearningTechnical
- Breaking Down Market Barriers: Distilled Prompt-Tuning Approach for Cross-Market RecommendationTechnical
- Breaking Measurement Barriers: From Compressed Sensing to Deep ReconstructionTechnical
- Breaking Model Lock-in: Cost-Efficient Zero-Shot LLM Routing via a Universal Latent SpaceTechnical
- Breaking One-Size-Fits-All: Revisiting Out-of-Distribution Detection on Graphs Under Diverse Distribution ShiftsTechnical
- Breaking Task Boundaries: A Unified Model for 3D Medical Image Fusion and Segmentation Guided by Manifold PerspectiveTechnical
- Breaking the Adversarial Robustness-Performance Trade-off in Text Classification via Manifold PurificationTechnical
- Breaking the Aggregation Bottleneck in Federated Recommendation: A Personalized Model Merging ApproachTechnical
- Breaking the Dyadic Barrier: Rethinking Fairness in Link Prediction Beyond Demographic ParityTechnical
- Breaking the Modality Barrier: Generative Modeling for Accurate Molecule Retrieval from Mass SpectraTechnical
- Breaking the Passive Learning Trap: An Active Perception Strategy for Human Motion PredictionTechnical
- Breaking the Resource Monopoly: LLM Post-Training and Serving with Modest Data and ComputeTechnical
- Breaking the Stealth-Potency Trade-off in Clean-Image Backdoors with Generative Trigger OptimizationTechnical
- Breaking the Trade-Off Between Faithfulness and Expressiveness for Large Language ModelsTechnical
- BridgeShape: Latent Diffusion Schrödinger Bridge for 3D Shape CompletionTechnical
- Bridging Cognitive Gap: Hierarchical Description Learning for Artistic Image Aesthetics AssessmentTechnical
- Bridging Day and Night: Target-Class Hallucination Suppression in Unpaired Image TranslationTechnical
- Bridging Granularity Gaps: Hierarchical Semantic Learning for Cross-domain Few-shot SegmentationTechnical
- Bridging Machine Learning and Physics for Scalable Long-Term Building Temperature Prediction (Student Abstract)Technical
- Bridging Modalities via Progressive Re-alignment for Multimodal Test-Time AdaptationTechnical
- Bridging Optimization and Neural Networks for Efficient Multi-view ClusteringTechnical
- Bridging Public Health with Clinical Decisions from a Data Centric PerspectiveTechnical
- Bridging Scale Discrepancies in Robotic Control via Language-Based Action RepresentationsTechnical
- Bridging Synthetic and Real Routing Problems via LLM-Guided Instance Generation and Progressive AdaptationTechnical
- Bridging Vision and Language for Robust Context-Aware Surgical Point Tracking: The VL-SurgPT Dataset and BenchmarkTechnical
- Bridging the Copyright Gap: Do Large Vision-Language Models Recognize and Respect Copyrighted Content?Technical
- Bridging the Language Gap: Uncovering and Aligning Shared Circuits for Multi-Hop Reasoning in Multilingual LLMsTechnical
- Bridging the Modality Reliability Gap in Drug-Target Interaction Prediction via a Confidence-aware Multimodal Fusion FrameworkTechnical
- Bridging the Skills Gap: A Course Model for Modern Generative AI EducationTechnical
- Bridging the Tokenizer Gap: Semantics and Distribution-aware Knowledge Transfer for Unbiased Cross-Tokenizer DistillationTechnical
- Bring Your Dreams to Life: Continual Text-to-Video CustomizationTechnical
- Brownian Bridge Augmented Surrogate Simulation and Injection Planning for Geological CO2 StorageTechnical
- Budgeted Online Active Learning with Expert Advice and Episodic PriorsTechnical
- BugSweeper: Function-Level Detection of Smart Contract Vulnerabilities Using Graph Neural NetworksTechnical
- Building AI Hardware Expertise: Edge AI Curriculum Design and Implementation in German UniversitiesTechnical
- Building Domain-Specific Small Language Models via Guided Data GenerationTechnical
- Building Instance Segmentation for Dense Urban SettlementsTechnical
- Building Interpretable, Trust-worthy Systems for Neural Signal DecodingTechnical
- BuildingWorld: A Structured 3D Building Dataset for Urban Foundation ModelsTechnical
- BulletTime4D: Towards High Spatio-Temporal Resolution Dynamic Scene Rendering via Spike-Guided Stereo VisionTechnical
- Burst Image Quality Assessment: A New Benchmark and Unified Framework for Multiple Downstream TasksTechnical
- C-GNN-PRUNE: A Unified Graph-Based Framework for Structure-Aware Pruning of Mixture-of-Experts ModelsTechnical
- C2R-KD: Complex to Real Knowledge Distillation (Student Abstract)Technical
- C3RL: Rethinking the Combination of Channel-independence and Channel-mixing from Representation LearningTechnical
- CABTO: Context-Aware Behavior Tree Grounding for Robot ManipulationTechnical
- CAD-VAE: Leveraging Correlation-Aware Latents for Comprehensive Fair DisentanglementTechnical
- CADTrack: Learning Contextual Aggregation with Deformable Alignment for Robust RGBT TrackingTechnical
- CADiff: Context-Aware Diffusion for Controllable Anomaly Generation in Anomaly DetectionTechnical
- CAFU: Constrained Alignment and Filtered Uniformity for Denoising RecommendationTechnical
- CAG-GS: Consistent Anchor Guided Gaussian Splatting for Large-scale Scene RenderingTechnical
- CAMA: Enhancing Mathematical Reasoning in Large Language Models with Causal KnowledgeTechnical
- CAMAR: Continuous Actions Multi-Agent RoutingTechnical
- CAMERA: Multi-Matrix Joint Compression for MoE Models via Micro-Expert Redundancy AnalysisTechnical
- CANDI: Curated Test-Time Adaptation for Multivariate Time-Series Anomaly Detection Under Distribution ShiftTechnical
- CANVAS: A Benchmark for Vision-Language Models on Tool-Based User Interface DesignTechnical
- CAPO: A Unified Policy Gradient Approach for Reward and Cost Optimization in Safe Reinforcement Learning (Student Abstract)Technical
- CARE-Bench: A Benchmark of Diverse Client Simulations Guided by Expert Principles for Evaluating LLMs in Psychological CounselingTechnical
- CART: Compositional AutoRegressive Transformer for Image GenerationTechnical
- CASL: Curvature-Augmented Self-supervised Learning for 3D Anomaly DetectionTechnical
- CAST-LUT: Tokenizer-Guided HSV Look-Up Tables for Purple Flare RemovalTechnical
- CAT-Net: A Cross-Attention Tone Network for Cross-Subject EEG-EMG Fusion Tone DecodingTechnical
- CATAL: Causally Disentangled Task Representation Learning for Offline Meta-Reinforcement LearningTechnical
- CATCH: A Controllable Theme Detection Framework with Contextualized Clustering and Hierarchical GenerationTechnical
- CATP: Contextually Adaptive Token Pruning for Efficient and Enhanced Multimodal In-Context LearningTechnical
- CATS: Category-Aware Token-level Steering for Training-Free Redundancy Reduction in Large Reasoning ModelsTechnical
- CCAHCL: Multi-Level Hypergraph Contrastive Learning for Connected Component AwarenessTechnical
- CCD-Bench: Probing Cultural Conflict in Large Language Model Decision-MakingTechnical
- CCFQA: A Benchmark for Cross-Lingual and Cross-Modal Speech and Text Factuality EvaluationTechnical
- CD-DPE: Dual-Prompt Expert Network Based on Convolutional Dictionary Feature Decoupling for Multi-Contrast MRI Super-ResolutionTechnical
- CEC-Zero: Zero-Supervision Character Error Correction with Self-Generated RewardsTechnical
- CGMIS: Concept-Graph Based Multi-Hop Instructions Synthesis for Enhancing Long-Context ReasoningTechnical
- CHARM: Collaborative Harmonization Across Arbitrary Modalities for Modality-Agnostic Semantic SegmentationTechnical
- CHASE: Contextual History for Adaptive and Simple Exploitation in Large Language Model JailbreakingTechnical
- CHDP: Cooperative Hybrid Diffusion Policies for Reinforcement Learning in Parameterized Action SpaceTechnical
- CHIMERA: Controllable High-quality Image-Mask Extraction for Reliable Diffusion-based Anomaly SynthesisTechnical
- CIA: Cluster-Instance Alignment for Unsupervised Day-Night Vehicle Re-IdentificationTechnical
- CIP-Net: Continual Interpretable Prototype-based NetworkTechnical
- CKDA: Cross-modality Knowledge Disentanglement and Alignment for Visible-Infrared Lifelong Person Re-identificationTechnical
- CL-DMDF: Dynamic Multimodal Data Fusion Model Based on Contrastive LearningTechnical
- CL-Guard: Defending DNNs Against Backdoors via Fine-Grained Neuron Analysis and Collaborative Dual-Network LearningTechnical
- CLASP: Cross-modal Salient Anchor-based Semantic Propagation for Weakly-supervised Dense Audio-Visual Event LocalizationTechnical
- CLEAR: Error Analysis via LLM-as-a-Judge Made EasyTechnical
- CLER: Improving Multimodal Financial Reasoning by Cross-MLLM Error ReflectionTechnical
- CLIP-FTI: Fine-Grained Face Template Inversion via CLIP-Driven Attribute ConditioningTechnical
- CLIP2Pose: Frozen CLIP as Semantic Guide for Domain Adaptive Pose EstimationTechnical
- CLIPDet3D: Vision-Language Collaborative Distillation for 3D Object DetectionTechnical
- CLIPPan: Adapting CLIP as a Supervisor for Unsupervised PansharpeningTechnical
- CLM-Access: A Specialized Foundation Model for High-Dimensional Single-Cell ATAC-Seq AnalysisTechnical
- CLUENet: Cluster Attention Makes Neural Networks Have EyesTechnical
- CLUHCS:Dual-View Contrastive Learning Enabled Unsupervised Heterogeneous Community Search with Meta-Path Behavior ModelingTechnical
- CMID: Towards Medical Visual Question Answering via Contrastive Mutual Information DecodingTechnical
- CMMCoT: Enhancing Complex Multi-Image Comprehension via Multi-Modal Chain-of-Thought and Memory AugmentationTechnical
- CMedBench: A Comprehensive Benchmark for Efficient Medical Large Language ModelsTechnical
- CNM-UNet: Continuous Ordinary Differential Equations for Medical Image SegmentationTechnical
- CO-Bench: Benchmarking Language Model Agents in Algorithm Search for Combinatorial OptimizationTechnical
- CO2-Meter: A Comprehensive Carbon Footprint Estimator for LLMs on Edge DevicesTechnical
- CODEI: Resource-Efficient Task-Driven Co-Design of Perception and Decision Making for Mobile Robots Applied to Autonomous Vehicles (Abstract Reprint)Technical
- COGS: A Causal Representation Learning Framework for Out-of-Distribution Generalization in Time SeriesTechnical
- COIN: Uncertainty-Guarding Selective Question Answering for Foundation Models with Provable Risk GuaranteesTechnical
- COSMOS: Coherent SuperGaussian Modeling with Spatial Priors for Sparse-View 3D SplattingTechnical
- COVR: Collaborative Optimization of VLMs and RL Agent for Visual-Based ControlTechnical
- CO²IF: Language-Bridging Hyperspectral-Multispectral Image Fusion with Coordinated and Cross-modal Optimal TransportTechnical
- CP-CLIP: Customized Parameter Generation for Open-vocabulary Semantic SegmentationTechnical
- CP-FREEZER: Latency Attacks Against Vehicular Cooperative PerceptionTechnical
- CP-Router: An Uncertainty-Aware Router Between LLM and LRMTechnical
- CP-Search: A Chain Progressive Search Training Framework Incentivizing the Cognitive Behaviors for Searching in LLMsTechnical
- CPOStream: Collaborating Prediction and Observation for Flicker-Free Streamable Free-Viewpoint Video with 3DGSTechnical
- CRAF: A Clinical Reasoning-Adaptive Framework via Reinforcement Learning for Similar Case RetrievalTechnical
- CRIME: Community Rewiring for Influence and Masking Entities in Social Networks (Student Abstract)Technical
- CRISP: Curriculum-Inducing Primitive Informed Subgoal Prediction for Boosting Hierarchical Reinforcement LearningTechnical
- CR³: Boosting Compositional Reasoning in MLLMs Through Rule-Based Reinforcement LearningTechnical
- CSP4SDG: Constraint and Information-Theory Based Role Identification in Social Deduction Games with LLM-Enhanced InferenceTechnical
- CTPD: Cross Tokenizer Preference DistillationTechnical
- CTX-Coder: Cross-Attention Architectures Empower LLMs for Long-Context Vulnerability DetectionTechnical
- CaPro: Curvilinear-aware Prompt Learning with Single Unlabeled Image for Cost-effective Curvilinear Structure SegmentationTechnical
- CaT-Diff: Cascaded Text-enhanced Diffusion Model for Time-Series ImputationTechnical
- CaTFormer: Causal Temporal Transformer with Dynamic Contextual Fusion for Driving Intention PredictionTechnical
- Calibrating Reliance: Addressing Misuse and Disuse in AI-Based Second-Opinion Systems for Medical DiagnosisTechnical
- Calibrating and Rotating: A Unified Framework for Weight Conditioning in PEFTTechnical
- Can Editing LLMs Inject Harm?Technical
- Can Humans Teach Machines to Code?Technical
- Can LLMs Detect Their Confabulations? Estimating Reliability in Uncertainty-Aware Language ModelsTechnical
- Can LLMs Identify Tax Abuse?Technical
- Can LLMs Truly Embody Human Personality? Analyzing AI and Human Behavior Alignment in Dispute ResolutionTechnical
- Can Large Language Models Grasp 3D Medical Anatomy Shapes? (Student Abstract)Technical
- Can Molecular Evolution Mechanism Enhance Molecular Representation?Technical
- Can Protective Watermarking Safeguard the Copyright of 3D Gaussian Splatting?Technical
- Can Pseudo-Label Be More Reliable? A Simple yet Effective Topology-Aware Graph Self-Training MethodTechnical
- Can You Tell the Difference? Contrastive Explanations for ABox EntailmentsTechnical
- Can You Trust What I Think? Analyzing and Improving Verbalized Uncertainty and Factuality in Reasoning-Based Large Language ModelsTechnical
- Cancer Survival Prediction by Cyclic Generation and Multi-grained AlignmentTechnical
- Capacity Constraints Make Admissions Processes Less PredictableTechnical
- CapeNext: Rethinking and Refining Dynamic Support Information for Category-Agnostic Pose EstimationTechnical
- Caption Anything in Video: Fine-grained Object-centric Captioning via Spatiotemporal Multimodal PromptingTechnical
- Capturing Dynamic User Interests Under Modality Imbalance for Multimodal Sequential RecommendationTechnical
- CareCom: Generative Image Composition with Calibrated Reference FeaturesTechnical
- Careful Queries, Credible Results: Teaching RAG Models Advanced Web Search Tools with Reinforcement LearningTechnical
- CasMoE: A Cascaded Framework for Efficient MoE Inference on Resource-constrained DevicesTechnical
- CastX: Cohort-Level Causal Inference Meets Statistical Testing for Faithful and Reliable GNN ExplanationsTechnical
- Catastrophic Forgetting in Kolmogorov-Arnold NetworksTechnical
- Catching the First Light of Tomorrow: A Hackathon-Based Framework for Introducing High School Students to AI AgentsTechnical
- CauVQ: Causal Vector Quantization for Graph OOD GeneralizationTechnical
- Causal Decoupling Domain Generalization for Remote Sensing Change DetectionTechnical
- Causal Discovery from Interval-Based Event SequencesTechnical
- Causal Explanations for Sequential Decision Making (Abstract Reprint)Technical
- Causal Inference Under Threshold Manipulation: Bayesian Mixture Modeling and Heterogeneous Treatment EffectsTechnical
- Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor CorrectionTechnical
- Causal Structure Learning for Dynamical Systems with Theoretical Score AnalysisTechnical
- Causal Tracing of Object Representations in Large Vision Language Models: Mechanistic Interpretability and Hallucination MitigationTechnical
- Causal, Strategic, and Combined Responsibility Attribution in Situation Calculus Concurrent Game StructuresTechnical
- Causal-ERC: A Multimodal Framework with Causal Prompting for Emotion Recognition in Conversations with Large Language ModelsTechnical
- Causal-HalBench: Uncovering LVLMs Object Hallucinations Through Causal InterventionTechnical
- Causal-LLM: Towards Predictive and Interpretable Spatiotemporal Foundation ModelsTechnical
- Causal-Tune: Mining Causal Factors from Vision Foundation Models for Domain Generalized Semantic SegmentationTechnical
- CausalCLIP: Causally-Informed Feature Disentanglement and Filtering for Generalizable Detection of Generated ImagesTechnical
- CausalPulse: Agentic Copilot for Root Cause Analysis in Smart ManufacturingTechnical
- CausalStep: A Benchmark for Explicit Stepwise Causal Reasoning in VideosTechnical
- CausalTrace: A Neurosymbolic Causal Analysis Agent for Smart ManufacturingTechnical
- Causality Matters: How Temporal Information Emerges in Video Language ModelsTechnical
- Causality-Aligned Semantic Recovery for Incomplete Cross-Modal RetrievalTechnical
- Causality-Aware Efficient Exploration for Cooperative Multi-Agent Reinforcement LearningTechnical
- Causality-inspired Federated Learning for Dynamic Spatio-Temporal GraphsTechnical
- Causally-Aware Attribute Completion for Incomplete Federated Graph ClusteringTechnical
- Causally-Grounded Dual-Path Attention Intervention for Object Hallucination Mitigation in LVLMsTechnical
- CellStream: Dynamical Optimal Transport Informed Embeddings for Reconstructing Cellular Trajectories from Snapshots DataTechnical
- Center-Outward q-Dominance: A Sample-Computable Proxy for Strong Stochastic Dominance in Stochastic Multi-Objective OptimisationTechnical
- Centralized Group Equitability and Individual Envy-Freeness in the Allocation of Indivisible ItemsTechnical
- Centralized Training with Hybrid Execution in Multi-Agent Reinforcement Learning via Predictive Observation Imputation (Abstract Reprint)Technical
- CertMask: Certifiable Defense Against Adversarial Patches via Theoretically Optimal Mask CoverageTechnical
- Certified Branch-and-Bound MaxSAT SolvingTechnical
- Certified L2-Norm Robustness of 3D Point Cloud Recognition in the Frequency DomainTechnical
- Certified but Fooled! Breaking Certified Defenses with Ghost CertificatesTechnical
- Chain-of-Search: Parameter-Efficient Reasoning for Zero-Shot Object NavigationTechnical
- Chain-of-Thought Driven Adversarial Scenario Extrapolation for Robust Language ModelsTechnical
- Channel-masked Asymmetric Distribution Matching for Cross-Domain Generalized Dataset DistillationTechnical
- CharBench: Evaluating the Role of Tokenization in Character-Level TasksTechnical
- Characterizing AI Manipulation Risks in Brazilian YouTube Climate DiscourseTechnical
- ChartEditor: A Reinforcement Learning Framework for Robust Chart EditingTechnical
- ChatCLIDS: Simulating Persuasive AI Dialogues to Promote Closed-Loop Insulin Adoption in Type 1 Diabetes CareTechnical
- Chatsparent: An Interactive System for Detecting and Mitigating Cognitive Fatigue in LLMsTechnical
- Cheating Stereo Matching in Full-Scale: Physical Adversarial Attack Against Binocular Depth Estimation in Autonomous DrivingTechnical
- Chinese Two-part Allegorical Sayings Reading Comprehension: Exploration from Reasoning to MetaphorTechnical
- ChipMind: Retrieval-Augmented Reasoning for Long-Context Circuit Design SpecificationsTechnical
- Choosing Abstraction Levels for Model-Based Software Debugging: A Theoretical and Empirical Analysis for Spreadsheet Programs (Abstract Reprint)Technical
- CiNuSeg: Class Incremental Nuclei Segmentation via Anchor-driven Consistency Learning with Dual Region RegularizationTechnical
- CineMPC: A Fully Autonomous Drone Cinematography System Incorporating Zoom, Focus, Pose, and Scene Composition (Abstract Reprint)Technical
- Circuit-Think: A Multimodal Reasoning Framework for Automated Circuit-to-Netlist Translation with Trajectory-Guided Reinforcement LearningTechnical
- City of Light (COL): A City-Scale, Geo-Anchored Urban Simulator with High-Throughput Multi-Sensor StreamsTechnical
- Class Incremental Medical Image Segmentation via Prototype-Guided Calibration and Dual-Aligned DistillationTechnical
- Class-Aware Active Annotation in Federated Semi-Supervised Learning for Medical Image ClassificationTechnical
- Class-Partitioned VQ-VAE and Latent Flow Matching for Point Cloud Scene GenerationTechnical
- Class-feature Watermark: A Resilient Black-box Watermark Against Model Extraction AttacksTechnical
- Classifier-induced Reciprocal Points for Multi-label Open-set RecognitionTechnical
- Clean-Label Physical Backdoor Attacks with Data DistillationTechnical
- Clear Nights Ahead: Towards Multi-Weather Nighttime Image RestorationTechnical
- ClearAIR: A Human-Visual-Perception-Inspired All-in-One Image RestorationTechnical
- CliCARE: Grounding Large Language Models in Clinical Guidelines for Decision Support over Longitudinal Cancer Electronic Health RecordsTechnical
- Client-level Active Error Correction in Distributed LearningTechnical
- Clinician-in-the-Loop Smart Home System to Detect Urinary Tract Infection Flare-Ups via Uncertainty-Aware Decision SupportTechnical
- Cliqueformer: Model-Based Optimization with Structured TransformersTechnical
- Closer to Biological Mechanism: Drug-Drug Interaction Prediction from the Perspective of PharmacophoreTechnical
- CloserToMe: A Unified Framework for Accurate and Transferable Latency Prediction Across Heterogeneous DevicesTechnical
- CloudMamba: Grouped Selective State Spaces for Point Cloud AnalysisTechnical
- CluCERT: Certifying LLM Robustness via Clustering-Guided Denoising SmoothingTechnical
- Clustering with Self-Learned Graph RegressionTechnical
- Co-Designing Unplugged Learning Activities with K-2 Teachers for Early AI Literacy EducationTechnical
- Co-EPG: A Framework for Co-Evolution of Planning and Grounding in Autonomous GUI AgentsTechnical
- Co-Layout: LLM-driven Co-optimization for Interior LayoutTechnical
- CoCo-MILP: Inter-Variable Contrastive and Intra-Constraint Competitive MILP Solution PredictionTechnical
- CoCoLIT: ControlNet-Conditioned Latent Image Translation for MRI to Amyloid PET SynthesisTechnical
- CoEvo: Continual Evolution of Symbolic Solutions Using Large Language ModelsTechnical
- CoEvoer: Collaborative Evolution Transformer for Upper-Body Expressive Human Pose and Shape EstimationTechnical
- CoFact: Dynamic Coordination of Attention Heads for Improving Factual Consistency in LLMsTechnical
- CoGenSAM: Codebook-Interactive Generative Labeling for Adapting SAM to Crack SegmentationTechnical
- CoGrad3D: Spatially-Coupled Timestep Optimization with Orthogonal Gradient Fusion for 3D GenerationTechnical
- CoLM: Collaborative Large Models via a Client-Server ParadigmTechnical
- CoMA-SLAM: Collaborative Multi-Agent Gaussian SLAM with Geometric ConsistencyTechnical
- CoMA: Compositional Human Motion Generation with Multi-modal AgentsTechnical
- CoRA: A Collaborative Robust Architecture with Hybrid Fusion for Efficient PerceptionTechnical
- CoRE-Learning with Look-Ahead and Immediate Resource AllocationTechnical
- CoRe-Fed: Bridging Collaborative and Representation Fairness via Federated Embedding DistillationTechnical
- CoS: Towards Optimal Event Scheduling via Chain-of-SchedulingTechnical
- CoSPED: Consistent Soft Prompt Targeted Data Extraction and DefenseTechnical
- CoT-VLNBench: A Benchmark for Visual Chain-of-Thought Reasoning in Vision-Language-Navigation RobotsTechnical
- Coarse-to-Fine Open-Set Graph Node Classification with Large Language ModelsTechnical
- Codebook-Centric Deep Hashing: End-to-End Joint Learning of Semantic Hash Centers and Neural Hash FunctionTechnical
- Codebook-Empowered Analysis-Friendly Extreme Underwater Image CompressionTechnical
- Cog-RAG: Cognitive-Inspired Dual-Hypergraph with Theme Alignment Retrieval-Augmented GenerationTechnical
- CogStream: Context-guided Streaming Video Question AnsweringTechnical
- CogniTrust: Cognitive Memory-Driven Verifiable Supervision for Robust HashingTechnical
- Cognitive Enhancement Chain-of-Thought Towards Enhancing Style Learning and Content Preservation for Long Style TransferTechnical
- CoherenDream: Boosting Holistic Text Coherence in 3D Generation via Multimodal Large Language Models FeedbackTechnical
- Collaborative Dual Representations for Semi-Supervised Partial Label LearningTechnical
- Collaborative Enhancement of Large and Small Models for Question Answering via Dual Knowledge TransferTechnical
- Collaborative Feature Matching with Progressive Correspondence LearningTechnical
- Collaborative LLM Numerical Reasoning with Local Data ProtectionTechnical
- Collaborative Representation Learning for Alignment of Tactile, Language, and Vision ModalitiesTechnical
- Collaborative Transformers with Multi-Level Forensic Attention for Image Manipulation LocalizationTechnical
- Collaboratively “Copy & Paste” 2D-3D Features for Complex Video-to-Video Motion EditingTechnical
- Colonel Blotto with Battlefield GamesTechnical
- ComLQ: Benchmarking Complex Logical Queries in Information RetrievalTechnical
- Combining LLM Semantic Reasoning with GNN Structural Modeling for Multi-View Multi-Label Feature SelectionTechnical
- CometNet: Contextual Motif-guided Long-term Time Series ForecastingTechnical
- CommitMoE: Efficient Fallback-Free MoE Inference with Offloading Under GPU Memory ConstraintsTechnical
- Commonality in Few: Few-Shot Multimodal Anomaly Detection via Hypergraph-Enhanced MemoryTechnical
- Communication-Efficient Heterogeneous Federated Learning with Sparse Prototypes in Resource-Constrained EnvironmentsTechnical
- Communication-efficient Multi-Agent Reinforcement Learning with Spatiotemporal Information HubTechnical
- ComoRAG: A Cognitive-Inspired Memory-Organized RAG for Stateful Long Narrative ReasoningTechnical
- CompEvent: Complex-valued Event-RGB Fusion for Low-light Video Enhancement and DeblurringTechnical
- CompRestacking: Capturing Channel Dependency in Highly Correlated Multivariate Time Series Data (Student Abstract)Technical
- CompTrack: Information Bottleneck-Guided Low-Rank Dynamic Token Compression for Point Cloud TrackingTechnical
- Compensate to Not Deviate: On Subsidised EquilibriaTechnical
- Compensating Distribution Drifts in Continual Learning with Pre-trained Vision TransformersTechnical
- Complex Instruction Following with Diverse Style Policies in Football GamesTechnical
- Complex Mathematical Expression Recognition: Benchmark, Large-Scale Dataset and Strong BaselineTechnical
- Complex Reasoning over Vision and Language --Leveraging Neurosymbolic AITechnical
- Composable Assurance for AI Alignment: A Framework for Propagating Formal Safety Properties Through MLOpsTechnical
- Composition-Incremental Learning for Compositional GeneralizationTechnical
- Compositional Attribute Imbalance in Vision DatasetsTechnical
- Comprehensive Urban Region Representation Learning via Multi-View Joint Learning and Contrastive LearningTechnical
- Compress-then-Rank: Faster and Better Listwise Reranking with Large Language Models via Ranking-Aware Passage CompressionTechnical
- Compression Artifacts Removal for VVC with Frequency Domain Mixture of Experts NetworkTechnical
- Computer Vision Modeling of the Development of Geometric and Numerical Concepts in HumansTechnical
- Computing Approximately Proportional Allocations of Indivisible Goods: Beyond Additive and Monotone ValuationsTechnical
- Computing Equilibrium Nominations in Presidential ElectionsTechnical
- Computing Probabilistic Explanations for ML Models: Fixed-Parameter AlgorithmsTechnical
- Computing Syntax Tree-based Minimal Unsatisfiable Cores of LTLf FormulasTechnical
- ConInstruct: Evaluating Large Language Models on Conflict Detection and Resolution in InstructionsTechnical
- ConSurv: Multimodal Continual Learning for Survival AnalysisTechnical
- Concept-RuleNet: Grounded Multi-Agent Neurosymbolic Reasoning in Vision Language ModelsTechnical
- Concepts from Representations: Post-hoc Concept Bottleneck Models via Sparse Decomposition of Visual RepresentationsTechnical
- Conceptualisation and Implementation of Human-centric Privacy Preserving Framework for Explainable AITechnical
- CondDiff-AMO: Integrating Conditional Diffusion Mechanism for Unified Amodal Mask GenerationTechnical
- Condensed Data Expansion Using Model Inversion for Knowledge DistillationTechnical
- Conditional Diffusion Model for Multi-Agent Dynamic Task DecompositionTechnical
- Conditional Distribution Learning for Graph ClassificationTechnical
- Conditional Information Bottleneck for Multimodal Fusion: Overcoming Shortcut Learning in Sarcasm DetectionTechnical
- Conditional Probabilistic Bipolar Argumentation Framework: Explanations, Complexity and ApproximationTechnical
- Conditional Prompt Learning via Degradation Perception for Underwater Image EnhancementTechnical
- ConfGuard: A Simple and Effective Backdoor Detection for Large Language ModelsTechnical
- Confidence Estimation for Text-to-SQL in Large Language ModelsTechnical
- Confidence-Guided Stepwise Model Routing for Cost-Efficient ReasoningTechnical
- Confirmation Bias: A Challenge for Scalable OversightTechnical
- Conformable Convolution for Topologically Constrained Learning of Complex Anatomical StructuresTechnical
- Conformal Constrained Policy Optimization for Cost-Effective LLM AgentsTechnical
- Conformal Prediction Meets Long-tail ClassificationTechnical
- Conformal Prediction for Multi-Source Detection on a NetworkTechnical
- Connecting the Dots: Training-Free Visual Grounding via Agentic ReasoningTechnical
- Connectivity-Guided Sparsification of 2-FWL GNNs: Preserving Full Expressivity with Improved EfficiencyTechnical
- Consensus Learning with Multi-Party Perturbation Triggers for Secure Model AccessTechnical
- Consensus-Aligned Neuron Efficient Fine-Tuning Large Language Models for Multi-Domain Machine TranslationTechnical
- Consensus-Driven Multi-Agent Cognitive Reasoning for Enhancing the Emotional Intelligence of Large Language ModelsTechnical
- ConsistTalk: Intensity Controllable Temporally Consistent Talking Head Generation with Diffusion Noise SearchTechnical
- Consistency-based Abductive Reasoning over Perceptual Errors of Multiple Pre-trained Models in Novel EnvironmentsTechnical
- Constrained Best Arm Identification with Tests for FeasibilityTechnical
- Constrained Molecule Generation Modelled Using the Grammar ConstraintTechnical
- Constrained Online Convex Optimization with Memory and PredictionsTechnical
- Constrained Particle Seeking: Solving Diffusion Inverse Problems with Just Forward PassesTechnical
- Constrained and Robust Policy Synthesis with Satisfiability-Modulo-Probabilistic-Model-CheckingTechnical
- Constraint Optimization of MicroPlate DesignsTechnical
- Constraint-Augmented Mongolian-Chinese Neural Machine Translation Based on Dynamic Feedback Alignment (Student Abstract)Technical
- Constraint-Guided Clustering for Identifying in-Vehicle Electronic Control Units from Voltage DataTechnical
- Constraints-Guided Diffusion Reasoner for Neuro-Symbolic LearningTechnical
- ConstructAI: From Real-Time Safety Insight to Skill Growth in Deployed Construction AI SystemsTechnical
- Constructing Superior Representations Beyond the Original Documents via a Contrastive Gaussian Fusion Network for ClusteringTechnical
- Content Diversity-guided Ambiguity Mitigation for Open-Set Noisy Label LearningTechnical
- Content-aware Information Compression and Selection for Whole Slide Image AnalysisTechnical
- Context Selection and Rewriting for Video-based Educational Question GenerationTechnical
- Context-Aware Diffusion for Telemetry Time Series with Permutation-Stable Feature Modeling (Student Abstract)Technical
- Context-Sensitive Abstractions for Reinforcement Learning with Parameterized ActionsTechnical
- Context-aware Dynamic Contrastive Learning Network and E-Bike Rider Benchmark for Person SearchTechnical
- Context-aware Graph Meta-learningTechnical
- ContextFlow: Training-Free Video Object Editing via Adaptive Context EnrichmentTechnical
- ContextGraph: Lifelog Intelligence Framework for Contextual Subgraph EvolutionTechnical
- Continual Out-of-Distribution Detection with Analytic Neural CollapseTechnical
- Continuous Degradation Modeling via Latent Flow Matching for Real-World Super-ResolutionTechnical
- Continuous Vision-Language-Action Co-Learning with Semantic-Physical Alignment for Behavioral CloningTechnical
- Continuum Dropout for Neural Differential EquationsTechnical
- Contribution-aware Token Compression for Efficient Video Understanding via Reinforcement LearningTechnical
- Control Illusion: The Failure of Instruction Hierarchies in Large Language ModelsTechnical
- ControlFuse: Instruction-guided Multi-Granularity Controllable Image FusionTechnical
- Controllable Epistemic Sensitivity in Large Language Models: Probing, Benchmarking, and Adaptive ReasoningTechnical
- Controllable Financial Market Generation with Diffusion Guided Meta AgentTechnical
- ConvMix: A Mixed-Criteria Data Augmentation Framework for Conversational Dense RetrievalTechnical
- Convergence of Fast Policy Iteration in Markov Games and Robust MDPsTechnical
- Convergent Semantics for Weighted Bipolar ArgumentationTechnical
- Conversational AI for Social Good (CAI4SG): An Overview of Emerging Trends, Applications, and ChallengesTechnical
- Conversational Learning Diagnosis via Reasoning Multi-Turn Interactive LearningTechnical
- Convex Clustering Redefined: Robust Learning with the Median of Means EstimatorTechnical
- Cook and Clean Together: Teaching Embodied Agents for Parallel Task ExecutionTechnical
- Cooperative Graph Transformer with Structural Consensus for Multi-View LearningTechnical
- CoordAR: One-Reference 6D Pose Estimation of Novel Objects via Autoregressive Coordinate Map GenerationTechnical
- Coordinated Humanoid Robot Locomotion with Symmetry Equivariant Reinforcement Learning PolicyTechnical
- Copyright Infringement Detection in Text-to-Image Diffusion Models via Differential PrivacyTechnical
- CorrectAD: A Self-Correcting Agentic System to Improve End-to-end Planning in Autonomous DrivingTechnical
- CorrectNav: Self-Correction Flywheel Empowers Vision-Language-Action Navigation ModelTechnical
- Correcting False Alarms from Unseen: Adapting Graph Anomaly Detectors at Test TimeTechnical
- Correcting Quantization-Induced Gradient Mismatch in Neural Image CompressionTechnical
- Correspondence Coverage Matters for Multi-Modal Dataset DistillationTechnical
- Cost-Effective Communication: An Auction-based Method for Language Agent InteractionTechnical
- Cost-Free Neutrality for the River MethodTechnical
- Cost-Minimized Label-Flipping Poisoning Attack to LLM AlignmentTechnical
- Cost-Sensitive Conformal Training with Provably Controllable Learning BoundsTechnical
- CounterBench: Evaluating and Improving Counterfactual Reasoning in Large Language ModelsTechnical
- Counterfactual Fairness with Imperfect Causal GraphsTechnical
- Counterfactual Planning for Generalizable Agents’ ActionsTechnical
- Counterfactual Question Generation Uncovering Learner ContradictionsTechnical
- Counterfactual eXplainable AI (XAI) Method for Deep Learning-Based Multivariate Time Series ClassificationTechnical
- Counterfactual-Driven Zero-Shot Classifier ExpansionTechnical
- Counterfactual-based Cognitive Alignment In-Context Learning for Relation ExtractionTechnical
- Covariance Scattering TransformsTechnical
- Coverage-Constrained Human-AI Cooperation with Multiple ExpertsTechnical
- CreBench: Human-Aligned Creativity Evaluation from Idea to Process to ProductTechnical
- Creating Blank Canvas Against AI-enabled Image ForgeryTechnical
- Creating Generalizable Data-Driven Approaches for Biodiversity Monitoring via AcousticsTechnical
- Credal Ensemble Distillation for Uncertainty QuantificationTechnical
- CroPS: Improving Dense Retrieval with Cross-Perspective Positive Samples in Short-Video SearchTechnical
- Cross Modal Fine-grained Alignment via Granularity-aware and Region-uncertain ModelingTechnical
- Cross-Domain Few-Shot Learning via Multi-View Collaborative Optimization with Vision-Language ModelsTechnical
- Cross-Field Interface-Aware Neural Operators for Multiphase Flow SimulationTechnical
- Cross-Granularity Hypergraph Retrieval-Augmented Generation for Multi-hop Question AnsweringTechnical
- Cross-Modal Knowledge Transfer in Time Series AI via Large Vision ModelsTechnical
- Cross-Modal Unlearning via Influential Neuron Path Editing in Multimodal Large Language ModelsTechnical
- Cross-Sample Augmented Test-Time Adaptation for Personalized Intraoperative Hypotension PredictionTechnical
- Cross-Scale Collaboration between LLMs and Lightweight Sequential Recommenders with Domain-Specific Latent ReasoningTechnical
- Cross-Space Synergy: A Unified Framework for Multimodal Emotion Recognition in ConversationTechnical
- Cross-View Progressive Feature Filtering for Multi-View Graph Clustering in Remote SensingTechnical
- Cross-domain Joint Learning with Prototype-guided Mixture-of-Experts for Infrared Moving Small Target DetectionTechnical
- Cross-modal Prompting for Balanced Incomplete Multi-modal Emotion RecognitionTechnical
- Cross-modal Proxy Evolving for OOD Detection with Vision-Language ModelsTechnical
- Cross-temporal 3D Gaussian Splatting for Sparse-view Guided Scene UpdateTechnical
- Cross-view Anchor Graph Learning and Factorization for Incomplete Multi-view ClusteringTechnical
- CrossCheck-Bench: Diagnosing Compositional Failures in Multimodal Conflict ResolutionTechnical
- CrossCut: Cross-Patch Aware Interactive Segmentation for Remote Sensing ImagesTechnical
- CrossVid: A Comprehensive Benchmark for Evaluating Cross-Video Reasoning in Multimodal Large Language ModelsTechnical
- Crossing Borders: A Multimodal Challenge for Indian Poetry Translation and Image GenerationTechnical
- CrystalDiT: Simple Diffusion Transformers for Crystal GenerationTechnical
- CtoD-MAT: Bridging Centralized and Decentralized Execution in Multi-Agent Reinforcement Learning (Student Abstract)Technical
- CtrlFuse: Mask-Prompt Guided Controllable Infrared and Visible Image FusionTechnical
- Cubing for TuningTechnical
- CueBench: Advancing Unified Understanding of Context-Aware Video Anomalies in Real-WorldTechnical
- Cueing Without Gapping: Cuer-Independent Cued Speech Recognition Powered by Cross-Cuer Invariant ModelingTechnical
- Culture Affordance Atlas: Reconciling Object Diversity Through Functional MappingTechnical
- CultureRL: Internalizing Cultural Principles in Large Language Models via Norm-Driven Reinforcement LearningTechnical
- Cumulant Attention in Vision Transformers (Student Abstract)Technical
- CyC3D: Fine-grained Controllable 3D Generation via Cycle Consistency RegularizationTechnical
- CyPortQA: Benchmarking Multimodal Large Language Models for Cyclone Preparedness in Port OperationTechnical
- CycleChemist: A Dual-Pronged Machine Learning Framework for Organic Photovoltaic DiscoveryTechnical
- Cylindrical Lattice Embedding for Program InductionTechnical
- Cyto-SSL: A Self-Supervised Pretraining Framework for Cytology Foundation ModelTechnical
- C³TG: Conflict-aware, Composite, and Collaborative Controlled Text GenerationTechnical
- D-FCGS: Feedforward Compression of Dynamic Gaussian Splatting for Free-Viewpoint VideosTechnical
- D-GARA: A Dynamic Benchmarking Framework for GUI Agent Robustness in Real-World AnomaliesTechnical
- D2 Prune: Sparsifying Large Language Models via Dual Taylor Expansion and Attention Distribution AwarenessTechnical
- D2MoRA: Diversity-Regulated Asymmetric MoE-LoRA Decomposition for Efficient Multi-Task AdaptationTechnical
- D3-RSMDE: 40× Faster and High-Fidelity Remote Sensing Monocular Depth EstimationTechnical
- D3ToM: Decider-Guided Dynamic Token Merging for Accelerating Diffusion MLLMsTechnical
- DA-DFGAS:Differentiable Federated Graph Neural Architecture Search with Distribution-Aware Attentive AggregationTechnical
- DANCE: Density-agnostic and Class-aware Network for Point Cloud CompletionTechnical
- DANS-KGC: Diffusion Based Adaptive Negative Sampling for Knowledge Graph CompletionTechnical
- DAPE: Harmonizing Content-Position Encoding for Versatile Dense Visual PredictionTechnical
- DAPointMamba: Domain Adaptive Point Mamba for Point Cloud CompletionTechnical
- DAPrompt: Dual Alignment Prompt of Structure and Semantics for Few-shot Graph LearningTechnical
- DARLING: Dual Hypergraph-Enhanced Curriculum-Guided Graph Structure Learning for Node ClassificationTechnical
- DAVID: Dual-stage Adaptive Vision-text Integrated Decoupling for Multimodal KV Cache EvictionTechnical
- DAVSP: Safety Alignment for Large Vision-Language Models via Deep Aligned Visual Safety PromptTechnical
- DAWN: Distributed LLM Multi-Agent Workflow SynthesisTechnical
- DBGroup: Dual-Branch Point Grouping for Weakly Supervised 3D Semantic Instance SegmentationTechnical
- DC-SPAN: A Dual Contrastive Attention Network for Multi-View ClusteringTechnical
- DCA-LUT: Deep Chromatic Alignment with 5D LUT for Purple Fringing RemovalTechnical
- DCAC: Dynamic Class-Aware Cache Creates Stronger Out-of-Distribution DetectorsTechnical
- DCHO: A Decomposition–Composition Framework for Predicting Higher-Order Brain Connectivity to Enhance Diverse Downstream ApplicationsTechnical
- DCMM-Transformer: Degree-Corrected Mixed-Membership Attention for Medical ImagingTechnical
- DCRNet: Delayed Conversion Modeling Based Personalized Flight Itinerary Ranking NetworkTechnical
- DCTR: Dual-Constraint Subgraph Optimization for Knowledge Graph-based Retrieval-Augmented GenerationTechnical
- DDIN: Reinforcement Learning with Asymmetric GNNs for Dismantling Directed Interdependent Networks (Student Abstract)Technical
- DEALT: LLM-driven Diversity-Enhanced Data Augmentation for Long-Tail Text ClassificationTechnical
- DECON: Reconstruction of Clothed-Geometric Multiple Humans from a Single Image via Geometry-Guided DecouplingTechnical
- DEEP: A Discourse Evolution Engine for Predictions About Social MovementsTechnical
- DEFANet: Dual-Path Edge-Target Collaboration with Frequency-Aware Enhancement for Infrared Small Target DetectionTechnical
- DEGRE: Dynamic Gating Ensembles for Trust-Aware Rejection in Medical Image DiagnosticsTechnical
- DEIG: Detail-Enhanced Instance Generation with Fine-Grained Semantic ControlTechnical
- DEPO: Dual-Efficiency Preference Optimization for LLM AgentsTechnical
- DETONATE – A Benchmark for Text-to-Image Alignment and Kernelized Direct Preference OptimizationTechnical
- DFAgent: From Natural Language Data Interactions to Reusable Agent-Ready ToolsTechnical
- DFDT: Dynamic Fast Decision Tree for IoT Data Stream Mining on Edge DevicesTechnical
- DFMN: A Dual-feet Matching Network with Hybrid Transformer-based Feature Extractor for Unsupervised Deformable Medical Image RegistrationTechnical
- DFRec: Dual Fluctuation Modeling of Multi-level Intent Evolution for Next-Item RecommendationTechnical
- DGKAN: Dual-branch Graph Kolmogorov-Arnold Network for Unsupervised Multimodal Change DetectionTechnical
- DGP: A Dual-Granularity Prompting Framework for Fraud Detection with Graph-Enhanced LLMsTechnical
- DGSAN: Dual-Graph Spatiotemporal Attention Network for Pulmonary Nodule Malignancy PredictionTechnical
- DGTF: Cross-Domain Decentralized Graph Learning with Topology-Aware Knowledge FusionTechnical
- DHCM-CACL: Dynamic Hierarchical Cross-modal Mamba with Confidence-Adaptive Contrastive Learning for Multimodal Emotion RecognitionTechnical
- DHMRec: Collaboration-Guided Multimodal Disentanglement and Hierarchical Fusion for RecommendationTechnical
- DIAA: A Decoding-Efficient Inference Acceleration Approach for On-Device Large Language ModelsTechnical
- DICE: Distilling Classifier-Free Guidance into Text EmbeddingsTechnical
- DIET: Machine Unlearning on a Data-DietTechnical
- DIFFA: Large Language Diffusion Models Can Listen and UnderstandTechnical
- DIFT: Protecting Contrastive Learning Against Data Poisoning Backdoor AttacksTechnical
- DIMM: Decoupled Multi-hierarchy Kalman Filter via Reinforcement LearningTechnical
- DIN: Dual Impulse Network for Multi-view Representation LearningTechnical
- DINOv3-Powered Multi-Task Foundation Model for Quantitative Remote Sensing Estimation (Student Abstract)Technical
- DISC: Dynamic Feature Selection for Cost-Sensitive Medical DiagnosisTechnical
- DISCODE: Distribution-Aware Score Decoder for Robust Automatic Evaluation of Image CaptioningTechnical
- DLDA: Unified Dual-Level Domain Adaptation for Low-Light Object DetectionTechnical
- DLVINet: Advancing Dual-Lens Video Inpainting Beyond Parallax ConstraintsTechnical
- DMCAR: Disentangled Mixture-of-Experts with Context-Aware Routing for Multi-View ClusteringTechnical
- DMGIN: How Multimodal LLMs Enhance Large Recommendation Models for Lifelong User Post-click BehaviorsTechnical
- DMGINE: Day-Memory Guided Nighttime Image Enhancement for Dynamic Traffic ScenesTechnical
- DMOSpeech 2: Reinforcement Learning for Duration Prediction in Metric-Optimized Speech SynthesisTechnical
- DNOI-4DRO: Deep 4D Radar Odometry with Differentiable Neural-Optimization IterationsTechnical
- DNR Bench: Benchmarking Over-Reasoning in Reasoning LLMsTechnical
AAAI accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.