AAAI 2026 Accepted Papers
The full list of 4,902 papers accepted at AAAI 2026 (Association for the Advancement of Artificial Intelligence Annual Conference on Artificial Intelligence). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Technical: 4,902
- DOS: Directional Object Separation in Text Embeddings for Multi-Object Image GenerationTechnical
- DOS: Distilling Observable Softmaps of Zipfian Prototypes for Self-Supervised Point RepresentationTechnical
- DP-GenG: Differentially Private Dataset Distillation Guided by DP-Generated DataTechnical
- DP-NCB: Privacy Preserving Fair BanditsTechnical
- DPRM: A Dual Implicit Process Reward Model in Multi-Hop Question AnsweringTechnical
- DQT: Dynamic Quantization Training via Dequantization-Free Nested Integer ArithmeticTechnical
- DR.Experts: Differential Refinement of Distortion-Aware Experts for Blind Image Quality AssessmentTechnical
- DRAFT-RL: Multi-Agent Chain-of-Draft Reasoning for Reinforcement Learning-Enhanced LLMsTechnical
- DRFGD: Disentangled Representation-Focused Generative Defense for Attack-Tolerant Cross-Modal HashingTechnical
- DRIFT: Difference-Aware Reinforcement Through Iterative Fine-Tuning for Language ModelTechnical
- DRM-Net: Explicit Residual Modelling with Subaquatic Multi-Scale Context Fusion for Underwater Image EnhancementTechnical
- DRMD: Deep Reinforcement Learning for Malware Detection Under Concept DriftTechnical
- DRSoRec: Dual-Rectification of Social Networks for RecommendationTechnical
- DS SERVE: A Framework for Efficient and Scalable Neural RetrievalTechnical
- DS-ATGO: Dual-Stage Synergistic Learning via Forward Adaptive Threshold and Backward Gradient Optimization for Spiking Neural NetworksTechnical
- DS-ProGen: A Dual-Structure Deep Language Model for Functional Protein DesignTechnical
- DSAP: Enhancing Generalization in Goal-Conditioned Reinforcement LearningTechnical
- DSCF: Dual-Source Counterfactual Fusion for High-Dimensional Combinatorial InterventionsTechnical
- DSCodeBench: A Realistic Benchmark for Data Science Code GenerationTechnical
- DSFedMed: Dual-Scale Federated Medical Image Segmentation via Mutual Distillation Between Foundation and Lightweight ModelsTechnical
- DSP-PCQA: Integrating Multiple Perception Preferences for Point Cloud Quality AssessmentTechnical
- DTECT: Dynamic Topic Explorer & Context TrackerTechnical
- DTTNet: Improving Video Shadow Detection via Dark-Aware Guidance and Tokenized Temporal ModelingTechnical
- DUP: Detection-guided Unlearning for Backdoor Purification in Language ModelsTechnical
- DWTSG: Parameter-Efficient Fine-Tuning of Large Pre-trained Models via Discrete Wavelet Transform and Subband GuidanceTechnical
- DanceHA: A Multi-Agent Framework for Document-Level Aspect-Based Sentiment AnalysisTechnical
- DarkBench+: An Extended Benchmark for Evaluating Dark Patterns in Large Language ModelsTechnical
- DarkFarseer: Robust Spatio-Temporal Kriging Under Graph Sparsity and NoiseTechnical
- Data Complexity of Querying Description Logic Knowledge Bases Under Cost-Based SemanticsTechnical
- Data Heterogeneity and Forgotten Labels in Split Federated LearningTechnical
- Data-Centric Sequential Recommendation with Relation-Augmented GenerationTechnical
- Data-Efficient and Contact-Rich Manipulation Through Diffusion Augmentation and Vision-Language ModelsTechnical
- DcMatch: Unsupervised Multi-Shape Matching with Dual-Level ConsistencyTechnical
- DcSplat: Dual-Constraint Human Gaussian Splatting with Latent Multi-View ConsistencyTechnical
- De Novo Molecular Generation from Mass Spectra via Many-Body Enhanced DiffusionTechnical
- De-Speakerizing Accented ASR: Measuring and Mitigating Speaker Entanglement for Fair, Reliable RecognitionTechnical
- De-biased Natural Language Egocentric Task Verification via Prototypical Evidence LearningTechnical
- De-collapsing User Intent: Adaptive Diffusion Augmentation with Mixture-of-Experts for Sequential RecommendationTechnical
- DeCoRL: Decoupling Reasoning Chains via Parallel Sub-Step Generation and Cascaded Reinforcement for Interpretable and Scalable RLHFTechnical
- DeFB: Decomposed Feature Learning for Real-Time Multi-Person Eyeblink Detection in Untrimmed In-the-Wild VideosTechnical
- DeFT-LoRA: Decoupled and Fused Tuning with LoRA Experts for Universal Cross-Domain RetrievalTechnical
- DeFuzzRAG: Handling Fuzzy Time Expressions for Temporal Robustness in Retrieval-Augmented GenerationTechnical
- DeLightMono: Enhancing Self-Supervised Monocular Depth Estimation in Endoscopy by Decoupling Uneven IlluminationTechnical
- DeLo: Dual Decomposed Low-Rank Experts Collaboration for Continual Missing Modality LearningTechnical
- DeNAS-ViT: Data Efficient NAS-Optimized Vision Transformer for Ultrasound Image SegmentationTechnical
- DeNC++: Efficient Diffusion-Enhanced Neural Codec for End-to-end Semantic Streaming at the EdgeTechnical
- DeOcc-1-to-3: 3D De-Occlusion from a Single Image via Self-Supervised Multi-View DiffusionTechnical
- DeToNATION: Decoupled Torch Network-Aware Training on Interlinked Online NodesTechnical
- Debate over Mixed-knowledge: A Robust Multi-Agent Reasoning Framework for Incomplete Knowledge Graph Question AnsweringTechnical
- Debiased Cognitive Diagnosis: A Contrastive Counterfactual Modeling Method via Variational AutoencoderTechnical
- Debiased Dual-Invariant Defense for Adversarially Robust Person Re-IdentificationTechnical
- Debiased Multiplex Tokenizer for Efficient Map-Free Visual RelocalizationTechnical
- Debiasing Diffusion Priors via 3D Attention for Consistent Gaussian SplattingTechnical
- Debiasing Machine Learning Predictions for Causal Inference Without Additional Ground Truth Data: “One Map, Many Trials” in Satellite-Driven Poverty AnalysisTechnical
- Deblur4DGS: 4D Gaussian Splatting from Blurry Monocular VideoTechnical
- Decentralized Non-convex Stochastic Optimization with Heterogeneous VarianceTechnical
- Decentralized Online Convex Optimization with Unknown Feedback DelaysTechnical
- Decidable Multi-agent Epistemic Planning: A Situation Calculus ApproachTechnical
- Decision-Driven Orthogonal Learning with Complementary Feature Mining for Robust Synthetic Image DetectionTechnical
- Decoding with Structured Awareness: Integrating Directional, Frequency-Spatial, and Structural Attention for Medical Image SegmentationTechnical
- Decompose and Attribute: Boosting Generalizable Open-Set Object Detection via Objectness ScoreTechnical
- Decompose and Conquer: Compositional Reasoning for Zero-Shot Temporal Action LocalizationTechnical
- Decomposing Direct and Indirect Biases in Linear Models Under Demographic Parity ConstraintTechnical
- Decomposing Direct and Indirect Biases in Linear Models Under Demographic Parity Constraint (Student Abstract)Technical
- Decomposing Prompts, Composing Actions: A Multi-Granularity Prompting Approach for Incremental Action LearningTechnical
- Decomposing and Composing: Towards Efficient Vision-Language Continual Learning via Rank-1 Expert Pool in a Single LoRATechnical
- Decomposing the Neurons: Activation Sparsity via Mixture of Experts for Continual Test Time AdaptationTechnical
- Deconstructing Pre-training: Knowledge Attribution Analysis in MoE and Dense ModelsTechnical
- Decoupled Spatiotemporal Forecasting from Extreme Sparse Observations via Quantized Latent SpaceTechnical
- Decoupling Continual Semantic SegmentationTechnical
- Decoupling Knowledge and Reasoning in LLMs: An Exploration Using Cognitive Dual-System TheoryTechnical
- Decoupling Scene Perception and Ego Status: A Multi-Context Fusion Approach for Enhanced Generalization in End-to-End Autonomous DrivingTechnical
- Decoupling Shared and Personalized Knowledge: A Dual-Branch Federated Learning Framework for Multi-Domain with Non-IID DataTechnical
- Decoupling Template Bias in CLIP: Harnessing Empty Prompts for Enhanced Few-Shot LearningTechnical
- Decoupling Understanding from Reasoning via Problem Space Mapping for Small-Scale Model ReasoningTechnical
- Decoupling What to Count and Where to See for Referring Expression CountingTechnical
- Deep (Predictive) Discounted Counterfactual Regret MinimizationTechnical
- Deep Clustering Based on Sparse Kolmogorov-Arnold Network and Spectral ConstraintTechnical
- Deep Extreme Transformer: Tackling Zero-Inflated Time Series for Precipitation PredictionTechnical
- Deep Hidden Cognition Facilitates Reliable Chain-of-Thought ReasoningTechnical
- Deep Incomplete Multi-View Clustering via Hierarchical Imputation and AlignmentTechnical
- Deep Inverse Shading: Consistent Albedo and Surface Detail Recovery via Generative RefinementTechnical
- Deep Model Reuse: Paving the Way for Efficient and Generalizable AI SystemsTechnical
- Deep Reinforcement Learning for Scalable Offline Three-Dimensional PackingTechnical
- Deep Research Arena: The First Exam of LLMs’ Research Abilities via Seminar-Grounded TasksTechnical
- DeepBooTS: Dual-Stream Residual Boosting for Drift-Resilient Time-Series ForecastingTechnical
- DeepGB-TB: A Risk-Balanced Cross-Attention Gradient-Boosted Convolutional Network for Rapid, Interpretable Tuberculosis ScreeningTechnical
- DeepOR: A Deep Reasoning Foundation Model for Optimization ModelingTechnical
- DeepPhy: Benchmarking Agentic VLMs on Physical ReasoningTechnical
- DeepProofLog: Efficient Proving in Deep Stochastic Logic ProgramsTechnical
- DeepRAHT: Learning Predictive RAHT for Point Cloud Attribute CompressionTechnical
- DeepRWCap: Neural-Guided Random-Walk Capacitance Solver for IC DesignTechnical
- DeepSenseMoE: Harnessing Power of Time Series Foundation Models for Few-Shot Human Activity RecognitionTechnical
- DeepTracer: Tracing Stolen Model via Deep Coupled WatermarksTechnical
- DeepWriter: A Multi-Agent Collaboration Framework for Information-rich Ultra-long Book WritingTechnical
- Deeper Treatment of the Bi-objective Search FrameworkTechnical
- Deeply Seeking Boundary for Lunar Regolith SegmentationTechnical
- Deferred Poisoning: Making the Model More Vulnerable via Hessian SingularizationTechnical
- DeformTrace: A Deformable State Space Model with Relay Tokens for Temporal Forgery LocalizationTechnical
- Deformable Polygonal Flow Matching with Informed Priors and Hierarchical Graph ConstraintsTechnical
- DegVoC: Revisiting Neural Vocoder from a Degradation PerspectiveTechnical
- DehazeGS: Seeing Through Fog with 3D Gaussian SplattingTechnical
- Delayed Feedback Modeling with Influence FunctionsTechnical
- DeloopSGNN: Revisiting Spectral GNNs Through the Lens of Spatial AggregationTechnical
- Delphi: A Neuro-Symbolic Framework for Individualized, Safe and Interpretable Treatment RecommendationTechnical
- Delta Matters: An Analytically Tractable Model for beta–delta Discounting AgentsTechnical
- Delving into Dynamic Scene Cue-Consistency for Robust 3D Multi-Object TrackingTechnical
- Democratizing Diplomacy: A Harness for Evaluating Any Large Language Model on Full-Press DiplomacyTechnical
- Democratizing LLM Efficiency: From Hyperscale Optimizations to Universal DeployabilityTechnical
- Democratizing Writing Support with AI: Insights from One Year of Real-World Interactions with an Open-Access Writing Feedback ToolTechnical
- Demystifying Foreground-Background Memorization in Diffusion ModelsTechnical
- Demystifying GNN-to-MLP Knowledge Transfer: Theoretical Grounding and Dual-Stream Distillation MethodTechnical
- DenoDet V2: Phase-Amplitude Cross Denoising for SAR Object DetectionTechnical
- DenoiseGS: Delta-Based 3D Gaussian Splatting with B-spline Trajectory Optimization for Dynamic Driving Scene ReconstructionTechnical
- Denoising Mixup for RegressionTechnical
- Dense Cross-Scale Image Alignment with Fully Spatial Correlation and Just Noticeable Difference GuidanceTechnical
- DensiCrafter: Physically-Constrained Generation and Fabrication of Self-Supporting Hollow StructuresTechnical
- DentalGS: Pose-Free 3D Gaussian Splatting from Five Intraoral Images for Novel View SynthesisTechnical
- Dep-MAP: A Multi-level Alignment Framework with Semantic Prototypes for Video-based Automatic Depression AssessmentTechnical
- Departures: Distributional Transport for Single-Cell Perturbation Prediction with Neural Schrödinger BridgesTechnical
- Deployed AI Agents for Industrial Asset Management: CodeReAct Framework for Event Analysis and Work Order AutomationTechnical
- Deploying Atmospheric and Oceanic AI Models on Chinese Hardware and Framework: Migration Strategies, Performance Optimization and AnalysisTechnical
- Deploying Rapid Damage Assessments from sUAS Imagery for Disaster ResponseTechnical
- Depth-Synergized Mamba Meets Memory Experts for All-Day Image Reflection SeparationTechnical
- Dereflection Any Image with Diffusion Priors and Diversified DataTechnical
- Description Logics with Two Types of Definite Descriptions: Complexity, Expressiveness, and Automated DeductionTechnical
- Designed to Spread: A Generative Approach to Enhance Information DiffusionTechnical
- Designing Incentives for Networked Multi-agent SystemsTechnical
- Designing Incident Reporting Systems for Harms from General-Purpose AITechnical
- Designing Optimal Mechanisms to Locate Facilities with Insufficient Capacity for Bayesian AgentsTechnical
- Designing Truthful Mechanisms for Asymptotic Fair DivisionTechnical
- DesireKV: Decoupling Sensitivity and Importance for Reasoning-Aware KV Cache CompressionTechnical
- Detect All-Type Deepfake Audio: Wavelet Prompt Tuning for Enhanced Auditory PerceptionTechnical
- Detecting Citation Hallucinations in Large Language Model Outputs (Student Abstract)Technical
- Detecting Compute Structuring in AI Governance Is Likely FeasibleTechnical
- Detecting Emotional Dynamic Trajectories: An Evaluation Framework for Emotional Support in Language ModelsTechnical
- Detecting Fake News in Short Videos Through Multi-View AggregationTechnical
- Detecting Unobserved Confounders: A Kernelized Regression ApproachTechnical
- Detecting the Future: All-at-Once Event Sequence Forecasting with Horizon MatchingTechnical
- Deterministic Hyperdimensional Learning with Rank Refinement (Student Abstract)Technical
- Deviation Dynamics in Cardinal Hedonic GamesTechnical
- DexGraspVLA: A Vision-Language-Action Framework Towards General Dexterous GraspingTechnical
- Dexterous Manipulation Transfer via Progressive Kinematic-Dynamic AlignmentTechnical
- DiA-gnostic VLVAE: Disentangled Alignment-Constrained Vision Language Variational AutoEncoder for Robust Radiology Reporting with Missing ModalitiesTechnical
- DiAPR: Dimensionally-Allocated Prototype Refinement for Non-Exemplar Class Incremental LearningTechnical
- DiCaP: Distribution-Calibrated Pseudo-labeling for Semi-Supervised Multi-Label LearningTechnical
- DiLO: Disentangled Latent Optimization for Learning Shape and Deformation in Grouped Deforming 3D ObjectsTechnical
- DiM-TS: Bridge the Gap Between Selective State Space Models and Time Series for Generative ModelingTechnical
- DiMA: Distinguishing Resident and Tourist Preferences via Multi-Modal LLM Alignment for Out-of-Town Cross-Domain RecommendationTechnical
- DiTEA: Mixture-of-Experts for Vision-Language-Action Model in Robotic ManipulationTechnical
- Diagnostic-Guided Dynamic Profile Optimization for LLM-based User Simulators in Sequential RecommendationTechnical
- DiagramGPT-Llama3:Enabling Editable, High-Fidelity Diagram Generation with Vision Large Language ModelsTechnical
- DialoGen: Towards Dialog Gesture Generation via Identity-Decoupled Style Guidance in Interactive Diffusion ModelTechnical
- DialogXpert: Driving Intelligent and Emotion-Aware Conversations Through Online Value-Based Reinforcement Learning with LLM PriorsTechnical
- Diff-NAT: Better Naturalistic and Aggressive Adversarial Attacks via Class-Optimized Diffusion for Object DetectionTechnical
- Diff-V2M: A Hierarchical Conditional Diffusion Model with Explicit Rhythmic Modeling for Video-to-Music GenerationTechnical
- DiffBench Meets DiffAgent: End-to-End LLM-Driven Diffusion Acceleration Code GenerationTechnical
- DiffMM: Efficient Method for Accurate Noisy and Sparse Trajectory Map Matching via One Step DiffusionTechnical
- DiffNR: Diffusion-Enhanced Neural Representation Optimization for Sparse-View 3D Tomographic ReconstructionTechnical
- DiffOP: Reinforcement Learning of Optimization-Based Control Policies via Implicit Policy GradientsTechnical
- DiffRefiner: Coarse to Fine Trajectory Planning via Diffusion Refinement with Semantic Interaction for End to End Autonomous DrivingTechnical
- Difference Vector Equalization for Robust Fine-tuning of Vision-Language ModelsTechnical
- Differentiable Semantic Meta-Learning Framework for Long-Tail Motion Forecasting in Autonomous DrivingTechnical
- Differentiable Sparse Identification of Lagrangian DynamicsTechnical
- Differentially Private Linear Programming: Reduced Sub-Optimality and Guaranteed Constraint SatisfactionTechnical
- Differentially Private Subspace Fine-Tuning for Large Language ModelsTechnical
- Differentiated Directional Intervention: A Framework for Evading LLM Safety AlignmentTechnical
- Difficulty Controlled Diffusion Model for Synthesizing Effective Training DataTechnical
- Difficulty Is Not Enough: Curriculum Learning for LLMs Fine-tuning Must Consider UtilityTechnical
- Difficulty-Aware Label-Guided Denoising for Monocular 3D Object DetectionTechnical
- Difficulty-Aware Learning Curve ExtrapolationTechnical
- Diffusion Distillation with Direct Preference Optimization for Efficient 3D LiDAR Scene CompletionTechnical
- Diffusion Implicit Policy for Unpaired Scene-aware Motion SynthesisTechnical
- Diffusion Model Based Signal Recovery Under 1-Bit QuantizationTechnical
- Diffusion Once and Done: Degradation-Aware LoRA for All-in-One Image RestorationTechnical
- Diffusion Reconstruction-based Data Likelihood Estimation for Core-Set SelectionTechnical
- Diffusion for Combating the Hallucination in Large Language Models (Student Abstract)Technical
- Diffusion-Assisted Progressive Learning for Weakly Supervised Phrase LocalizationTechnical
- Diffusion-Based Contextual Reconstruction for Point Cloud Segmentation with Limited AnnotationsTechnical
- Diffusion-based Personalized Pathology Disentanglement for Impaired Gait AnalysisTechnical
- Diffusion-calibrated Continual Test-time AdaptationTechnical
- DiffusionPose: Markov-Optimized Diffusion Model for Human Pose EstimationTechnical
- DigimonGPT: An Evolvable Agent with Hierarchical Human-like Memory for Video Question AnsweringTechnical
- Digital Scale: Open-Source On-Device BMI Estimation from Smartphone Camera Images Trained on a Large-Scale Real-World DatasetTechnical
- DipGuava: Disentangling Personalized Gaussian Features for 3D Head Avatars from Monocular VideoTechnical
- Directing Uncertainty-Aware Information Flow for Robust Diffusion PredictionTechnical
- Direction Sensitivity–Based Knowledge Distillation: Optimization-Aware Low-Rank Knowledge TransferTechnical
- DisCo DETR: Distance-aware Multi-view Contrastive Learning for DETR Pre-trainingTechnical
- Discounted Cuts: A Stackelberg Approach to Network DisruptionTechnical
- Discovering Decoupled Functional Modules in Large Language ModelsTechnical
- Discovering Hybrid World Representations with Co-Evolving Foundation ModelsTechnical
- Discovering Latent Facts from Context to Construct Richer Open Knowledge GraphsTechnical
- Discovering Linear Non-Gaussian Models for All Categories of Missing Data (Student Abstract)Technical
- Discovering Mixture Skills for Unsupervised Reinforcement LearningTechnical
- Discovery of Feasible 3D Printing Configurations for Metal Alloys via AI-Driven Adaptive Experimental DesignTechnical
- Discrete Structure Augmentation for Graph Convolutional NetworksTechnical
- Discrete-Guided Diffusion for Scalable and Safe Multi-Robot Motion PlanningTechnical
- Discretization Is Not Always Better: Rethinking Deep Quantization for Asymmetric Image RetrievalTechnical
- Discriminative Graph Embedding Framework via Label-Free Marginal Fisher AnalysisTechnical
- Disentangled Generation-Based Prototypical Alignment for Few-Shot Unsupervised Domain Adaptation in Graph-Level Anomaly DetectionTechnical
- Disentangled Hypergraph-Guided Mamba Scanning for Fine-Grained Visual RecognitionTechnical
- Disentangling Adversarial Prompts: A Semantic-Graph Defense for Robust LLM SecurityTechnical
- Disentangling for Transfer: Boosting Limited Modalities via Information-Theoretic Regularization and Cross-Modal ReconstructionTechnical
- Distillation Dynamics: Towards Understanding Feature-Based Distillation in Vision TransformersTechnical
- Distillation-Guided Structural Transfer for Continual Learning Beyond Sparse Distributed MemoryTechnical
- Distilling Cross-Modal Knowledge via Feature DisentanglementTechnical
- Distilling Future Temporal Knowledge with Masked Feature Reconstruction for 3D Object DetectionTechnical
- Distractor-Based Jailbreaking Attacks in Language Models and Associated Changes in Chain-of-Thought Content (Student Abstract)Technical
- Distribution Shift Is Key to Learning Invariant PredictionTechnical
- Distribution-Based Feature Attribution for Explaining the Predictions of Any ClassifierTechnical
- Distributional Priors Guided Diffusion for Generating 3D Molecules in Low Data RegimesTechnical
- Distributionally Robust Online Markov Game with Linear Function ApproximationTechnical
- Disturbance-based Discretization, Differentiable IDS Channel, and an IDS-Correcting Code for DNA-based StorageTechnical
- DivControl: Knowledge Diversion for Controllable Image GenerationTechnical
- Diverse Human Driving Vehicle Simulation in Background Traffic for Autonomous Driving TestsTechnical
- Diversifying Counterattacks: Orthogonal Exploration for Robust CLlP InferenceTechnical
- Diversity Meets Relevancy: Multi-Agent Knowledge Probing for Industry 4.0 ApplicationsTechnical
- Diversity Recommendation via Causal Deconfounding of Co-purchase Relations and Counterfactual ExposureTechnical
- Diversity of Structured Domains via k-Kemeny ScoresTechnical
- Divide, Conquer and Unite: Hierarchical Style-Recalibrated Prototype Alignment for Federated Medical SegmentationTechnical
- Divide-and-Conquer Decoupled Network for Cross-Domain Few-Shot SegmentationTechnical
- Dividing Indivisible Items for the Benefit of All: It Is Hard to Be Fair Without Social AwarenessTechnical
- Do Audio-Visual Segmentation Models Truly Segment Sounding Objects?Technical
- Do It for HER: First-Order Temporal Logic Reward Specification in Reinforcement LearningTechnical
- Do LLMs Feel? Teaching Emotion Recognition with Prompts, Retrieval, and Curriculum LearningTechnical
- Do LLMs Really Struggle at NL-FOL Translation? Revealing Their Strengths via a Novel Benchmarking StrategyTechnical
- Do Language Models Associate Sound with Meaning? A Multimodal Study of Sound SymbolismTechnical
- Do Large Language Models (LLMs) Understand Chronology? (Student Abstract)Technical
- Do Large Language Models Reason About Uncertainty Like Humans? A Benchmark on Hurricane Forecast Visualization ComprehensionTechnical
- Do Large Language Models Think like the Brain? Sentence-Level Evidences from Layer-Wise Embeddings and fMRITechnical
- Do Not Merge My Model! Safeguarding Open-Source LLMs Against Unauthorized Model MergingTechnical
- Do Retrieval Augmented Language Models Know When They Don’t Know?Technical
- Do We Need Perfect Data? Leveraging Noise for Domain Generalized SegmentationTechnical
- Do We Truly Need So Many Samples? Multi-LLM Repeated Sampling Efficiently Scales Test-Time ComputeTechnical
- DoBlock: Blocking Malicious Association Propagation for Backdoor-Robust Federated Learning Under Domain SkewTechnical
- DoKnowAD: Calibrating Normal Representations with Refined Domain Knowledge to Enhance Time Series Anomaly DetectionTechnical
- DocR1: Evidence Page-Guided GRPO for Multi-Page Document UnderstandingTechnical
- Docora: A System for Interactive Knowledge Extraction and Visualization from Scientific PDFsTechnical
- Does Question Really Matter? The Attribution of Answer Bias in LLM EvaluationTechnical
- DogFit: Domain-guided Fine-tuning for Efficient Transfer Learning of Diffusion ModelsTechnical
- Domain Adaptation Guided Infrared and Visible Image FusionTechnical
- Domain-Auxiliary Infrared Moving Small Target Detection by Learning to Overlook Domain DiscrepancyTechnical
- Domain-Aware Multi-View Contrastive Representation Learning for Protein Subcellular Localization PredictionTechnical
- Domain-Aware Suppression and Aggregation for Federated DG ReIDTechnical
- Domain-Specific Retrieval for Retrieval-Augmented Generation: A Case Study on Pertussis Research (Student Abstract)Technical
- DomainCQA: Crafting Knowledge-Intensive QA from Domain-Specific ChartsTechnical
- Dominance Pruning and Heuristics in Optimal Adversarial Non-Deterministic PlanningTechnical
- Don’t Start Over: A Cost-Effective Framework for Migrating Personalized Prompts Between LLMsTechnical
- Don’t Stop the Multi-Party! On Generating Synthetic Written Multi-Party Conversations with ConstraintsTechnical
- Dormant Backdoor: Weaponizing Model Finetuning for Feasible Backdoor Attacks Against Pretrained ModelsTechnical
- Double Rounding: Nearly Lossless Adaptive Bit Switching for QATTechnical
- Doubly Debiased Test-Time Prompt Tuning for Vision-Language ModelsTechnical
- Doubly Robust Causal Estimation Under Multi-View Network Interference (Student Abstract)Technical
- DragNeXt: Rethinking Drag-Based Image EditingTechnical
- Dream-IF: Dynamic Relative EnhAnceMent for Image FusionTechnical
- DreamRunner: Fine-Grained Compositional Story-to-Video Generation with Retrieval-Augmented Motion AdaptationTechnical
- Drift Estimation for Diffusion Processes Using Neural Networks Based on Discretely Observed Independent PathsTechnical
- Drift-aware Collaborative Assistance Mixture of Experts for Heterogeneous Multistream LearningTechnical
- Drifting Away from Truth: GenAI-Driven News Diversity Challenges LVLM-Based Misinformation DetectionTechnical
- Drive-R1: Bridging Reasoning and Planning in VLMs for Autonomous Driving with Reinforcement LearningTechnical
- DriveFlow: Rectified Flow Adaptation for Robust 3D Object Detection in Autonomous DrivingTechnical
- DriveLiDAR4D: Sequential and Controllable LiDAR Scene Generation for Autonomous DrivingTechnical
- DriveSuprim: Towards Precise Trajectory Selection for End-to-End PlanningTechnical
- Driving Engagement in Daily Fantasy Sports with a Scalable and Urgency-Aware Ranking EngineTechnical
- Driving with Advice: Large Model as Motion Advisor for Joint PlanningTechnical
- Driving with Regulation: Trustworthy and Interpretable Decision-Making for Autonomous Driving with Retrieval-Augmented ReasoningTechnical
- Dropout Prompt Learning: Towards Robust and Adaptive Vision-Language ModelsTechnical
- Dropouts in Confidence: Moral Uncertainty in Human-LLM AlignmentTechnical
- DuGI-MAE: Improving Infrared Mask Autoencoders via Dual-Domain GuidanceTechnical
- Dual Coding Theory in Action: Language-Assisted Human Pose Estimation in VideosTechnical
- Dual Graph Disambiguation for Multi-Instance Partial-Label LearningTechnical
- Dual Mamba for Node-Specific Representation Learning: Tackling Over-Smoothing with Selective State Space ModelingTechnical
- Dual-Branch Asymmetric Discrepancy Learning Based on Fake Image Pattern-Coexistence for AI-Generated Image DetectionTechnical
- Dual-Channel Learning Framework for Zero-Shot CircRNA-miRNA Interaction Prediction via State Space ModelingTechnical
- Dual-Geometry Graph Network: Unifying Local and Global Priors for Few-Shot LearningTechnical
- Dual-Horizon Interest Model for Unified Search and RecommendationTechnical
- Dual-Kernel Graph Community Contrastive LearningTechnical
- Dual-Path Knowledge-Augmented Contrastive Alignment Network for Spatially Resolved TranscriptomicsTechnical
- Dual-Perspective Disentanglement: Learning Symmetric Group-Aware Representations for Cross-Domain RecommendationTechnical
- Dual-Phase Visual-Language Pretraining and Adaptation for Long-Tailed Multi-Label RecognitionTechnical
- Dual-Seed Evolutionary Algorithm for Noise Optimization in Diffusion ModelsTechnical
- Dual-Teacher Interactive Knowledge Distillation Network for Text-to-Visible & Infrared Person RetrievalTechnical
- Dual-View Inference Attack: Machine Unlearning Amplifies Privacy ExposureTechnical
- Dual-branch Spatial-Temporal Self-supervised Representation for Enhanced Road Network LearningTechnical
- Dual-stream Relation-modeling Disentanglement for Cloth-Changing Person Re-IdentificationTechnical
- DualFete: Revisiting Teacher-Student Interactions from a Feedback Perspective for Semi-supervised Medical Image SegmentationTechnical
- DualScope: Capturing Critical Spatial and Temporal Cues for Distracted Driving Activity RecognitionTechnical
- DualSpeechLM: Towards Unified Speech Understanding and Generation via Dual Speech Token Modeling with Large Language ModelsTechnical
- DuoCast: Duo-Probabilistic Diffusion for Precipitation NowcastingTechnical
- DuoKD: Dual Knowledge Distillation from Large Language Models for Robust Graph Neural NetworksTechnical
- Duplex Rewards Optimization for Test-Time Composed Image RetrievalTechnical
- DyC-STG: Dynamic Causal Spatio-Temporal Graph Network for Real-time Data Credibility Analysis in IoTTechnical
- DySy-Det: A Synergistic Framework with Dynamic Reconstruction-Path Consistency for AI-Generated Image DetectionTechnical
- DynaQuant: Dynamic Mixed-Precision Quantization for Learned Image CompressionTechnical
- Dynamic Agent Grouping ECBS: Scaling Windowed Multi-Agent Path Finding with Completeness GuaranteesTechnical
- Dynamic Cognitive Planning for Cognitive-Functional Dialogue: A Case Study in Emotional Support ConversationTechnical
- Dynamic Deep Graph Learning for Incomplete Multi-View Clustering with Masked Graph Reconstruction LossTechnical
- Dynamic Deep Prompt Optimization for Defending Against Jailbreak Attacks on LLMsTechnical
- Dynamic Gaussian Scene Reconstruction from Unsynchronized VideosTechnical
- Dynamic Geometric Equivariant Network for Full-Atom Antibody DesignTechnical
- Dynamic Semantic Tokenization for Time Series via Elastic Sampling on Physics-aware PerceptionTechnical
- Dynamic Sparsity: Challenging Common Sparsity Assumptions for Learning World Models in Robotic Reinforcement Learning BenchmarksTechnical
- Dynamic Weight Adaptation in Spiking Neural Networks Inspired by Biological HomeostasisTechnical
- Dynamic-Static Collaboration for Unsupervised Domain Adaptive Video-Based Visible-Infrared Person Re-IdentificationTechnical
- Dynamic-Static Synergistic Selection Method for Candidate Code Solutions with Generated Test CasesTechnical
- DynamicRTL: RTL Representation Learning for Dynamic Circuit BehaviorTechnical
- Dynamics-Aware Planning Representation for Zero-Shot Reinforcement Learning (Student Abstract)Technical
- D²-VPR: A Parameter-efficient Visual-foundation-model-based Visual Place Recognition Method via Knowledge Distillation and Deformable AggregationTechnical
- D²PPO: Diffusion Policy Policy Optimization with Dispersive LossTechnical
- D²Pruner: Debiased Importance and Structural Diversity for MLLM Token PruningTechnical
- E-Logic Prompt: Unified Energy-Logic Framework for Continual Visual Question AnsweringTechnical
- E-MaT:Event-oriented Mamba for Egocentric Point TrackingTechnical
- EA-VAE: Learning to Reconstruct Dysarthric Speech via Variational Autoencoder with Encoding AlignmentTechnical
- EA: Managing Green Data Centers Using Deep Reinforcement Learning Without DiscountingTechnical
- EAGLE: Episodic Appearance- and Geometry-aware Memory for Unified 2D-3D Visual Query Localization in Egocentric VisionTechnical
- EARG-Net: Edge-Aware Reconstruction-Guided Network for Image Manipulation Detection and LocalizationTechnical
- EASE: Practical and Efficient Safety Alignment for Small Language ModelsTechnical
- EC-MVSNet: Enhanced Cascaded Multi-View Stereo with Cross-Scale Relevance IntegrationTechnical
- ECD: Evidence-guided Contrastive Decoding in Retrieval-Augmented Generation with Accurate Knowledge Reference AdjustmentTechnical
- ECPv2: Fast, Efficient, and Scalable Global Optimization of Lipschitz FunctionsTechnical
- EEG Agent: A Unified Framework for Automated EEG Analysis Using Large Language ModelsTechnical
- EEG-DLite: Dataset Distillation for Efficient Large EEG Model TrainingTechnical
- EFX Allocation in (Multi)HypergraphsTechnical
- EFX and PO Allocation Exists for Two Types of GoodsTechnical
- EHL*: Memory-Budgeted Indexing for Ultrafast Optimal Euclidean PathfindingTechnical
- EHRStruct: A Comprehensive Benchmark Framework for Evaluating Large Language Models on Structured Electronic Health Record TasksTechnical
- EIDSeg: A Pixel-Level Semantic Segmentation Dataset for Post-Earthquake Damage Assessment from Social Media ImagesTechnical
- ELSPR: Evaluator LLM Training Data Self-Purification on Non-Transitive Preferences via Tournament Graph ReconstructionTechnical
- EM-KD: Distilling Efficient Multimodal Large Language Model with Unbalanced Vision TokensTechnical
- EMAformer: Enhancing Transformer Through Embedding Armor for Time Series ForecastingTechnical
- EMOD: A Unified EEG Emotion Representation Framework Leveraging V-A Guided Contrastive LearningTechnical
- EMODIS: A Benchmark for Context-Dependent Emoji Disambiguation in Large Language ModelsTechnical
- ENCORE: Entropy-guided Reward Composition for Multi-head Safety Reward ModelsTechnical
- ENHash: Error Notebook-Guided Fine-Grained Learning for Unsupervised Cross-Modal HashingTechnical
- EPIC: Explanation of Pretrained Image Classification Networks via PrototypesTechnical
- EPO: Diverse and Realistic Protein Ensemble Generation via Energy Preference OptimizationTechnical
- EPSegFZ: Efficient Point Cloud Semantic Segmentation for Few- and Zero-Shot Scenarios with Language GuidanceTechnical
- ERank: Fusing Supervised Fine-Tuning and Reinforcement Learning for Effective and Efficient Text RerankingTechnical
- ESCA: An Emotional Support Conversation Agent for Enhancing Reasonable Strategy Planning and Effective ExpressionTechnical
- ESG-Bench: Benchmarking Long-Context ESG Reports for Hallucination MitigationTechnical
- ESMC: MLLM-Based Embedding Selection for Explainable Multiple ClusteringTechnical
- EVOKE: Efficient and High-Fidelity EEG-to-Video Reconstruction via Decoupling Implicit Neural RepresentationTechnical
- Early Warning of Intraoperative Adverse Events via Transformer-Driven Multi-Label LearningTechnical
- Earth-Adapter: Bridge the Geospatial Domain Gaps with a Frequency-Guided Mixture of AdaptersTechnical
- EarthCrafter: Scalable 3D Earth Generation via Dual-Sparse Latent DiffusionTechnical
- Easy for Children, Hard for AI: The Limits of Multimodal LLMs in Early Childhood LearningTechnical
- Easy to Learn, Yet Hard to Forget: Towards Robust Unlearning Under BiasTechnical
- EasyText: Controllable Diffusion Transformer for Multilingual Text RenderingTechnical
- EccoMamba: Enhanced Cross-hierarchical Continuity Orthogonal Mamba for Medical Image SegmentationTechnical
- EchoBat: Echo-Vision Enhancement and Echo-Layered Sampling for Video LLMs Hallucination MitigationTechnical
- EchoEdit: Consistent Multi-Hop Question Answering via Ripple Control in Knowledge EditingTechnical
- EchoGen: Cycle-Consistent Learning for Unified Layout-Image Generation and UnderstandingTechnical
- EchoMimicV3: 1.3B Parameters Are All You Need for Unified Multi-Modal and Multi-Task Human AnimationTechnical
- Echoless Label-Based Pre-computation for Memory-Efficient Heterogeneous Graph LearningTechnical
- EcoAgent: An Efficient Device-Cloud Collaborative Multi-Agent Framework for Mobile AutomationTechnical
- EcoDiffusion: Uncertainty-Aware Emulation of Ecosystem Processes with Conditional Diffusion for Long Sequences with Single-Step InitializationTechnical
- Economics of Content Creation with Generative AITechnical
- EdGCL: Disentangling Social and Cognitive Homophily in Graph-Based Educational Recommender SystemsTechnical
- Edge Consistency for 4D Gaussian Splatting in Dynamic Scene RenderingTechnical
- Edge Self-Adversarial Augmentation Enhances Graph Contrastive Learning Against Neighborhood InconsistencyTechnical
- Edge-Binary Public Goods GamesTechnical
- Edge-Centric Relational Reasoning for 3D Scene Graph PredictionTechnical
- EdgeMTSC: A Lightweight Large-Kernel ConvNet for Multivariate Time Series ClassificationTechnical
- Editing Is a Bargaining Game: Balanced Knowledge Editing in Large Language ModelsTechnical
- Editing as Unlearning: Are Knowledge Editing Methods Strong Baselines for Large Language Model Unlearning?Technical
- EduGuardBench: A Holistic Benchmark for Evaluating the Pedagogical Fidelity and Adversarial Safety of LLMs as Simulated TeachersTechnical
- EduMod-LLM: A Modular Approach for Designing Flexible and Transparent Educational AssistantsTechnical
- Educating the Public in Artificial Intelligence: Insights from a Large-Scale CourseTechnical
- Effective Robotic Cloth Grasping Through Suppressing False DiscoveriesTechnical
- Effective Strategies for Teaching Machine LearningTechnical
- Efficient Chromosome Parallelization for Precision Medicine Genomic WorkflowsTechnical
- Efficient Contextual Bandit Learning via Reward-Space Sampling and Online Optimization (Student Abstract)Technical
- Efficient Diffusion Planning with Temporal DiffusionTechnical
- Efficient Few-Step Solution Generation via Discrete Flow Matching for Combinatorial OptimizationTechnical
- Efficient Forecasting of Geostationary Infrared Brightness Temperature Sequences: A Benchmark and a Lightweight ModelTechnical
- Efficient Hallucination Detection: Adaptive Bayesian Estimation of Semantic Entropy with Guided Semantic ExplorationTechnical
- Efficient LLM-Jailbreaking via Multimodal-LLM JailbreakTechnical
- Efficient Modality Translation via Arbitrary Conditioning and Wasserstein RegularizationTechnical
- Efficient Model Specialization via Training-time and Test-time AdaptationTechnical
- Efficient Multiagent Planning via Shared Action SuggestionsTechnical
- Efficient Multimodal Large Language Model via Dynamic KV Cache QuantizationTechnical
- Efficient Plug-and-Play Weight Refinement for Sparse Large ModelsTechnical
- Efficient Post-Training Refinement of Latent Reasoning in Large Language ModelsTechnical
- Efficient Preference Alignment via Pareto Exploration (Student Abstract)Technical
- Efficient Protein Optimization via Structure-aware Hamiltonian DynamicsTechnical
- Efficient Reasoning for Large Reasoning Language Models via Certainty-Guided Reflection SuppressionTechnical
- Efficient Reinforcement Learning for Zero-Shot Coordination in Evolving GamesTechnical
- Efficient Robot Learning from Diverse DataTechnical
- Efficient Rule Induction by Ignoring Pointless RulesTechnical
- Efficient Segmentation with Multimodal Large Language Model via Token RoutingTechnical
- Efficient Solution and Learning of Robust Factored MDPsTechnical
- Efficient Switchable Safety Control in LLMs via Magic-Token-Guided Co-TrainingTechnical
- Efficient Tensorized Multi-View Anchor Graph Clustering with Affinity Propagation for Remote Sensing DataTechnical
- Efficient Thought Space Exploration Through Strategic InterventionTechnical
- Efficient Transcoder Adaptation for Fine-Tuned Models: Revealing Medical Reasoning Mechanisms in Large Language ModelsTechnical
- Efficient Verification and Falsification of ReLU Neural Barrier CertificatesTechnical
- Efficient and Adaptive Simultaneous Speech Translation with Fully Unidirectional ArchitectureTechnical
- Efficient and Effective In-context Demonstration Selection with CoresetTechnical
- Efficient and Reliable Hitting-Set Computations for the Implicit Hitting Set ApproachTechnical
- Efficient, Secure, Differentially Private Deep Learning in the Two-Server ModelTechnical
- EfficientFSL: Enhancing Few-Shot Classification via Query-Only Tuning In Vision TransformersTechnical
- EfficientFlow: Efficient Equivariant Flow Policy Learning for Embodied AITechnical
- Efficiently Computing Compact Formal ExplanationsTechnical
- Efficiently Enhancing Long-term Series Forecasting via Adaptive Lookback with WaveletsTechnical
- Efficiently Seeking Flat Minima for Better Generalization in Fine-Tuning Large Language Models and BeyondTechnical
- Ego-PMOVE: Prompt-aware Mixture of View Experts Network for Egocentric Gaze PredictionTechnical
- EgoCross: Benchmarking Multimodal Large Language Models for Cross-Domain Egocentric Video Question AnsweringTechnical
- EgoEMS: A High-Fidelity Multimodal Egocentric Dataset for Cognitive Assistance in Emergency Medical ServicesTechnical
- Eguard: Defending LLM Embeddings Against Inversion Attacks via Text Mutual Information OptimizationTechnical
- EigenShield: Inference-Time, Model-Agnostic Jailbreaking Defense via Causal Subspace FilteringTechnical
- ElastoGen: 4D Generative ElastodynamicsTechnical
- ElementaryNet: A Non-Strategic Neural Network for Predicting Human Behavior in Normal-Form GamesTechnical
- Elevating AI on the Edge: A Demonstration of MIMaaS (Machine Intelligence with Microcontroller-as-a-Service)Technical
- Eliciting Causal Knowledge from AgentsTechnical
- Eliciting Chain-of-Thought in Base LLMs via Gradient-Based Representation OptimizationTechnical
- Elite Pattern Reinforcement for Vehicle Routing ProblemsTechnical
- Ellipsoid-Based Decision Boundaries for Open Intent ClassificationTechnical
- Embracing Positional Bias in Multiple-Choice Question Answering via Permutation Equivariant Neural NetworksTechnical
- EmbryoDiff: A Conditional Diffusion Framework with Multi-Focal Feature Fusion for Fine-Grained Embryo Developmental Stage RecognitionTechnical
- Emergent Fast-Slow Dynamics in Multi-Agent Q-Learning for Networked Stochastic GamesTechnical
- EmoVid: A Multimodal Emotion Video Dataset for Emotion-Centric Video Understanding and GenerationTechnical
- Emotion and Intention Guided Multi-Modal Learning for Sticker Response SelectionTechnical
- Emotion-Coherent Reasoning for Multimodal LLMs via Emotional Rationale VerifierTechnical
- Emotion-Conditioned Motion Sub-spaces with Flow Matching for Real-Time Audio-Driven Talking HeadsTechnical
- Empowering DINO Representations for Underwater Instance Segmentation via Aligner and PrompterTechnical
- Empowering LLMs with Symbolic Representation and ReasoningTechnical
- Empowering Semantic-Sensitive Underwater Image Enhancement with VLMTechnical
- Empowering Sparse-Input Neural Radiance Fields with Dual-Level Semantic Guidance from Dense Novel ViewsTechnical
- EnViT: Enhancing the Performance of Early-Exit Vision Transformers via Exit-Aware Structured Dropout-Enabled Self-DistillationTechnical
- Enabling Delayed-Full Charging Through Transformer-Based Real-Time-to-Departure Modeling for EV Battery LongevityTechnical
- Encode Geometric Diagram as Geo-Graph in Geometry Problem SolvingTechnical
- End-Effector Cartesian Velocity Control for Redundant Loader Cranes Using Reinforcement Learning (Abstract Reprint)Technical
- End-to-End Contrastive Language-Speech Pretraining Model for Long-Form Spoken Question AnsweringTechnical
- End-to-End Knowledge Distillation for Unsupervised Domain Adaptation with Large Vision-language ModelsTechnical
- End-to-End Multi-Person Pose Estimation with Pose-Aware Video TransformerTechnical
- EndoIR: Degradation-Agnostic All-in-One Endoscopic Image Restoration via Noise-Aware Routing DiffusionTechnical
- Endowing Vision-Language Models with System 2 Thinking for Fine-grained Visual RecognitionTechnical
- Energy-based Autoregressive Generation for Neural Population DynamicsTechnical
- Energy-guided Dual Domain-invariant Prompting Framework with Fourier Regularization for Generalized Few-Shot Medical SegmentationTechnical
- Enhanced Federated Deep Multi-View Clustering Under Uncertainty ScenarioTechnical
- Enhanced Privacy Leakage from Noise-Perturbed Gradients via Gradient-Guided Conditional Diffusion ModelsTechnical
- Enhanced Recommendation Systems with Retrieval-Augmented Large Language Model (Abstract Reprint)Technical
- Enhancing All-to-X Backdoor Attacks with Optimized Target Class MappingTechnical
- Enhancing Binary Encoded Crime Linkage Analysis Using Siamese NetworkTechnical
- Enhancing Chemical Explainability Through Counterfactual MaskingTechnical
- Enhancing Control Policy Smoothness by Aligning Actions with Predictions from Preceding StatesTechnical
- Enhancing Conversational Recommender Systems with Tree-Structured Knowledge and Pretrained Language ModelsTechnical
- Enhancing DPSGD via Per-Sample Momentum and Low-Pass FilteringTechnical
- Enhancing Diffusion Policies with Distribution-Matching Generator in Offline Reinforcement LearningTechnical
- Enhancing Exploration and Exploitation in Hierarchical Reinforcement Learning with Subgoal Graph LearningTechnical
- Enhancing Generalization of Depth Estimation Foundation Model via Weakly-Supervised Adaptation with RegularizationTechnical
- Enhancing Interpretability for Vision Models via Shapley Value OptimizationTechnical
- Enhancing Kernel Power $K$-means: Scalable and Robust Clustering with Random Fourier Features and Possibilistic MethodTechnical
- Enhancing Logical Expressiveness in Graph Neural Networks via Path-Neighbor AggregationTechnical
- Enhancing Medical Large Vision-Language Models via Alignment DistillationTechnical
- Enhancing Meme Emotion Understanding with Multi-Level Modality Enhancement and Dual-Stage Modal FusionTechnical
- Enhancing Multimodal Misinformation Detection by Replaying the Whole Story from Image Modality PerspectiveTechnical
- Enhancing Noise Resilience in Face Clustering via Sparse Differential TransformerTechnical
- Enhancing PIBT via Multi-Action OperationsTechnical
- Enhancing Pre-training Data Detection in LLMs Through Discriminative and Symmetric Prefix SelectionTechnical
- Enhancing Predictive Model Learning via Domain-Knowledge Augmented Latent Feature MiningTechnical
- Enhancing Retrieval-Augmented Large Vision Language Models via Knowledge Conflict MitigationTechnical
- Enhancing Robustness of Offline Reinforcement Learning Under Data Corruption via Sharpness-Aware Minimization (Student Abstract)Technical
- Enhancing Rotation-Invariant 3D Learning with Global Pose Awareness and Attention MechanismsTechnical
- Enhancing Spatial Reasoning Through Visual and Textual ThinkingTechnical
- Enhancing Stability and Fidelity for Zero-Shot TTS with a Multi-Level EvaluatorTechnical
- Enhancing Strategy Logic with Procedural RationalityTechnical
- Enhancing Uncertainty Estimation in LLMs with Expectation of Aggregated Internal BeliefTechnical
- Enhancing the Knowledge Tracing via a Plug-In Guided Diffusion ModelTechnical
- Enumerating Minimal Unsatisfiable Cores of LTLf FormulaeTechnical
- EoH-S: Evolution of Heuristic Set Using LLMs for Automated Heuristic DesignTechnical
- EquaCode: A Multi-Strategy Jailbreak Approach for Large Language Models via Equation Solving and Code CompletionTechnical
- Equilibrium-Driven Vertical Federated Learning with Selective Privacy ProtectionTechnical
- Equivariant Atomic and Lattice Modeling Using Geometric Deep Learning for Crystal Structure OptimizationTechnical
- Error Correction in Radiology Reports: A Knowledge Distillation-Based Multi-Stage FrameworkTechnical
- Error Slice Discovery via Manifold CompactnessTechnical
- Escaping Optimization Stagnation: Taking Steps Beyond Task Arithmetic via Difference VectorsTechnical
- Escaping the CAM Shadow: Uncertainty-Guided Reliable Learning for Weakly Supervised Semantic SegmentationTechnical
- EssayBench: Evaluating Large Language Models in Multi-Genre Chinese Essay WritingTechnical
- Estimating Online Influence Needs Causal Modeling! Counterfactual Analysis of Misinformation Engagement on Social MediaTechnical
- Estimating the True Distribution of Data Collected with Randomized ResponseTechnical
- Ethical Decision-making with AI: Value Alignment and the Role of ReasoningTechnical
- Ev-iCRF: Self-supervised Event-guided iCRF Estimation for HDR Image ReconstructionTechnical
- EvDiff3D: Event-Aware Diffusion Repair for High-Fidelity Event-Based 3D ReconstructionTechnical
- EvalMuse-40K: A Fine-Grained Benchmark with Comprehensive Human Annotations for Text-to-Image Generation Model Alignment EvaluationTechnical
- EvalQAG: A Framework for Automatic Complex QA Generation and a Benchmark QA Dataset for Policy DocumentsTechnical
- Evaluating LLMs for Police Decision-Making: A Framework Based on Police Action ScenariosTechnical
- Evaluating Online Moderation via LLM-Powered Counterfactual SimulationsTechnical
- Evaluating the Factuality of Large Language Models Using Multiple Plug-and-Play Fact SourcesTechnical
- Evaluating, Synthesizing, and Enhancing for Customer Support ConversationTechnical
- Event-Guided Scene Text Image Super-ResolutionTechnical
- Event-Guided Super-Resolving Blurry Image via Asymmetric Integral Driven ConsistencyTechnical
- Every Little Bit Helps: Exploring Better Utilization of Unlabeled Data for Semi-supervised Singing Melody Extraction Using Multi-bands Diffusion ModelTechnical
- Evidence-aware Integration and Domain Identification of Spatial Transcriptomics DataTechnical
- EvoEmpirBench: Dynamic Spatial Reasoning with Agent-ExpVerTechnical
- EvoFMVC: Trusted Federated Multi-View Clustering with Evolutionary FusionTechnical
- EvoGrad: Evolutionary-Weighted Gradient and Hessian Learning for Black-Box OptimizationTechnical
- EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language ModelsTechnical
- Evolving Generalist Virtual Agents with Generative and Associative MemoryTechnical
- Evolving Semantic Propagation for Aerial Semantic 3D Gaussian SplattingTechnical
- ExPairT-LLM: Exact Learning for LLM Code Selection by Pairwise QueriesTechnical
- Exact Algorithms for Distance to Unique Vertex CoverTechnical
- Exact Combinatorial Multi-Class Graph Cuts for Semi-Supervised LearningTechnical
- Exact Optimization for Minimum Dominating SetsTechnical
- Exact Shapley Attributions in Quadratic-time for FANOVA Gaussian ProcessesTechnical
- Exact and Approximate Maximin Share Allocations in Multi-GraphsTechnical
- Exclusion Zones of Instant Runoff VotingTechnical
- Existence of 2-EFX Allocations of ChoresTechnical
- Exo2Ego: Exocentric Knowledge Guided MLLM for Egocentric Video UnderstandingTechnical
- ExoTimer: Leveraging Large Language Models for Time Series Forecasting with Exogenous VariablesTechnical
- Expand Your SCOPE: Semantic Cognition over Potential-Based Exploration for Embodied Visual NavigationTechnical
- Expandable and Differentiable Dual Memories with Orthogonal Regularization for Exemplar-free Continual LearningTechnical
- Experience with Single Domain Generalization in Real World Medical Imaging DeploymentsTechnical
- Experiential Fairness: Bridging the Gap Between User Experience and Resource-Centric Fairness in Online LLM ServicesTechnical
- Experimentation on Endogenous GraphsTechnical
- Expert-Guided Prompting and Retrieval-Augmented Generation for Emergency Medical Service Question AnsweringTechnical
- Expert-Inspired Multi-Agent Coordination for Multi-Objective Molecular OptimizationTechnical
- ExpertAD: Enhancing Autonomous Driving Systems with Mixture of ExpertsTechnical
- Explain with Visual Keypoints Like a Real Mentor! A Benchmark for Multimodal Solution ExplanationTechnical
- Explain-from-Stroke: Capturing Invisible Learning Processes Through Handwriting Dynamics AnalysisTechnical
- Explainable Depression Assessment from Face Videos by Weakly Supervised LearningTechnical
- Explainable Melanoma Diagnosis with Contrastive Learning and LLM-based Report GenerationTechnical
- Explainable Synthetic Image Detection Through Diffusion Timestep EnsemblingTechnical
- Explaining Decentralized Multi-Agent Reinforcement Learning PoliciesTechnical
- Explaining Temporal Graph Neural Network via Quantum-Inspired Evolutionary AlgorithmTechnical
- Explaining Tournament Solutions with Minimal SupportsTechnical
- Explanation-Preserving Augmentation for Semi-Supervised Graph Representation LearningTechnical
- Explanations for Sequential Decision-Making – an OverviewTechnical
- Explicit Intent-Enhanced Knowledge Distillation for Trip RecommendationTechnical
- Explicit Modeling of Causal Factors and Confounders for Image ClassificationTechnical
- Explicit Temporal-Semantic Modeling for Dense Video Captioning via Context-Aware Cross-Modal InteractionTechnical
- Exploiting All Mamba Fusion for Efficient RGB-D TrackingTechnical
- Exploiting Blurry Representations for Event-guided Video Super-ResolutionTechnical
- Exploiting Geometric Structures for Modeling Multi-Agent Behaviors: A New ThinkingTechnical
- Exploiting Graph-Based Structural Priors for Visual RecognitionTechnical
- Exploiting Inter-Session Information with Frequency-enhanced Dual-Path Networks for Sequential RecommendationTechnical
- Exploiting Missing Data Remediation Strategies Using Adversarial Missingness AttacksTechnical
- Exploiting Pre-trained Language Model for Cross-city Urban Flow Prediction Guided by Information-theoretic AnalysisTechnical
- Exploiting Space Folding by Neural NetworksTechnical
- Exploiting Synergistic Cognitive Biases to Bypass Safety in LLMsTechnical
- Explore How to Inject Beneficial Noise in MLLMsTechnical
- Explore and Establish Synergistic Effects Between Weight Pruning and Coreset Selection in Neural Network TrainingTechnical
- Explore to Learn: Latent Exploration Through Disentangled Synergy Patterns for Reinforcement Learning in Overactuated ControlTechnical
- Exploring Category-level Articulated Object Pose Tracking on SE(3) ManifoldsTechnical
- Exploring Cross-Cultural Perspectives on AI Education: Insights from Teachers in Nigeria and the USATechnical
- Exploring Depth Generalization in Large Language Models for Solving Recursive Logic TasksTechnical
- Exploring Domain Generalization and Subpopulation Shift for Generalizable Graph-Level Anomaly DetectionTechnical
- Exploring Efficient Open-Vocabulary Segmentation in the Remote SensingTechnical
- Exploring Generalizable Remote Sensing Change Detection via Low-Rank Exchange Adaptation of Vision Foundation ModelTechnical
- Exploring High-order-aware Prompt Learning for Zero-shot Anomaly DetectionTechnical
- Exploring Modality-Aware Fusion and Decoupled Temporal Propagation for Multi-Modal Object TrackingTechnical
- Exploring Non-Convex Discrete Energy Landscapes: An Efficient Langevin-Like Sampler with Replica ExchangeTechnical
- Exploring Position Encoding Mechanism in Diffusion U-Net for Training-free High-resolution Image GenerationTechnical
- Exploring Reliable Spatiotemporal Dependencies for Efficient Visual TrackingTechnical
- Exploring Selective Avoidance for Online User Behavior Analysis: A Forest of Thought ExplanationTechnical
- Exploring Surround-View Fisheye Camera 3D Object DetectionTechnical
- Exploring Transferability of Self-Supervised Learning by Task Conflict CalibrationTechnical
- Exploring the Janus Face of Synthetic Images: From Privacy-secure Biometrics to Universal and Robust Deepfake DetectionTechnical
- Exploring the Potentials of Spiking Neural Networks for Image DerainingTechnical
- Exposing DeepFakes via Hyperspectral Domain Mapping (Student Abstract)Technical
- Exposing the Cracks: Vulnerabilities of Retrieval-Augmented LLM-based Machine TranslationTechnical
- Expressive Power of Graph Transformers via LogicTechnical
- Expressive Recursive Answers for Ontological Knowledge BasesTechnical
- Expressive Temporal Specifications for Reward MonitoringTechnical
- ExtendAttack: Attacking Servers of LRMs via Extending ReasoningTechnical
- Extendable Planning via Multiscale DiffusionTechnical
- Extending Description Logics with Generic Concepts – the Case of TerminologiesTechnical
- Extracting Events Like Code: A Multi-Agent Programming Framework for Zero-Shot Event ExtractionTechnical
- Extracting Interaction-Aware Monosemantic Concepts in Recommender SystemsTechnical
- Extracting Multimodal Learngene in CLIP: Unveiling the Multimodal Generalizable KnowledgeTechnical
- Extreme Value Monte Carlo Tree Search for Classical PlanningTechnical
- E³SAM2: Entropy-Aware and Edge-Guided Adaptation of SAM2 for Echocardiography Video SegmentationTechnical
- F.A.C.U.L.: Language-Based Interaction with AI Companions in GamingTechnical
- F2RVLM: Boosting Fine-grained Fragment Retrieval for Multi-Modal Long-form Dialogue with Vision Language ModelTechnical
- F2SST: Frequency-to-Spatial Semantic Transfer for Few-Shot Image ClassificationTechnical
- FACTGUARD: Event-Centric and Commonsense-Guided Fake News DetectionTechnical
- FAM: Fine-Grained Alignment Matters in Multimodal Embedding Learning with Large Vision-Language ModelsTechnical
- FAMDR: Feature-Aligned Multimodal Denoising for Reliable Diagnostic Reconciliation in Medical ImagingTechnical
- FANoise: Singular Value-Adaptive Noise Modulation for Robust Multimodal Representation LearningTechnical
- FARM: Frame-Accelerated Augmentation and Residual Mixture-of-Experts for Physics-Based High-Dynamic Humanoid ControlTechnical
- FCMO: A Flow-Curv Mamba Operator for Large-Scale 3D Vehicle AerodynamicsTechnical
- FD-MAGRPO: Functionality-Driven Multi-Agent Group Relative Policy Optimization for Analog-LDO SizingTechnical
- FDC-Ground: Improving GRPO for GUI Grounding via Exponential Rewards and Fact-Aligned PruningTechnical
- FDP: A Frequency-Decomposition Preprocessing Pipeline for Unsupervised Anomaly Detection in Brain MRITechnical
- FGD-Align: Pluralistic Alignment for Large Language Models via Fuzzy Group Decision-MakingTechnical
- FGM-HD: Boosting Generation Diversity of Fractal Generative Models through Hausdorff Dimension InductionTechnical
- FGNet: Leveraging Feature-Guided Attention to Refine SAM2 for 3D EM Neuron SegmentationTechnical
- FIA-Edit: Frequency-Interactive Attention for Efficient and High-Fidelity Inversion-Free Text-Guided Image EditingTechnical
- FILTER: A Framework for Defending Against Backdoor Attacks in Vertical Federated LearningTechnical
- FIND: A Simple Yet Effective Baseline for Diffusion-Generated Image DetectionTechnical
- FINE: Factorized Multimodal Sentiment Analysis via Mutual INformation EstimationTechnical
- FIRM-MoE:Fine-GrainedExpert Decomposition for Resource-Adaptive MoE InferenceTechnical
- FIXME: Towards End-to-End Benchmarking of LLM-Aided Design VerificationTechnical
- FLAG-4D: Flow-Guided Local-Global Dual-Deformation Model for 4D ReconstructionTechnical
- FLRQ: Faster LLM Quantization with Flexible Low-Rank Matrix SketchingTechnical
- FP=XINT: Representing Neural Networks via Low-Bit Series Basis FunctionsTechnical
- FPT Approximation Algorithms for TSP on Non-Metric GraphsTechnical
- FQ-PETR: Fully Quantized Position Embedding Transformation for Multi-View 3D Object DetectionTechnical
- FRBAT: Conditionally-Visible Physical Backdoor Attack via FluorescenceTechnical
- FRoD: Full-Rank Efficient Fine-Tuning with Rotational Degrees for Fast ConvergenceTechnical
- FT-MoE: Sustainable-learning Mixture of Experts for Fault-Tolerant ComputingTechnical
- FT-NCFM: An Influence-Aware Data Distillation Framework for Efficient VLA ModelsTechnical
- FUSE: Fine-Grained and Semantic-Aware Learning for Unified Image Understanding and GenerationTechnical
- FUSION: Dataset Pruning via Fusing Uncertainty with Structural Information for Optimal Neural Training in Crystal Property PredictionTechnical
- FVNet: Harnessing Liquid Neural Dynamics for Lightweight Visual RepresentationTechnical
- FaNe: Towards Fine-Grained Cross-Modal Contrast with False-Negative Reduction and Text-Conditioned Sparse AttentionTechnical
- FaceShield: Explainable Face Anti-Spoofing with Multimodal Large Language ModelsTechnical
- Facial Dynamics in Video: Instruction Tuning for Improved Facial Expression Perception and Contextual AwarenessTechnical
- Facial-R1: Aligning Reasoning and Recognition for Facial Emotion AnalysisTechnical
- Facilitating Early Maladaptive Schema–Guided Polite and Empathetic Psychotherapeutic Support: An LLM-Driven MoE-RL-Based Dialogue SystemTechnical
- Facility Location for Congesting Commuters and Generalizing the Cost-Distance ProblemTechnical
- Fact2Fiction: Targeted Poisoning Attack to Agentic Fact-checking SystemTechnical
- Factorization-in-Loop:Proximal Fill-in Minimization for Sparse Matrix ReorderingTechnical
- Factuality Evaluation Using Reasoning and World ModelingTechnical
- Fading the Digital Ink: A Universal Black-Box Attack Framework for 3DGS Watermarking SystemsTechnical
- Failure Localization in Multi-Agent Code Generation via Knowledge-Guided and Transferable ReasoningTechnical
- Failures to Surface Harmful Contents in Video Large Language ModelsTechnical
- Fair Algorithms with Probing for Multi-Agent Multi-Armed BanditsTechnical
- Fair Allocation of Indivisible Goods with Variable GroupsTechnical
- Fair Bayesian Data Selection via Generalized Discrepancy MeasuresTechnical
- Fair Diffusion AuctionsTechnical
- Fair Division Among Couples and Small GroupsTechnical
- Fair Domain Generalization: An Information-Theoretic ViewTechnical
- Fair Facial Attribute Recognition via Group-Decoupled Vision Transformer with Mask-Guided Correlation SuppressionTechnical
- Fair Graph Learning with Limited Sensitive Attribute InformationTechnical
- Fair Incentives for Early Arrival in 0-1 Cooperative GamesTechnical
- Fair Model-based ClusteringTechnical
- Fair Societies: Algorithms for House AllocationsTechnical
- Fair and Efficient Balanced Allocation for Indivisible GoodsTechnical
- FairGC: Fostering Individual and Group Fairness for Deep Graph ClusteringTechnical
- FairGSE: Fairness-Aware Graph Neural Network Without High False Positive RatesTechnical
- Fairness Aware Reinforcement Learning via Proximal Policy OptimizationTechnical
- Fairness Perceptions of Large Language ModelsTechnical
- Fairness and Stability for Shared Resource Allocation ProblemsTechnical
- Fairness in Repeated Matching: A Maximin PerspectiveTechnical
- Fairness in the Multi-Secretary ProblemTechnical
- Fairness-Aware Design for Contextual Experiments: Guaranteeing Reliability and Equity in Heterogeneous SubgroupsTechnical
- Faithful in Steps: Improving Generalization and Citation in RAG via Query DecompositionTechnical
- False Positives Matter: Multidimensional Localization Evaluation and Training-Free Explainable Adversarial Patch DefenseTechnical
- FantasyHSI: Video-Generation-Centric 4D Human Synthesis in Any Scene Through a Graph-Based Multi-Agent FrameworkTechnical
- FantasyStyle: Controllable Stylized Distillation for 3D Gaussian SplattingTechnical
- FantasyTalking2: Timestep-Layer Adaptive Preference Optimization for Audio-Driven Portrait AnimationTechnical
- Fashion Microscope: Pixel-Level Attribute Perception via Optimal Transport and Neural Semantic AggregationTechnical
- FashionMAC: Deformation-Free Fashion Image Generation with Fine-Grained Model Appearance CustomizationTechnical
- Fast 3D Surrogate Modeling for Data Center Thermal ManagementTechnical
- Fast Conformal Prediction Using Conditional Interquantile IntervalsTechnical
- Fast Guaranteed Robust Local-Smooth Principal Component SeparationTechnical
- Fast Multi-view Consistent 3D Editing with Video PriorsTechnical
- FastAnimate: Towards Learnable Template Construction and Pose Deformation for Fast 3D Human Avatar AnimationTechnical
- FastDriveVLA: Efficient End-to-End Driving via Plug-and-Play Reconstruction-based Token PruningTechnical
- FastFLUX: Pruning FLUX with Block-wise Replacement and Sandwich TrainingTechnical
- Faster Certified Symmetry Breaking Using Orders with Auxiliary VariablesTechnical
- Faster Game Solving via Asymmetry of Step SizesTechnical
- Faster Game Solving via Hyperparameter SchedulesTechnical
- Faster Symmetry Breaking Constraints for Abstract StructuresTechnical
- Fault Diagnosis of Irregular Sequences by Adjoint Learning in Continuous-Time Model SpaceTechnical
- FeTS: A Feature-Aware Framework for Time Series ForecastingTechnical
- Feasibility-Aware Masked Transformer for the Pickup-and-Delivery Problem with Time Windows (Student Abstract)Technical
- Feature Attribution for Human Sensing with Radio SignalsTechnical
- Feature Compression May Be the Root Cause of Adversarial Fragility in Neural Network Classifiers (Student Abstract)Technical
- Feature Hallucination for Self-supervised Action Recognition (Abstract Reprint)Technical
- Feature Integration Spaces: Joint Training Reveals Dual Encoding in Neural Network RepresentationsTechnical
- Feature-Aware One-Shot Federated Learning via Hierarchical Token SequencesTechnical
- Feature-Centric Unsupervised Node Representation Learning Without Homophily AssumptionTechnical
- FedALT: Federated Fine-Tuning Through Adaptive Local Training with Rest-of-World LoRATechnical
- FedARKS: Federated Aggregation via Robust and Discriminative Knowledge Selection and Integration for Person Re-identificationTechnical
- FedAU2: Attribute Unlearning for User-Level Federated Recommender Systems with Adaptive and Robust Adversarial TrainingTechnical
- FedAdamW: A Communication-Efficient Optimizer with Convergence and Generalization Guarantees for Federated Large ModelsTechnical
- FedBRICK: Structural Bias Aware Heterogeneous Foundation Model Federated TuningTechnical
- FedCD: Towards Consolidated Distillation for Heterogeneous Federated LearningTechnical
- FedCure: Mitigating Participation Bias in Semi-Asynchronous Federated Learning with Non-IID DataTechnical
- FedDNA: DNA Sequence Reconstruction via Deep Evidential Learning and Personalized Federated AggregationTechnical
- FedGRPO: Privately Optimizing Foundation Models with Group-Relative Rewards from Domain ClientsTechnical
- FedLAGC: Towards High Performance System-Heterogeneous Federated Learning via Layer-Adaptive Submodel Extraction and Gradient CorrectionTechnical
- FedMerge: Federated Model Merging for PersonalizationTechnical
- FedPKDA: Personalized Federated Learning with Privacy-Preserving Knowledge Dynamic AlignmentTechnical
- FedPM: Federated Learning Using Second-order Optimization with Preconditioned Mixing of Local ParametersTechnical
- FedP²EFT: Federated Learning to Personalize PEFT for Multilingual LLMsTechnical
- FedRNC: Addressing Spatio-Temporal Label Misalignment in Federated Noisy Class-Incremental LearningTechnical
- FedSDA: Federated Stain Distribution Alignment for Non-IID Histopathological Image ClassificationTechnical
- FedSDWC: Federated Synergistic Dual-Representation Weak Causal Learning for OODTechnical
- FedSEA-LLaMA: A Secure, Efficient and Adaptive Federated Splitting Framework for Large Language ModelsTechnical
- FedSkeleton: Secure Multi-Party Graph Skeleton Construction for Privacy-Preserving Federated Time-Series ForecastingTechnical
- FedTopo: Topology-Informed Representation Alignment in Federated Learning Under Non-I.I.D. ConditionsTechnical
- Federated CLIP for Resource-Efficient Heterogeneous Medical Image ClassificationTechnical
- Federated Context-Aware Personalized RecommendationTechnical
- Federated Cross-Modal Style-Aware Prompt Generation (Student Abstract)Technical
- Federated Graph-level Clustering Network with Attribute InferenceTechnical
- Federated Incomplete Multi-View Clustering with Tensorized Low-Rank ConstraintTechnical
- Federated Learning PlaygroundTechnical
- Federated Linear Dueling BanditsTechnical
- Federated Vision-Language-Recommendation with Personalized FusionTechnical
- Few-Shot Precise Event Spotting via Unified Multi-Entity Graph and DistillationTechnical
- Few-step Flow for 3D Generation via Marginal-Data Transport DistillationTechnical
- Fidelity-Aware Recommendation Explanations via Stochastic Path IntegrationTechnical
- FilmSceneDesigner: Chaining Set Design for Procedural Film Scene GenerationTechnical
- FilmWeaver: Weaving Consistent Multi-Shot Videos with Cache-Guided Autoregressive DiffusionTechnical
- Filter, Correlate, Compress: Training-Free Token Reduction for MLLM AccelerationTechnical
- FinMMDocR: Benchmarking Financial Multimodal Reasoning with Scenario Awareness, Document Understanding, and Multi-Step ComputationTechnical
- FinMathBench: A Formula-Driven Benchmark for Evaluating LLMs’ Math Reasoning Capabilities in FinanceTechnical
- FinRpt: Dataset, Evaluation System and LLM-based Multi-agent Framework for Equity Research Report GenerationTechnical
- FindTheFlaws: Annotated Errors for Detecting Flawed Reasoning and Scalable Oversight ResearchTechnical
- Finding Diverse Solutions Parameterized by CliquewidthTechnical
- Finding One Local Optimum Is Easy—but What About Two?Technical
- Finding Time Series Anomalies Using Granular-Ball Vector Data DescriptionTechnical
- Finding the Translation Switch: Discovering and Exploiting the Task-Initiation Features in LLMsTechnical
- Fine-Grained DINO Tuning with Dual Supervision for Face Forgery DetectionTechnical
- Fine-Grained Generalization via Structuralizing Concept and Feature Space into Commonality, Specificity and ConfoundingTechnical
- Fine-Grained Image Retrieval via Dual-Vision AdaptationTechnical
- Fine-Grained Interpretation of Political Opinions in Large Language ModelsTechnical
- Fine-Grained Representation for Lane Topology ReasoningTechnical
- Fine-Tuned LLMs Know They Don’t Know: A Parameter-Efficient Approach to Recovering HonestyTechnical
- Fine-Tuning Sample Order Matters in Propositional Logical Question-Answering (Student Abstract)Technical
- Fine-flow Distilling Coarse-flow Video Generation for Long-Term Driving World ModelTechnical
- Fine-grained Image Quality Assessment for Perceptual Image RestorationTechnical
- Fine-grained Uncertainty Decomposition in Large Language Models: A Spectral ApproachTechnical
- Fine-tuning Zero-shot Large Language Models for Patient-reported Outcomes (Student Abstract)Technical
- FineRef: Fine-Grained Error Reflection and Correction for Long-Form Generation with CitationsTechnical
- FineTec: Fine-Grained Action Recognition Under Temporal Corruption via Skeleton Decomposition and Sequence CompletionTechnical
- FineVAU: A Novel Human-Aligned Benchmark for Fine-Grained Video Anomaly UnderstandingTechnical
- FineXtrol: Controllable Motion Generation via Fine-Grained TextTechnical
- Firing Bits Where It Matters: Spiking-Guided Just Recognizable Distortion Modeling for Machine-Centric Video CodingTechnical
- First Learn, Then Review: Human-Like Continual Learning for Cross-View Geo-Localization with Limited Field of ViewTechnical
- First-Order Error Matters: Accurate Compensation for Quantized Large Language ModelsTechnical
- First-Order Representation Languages for Goal-Conditioned RLTechnical
- FlashKAT: Understanding and Addressing Performance Bottlenecks in the Kolmogorov-Arnold TransformerTechnical
- FlashSVD: Memory-Efficient Inference with Streaming for Low-Rank ModelsTechnical
- FlashVideo: Flowing Fidelity to Detail for Efficient High-Resolution Video GenerationTechnical
- Flexible Concept Bottleneck ModelTechnical
- Flexible, Lifelong, Explainable, and Robust Solutions for Multi-Agent Path Finding ProblemsTechnical
- FloorPlanFormer: Multi-Task Transformer Network for Floor Plan Recognition with Outer-to-Inner Feature RefinementTechnical
- FlorE: Integrating Full Lorentz Group and Directional Offsets for Effective Knowledge Graph EmbeddingTechnical
- Flora: Effortless Context Construction to Arbitrary Length and ScaleTechnical
- Flow-Based Knowledge Transfer for Efficient Large Model DistillationTechnical
- Flow-Induced Diagonal Gaussian ProcessesTechnical
- FlowAnyTime: Efficient Fine-tuning with Intra-Inter Frame Distillation for All-Weather Optical Flow EstimationTechnical
- FlowPath: Learning Data-Driven Manifolds with Invertible Flows for Robust Irregularly-sampled Time Series ClassificationTechnical
- Flowing Backwards: Improving Normalizing Flows via Reverse Representation AlignmentTechnical
- FoAM: Foresight-Augmented Multi-Task Imitation Policy for Robotic ManipulationTechnical
- FocusDPO: Dynamic Preference Optimization for Multi-Subject Personalized Image Generation via Adaptive FocusTechnical
- Focusing on Language: Revealing and Exploiting Language Attention Heads in Multilingual Large Language ModelsTechnical
- Force-Aware 3D Contact Modeling for Stable Grasp GenerationTechnical
- ForeDiffusion: Foresight-Conditioned Diffusion Policy via Future View Construction for Robot ManipulationTechnical
- ForeSWE: Forecasting Snow-Water Equivalent with an Uncertainty-Aware Attention ModelTechnical
- Forecast Then Calibrate: Feature Caching as ODE for Efficient Diffusion TransformersTechnical
- Forecasting Clinical Risk from Textual Time Series: Structuring Narratives for Temporal AI in HealthcareTechnical
- Forest vs Tree: The (N, K) Trade-off in Reproducible ML EvaluationTechnical
- Forget Less by Learning from Parents Through Hierarchical RelationshipsTechnical
- Forget What Has Seen: Selective Concept Unlearning in Segmentation Foundation ModelsTechnical
- Forgetting Knowledge Localization and Isolation for Continual Forgetting of Pre-trained Vision ModelsTechnical
- Forgetting by Pruning: Data Deletion in Join Cardinality EstimationTechnical
- Formal Abductive Latent Explanations for Prototype-Based NetworksTechnical
- Formal Verification of Diffusion AuctionsTechnical
- Formal Verification of Neural ODE for Safety Evaluation in Autonomous VehiclesTechnical
- Format Matters: The Robustness of Multimodal LLMs in Reviewing Evidence from Tables and ChartsTechnical
- Format as a Prior: Quantifying and Analyzing Bias in LLMs for Heterogeneous DataTechnical
- Foundation-Adaptive Integrated Refinement for Generalized Category DiscoveryTechnical
- FoundationSLAM: Unleashing the Power of Depth Foundation Models for End-to-End Dense Visual SLAMTechnical
- Foundations of Formal Reasoning over Knowledge Bases Combining Symbolic and Sub-Symbolic KnowledgeTechnical
- FourierPET: Deep Fourier-based Unrolled Network for Low-count PET ReconstructionTechnical
- FracSegmentator: Fracture Instance Segmentation with Trauma-Prior-Guided Contrastive LearningTechnical
- Fractured Glass, Failing Cameras: Simulating Physics-Based Adversarial Samples for Autonomous Driving SystemsTechnical
- Fragile by Design: On the Limits of Adversarial Defenses in Personalized DreamBooth GenerationTechnical
- Framework GNN-AID: Graph Neural Network Analysis, Interpretation and DefenseTechnical
- FreDN: Spectral Disentanglement for Time Series Forecasting via Learnable Frequency DecompositionTechnical
- FreLay: Frequency-aware Energy Function for Training-free Layout-to-Image GenerationTechnical
- Free-Form Scene Editor: Enabling Multi-Round Object Manipulation Like in a 3D EngineTechnical
- FreeAskWorld: An Interactive and Closed-Loop Simulator for Human-Centric Embodied AITechnical
- FreeGaussian: Annotation-free Control of Articulated Objects via 3D Gaussian Splats with Flow DerivativesTechnical
- FreeInpaint: Tuning-free Prompt Alignment and Visual Rationality Enhancement in Image InpaintingTechnical
- FreeMem: Enhancing Consistency in Long Video Generation via Tuning-Free MemoryTechnical
- FreqCycle: A Multi-Scale Time-Frequency Analysis Method for Time Series ForecastingTechnical
- FreqTAD: Multi-scale Frequency Encoding and Time-Frequency Attention for Anomaly Detection in Dynamic GraphsTechnical
- Frequency Mining Empowered by Text Aggregation: A New Perspective on Document Image Tampering DetectionTechnical
- Frequency-Aligned Cross-Modal Learning with Top-K Wavelet Fusion and Dynamic Expert Routing for Enhanced Retinal Disease DiagnosisTechnical
- Frequency-Aware Vision-Language Multimodality Generalization Network for Remote Sensing Image ClassificationTechnical
- Frequency-Dependent Scheduled Schrödinger Bridge for Underwater Acoustic Signal DenoisingTechnical
- From Attribution to Action: Jointly ALIGNing Predictions and ExplanationsTechnical
- From Benchmarks to Business Impact: Deploying IBM Generalist Agent in Enterprise ProductionTechnical
- From Blind Transfer to Wise Selection: Prototype-Driven Neighbor-Domain Adaptation for Fake News DetectionTechnical
- From Chaos to Clarity: A Knowledge Graph-Driven Audit Dataset Generation Framework for LLM UnlearningTechnical
- From Chaos to Cure: A Prefix Heuristics Guided Model-Agnostic Adaptive Detoxification FrameworkTechnical
- From Dataset to Real-world: General 3D Object Detection via Generalized Cross-domain Few-shot LearningTechnical
- From Decision Trees to Boolean Logic: A Fast and Unified SHAP AlgorithmTechnical
- From Decisions to Multiplicity: Frameworks, Theories, and ApplicationsTechnical
- From Detection to Diagnosis: Advancing Hallucination Analysis with Automated Data SynthesisTechnical
- From Diagnosis to Generalization: A Cognitive Approach to Data Selection for Educational LLMsTechnical
- From Dialogue to Destination: Geography-Aware Large Language Models with Multimodal Fusion for Conversational RecommendationTechnical
- From Discriminative to Generative: A Diffusion-Based Paradigm for Multi-Agent Collaborative PerceptionTechnical
- From Embeddings to Chatbots: Playful NLP Activities for Middle School AI LiteracyTechnical
- From Few-Shot Learning to Data-Efficient IntelligenceTechnical
- From Hypothesis to Premises: LLM-based Backward Logical Reasoning with Selective Symbolic TranslationTechnical
- From IDs to Semantics: A Generative Framework for Cross-Domain Recommendation with Adaptive Semantic TokenizationTechnical
- From Imitation to Discrimination: Toward a Generalized Curriculum Advantage Mechanism Enhancing Cross-Domain Reasoning TasksTechnical
- From Intent to Execution: Multimodal Chain-of-Thought Reinforcement Learning for Precise CAD Code GenerationTechnical
- From Macro to Micro: Probing Dataset Diversity in Language Model Fine-TuningTechnical
- From Mathematical Reasoning to Code: Generalization of Process Reward Models in Test-Time ScalingTechnical
- From Natural Language to Executable ETL Flows: The IBM DataStage AssistantTechnical
- From Parameter to Representation: A Closed-Form Approach for Controllable Model MergingTechnical
- From Passive Perception to Active Memory: A Weakly Supervised Image Manipulation Localization Framework Driven by Coarse-Grained AnnotationsTechnical
- From Pixels to Logic: A Perception-Reasoning Decomposition Framework for Open-World Referring Expression ComprehensionTechnical
- From Points to Coalitions: Hierarchical Contrastive Shapley Values for Prioritizing Data SamplesTechnical
- From Pretrain to Pain: Adversarial Vulnerability of Video Foundation Models Without Task KnowledgeTechnical
- From Representation to Reasoning: Toward General-Purpose Visual IntelligenceTechnical
- From Sampling to Cognition: Modeling Internal Cognitive Confidence in Language Models for Robust Uncertainty CalibrationTechnical
- From Scene to Object: Enhancing Open-Vocabulary Object Detection via Foreground-Background Context ReasoningTechnical
- From Semantics to Spectrum: A New Lens on Graph Augmentation StrategyTechnical
- From Sequential to Recursive: Enhancing Decision-Focused Learning with Bidirectional FeedbackTechnical
- From Single to Societal: Analyzing Persona-Induced Bias in Multi-Agent InteractionsTechnical
- From Solver to Tutor: Evaluating the Pedagogical Intelligence of LLMs with KMP-BenchTechnical
- From Static to Active: Knowledge-Aware Node State Selection in Multi-view Graph LearningTechnical
- From Stimuli to Minds: Enhancing Psychological Reasoning in LLMs via Bilateral Reinforcement LearningTechnical
- From Subtle to Significant: Prompt-Driven Self-Improving Optimization in Test-Time Graph OOD DetectionTechnical
- From Text to Simulation: A Multi-Agent LLM Workflow for Automated Chemical Process DesignTechnical
- From Tokens to Latent States: Leveraging Pre-trained Language Models for Improving Partially Observable Reinforcement LearningTechnical
- From Woofs to Words: Towards Intelligent Robotic Guide Dogs with Verbal CommunicationTechnical
- Full-Atom Peptide Design via Riemannian–Euclidean Bayesian Flow NetworksTechnical
- Function-on-Function Bayesian OptimizationTechnical
- FuseMine: Robust Multi-Modal Compound-Protein Interaction Prediction via Differential Attention Feature MiningTechnical
- FusedRec: Fused Embedding Communication for Distributed Recommendation Training on GPUsTechnical
- Fusing Deep Learning and Fuzzy Logic: A Framework for Adaptive and Scalable InterpretabilityTechnical
- Fusing Time-Domain and Constellation Views: A Multimodal MAE for Wireless Signals (Student Abstract)Technical
- G-IR: Geometric Image Representation for LearningTechnical
- G-UBS: Towards Robust Understanding of Implicit Feedback via Group-Aware User Behavior SimulationTechnical
- GAGS: Granularity-Aware Feature Distillation for Language Gaussian SplattingTechnical
- GAHMN: A Generative Approach for High-Dimensional Mediation AnalysisTechnical
- GAICo: A Deployed and Extensible Framework for Evaluating Diverse and Multimodal Generative AI OutputsTechnical
- GAICo: Demonstrating a Unified Framework for Multi-Modal GenAI EvaluationTechnical
- GARNET: GoT-Based Alert Reduction and Narrative Event TracingTechnical
- GATCL: An Adaptive Contrastive Learning Framework Based on MHGAT for Spatial Domain Identification in Spatial TranscriptomicsTechnical
- GCA: Geometry-aware Conditional Alignment for Partial Domain Adaptation with Coding Rate ReductionTechnical
- GCIB: Causal Intervention Guided Graph Information Bottleneck FrameworkTechnical
- GCL-OT: Graph Contrastive Learning with Optimal Transport for Heterophilic Text-Attributed GraphsTechnical
- GDBA Revisited: Unleashing the Power of Guided Local Search for Distributed Constraint OptimizationTechnical
- GEM: A Scale-Aware and Distribution-Sensitive Sparse Fine-Tuning Framework for Effective Downstream AdaptationTechnical
- GEM: Gaussian Embedding Modeling for Out-of-Distribution Detection in GUI AgentsTechnical
- GEM: Generative Entropy-Guided Preference Modeling for Few-Shot Alignment of LLMsTechnical
- GEMA-Score: Granular Explainable Multi-Agent Scoring Framework for Radiology Report EvaluationTechnical
- GENMAC: Compositional Text-to-Video Generation with Multi-Agent CollaborationTechnical
- GEWDiff: Geometric Enhanced Wavelet-based Diffusion Model for Hyperspectral Image Super-resolutionTechnical
- GHOST: Solving the Traveling Salesman Problem on Graphs of Convex SetsTechnical
- GIER: Addressing Class Imbalance in GNNs Through Experience ReplayTechnical
- GIIM: Graph-based Learning of Inter- and Intra-view Dependencies for Multi-view Medical Image DiagnosisTechnical
- GINO-Q: Learning an Asymptotically Optimal Index Policy for Restless Multi-armed BanditsTechnical
- GLANCE: Global Actions in a Nutshell for Counterfactual ExplainabilityTechnical
- GLOBA: Rethinking Parameter Conflicts in Model MergingTechnical
- GLoMOT: Efficient Online GNN-based Low-Frame-Rate Multi-Object TrackerTechnical
- GMAI-VL & GMAI-VL-5.5M: A Large Vision-Language Model and a Comprehensive Multimodal Dataset Towards General Medical AITechnical
- GOAL: Geometrically Optimal Alignment for Continual Generalized Category DiscoveryTechnical
- GOMPSNR: Reflourish the Signal-to-Noise Ratio Metric for Audio Generation TasksTechnical
- GP-MoLFormer-Sim: Test Time Molecular Optimization Through Contextual Similarity GuidanceTechnical
- GPGS: Consistent 3D Object Removal via Geometry-Aware 3D Inpainting and Projected Image Refinement in 3D Gaussian SplattingTechnical
- GPTKB v1.5: A Massive Knowledge Base for Exploring Factual LLM KnowledgeTechnical
- GRAM-R²: Self-Training Generative Foundation Reward Models for Reward ReasoningTechnical
- GRDC: A Unified Graph-Driven Framework for Role Discovery and Communication in Multi-Agent Reinforcement LearningTechnical
- GREAT: Generalizable Representation Enhancement via Auxiliary Transformations for Zero-Shot Environmental PredictionTechnical
- GRIM: Task-Oriented Grasping with Conditioning on Generative ExamplesTechnical
- GRIP: Latent Field-Guided Graph Policy for Budget-Constrained Multi-Agent RoutingTechnical
- GROVER: Graph-guided Representation of Omics and Vision with Expert Regulation for Adaptive Spatial Multi-omics FusionTechnical
- GS-Checker: Tampering Localization for 3D Gaussian SplattingTechnical
- GSAG-CDGAN: A Generalizable Small-Sample Attention-Guided GAN for Remote Sensing Change Detection (Student Abstract)Technical
- GSAP-ERE: Fine-Grained Scholarly Entity and Relation Extraction Focused on Machine LearningTechnical
- GT-SNT: A Linear-Time Transformer for Large-Scale Graphs via Spiking Node TokenizationTechnical
- GT2-GS: Geometry-aware Texture Transfer for Gaussian SplattingTechnical
- GUI-Eyes: Tool-Augmented Perception for Visual Grounding in GUI AgentsTechnical
- GUI-G²: Gaussian Reward Modeling for GUI GroundingTechnical
- GUIC: Certified Graph Unlearning with Individual Fairness GuaranteesTechnical
- GUIDE: Gaussian Unified Instance Detection for Enhanced Obstacle Perception in Autonomous DrivingTechnical
- GUIDER: Uncertainty Guided Dynamic Re-ranking for Large Language Models Based Recommender SystemsTechnical
- GUSLO: General and Unified Structured Light OptimizationTechnical
- Gait Recognition via Collaborating Discriminative and Generative Diffusion ModelsTechnical
- Gait Transformer: End-to-End Transformer Backbone for Gait RecognitionTechnical
- Game Ground Bench: Probing the Limits of LVLMs in Complex Semantic Grounding Across Game UniversesTechnical
- Game Theory Based Community-Aware Opinion DynamicsTechnical
- Game-Theoretic Simulations Meet AI: Fast Policy Recommendations Under Data Scarcity (Student Abstract)Technical
- Games of Representation: Developing Card-Based Activities to Teach About Representation and Bias in AI DatasetsTechnical
- GateRA: Token-aware Modulation for Parameter-Efficient Fine-tuningTechnical
- Gated Variational Graph Autoencoders as Experts with Competition and Consensus for Multi-view ClusteringTechnical
- Gaussian Approximation for Two-Timescale Linear Stochastic ApproximationTechnical
- Gaussian Blending: Rethinking Alpha Blending in 3D Gaussian SplattingTechnical
- Gaussian Uncertainty-Driven Multi-Model Fitting with Graph Neural NetworkTechnical
- GaussianImage++: Boosted Image Representation and Compression with 2D Gaussian SplattingTechnical
- GazeInterpreter: Parsing Eye Gaze to Generate Eye-Body-Coordinated NarrationsTechnical
- GeM-VG: Towards Generalized Multi-image Visual Grounding with Multimodal Large Language ModelsTechnical
- GeWu: A Culturally-Grounded Chinese Benchmark for Multi-Stage Social Bias Evaluation in Large Language ModelsTechnical
- GenMatLab: A Generative Platform for Inverse Materials DesignTechnical
- GenPRM: Scaling Test-Time Compute of Process Reward Models via Generative ReasoningTechnical
- GenPTW: Latent Image Watermarking for Provenance Tracing and Tamper LocalizationTechnical
- GenVidBench: A 6-Million Benchmark for AI-Generated Video DetectionTechnical
- Gene Incremental Learning for Single-Cell TranscriptomicsTechnical
- GenePheno: Interpretable Gene Knockout-Induced Phenotype Abnormality Prediction from Gene SequencesTechnical
- Generalising Traffic Forecasting to Regions Without Traffic ObservationsTechnical
- Generalizable Drug–Target Interaction Prediction via ESM-2 Representations and Progressive Contrastive Curriculum LearningTechnical
- Generalizable Heterogeneity-aware Federated Feature and Basic-matrix Consistency LearningTechnical
- Generalizable Slum Detection from Satellite Imagery with Mixture-of-ExpertsTechnical
- Generalizable and Efficient Automated Scoring with a Knowledge-Distilled Multi-Task Mixture-of-ExpertsTechnical
- Generalization Bounds for Semi-supervised Matrix Completion with Distributional Side InformationTechnical
- Generalized Geometry Encoding Volume for Real-time Stereo MatchingTechnical
- Generalized Threshold Optimization with Harmony Multi-Threshold Neurons for Accurate ANN-to-SNN ConversionTechnical
- Generalized-Scale Object Counting with Gradual Query AggregationTechnical
- Generalizing Analogical Inference from Boolean to Continuous DomainsTechnical
- Generalizing Fair Clustering to Multiple Groups: Algorithms and ApplicationsTechnical
- Generalizing Vision-Language Models with Dedicated Prompt GuidanceTechnical
- Generating Attribute-Aware Human Motions from Textual PromptTechnical
- Generating In-Distribution Counterfactual Explanation for Graph Neural NetworksTechnical
- Generating Risky Samples with Conformity Constraints via Diffusion ModelsTechnical
- Generating Sketches in a Hierarchical Auto-Regressive Process for Flexible Sketch Drawing Manipulation at Stroke-LevelTechnical
- Generating Streamlining Constraints with Large Language Models (Abstract Reprint)Technical
- Generating-Filtering-Ranking: A Three-Stage MultiModal Data Augmentation Framework Under Partial Modality MissingTechnical
- Generative AI Against Poaching: Latent Composite Flow Matching for Poaching PredictionTechnical
- Generative AI as a Cognitive Co-Participant: Disciplinary Modulation of EFL Academic Reading Load and MotivationTechnical
- Generative AI-Driven Data Transformation for Enhanced Machine Learning Performance (Student Abstract)Technical
- Generative Branching for Mixed-Integer Linear ProgrammingTechnical
- Generative Graphical Inverse Kinematics (Abstract Reprint)Technical
- Generic Adversarial Attack Framework Against Graph-based Vertical Federated LearningTechnical
- Gentle Manipulation Policy Learning via Demonstrations from VLM Planned Atomic SkillsTechnical
- Geo2Vec: Shape- and Distance-Aware Neural Representation of Geospatial EntitiesTechnical
- GeoBayes: Probabilistic Image Geo-Localization Inference via Sequential Bayesian UpdatingTechnical
- GeoCoBox: Box-supervised 3D Tumor Segmentation via Geometric Co-embeddingTechnical
- GeoGen: A Two-stage Coarse-to-Fine Framework for Fine-grained Synthetic Location-based Social Network Trajectory GenerationTechnical
- GeoMoE: Divide-and-Conquer Motion Field Modeling with Mixture-of-Experts for Two-View GeometryTechnical
- GeoNum: Bridging Numerical Continuity and Language Semantics via Geometric EmbeddingTechnical
- GeoPTH: A Lightweight Approach to Category-Based Trajectory Retrieval via Geometric Prototype Trajectory HashingTechnical
- GeoProblem Factory: A Visual Interaction System for Solvable and Controllable Geometric Problem Generation by Leveraging Symbolic Deduction EngineTechnical
- GeoShield: Safeguarding Geolocation Privacy from Vision-Language Models via Adversarial PerturbationsTechnical
- GeoX-Bench: Benchmarking Cross-View Geo-Localization and Pose Estimation Capabilities of Large Multimodal ModelsTechnical
- Geometric Correspondence Constrained Pseudo-Label Alignment for Source-Free Domain Adaptive Fundus Image SegmentationTechnical
- Geometrically Inspired Kernel Machines for Collaborative Learning Beyond Gradient Descent (Abstract Reprint)Technical
- Geometry Meets Light: Leveraging Geometric Priors for Universal Photometric Stereo Under Limited Multi-Illumination CuesTechnical
- Geometry-Aware Noisy Correspondence Mitigation for Cross-Modal Text-Based Person RetrievalTechnical
- Geometry-Aware Stereo Matching via Monocular Disparity Distribution Prior and Gradient EnhancementTechnical
- Geometry-Aware Variational Information Maximization for Deep Incomplete Multi-view ClusteringTechnical
- Ghost in the Transformer: Detecting Model Reuse with Invariant Spectral SignaturesTechnical
- GigaMoE: Sparsity-Guided Mixture of Experts for Efficient Gigapixel Object DetectionTechnical
- GitTaskBench: A Benchmark for Code Agents Solving Real-World Tasks Through Code Repository LeveragingTechnical
- GlitchCleaner: Lightweight Glitch Tokens Repairing by Lossless Gated LoRA in Large Language ModelsTechnical
- GlitchMiner: Mining Glitch Tokens in Large Language Models via Gradient-based Discrete OptimizationTechnical
- GloCTM: Cross-Lingual Topic Modeling via a Global Context SpaceTechnical
- GloTok: Global Perspective Tokenizer for Image Reconstruction and GenerationTechnical
- Global Compression Commander: Plug-and-Play Inference Acceleration for High-Resolution Large Vision-Language ModelsTechnical
- Global-Lens Transformers: Adaptive Token Mixing for Dynamic Link PredictionTechnical
- Global-Local Confidence Fusion for Hallucination Detection in Mathematical Reasoning TaskTechnical
- GlyphShield: Document Watermarking for the Physical World via Vector Typeface SynthesisTechnical
- Goal-Oriented Time-Series Forecasting: Foundation Framework DesignTechnical
- Good Gradients Poison Your Model: Evading Defenses in Federated Learning via Boundary-adaptive PerturbationTechnical
- Good-for-MDP State Reduction for Stochastic LTL PlanningTechnical
- Gotta Hear Them All: Towards Sound Source Aware Audio GenerationTechnical
- GraFT: Infusing Pre-trained Transformers with Relational Structure for Time Series ForecastingTechnical
- Gracefully Air-Written: Enhancing the Legibility and Style Consistency of In-Air HandwritingTechnical
- Gradient as Conditions: Rethinking HOG for All-in-one Image RestorationTechnical
- Gradient-Protected Value Decomposition for Cooperative Multi-Agent Reinforcement LearningTechnical
- GranAlign: Granularity-Aware Alignment Framework for Zero-shot Video Moment RetrievalTechnical
- Graph Attention-Guided Search for Dense Multi-Agent PathfindingTechnical
- Graph Choosability via SAT: Beyond the NullstellensatzTechnical
- Graph Contrastive Learning with Balanced Hard Negatives and Fine-grained Semantic-aware PositivesTechnical
- Graph Domain Adaptation via Homophily-Agnostic Reconstructing StructureTechnical
- Graph Flow Matching: Enhancing Image Generation with Neighbor-Aware Flow FieldsTechnical
- Graph Masked Autoencoder for Multi-view Remote Sensing Data ClusteringTechnical
- Graph Meets Deep Unfolding: An Interpretable Mutual-benefit Multi-view Learning NetworkTechnical
- Graph Neural Field with Spatial-Correlation Augmentation for HRTF PersonalizationTechnical
- Graph Neural ODEs with Stability and Conservation Guarantees for Tumor Microenvironment Dynamics (Student Abstract)Technical
- Graph Out-of-Distribution Detection via Test-Time Calibration with Dual Dynamic DictionariesTechnical
- Graph RAG for Automated Short Answer Grading with Feedback: Bridging Pedagogical Needs and Technical CapabilitiesTechnical
- Graph Smoothing for Enhanced Local Geometry Learning in Point Cloud AnalysisTechnical
- Graph VQ-Transformer (GVT): Fast and Accurate Molecular Generation via High-Fidelity Discrete LatentsTechnical
- Graph of Verification: Structured Verification of LLM Reasoning with Directed Acyclic GraphsTechnical
- Graph-Conditional Flow Matching for Relational Data GenerationTechnical
- Graph-Driven Domain Co-Adaptation for Cross-Domain Image Quality AssessmentTechnical
- Graph-Semantic Guided Learning for Virtual Immunohistochemistry Staining on Consecutive Histology SectionsTechnical
- Graph-Theoretic Consistency for Robust and Topology-Aware Semi-Supervised Histopathology Segmentation (Student Abstract)Technical
- Graph-augmented and Over-smoothing-resistant Contrastive Clustering for Short TextTechnical
- Graph-based Label-Efficient Learning: When Graph-Structured Data Meets Limited LabelsTechnical
- Graph-of-Mark: Promote Spatial Reasoning in Multimodal Language Models with Graph-Based Visual PromptingTechnical
- Graph2Video: Leveraging Video Models to Model Dynamic Graph EvolutionTechnical
- GraphCoT-VLA: A 3D Spatial-Aware Reasoning Vision-Language-Action Model for Robotic Manipulation with Ambiguous InstructionsTechnical
- GraphGrasp: Lightweight and Efficient Graph-Guided 6-DoF Robotic Grasp Pose Estimation NetworkTechnical
- GraphIC: A Graph-Based In-Context Example Retrieval Model for Multi-Step ReasoningTechnical
- GraphIF: Enhancing Multi-Turn Instruction Following for Large Language Models with Relation Graph PromptTechnical
- GraphOracle: Efficient Fully-Inductive Knowledge Graph Reasoning via Relation-Dependency GraphsTechnical
- GraphRAG-Induced Dual Knowledge Structure Graphs for Personalized Learning Path RecommendationTechnical
- GraphTextack: A Realistic Black-Box Node Injection Attack on LLM-Enhanced GNNsTechnical
- GraphVSSM: Graph Variational State-Space Model for Probabilistic Spatiotemporal Inference of Dynamic Exposure and Vulnerability for Regional Disaster Resilience AssessmentTechnical
- GrayKD: Distilling Better Knowledge from Black-box LLM via Multi-rationale InjectionTechnical
- Greedily Maximizing Ex-Ante FairnessTechnical
- Griffin: Aerial-Ground Cooperative Detection and Tracking Dataset and BenchmarkTechnical
- Ground What You See: Hallucination-Resistant MLLMs via Caption Feedback, Diversity-Aware Sampling, and Conflict RegularizationTechnical
- Grounding Actions in Camera Space: Observation-Centric Vision-Language-Action PolicyTechnical
- Group Causal Policy Optimization for Post-Training Large Language ModelsTechnical
- Group Fair Matchings Using Convex Cost FunctionsTechnical
- Group Orthogonal Low-Rank Adaptation for RGB-T TrackingTechnical
- Group-aware Multiscale Ensemble Learning for Test-Time Multimodal Sentiment AnalysisTechnical
- Grow-on-Demand: Sparse and Adaptive Expert Expansion for Continual Instruction TuningTechnical
- Guarding Digital Identity: Attention-Guided Fusion for Detecting Forged ID Documents (Student Abstract)Technical
- Guess or Recall? Training CNNs to Classify and Localize Memorization in LLMsTechnical
- GuidNoise: Single-Pair Guided Diffusion for Generalized Noise SynthesisTechnical
- GuideGen: A Text-Guided Framework for Paired Full-torso Anatomy and CT Volume GenerationTechnical
- Guided Distillation and Risk Adaptive Evolution for Multi-Robot NavigationTechnical
- Guided Latent Spaces for Controllable Multi-Scenario Generation in Autonomous Driving (Student Abstract)Technical
- Guided Perturbation Sensitivity (GPS): Detecting Adversarial Text via Embedding Stability and Word ImportanceTechnical
- Guideline-Consistent Segmentation via Multi-Agent RefinementTechnical
AAAI accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.