AAAI 2026 Accepted Papers
The full list of 4,902 papers accepted at AAAI 2026 (Association for the Advancement of Artificial Intelligence Annual Conference on Artificial Intelligence). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Technical: 4,902
- Guiding Point Cloud Denoising with Learned Structural PriorsTechnical
- H-GAR: A Hierarchical Interaction Framework via Goal-Driven Observation-Action Refinement for Robotic ManipulationTechnical
- H-RDT: Human Manipulation Enhanced Bimanual Robotic ManipulationTechnical
- HABIT: Chrono-Synergia Robust Progressive Learning Framework for Composed Image RetrievalTechnical
- HALO: Hardware-Aware Quantization with Low Critical-Path-Delay Weights for LLM AccelerationTechnical
- HALoRA: Low-Rank Adaptation with Hierarchical Budget Allocation for Efficient Vision-Language AlignmentTechnical
- HAMLET4Fairness: Enhancing Fairness in AI Pipelines Through Human-Centered AutoML and ArgumentationTechnical
- HAP: Harmonized Amplitude Perturbation for Cross-Domain Few-Shot LearningTechnical
- HAPO: Training Language Models to Reason Concisely via History-Aware Policy OptimizationTechnical
- HARK: Hierarchical Agentic Retrieval with Keyframing for Video Understanding (Student Abstract)Technical
- HATIR: Heat-Aware Diffusion for Turbulent Infrared Video Super-ResolutionTechnical
- HC2-GNN: Hierarchical Graph Representation Learning for Efficient Text ClassificationTechnical
- HCC-3D: Hierarchical Compensatory Compression for 98% 3D Token Reduction in Vision-Language ModelsTechnical
- HCF: Hierarchical Cascade Framework for Distributed Multi-Stage Image CompressionTechnical
- HCPO: Hierarchical Conductor-Based Policy Optimization in Multi-Agent Reinforcement LearningTechnical
- HDGS: Hierarchical Dynamic Gaussian Splatting for Urban Driving ScenesTechnical
- HDRMovieformer: A Transformer Framework and Benchmark for Cinematic SDR-to-HDR ConversionTechnical
- HD²-SSC: High-Dimension High-Density Semantic Scene Completion for Autonomous DrivingTechnical
- HEV Generative Sandbox: A Framework for Assessing Domain-Specific Social Risks Through Human-LLM SimulationTechnical
- HFR-MKGC: Hierarchical Fusion Reasoning with MLLMs for Multi-modal Knowledge Graph CompletionTechnical
- HGATSolver: A Heterogeneous Graph Attention Solver for Fluid–Structure InteractionTechnical
- HGLTR: Hierarchical Knowledge Injection for Calibrating Pre-trained Models in Long-Tail RecognitionTechnical
- HI-SLAM2: Geometry-Aware Gaussian SLAM for Fast Monocular Scene Reconstruction (Abstract Reprint)Technical
- HINPool: A Unified Heterogeneous Graph Pooling Framework for Accurate Molecular and Protein Property PredictionTechnical
- HISE-KT: Synergizing Heterogeneous Information Networks and LLMs for Explainable Knowledge Tracing with Meta-Path OptimizationTechnical
- HKAFER: Achieve Visual Parameter-Efficient Fine-Tuning via Heterogeneous Kronecker Adaptation for Facial Expression RecognitionTechnical
- HLML-SNN:Fast Continual Learning in Spiking Neural Networks Achieved via Hebbian Learning-Driven Meta-LearningTechnical
- HLPD: Aligning LLMs to Human Language Preference for Machine-Revised Text DetectionTechnical
- HMformer: Unleashing Transformer’s Potential for Time Series Forecasting via Hierarchical Multi-Scale ModelingTechnical
- HN-MVTS: HyperNetwork-based Multivariate Time Series ForecastingTechnical
- HOSIG: Full-Body Human-Object-Scene Interaction Generation with Hierarchical Scene PerceptionTechnical
- HPSU: A Benchmark for Human-Level Perception in Real-World Spoken Speech UnderstandingTechnical
- HQ-SVC: Towards High-Quality Zero-Shot Singing Voice Conversion in Low-Resource ScenariosTechnical
- HSA-Net: Hierarchical and Structure-Aware Framework for Efficient and Scalable Molecular Language ModelingTechnical
- HSKBenchmark: Modeling and Benchmarking Chinese Second Language Acquisition in Large Language Models Through Curriculum TuningTechnical
- HTG-GCL: Leveraging Hierarchical Topological Granularity from Cellular Complexes for Graph Contrastive LearningTechnical
- HTN Plan Verification by Qualitative Temporal ReasoningTechnical
- HTTrack: Learning to Perceive Targets via Historical Trajectories in Satellite Video TrackingTechnical
- HaNa: Hardness and Noise-Aware Robust Cross-modal RetrievalTechnical
- HalluClean: A Unified Framework to Combat Hallucinations in LLMsTechnical
- Hallucinate Less by Thinking More: Aspect-Based Causal Abstention for Large Language ModelsTechnical
- Hallucination as a Computational Boundary: A Hierarchy of Inevitability and the Oracle EscapeTechnical
- Hallucinations at the FirewallTechnical
- HandMCM: Multi-modal Point Cloud-based Correspondence State Space Model for 3D Hand Pose EstimationTechnical
- HanjaBridge: Resolving Semantic Ambiguity in Korean LLMs via Hanja-Augmented Pre-TrainingTechnical
- Hard vs. Noise: Resolving Hard-Noisy Sample Confusion in Recommender Systems via Large Language ModelsTechnical
- HardF-SNN: Hardware-Friendly Quantization for Spiking Neural Networks with Efficient Integer-Arithmetic-Only InferenceTechnical
- HarmoQ: Harmonized Post-Training Quantization for High-Fidelity Image Super-ResolutionTechnical
- Harmonic Dataset Distillation for Time Series ForecastingTechnical
- Harnessing Diffusion-Generated Synthetic Images for Fair Image ClassificationTechnical
- Harnessing Textual Semantic Priors for Knowledge Transfer and Refinement in CLIP-Driven Continual LearningTechnical
- Harnessing Vision-Language Models for Time Series Anomaly DetectionTechnical
- Harnessing the Unseen: The Hidden Influence of Intrinsic Knowledge in Long-Context Language ModelsTechnical
- Hashed Watermark as a Filter: A Unified Defense Against Forging and Overwriting Attacks in Neural Network WatermarkingTechnical
- Head-Aware KV Cache Compression for Efficient Visual Autoregressive ModelingTechnical
- HeadHunt-VAD: Hunting Robust Anomaly-Sensitive Heads in MLLM for Tuning-Free Video Anomaly DetectionTechnical
- HealSplit: Towards Self-Healing Through Adversarial Distillation in Split Federated LearningTechnical
- Hearing More with Less: Multi-Modal Retrieval-and-Selection Augmented Conversational LLM-Based ASRTechnical
- HeartLLM: Discretized ECG Tokenization for LLM-Based Diagnostic ReasoningTechnical
- Heterogeneous Complementary DistillationTechnical
- Heterogeneous Graph Neural Networks for Assumption-Based ArgumentationTechnical
- Heterogeneous Uncertainty-Guided Composed Image Retrieval with Fine-Grained Probabilistic LearningTechnical
- Heterophily-aware Contrastive Learning for Heterophilic HypergraphsTechnical
- Hexaïssa: Standing on Giants’ Shoulders—Routing the Best Chess Engines with Mixture-of-Experts and Latent Reward LearningTechnical
- Hi-EF: Benchmarking Emotion Forecasting in Human-interactionTechnical
- HiCL: Hippocampal-Inspired Continual LearningTechnical
- HiFC-GAN: Hierarchical Feature-Constrained GAN for Optical-to-SAR Transfer in SAR Target ClassificationTechnical
- HiFi-Mamba: Dual-Stream ?-Laplacian Enhanced Mamba for High-Fidelity MRI ReconstructionTechnical
- HiFi-Mesh: High-Fidelity Efficient 3D Mesh Generation via Compact Autoregressive DependenceTechnical
- HiFusion: Hierarchical Intra-Spot Alignment and Regional Context Fusion for Spatial Gene Expression Prediction from HistopathologyTechnical
- HiGFA: Hierarchical Guidance for Fine-grained Data Augmentation with Diffusion ModelsTechnical
- HiLoMix: Robust High- and Low-Frequency Graph Learning Framework for Mixing Address AssociationTechnical
- HiMo-CLIP: Modeling Semantic Hierarchy and Monotonicity in Vision-Language AlignmentTechnical
- HiMo: High-Speed Objects Motion Compensation in Point Clouds (Abstract Reprint)Technical
- HiNCoT: Hierarchical Nonlinear Continuous Transform-based Tensor Representation for Multi-Dimensional Data RecoveryTechnical
- HiPrune: Training-Free Visual Token Pruning via Hierarchical Attention in Vision-Language Models (Student Abstract)Technical
- HiQ-Lip: A Hierarchical Quantum-Classical Method for Global Lipschitz Constant Estimation of ReLU NetworksTechnical
- HiTVideo: Hierarchical Tokenizers for Enhancing Text-to-Video Generation with Autoregressive Large Language ModelsTechnical
- HiVA: Self-organized Hierarchical Variable Agent via Goal-driven Semantic-Topological EvolutionTechnical
- Hidden in the Noise: Unveiling Backdoors in Audio LLMs Alignment Through Latent Acoustic Pattern TriggersTechnical
- Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving DiagnosisTechnical
- HierSearch: A Hierarchical Enterprise Deep Search Framework Integrating Local and Web SearchesTechnical
- HierarNet: Independent Interactive Hierarchical Disease Outbreak ForecastingTechnical
- Hierarchical Attention Network with Correction for Cross-Domain User AssociationTechnical
- Hierarchical Cross-View Alignment for Multi-View Clustering via Decoupled Information DistillationTechnical
- Hierarchical Dataset Selection for High-Quality Data SharingTechnical
- Hierarchical Direction Perception via Atomic Dot-Product Operators for Rotation-Invariant Point Clouds LearningTechnical
- Hierarchical Dual-Domain Fusion with Frequency-Guided Spatial Modeling for Pan-SharpeningTechnical
- Hierarchical Frequency-Decomposition Graph Neural Networks for Road Network Representation LearningTechnical
- Hierarchical Frequency-Guided Alignment Transformer for Compressed Video Quality EnhancementTechnical
- Hierarchical Prompt Learning for Image- and Text-Based Person Re-IdentificationTechnical
- Hierarchical Reinforcement Learning with Topology-Aware Exploration Framework for Multi-path Commodity Flow ProblemTechnical
- Hierarchical Schedule Optimization for Fast and Robust Diffusion Model SamplingTechnical
- Hierarchical Semantic Alignment for Image ClusteringTechnical
- Hierarchical Structure-Property Alignment for Data-Efficient Molecular Generation and EditingTechnical
- HierarchicalPrune: Position-Aware Compression for Large-Scale Diffusion ModelsTechnical
- High Dimensional Distributed Gradient Descent with Arbitrary Number of Byzantine AttackersTechnical
- High-Order Error Bounds for Markovian LSA with Richardson–Romberg ExtrapolationTechnical
- High-Pass Matters: Theoretical Insights and Sheaflet-Based Design for Hypergraph Neural NetworksTechnical
- High-Quality Full-Head 3D Avatar Generation from Any Single Portrait ImageTechnical
- High-Speed FHD Full-Color Video Computer-Generated HolographyTechnical
- Higher-Order ResponsibilityTechnical
- Hilbert Curve-Encoded Rotation-Equivariant Oriented Object Detector with Locality-Preserving Spatial MappingTechnical
- History-Aware Reasoning for GUI AgentsTechnical
- History-Enhanced Two-Stage Transformer for Aerial Vision-and-Language NavigationTechnical
- HitKV: Activation Frequency Knows Which Tokens Are ImportantTechnical
- HiveMind: Contribution-Guided Online Prompt Optimization of LLM Multi-Agent SystemsTechnical
- HogVul: Black-box Adversarial Code Generation Framework Against LM-based Vulnerability DetectorsTechnical
- Horizontal and Vertical Federated Causal Structure Learning via Higher-order CumulantsTechnical
- HouseTune: Two-Stage Floorplan Generation with LLM AssistanceTechnical
- How Bias Binds: Measuring Hidden Associations for Bias Control in Text-to-Image CompositionsTechnical
- How Can You Tell if Your Large Language Model Could Be a Closet Antisemite? An Explainability-Based Audit Framework for Implicit BiasTechnical
- How Do Data Owners Say No? A Case Study of Data Consent Mechanisms in Web-Scraped Vision-Language AI Training DatasetsTechnical
- How Does Alignment Enhance LLMs’ Multilingual Capabilities? A Language Neurons PerspectiveTechnical
- How Does Chain of Thought Think? Mechanistic Interpretability of Chain-of-Thought Reasoning with Sparse AutoencodingTechnical
- How Does LLM-powered Coding Assistance Shape Incidental Learning? Exploring Cognitive Forcing Strategies in Programming EducationTechnical
- How Foundational Skills Influence VLM-based Embodied Agents: A Native PerspectiveTechnical
- How Good Are Inducing Points for Dataset Distillation? (Student Abstract)Technical
- How Hard Is It to Explain Preferences Using Few Boolean Attributes?Technical
- How Hard Is It to Rig a Tournament When Few Players Can Beat or Be Beaten by the Favorite?Technical
- How Many Experts Are Enough? Towards Optimal Semantic Specialization for Mixture-of-ExpertsTechnical
- How Much Do Large Language Model Cheat on Evaluation? Benchmarking Overestimation Under the One-Time-Pad-Based FrameworkTechnical
- How Reasoning Influences Intersectional Biases in Vision–Language Models (Student Abstract)Technical
- How Wide and How Deep? Mitigating Over-squashing of GNNs via Channel Capacity Constrained EstimationTechnical
- HuiduRep: A Robust Self-Supervised Framework for Learning Neural Representations from Extracellular RecordingsTechnical
- Human Cognition Inspired RAG with Knowledge Graph for Complex Problem SolvingTechnical
- Human Cognitive Biases in Explanation-based Interaction: The Case of Within and Between Session Order EffectTechnical
- Human Motion Synthesis in 3D Scenes via Unified Scene Semantic OccupancyTechnical
- Human Motion UnlearningTechnical
- Human-Centric Open-Future Task Discovery: Formulation, Benchmark, and Scalable Tree-Based SearchTechnical
- Human-Centric Video Generation via Collaborative Multi-Modal ConditioningTechnical
- Human-Corrected Labels Learning: Enhancing Labels Quality via Human Correction of VLMs DiscrepanciesTechnical
- Human-in-the-Loop Bandwidth Estimation for Quality of Experience Optimization in Real-Time Video CommunicationTechnical
- Human-in-the-Loop Eider Duck Counting in Arctic Canada with an Open-Vocabulary Multi-Species Wildlife DetectorTechnical
- Human2Robot: Learning Robot Actions from Paired Human-Robot VideosTechnical
- HumanPro: Single-view 3D Clothed Human Reconstruction with Progressive Normal GuidanceTechnical
- HumanSense: From Multimodal Perception to Empathetic Context-Aware Responses Through Reasoning MLLMsTechnical
- HumorReject: Decoupling LLM Safety from Refusal Prefix via a Little HumorTechnical
- HyCoRA: Hyper-Contrastive Role-Adaptive Learning for Role-PlayingTechnical
- HyFI: Hyperbolic Feature Interpolation for Brain-Vision AlignmentTechnical
- HyMoERec: Hybrid Mixture-of-Experts for Sequential Recommendation (Student Abstract)Technical
- HyRNN: Hybrid Recurrent Neural Networks for Approximating Hybrid Dynamical SystemsTechnical
- HybriDLA: Hybrid Generation for Document Layout AnalysisTechnical
- Hybrid PPO–DQN for Multi-Objective Adaptive Cruise Control in Eco-Driving: Reward Shaping Toward Safety and Sustainability (Student Abstract)Technical
- Hybrid Restricted Master Problem for Boolean Matrix FactorisationTechnical
- Hybrid Routing for a Mixture of LoRA ExpertsTechnical
- Hybrid Semantics Accounting for Argument TypesTechnical
- Hybrid Vector-Occupancy Field for Robust Implicit 3D Surface ReconstructionTechnical
- Hybrid-DMKG: A Hybrid Reasoning Framework over Dynamic Multimodal Knowledge Graphs for Multimodal Multihop QA with Knowledge EditingTechnical
- Hybrid-Domain Adaptative Representation Learning for Gaze EstimationTechnical
- Hyper-Opinion Vagueness Quantification for Robust Multimodal LearningTechnical
- HyperAim: Hypergraph Contrastive Learning with Adaptive Multi-frequency FiltersTechnical
- HyperCOD: The First Challenging Benchmark and Baseline for Hyperspectral Camouflaged Object DetectionTechnical
- HyperD: Hybrid Periodicity Decoupling Framework for Traffic ForecastingTechnical
- HyperDiag: Temporal–Regional Hypergraph Learning via Topology-Enhanced State Propagation for Brain Disease DiagnosisTechnical
- HyperGLLM: An Efficient Framework for Endpoint Threat Detection via Hypergraph-Enhanced Large Language ModelsTechnical
- HyperGOOD: Towards Out-of-Distribution Detection in HypergraphsTechnical
- HyperLoad: A Cross-Modality Enhanced Large Language Model-Based Framework for Green Data Center Cooling Load PredictionTechnical
- HyperNoRA: Hyperedge Prediction via Node-Level Relation-Aware Self-Supervised Hypergraph LearningTechnical
- HyperSHAP: Shapley Values and Interactions for Explaining Hyperparameter OptimizationTechnical
- HyperSign: Hierarchical Hypergraph-based Co-occurrence Modeling for Sign Language Recognition and TranslationTechnical
- HyperSign: Saliency-Aware Spatial Graphs and Temporal Hypergraphs for Continuous Sign Language RecognitionTechnical
- Hyperbolic Continuous Structural Entropy for Hierarchical ClusteringTechnical
- Hyperbolic Hierarchical Alignment Reasoning Network for Text-3D RetrievalTechnical
- Hyperbolic-Enhanced Mixture-of-Experts Mamba for Sequential RecommendationTechnical
- Hypergraph-Based Multi-View Multi-Label Classification via Adaptive High-Order Semantic FusionTechnical
- Hypertension and Total-Order Forward Decomposition Optimizations (Abstract Reprint)Technical
- Hypothesis-Driven Reasoning for Large Language ModelsTechnical
- HypoxSpike: Ternary Spiking Neural Network for Opioid Overdose DetectionTechnical
- I Have Covered All the Bases Here: Interpreting Reasoning Features in Large Language Models via Sparse AutoencodersTechnical
- I-CAM-UV: Integrating Causal Graphs over Non-Identical Variable Sets Using Causal Additive Models with Unobserved VariablesTechnical
- I-INR: Iterative Implicit Neural RepresentationsTechnical
- I2CD: An Invertible Causal Framework for Compositional Zero-Shot Learning via Disentangle-Compose-DisentangleTechnical
- I2E: Real-Time Image-to-Event Conversion for High-Performance Spiking Neural NetworksTechnical
- IAD-R1: Reinforcing Consistent Reasoning in Industrial Anomaly DetectionTechnical
- ICAD-LLM: One-for-All Anomaly Detection via In-Context Learning with Large Language ModelsTechnical
- ICL-Router: In-Context Learned Model Representations for LLM RoutingTechnical
- ICLR: Inter-Chrominance and Luminance Interaction for Natural Color Restoration in Low-Light Image EnhancementTechnical
- ICM-Fusion: In-Context Meta-Optimized LoRA Fusion for Multi-Task AdaptationTechnical
- ID-Splat: Propagating Object Identities for Segmenting 3D Aerial-view ScenesTechnical
- IDK-S: Incremental Distributional Kernel for Streaming Anomaly DetectionTechnical
- IE-SRGS: An Internal-External Knowledge Fusion Framework for High-Fidelity 3D Gaussian Splatting Super-ResolutionTechnical
- IGFuse: Interactive 3D Gaussian Scene Reconstruction via Multi-Scans FusionTechnical
- IGIANet: Illumination Guided Implicit Alignment Network for Infrared–Visible UAV DetectionTechnical
- IGT4ETH: An Isotropic Pre-trained Graph Transformer for Ethereum Account ClassificationTechnical
- IMAGGarment+: Efficient Attribute-Wise Diffusion for Garment GenerationTechnical
- IMPACT: Integrated Multimodal Pipeline for Rapid Accident Causality Tracking (Student Abstract)Technical
- INTENT: Invariance and Discrimination-aware Noise Mitigation for Robust Composed Image RetrievalTechnical
- IO-RAE: Information-Obfuscation Reversible Adversarial Example for Audio Privacy ProtectionTechnical
- IPDA:Intelligent Perception Delay Alignment Method Based on Spatio-Temporal Co-Sensing CalibrationTechnical
- IPFormer: Instance Prompt-guided Transformer for Multi-modal Multi-shot Video UnderstandingTechnical
- IQGS: Instance Query-based Gaussian SegmentationTechnical
- IROTE: Human-like Traits Elicitation of Large Language Model via In-Context Self-Reflective OptimizationTechnical
- IS-Bench: Evaluating Interactive Safety of VLM-Driven Embodied Agents in Daily Household TasksTechnical
- ITPP: Learning Disentangled Event Dynamics in Marked Temporal Point ProcessesTechnical
- IdeFN: Identifying Unclicked Space False Negatives via Relaxed Partial Optimal Transport for Conversion Rate PredictionTechnical
- IdealTSF: Can Non-Ideal Data Contribute to Enhancing the Performance of Time Series Forecasting Models?Technical
- Identifying Features Associated with Bias Against 93 Stigmatized Groups in Language Models and Guardrail Model Safety MitigationTechnical
- Identifying Imperfect Clones in ElectionsTechnical
- Identifying and Analyzing Performance-Critical Tokens in Large Language ModelsTechnical
- Identity-Aware Vision-Language Model for Explainable Face Forgery DetectionTechnical
- IdentityStory: Taming Your Identity-Preserving Generator for Human-Centric Story GenerationTechnical
- Image Content Matters: An Image Content Aware State Space Model for Accelerated MRI ReconstructionTechnical
- Image Restoration via Primal Dual Hybrid Gradient and Flow Generative ModelTechnical
- Image-Text Knowledge Modeling for Unsupervised Multi-Scenario Person Re-IdentificationTechnical
- ImageBindDC: Compressing Multi-modal Data with ImageBind-based CondensationTechnical
- ImageSet2Text: Describing Sets of Images Through TextTechnical
- ImagerySearch: Adaptive Test-Time Search for Video Generation Beyond Semantic Dependency ConstraintsTechnical
- Imagine with Layout and Sketch: Enhancing Vision-Language Retrieval with Dual-Stream Multi-Modal Query RefinementTechnical
- Impact of a Data-driven Teaching Approach on 9th Graders Conceptual Understanding of Machine LearningTechnical
- Implications for AI Research: Applying Lessons from the Expert Systems Boom and Bust to the Current Large-Language Model BoomTechnical
- Implicit Neural Representation with Multi-Scale Sine ActivationTechnical
- Importance-Aware Data Selection for Efficient LLM Instruction TuningTechnical
- Imprint of the Forgotten: Stealthy Membership Inference in Unlearned Graph Neural NetworksTechnical
- Improve Molecular Conformation Modeling with Geometric Deep LearningTechnical
- Improved Algorithms for Trip-Vehicle Assignment in Ride-SharingTechnical
- Improved Differentially Private Algorithms for Rank AggregationTechnical
- Improved Fully Dynamic Submodular Maximization Under Matroid ConstraintsTechnical
- Improved Masked Image Generation with Knowledge-Augmented Token RepresentationsTechnical
- Improved Runtime Guarantees for the SPEA2 Multi-Objective OptimizerTechnical
- Improved Streaming Algorithm for Fair k-Center ClusteringTechnical
- Improving Batch Normalization with Test-Time Adaptation for Robust Object Detection in Self-DrivingTechnical
- Improving CAPTCHA Robustness via Controlled Image Corruptions (Student Abstract)Technical
- Improving Day-Ahead Grid Carbon Intensity Forecasting by Joint Modeling of Local-Temporal and Cross-Variable Dependencies Across Different FrequenciesTechnical
- Improving Deepfake Detection with Reinforcement Learning-Based Adaptive Data AugmentationTechnical
- Improving Exact Algorithm for Pseudo Boolean Optimization with Two New Phase Selection HeuristicsTechnical
- Improving Generalization in LLM Structured Pruning via Function-Aware Neuron GroupingTechnical
- Improving Generalization in Offline Meta-Reinforcement Learning via Cross-task ContextsTechnical
- Improving Implicit Discourse Relation Recognition with Natural Language Explanations from LLMsTechnical
- Improving Large Molecular Language Model via Relation-aware Multimodal CollaborationTechnical
- Improving Long-Context Summarization with Multi-Granularity Retrieval OptimizationTechnical
- Improving Low-Resource Translation with Dictionary-Guided Fine-Tuning and RL: A Spanish-to-Wayuunaiki StudyTechnical
- Improving Region Representation Learning from Urban Imagery with Noisy Long-Caption SupervisionTechnical
- Improving Sparse IMU-based Motion Capture with Motion Label SmoothingTechnical
- Improving Stochastic Action-Constrained Reinforcement Learning via Truncated DistributionsTechnical
- Improving Sustainability of Adversarial Examples in Class-Incremental LearningTechnical
- Improving Target Presence and Plurality Recognition for Generalized Referring Image SegmentationTechnical
- Improving Value-based Process Verifier via Low-Cost Variance ReductionTechnical
- Improving the Accuracy of Dense Retrieval on the Quantized Indexes via Gradient Optimization of the Target EmbeddingsTechnical
- Improving the Convergence Rate of Ray Search Optimization for Query-Efficient Hard-Label AttacksTechnical
- Impute Missing Entries with UncertaintyTechnical
- In-Situ Eval: A Modular Framework for Custom and Real-Time RAG BenchmarkingTechnical
- In-Token Rationality Optimization: Towards Accurate and Concise LLM Reasoning via Self-FeedbackTechnical
- InEx: Hallucination Mitigation via Introspection and Cross-Modal Multi-Agent CollaborationTechnical
- InTimeAD: Interactive Time Series Anomaly DetectionTechnical
- Inapproximability of STRIPS PlanningTechnical
- Incoherence as Oracle-less Measure of Error in LLM-Based Code GenerationTechnical
- Incomplete Multi-View Unsupervised Federated Feature Selection via Cooperative Particle Swarm Optimization and Tensor-Aligned LearningTechnical
- Incomplete Multi-view Diabetic Retinopathy Grading via Self-Supervised Inter- and Intra-View RestorationTechnical
- Incorporating Self-Rewriting into Large Language Model Reasoning ReinforcementTechnical
- Incorporating Token Importance in Multi-Vector RetrievalTechnical
- Incremental Data-Driven Policy Synthesis via Game AbstractionsTechnical
- Incremental Maintenance of DatalogMTL MaterialisationsTechnical
- IndexTTS2: A Breakthrough in Emotionally Expressive and Duration-Controlled Auto-Regressive Zero-Shot Text-to-SpeechTechnical
- Indoor Multi-View Radar Object Detection via 3D Bounding Box DiffusionTechnical
- IndoorUAV: Benchmarking Vision-Language UAV Navigation in Continuous Indoor EnvironmentsTechnical
- Induce, Align, Predict: Zero-Shot Stance Detection via Cognitive Inductive ReasoningTechnical
- Inductive Generative Recommendation via Retrieval-based SpeculationTechnical
- Inequality in the Age of PseudonymityTechnical
- Inference Offloading for Cost-Sensitive Binary Classification at the EdgeTechnical
- Inference Scaling Law for Retrieval Augmented GenerationTechnical
- Inference-Aware Prompt Optimization for Aligning Black-Box Large Language ModelsTechnical
- Inference-time Scaling for Diffusion-based Audio Super-resolutionTechnical
- Inferring Implicit Goals Across Differing Task ModelsTechnical
- InfiGUI-G1: Advancing GUI Grounding with Adaptive Exploration Policy OptimizationTechnical
- Infinite-Story: A Training-Free Consistent Text-to-Image GenerationTechnical
- InfoCLIP: Bridging Vision-Language Pretraining and Open-Vocabulary Semantic Segmentation via Information-Theoretic Alignment TransferTechnical
- InfoCom: Kilobyte-Scale Communication-Efficient Collaborative Perception with Information BottleneckTechnical
- InfoDecom: Decomposing Information for Defending Against Privacy Leakage in Split InferenceTechnical
- InfoQ: Mixed-Precision Quantization via Global Information FlowTechnical
- Information Elicitation Mechanisms for Bayesian Auctions (Abstract Reprint)Technical
- Information Theoretic Optimal Surveillance for Epidemic Prevalence in NetworksTechnical
- Information-Theoretic Minimal Sufficient Representation for Multi-Domain Knowledge Graph CompletionTechnical
- Informative Subgraph Extraction with Deep Reinforcement Learning for Drug-Drug Interaction PredictionTechnical
- Infrared-Privileged UAV Detection via Cross-Modal Vector-QuantizationTechnical
- InfrastructureSentinel: Policy Enforced Guardrails for Secure MCP-driven Infrastructure AgentsTechnical
- Injection Without Distortion: Geometrically Constrained Knowledge Enhancement for Vision-Language ModelsTechnical
- Injection, Attack and Erasure: Revocable Backdoor Attacks via Machine UnlearningTechnical
- Inpaint-Anywhere: Zero-Shot Multi-Identity Inpainting with Efficient Diffusion TransformerTechnical
- Insert Anything: Image Insertion via In-Context Editing in DiTTechnical
- Instance Dependent Testing of Samplers Using Interval ConditioningTechnical
- Instance Generation for Meta-Black-Box Optimization Through Latent Space Reverse EngineeringTechnical
- Instance-Guided Scene Adaptation for Unsupervised Person SearchTechnical
- InstructDubber: Instruction-based Alignment for Zero-shot Movie DubbingTechnical
- Instruction-Guided Cross-Modal Clustering for Training-Free Visual Token Pruning in Vision-Language ModelsTechnical
- InteChar: A Unified Oracle Bone Character List for Ancient Chinese Language ModelingTechnical
- Integral-based Knockoffs Inference for Partially Linear ModelsTechnical
- Integrating AI Competencies into Teacher Education ProgramsTechnical
- Integrating Diverse Assignment Strategies into DETRsTechnical
- Integrating Fourier Neural Operators into High-Fidelity Helicopter Flight Simulation for Real-Time Urban Wind PredictionTechnical
- Integrating Reweighted Least Squares with Plug-and-Play Diffusion Priors for Noisy Image RestorationTechnical
- IntelliProof: An Argumentation Network-based Conversational Helper for Organized ReflectionTechnical
- IntentMotion: Learning Intent-Aware Human Motion from Language in 3D ScenesTechnical
- Intention Chain-of-Thought Prompting with Dynamic Routing for Code GenerationTechnical
- Intention-Aware Diffusion Model for Pedestrian Trajectory PredictionTechnical
- Intention-Guided Cognitive Reasoning for Egocentric Long-Term Action AnticipationTechnical
- Inter-Client Dependency Recovery with Hidden Global Components for Federated Traffic PredictionTechnical
- InterCoser: Interactive 3D Character Creation with Disentangled Fine-Grained FeaturesTechnical
- InterMoE: Individual-Specific 3D Human Interaction Generation via Dynamic Temporal-Selective MoETechnical
- Interactive Evaluation of Large Language Models for Multi-Requirement Software Engineering TasksTechnical
- Interest-Shift-Aware Logical Reasoning for Efficient Long-Sequence RecommendationTechnical
- Interest-driven Deep Multi-modal ClusteringTechnical
- Intermediate N-Gramming: Deterministic and Fast N-Grams for Large N and Large DatasetsTechnical
- Interpolated Stochastic Interventions Based on Propensity Scores, Target Policies and Treatment-Specific CostsTechnical
- Interpretable Adversarial Reinforcement LearningTechnical
- Interpretable Machine Learning for In-Home Mild Cognitive Impairment DetectionTechnical
- Interpretable Reward Model via Sparse AutoencoderTechnical
- Interpretable and Robust Behavior Abstraction via Environment-Disentangled Heterogeneous GraphTechnical
- Interpreting Capsule Networks for Image Classification by Routing Path Visualization (Abstract Reprint)Technical
- Interpreting Fedspeak with Confidence: A LLM-Based Uncertainty-Aware Framework Guided by Monetary Policy Transmission PathsTechnical
- Intervention-Aware Time Series Modeling: Capturing and Evaluating Feature DependenciesTechnical
- Intra-Class Unbiased Prototype Aggregation and Classifier Collaboration for Personalized Federated LearningTechnical
- Intra-Image Mining and Symmetric Maximum Concept Matching for Few Shot Out-of-Distribution DetectionTechnical
- Intrinsic Barriers and Practical Pathways for Human–AI Alignment: An Agreement-Based Complexity AnalysisTechnical
- Introducing Decomposed Causality with Spatiotemporal Object-Centric Representation for Video ClassificationTechnical
- Introducing Visual Scenes and Reasoning: A More Realistic Benchmark for Spoken Language UnderstandingTechnical
- Intuitive Thinking: Expanding Large Language Models’ Thinking for Rapid Decision-Making on Candidate Corrections in Chinese Grammar Error CorrectionTechnical
- Invariant Conditional Molecular Generation Under Distribution ShiftTechnical
- Invariant Feature Learning for Counterfactual Watch-time Prediction in Video RecommendationTechnical
- Invariant Representation Learning for Memory Behavior Modeling via Adaptive Environment SeparationTechnical
- Inverse Optimal Transport for Efficient Adaptation of Vision-Language ModelsTechnical
- Investigating Data Pruning for Pretraining Biological Foundation Models at ScaleTechnical
- Investigating Prosocial Behavior Theory in LLM Agents Under Policy-Induced InequitiesTechnical
- Investigating Social Bias Propagation in Federated Fine-tuning of Large Language ModelsTechnical
- Investigating Vaccine Buyer’s Remorse: Post-Vaccination Decision Regret in COVID-19 Social Media Using Politically Diverse Human AnnotationTechnical
- Investigating the Impact of Direct Punishment on the Emergence of Cooperation in Mulit-agent Reinforcement Learning Systems (Abstract Reprint)Technical
- Invisible Triggers, Visible Threats! Road-Style Adversarial Creation Attack for Visual 3D Detection in Autonomous DrivingTechnical
- Is Symbolic Music a Specific Language? Exploring Inspiration-to-Structure Machine Composition via LLMsTechnical
- Is Word Sense Disambiguation Dead in the LLM Era?Technical
- Is Your (Reasoning) Multimodal Language Model Vulnerable Toward Distractions?Technical
- Is the Information Bottleneck Robust Enough? Towards Label-Noise Resistant Information Bottleneck LearningTechnical
- Iterative Multi-Granular RAG with Contextual Hierarchical GraphTechnical
- JELV: A Judge of Edit-Level Validity for Evaluation and Automated Reference Expansion in Grammatical Error CorrectionTechnical
- JRDB-Reasoning: A Difficulty-Graded Benchmark for Visual Reasoning in RoboticsTechnical
- JoDiffusion: Jointly Diffusing Image with Pixel-Level Annotations for Semantic Segmentation PromotionTechnical
- Joint Evaluation of Answer and Reasoning Consistency for Hallucination Detection in Large Reasoning ModelsTechnical
- Joint Implicit and Explicit Language Learning for Pedestrian Attribute RecognitionTechnical
- Joint-GCG: Unified Gradient-Based Poisoning Attacks on Retrieval-Augmented Generation SystemsTechnical
- Judge Q: Trainable Queries for Optimized Information Retention in KV Cache EvictionTechnical
- JudgeBoard: Benchmarking and Enhancing Small Language Models for Reasoning EvaluationTechnical
- Judging by the Rules: Compliance-Aligned Framework for Modern Slavery Statement MonitoringTechnical
- Jump-teaching: Combating Sample Selection Bias via Temporal DisagreementTechnical
- Jupiter: Enhancing LLM Data Analysis Capabilities via Notebook and Inference-Time Value-Guided SearchTechnical
- Just Few States Are Enough: Randomized Sparse Feedback for Stability of Dynamical SystemsTechnical
- K-12EduBench: A Benchmark for Evaluating Large Language Models’ Knowledge, Problem-Solving, and Educational Goal Cognition in K-12 EducationTechnical
- K-ProtoDiff: Key Prototypes-Guided Diffusion for Time Series GenerationTechnical
- K-STaR: Knowledge-Aware Self-Taught ReasonerTechnical
- KALL-E: Autoregressive Speech Synthesis with Next-Distribution PredictionTechnical
- KCLNet: Electrically Equivalence-Oriented Graph Representation Learning for Analog CircuitsTechnical
- KNNDA: A New Perspective of Alignment Recovery for Partially View-Aligned ClusteringTechnical
- KOALA: Knowledge of Optimization and Learning Algorithms for HealthcareTechnical
- KPDM: Key Phrase Dynamic Masking for Robust Text-to-Image Person RetrievalTechnical
- KPLM-STA: Physically-Accurate Shadow Synthesis for Human Relighting via Keypoint-Based Light ModelingTechnical
- KSS-MoE: Knowledge Space Synergy Framework in Mixture of Experts for Continual Visual Instruction TuningTechnical
- KTCF: Actionable Recourse in Knowledge Tracing via Counterfactual Explanations for EducationTechnical
- KTV: Keyframes and Key Tokens Selection for Efficient Training-Free Video LLMsTechnical
- KVmix: Gradient-Based Layer Importance-Aware Mixed-Precision Quantization for KV CacheTechnical
- KeenKT: Knowledge Mastery-State Disambiguation for Knowledge TracingTechnical
- Keep On Going: Learning Robust Humanoid Motion Skills via Selective Adversarial TrainingTechnical
- KeepKV: Achieving Periodic Lossless KV Cache Compression for Efficient LLM InferenceTechnical
- Kernelized Edge Attention: Addressing Semantic Attention Blurring in Temporal Graph Neural NetworksTechnical
- Key Decision-Makers in Multi-Agent Debates: Who Holds the Power?Technical
- Khan-GCL: Kolmogorov–Arnold Network Based Graph Contrastive Learning with Hard NegativesTechnical
- KineST: A Kinematics-guided Spatiotemporal State Space Model for Human Motion Tracking from Sparse SignalsTechnical
- Know Your Neighbors: Subgraph Importance Sampling for Heterophilic Graph Active LearningTechnical
- KnowLCP: Knowledge Augmented Lane Change Prediction for Autonomous DrivingTechnical
- KnowPilot: Your Knowledge-Driven Copilot for Domain TasksTechnical
- KnowThyself: An Agentic Assistant for LLM InterpretabilityTechnical
- Knowledge Boundary Discovery for Large Language ModelsTechnical
- Knowledge Completes the Vision: A Multimodal Entity-aware Retrieval-Augmented Generation Framework for News Image CaptioningTechnical
- Knowledge Graph Guided Heterogeneity-Informed Diffusion Model for Spatio-Temporal GenerationTechnical
- Knowledge Graph for Efficient Multi-hop Question Generation (Student Abstract)Technical
- Knowledge-Based Stable Roommates ProblemsTechnical
- Knowledge-Enhanced Explainable Hypergraph Convolution Network for Medication RecommendationTechnical
- Knowledge-Enhanced Explainable Prompting for Vision-Language ModelsTechnical
- Knowledge-Enhanced Image Captioning with Adaptive Graph-based Multimodal Alignment and LLMTechnical
- Knowledge-Guided Machine Learning: A Paradigm Shift in AI for ScienceTechnical
- Koopman Invariants as Drivers of Emergent Time-Series Clustering in Joint-Embedding Predictive ArchitecturesTechnical
- Kronos: A Foundation Model for the Language of Financial MarketsTechnical
- L2-LoRA: Improving Low-Rank Adaptation with Layer-Specific RegularizationTechnical
- L2V-CoT: Cross-Modal Transfer of Chain-of-Thought Reasoning via Latent InterventionTechnical
- LAMDA: Two-Phase HPO via Learning Prior from Low-Fidelity DataTechnical
- LAMDAS: LLM as an Implicit Classifier for Domain-specific Data SelectionTechnical
- LAMIC: Layout-Aware Multi-Image Composition via Scalability of Multimodal Diffusion TransformerTechnical
- LAMP: Learning Universal Adversarial Perturbations for Multi-Image Tasks via Pre-trained ModelsTechnical
- LAS: Loss-less ANN-SNN Conversion for Fully Spike-Driven Large Language ModelsTechnical
- LC3: Long Cross-Language Code Clone Detection Enhanced by Opcode Sequences and Affinity AggregationTechnical
- LENS: Learning to Segment Anything with Unified Reinforced ReasoningTechnical
- LGAN: An Efficient High-Order Graph Neural Network via the Line Graph AggregationTechnical
- LILAD: Learning In-context Lyapunov-stable Adaptive Dynamics ModelsTechnical
- LLA: Enhancing Security and Privacy for Generative Models with Logic-Locked AcceleratorsTechnical
- LLM Collaboration with Multi-Agent Reinforcement LearningTechnical
- LLM Collaborative Filtering: User-Item Graph as New LanguageTechnical
- LLM Safety in Judicial AI: A Stress Test of Social Media Influence on Real-World JudgmentsTechnical
- LLM Targeted Underperformance Disproportionately Impacts Vulnerable UsersTechnical
- LLM-Aligned Geographic Item Tokenization for Local-Life RecommendationTechnical
- LLM-Based Agent for Competitive Landscape Mapping in Drug Asset Due DiligenceTechnical
- LLM-CAS: Dynamic Neuron Perturbation for Real-Time Hallucination CorrectionTechnical
- LLM-Enabled Scientific Knowledge Diffusion AnalysisTechnical
- LLM-Enhanced Energy Contrastive Learning for Out-of-Distribution Detection in Text-Attributed GraphsTechnical
- LLM-Free Image Captioning Evaluation in Reference-Flexible SettingsTechnical
- LLM-Guided Quantified SMT Solving over Uninterpreted FunctionsTechnical
- LLM-Oriented Token-Adaptive Knowledge DistillationTechnical
- LLM2CLIP: Powerful Language Model Unlocks Richer Cross-Modality RepresentationTechnical
- LLM4Sweat: A Trustworthy Large Language Model for Hyperhidrosis SupportTechnical
- LLMC+: Benchmarking Vision-Language Model Compression with a plug-and-play ToolkitTechnical
- LLMTM: Benchmarking and Optimizing LLMs for Temporal Motif Analysis in Dynamic GraphsTechnical
- LLMdoctor: Token-Level Flow-Guided Preference Optimization for Efficient Test-Time Alignment of Large Language ModelsTechnical
- LLMs Unleashed: Generating Protocol Code from RFC SpecificationsTechnical
- LLaVA-MS-PIT: Multi-Modal Schema-Guided Progressive Instruction Tuning for Multi-Modal Event ExtractionTechnical
- LLaVA-UHD v2: Exploiting Hierarchical Vision Granularity in MLLMs via Inverse Semantic PyramidTechnical
- LLaVA³: Representing 3D Scenes Like a Cubist Painter to Boost 3D Scene Understanding of VLMsTechnical
- LMGL-WD: LLM-Guided Multi-Task Graph Learning for Category-Level Warehouse Demand Prediction in E-CommerceTechnical
- LOG-Nav: Efficient Layout-Aware Object-Goal Navigation with Hierarchical PlanningTechnical
- LORETTA: A Low Resource Framework to Poison Continuous Time Dynamic GraphsTechnical
- LPPG-RL: Lexicographically Projected Policy Gradient Reinforcement Learning with Subproblem ExplorationTechnical
- LR-AdaInSeg:Adaptive Instance Segmentation of Incomplete 3D Scenes Driven by Low-Rank NetworksTechnical
- LSAP-PV: High-Fidelity Palm Vein Image Synthesis via Layered Spectral Absorption Projection-Guided Diffusion ModelTechnical
- LSD-3D: Large-Scale 3D Driving Scene Generation with Geometry GroundingTechnical
- LSDTs: LLM-Augmented Semantic Digital Twins for Adaptive Knowledge-Intensive Infrastructure PlanningTechnical
- LSHFed: Robust and Communication-Efficient Federated Learning with Locally-Sensitive Hashing Gradient MappingTechnical
- LUCID: Learning-Enabled Uncertainty-Aware Certification of Stochastic Dynamical SystemsTechnical
- LUDO: Low-Latency Understanding of Deformable Objects Using Point Cloud Occupancy Functions (Abstract Reprint)Technical
- LUMIN: A Longitudinal Multi-modal Knowledge Decomposition Network for Predicting Breast Cancer RecurrenceTechnical
- LWGANet: Addressing Spatial and Channel Redundancy in Remote Sensing Visual Tasks with Light-Weight Grouped AttentionTechnical
- La La LiDAR: Large-Scale Layout Generation from LiDAR DataTechnical
- La VIDA: Towards a Motivated Goal Reasoning Agent (Abstract Reprint)Technical
- LaF-GRPO: In-Situ Navigation Instruction Generation for the Visually Impaired via GRPO with LLM-as-Follower RewardTechnical
- LaFINet: Laplacian-Based Frequency Injection Network for Camouflage Object Detection (Student Abstract)Technical
- LaTeX2Layout: High-Fidelity, Scalable Document Layout Annotation Pipeline for Layout DetectionTechnical
- LabelKAN - Kolmogorov-Arnold Networks for Inter-Label Learning: Avian Community LearningTechnical
- LampQ: Towards Accurate Layer-wise Mixed Precision Quantization for Vision TransformersTechnical
- LandCraft: Designing the Structured 3D Landscapes via Text GuidanceTechnical
- Landsat30-AU: A Vision-Language Dataset for Australian Landsat ImageryTechnical
- LangGPS: Language Separability Guided Data Pre-Selection for Joint Multilingual Instruction TuningTechnical
- Language Drift in Multilingual Retrieval-Augmented Generation: Characterization and Decoding-Time MitigationTechnical
- Language Model Distillation: A Temporal Difference Imitation Learning PerspectiveTechnical
- Language Models Do Not Embed Numbers Continuously (Student Abstract)Technical
- Language Models and Logic Programs for Trustworthy Tax ReasoningTechnical
- Language-Guided and Motion-Aware Gait Representation for Generalizable RecognitionTechnical
- Large Connectome Model: An fMRI Foundation Model of Brain Connectomes Empowered by Brain-Environment Interaction in Multitask Learning LandscapeTechnical
- Large Language Model Unlearning for Source CodeTechnical
- Large Language Models Meet Extreme Multi-label Classification: Scaling and Multi-modal FrameworkTechnical
- Large Language Models Struggle with Unreasonability in Math ProblemsTechnical
- Large Participation Experiential Learning Activity for Multiagent SystemsTechnical
- Large Scale Retrieval for the LinkedIn Feed Using Causal Language ModelsTechnical
- Latent Knowledge-Guided Video Diffusion for Scientific Phenomena Generation from a Single Initial FrameTechnical
- Latent Representations of Land–Sea Boundaries and Extreme Temperature in Aurora’s Encoder (Student Abstract)Technical
- Latent Self-Consistency for Reliable Majority-Set Selection in Short- and Long-Answer ReasoningTechnical
- Latent State-Predictive Exploration for Deep Reinforcement LearningTechnical
- LatentLLM: Activation-Aware Transform to Multi-Head Latent AttentionTechnical
- LatentVLA: Taming Latent Space for Generalizable and Long-Horizon Bimanual ManipulationTechnical
- LayerEdit: Disentangled Multi-Object Editing via Conflict-Aware Multi-Layer LearningTechnical
- Layout-Aware Document Parsing with Visual-Linguistic Fusion: The DATA-LUX with Academic Content Service ProviderTechnical
- Laytrol: Preserving Pretrained Knowledge in Layout Control for Multimodal Diffusion TransformersTechnical
- LeanRAG: Knowledge-Graph-Based Generation with Semantic Aggregation and Hierarchical RetrievalTechnical
- LeanTutor: Towards a Verified AI Mathematical Proof TutorTechnical
- Leap of FAITH from GNN-to-MLP: Fairness Aware Inference via DisTillation of GrapH KnowledgeTechnical
- Learn from Global Correlations: Enhancing Evolutionary Algorithm via Spectral GNNTechnical
- Learnable Matrix Profile for Motif Discovery on Multivariate Time SeriesTechnical
- Learnable Permutation for Structured Sparsity on Transformer ModelsTechnical
- Learner-Tailored Program Repair: A Solution Generator with Iterative Edit-Driven Retrieval EnhancementTechnical
- Learngene: Inheritable ‘Genes’ in Intelligent Agents (Abstract Reprint)Technical
- Learning 3D Occupancy from Beam Overlap in 2D Rotating mmWave RadarTechnical
- Learning 3D Texture-Aware Representations for Parsing Diverse Human Clothing and Body PartsTechnical
- Learning Adaptive and Expandable Mixture Model for Continual LearningTechnical
- Learning Better UAV-Based Cross-View Object Geo-Localization from Multi-Modal Prompts: MoP-UAV Benchmark and MoPT FrameworkTechnical
- Learning Beyond Domains: Misleading Prompts and Pseudo-Label Contrast for Text Domain GeneralizationTechnical
- Learning Beyond Vision: Vision-Language Distillation and Edge-Aware Mix Diffusion in Semi-Supervised Semantic SegmentationTechnical
- Learning Branching Policies for MILPs with Proximal Policy OptimizationTechnical
- Learning Cell-Aware Hierarchical Multi-Modal Representations for Robust Molecular ModelingTechnical
- Learning Compact Latent Space for Representing Neural Signed Distance Functions with High-fidelity Geometry DetailsTechnical
- Learning Conjugate Direction Fields for Planar Quadrilateral Mesh GenerationTechnical
- Learning DFAs from Positive Examples Only via Word CountingTechnical
- Learning Depth from Past Selves: Self-Evolution Contrast for Robust Depth EstimationTechnical
- Learning Diffusion Policy from Primitive Skills for Robot ManipulationTechnical
- Learning Diverse Bimanual Dexterous Manipulation Skills from Human DemonstrationsTechnical
- Learning Droplet Dynamics on Rough Unstructured Surfaces Using Physics-Informed Neural Networks (Student Abstract)Technical
- Learning Dynamics as Feedback: An Adaptive Entropy Flow Dynamics Framework for Long-tailed Human Action RecognitionTechnical
- Learning Fair Graph Representations via Probability of Necessity and SufficiencyTechnical
- Learning Fair Representations with Kolmogorov-Arnold NetworksTechnical
- Learning Heuristic Functions for HTN PlanningTechnical
- Learning Heuristic Functions with Graph Neural Networks for Numeric PlanningTechnical
- Learning Intrinsic Hierarchy for Generalized Category DiscoveryTechnical
- Learning Knowledge from Textual Descriptions for 3D Human Pose EstimationTechnical
- Learning Label Distribution with Dirichlet Process Mixture ModelTechnical
- Learning Latent Imaging Biomarkers for Interpretable Microvascular Invasion Prediction in Hepatocellular CarcinomaTechnical
- Learning More from Less: Resource-Constrained Generative AI for Classification, Generation, and PersonalizationTechnical
- Learning Network Dismantling Without Handcrafted InputsTechnical
- Learning Neural Operators from Partial Observations via Latent Autoregressive ModelingTechnical
- Learning Object-Centric Motion Priors from Human for Robotic Dexterous ManipulationTechnical
- Learning Optimal Prompt Ensemble for Multi-source Visual Prompt TransferTechnical
- Learning Personalised Human Internal Cognition from External Expressive Behaviours for Real Personality RecognitionTechnical
- Learning Procedural-Aware Video Representations Through State-Grounded Hierarchy UnfoldingTechnical
- Learning Protein–Ligand Binding in Hyperbolic SpaceTechnical
- Learning Spatial Decay for Vision TransformersTechnical
- Learning Structurally Stabilized Representations for Lossless DNA StorageTechnical
- Learning Subgroups with Maximum Treatment Effects Without Causal HeuristicsTechnical
- Learning Systems Expansion with Efficient Heterogeneity-aware Knowledge TransferTechnical
- Learning Through Concepts: Hierarchies, Logic and ReasoningTechnical
- Learning Time in Static ClassifiersTechnical
- Learning Topology-Aware Dynamic Associations for Robust Multi-Person Pose EstimationTechnical
- Learning Topology-Driven Multi-Subspace Fusion for Grassmannian Deep NetworksTechnical
- Learning Underwater Image Enhancement Iteratively Without Reference ImagesTechnical
- Learning Vision-Based Neural Network Controllers with Semi-Probabilistic Safety GuaranteesTechnical
- Learning Whom to Align With: Progressive Anomaly Combination Detection for Partially View-Aligned ClusteringTechnical
- Learning a Fix and Explore Framework for Continuous Generalized Category DiscoveryTechnical
- Learning from Answer Sets via Single-Shot Disjunctive ASP EncodingTechnical
- Learning from Guidelines: Structured Prompt Optimization for Expert Annotation TasksTechnical
- Learning from Human Gaze: Human-like Robot Social Navigation in Dense CrowdsTechnical
- Learning from Imperfect Data: Incremental Learning and Few-shot LearningTechnical
- Learning from Imperfect Data: Robust Inference of Dynamic Systems Using Simulation-Based Generative ModelTechnical
- Learning from Long-Term Engagement: Adaptive Tutoring Dialogue Planning for Personalized EducationTechnical
- Learning from Reasoning Failures via Synthetic Data GenerationTechnical
- Learning from Scoring Disagreements: Contrastive Error Mining for Efficient and Robust LLM-based AssessmentTechnical
- Learning from the Undesirable: Robust Adaptation of Language Models Without ForgettingTechnical
- Learning in Zero-Sum Markov Games: Relaxing Strong Reachability and Mixing Time AssumptionsTechnical
- Learning the Latent Structure: A Feature-Centric Approach to Graph Data AugmentationTechnical
- Learning to Cluster Rare Cell Types: Implicit Semantic Data Augmentation for Spatial Multi-modal Omics AnalysisTechnical
- Learning to Collaborate: An Orchestrated-Decentralized Framework for Peer-to-Peer LLM FederationTechnical
- Learning to Compress Graphs via Dual Agents for Consistent Topological Robustness EvaluationTechnical
- Learning to Compress: Unlocking the Potential of Large Language Models for Text RepresentationTechnical
- Learning to Cooperate with Minimal ObservabilityTechnical
- Learning to Curate Context: Jointly Optimizing Retrieval and Prediction for Multimodal Social Media PopularityTechnical
- Learning to Deliberate: Meta-policy Collaboration for Agentic LLMs with Multi-agent Reinforcement LearningTechnical
- Learning to Disentangle Latent Reasoning Rules with Language VAEs: A Systematic StudyTechnical
- Learning to Explore: Policy-Guided Outlier Synthesis for Graph Out-of-Distribution DetectionTechnical
- Learning to Generate Structured Meshes with In-Context: Toward Generalization in Mesh GenerationTechnical
- Learning to Generate and Extract: A Multi-Agent Collaboration Framework for Zero-Shot Document-Level Event Arguments ExtractionTechnical
- Learning to LEAP: Efficient Dense Point Tracking by Focusing Where It MattersTechnical
- Learning to Optimize Job Shop Scheduling Under Structural UncertaintyTechnical
- Learning to Parse and Reconstruct: Bidirectional Modeling of Question-to-Program MappingTechnical
- Learning to Rank: How GNNs Solve Max-Clique and Sparse PCATechnical
- Learning to Tell Apart: Weakly Supervised Video Anomaly Detection via Disentangled Semantic AlignmentTechnical
- Learning to Transform: Unifying Latent Geometric Shape and Appearance Representations in Healthcare ImagingTechnical
- Learning to Use AI for Learning: Teaching Responsible Use of AI Chatbot to K-12 Students Through an AI Literacy ModuleTechnical
- Learning with Preserving for Continual Multitask LearningTechnical
- Learning with Structure: Computing Consistent Subsets on Structurally-Regular GraphsTechnical
- Learning-Augmented Ski Rental with Discrete Distribution: A Bayesian ApproachTechnical
- Length-Adaptive Interest Network for Balancing Long and Short Sequence Modeling in CTR PredictionTechnical
- Less Is Better: Sparse Instance Learning for Cross-Domain Few-Shot Object DetectionTechnical
- Less Is More: Rethinking Parameter-Efficient Fine-Tuning from a Subtractive PerspectiveTechnical
- Less Is More: Sparse and Cooperative Perturbation for Point Cloud AttacksTechnical
- Less Is More: Vision Representation Compression for Efficient Video Generation with Large Language ModelsTechnical
- Let the Model Learn to Feel: Mode-Guided Tonality Injection for Symbolic Music Emotion RecognitionTechnical
- Let the Void Be Void: Robust Open-Set Semi-Supervised Learning via Selective Non-AlignmentTechnical
- Lethe: Layer- and Time-Adaptive KV Cache Pruning for Reasoning-Intensive LLM ServingTechnical
- Let’s Think with Images Efficiently! An Interleaved-Modal Chain-of-Thought Reasoning Framework with Dynamic and Precise Visual ThoughtsTechnical
- Leveraging Dissimilarity Invariance as a Robust Anchor for Learning with Noisy LabelsTechnical
- Leveraging Failed Samples: A Few-Shot and Training-Free Framework for Generalized Deepfake DetectionTechnical
- Leveraging Image as Compressed Visual Prompt and Hierarchical Visual Knowledge for Effective Image Utilization in MLLMsTechnical
- Leveraging Sparse Observations to Predict Species Abundance Across Space and TimeTechnical
- Leveraging Textual Compositional Reasoning for Robust Change CaptioningTechnical
- Leveraging Visual Blur Perception Characteristics for EEG DecodingTechnical
- LexChain: Modeling Legal Reasoning Chains for Chinese Tort Case AnalysisTechnical
- LexInstructEval: Lexical Instruction Following Evaluation for Large Language ModelsTechnical
- LiBrain: LLM-Powered Li-ion Battery Diagnostics with Time-Series-Aware Retrieval-Augmented Framework for E-bikesTechnical
- LiDAR-GS++: Improving LiDAR Gaussian Reconstruction via Diffusion PriorsTechnical
- LiDARCrafter: Dynamic 4D World Modeling from LiDAR SequencesTechnical
- LiNeXt: Revisiting LiDAR Completion with Efficient Non-Diffusion ArchitecturesTechnical
- LiR3AG: A Lightweight Rerank Reasoning Strategy Framework for Retrieval-Augmented GenerationTechnical
- LiRA: A Multi-Agent Framework for Reliable and Readable Literature Review GenerationTechnical
- LiViBench: An Omnimodal Benchmark for Interactive Livestream Video UnderstandingTechnical
- Libra-MIL: Multimodal Prototypes Stereoscopic Infused with Task-specific Language Priors for Few-shot Whole Slide Image ClassificationTechnical
- LidarPainter: One-Step Away from Any Lidar View to Novel GuidanceTechnical
- LieCraft: A Multi-Agent Framework for Evaluating Deceptive Capabilities in Language ModelsTechnical
- Life, Machine Learning, and the Search for Habitability: Predicting Biosignature Fluxes for the Habitable Worlds ObservatoryTechnical
- LifeAlign: Lifelong Alignment for Large Language Models with Memory-Augmented Focalized Preference OptimizationTechnical
- Lifelong Domain Adaptive 3D Human Pose EstimationTechnical
- Lifelong Language-Conditioned Robotic Manipulation LearningTechnical
- Light but Sharp: SlimSTAD for Real-Time Action Detection from Sensor DataTechnical
- Light-IF: Endowing LLMs with Generalizable Reasoning via Preview and Self-Checking for Complex Instruction FollowingTechnical
- Lightning Fast Caching-based Parallel Denoising Prediction for Accelerating Talking Head GenerationTechnical
- Lightweight Adaptive Topological Layout and Semantic Mapping in Vision-and-Language Navigation on WebsitesTechnical
- Lightweight Additive Blend Maps for Texture-Preserving Face Retouching: A Neural Approach to Traditional Photographic TechniquesTechnical
- Lightweight Optimal-Transport Harmonization on Edge DevicesTechnical
- LinProVSR: Linguistics-Knowledge Guided Progressive Disambiguation Network for Visual Speech RecognitionTechnical
- Linear Time Algorithms for Individually Fair k-means via Multi-Swap Local SearchTechnical
- Linguistic Steganography via Self-Adjusting Asymmetric Number System (Abstract Reprint)Technical
- Listen like a Teacher: Mitigating Whisper Hallucinations Using Adaptive Layer Attention and Knowledge DistillationTechnical
- Listening Between the Frames: Bridging Temporal Gaps in Large Audio-Language ModelsTechnical
- LiteGE: Lightweight Geodesic Embedding for Efficient Geodesics Computation and Non-Isometric Shape CorrespondenceTechnical
- LiteLong: Resource-Efficient Long-Context Data Synthesis for LLMsTechnical
- Lithology-Aware Conditional Variational Autoencoder for Synthetic Well Log Generation in Petroleum Reservoirs (Student Abstract)Technical
- LoGIC: Multi-LoRA Guided Importance Consensus for Multi-Task Pruning in Vision TransformersTechnical
- LoGoSeg: Integrating Local and Global Features for Open-Vocabulary Semantic SegmentationTechnical
- LoKI: Low-Damage Knowledge Implanting of Large Language ModelsTechnical
- LoRA in LoRA: Towards Parameter-Efficient Architecture Expansion for Continual Visual Instruction TuningTechnical
- Local Guidance for Configuration-Based Multi-Agent PathfindingTechnical
- LocalBench: Benchmarking LLMs on County-Level Local Knowledge and ReasoningTechnical
- Localization-Anchored Instance Discrimination for Domain Adaptive Person SearchTechnical
- Localized Near Surface Temperature Inversion Forecasting Using Long Short-Term MemoryTechnical
- Logic Unseen: Revealing the Logical Blindspots of Vision-Language ModelsTechnical
- LogicCat: A Chain-of-Thought Text-to-SQL Benchmark for Complex ReasoningTechnical
- Logical Characterizations of GNNs with Mean AggregationTechnical
- Long-form RewardBench: Evaluating Reward Models for Long-form GenerationTechnical
- LongLLaDA: Unlocking Long Context Capabilities in Diffusion LLMsTechnical
- LongSplat: Online Generalizable 3D Gaussian Splatting from Long Sequence ImagesTechnical
- LongT2IBench: A Benchmark for Evaluating Long Text-to-Image Generation with Graph-structured AnnotationsTechnical
- Look Closer! An Adversarial Parametric Editing Framework for Hallucination Mitigation in VLMsTechnical
- Look as You Think: Unifying Reasoning and Visual Evidence Attribution for Verifiable Document RAG via Reinforcement LearningTechnical
- Look-Back: Implicit Visual Re-focusing in MLLM ReasoningTechnical
- LookFlow: Training-Free and Efficient High-Resolution Image Synthesis via Dynamic Lookahead Guidance FlowTechnical
- LoopLLM: Transferable Energy-Latency Attacks in LLMs via Repetitive GenerationTechnical
- Loss-Guided Auxiliary Agents for Overcoming Mode Collapse in GFlowNetsTechnical
- Lost in Benchmarks? Rethinking Large Language Model Benchmarking with Item Response TheoryTechnical
- Lost in Time? A Meta-Learning Framework for Time-Shift-Tolerant Physiological Signal TransformationTechnical
- Low-Rank Curvature for Zeroth-Order Optimization in LLM Fine-tuningTechnical
- LowRank-CAM: A Computationally Efficient and Interpretable Framework for Medical Image Analysis (Student Abstract)Technical
- LungNoduleAgent: A Collaborative Multi-Agent System for Precision Diagnosis of Lung NodulesTechnical
- M-Loss: Quantifying Model Merging Compatibility with Limited Unlabeled DataTechnical
- M2FMoE: Multi-Resolution Multi-View Frequency Mixture-of-Experts for Extreme-Adaptive Time Series ForecastingTechnical
- M2I2: Learning Efficient Multi-Agent Communication via Masked State Modeling and Intention InferenceTechnical
- M3SR: Multi-Scale Multi-Perceptual Mamba for Efficient Spectral ReconstructionTechnical
- M3Time: LLM-Enhanced Multi-Modal, Multi-Scale, and Multi-Frequency Multivariate Time Series ForecastingTechnical
- M3UCD: A Multi-task Multimodal Metaphor Understanding Challenge Dataset for LLMsTechnical
- M3ashy: Multi-Modal Material Synthesis via HyperdiffusionTechnical
- MACRec: A Multi-View Subspace Alignment Framework for Contrastive Sampling Calibration in RecommendationTechnical
- MACS: Multi-source Audio-to-image Generation with Contextual Significance and Semantic AlignmentTechnical
- MACoT: Synthesizing Chains of Thought for Small Models via Multi-Agent CollaborationTechnical
- MAFA: A Multi-Agent Framework for Enterprise-Scale Annotation with Configurable Task AdaptationTechnical
- MAGIC VFM-Meta-Learning Adaptation for Ground Interaction Control with Visual Foundation Models (Abstract Reprint)Technical
- MAGIC: Mastering Physical Adversarial Generation in Context Through Collaborative LLM AgentsTechnical
- MAGIC: Multi-Agent Argumentation and Grammar Integrated CritiquerTechnical
- MAISI-v2: Accelerated 3D High-Resolution Medical Image Synthesis with Rectified Flow and Region-specific Contrastive LossTechnical
- MAJIC: Markovian Adaptive Jailbreaking via Iterative Composition of Diverse Innovative StrategiesTechnical
- MAMA-Memeia! Multi-Aspect Multi-Agent Collaboration for Depressive Symptoms Identification in MemesTechnical
- MAPI-GNN: Multi-Activation Plane Interaction Graph Neural Network for Multimodal Medical DiagnosisTechnical
- MAPS: Multi-Agent Personality Shaping for Collaborative ReasoningTechnical
- MARE: Multimodal Analogical Reasoning for Disease Evolution-Aware Radiology Report GenerationTechnical
- MARLIN: Multi-Agent Reinforcement Learning for Incremental DAG DiscoveryTechnical
- MARPO: A Reflective Policy Optimization for Multi-Agent Reinforcement LearningTechnical
- MARS: A Meta-Adaptive Reinforcement Learning Framework for Risk-Aware Multi-Agent Portfolio ManagementTechnical
- MARS: Multi-Agent Adaptive Reasoning with Socratic Guidance for Automated Prompt OptimizationTechnical
- MARS: Multimodal Adaptive Reasoning Model for Avoiding OverthinkingTechnical
- MASP: Multi-Aspect Guided Emotion Reasoning with Soft Prompt Tuning In Vision-Language ModelsTechnical
- MAU-GPT: Enhancing Multi-type Industrial Anomaly Understanding via Anomaly-aware and Generalist Experts AdaptationTechnical
- MAUGen: A Unified Diffusion Approach for Multi-Identity Facial Expression and AU Label GenerationTechnical
- MAVERIX: Multimodal Audio-Visual Evaluation and Recognition IndeXTechnical
- MAVIS: A Benchmark for Multimodal Source Attribution in Long-form Visual Question AnsweringTechnical
- MCA-Bench: A Multimodal Benchmark for Evaluating CAPTCHA Robustness Against VLM-based AttacksTechnical
- MCGS: Markov Chain Gaussian Splatting for Dynamic Scenes ReconstructionTechnical
- MCI-Net: A Robust Multi-Domain Context Integration Network for Point Cloud RegistrationTechnical
- MCIE: Multimodal LLM-Driven Complex Instruction Image Editing with Spatial GuidanceTechnical
- MCMoE: Completing Missing Modalities with Mixture of Experts for Incomplete Multimodal Action Quality AssessmentTechnical
- MCP-AgentBench: Evaluating Real-World Language Agent Performance with MCP-Mediated ToolsTechnical
- MCPTox: A Benchmark for Tool Poisoning on Real-World MCP ServersTechnical
- MCTS-SQL: Light-Weight LLMs Can Master the Text-to-SQL Through Monte Carlo Tree SearchTechnical
- MCTSr-Zero: Self-Reflective Psychological Counseling Dialogues Generation via Principles and Adaptive ExplorationTechnical
- MCW-KD: Multi-Cost Wasserstein Knowledge Distillation for Large Language ModelsTechnical
- MDBench: Benchmarking Data-Driven Methods for Model DiscoveryTechnical
- MDF: A Modality-Aware Disentanglement and Fusion Framework for Multimodal Sentiment AnalysisTechnical
- MDK12-Bench: A Multi-Discipline Benchmark for Evaluating Reasoning in Multimodal Large Language ModelsTechnical
- MDMLP-EIA: Multi-domain Dynamic MLPs with Energy Invariant Attention for Time Series ForecastingTechnical
- MDND: Unsupervised Learning Guided by Non-Differentiable Refinement for Shape CorrespondenceTechnical
- MDiff4STR: Mask Diffusion Model for Scene Text RecognitionTechnical
- ME-SFDA: Marginal Exploration with Pyramidal Atkinson-Shiffrin Memory for Source-Free Domain AdaptationTechnical
- MEML-GRPO: Heterogeneous Multi-Expert Mutual Learning for RLVR AdvancementTechnical
- METP: Multi-Granularity Integration of External Covariates for Temporal Point ProcessesTechnical
- MF-Speech: Achieving Fine-Grained and Compositional Control in Speech Generation via Factor DisentanglementTechnical
- MFINet: Multi-view Fusion and 2D–3D Interaction Enhancement for Real-Time LiDAR Semantic SegmentationTechnical
- MFmamba: A Multi-function Network for Panchromatic Image Resolution Restoration Based on State-Space ModelTechnical
- MGD:Mesh-guided Gaussians with Diffusion Priors for Dynamic Objects Reconstruction from Monocular RGB-D VideoTechnical
- MGT-Prism: Enhancing Domain Generalization for Machine-Generated Text Detection via Spectral AlignmentTechnical
- MHA2MLA-VLM: Enabling DeepSeek’s Economical Multi-Head Latent Attention Across Vision-Language ModelsTechnical
- MHB: Medical Hallucination Benchmark for Large Language Models in Complex Clinical TasksTechnical
- MHED-SLAM: Multi-Scale Hybrid Encoding-Based Decoupled SLAMTechnical
- MIDB: Multilingual Instruction Data Booster for Enhancing Cultural Equality in Multilingual Instruction SynthesisTechnical
- MIDILM: A Dual-Path Model for Controllable Text-to-MIDI GenerationTechnical
- MIGDiff: Multi-attributes Imputations for Attribute-missing Graphs via Graph Denoising Diffusion ModelTechnical
- MINGLE: VLMs for Semantically Complex Region Detection in Urban ScenesTechnical
- MIRA: Evaluating Multimodal AI on Complex Clinical Reasoning in Interventional RadiologyTechnical
- MIRAGE: Scaling Test-Time Inference with Parallel Graph-Retrieval-Augmented Reasoning ChainsTechnical
- MIRAGE: Towards AI-Generated Image Detection in the WildTechnical
- MIRNet: Integrating Constrained Graph-Based Reasoning with Pre-training for Diagnostic Medical ImagingTechnical
- MISF: MLLM Guided Iterative Sample Filtering for Data Fault DetectionTechnical
- MLLM Enriched Explainable Multiple ClusteringTechnical
- MM-R1: Unleashing the Power of Unified Multimodal Large Language Models for Personalized Image GenerationTechnical
- MM4Rec: Multi-Source and Multi-Scenario Recommender for Unified User PreferenceTechnical
- MMAU-Pro: A Challenging and Comprehensive Benchmark for Holistic Evaluation of Audio General IntelligenceTechnical
- MMBERT: Scaled Mixture-of-Experts Multimodal BERT for Robust Chinese Hate Speech Detection Under Cloaking PerturbationsTechnical
- MME-SCI: A Comprehensive and Challenging Science Benchmark for Multimodal Large Language ModelsTechnical
- MMG-VL: A Vision-Language Driven Approach for Multi-Person Motion GenerationTechnical
- MMG-Vid: Maximizing Marginal Gains at Segment-level and Token-level for Efficient Video LLMsTechnical
- MMIFEvol: Towards Evolutionary Multimodal Instruction FollowingTechnical
- MMMamba: A Versatile Cross-Modal in Context Fusion Framework for Pan-Sharpening and Zero-Shot Image EnhancementTechnical
- MMPG: MoE-based Adaptive Multi-Perspective Graph Fusion for Protein Representation LearningTechnical
- MMRAG-RFT: Two-stage Reinforcement Fine-tuning for Explainable Multi-modal Retrieval-augmented GenerationTechnical
- MMhops-R1: Multimodal Multi-hop ReasoningTechnical
- MOBA: A Material-Oriented Backdoor Attack Against LiDAR-Based 3D Object Detection SystemsTechnical
- MODA: The First Challenging Benchmark for Multispectral Object Detection in Aerial ImagesTechnical
- MOGO: Residual Quantized Hierarchical Causal Transformer for Real-Time and Infinite-Length 3D Human Motion GenerationTechnical
- MORGAN: To Bridge Mixture of Experts and Spectral Graph Neural NetworkTechnical
- MOTIF: Multi-strategy Optimization via Turn-based Interactive FrameworkTechnical
- MP-ISMoE: Mixed-Precision Interactive Side Mixture-of-Experts for Efficient Transfer LearningTechnical
- MP1: MeanFlow Tames Policy Learning in 1-step for Robotic ManipulationTechnical
- MPA: Multimodal Prototype Augmentation for Few-Shot LearningTechnical
- MPAS: Breaking Sequential Constraints of Multi-Agent Communication Topologies via Individual-Epistemic Message PropagationTechnical
- MPD-SGR: Robust Spiking Neural Networks with Membrane Potential Distribution-Driven Surrogate Gradient RegularizationTechnical
- MPI-Mamba: Latent Feature Fusion Mamba for Anisotropic Image Calibration and Deblurring in Magnetic Particle ImagingTechnical
- MPJudge: Towards Perceptual Assessment of Music-Induced PaintingsTechnical
- MPMA: Preference Manipulation Attack Against Model Context ProtocolTechnical
- MR-COSMO: Visual-Text Memory Recall and Direct CrOSs-MOdal Alignment Method for Query-Driven 3D SegmentationTechnical
- MRACL: Multi-Reward Space Guided Adaptive Curriculum Reinforcement Learning for LLMsTechnical
- MRGeo: Robust Cross-View Geo-Localization of Corrupted Images via Spatial and Channel Feature EnhancementTechnical
- MRT: Learning Compact Representations with Mixed RWKV-Transformer for Extreme Image CompressionTechnical
- MS-PPO: Mean Standard Deviation Proximal Policy Optimization for Reliable Parking Space Search in Structured EnvironmentsTechnical
- MSAT-LDM: Toward Transferable High-Fidelity Watermarking for Latent Diffusion Model via Modular Self-Augmented TrainingTechnical
- MSAnchor: De Novo Molecular Generation from Mass Spectrometry Data with Anchor-Extended Molecular ScaffoldsTechnical
- MSCFL: Model Structure-Aware Clustered Federated Learning for System Heterogeneity and Data DriftTechnical
- MSME: A Multi-Stage Multi-Expert Framework for Zero-Shot Stance DetectionTechnical
- MSPCaps: A Multi-Scale Patchify Capsule Network with Cross-Agreement Routing for Visual RecognitionTechnical
- MSR-Rec: Multi-Step Reasoning-Enhanced LLM for Sequential RecommendationTechnical
- MSTDiff: Multiscale-Aware Transformer Diffusion Network for Video Object DetectionTechnical
- MTAttack: Multi-Target Backdoor Attacks Against Large Vision-Language ModelsTechnical
- MTP: Exploring Multimodal Urban Traffic Profiling with Modality Augmentation and Spectrum FusionTechnical
- MTRL-CG: Multi-Task Reinforcement Learning Method with Spectral Clustering-Based Task GroupingTechnical
- MUG: Meta-path-aware Universal Heterogeneous Graph Pre-TrainingTechnical
- MULTIBENCH++: A Unified and Comprehensive Multimodal Fusion Benchmarking Across Specialized DomainsTechnical
- MUSE: Multi-Scale Dense Self-Distillation for Nucleus Detection and ClassificationTechnical
- MUSE: Multimodal Uncertainty-Based Self-Driven Evolution for Robust Physiological-Signal–Based Driver Fatigue DetectionTechnical
- MUTrack: A Memory-Aware Unified Representation Framework for Visual TrackingTechnical
- MV-LLMRec: Multi-View Representation Learning with Large Language Models for Recommendation (Student Abstract)Technical
- MVGD-Net: A Novel Motion-aware Video Glass Surface Detection MethodTechnical
- MaRS: A Multi-modality Very-high-resolution Remote Sensing Foundation Model with Cross-Granularity Meta-Modality LearningTechnical
- MacPrompt: Maraconic-Guided Jailbreak Against Text-to-Image ModelsTechnical
- MacVQA: Adaptive Memory Allocation and Global Noise Filtering for Continual Visual Question AnsweringTechnical
- Machine Learning Models Assisting the Development of Antibody Therapeutics and Vaccines – an Emerging TrendTechnical
- Machine Learning for Sustainable Rice Production: Region-Scale Monitoring of Water-Saving Practices in Punjab, IndiaTechnical
- Machine Pareidolia: Protecting Facial Image with Emotional EditingTechnical
- MagicPaint: Operate Anything for Image Inpainting with Diffusion ModelTechnical
- Magnitude-Modulated Equivariant Adapter for Parameter-Efficient Fine-Tuning of Equivariant Graph Neural NetworksTechnical
- Magnol.AI Copilot: Multimodal LLMs for Conversational Insight GenerationTechnical
- Make Foundation Models Trustworthy Again: Causal Fine-Adaptation for Medical Image SegmentationTechnical
- Make LVLMs Focus: Context-Aware Attention Modulation for Better Multimodal In-Context LearningTechnical
- Make Model Transparent: Brain Network Analysis via Causal and Knowledge Graph LearningTechnical
- Makespan Investigations of Sequential, Parallel, PO, and POCL PlansTechnical
- Making Every Head Count: Sparse Attention Without the Speed-Performance Trade-offTechnical
- Making Sense of LLM Decisions: A Prototype-based Framework for Explainable ClassificationTechnical
- Making Visual Dialogue More Engaging: A New Task, Method, and MetricTechnical
- Mamba-Driven Multi-View Discriminative Clustering via Global-Local Cross-View Sequence ModelingTechnical
- MambaOVSR: Multiscale Fusion with Global Motion Modeling for Chinese Opera Video Super-ResolutionTechnical
- MambaSeg: Harnessing Mamba for Accurate and Efficient Image-Event Semantic SegmentationTechnical
- Managing Infinite Abstractions in Numeric Pattern Database HeuristicsTechnical
- ManiLong-Shot: Interaction-Aware One-Shot Imitation Learning for Long-Horizon ManipulationTechnical
- Maniflat3D: Learning 3D Geometry Through Planar Representations from Multi-Layer UnwrappingTechnical
- ManipDreamer3D: Synthesizing Plausible Robotic Manipulation Video with Occupancy-aware 3D TrajectoryTechnical
- ManipLVM-R1: Reinforcement Learning for Reasoning in Embodied Manipulation with Large Vision-Language ModelsTechnical
- Manipulating the Mind’s Eye: A-SAGE, the Attention-Based Attack on ViT ExplainabilityTechnical
- Manipulation Intention Understanding for Zero-Shot Composed Image RetrievalTechnical
- Many Minds, One Path: LLM-Augmented Consensus Decision for Distributed Control in Multi-Agent Collaborative Stable ScenariosTechnical
- Mapping on a Budget: Optimizing Spatial Data Collection for MLTechnical
- Margin-Aware Preference Optimization for Aligning Diffusion Models Without ReferenceTechnical
- Marginalized Generalized IoU (MGIoU): A Unified Objective Function for Optimizing Convex Parametric ShapesTechnical
- Market-Aware Event Timeline Summarization: Integrating Price Signals to Improve Financial News UnderstandingTechnical
- MartDE: A Privacy-Preserving and Cost-Efficient Evaluation Framework for Data MarketplacesTechnical
- Mask the Redundancy: Evolving Masking Representation Learning for Multivariate Time-Series ClusteringTechnical
- Mask2IV: Interaction-Centric Video Generation via Mask TrajectoriesTechnical
- MaskAD: Parallel Masked Autoencoder for Multi-class Unsupervised Anomaly DetectionTechnical
- MaskAnyNet: Rethinking Masked Image Regions as Valuable Information in Supervised LearningTechnical
- Masked Clustering Prediction for Unsupervised Point Cloud Pre-trainingTechnical
- Masked Mineral Modeling: Continent-Scale Mineral Prospecting via Geospatial InfillingTechnical
- Mass Concept Erasure in Diffusion Models with Concept HierarchyTechnical
- Massively Parallel Proof-Number Search for Impartial Games and BeyondTechnical
- Matching Policy Design for Gig Platforms with “Priority” FeaturesTechnical
- MathSE: Improving Multimodal Mathematical Reasoning via Self-Evolving Iterative Reflection and Reward-Guided Fine-TuningTechnical
- MathSmith: Towards Extremely Hard Mathematical Reasoning by Forging Synthetic Problems with a Reinforced PolicyTechnical
- Matrix Editing Meets Fair Clustering: Parameterized Algorithms and ComplexityTechnical
- Matrix-Free Two-to-Infinity and One-to-Two Norms EstimationTechnical
- Maximizing Schatten-p Norm Regularization Toward BalanceTechnical
- MdaIF: Robust One-Stop Multi-Degradation-Aware Image Fusion with Language-Driven SemanticsTechnical
- Measuring Model Performance in the Presence of an InterventionTechnical
- Measuring What Matters: Scenario-Driven Evaluation for Trajectory Predictors in Autonomous DrivingTechnical
- Measuring the Unmeasurable: Unveiling Latent Cognitive Capabilities of LLMTechnical
- MechaFormer: Sequence Learning for Kinematic Mechanism Design AutomationTechnical
- Mechanistic Dissection of Cross-Attention Subspaces in Text-to-Image Diffusion ModelsTechnical
- MedAtlas: Evaluating LLMs for Multi-Round, Multi-Task Medical Reasoning Across Diverse Imaging Modalities and Clinical TextTechnical
- MedEyes: Learning Dynamic Visual Focus for Medical Progressive DiagnosisTechnical
- MedGR2: Breaking the Data Barrier for Medical Reasoning via Generative Reward LearningTechnical
- MedLA: A Logic-Driven Multi-Agent Framework for Complex Medical Reasoning with Large Language ModelsTechnical
- MedMKEB: A Comprehensive Knowledge Editing Benchmark for Medical Multimodal Large Language ModelsTechnical
- MedOmni-45°: A Safety–Performance Benchmark for Reasoning-Oriented LLMs in MedicineTechnical
- MedReasoner: Reinforcement Learning Drives Reasoning Grounding from Clinical Thought to Pixel-Level PrecisionTechnical
- MedSAMix: A Training-Free Model Merging Approach for Medical Image SegmentationTechnical
- MedSpaformer: A Transferable Transformer with Multi-Granularity Token Sparsification for Medical Time Series ClassificationTechnical
- MedS³: Towards Medical Slow Thinking with Self-Evolved Soft Dual-sided Process SupervisionTechnical
- Medical Image Segmentation with Minimal Labeling Effort: How Far Can We Push the Limits?Technical
- Medical Vision–Language Pretraining with LLM-Guided Temporal SupervisionTechnical
- Medverse: A Universal Model for Full-Resolution 3D Medical Image Segmentation, Transformation and EnhancementTechnical
- MegaCoin: Enhancing Medium-Grained Color Perception for Vision-Language ModelsTechnical
- Melodia: Training-Free Music Editing Guided by Attention Probing in Diffusion ModelsTechnical
- Mem-PAL: Towards Memory-based Personalized Dialogue Assistants for Long-term User-Agent InteractionTechnical
- Mem4D: Decoupling Static and Dynamic Memory for Dynamic Scene ReconstructionTechnical
- MemGuide: Intent-Driven Memory Selection for Goal-Oriented Multi-Session LLM AgentsTechnical
- Membership Inference Attack Against Large Language Model-Based Recommendation Systems: A New Distillation-Based ParadigmTechnical
- MemeBQ:Memory Efficient Binary Quantization of LLMsTechnical
- MemoVision: A Digital Catalog for Everyday InteractionsTechnical
- Memorization and Expressivity in Transformers: A Learning-Theoretic PerspectiveTechnical
- Memorize Early, Then Query: Inlier-Memorization-Guided Active Outlier DetectionTechnical
- Memory Based Advantage Shaping for LLM-Guided Reinforcement Learning (Student Abstract)Technical
- MemoryART: Enhancing LLMs via Multi-Memory Models with Adaptive Resonance Theory for Healthcare AgentsTechnical
- Mental Model-based Generation of Lies for Insider Threat ModelingTechnical
- MentalGuide: Towards Multi-Turn, State-Aware and Strategy-Driven Conversations for Mental Health SupportTechnical
- MergeDNA: Context-Aware Genome Modeling with Dynamic Tokenization Through Token MergingTechnical
- MeshA*: Efficient Path Planning with Motion PrimitivesTechnical
- MeshSplat: Generalizable Sparse-View Surface Reconstruction via Gaussian SplattingTechnical
- Meta Dynamic Graph for Traffic Flow PredictionTechnical
- Meta-Black-Box Optimization with Bi-Space Landscape Analysis and Dual-Control Mechanism for SAEATechnical
- Meta-GAIN for Missing Data ImputationTechnical
- Meta-Guided Sample Reweighting for Robust Cross-Modal Hashing Retrieval with Noisy LabelsTechnical
- Meta-Normalizing Flow for Data-Limited Offline Meta-Reinforcement Learning (Student Abstract)Technical
- MetaAct-RL: Training Language Models for Reasoning Through Meta-Action-Based Reinforcement LearningTechnical
- MetaCipher: A Time-Persistent and Universal Multi-Agent Framework for Cipher-Based Jailbreak Attacks for LLMsTechnical
- MetaDiT: Enabling Fine-grained Constraints in High-degree-of Freedom Metasurface DesignTechnical
- MetaEval: Measuring the Discrimination of Benchmarks for Efficient LLM EvaluationTechnical
- MetaGDPO: Alleviating Catastrophic Forgetting with Metacognitive Knowledge Through Group Direct Preference OptimizationTechnical
- MetaGPT: A Large Vision-Language Model for Meme Metaphor UnderstandingTechnical
- MetaGameBO: Hierarchical Game-Theoretic Driven Robust Meta-Learning for Bayesian OptimizationTechnical
- MetaTrader: Learning to Generalize RL Trading Policies Beyond Offline DataTechnical
- Methods for Optimization Problems with Markovian Stochasticity and Non-Euclidean GeometryTechnical
- Metric Distortion with Preference IntensitiesTechnical
- MicLog: Towards Accurate and Efficient LLM-based Log Parsing via Progressive Meta In-Context LearningTechnical
- MicroEvoEval: A Systematic Evaluation Framework for Image-Based Microstructure Evolution PredictionTechnical
- Mimic-X: A Large-Scale Motion Dataset via Fast Physics-Based Controller AdaptationTechnical
- Mind the Gap: Predicting, Explaining and Reducing Time-to-First-Comment (Reply Gap) in Online Mental-Health CommunitiesTechnical
- Mind the Gap: Quantifying and Aligning Human-AI Visual Attention for Accident AnticipationTechnical
- Mind the Gap: The Divergence Between Human and LLM-Generated TasksTechnical
- Mind the Third Eye! Benchmarking Privacy Awareness in MLLM-powered Smartphone AgentsTechnical
- MindCross: Fast New Subject Adaptation with Limited Data for Cross-subject Video Reconstruction from Brain SignalsTechnical
- MindSight: A Bio-Inspired Neural Architecture for Visual Restoration via Cortical Electrical StimulationTechnical
- MindVote: When AI Meets the Wild West of Social Media OpinionTechnical
- Minimizing Inequity in Facility Location GamesTechnical
- Minimum-Cost Network Flow with Dual PredictionsTechnical
- Minimum-Length Conformal Prediction Sets for Ordinal ClassificationTechnical
- Minute-Long Videos with Dual ParallelismsTechnical
- MirrorShield: Towards Dynamic Adaptive Defense Against Jailbreaks via Entropy-Guided Mirror CraftingTechnical
- Misalignment from Treating Means as EndsTechnical
- Misclassification-Aware Robust Learning from Multiple Human Labelers (Student Abstract)Technical
- Mitigating Content Effects on Reasoning in Language Models Through Fine-Grained Activation SteeringTechnical
- Mitigating Endogenous Confirmation Bias in Noisy Label Learning for Vision-Language ModelsTechnical
- Mitigating Entity Hallucinations in 3D Radiology Report Generation via Dual-Stream AlignmentTechnical
- Mitigating Error Accumulation in Co-Speech Motion Generation via Global Rotation Diffusion and Multi-Level ConstraintsTechnical
- Mitigating Error Accumulation in Knowledge Editing for Multi-Hop Question AnsweringTechnical
- Mitigating Hallucinations in Large Language Models via Causal ReasoningTechnical
- Mitigating Length Bias in RLHF Through a Causal LensTechnical
- Mitigating Low-Quality Reasoning in MLLMs: Self-Driven Refined Multimodal CoT with Selective Thinking and Step-wise Visual EnhancementTechnical
- Mitigating Negative Flips via Margin Preserving TrainingTechnical
- Mitigating Noise and Imbalance in Social Governance Graphs for Multi-Type Risk AssessmentTechnical
- Mitigating Perception Bias: A Training-Free Approach to Enhance LMM for Image Quality AssessmentTechnical
- Mitigating Self-Preference by Authorship ObfuscationTechnical
- Mix-QSAM2: Mixed-Precision Quantization for High Fidelity Segmentation in Resource Constrained ScenariosTechnical
- Mixture of Ranks with Degradation-Aware Routing for One-Step Real-World Image Super-ResolutionTechnical
- Mixture-of-Trees: Learning to Select and Weigh Reasoning Paths for Efficient LLM InferenceTechnical
- Mnemosyne: Accelerating Multi-Hop Question Answering via Cache Hit Order FittingTechnical
- MoBGS: Motion Deblurring Dynamic 3D Gaussian Splatting for Blurry Monocular VideoTechnical
- MoCHA: Advanced Vision-Language Reasoning with MoE Connector and Hierarchical Group AttentionTechnical
- MoCast: Learning Turbulent Motions Under Physical Guidance for Precipitation NowcastingTechnical
- MoE-Guided Graph Diffusion for Oriented Molecule DesignTechnical
- MoEA-Net: Modality-Incremental Expert Aggregation Network for Retinal Prognostic PredictionTechnical
- MoEG-HOI: Mixture of Expert Groups for One-Stage Hand-Object Interaction Motion Generation with Hand-Finger-Joint Semantic GuidanceTechnical
- MoEGaze: A Mixture of Experts Approach for Generalizable Gaze EstimationTechnical
- MoETTA: Test-Time Adaptation Under Mixed Distribution Shifts with MoE-LayerNormTechnical
- MoE^2: A Mixture-of-Mixtures of Experts for Ensemble-Free Domain GeneralizationTechnical
- MoFu: Scale-Aware Modulation and Fourier Fusion for Multi-Subject Video GenerationTechnical
- MoHoBench: Assessing Honesty of Multimodal Large Language Models via Unanswerable Visual QuestionsTechnical
- MoLe-VLA: Dynamic Layer-skipping Vision Language Action Model via Mixture-of-Layers for Efficient Robot ManipulationTechnical
- MoLoRA: Boosting LLM-based End-to-end Speech Translation with Mixture of Low-rank ExpertsTechnical
- MoMoREC: A Multi-agent Motivation Generation Framework for Residual Semantic ID-Aware RecommendationTechnical
- MoReMouse: Monocular Reconstruction of Laboratory MouseTechnical
- MoSE: Hierarchical Self-Distillation Enhances Early Layer EmbeddingsTechnical
- MoSs: Mixture of Scales for Efficient High-Resolution Autoregressive Image GenerationTechnical
- MoToRec: Sparse-Regularized Multimodal Tokenization for Cold-Start RecommenderTechnical
- Mobile-Agent-RAG: Driving Smart Multi-Agent Coordination with Contextual Knowledge Empowerment for Long-Horizon Mobile AutomationTechnical
- MobileSafetyBench: Evaluating Safety of Autonomous Agents in Mobile Device ControlTechnical
- ModalSyncSum: Synchronizing Image and Text for Reliable Summary GenerationTechnical
- Modality and Task Adaptation for Enhanced Zero-shot Composed Image RetrievalTechnical
- Modality-Aware Bias Mitigation and Invariance Learning for Unsupervised Visible-Infrared Person Re-IdentificationTechnical
- Modality-Balanced Collaborative Distillation for Multi-Modal Domain GeneralizationTechnical
- Model AI Assignments 2026Technical
- Model Change for Description Logic ConceptsTechnical
- Model Counting for Dependency Quantified Boolean FormulasTechnical
- Model Editing as a Double-Edged Sword: Steering Agent Behavior Toward Beneficence or HarmTechnical
- Model Whisper: Steering Vectors Unlock Large Language Models’ Potential in Test-TimeTechnical
- Model-Agnostic Sentiment Distribution Stability Analysis for Robust LLM-Generated Texts DetectionTechnical
- Modeling Item-Level Dynamic Variability with Residual Diffusion for Bundle RecommendationTechnical
- Modeling Rapid Contextual Learning in the Visual Cortex with Fast-Weight Deep Autoencoder NetworksTechnical
- Modeling Retinal Ganglion Cells with Neural Differential Equations (Student Abstract)Technical
- Modeling Trend Dynamics with Variational Neural ODEs for Information Popularity PredictionTechnical
- Modeling Uncertainty Trends for Timely Retrieval in Dynamic RAGTechnical
- Modelling the Effects of Hearing Loss on Neural Coding in the Auditory Midbrain with Variational ConditioningTechnical
- Modulation-Based Backdoors: Leveraging Amplitude and Frequency Patterns to Attack Speaker RecognitionTechnical
- MolSight: Optical Chemical Structure Recognition with SMILES Pretraining, Multi-Granularity Learning and Reinforcement LearningTechnical
- Mono3DVG-EnSD: Enhanced Spatial-aware and Dimension-decoupled Text Encoding for Monocular 3D Visual GroundingTechnical
- MonoCLUE: Object-Aware Clustering Enhances Monocular 3D Object DetectionTechnical
- MonoCloth: Reconstruction and Animation of Cloth-Decoupled Human Avatars from Monocular VideosTechnical
- MonoDream: Monocular Vision-Language Navigation with Panoramic DreamingTechnical
- Monocular Mesh Recovery and Body Measurement of Female Saanen GoatsTechnical
- Monocular Vehicle Pose and Shape Reconstruction via Dynamic Context Adaptation and Progressive Geometry RefinementTechnical
- Monte Carlo Diffusion for Generalizable Learning-Based RANSACTechnical
- Moral Change or Noise? On Problems of Aligning AI with Temporally Unstable Human FeedbackTechnical
- MoralReason: Generalizable Moral Decision Alignment for LLM Agents Using Reasoning-Level Reinforcement LearningTechnical
- More than Irrational: Modeling Belief-Biased AgentsTechnical
- Mosaic Pruning: A Hierarchical Framework for Generalizable Pruning of Mixture-of-Experts ModelsTechnical
- MosaicDoc: A Large-Scale Bilingual Benchmark for Visually Rich Document UnderstandingTechnical
- Motion Planning Diffusion: Learning and Adapting Robot Motion Planning with Diffusion Models (Abstract Reprint)Technical
- Motion-Aware Object Tracking via Motion and Geometry-Aware CuesTechnical
- MotionCharacter: Fine-Grained Motion Controllable Human Video GenerationTechnical
- MotionFlow: Attention-Driven Motion Transfer in Video Diffusion ModelsTechnical
- MotionPhysics: Learnable Motion Distillation for Text-Guided SimulationTechnical
- MotivDance: Fine-Grained Text-Guided Motivation Choreography with Music SynchronizationTechnical
- MovSemCL: Movement-Semantics Contrastive Learning for Trajectory SimilarityTechnical
- MovieGraph-ToM: Evaluating Long-Range Theory of Mind in Large Language Models via Implicit Social-Causal GraphsTechnical
- MrCoM: A Meta-Regularized World-Model Generalizing Across Multi-ScenariosTechnical
- MrM: Black-Box Membership Inference Attacks Against Multimodal RAG SystemsTechnical
- MuSASplat: Efficient Sparse-View 3D Gaussian Splats via Lightweight Multi-Scale AdaptationTechnical
- MulTiCast: A Multimodal Time Series Forecasting SystemTechnical
- Multi-Agent Corridor Reasoning for Multi-Agent Path FindingTechnical
- Multi-Agent Path Finding with Unassigned Agents (MAPFUA)Technical
- Multi-Agent Pointer Transformer: Seq-to-Seq Reinforcement Learning for Multi-Vehicle Dynamic Pickup-Delivery ProblemsTechnical
- Multi-Agent Reinforcement Learning for Modeling, Simulating, and Optimizing Energy MarketsTechnical
- Multi-Agent Undercover Gaming: Hallucination Removal Through Counterfactual Test for Multimodal ReasoningTechnical
- Multi-Agent VLMs Guided Self-Training with PNU Loss for Low-Resource Offensive Content DetectionTechnical
- Multi-Armed Bandits Meet Large Language ModelsTechnical
- Multi-Aspect Cross-modal Quantization for Generative RecommendationTechnical
- Multi-District School Choice: Playing on Several FieldsTechnical
- Multi-Faceted Attack: Exposing Cross-Model Vulnerabilities in Defense-Equipped Vision-Language ModelsTechnical
- Multi-Granular Graph Learning with Fine-Grained Behavioral Pattern Awareness for Session-Based RecommendationTechnical
- Multi-Horizon Time Series Forecasting of Non-Parametric CDFs with Deep Lattice NetworksTechnical
- Multi-Label Classification with Incremental and Decremental FeaturesTechnical
- Multi-Level Blur-Aware Stable Diffusion for Region-Adaptive Defocus DeblurringTechnical
- Multi-Level Domain Adaptation and Contrastive Domain Isolation with Bilinear Fusion for Patient Drug Response PredictionTechnical
- Multi-Metric Preference Alignment for Generative Speech RestorationTechnical
- Multi-Modal Assistance for Unsupervised Domain Adaptation on Point Cloud 3D Object DetectionTechnical
- Multi-Modal Fact Knowledge Generation for Imbalanced Cross-Source Entity AlignmentTechnical
- Multi-Modal Interactive Control of Robotic Arm Based on Offline Large Language Models (Student Abstract)Technical
- Multi-Modal Style Transfer-based Prompt Tuning for Efficient Federated Domain GeneralizationTechnical
- Multi-Objective Bilevel LearningTechnical
- Multi-Objective Search: Algorithms, Applications, and Emerging DirectionsTechnical
- Multi-Robot Learning from Human FeedbackTechnical
- Multi-Semantic Modeling for Glass Surface Detection in the WildTechnical
- Multi-Stage Reinforcement Learning for Robust Charging of Quantum Batteries (Student Abstract)Technical
- Multi-Step Deformable Gaussian Splatting for Dynamic Scene RenderingTechnical
- Multi-Task Test-time Adaptation via Gradient Consensus and Plasticity ConstraintTechnical
- Multi-Value Alignment for LLMs via Value Decorrelation and ExtrapolationTechnical
- Multi-View Clustering with Granularity-Aware Pseudo SupervisionTechnical
- Multi-View Differential Mixing and Graph-Guided Structural Region Selection for Cross-Modal AlignmentTechnical
- Multi-Window Gabor Transform Network for Ground Penetrating Radar B-Scan Image ReconstructionTechnical
- Multi-agent In-context Coordination via Decentralized Memory RetrievalTechnical
- Multi-dimensional Adaptive Mix-hop Contextual Learning Framework for Universal Graph Anomaly DetectionTechnical
- Multi-dimensional Neural Decoding with Orthogonal Representations for Brain-Computer InterfacesTechnical
- Multi-granularity Intent Modeling with Adversarial Robustness for Sequential RecommendationTechnical
- Multi-granularity Interactive Attention Framework for Residual Hierarchical Pronunciation AssessmentTechnical
- Multi-granularity Temporal Knowledge Editing over Large Language ModelsTechnical
- Multi-graph Fusion Cross-model Contrastive Learning for RecommendationTechnical
- Multi-knowledge Enhanced Graph Neural Network for Multi-trait Essay ScoringTechnical
- Multi-level Style Preference Optimization: An Adaptive Detection Framework for Human-Machine Hybrid TextTechnical
- Multi-modal Dynamic Proxy Learning for Personalized Multiple ClusteringTechnical
- Multi-view Invariance Learning for 3D Scene Graph Pre-training via Collaborative Cross-Modal RegularizationTechnical
- Multi-view Learning via Trusted Pairwise Entity EnergyTechnical
- MultiKD: Backdoor Defense in Federated Graph Learning via Attention-Guided Multi-Teacher DistillationTechnical
- MultiMedBench: A Scenario-Aware Benchmark for Evaluating Knowledge Editing in Medical VQATechnical
- MultiMotion: Multi Subject Video Motion Transfer via Video Diffusion TransformerTechnical
- MultiTab: A Scalable Foundation for Multitask Learning on Tabular DataTechnical
- Multifaceted Scenario-Aware Hypergraph Learning for Next POI RecommendationTechnical
- Multigranular Evaluation for Brain Visual DecodingTechnical
- Multimodal Coarse-to-Local Transformer for End-to-End Autonomous Driving (Student Abstract)Technical
- Multimodal DeepResearcher: Generating Text-Chart Interleaved Reports from Scratch with Agentic FrameworkTechnical
- Multimodal Digital Phenotyping for Early Prediction of Manic Episodes Through Keystroke Dynamics and Circadian Pattern AnalysisTechnical
- Multimodal Gaussian Mixture Variational Autoencoder with Consistency RegularizationsTechnical
- Multimodal Graph Representation Learning with Dynamic Information PathwaysTechnical
- Multimodal Mixture-of-Experts with Retrieval Augmentation for Protein Active Site IdentificationTechnical
- Multimodal Robust Prompt Distillation for 3D Point Cloud ModelsTechnical
- Multimodal Super-Resolution: Discovering Hidden Physics and Its Application to Fusion Plasmas (Abstract Reprint)Technical
- Multimodal Table Understanding with Difficulty-aware Reinforcement LearningTechnical
- Multimodal Tabular Data LearningTechnical
- Multiple Human Motion UnderstandingTechnical
- Multiple-Interval Coverage for Resource Management of Passive Surveillance SystemsTechnical
- Multiple-play Stochastic Bandits with Prioritized Arm Capacity SharingTechnical
- Multiplex Heterogeneous Graph Neural Networks with Euclidean-Riemannian Mutual Space SynergyTechnical
- Multiplicative Orthogonal Sequential Editing for Language ModelsTechnical
- Multitasks-based Deep Evidential Fusion Network for Blind Image Quality AssessmentTechnical
- Multivariate Diffusion Transformer with Decoupled Attention for High-Fidelity Mask-Text Collaborative Facial GenerationTechnical
- Multivariate Functional Linear Discriminant Analysis for Partially-Observed Time Series (Abstract Reprint)Technical
- Multivariate Gaussian Representation Learning for Medical Action EvaluationTechnical
- MusicRec: Multi-modal Semantic-Enhanced Identifier with Collaborative Signals for Generative RecommendationTechnical
- MvP-ECR: Multi-Perspective Emotion-Cause Reasoning for Empathetic DialogueTechnical
- MyGram: Modality-aware Graph Transformer with Global Distribution for Multi-modal Entity AlignmentTechnical
- M²VAE: Multi-Modal Multi-View Variational Autoencoder for Cold-start Item RecommendationTechnical
- NADIR: Differential Attention Flow for Non-Autoregressive Transliteration in Indic LanguagesTechnical
- NGTM: Substructure-based Neural Graph Topic Model for Interpretable Graph GenerationTechnical
- NICE: Neural Implicit Craniofacial Model for Orthognathic Surgery PredictionTechnical
- NL2CA: Auto-formalizing Cognitive Decision-Making from Natural Language Using an Unsupervised CriticNL2LTL FrameworkTechnical
- NODiff: Neural Operator Diffusion for Multispectral Image FusionTechnical
- NOTAM-Evolve: A Knowledge-Guided Self-Evolving Optimization Framework with LLMs for NOTAM InterpretationTechnical
- NOVAID: Natural-language Observability Visualization Assistant for ITOps Dashboard Widget GenerationTechnical
- NP-MiSR: Neural Process-based Multi-Interest Learning for Session-Based RecommendationTechnical
- NTSFormer: A Self-Teaching Graph Transformer for Multimodal Isolated Cold-Start Node ClassificationTechnical
- NURBGen: High-Fidelity Text-to-CAD Generation Through LLM-Driven NURBS ModelingTechnical
- NaVLA$^2$: A Vision-Language-Audio-Action Model for Multimodal Instruction NavigationTechnical
- Nanoporous Materials Discovery via Search Bias-Guided Surrogate ModelingTechnical
AAAI accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.