← All conferences

AAAI 2026 Accepted Papers

The full list of 4,902 papers accepted at AAAI 2026 (Association for the Advancement of Artificial Intelligence Annual Conference on Artificial Intelligence). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.

Technical: 4,902
  1. Guiding Point Cloud Denoising with Learned Structural PriorsTechnical
  2. H-GAR: A Hierarchical Interaction Framework via Goal-Driven Observation-Action Refinement for Robotic ManipulationTechnical
  3. H-RDT: Human Manipulation Enhanced Bimanual Robotic ManipulationTechnical
  4. HABIT: Chrono-Synergia Robust Progressive Learning Framework for Composed Image RetrievalTechnical
  5. HALO: Hardware-Aware Quantization with Low Critical-Path-Delay Weights for LLM AccelerationTechnical
  6. HALoRA: Low-Rank Adaptation with Hierarchical Budget Allocation for Efficient Vision-Language AlignmentTechnical
  7. HAMLET4Fairness: Enhancing Fairness in AI Pipelines Through Human-Centered AutoML and ArgumentationTechnical
  8. HAP: Harmonized Amplitude Perturbation for Cross-Domain Few-Shot LearningTechnical
  9. HAPO: Training Language Models to Reason Concisely via History-Aware Policy OptimizationTechnical
  10. HARK: Hierarchical Agentic Retrieval with Keyframing for Video Understanding (Student Abstract)Technical
  11. HATIR: Heat-Aware Diffusion for Turbulent Infrared Video Super-ResolutionTechnical
  12. HC2-GNN: Hierarchical Graph Representation Learning for Efficient Text ClassificationTechnical
  13. HCC-3D: Hierarchical Compensatory Compression for 98% 3D Token Reduction in Vision-Language ModelsTechnical
  14. HCF: Hierarchical Cascade Framework for Distributed Multi-Stage Image CompressionTechnical
  15. HCPO: Hierarchical Conductor-Based Policy Optimization in Multi-Agent Reinforcement LearningTechnical
  16. HDGS: Hierarchical Dynamic Gaussian Splatting for Urban Driving ScenesTechnical
  17. HDRMovieformer: A Transformer Framework and Benchmark for Cinematic SDR-to-HDR ConversionTechnical
  18. HD²-SSC: High-Dimension High-Density Semantic Scene Completion for Autonomous DrivingTechnical
  19. HEV Generative Sandbox: A Framework for Assessing Domain-Specific Social Risks Through Human-LLM SimulationTechnical
  20. HFR-MKGC: Hierarchical Fusion Reasoning with MLLMs for Multi-modal Knowledge Graph CompletionTechnical
  21. HGATSolver: A Heterogeneous Graph Attention Solver for Fluid–Structure InteractionTechnical
  22. HGLTR: Hierarchical Knowledge Injection for Calibrating Pre-trained Models in Long-Tail RecognitionTechnical
  23. HI-SLAM2: Geometry-Aware Gaussian SLAM for Fast Monocular Scene Reconstruction (Abstract Reprint)Technical
  24. HINPool: A Unified Heterogeneous Graph Pooling Framework for Accurate Molecular and Protein Property PredictionTechnical
  25. HISE-KT: Synergizing Heterogeneous Information Networks and LLMs for Explainable Knowledge Tracing with Meta-Path OptimizationTechnical
  26. HKAFER: Achieve Visual Parameter-Efficient Fine-Tuning via Heterogeneous Kronecker Adaptation for Facial Expression RecognitionTechnical
  27. HLML-SNN:Fast Continual Learning in Spiking Neural Networks Achieved via Hebbian Learning-Driven Meta-LearningTechnical
  28. HLPD: Aligning LLMs to Human Language Preference for Machine-Revised Text DetectionTechnical
  29. HMformer: Unleashing Transformer’s Potential for Time Series Forecasting via Hierarchical Multi-Scale ModelingTechnical
  30. HN-MVTS: HyperNetwork-based Multivariate Time Series ForecastingTechnical
  31. HOSIG: Full-Body Human-Object-Scene Interaction Generation with Hierarchical Scene PerceptionTechnical
  32. HPSU: A Benchmark for Human-Level Perception in Real-World Spoken Speech UnderstandingTechnical
  33. HQ-SVC: Towards High-Quality Zero-Shot Singing Voice Conversion in Low-Resource ScenariosTechnical
  34. HSA-Net: Hierarchical and Structure-Aware Framework for Efficient and Scalable Molecular Language ModelingTechnical
  35. HSKBenchmark: Modeling and Benchmarking Chinese Second Language Acquisition in Large Language Models Through Curriculum TuningTechnical
  36. HTG-GCL: Leveraging Hierarchical Topological Granularity from Cellular Complexes for Graph Contrastive LearningTechnical
  37. HTN Plan Verification by Qualitative Temporal ReasoningTechnical
  38. HTTrack: Learning to Perceive Targets via Historical Trajectories in Satellite Video TrackingTechnical
  39. HaNa: Hardness and Noise-Aware Robust Cross-modal RetrievalTechnical
  40. HalluClean: A Unified Framework to Combat Hallucinations in LLMsTechnical
  41. Hallucinate Less by Thinking More: Aspect-Based Causal Abstention for Large Language ModelsTechnical
  42. Hallucination as a Computational Boundary: A Hierarchy of Inevitability and the Oracle EscapeTechnical
  43. Hallucinations at the FirewallTechnical
  44. HandMCM: Multi-modal Point Cloud-based Correspondence State Space Model for 3D Hand Pose EstimationTechnical
  45. HanjaBridge: Resolving Semantic Ambiguity in Korean LLMs via Hanja-Augmented Pre-TrainingTechnical
  46. Hard vs. Noise: Resolving Hard-Noisy Sample Confusion in Recommender Systems via Large Language ModelsTechnical
  47. HardF-SNN: Hardware-Friendly Quantization for Spiking Neural Networks with Efficient Integer-Arithmetic-Only InferenceTechnical
  48. HarmoQ: Harmonized Post-Training Quantization for High-Fidelity Image Super-ResolutionTechnical
  49. Harmonic Dataset Distillation for Time Series ForecastingTechnical
  50. Harnessing Diffusion-Generated Synthetic Images for Fair Image ClassificationTechnical
  51. Harnessing Textual Semantic Priors for Knowledge Transfer and Refinement in CLIP-Driven Continual LearningTechnical
  52. Harnessing Vision-Language Models for Time Series Anomaly DetectionTechnical
  53. Harnessing the Unseen: The Hidden Influence of Intrinsic Knowledge in Long-Context Language ModelsTechnical
  54. Hashed Watermark as a Filter: A Unified Defense Against Forging and Overwriting Attacks in Neural Network WatermarkingTechnical
  55. Head-Aware KV Cache Compression for Efficient Visual Autoregressive ModelingTechnical
  56. HeadHunt-VAD: Hunting Robust Anomaly-Sensitive Heads in MLLM for Tuning-Free Video Anomaly DetectionTechnical
  57. HealSplit: Towards Self-Healing Through Adversarial Distillation in Split Federated LearningTechnical
  58. Hearing More with Less: Multi-Modal Retrieval-and-Selection Augmented Conversational LLM-Based ASRTechnical
  59. HeartLLM: Discretized ECG Tokenization for LLM-Based Diagnostic ReasoningTechnical
  60. Heterogeneous Complementary DistillationTechnical
  61. Heterogeneous Graph Neural Networks for Assumption-Based ArgumentationTechnical
  62. Heterogeneous Uncertainty-Guided Composed Image Retrieval with Fine-Grained Probabilistic LearningTechnical
  63. Heterophily-aware Contrastive Learning for Heterophilic HypergraphsTechnical
  64. Hexaïssa: Standing on Giants’ Shoulders—Routing the Best Chess Engines with Mixture-of-Experts and Latent Reward LearningTechnical
  65. Hi-EF: Benchmarking Emotion Forecasting in Human-interactionTechnical
  66. HiCL: Hippocampal-Inspired Continual LearningTechnical
  67. HiFC-GAN: Hierarchical Feature-Constrained GAN for Optical-to-SAR Transfer in SAR Target ClassificationTechnical
  68. HiFi-Mamba: Dual-Stream ?-Laplacian Enhanced Mamba for High-Fidelity MRI ReconstructionTechnical
  69. HiFi-Mesh: High-Fidelity Efficient 3D Mesh Generation via Compact Autoregressive DependenceTechnical
  70. HiFusion: Hierarchical Intra-Spot Alignment and Regional Context Fusion for Spatial Gene Expression Prediction from HistopathologyTechnical
  71. HiGFA: Hierarchical Guidance for Fine-grained Data Augmentation with Diffusion ModelsTechnical
  72. HiLoMix: Robust High- and Low-Frequency Graph Learning Framework for Mixing Address AssociationTechnical
  73. HiMo-CLIP: Modeling Semantic Hierarchy and Monotonicity in Vision-Language AlignmentTechnical
  74. HiMo: High-Speed Objects Motion Compensation in Point Clouds (Abstract Reprint)Technical
  75. HiNCoT: Hierarchical Nonlinear Continuous Transform-based Tensor Representation for Multi-Dimensional Data RecoveryTechnical
  76. HiPrune: Training-Free Visual Token Pruning via Hierarchical Attention in Vision-Language Models (Student Abstract)Technical
  77. HiQ-Lip: A Hierarchical Quantum-Classical Method for Global Lipschitz Constant Estimation of ReLU NetworksTechnical
  78. HiTVideo: Hierarchical Tokenizers for Enhancing Text-to-Video Generation with Autoregressive Large Language ModelsTechnical
  79. HiVA: Self-organized Hierarchical Variable Agent via Goal-driven Semantic-Topological EvolutionTechnical
  80. Hidden in the Noise: Unveiling Backdoors in Audio LLMs Alignment Through Latent Acoustic Pattern TriggersTechnical
  81. Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving DiagnosisTechnical
  82. HierSearch: A Hierarchical Enterprise Deep Search Framework Integrating Local and Web SearchesTechnical
  83. HierarNet: Independent Interactive Hierarchical Disease Outbreak ForecastingTechnical
  84. Hierarchical Attention Network with Correction for Cross-Domain User AssociationTechnical
  85. Hierarchical Cross-View Alignment for Multi-View Clustering via Decoupled Information DistillationTechnical
  86. Hierarchical Dataset Selection for High-Quality Data SharingTechnical
  87. Hierarchical Direction Perception via Atomic Dot-Product Operators for Rotation-Invariant Point Clouds LearningTechnical
  88. Hierarchical Dual-Domain Fusion with Frequency-Guided Spatial Modeling for Pan-SharpeningTechnical
  89. Hierarchical Frequency-Decomposition Graph Neural Networks for Road Network Representation LearningTechnical
  90. Hierarchical Frequency-Guided Alignment Transformer for Compressed Video Quality EnhancementTechnical
  91. Hierarchical Prompt Learning for Image- and Text-Based Person Re-IdentificationTechnical
  92. Hierarchical Reinforcement Learning with Topology-Aware Exploration Framework for Multi-path Commodity Flow ProblemTechnical
  93. Hierarchical Schedule Optimization for Fast and Robust Diffusion Model SamplingTechnical
  94. Hierarchical Semantic Alignment for Image ClusteringTechnical
  95. Hierarchical Structure-Property Alignment for Data-Efficient Molecular Generation and EditingTechnical
  96. HierarchicalPrune: Position-Aware Compression for Large-Scale Diffusion ModelsTechnical
  97. High Dimensional Distributed Gradient Descent with Arbitrary Number of Byzantine AttackersTechnical
  98. High-Order Error Bounds for Markovian LSA with Richardson–Romberg ExtrapolationTechnical
  99. High-Pass Matters: Theoretical Insights and Sheaflet-Based Design for Hypergraph Neural NetworksTechnical
  100. High-Quality Full-Head 3D Avatar Generation from Any Single Portrait ImageTechnical
  101. High-Speed FHD Full-Color Video Computer-Generated HolographyTechnical
  102. Higher-Order ResponsibilityTechnical
  103. Hilbert Curve-Encoded Rotation-Equivariant Oriented Object Detector with Locality-Preserving Spatial MappingTechnical
  104. History-Aware Reasoning for GUI AgentsTechnical
  105. History-Enhanced Two-Stage Transformer for Aerial Vision-and-Language NavigationTechnical
  106. HitKV: Activation Frequency Knows Which Tokens Are ImportantTechnical
  107. HiveMind: Contribution-Guided Online Prompt Optimization of LLM Multi-Agent SystemsTechnical
  108. HogVul: Black-box Adversarial Code Generation Framework Against LM-based Vulnerability DetectorsTechnical
  109. Horizontal and Vertical Federated Causal Structure Learning via Higher-order CumulantsTechnical
  110. HouseTune: Two-Stage Floorplan Generation with LLM AssistanceTechnical
  111. How Bias Binds: Measuring Hidden Associations for Bias Control in Text-to-Image CompositionsTechnical
  112. How Can You Tell if Your Large Language Model Could Be a Closet Antisemite? An Explainability-Based Audit Framework for Implicit BiasTechnical
  113. How Do Data Owners Say No? A Case Study of Data Consent Mechanisms in Web-Scraped Vision-Language AI Training DatasetsTechnical
  114. How Does Alignment Enhance LLMs’ Multilingual Capabilities? A Language Neurons PerspectiveTechnical
  115. How Does Chain of Thought Think? Mechanistic Interpretability of Chain-of-Thought Reasoning with Sparse AutoencodingTechnical
  116. How Does LLM-powered Coding Assistance Shape Incidental Learning? Exploring Cognitive Forcing Strategies in Programming EducationTechnical
  117. How Foundational Skills Influence VLM-based Embodied Agents: A Native PerspectiveTechnical
  118. How Good Are Inducing Points for Dataset Distillation? (Student Abstract)Technical
  119. How Hard Is It to Explain Preferences Using Few Boolean Attributes?Technical
  120. How Hard Is It to Rig a Tournament When Few Players Can Beat or Be Beaten by the Favorite?Technical
  121. How Many Experts Are Enough? Towards Optimal Semantic Specialization for Mixture-of-ExpertsTechnical
  122. How Much Do Large Language Model Cheat on Evaluation? Benchmarking Overestimation Under the One-Time-Pad-Based FrameworkTechnical
  123. How Reasoning Influences Intersectional Biases in Vision–Language Models (Student Abstract)Technical
  124. How Wide and How Deep? Mitigating Over-squashing of GNNs via Channel Capacity Constrained EstimationTechnical
  125. HuiduRep: A Robust Self-Supervised Framework for Learning Neural Representations from Extracellular RecordingsTechnical
  126. Human Cognition Inspired RAG with Knowledge Graph for Complex Problem SolvingTechnical
  127. Human Cognitive Biases in Explanation-based Interaction: The Case of Within and Between Session Order EffectTechnical
  128. Human Motion Synthesis in 3D Scenes via Unified Scene Semantic OccupancyTechnical
  129. Human Motion UnlearningTechnical
  130. Human-Centric Open-Future Task Discovery: Formulation, Benchmark, and Scalable Tree-Based SearchTechnical
  131. Human-Centric Video Generation via Collaborative Multi-Modal ConditioningTechnical
  132. Human-Corrected Labels Learning: Enhancing Labels Quality via Human Correction of VLMs DiscrepanciesTechnical
  133. Human-in-the-Loop Bandwidth Estimation for Quality of Experience Optimization in Real-Time Video CommunicationTechnical
  134. Human-in-the-Loop Eider Duck Counting in Arctic Canada with an Open-Vocabulary Multi-Species Wildlife DetectorTechnical
  135. Human2Robot: Learning Robot Actions from Paired Human-Robot VideosTechnical
  136. HumanPro: Single-view 3D Clothed Human Reconstruction with Progressive Normal GuidanceTechnical
  137. HumanSense: From Multimodal Perception to Empathetic Context-Aware Responses Through Reasoning MLLMsTechnical
  138. HumorReject: Decoupling LLM Safety from Refusal Prefix via a Little HumorTechnical
  139. HyCoRA: Hyper-Contrastive Role-Adaptive Learning for Role-PlayingTechnical
  140. HyFI: Hyperbolic Feature Interpolation for Brain-Vision AlignmentTechnical
  141. HyMoERec: Hybrid Mixture-of-Experts for Sequential Recommendation (Student Abstract)Technical
  142. HyRNN: Hybrid Recurrent Neural Networks for Approximating Hybrid Dynamical SystemsTechnical
  143. HybriDLA: Hybrid Generation for Document Layout AnalysisTechnical
  144. Hybrid PPO–DQN for Multi-Objective Adaptive Cruise Control in Eco-Driving: Reward Shaping Toward Safety and Sustainability (Student Abstract)Technical
  145. Hybrid Restricted Master Problem for Boolean Matrix FactorisationTechnical
  146. Hybrid Routing for a Mixture of LoRA ExpertsTechnical
  147. Hybrid Semantics Accounting for Argument TypesTechnical
  148. Hybrid Vector-Occupancy Field for Robust Implicit 3D Surface ReconstructionTechnical
  149. Hybrid-DMKG: A Hybrid Reasoning Framework over Dynamic Multimodal Knowledge Graphs for Multimodal Multihop QA with Knowledge EditingTechnical
  150. Hybrid-Domain Adaptative Representation Learning for Gaze EstimationTechnical
  151. Hyper-Opinion Vagueness Quantification for Robust Multimodal LearningTechnical
  152. HyperAim: Hypergraph Contrastive Learning with Adaptive Multi-frequency FiltersTechnical
  153. HyperCOD: The First Challenging Benchmark and Baseline for Hyperspectral Camouflaged Object DetectionTechnical
  154. HyperD: Hybrid Periodicity Decoupling Framework for Traffic ForecastingTechnical
  155. HyperDiag: Temporal–Regional Hypergraph Learning via Topology-Enhanced State Propagation for Brain Disease DiagnosisTechnical
  156. HyperGLLM: An Efficient Framework for Endpoint Threat Detection via Hypergraph-Enhanced Large Language ModelsTechnical
  157. HyperGOOD: Towards Out-of-Distribution Detection in HypergraphsTechnical
  158. HyperLoad: A Cross-Modality Enhanced Large Language Model-Based Framework for Green Data Center Cooling Load PredictionTechnical
  159. HyperNoRA: Hyperedge Prediction via Node-Level Relation-Aware Self-Supervised Hypergraph LearningTechnical
  160. HyperSHAP: Shapley Values and Interactions for Explaining Hyperparameter OptimizationTechnical
  161. HyperSign: Hierarchical Hypergraph-based Co-occurrence Modeling for Sign Language Recognition and TranslationTechnical
  162. HyperSign: Saliency-Aware Spatial Graphs and Temporal Hypergraphs for Continuous Sign Language RecognitionTechnical
  163. Hyperbolic Continuous Structural Entropy for Hierarchical ClusteringTechnical
  164. Hyperbolic Hierarchical Alignment Reasoning Network for Text-3D RetrievalTechnical
  165. Hyperbolic-Enhanced Mixture-of-Experts Mamba for Sequential RecommendationTechnical
  166. Hypergraph-Based Multi-View Multi-Label Classification via Adaptive High-Order Semantic FusionTechnical
  167. Hypertension and Total-Order Forward Decomposition Optimizations (Abstract Reprint)Technical
  168. Hypothesis-Driven Reasoning for Large Language ModelsTechnical
  169. HypoxSpike: Ternary Spiking Neural Network for Opioid Overdose DetectionTechnical
  170. I Have Covered All the Bases Here: Interpreting Reasoning Features in Large Language Models via Sparse AutoencodersTechnical
  171. I-CAM-UV: Integrating Causal Graphs over Non-Identical Variable Sets Using Causal Additive Models with Unobserved VariablesTechnical
  172. I-INR: Iterative Implicit Neural RepresentationsTechnical
  173. I2CD: An Invertible Causal Framework for Compositional Zero-Shot Learning via Disentangle-Compose-DisentangleTechnical
  174. I2E: Real-Time Image-to-Event Conversion for High-Performance Spiking Neural NetworksTechnical
  175. IAD-R1: Reinforcing Consistent Reasoning in Industrial Anomaly DetectionTechnical
  176. ICAD-LLM: One-for-All Anomaly Detection via In-Context Learning with Large Language ModelsTechnical
  177. ICL-Router: In-Context Learned Model Representations for LLM RoutingTechnical
  178. ICLR: Inter-Chrominance and Luminance Interaction for Natural Color Restoration in Low-Light Image EnhancementTechnical
  179. ICM-Fusion: In-Context Meta-Optimized LoRA Fusion for Multi-Task AdaptationTechnical
  180. ID-Splat: Propagating Object Identities for Segmenting 3D Aerial-view ScenesTechnical
  181. IDK-S: Incremental Distributional Kernel for Streaming Anomaly DetectionTechnical
  182. IE-SRGS: An Internal-External Knowledge Fusion Framework for High-Fidelity 3D Gaussian Splatting Super-ResolutionTechnical
  183. IGFuse: Interactive 3D Gaussian Scene Reconstruction via Multi-Scans FusionTechnical
  184. IGIANet: Illumination Guided Implicit Alignment Network for Infrared–Visible UAV DetectionTechnical
  185. IGT4ETH: An Isotropic Pre-trained Graph Transformer for Ethereum Account ClassificationTechnical
  186. IMAGGarment+: Efficient Attribute-Wise Diffusion for Garment GenerationTechnical
  187. IMPACT: Integrated Multimodal Pipeline for Rapid Accident Causality Tracking (Student Abstract)Technical
  188. INTENT: Invariance and Discrimination-aware Noise Mitigation for Robust Composed Image RetrievalTechnical
  189. IO-RAE: Information-Obfuscation Reversible Adversarial Example for Audio Privacy ProtectionTechnical
  190. IPDA:Intelligent Perception Delay Alignment Method Based on Spatio-Temporal Co-Sensing CalibrationTechnical
  191. IPFormer: Instance Prompt-guided Transformer for Multi-modal Multi-shot Video UnderstandingTechnical
  192. IQGS: Instance Query-based Gaussian SegmentationTechnical
  193. IROTE: Human-like Traits Elicitation of Large Language Model via In-Context Self-Reflective OptimizationTechnical
  194. IS-Bench: Evaluating Interactive Safety of VLM-Driven Embodied Agents in Daily Household TasksTechnical
  195. ITPP: Learning Disentangled Event Dynamics in Marked Temporal Point ProcessesTechnical
  196. IdeFN: Identifying Unclicked Space False Negatives via Relaxed Partial Optimal Transport for Conversion Rate PredictionTechnical
  197. IdealTSF: Can Non-Ideal Data Contribute to Enhancing the Performance of Time Series Forecasting Models?Technical
  198. Identifying Features Associated with Bias Against 93 Stigmatized Groups in Language Models and Guardrail Model Safety MitigationTechnical
  199. Identifying Imperfect Clones in ElectionsTechnical
  200. Identifying and Analyzing Performance-Critical Tokens in Large Language ModelsTechnical
  201. Identity-Aware Vision-Language Model for Explainable Face Forgery DetectionTechnical
  202. IdentityStory: Taming Your Identity-Preserving Generator for Human-Centric Story GenerationTechnical
  203. Image Content Matters: An Image Content Aware State Space Model for Accelerated MRI ReconstructionTechnical
  204. Image Restoration via Primal Dual Hybrid Gradient and Flow Generative ModelTechnical
  205. Image-Text Knowledge Modeling for Unsupervised Multi-Scenario Person Re-IdentificationTechnical
  206. ImageBindDC: Compressing Multi-modal Data with ImageBind-based CondensationTechnical
  207. ImageSet2Text: Describing Sets of Images Through TextTechnical
  208. ImagerySearch: Adaptive Test-Time Search for Video Generation Beyond Semantic Dependency ConstraintsTechnical
  209. Imagine with Layout and Sketch: Enhancing Vision-Language Retrieval with Dual-Stream Multi-Modal Query RefinementTechnical
  210. Impact of a Data-driven Teaching Approach on 9th Graders Conceptual Understanding of Machine LearningTechnical
  211. Implications for AI Research: Applying Lessons from the Expert Systems Boom and Bust to the Current Large-Language Model BoomTechnical
  212. Implicit Neural Representation with Multi-Scale Sine ActivationTechnical
  213. Importance-Aware Data Selection for Efficient LLM Instruction TuningTechnical
  214. Imprint of the Forgotten: Stealthy Membership Inference in Unlearned Graph Neural NetworksTechnical
  215. Improve Molecular Conformation Modeling with Geometric Deep LearningTechnical
  216. Improved Algorithms for Trip-Vehicle Assignment in Ride-SharingTechnical
  217. Improved Differentially Private Algorithms for Rank AggregationTechnical
  218. Improved Fully Dynamic Submodular Maximization Under Matroid ConstraintsTechnical
  219. Improved Masked Image Generation with Knowledge-Augmented Token RepresentationsTechnical
  220. Improved Runtime Guarantees for the SPEA2 Multi-Objective OptimizerTechnical
  221. Improved Streaming Algorithm for Fair k-Center ClusteringTechnical
  222. Improving Batch Normalization with Test-Time Adaptation for Robust Object Detection in Self-DrivingTechnical
  223. Improving CAPTCHA Robustness via Controlled Image Corruptions (Student Abstract)Technical
  224. Improving Day-Ahead Grid Carbon Intensity Forecasting by Joint Modeling of Local-Temporal and Cross-Variable Dependencies Across Different FrequenciesTechnical
  225. Improving Deepfake Detection with Reinforcement Learning-Based Adaptive Data AugmentationTechnical
  226. Improving Exact Algorithm for Pseudo Boolean Optimization with Two New Phase Selection HeuristicsTechnical
  227. Improving Generalization in LLM Structured Pruning via Function-Aware Neuron GroupingTechnical
  228. Improving Generalization in Offline Meta-Reinforcement Learning via Cross-task ContextsTechnical
  229. Improving Implicit Discourse Relation Recognition with Natural Language Explanations from LLMsTechnical
  230. Improving Large Molecular Language Model via Relation-aware Multimodal CollaborationTechnical
  231. Improving Long-Context Summarization with Multi-Granularity Retrieval OptimizationTechnical
  232. Improving Low-Resource Translation with Dictionary-Guided Fine-Tuning and RL: A Spanish-to-Wayuunaiki StudyTechnical
  233. Improving Region Representation Learning from Urban Imagery with Noisy Long-Caption SupervisionTechnical
  234. Improving Sparse IMU-based Motion Capture with Motion Label SmoothingTechnical
  235. Improving Stochastic Action-Constrained Reinforcement Learning via Truncated DistributionsTechnical
  236. Improving Sustainability of Adversarial Examples in Class-Incremental LearningTechnical
  237. Improving Target Presence and Plurality Recognition for Generalized Referring Image SegmentationTechnical
  238. Improving Value-based Process Verifier via Low-Cost Variance ReductionTechnical
  239. Improving the Accuracy of Dense Retrieval on the Quantized Indexes via Gradient Optimization of the Target EmbeddingsTechnical
  240. Improving the Convergence Rate of Ray Search Optimization for Query-Efficient Hard-Label AttacksTechnical
  241. Impute Missing Entries with UncertaintyTechnical
  242. In-Situ Eval: A Modular Framework for Custom and Real-Time RAG BenchmarkingTechnical
  243. In-Token Rationality Optimization: Towards Accurate and Concise LLM Reasoning via Self-FeedbackTechnical
  244. InEx: Hallucination Mitigation via Introspection and Cross-Modal Multi-Agent CollaborationTechnical
  245. InTimeAD: Interactive Time Series Anomaly DetectionTechnical
  246. Inapproximability of STRIPS PlanningTechnical
  247. Incoherence as Oracle-less Measure of Error in LLM-Based Code GenerationTechnical
  248. Incomplete Multi-View Unsupervised Federated Feature Selection via Cooperative Particle Swarm Optimization and Tensor-Aligned LearningTechnical
  249. Incomplete Multi-view Diabetic Retinopathy Grading via Self-Supervised Inter- and Intra-View RestorationTechnical
  250. Incorporating Self-Rewriting into Large Language Model Reasoning ReinforcementTechnical
  251. Incorporating Token Importance in Multi-Vector RetrievalTechnical
  252. Incremental Data-Driven Policy Synthesis via Game AbstractionsTechnical
  253. Incremental Maintenance of DatalogMTL MaterialisationsTechnical
  254. IndexTTS2: A Breakthrough in Emotionally Expressive and Duration-Controlled Auto-Regressive Zero-Shot Text-to-SpeechTechnical
  255. Indoor Multi-View Radar Object Detection via 3D Bounding Box DiffusionTechnical
  256. IndoorUAV: Benchmarking Vision-Language UAV Navigation in Continuous Indoor EnvironmentsTechnical
  257. Induce, Align, Predict: Zero-Shot Stance Detection via Cognitive Inductive ReasoningTechnical
  258. Inductive Generative Recommendation via Retrieval-based SpeculationTechnical
  259. Inequality in the Age of PseudonymityTechnical
  260. Inference Offloading for Cost-Sensitive Binary Classification at the EdgeTechnical
  261. Inference Scaling Law for Retrieval Augmented GenerationTechnical
  262. Inference-Aware Prompt Optimization for Aligning Black-Box Large Language ModelsTechnical
  263. Inference-time Scaling for Diffusion-based Audio Super-resolutionTechnical
  264. Inferring Implicit Goals Across Differing Task ModelsTechnical
  265. InfiGUI-G1: Advancing GUI Grounding with Adaptive Exploration Policy OptimizationTechnical
  266. Infinite-Story: A Training-Free Consistent Text-to-Image GenerationTechnical
  267. InfoCLIP: Bridging Vision-Language Pretraining and Open-Vocabulary Semantic Segmentation via Information-Theoretic Alignment TransferTechnical
  268. InfoCom: Kilobyte-Scale Communication-Efficient Collaborative Perception with Information BottleneckTechnical
  269. InfoDecom: Decomposing Information for Defending Against Privacy Leakage in Split InferenceTechnical
  270. InfoQ: Mixed-Precision Quantization via Global Information FlowTechnical
  271. Information Elicitation Mechanisms for Bayesian Auctions (Abstract Reprint)Technical
  272. Information Theoretic Optimal Surveillance for Epidemic Prevalence in NetworksTechnical
  273. Information-Theoretic Minimal Sufficient Representation for Multi-Domain Knowledge Graph CompletionTechnical
  274. Informative Subgraph Extraction with Deep Reinforcement Learning for Drug-Drug Interaction PredictionTechnical
  275. Infrared-Privileged UAV Detection via Cross-Modal Vector-QuantizationTechnical
  276. InfrastructureSentinel: Policy Enforced Guardrails for Secure MCP-driven Infrastructure AgentsTechnical
  277. Injection Without Distortion: Geometrically Constrained Knowledge Enhancement for Vision-Language ModelsTechnical
  278. Injection, Attack and Erasure: Revocable Backdoor Attacks via Machine UnlearningTechnical
  279. Inpaint-Anywhere: Zero-Shot Multi-Identity Inpainting with Efficient Diffusion TransformerTechnical
  280. Insert Anything: Image Insertion via In-Context Editing in DiTTechnical
  281. Instance Dependent Testing of Samplers Using Interval ConditioningTechnical
  282. Instance Generation for Meta-Black-Box Optimization Through Latent Space Reverse EngineeringTechnical
  283. Instance-Guided Scene Adaptation for Unsupervised Person SearchTechnical
  284. InstructDubber: Instruction-based Alignment for Zero-shot Movie DubbingTechnical
  285. Instruction-Guided Cross-Modal Clustering for Training-Free Visual Token Pruning in Vision-Language ModelsTechnical
  286. InteChar: A Unified Oracle Bone Character List for Ancient Chinese Language ModelingTechnical
  287. Integral-based Knockoffs Inference for Partially Linear ModelsTechnical
  288. Integrating AI Competencies into Teacher Education ProgramsTechnical
  289. Integrating Diverse Assignment Strategies into DETRsTechnical
  290. Integrating Fourier Neural Operators into High-Fidelity Helicopter Flight Simulation for Real-Time Urban Wind PredictionTechnical
  291. Integrating Reweighted Least Squares with Plug-and-Play Diffusion Priors for Noisy Image RestorationTechnical
  292. IntelliProof: An Argumentation Network-based Conversational Helper for Organized ReflectionTechnical
  293. IntentMotion: Learning Intent-Aware Human Motion from Language in 3D ScenesTechnical
  294. Intention Chain-of-Thought Prompting with Dynamic Routing for Code GenerationTechnical
  295. Intention-Aware Diffusion Model for Pedestrian Trajectory PredictionTechnical
  296. Intention-Guided Cognitive Reasoning for Egocentric Long-Term Action AnticipationTechnical
  297. Inter-Client Dependency Recovery with Hidden Global Components for Federated Traffic PredictionTechnical
  298. InterCoser: Interactive 3D Character Creation with Disentangled Fine-Grained FeaturesTechnical
  299. InterMoE: Individual-Specific 3D Human Interaction Generation via Dynamic Temporal-Selective MoETechnical
  300. Interactive Evaluation of Large Language Models for Multi-Requirement Software Engineering TasksTechnical
  301. Interest-Shift-Aware Logical Reasoning for Efficient Long-Sequence RecommendationTechnical
  302. Interest-driven Deep Multi-modal ClusteringTechnical
  303. Intermediate N-Gramming: Deterministic and Fast N-Grams for Large N and Large DatasetsTechnical
  304. Interpolated Stochastic Interventions Based on Propensity Scores, Target Policies and Treatment-Specific CostsTechnical
  305. Interpretable Adversarial Reinforcement LearningTechnical
  306. Interpretable Machine Learning for In-Home Mild Cognitive Impairment DetectionTechnical
  307. Interpretable Reward Model via Sparse AutoencoderTechnical
  308. Interpretable and Robust Behavior Abstraction via Environment-Disentangled Heterogeneous GraphTechnical
  309. Interpreting Capsule Networks for Image Classification by Routing Path Visualization (Abstract Reprint)Technical
  310. Interpreting Fedspeak with Confidence: A LLM-Based Uncertainty-Aware Framework Guided by Monetary Policy Transmission PathsTechnical
  311. Intervention-Aware Time Series Modeling: Capturing and Evaluating Feature DependenciesTechnical
  312. Intra-Class Unbiased Prototype Aggregation and Classifier Collaboration for Personalized Federated LearningTechnical
  313. Intra-Image Mining and Symmetric Maximum Concept Matching for Few Shot Out-of-Distribution DetectionTechnical
  314. Intrinsic Barriers and Practical Pathways for Human–AI Alignment: An Agreement-Based Complexity AnalysisTechnical
  315. Introducing Decomposed Causality with Spatiotemporal Object-Centric Representation for Video ClassificationTechnical
  316. Introducing Visual Scenes and Reasoning: A More Realistic Benchmark for Spoken Language UnderstandingTechnical
  317. Intuitive Thinking: Expanding Large Language Models’ Thinking for Rapid Decision-Making on Candidate Corrections in Chinese Grammar Error CorrectionTechnical
  318. Invariant Conditional Molecular Generation Under Distribution ShiftTechnical
  319. Invariant Feature Learning for Counterfactual Watch-time Prediction in Video RecommendationTechnical
  320. Invariant Representation Learning for Memory Behavior Modeling via Adaptive Environment SeparationTechnical
  321. Inverse Optimal Transport for Efficient Adaptation of Vision-Language ModelsTechnical
  322. Investigating Data Pruning for Pretraining Biological Foundation Models at ScaleTechnical
  323. Investigating Prosocial Behavior Theory in LLM Agents Under Policy-Induced InequitiesTechnical
  324. Investigating Social Bias Propagation in Federated Fine-tuning of Large Language ModelsTechnical
  325. Investigating Vaccine Buyer’s Remorse: Post-Vaccination Decision Regret in COVID-19 Social Media Using Politically Diverse Human AnnotationTechnical
  326. Investigating the Impact of Direct Punishment on the Emergence of Cooperation in Mulit-agent Reinforcement Learning Systems (Abstract Reprint)Technical
  327. Invisible Triggers, Visible Threats! Road-Style Adversarial Creation Attack for Visual 3D Detection in Autonomous DrivingTechnical
  328. Is Symbolic Music a Specific Language? Exploring Inspiration-to-Structure Machine Composition via LLMsTechnical
  329. Is Word Sense Disambiguation Dead in the LLM Era?Technical
  330. Is Your (Reasoning) Multimodal Language Model Vulnerable Toward Distractions?Technical
  331. Is the Information Bottleneck Robust Enough? Towards Label-Noise Resistant Information Bottleneck LearningTechnical
  332. Iterative Multi-Granular RAG with Contextual Hierarchical GraphTechnical
  333. JELV: A Judge of Edit-Level Validity for Evaluation and Automated Reference Expansion in Grammatical Error CorrectionTechnical
  334. JRDB-Reasoning: A Difficulty-Graded Benchmark for Visual Reasoning in RoboticsTechnical
  335. JoDiffusion: Jointly Diffusing Image with Pixel-Level Annotations for Semantic Segmentation PromotionTechnical
  336. Joint Evaluation of Answer and Reasoning Consistency for Hallucination Detection in Large Reasoning ModelsTechnical
  337. Joint Implicit and Explicit Language Learning for Pedestrian Attribute RecognitionTechnical
  338. Joint-GCG: Unified Gradient-Based Poisoning Attacks on Retrieval-Augmented Generation SystemsTechnical
  339. Judge Q: Trainable Queries for Optimized Information Retention in KV Cache EvictionTechnical
  340. JudgeBoard: Benchmarking and Enhancing Small Language Models for Reasoning EvaluationTechnical
  341. Judging by the Rules: Compliance-Aligned Framework for Modern Slavery Statement MonitoringTechnical
  342. Jump-teaching: Combating Sample Selection Bias via Temporal DisagreementTechnical
  343. Jupiter: Enhancing LLM Data Analysis Capabilities via Notebook and Inference-Time Value-Guided SearchTechnical
  344. Just Few States Are Enough: Randomized Sparse Feedback for Stability of Dynamical SystemsTechnical
  345. K-12EduBench: A Benchmark for Evaluating Large Language Models’ Knowledge, Problem-Solving, and Educational Goal Cognition in K-12 EducationTechnical
  346. K-ProtoDiff: Key Prototypes-Guided Diffusion for Time Series GenerationTechnical
  347. K-STaR: Knowledge-Aware Self-Taught ReasonerTechnical
  348. KALL-E: Autoregressive Speech Synthesis with Next-Distribution PredictionTechnical
  349. KCLNet: Electrically Equivalence-Oriented Graph Representation Learning for Analog CircuitsTechnical
  350. KNNDA: A New Perspective of Alignment Recovery for Partially View-Aligned ClusteringTechnical
  351. KOALA: Knowledge of Optimization and Learning Algorithms for HealthcareTechnical
  352. KPDM: Key Phrase Dynamic Masking for Robust Text-to-Image Person RetrievalTechnical
  353. KPLM-STA: Physically-Accurate Shadow Synthesis for Human Relighting via Keypoint-Based Light ModelingTechnical
  354. KSS-MoE: Knowledge Space Synergy Framework in Mixture of Experts for Continual Visual Instruction TuningTechnical
  355. KTCF: Actionable Recourse in Knowledge Tracing via Counterfactual Explanations for EducationTechnical
  356. KTV: Keyframes and Key Tokens Selection for Efficient Training-Free Video LLMsTechnical
  357. KVmix: Gradient-Based Layer Importance-Aware Mixed-Precision Quantization for KV CacheTechnical
  358. KeenKT: Knowledge Mastery-State Disambiguation for Knowledge TracingTechnical
  359. Keep On Going: Learning Robust Humanoid Motion Skills via Selective Adversarial TrainingTechnical
  360. KeepKV: Achieving Periodic Lossless KV Cache Compression for Efficient LLM InferenceTechnical
  361. Kernelized Edge Attention: Addressing Semantic Attention Blurring in Temporal Graph Neural NetworksTechnical
  362. Key Decision-Makers in Multi-Agent Debates: Who Holds the Power?Technical
  363. Khan-GCL: Kolmogorov–Arnold Network Based Graph Contrastive Learning with Hard NegativesTechnical
  364. KineST: A Kinematics-guided Spatiotemporal State Space Model for Human Motion Tracking from Sparse SignalsTechnical
  365. Know Your Neighbors: Subgraph Importance Sampling for Heterophilic Graph Active LearningTechnical
  366. KnowLCP: Knowledge Augmented Lane Change Prediction for Autonomous DrivingTechnical
  367. KnowPilot: Your Knowledge-Driven Copilot for Domain TasksTechnical
  368. KnowThyself: An Agentic Assistant for LLM InterpretabilityTechnical
  369. Knowledge Boundary Discovery for Large Language ModelsTechnical
  370. Knowledge Completes the Vision: A Multimodal Entity-aware Retrieval-Augmented Generation Framework for News Image CaptioningTechnical
  371. Knowledge Graph Guided Heterogeneity-Informed Diffusion Model for Spatio-Temporal GenerationTechnical
  372. Knowledge Graph for Efficient Multi-hop Question Generation (Student Abstract)Technical
  373. Knowledge-Based Stable Roommates ProblemsTechnical
  374. Knowledge-Enhanced Explainable Hypergraph Convolution Network for Medication RecommendationTechnical
  375. Knowledge-Enhanced Explainable Prompting for Vision-Language ModelsTechnical
  376. Knowledge-Enhanced Image Captioning with Adaptive Graph-based Multimodal Alignment and LLMTechnical
  377. Knowledge-Guided Machine Learning: A Paradigm Shift in AI for ScienceTechnical
  378. Koopman Invariants as Drivers of Emergent Time-Series Clustering in Joint-Embedding Predictive ArchitecturesTechnical
  379. Kronos: A Foundation Model for the Language of Financial MarketsTechnical
  380. L2-LoRA: Improving Low-Rank Adaptation with Layer-Specific RegularizationTechnical
  381. L2V-CoT: Cross-Modal Transfer of Chain-of-Thought Reasoning via Latent InterventionTechnical
  382. LAMDA: Two-Phase HPO via Learning Prior from Low-Fidelity DataTechnical
  383. LAMDAS: LLM as an Implicit Classifier for Domain-specific Data SelectionTechnical
  384. LAMIC: Layout-Aware Multi-Image Composition via Scalability of Multimodal Diffusion TransformerTechnical
  385. LAMP: Learning Universal Adversarial Perturbations for Multi-Image Tasks via Pre-trained ModelsTechnical
  386. LAS: Loss-less ANN-SNN Conversion for Fully Spike-Driven Large Language ModelsTechnical
  387. LC3: Long Cross-Language Code Clone Detection Enhanced by Opcode Sequences and Affinity AggregationTechnical
  388. LENS: Learning to Segment Anything with Unified Reinforced ReasoningTechnical
  389. LGAN: An Efficient High-Order Graph Neural Network via the Line Graph AggregationTechnical
  390. LILAD: Learning In-context Lyapunov-stable Adaptive Dynamics ModelsTechnical
  391. LLA: Enhancing Security and Privacy for Generative Models with Logic-Locked AcceleratorsTechnical
  392. LLM Collaboration with Multi-Agent Reinforcement LearningTechnical
  393. LLM Collaborative Filtering: User-Item Graph as New LanguageTechnical
  394. LLM Safety in Judicial AI: A Stress Test of Social Media Influence on Real-World JudgmentsTechnical
  395. LLM Targeted Underperformance Disproportionately Impacts Vulnerable UsersTechnical
  396. LLM-Aligned Geographic Item Tokenization for Local-Life RecommendationTechnical
  397. LLM-Based Agent for Competitive Landscape Mapping in Drug Asset Due DiligenceTechnical
  398. LLM-CAS: Dynamic Neuron Perturbation for Real-Time Hallucination CorrectionTechnical
  399. LLM-Enabled Scientific Knowledge Diffusion AnalysisTechnical
  400. LLM-Enhanced Energy Contrastive Learning for Out-of-Distribution Detection in Text-Attributed GraphsTechnical
  401. LLM-Free Image Captioning Evaluation in Reference-Flexible SettingsTechnical
  402. LLM-Guided Quantified SMT Solving over Uninterpreted FunctionsTechnical
  403. LLM-Oriented Token-Adaptive Knowledge DistillationTechnical
  404. LLM2CLIP: Powerful Language Model Unlocks Richer Cross-Modality RepresentationTechnical
  405. LLM4Sweat: A Trustworthy Large Language Model for Hyperhidrosis SupportTechnical
  406. LLMC+: Benchmarking Vision-Language Model Compression with a plug-and-play ToolkitTechnical
  407. LLMTM: Benchmarking and Optimizing LLMs for Temporal Motif Analysis in Dynamic GraphsTechnical
  408. LLMdoctor: Token-Level Flow-Guided Preference Optimization for Efficient Test-Time Alignment of Large Language ModelsTechnical
  409. LLMs Unleashed: Generating Protocol Code from RFC SpecificationsTechnical
  410. LLaVA-MS-PIT: Multi-Modal Schema-Guided Progressive Instruction Tuning for Multi-Modal Event ExtractionTechnical
  411. LLaVA-UHD v2: Exploiting Hierarchical Vision Granularity in MLLMs via Inverse Semantic PyramidTechnical
  412. LLaVA³: Representing 3D Scenes Like a Cubist Painter to Boost 3D Scene Understanding of VLMsTechnical
  413. LMGL-WD: LLM-Guided Multi-Task Graph Learning for Category-Level Warehouse Demand Prediction in E-CommerceTechnical
  414. LOG-Nav: Efficient Layout-Aware Object-Goal Navigation with Hierarchical PlanningTechnical
  415. LORETTA: A Low Resource Framework to Poison Continuous Time Dynamic GraphsTechnical
  416. LPPG-RL: Lexicographically Projected Policy Gradient Reinforcement Learning with Subproblem ExplorationTechnical
  417. LR-AdaInSeg:Adaptive Instance Segmentation of Incomplete 3D Scenes Driven by Low-Rank NetworksTechnical
  418. LSAP-PV: High-Fidelity Palm Vein Image Synthesis via Layered Spectral Absorption Projection-Guided Diffusion ModelTechnical
  419. LSD-3D: Large-Scale 3D Driving Scene Generation with Geometry GroundingTechnical
  420. LSDTs: LLM-Augmented Semantic Digital Twins for Adaptive Knowledge-Intensive Infrastructure PlanningTechnical
  421. LSHFed: Robust and Communication-Efficient Federated Learning with Locally-Sensitive Hashing Gradient MappingTechnical
  422. LUCID: Learning-Enabled Uncertainty-Aware Certification of Stochastic Dynamical SystemsTechnical
  423. LUDO: Low-Latency Understanding of Deformable Objects Using Point Cloud Occupancy Functions (Abstract Reprint)Technical
  424. LUMIN: A Longitudinal Multi-modal Knowledge Decomposition Network for Predicting Breast Cancer RecurrenceTechnical
  425. LWGANet: Addressing Spatial and Channel Redundancy in Remote Sensing Visual Tasks with Light-Weight Grouped AttentionTechnical
  426. La La LiDAR: Large-Scale Layout Generation from LiDAR DataTechnical
  427. La VIDA: Towards a Motivated Goal Reasoning Agent (Abstract Reprint)Technical
  428. LaF-GRPO: In-Situ Navigation Instruction Generation for the Visually Impaired via GRPO with LLM-as-Follower RewardTechnical
  429. LaFINet: Laplacian-Based Frequency Injection Network for Camouflage Object Detection (Student Abstract)Technical
  430. LaTeX2Layout: High-Fidelity, Scalable Document Layout Annotation Pipeline for Layout DetectionTechnical
  431. LabelKAN - Kolmogorov-Arnold Networks for Inter-Label Learning: Avian Community LearningTechnical
  432. LampQ: Towards Accurate Layer-wise Mixed Precision Quantization for Vision TransformersTechnical
  433. LandCraft: Designing the Structured 3D Landscapes via Text GuidanceTechnical
  434. Landsat30-AU: A Vision-Language Dataset for Australian Landsat ImageryTechnical
  435. LangGPS: Language Separability Guided Data Pre-Selection for Joint Multilingual Instruction TuningTechnical
  436. Language Drift in Multilingual Retrieval-Augmented Generation: Characterization and Decoding-Time MitigationTechnical
  437. Language Model Distillation: A Temporal Difference Imitation Learning PerspectiveTechnical
  438. Language Models Do Not Embed Numbers Continuously (Student Abstract)Technical
  439. Language Models and Logic Programs for Trustworthy Tax ReasoningTechnical
  440. Language-Guided and Motion-Aware Gait Representation for Generalizable RecognitionTechnical
  441. Large Connectome Model: An fMRI Foundation Model of Brain Connectomes Empowered by Brain-Environment Interaction in Multitask Learning LandscapeTechnical
  442. Large Language Model Unlearning for Source CodeTechnical
  443. Large Language Models Meet Extreme Multi-label Classification: Scaling and Multi-modal FrameworkTechnical
  444. Large Language Models Struggle with Unreasonability in Math ProblemsTechnical
  445. Large Participation Experiential Learning Activity for Multiagent SystemsTechnical
  446. Large Scale Retrieval for the LinkedIn Feed Using Causal Language ModelsTechnical
  447. Latent Knowledge-Guided Video Diffusion for Scientific Phenomena Generation from a Single Initial FrameTechnical
  448. Latent Representations of Land–Sea Boundaries and Extreme Temperature in Aurora’s Encoder (Student Abstract)Technical
  449. Latent Self-Consistency for Reliable Majority-Set Selection in Short- and Long-Answer ReasoningTechnical
  450. Latent State-Predictive Exploration for Deep Reinforcement LearningTechnical
  451. LatentLLM: Activation-Aware Transform to Multi-Head Latent AttentionTechnical
  452. LatentVLA: Taming Latent Space for Generalizable and Long-Horizon Bimanual ManipulationTechnical
  453. LayerEdit: Disentangled Multi-Object Editing via Conflict-Aware Multi-Layer LearningTechnical
  454. Layout-Aware Document Parsing with Visual-Linguistic Fusion: The DATA-LUX with Academic Content Service ProviderTechnical
  455. Laytrol: Preserving Pretrained Knowledge in Layout Control for Multimodal Diffusion TransformersTechnical
  456. LeanRAG: Knowledge-Graph-Based Generation with Semantic Aggregation and Hierarchical RetrievalTechnical
  457. LeanTutor: Towards a Verified AI Mathematical Proof TutorTechnical
  458. Leap of FAITH from GNN-to-MLP: Fairness Aware Inference via DisTillation of GrapH KnowledgeTechnical
  459. Learn from Global Correlations: Enhancing Evolutionary Algorithm via Spectral GNNTechnical
  460. Learnable Matrix Profile for Motif Discovery on Multivariate Time SeriesTechnical
  461. Learnable Permutation for Structured Sparsity on Transformer ModelsTechnical
  462. Learner-Tailored Program Repair: A Solution Generator with Iterative Edit-Driven Retrieval EnhancementTechnical
  463. Learngene: Inheritable ‘Genes’ in Intelligent Agents (Abstract Reprint)Technical
  464. Learning 3D Occupancy from Beam Overlap in 2D Rotating mmWave RadarTechnical
  465. Learning 3D Texture-Aware Representations for Parsing Diverse Human Clothing and Body PartsTechnical
  466. Learning Adaptive and Expandable Mixture Model for Continual LearningTechnical
  467. Learning Better UAV-Based Cross-View Object Geo-Localization from Multi-Modal Prompts: MoP-UAV Benchmark and MoPT FrameworkTechnical
  468. Learning Beyond Domains: Misleading Prompts and Pseudo-Label Contrast for Text Domain GeneralizationTechnical
  469. Learning Beyond Vision: Vision-Language Distillation and Edge-Aware Mix Diffusion in Semi-Supervised Semantic SegmentationTechnical
  470. Learning Branching Policies for MILPs with Proximal Policy OptimizationTechnical
  471. Learning Cell-Aware Hierarchical Multi-Modal Representations for Robust Molecular ModelingTechnical
  472. Learning Compact Latent Space for Representing Neural Signed Distance Functions with High-fidelity Geometry DetailsTechnical
  473. Learning Conjugate Direction Fields for Planar Quadrilateral Mesh GenerationTechnical
  474. Learning DFAs from Positive Examples Only via Word CountingTechnical
  475. Learning Depth from Past Selves: Self-Evolution Contrast for Robust Depth EstimationTechnical
  476. Learning Diffusion Policy from Primitive Skills for Robot ManipulationTechnical
  477. Learning Diverse Bimanual Dexterous Manipulation Skills from Human DemonstrationsTechnical
  478. Learning Droplet Dynamics on Rough Unstructured Surfaces Using Physics-Informed Neural Networks (Student Abstract)Technical
  479. Learning Dynamics as Feedback: An Adaptive Entropy Flow Dynamics Framework for Long-tailed Human Action RecognitionTechnical
  480. Learning Fair Graph Representations via Probability of Necessity and SufficiencyTechnical
  481. Learning Fair Representations with Kolmogorov-Arnold NetworksTechnical
  482. Learning Heuristic Functions for HTN PlanningTechnical
  483. Learning Heuristic Functions with Graph Neural Networks for Numeric PlanningTechnical
  484. Learning Intrinsic Hierarchy for Generalized Category DiscoveryTechnical
  485. Learning Knowledge from Textual Descriptions for 3D Human Pose EstimationTechnical
  486. Learning Label Distribution with Dirichlet Process Mixture ModelTechnical
  487. Learning Latent Imaging Biomarkers for Interpretable Microvascular Invasion Prediction in Hepatocellular CarcinomaTechnical
  488. Learning More from Less: Resource-Constrained Generative AI for Classification, Generation, and PersonalizationTechnical
  489. Learning Network Dismantling Without Handcrafted InputsTechnical
  490. Learning Neural Operators from Partial Observations via Latent Autoregressive ModelingTechnical
  491. Learning Object-Centric Motion Priors from Human for Robotic Dexterous ManipulationTechnical
  492. Learning Optimal Prompt Ensemble for Multi-source Visual Prompt TransferTechnical
  493. Learning Personalised Human Internal Cognition from External Expressive Behaviours for Real Personality RecognitionTechnical
  494. Learning Procedural-Aware Video Representations Through State-Grounded Hierarchy UnfoldingTechnical
  495. Learning Protein–Ligand Binding in Hyperbolic SpaceTechnical
  496. Learning Spatial Decay for Vision TransformersTechnical
  497. Learning Structurally Stabilized Representations for Lossless DNA StorageTechnical
  498. Learning Subgroups with Maximum Treatment Effects Without Causal HeuristicsTechnical
  499. Learning Systems Expansion with Efficient Heterogeneity-aware Knowledge TransferTechnical
  500. Learning Through Concepts: Hierarchies, Logic and ReasoningTechnical
  501. Learning Time in Static ClassifiersTechnical
  502. Learning Topology-Aware Dynamic Associations for Robust Multi-Person Pose EstimationTechnical
  503. Learning Topology-Driven Multi-Subspace Fusion for Grassmannian Deep NetworksTechnical
  504. Learning Underwater Image Enhancement Iteratively Without Reference ImagesTechnical
  505. Learning Vision-Based Neural Network Controllers with Semi-Probabilistic Safety GuaranteesTechnical
  506. Learning Whom to Align With: Progressive Anomaly Combination Detection for Partially View-Aligned ClusteringTechnical
  507. Learning a Fix and Explore Framework for Continuous Generalized Category DiscoveryTechnical
  508. Learning from Answer Sets via Single-Shot Disjunctive ASP EncodingTechnical
  509. Learning from Guidelines: Structured Prompt Optimization for Expert Annotation TasksTechnical
  510. Learning from Human Gaze: Human-like Robot Social Navigation in Dense CrowdsTechnical
  511. Learning from Imperfect Data: Incremental Learning and Few-shot LearningTechnical
  512. Learning from Imperfect Data: Robust Inference of Dynamic Systems Using Simulation-Based Generative ModelTechnical
  513. Learning from Long-Term Engagement: Adaptive Tutoring Dialogue Planning for Personalized EducationTechnical
  514. Learning from Reasoning Failures via Synthetic Data GenerationTechnical
  515. Learning from Scoring Disagreements: Contrastive Error Mining for Efficient and Robust LLM-based AssessmentTechnical
  516. Learning from the Undesirable: Robust Adaptation of Language Models Without ForgettingTechnical
  517. Learning in Zero-Sum Markov Games: Relaxing Strong Reachability and Mixing Time AssumptionsTechnical
  518. Learning the Latent Structure: A Feature-Centric Approach to Graph Data AugmentationTechnical
  519. Learning to Cluster Rare Cell Types: Implicit Semantic Data Augmentation for Spatial Multi-modal Omics AnalysisTechnical
  520. Learning to Collaborate: An Orchestrated-Decentralized Framework for Peer-to-Peer LLM FederationTechnical
  521. Learning to Compress Graphs via Dual Agents for Consistent Topological Robustness EvaluationTechnical
  522. Learning to Compress: Unlocking the Potential of Large Language Models for Text RepresentationTechnical
  523. Learning to Cooperate with Minimal ObservabilityTechnical
  524. Learning to Curate Context: Jointly Optimizing Retrieval and Prediction for Multimodal Social Media PopularityTechnical
  525. Learning to Deliberate: Meta-policy Collaboration for Agentic LLMs with Multi-agent Reinforcement LearningTechnical
  526. Learning to Disentangle Latent Reasoning Rules with Language VAEs: A Systematic StudyTechnical
  527. Learning to Explore: Policy-Guided Outlier Synthesis for Graph Out-of-Distribution DetectionTechnical
  528. Learning to Generate Structured Meshes with In-Context: Toward Generalization in Mesh GenerationTechnical
  529. Learning to Generate and Extract: A Multi-Agent Collaboration Framework for Zero-Shot Document-Level Event Arguments ExtractionTechnical
  530. Learning to LEAP: Efficient Dense Point Tracking by Focusing Where It MattersTechnical
  531. Learning to Optimize Job Shop Scheduling Under Structural UncertaintyTechnical
  532. Learning to Parse and Reconstruct: Bidirectional Modeling of Question-to-Program MappingTechnical
  533. Learning to Rank: How GNNs Solve Max-Clique and Sparse PCATechnical
  534. Learning to Tell Apart: Weakly Supervised Video Anomaly Detection via Disentangled Semantic AlignmentTechnical
  535. Learning to Transform: Unifying Latent Geometric Shape and Appearance Representations in Healthcare ImagingTechnical
  536. Learning to Use AI for Learning: Teaching Responsible Use of AI Chatbot to K-12 Students Through an AI Literacy ModuleTechnical
  537. Learning with Preserving for Continual Multitask LearningTechnical
  538. Learning with Structure: Computing Consistent Subsets on Structurally-Regular GraphsTechnical
  539. Learning-Augmented Ski Rental with Discrete Distribution: A Bayesian ApproachTechnical
  540. Length-Adaptive Interest Network for Balancing Long and Short Sequence Modeling in CTR PredictionTechnical
  541. Less Is Better: Sparse Instance Learning for Cross-Domain Few-Shot Object DetectionTechnical
  542. Less Is More: Rethinking Parameter-Efficient Fine-Tuning from a Subtractive PerspectiveTechnical
  543. Less Is More: Sparse and Cooperative Perturbation for Point Cloud AttacksTechnical
  544. Less Is More: Vision Representation Compression for Efficient Video Generation with Large Language ModelsTechnical
  545. Let the Model Learn to Feel: Mode-Guided Tonality Injection for Symbolic Music Emotion RecognitionTechnical
  546. Let the Void Be Void: Robust Open-Set Semi-Supervised Learning via Selective Non-AlignmentTechnical
  547. Lethe: Layer- and Time-Adaptive KV Cache Pruning for Reasoning-Intensive LLM ServingTechnical
  548. Let’s Think with Images Efficiently! An Interleaved-Modal Chain-of-Thought Reasoning Framework with Dynamic and Precise Visual ThoughtsTechnical
  549. Leveraging Dissimilarity Invariance as a Robust Anchor for Learning with Noisy LabelsTechnical
  550. Leveraging Failed Samples: A Few-Shot and Training-Free Framework for Generalized Deepfake DetectionTechnical
  551. Leveraging Image as Compressed Visual Prompt and Hierarchical Visual Knowledge for Effective Image Utilization in MLLMsTechnical
  552. Leveraging Sparse Observations to Predict Species Abundance Across Space and TimeTechnical
  553. Leveraging Textual Compositional Reasoning for Robust Change CaptioningTechnical
  554. Leveraging Visual Blur Perception Characteristics for EEG DecodingTechnical
  555. LexChain: Modeling Legal Reasoning Chains for Chinese Tort Case AnalysisTechnical
  556. LexInstructEval: Lexical Instruction Following Evaluation for Large Language ModelsTechnical
  557. LiBrain: LLM-Powered Li-ion Battery Diagnostics with Time-Series-Aware Retrieval-Augmented Framework for E-bikesTechnical
  558. LiDAR-GS++: Improving LiDAR Gaussian Reconstruction via Diffusion PriorsTechnical
  559. LiDARCrafter: Dynamic 4D World Modeling from LiDAR SequencesTechnical
  560. LiNeXt: Revisiting LiDAR Completion with Efficient Non-Diffusion ArchitecturesTechnical
  561. LiR3AG: A Lightweight Rerank Reasoning Strategy Framework for Retrieval-Augmented GenerationTechnical
  562. LiRA: A Multi-Agent Framework for Reliable and Readable Literature Review GenerationTechnical
  563. LiViBench: An Omnimodal Benchmark for Interactive Livestream Video UnderstandingTechnical
  564. Libra-MIL: Multimodal Prototypes Stereoscopic Infused with Task-specific Language Priors for Few-shot Whole Slide Image ClassificationTechnical
  565. LidarPainter: One-Step Away from Any Lidar View to Novel GuidanceTechnical
  566. LieCraft: A Multi-Agent Framework for Evaluating Deceptive Capabilities in Language ModelsTechnical
  567. Life, Machine Learning, and the Search for Habitability: Predicting Biosignature Fluxes for the Habitable Worlds ObservatoryTechnical
  568. LifeAlign: Lifelong Alignment for Large Language Models with Memory-Augmented Focalized Preference OptimizationTechnical
  569. Lifelong Domain Adaptive 3D Human Pose EstimationTechnical
  570. Lifelong Language-Conditioned Robotic Manipulation LearningTechnical
  571. Light but Sharp: SlimSTAD for Real-Time Action Detection from Sensor DataTechnical
  572. Light-IF: Endowing LLMs with Generalizable Reasoning via Preview and Self-Checking for Complex Instruction FollowingTechnical
  573. Lightning Fast Caching-based Parallel Denoising Prediction for Accelerating Talking Head GenerationTechnical
  574. Lightweight Adaptive Topological Layout and Semantic Mapping in Vision-and-Language Navigation on WebsitesTechnical
  575. Lightweight Additive Blend Maps for Texture-Preserving Face Retouching: A Neural Approach to Traditional Photographic TechniquesTechnical
  576. Lightweight Optimal-Transport Harmonization on Edge DevicesTechnical
  577. LinProVSR: Linguistics-Knowledge Guided Progressive Disambiguation Network for Visual Speech RecognitionTechnical
  578. Linear Time Algorithms for Individually Fair k-means via Multi-Swap Local SearchTechnical
  579. Linguistic Steganography via Self-Adjusting Asymmetric Number System (Abstract Reprint)Technical
  580. Listen like a Teacher: Mitigating Whisper Hallucinations Using Adaptive Layer Attention and Knowledge DistillationTechnical
  581. Listening Between the Frames: Bridging Temporal Gaps in Large Audio-Language ModelsTechnical
  582. LiteGE: Lightweight Geodesic Embedding for Efficient Geodesics Computation and Non-Isometric Shape CorrespondenceTechnical
  583. LiteLong: Resource-Efficient Long-Context Data Synthesis for LLMsTechnical
  584. Lithology-Aware Conditional Variational Autoencoder for Synthetic Well Log Generation in Petroleum Reservoirs (Student Abstract)Technical
  585. LoGIC: Multi-LoRA Guided Importance Consensus for Multi-Task Pruning in Vision TransformersTechnical
  586. LoGoSeg: Integrating Local and Global Features for Open-Vocabulary Semantic SegmentationTechnical
  587. LoKI: Low-Damage Knowledge Implanting of Large Language ModelsTechnical
  588. LoRA in LoRA: Towards Parameter-Efficient Architecture Expansion for Continual Visual Instruction TuningTechnical
  589. Local Guidance for Configuration-Based Multi-Agent PathfindingTechnical
  590. LocalBench: Benchmarking LLMs on County-Level Local Knowledge and ReasoningTechnical
  591. Localization-Anchored Instance Discrimination for Domain Adaptive Person SearchTechnical
  592. Localized Near Surface Temperature Inversion Forecasting Using Long Short-Term MemoryTechnical
  593. Logic Unseen: Revealing the Logical Blindspots of Vision-Language ModelsTechnical
  594. LogicCat: A Chain-of-Thought Text-to-SQL Benchmark for Complex ReasoningTechnical
  595. Logical Characterizations of GNNs with Mean AggregationTechnical
  596. Long-form RewardBench: Evaluating Reward Models for Long-form GenerationTechnical
  597. LongLLaDA: Unlocking Long Context Capabilities in Diffusion LLMsTechnical
  598. LongSplat: Online Generalizable 3D Gaussian Splatting from Long Sequence ImagesTechnical
  599. LongT2IBench: A Benchmark for Evaluating Long Text-to-Image Generation with Graph-structured AnnotationsTechnical
  600. Look Closer! An Adversarial Parametric Editing Framework for Hallucination Mitigation in VLMsTechnical
  601. Look as You Think: Unifying Reasoning and Visual Evidence Attribution for Verifiable Document RAG via Reinforcement LearningTechnical
  602. Look-Back: Implicit Visual Re-focusing in MLLM ReasoningTechnical
  603. LookFlow: Training-Free and Efficient High-Resolution Image Synthesis via Dynamic Lookahead Guidance FlowTechnical
  604. LoopLLM: Transferable Energy-Latency Attacks in LLMs via Repetitive GenerationTechnical
  605. Loss-Guided Auxiliary Agents for Overcoming Mode Collapse in GFlowNetsTechnical
  606. Lost in Benchmarks? Rethinking Large Language Model Benchmarking with Item Response TheoryTechnical
  607. Lost in Time? A Meta-Learning Framework for Time-Shift-Tolerant Physiological Signal TransformationTechnical
  608. Low-Rank Curvature for Zeroth-Order Optimization in LLM Fine-tuningTechnical
  609. LowRank-CAM: A Computationally Efficient and Interpretable Framework for Medical Image Analysis (Student Abstract)Technical
  610. LungNoduleAgent: A Collaborative Multi-Agent System for Precision Diagnosis of Lung NodulesTechnical
  611. M-Loss: Quantifying Model Merging Compatibility with Limited Unlabeled DataTechnical
  612. M2FMoE: Multi-Resolution Multi-View Frequency Mixture-of-Experts for Extreme-Adaptive Time Series ForecastingTechnical
  613. M2I2: Learning Efficient Multi-Agent Communication via Masked State Modeling and Intention InferenceTechnical
  614. M3SR: Multi-Scale Multi-Perceptual Mamba for Efficient Spectral ReconstructionTechnical
  615. M3Time: LLM-Enhanced Multi-Modal, Multi-Scale, and Multi-Frequency Multivariate Time Series ForecastingTechnical
  616. M3UCD: A Multi-task Multimodal Metaphor Understanding Challenge Dataset for LLMsTechnical
  617. M3ashy: Multi-Modal Material Synthesis via HyperdiffusionTechnical
  618. MACRec: A Multi-View Subspace Alignment Framework for Contrastive Sampling Calibration in RecommendationTechnical
  619. MACS: Multi-source Audio-to-image Generation with Contextual Significance and Semantic AlignmentTechnical
  620. MACoT: Synthesizing Chains of Thought for Small Models via Multi-Agent CollaborationTechnical
  621. MAFA: A Multi-Agent Framework for Enterprise-Scale Annotation with Configurable Task AdaptationTechnical
  622. MAGIC VFM-Meta-Learning Adaptation for Ground Interaction Control with Visual Foundation Models (Abstract Reprint)Technical
  623. MAGIC: Mastering Physical Adversarial Generation in Context Through Collaborative LLM AgentsTechnical
  624. MAGIC: Multi-Agent Argumentation and Grammar Integrated CritiquerTechnical
  625. MAISI-v2: Accelerated 3D High-Resolution Medical Image Synthesis with Rectified Flow and Region-specific Contrastive LossTechnical
  626. MAJIC: Markovian Adaptive Jailbreaking via Iterative Composition of Diverse Innovative StrategiesTechnical
  627. MAMA-Memeia! Multi-Aspect Multi-Agent Collaboration for Depressive Symptoms Identification in MemesTechnical
  628. MAPI-GNN: Multi-Activation Plane Interaction Graph Neural Network for Multimodal Medical DiagnosisTechnical
  629. MAPS: Multi-Agent Personality Shaping for Collaborative ReasoningTechnical
  630. MARE: Multimodal Analogical Reasoning for Disease Evolution-Aware Radiology Report GenerationTechnical
  631. MARLIN: Multi-Agent Reinforcement Learning for Incremental DAG DiscoveryTechnical
  632. MARPO: A Reflective Policy Optimization for Multi-Agent Reinforcement LearningTechnical
  633. MARS: A Meta-Adaptive Reinforcement Learning Framework for Risk-Aware Multi-Agent Portfolio ManagementTechnical
  634. MARS: Multi-Agent Adaptive Reasoning with Socratic Guidance for Automated Prompt OptimizationTechnical
  635. MARS: Multimodal Adaptive Reasoning Model for Avoiding OverthinkingTechnical
  636. MASP: Multi-Aspect Guided Emotion Reasoning with Soft Prompt Tuning In Vision-Language ModelsTechnical
  637. MAU-GPT: Enhancing Multi-type Industrial Anomaly Understanding via Anomaly-aware and Generalist Experts AdaptationTechnical
  638. MAUGen: A Unified Diffusion Approach for Multi-Identity Facial Expression and AU Label GenerationTechnical
  639. MAVERIX: Multimodal Audio-Visual Evaluation and Recognition IndeXTechnical
  640. MAVIS: A Benchmark for Multimodal Source Attribution in Long-form Visual Question AnsweringTechnical
  641. MCA-Bench: A Multimodal Benchmark for Evaluating CAPTCHA Robustness Against VLM-based AttacksTechnical
  642. MCGS: Markov Chain Gaussian Splatting for Dynamic Scenes ReconstructionTechnical
  643. MCI-Net: A Robust Multi-Domain Context Integration Network for Point Cloud RegistrationTechnical
  644. MCIE: Multimodal LLM-Driven Complex Instruction Image Editing with Spatial GuidanceTechnical
  645. MCMoE: Completing Missing Modalities with Mixture of Experts for Incomplete Multimodal Action Quality AssessmentTechnical
  646. MCP-AgentBench: Evaluating Real-World Language Agent Performance with MCP-Mediated ToolsTechnical
  647. MCPTox: A Benchmark for Tool Poisoning on Real-World MCP ServersTechnical
  648. MCTS-SQL: Light-Weight LLMs Can Master the Text-to-SQL Through Monte Carlo Tree SearchTechnical
  649. MCTSr-Zero: Self-Reflective Psychological Counseling Dialogues Generation via Principles and Adaptive ExplorationTechnical
  650. MCW-KD: Multi-Cost Wasserstein Knowledge Distillation for Large Language ModelsTechnical
  651. MDBench: Benchmarking Data-Driven Methods for Model DiscoveryTechnical
  652. MDF: A Modality-Aware Disentanglement and Fusion Framework for Multimodal Sentiment AnalysisTechnical
  653. MDK12-Bench: A Multi-Discipline Benchmark for Evaluating Reasoning in Multimodal Large Language ModelsTechnical
  654. MDMLP-EIA: Multi-domain Dynamic MLPs with Energy Invariant Attention for Time Series ForecastingTechnical
  655. MDND: Unsupervised Learning Guided by Non-Differentiable Refinement for Shape CorrespondenceTechnical
  656. MDiff4STR: Mask Diffusion Model for Scene Text RecognitionTechnical
  657. ME-SFDA: Marginal Exploration with Pyramidal Atkinson-Shiffrin Memory for Source-Free Domain AdaptationTechnical
  658. MEML-GRPO: Heterogeneous Multi-Expert Mutual Learning for RLVR AdvancementTechnical
  659. METP: Multi-Granularity Integration of External Covariates for Temporal Point ProcessesTechnical
  660. MF-Speech: Achieving Fine-Grained and Compositional Control in Speech Generation via Factor DisentanglementTechnical
  661. MFINet: Multi-view Fusion and 2D–3D Interaction Enhancement for Real-Time LiDAR Semantic SegmentationTechnical
  662. MFmamba: A Multi-function Network for Panchromatic Image Resolution Restoration Based on State-Space ModelTechnical
  663. MGD:Mesh-guided Gaussians with Diffusion Priors for Dynamic Objects Reconstruction from Monocular RGB-D VideoTechnical
  664. MGT-Prism: Enhancing Domain Generalization for Machine-Generated Text Detection via Spectral AlignmentTechnical
  665. MHA2MLA-VLM: Enabling DeepSeek’s Economical Multi-Head Latent Attention Across Vision-Language ModelsTechnical
  666. MHB: Medical Hallucination Benchmark for Large Language Models in Complex Clinical TasksTechnical
  667. MHED-SLAM: Multi-Scale Hybrid Encoding-Based Decoupled SLAMTechnical
  668. MIDB: Multilingual Instruction Data Booster for Enhancing Cultural Equality in Multilingual Instruction SynthesisTechnical
  669. MIDILM: A Dual-Path Model for Controllable Text-to-MIDI GenerationTechnical
  670. MIGDiff: Multi-attributes Imputations for Attribute-missing Graphs via Graph Denoising Diffusion ModelTechnical
  671. MINGLE: VLMs for Semantically Complex Region Detection in Urban ScenesTechnical
  672. MIRA: Evaluating Multimodal AI on Complex Clinical Reasoning in Interventional RadiologyTechnical
  673. MIRAGE: Scaling Test-Time Inference with Parallel Graph-Retrieval-Augmented Reasoning ChainsTechnical
  674. MIRAGE: Towards AI-Generated Image Detection in the WildTechnical
  675. MIRNet: Integrating Constrained Graph-Based Reasoning with Pre-training for Diagnostic Medical ImagingTechnical
  676. MISF: MLLM Guided Iterative Sample Filtering for Data Fault DetectionTechnical
  677. MLLM Enriched Explainable Multiple ClusteringTechnical
  678. MM-R1: Unleashing the Power of Unified Multimodal Large Language Models for Personalized Image GenerationTechnical
  679. MM4Rec: Multi-Source and Multi-Scenario Recommender for Unified User PreferenceTechnical
  680. MMAU-Pro: A Challenging and Comprehensive Benchmark for Holistic Evaluation of Audio General IntelligenceTechnical
  681. MMBERT: Scaled Mixture-of-Experts Multimodal BERT for Robust Chinese Hate Speech Detection Under Cloaking PerturbationsTechnical
  682. MME-SCI: A Comprehensive and Challenging Science Benchmark for Multimodal Large Language ModelsTechnical
  683. MMG-VL: A Vision-Language Driven Approach for Multi-Person Motion GenerationTechnical
  684. MMG-Vid: Maximizing Marginal Gains at Segment-level and Token-level for Efficient Video LLMsTechnical
  685. MMIFEvol: Towards Evolutionary Multimodal Instruction FollowingTechnical
  686. MMMamba: A Versatile Cross-Modal in Context Fusion Framework for Pan-Sharpening and Zero-Shot Image EnhancementTechnical
  687. MMPG: MoE-based Adaptive Multi-Perspective Graph Fusion for Protein Representation LearningTechnical
  688. MMRAG-RFT: Two-stage Reinforcement Fine-tuning for Explainable Multi-modal Retrieval-augmented GenerationTechnical
  689. MMhops-R1: Multimodal Multi-hop ReasoningTechnical
  690. MOBA: A Material-Oriented Backdoor Attack Against LiDAR-Based 3D Object Detection SystemsTechnical
  691. MODA: The First Challenging Benchmark for Multispectral Object Detection in Aerial ImagesTechnical
  692. MOGO: Residual Quantized Hierarchical Causal Transformer for Real-Time and Infinite-Length 3D Human Motion GenerationTechnical
  693. MORGAN: To Bridge Mixture of Experts and Spectral Graph Neural NetworkTechnical
  694. MOTIF: Multi-strategy Optimization via Turn-based Interactive FrameworkTechnical
  695. MP-ISMoE: Mixed-Precision Interactive Side Mixture-of-Experts for Efficient Transfer LearningTechnical
  696. MP1: MeanFlow Tames Policy Learning in 1-step for Robotic ManipulationTechnical
  697. MPA: Multimodal Prototype Augmentation for Few-Shot LearningTechnical
  698. MPAS: Breaking Sequential Constraints of Multi-Agent Communication Topologies via Individual-Epistemic Message PropagationTechnical
  699. MPD-SGR: Robust Spiking Neural Networks with Membrane Potential Distribution-Driven Surrogate Gradient RegularizationTechnical
  700. MPI-Mamba: Latent Feature Fusion Mamba for Anisotropic Image Calibration and Deblurring in Magnetic Particle ImagingTechnical
  701. MPJudge: Towards Perceptual Assessment of Music-Induced PaintingsTechnical
  702. MPMA: Preference Manipulation Attack Against Model Context ProtocolTechnical
  703. MR-COSMO: Visual-Text Memory Recall and Direct CrOSs-MOdal Alignment Method for Query-Driven 3D SegmentationTechnical
  704. MRACL: Multi-Reward Space Guided Adaptive Curriculum Reinforcement Learning for LLMsTechnical
  705. MRGeo: Robust Cross-View Geo-Localization of Corrupted Images via Spatial and Channel Feature EnhancementTechnical
  706. MRT: Learning Compact Representations with Mixed RWKV-Transformer for Extreme Image CompressionTechnical
  707. MS-PPO: Mean Standard Deviation Proximal Policy Optimization for Reliable Parking Space Search in Structured EnvironmentsTechnical
  708. MSAT-LDM: Toward Transferable High-Fidelity Watermarking for Latent Diffusion Model via Modular Self-Augmented TrainingTechnical
  709. MSAnchor: De Novo Molecular Generation from Mass Spectrometry Data with Anchor-Extended Molecular ScaffoldsTechnical
  710. MSCFL: Model Structure-Aware Clustered Federated Learning for System Heterogeneity and Data DriftTechnical
  711. MSME: A Multi-Stage Multi-Expert Framework for Zero-Shot Stance DetectionTechnical
  712. MSPCaps: A Multi-Scale Patchify Capsule Network with Cross-Agreement Routing for Visual RecognitionTechnical
  713. MSR-Rec: Multi-Step Reasoning-Enhanced LLM for Sequential RecommendationTechnical
  714. MSTDiff: Multiscale-Aware Transformer Diffusion Network for Video Object DetectionTechnical
  715. MTAttack: Multi-Target Backdoor Attacks Against Large Vision-Language ModelsTechnical
  716. MTP: Exploring Multimodal Urban Traffic Profiling with Modality Augmentation and Spectrum FusionTechnical
  717. MTRL-CG: Multi-Task Reinforcement Learning Method with Spectral Clustering-Based Task GroupingTechnical
  718. MUG: Meta-path-aware Universal Heterogeneous Graph Pre-TrainingTechnical
  719. MULTIBENCH++: A Unified and Comprehensive Multimodal Fusion Benchmarking Across Specialized DomainsTechnical
  720. MUSE: Multi-Scale Dense Self-Distillation for Nucleus Detection and ClassificationTechnical
  721. MUSE: Multimodal Uncertainty-Based Self-Driven Evolution for Robust Physiological-Signal–Based Driver Fatigue DetectionTechnical
  722. MUTrack: A Memory-Aware Unified Representation Framework for Visual TrackingTechnical
  723. MV-LLMRec: Multi-View Representation Learning with Large Language Models for Recommendation (Student Abstract)Technical
  724. MVGD-Net: A Novel Motion-aware Video Glass Surface Detection MethodTechnical
  725. MaRS: A Multi-modality Very-high-resolution Remote Sensing Foundation Model with Cross-Granularity Meta-Modality LearningTechnical
  726. MacPrompt: Maraconic-Guided Jailbreak Against Text-to-Image ModelsTechnical
  727. MacVQA: Adaptive Memory Allocation and Global Noise Filtering for Continual Visual Question AnsweringTechnical
  728. Machine Learning Models Assisting the Development of Antibody Therapeutics and Vaccines – an Emerging TrendTechnical
  729. Machine Learning for Sustainable Rice Production: Region-Scale Monitoring of Water-Saving Practices in Punjab, IndiaTechnical
  730. Machine Pareidolia: Protecting Facial Image with Emotional EditingTechnical
  731. MagicPaint: Operate Anything for Image Inpainting with Diffusion ModelTechnical
  732. Magnitude-Modulated Equivariant Adapter for Parameter-Efficient Fine-Tuning of Equivariant Graph Neural NetworksTechnical
  733. Magnol.AI Copilot: Multimodal LLMs for Conversational Insight GenerationTechnical
  734. Make Foundation Models Trustworthy Again: Causal Fine-Adaptation for Medical Image SegmentationTechnical
  735. Make LVLMs Focus: Context-Aware Attention Modulation for Better Multimodal In-Context LearningTechnical
  736. Make Model Transparent: Brain Network Analysis via Causal and Knowledge Graph LearningTechnical
  737. Makespan Investigations of Sequential, Parallel, PO, and POCL PlansTechnical
  738. Making Every Head Count: Sparse Attention Without the Speed-Performance Trade-offTechnical
  739. Making Sense of LLM Decisions: A Prototype-based Framework for Explainable ClassificationTechnical
  740. Making Visual Dialogue More Engaging: A New Task, Method, and MetricTechnical
  741. Mamba-Driven Multi-View Discriminative Clustering via Global-Local Cross-View Sequence ModelingTechnical
  742. MambaOVSR: Multiscale Fusion with Global Motion Modeling for Chinese Opera Video Super-ResolutionTechnical
  743. MambaSeg: Harnessing Mamba for Accurate and Efficient Image-Event Semantic SegmentationTechnical
  744. Managing Infinite Abstractions in Numeric Pattern Database HeuristicsTechnical
  745. ManiLong-Shot: Interaction-Aware One-Shot Imitation Learning for Long-Horizon ManipulationTechnical
  746. Maniflat3D: Learning 3D Geometry Through Planar Representations from Multi-Layer UnwrappingTechnical
  747. ManipDreamer3D: Synthesizing Plausible Robotic Manipulation Video with Occupancy-aware 3D TrajectoryTechnical
  748. ManipLVM-R1: Reinforcement Learning for Reasoning in Embodied Manipulation with Large Vision-Language ModelsTechnical
  749. Manipulating the Mind’s Eye: A-SAGE, the Attention-Based Attack on ViT ExplainabilityTechnical
  750. Manipulation Intention Understanding for Zero-Shot Composed Image RetrievalTechnical
  751. Many Minds, One Path: LLM-Augmented Consensus Decision for Distributed Control in Multi-Agent Collaborative Stable ScenariosTechnical
  752. Mapping on a Budget: Optimizing Spatial Data Collection for MLTechnical
  753. Margin-Aware Preference Optimization for Aligning Diffusion Models Without ReferenceTechnical
  754. Marginalized Generalized IoU (MGIoU): A Unified Objective Function for Optimizing Convex Parametric ShapesTechnical
  755. Market-Aware Event Timeline Summarization: Integrating Price Signals to Improve Financial News UnderstandingTechnical
  756. MartDE: A Privacy-Preserving and Cost-Efficient Evaluation Framework for Data MarketplacesTechnical
  757. Mask the Redundancy: Evolving Masking Representation Learning for Multivariate Time-Series ClusteringTechnical
  758. Mask2IV: Interaction-Centric Video Generation via Mask TrajectoriesTechnical
  759. MaskAD: Parallel Masked Autoencoder for Multi-class Unsupervised Anomaly DetectionTechnical
  760. MaskAnyNet: Rethinking Masked Image Regions as Valuable Information in Supervised LearningTechnical
  761. Masked Clustering Prediction for Unsupervised Point Cloud Pre-trainingTechnical
  762. Masked Mineral Modeling: Continent-Scale Mineral Prospecting via Geospatial InfillingTechnical
  763. Mass Concept Erasure in Diffusion Models with Concept HierarchyTechnical
  764. Massively Parallel Proof-Number Search for Impartial Games and BeyondTechnical
  765. Matching Policy Design for Gig Platforms with “Priority” FeaturesTechnical
  766. MathSE: Improving Multimodal Mathematical Reasoning via Self-Evolving Iterative Reflection and Reward-Guided Fine-TuningTechnical
  767. MathSmith: Towards Extremely Hard Mathematical Reasoning by Forging Synthetic Problems with a Reinforced PolicyTechnical
  768. Matrix Editing Meets Fair Clustering: Parameterized Algorithms and ComplexityTechnical
  769. Matrix-Free Two-to-Infinity and One-to-Two Norms EstimationTechnical
  770. Maximizing Schatten-p Norm Regularization Toward BalanceTechnical
  771. MdaIF: Robust One-Stop Multi-Degradation-Aware Image Fusion with Language-Driven SemanticsTechnical
  772. Measuring Model Performance in the Presence of an InterventionTechnical
  773. Measuring What Matters: Scenario-Driven Evaluation for Trajectory Predictors in Autonomous DrivingTechnical
  774. Measuring the Unmeasurable: Unveiling Latent Cognitive Capabilities of LLMTechnical
  775. MechaFormer: Sequence Learning for Kinematic Mechanism Design AutomationTechnical
  776. Mechanistic Dissection of Cross-Attention Subspaces in Text-to-Image Diffusion ModelsTechnical
  777. MedAtlas: Evaluating LLMs for Multi-Round, Multi-Task Medical Reasoning Across Diverse Imaging Modalities and Clinical TextTechnical
  778. MedEyes: Learning Dynamic Visual Focus for Medical Progressive DiagnosisTechnical
  779. MedGR2: Breaking the Data Barrier for Medical Reasoning via Generative Reward LearningTechnical
  780. MedLA: A Logic-Driven Multi-Agent Framework for Complex Medical Reasoning with Large Language ModelsTechnical
  781. MedMKEB: A Comprehensive Knowledge Editing Benchmark for Medical Multimodal Large Language ModelsTechnical
  782. MedOmni-45°: A Safety–Performance Benchmark for Reasoning-Oriented LLMs in MedicineTechnical
  783. MedReasoner: Reinforcement Learning Drives Reasoning Grounding from Clinical Thought to Pixel-Level PrecisionTechnical
  784. MedSAMix: A Training-Free Model Merging Approach for Medical Image SegmentationTechnical
  785. MedSpaformer: A Transferable Transformer with Multi-Granularity Token Sparsification for Medical Time Series ClassificationTechnical
  786. MedS³: Towards Medical Slow Thinking with Self-Evolved Soft Dual-sided Process SupervisionTechnical
  787. Medical Image Segmentation with Minimal Labeling Effort: How Far Can We Push the Limits?Technical
  788. Medical Vision–Language Pretraining with LLM-Guided Temporal SupervisionTechnical
  789. Medverse: A Universal Model for Full-Resolution 3D Medical Image Segmentation, Transformation and EnhancementTechnical
  790. MegaCoin: Enhancing Medium-Grained Color Perception for Vision-Language ModelsTechnical
  791. Melodia: Training-Free Music Editing Guided by Attention Probing in Diffusion ModelsTechnical
  792. Mem-PAL: Towards Memory-based Personalized Dialogue Assistants for Long-term User-Agent InteractionTechnical
  793. Mem4D: Decoupling Static and Dynamic Memory for Dynamic Scene ReconstructionTechnical
  794. MemGuide: Intent-Driven Memory Selection for Goal-Oriented Multi-Session LLM AgentsTechnical
  795. Membership Inference Attack Against Large Language Model-Based Recommendation Systems: A New Distillation-Based ParadigmTechnical
  796. MemeBQ:Memory Efficient Binary Quantization of LLMsTechnical
  797. MemoVision: A Digital Catalog for Everyday InteractionsTechnical
  798. Memorization and Expressivity in Transformers: A Learning-Theoretic PerspectiveTechnical
  799. Memorize Early, Then Query: Inlier-Memorization-Guided Active Outlier DetectionTechnical
  800. Memory Based Advantage Shaping for LLM-Guided Reinforcement Learning (Student Abstract)Technical
  801. MemoryART: Enhancing LLMs via Multi-Memory Models with Adaptive Resonance Theory for Healthcare AgentsTechnical
  802. Mental Model-based Generation of Lies for Insider Threat ModelingTechnical
  803. MentalGuide: Towards Multi-Turn, State-Aware and Strategy-Driven Conversations for Mental Health SupportTechnical
  804. MergeDNA: Context-Aware Genome Modeling with Dynamic Tokenization Through Token MergingTechnical
  805. MeshA*: Efficient Path Planning with Motion PrimitivesTechnical
  806. MeshSplat: Generalizable Sparse-View Surface Reconstruction via Gaussian SplattingTechnical
  807. Meta Dynamic Graph for Traffic Flow PredictionTechnical
  808. Meta-Black-Box Optimization with Bi-Space Landscape Analysis and Dual-Control Mechanism for SAEATechnical
  809. Meta-GAIN for Missing Data ImputationTechnical
  810. Meta-Guided Sample Reweighting for Robust Cross-Modal Hashing Retrieval with Noisy LabelsTechnical
  811. Meta-Normalizing Flow for Data-Limited Offline Meta-Reinforcement Learning (Student Abstract)Technical
  812. MetaAct-RL: Training Language Models for Reasoning Through Meta-Action-Based Reinforcement LearningTechnical
  813. MetaCipher: A Time-Persistent and Universal Multi-Agent Framework for Cipher-Based Jailbreak Attacks for LLMsTechnical
  814. MetaDiT: Enabling Fine-grained Constraints in High-degree-of Freedom Metasurface DesignTechnical
  815. MetaEval: Measuring the Discrimination of Benchmarks for Efficient LLM EvaluationTechnical
  816. MetaGDPO: Alleviating Catastrophic Forgetting with Metacognitive Knowledge Through Group Direct Preference OptimizationTechnical
  817. MetaGPT: A Large Vision-Language Model for Meme Metaphor UnderstandingTechnical
  818. MetaGameBO: Hierarchical Game-Theoretic Driven Robust Meta-Learning for Bayesian OptimizationTechnical
  819. MetaTrader: Learning to Generalize RL Trading Policies Beyond Offline DataTechnical
  820. Methods for Optimization Problems with Markovian Stochasticity and Non-Euclidean GeometryTechnical
  821. Metric Distortion with Preference IntensitiesTechnical
  822. MicLog: Towards Accurate and Efficient LLM-based Log Parsing via Progressive Meta In-Context LearningTechnical
  823. MicroEvoEval: A Systematic Evaluation Framework for Image-Based Microstructure Evolution PredictionTechnical
  824. Mimic-X: A Large-Scale Motion Dataset via Fast Physics-Based Controller AdaptationTechnical
  825. Mind the Gap: Predicting, Explaining and Reducing Time-to-First-Comment (Reply Gap) in Online Mental-Health CommunitiesTechnical
  826. Mind the Gap: Quantifying and Aligning Human-AI Visual Attention for Accident AnticipationTechnical
  827. Mind the Gap: The Divergence Between Human and LLM-Generated TasksTechnical
  828. Mind the Third Eye! Benchmarking Privacy Awareness in MLLM-powered Smartphone AgentsTechnical
  829. MindCross: Fast New Subject Adaptation with Limited Data for Cross-subject Video Reconstruction from Brain SignalsTechnical
  830. MindSight: A Bio-Inspired Neural Architecture for Visual Restoration via Cortical Electrical StimulationTechnical
  831. MindVote: When AI Meets the Wild West of Social Media OpinionTechnical
  832. Minimizing Inequity in Facility Location GamesTechnical
  833. Minimum-Cost Network Flow with Dual PredictionsTechnical
  834. Minimum-Length Conformal Prediction Sets for Ordinal ClassificationTechnical
  835. Minute-Long Videos with Dual ParallelismsTechnical
  836. MirrorShield: Towards Dynamic Adaptive Defense Against Jailbreaks via Entropy-Guided Mirror CraftingTechnical
  837. Misalignment from Treating Means as EndsTechnical
  838. Misclassification-Aware Robust Learning from Multiple Human Labelers (Student Abstract)Technical
  839. Mitigating Content Effects on Reasoning in Language Models Through Fine-Grained Activation SteeringTechnical
  840. Mitigating Endogenous Confirmation Bias in Noisy Label Learning for Vision-Language ModelsTechnical
  841. Mitigating Entity Hallucinations in 3D Radiology Report Generation via Dual-Stream AlignmentTechnical
  842. Mitigating Error Accumulation in Co-Speech Motion Generation via Global Rotation Diffusion and Multi-Level ConstraintsTechnical
  843. Mitigating Error Accumulation in Knowledge Editing for Multi-Hop Question AnsweringTechnical
  844. Mitigating Hallucinations in Large Language Models via Causal ReasoningTechnical
  845. Mitigating Length Bias in RLHF Through a Causal LensTechnical
  846. Mitigating Low-Quality Reasoning in MLLMs: Self-Driven Refined Multimodal CoT with Selective Thinking and Step-wise Visual EnhancementTechnical
  847. Mitigating Negative Flips via Margin Preserving TrainingTechnical
  848. Mitigating Noise and Imbalance in Social Governance Graphs for Multi-Type Risk AssessmentTechnical
  849. Mitigating Perception Bias: A Training-Free Approach to Enhance LMM for Image Quality AssessmentTechnical
  850. Mitigating Self-Preference by Authorship ObfuscationTechnical
  851. Mix-QSAM2: Mixed-Precision Quantization for High Fidelity Segmentation in Resource Constrained ScenariosTechnical
  852. Mixture of Ranks with Degradation-Aware Routing for One-Step Real-World Image Super-ResolutionTechnical
  853. Mixture-of-Trees: Learning to Select and Weigh Reasoning Paths for Efficient LLM InferenceTechnical
  854. Mnemosyne: Accelerating Multi-Hop Question Answering via Cache Hit Order FittingTechnical
  855. MoBGS: Motion Deblurring Dynamic 3D Gaussian Splatting for Blurry Monocular VideoTechnical
  856. MoCHA: Advanced Vision-Language Reasoning with MoE Connector and Hierarchical Group AttentionTechnical
  857. MoCast: Learning Turbulent Motions Under Physical Guidance for Precipitation NowcastingTechnical
  858. MoE-Guided Graph Diffusion for Oriented Molecule DesignTechnical
  859. MoEA-Net: Modality-Incremental Expert Aggregation Network for Retinal Prognostic PredictionTechnical
  860. MoEG-HOI: Mixture of Expert Groups for One-Stage Hand-Object Interaction Motion Generation with Hand-Finger-Joint Semantic GuidanceTechnical
  861. MoEGaze: A Mixture of Experts Approach for Generalizable Gaze EstimationTechnical
  862. MoETTA: Test-Time Adaptation Under Mixed Distribution Shifts with MoE-LayerNormTechnical
  863. MoE^2: A Mixture-of-Mixtures of Experts for Ensemble-Free Domain GeneralizationTechnical
  864. MoFu: Scale-Aware Modulation and Fourier Fusion for Multi-Subject Video GenerationTechnical
  865. MoHoBench: Assessing Honesty of Multimodal Large Language Models via Unanswerable Visual QuestionsTechnical
  866. MoLe-VLA: Dynamic Layer-skipping Vision Language Action Model via Mixture-of-Layers for Efficient Robot ManipulationTechnical
  867. MoLoRA: Boosting LLM-based End-to-end Speech Translation with Mixture of Low-rank ExpertsTechnical
  868. MoMoREC: A Multi-agent Motivation Generation Framework for Residual Semantic ID-Aware RecommendationTechnical
  869. MoReMouse: Monocular Reconstruction of Laboratory MouseTechnical
  870. MoSE: Hierarchical Self-Distillation Enhances Early Layer EmbeddingsTechnical
  871. MoSs: Mixture of Scales for Efficient High-Resolution Autoregressive Image GenerationTechnical
  872. MoToRec: Sparse-Regularized Multimodal Tokenization for Cold-Start RecommenderTechnical
  873. Mobile-Agent-RAG: Driving Smart Multi-Agent Coordination with Contextual Knowledge Empowerment for Long-Horizon Mobile AutomationTechnical
  874. MobileSafetyBench: Evaluating Safety of Autonomous Agents in Mobile Device ControlTechnical
  875. ModalSyncSum: Synchronizing Image and Text for Reliable Summary GenerationTechnical
  876. Modality and Task Adaptation for Enhanced Zero-shot Composed Image RetrievalTechnical
  877. Modality-Aware Bias Mitigation and Invariance Learning for Unsupervised Visible-Infrared Person Re-IdentificationTechnical
  878. Modality-Balanced Collaborative Distillation for Multi-Modal Domain GeneralizationTechnical
  879. Model AI Assignments 2026Technical
  880. Model Change for Description Logic ConceptsTechnical
  881. Model Counting for Dependency Quantified Boolean FormulasTechnical
  882. Model Editing as a Double-Edged Sword: Steering Agent Behavior Toward Beneficence or HarmTechnical
  883. Model Whisper: Steering Vectors Unlock Large Language Models’ Potential in Test-TimeTechnical
  884. Model-Agnostic Sentiment Distribution Stability Analysis for Robust LLM-Generated Texts DetectionTechnical
  885. Modeling Item-Level Dynamic Variability with Residual Diffusion for Bundle RecommendationTechnical
  886. Modeling Rapid Contextual Learning in the Visual Cortex with Fast-Weight Deep Autoencoder NetworksTechnical
  887. Modeling Retinal Ganglion Cells with Neural Differential Equations (Student Abstract)Technical
  888. Modeling Trend Dynamics with Variational Neural ODEs for Information Popularity PredictionTechnical
  889. Modeling Uncertainty Trends for Timely Retrieval in Dynamic RAGTechnical
  890. Modelling the Effects of Hearing Loss on Neural Coding in the Auditory Midbrain with Variational ConditioningTechnical
  891. Modulation-Based Backdoors: Leveraging Amplitude and Frequency Patterns to Attack Speaker RecognitionTechnical
  892. MolSight: Optical Chemical Structure Recognition with SMILES Pretraining, Multi-Granularity Learning and Reinforcement LearningTechnical
  893. Mono3DVG-EnSD: Enhanced Spatial-aware and Dimension-decoupled Text Encoding for Monocular 3D Visual GroundingTechnical
  894. MonoCLUE: Object-Aware Clustering Enhances Monocular 3D Object DetectionTechnical
  895. MonoCloth: Reconstruction and Animation of Cloth-Decoupled Human Avatars from Monocular VideosTechnical
  896. MonoDream: Monocular Vision-Language Navigation with Panoramic DreamingTechnical
  897. Monocular Mesh Recovery and Body Measurement of Female Saanen GoatsTechnical
  898. Monocular Vehicle Pose and Shape Reconstruction via Dynamic Context Adaptation and Progressive Geometry RefinementTechnical
  899. Monte Carlo Diffusion for Generalizable Learning-Based RANSACTechnical
  900. Moral Change or Noise? On Problems of Aligning AI with Temporally Unstable Human FeedbackTechnical
  901. MoralReason: Generalizable Moral Decision Alignment for LLM Agents Using Reasoning-Level Reinforcement LearningTechnical
  902. More than Irrational: Modeling Belief-Biased AgentsTechnical
  903. Mosaic Pruning: A Hierarchical Framework for Generalizable Pruning of Mixture-of-Experts ModelsTechnical
  904. MosaicDoc: A Large-Scale Bilingual Benchmark for Visually Rich Document UnderstandingTechnical
  905. Motion Planning Diffusion: Learning and Adapting Robot Motion Planning with Diffusion Models (Abstract Reprint)Technical
  906. Motion-Aware Object Tracking via Motion and Geometry-Aware CuesTechnical
  907. MotionCharacter: Fine-Grained Motion Controllable Human Video GenerationTechnical
  908. MotionFlow: Attention-Driven Motion Transfer in Video Diffusion ModelsTechnical
  909. MotionPhysics: Learnable Motion Distillation for Text-Guided SimulationTechnical
  910. MotivDance: Fine-Grained Text-Guided Motivation Choreography with Music SynchronizationTechnical
  911. MovSemCL: Movement-Semantics Contrastive Learning for Trajectory SimilarityTechnical
  912. MovieGraph-ToM: Evaluating Long-Range Theory of Mind in Large Language Models via Implicit Social-Causal GraphsTechnical
  913. MrCoM: A Meta-Regularized World-Model Generalizing Across Multi-ScenariosTechnical
  914. MrM: Black-Box Membership Inference Attacks Against Multimodal RAG SystemsTechnical
  915. MuSASplat: Efficient Sparse-View 3D Gaussian Splats via Lightweight Multi-Scale AdaptationTechnical
  916. MulTiCast: A Multimodal Time Series Forecasting SystemTechnical
  917. Multi-Agent Corridor Reasoning for Multi-Agent Path FindingTechnical
  918. Multi-Agent Path Finding with Unassigned Agents (MAPFUA)Technical
  919. Multi-Agent Pointer Transformer: Seq-to-Seq Reinforcement Learning for Multi-Vehicle Dynamic Pickup-Delivery ProblemsTechnical
  920. Multi-Agent Reinforcement Learning for Modeling, Simulating, and Optimizing Energy MarketsTechnical
  921. Multi-Agent Undercover Gaming: Hallucination Removal Through Counterfactual Test for Multimodal ReasoningTechnical
  922. Multi-Agent VLMs Guided Self-Training with PNU Loss for Low-Resource Offensive Content DetectionTechnical
  923. Multi-Armed Bandits Meet Large Language ModelsTechnical
  924. Multi-Aspect Cross-modal Quantization for Generative RecommendationTechnical
  925. Multi-District School Choice: Playing on Several FieldsTechnical
  926. Multi-Faceted Attack: Exposing Cross-Model Vulnerabilities in Defense-Equipped Vision-Language ModelsTechnical
  927. Multi-Granular Graph Learning with Fine-Grained Behavioral Pattern Awareness for Session-Based RecommendationTechnical
  928. Multi-Horizon Time Series Forecasting of Non-Parametric CDFs with Deep Lattice NetworksTechnical
  929. Multi-Label Classification with Incremental and Decremental FeaturesTechnical
  930. Multi-Level Blur-Aware Stable Diffusion for Region-Adaptive Defocus DeblurringTechnical
  931. Multi-Level Domain Adaptation and Contrastive Domain Isolation with Bilinear Fusion for Patient Drug Response PredictionTechnical
  932. Multi-Metric Preference Alignment for Generative Speech RestorationTechnical
  933. Multi-Modal Assistance for Unsupervised Domain Adaptation on Point Cloud 3D Object DetectionTechnical
  934. Multi-Modal Fact Knowledge Generation for Imbalanced Cross-Source Entity AlignmentTechnical
  935. Multi-Modal Interactive Control of Robotic Arm Based on Offline Large Language Models (Student Abstract)Technical
  936. Multi-Modal Style Transfer-based Prompt Tuning for Efficient Federated Domain GeneralizationTechnical
  937. Multi-Objective Bilevel LearningTechnical
  938. Multi-Objective Search: Algorithms, Applications, and Emerging DirectionsTechnical
  939. Multi-Robot Learning from Human FeedbackTechnical
  940. Multi-Semantic Modeling for Glass Surface Detection in the WildTechnical
  941. Multi-Stage Reinforcement Learning for Robust Charging of Quantum Batteries (Student Abstract)Technical
  942. Multi-Step Deformable Gaussian Splatting for Dynamic Scene RenderingTechnical
  943. Multi-Task Test-time Adaptation via Gradient Consensus and Plasticity ConstraintTechnical
  944. Multi-Value Alignment for LLMs via Value Decorrelation and ExtrapolationTechnical
  945. Multi-View Clustering with Granularity-Aware Pseudo SupervisionTechnical
  946. Multi-View Differential Mixing and Graph-Guided Structural Region Selection for Cross-Modal AlignmentTechnical
  947. Multi-Window Gabor Transform Network for Ground Penetrating Radar B-Scan Image ReconstructionTechnical
  948. Multi-agent In-context Coordination via Decentralized Memory RetrievalTechnical
  949. Multi-dimensional Adaptive Mix-hop Contextual Learning Framework for Universal Graph Anomaly DetectionTechnical
  950. Multi-dimensional Neural Decoding with Orthogonal Representations for Brain-Computer InterfacesTechnical
  951. Multi-granularity Intent Modeling with Adversarial Robustness for Sequential RecommendationTechnical
  952. Multi-granularity Interactive Attention Framework for Residual Hierarchical Pronunciation AssessmentTechnical
  953. Multi-granularity Temporal Knowledge Editing over Large Language ModelsTechnical
  954. Multi-graph Fusion Cross-model Contrastive Learning for RecommendationTechnical
  955. Multi-knowledge Enhanced Graph Neural Network for Multi-trait Essay ScoringTechnical
  956. Multi-level Style Preference Optimization: An Adaptive Detection Framework for Human-Machine Hybrid TextTechnical
  957. Multi-modal Dynamic Proxy Learning for Personalized Multiple ClusteringTechnical
  958. Multi-view Invariance Learning for 3D Scene Graph Pre-training via Collaborative Cross-Modal RegularizationTechnical
  959. Multi-view Learning via Trusted Pairwise Entity EnergyTechnical
  960. MultiKD: Backdoor Defense in Federated Graph Learning via Attention-Guided Multi-Teacher DistillationTechnical
  961. MultiMedBench: A Scenario-Aware Benchmark for Evaluating Knowledge Editing in Medical VQATechnical
  962. MultiMotion: Multi Subject Video Motion Transfer via Video Diffusion TransformerTechnical
  963. MultiTab: A Scalable Foundation for Multitask Learning on Tabular DataTechnical
  964. Multifaceted Scenario-Aware Hypergraph Learning for Next POI RecommendationTechnical
  965. Multigranular Evaluation for Brain Visual DecodingTechnical
  966. Multimodal Coarse-to-Local Transformer for End-to-End Autonomous Driving (Student Abstract)Technical
  967. Multimodal DeepResearcher: Generating Text-Chart Interleaved Reports from Scratch with Agentic FrameworkTechnical
  968. Multimodal Digital Phenotyping for Early Prediction of Manic Episodes Through Keystroke Dynamics and Circadian Pattern AnalysisTechnical
  969. Multimodal Gaussian Mixture Variational Autoencoder with Consistency RegularizationsTechnical
  970. Multimodal Graph Representation Learning with Dynamic Information PathwaysTechnical
  971. Multimodal Mixture-of-Experts with Retrieval Augmentation for Protein Active Site IdentificationTechnical
  972. Multimodal Robust Prompt Distillation for 3D Point Cloud ModelsTechnical
  973. Multimodal Super-Resolution: Discovering Hidden Physics and Its Application to Fusion Plasmas (Abstract Reprint)Technical
  974. Multimodal Table Understanding with Difficulty-aware Reinforcement LearningTechnical
  975. Multimodal Tabular Data LearningTechnical
  976. Multiple Human Motion UnderstandingTechnical
  977. Multiple-Interval Coverage for Resource Management of Passive Surveillance SystemsTechnical
  978. Multiple-play Stochastic Bandits with Prioritized Arm Capacity SharingTechnical
  979. Multiplex Heterogeneous Graph Neural Networks with Euclidean-Riemannian Mutual Space SynergyTechnical
  980. Multiplicative Orthogonal Sequential Editing for Language ModelsTechnical
  981. Multitasks-based Deep Evidential Fusion Network for Blind Image Quality AssessmentTechnical
  982. Multivariate Diffusion Transformer with Decoupled Attention for High-Fidelity Mask-Text Collaborative Facial GenerationTechnical
  983. Multivariate Functional Linear Discriminant Analysis for Partially-Observed Time Series (Abstract Reprint)Technical
  984. Multivariate Gaussian Representation Learning for Medical Action EvaluationTechnical
  985. MusicRec: Multi-modal Semantic-Enhanced Identifier with Collaborative Signals for Generative RecommendationTechnical
  986. MvP-ECR: Multi-Perspective Emotion-Cause Reasoning for Empathetic DialogueTechnical
  987. MyGram: Modality-aware Graph Transformer with Global Distribution for Multi-modal Entity AlignmentTechnical
  988. M²VAE: Multi-Modal Multi-View Variational Autoencoder for Cold-start Item RecommendationTechnical
  989. NADIR: Differential Attention Flow for Non-Autoregressive Transliteration in Indic LanguagesTechnical
  990. NGTM: Substructure-based Neural Graph Topic Model for Interpretable Graph GenerationTechnical
  991. NICE: Neural Implicit Craniofacial Model for Orthognathic Surgery PredictionTechnical
  992. NL2CA: Auto-formalizing Cognitive Decision-Making from Natural Language Using an Unsupervised CriticNL2LTL FrameworkTechnical
  993. NODiff: Neural Operator Diffusion for Multispectral Image FusionTechnical
  994. NOTAM-Evolve: A Knowledge-Guided Self-Evolving Optimization Framework with LLMs for NOTAM InterpretationTechnical
  995. NOVAID: Natural-language Observability Visualization Assistant for ITOps Dashboard Widget GenerationTechnical
  996. NP-MiSR: Neural Process-based Multi-Interest Learning for Session-Based RecommendationTechnical
  997. NTSFormer: A Self-Teaching Graph Transformer for Multimodal Isolated Cold-Start Node ClassificationTechnical
  998. NURBGen: High-Fidelity Text-to-CAD Generation Through LLM-Driven NURBS ModelingTechnical
  999. NaVLA$^2$: A Vision-Language-Audio-Action Model for Multimodal Instruction NavigationTechnical
  1000. Nanoporous Materials Discovery via Search Bias-Guided Surrogate ModelingTechnical

Looking for submission deadlines instead? See the conference deadline calendar.