ICML 2026 Accepted Papers
The full list of 6,634 papers accepted at ICML 2026 (International Conference on Machine Learning). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 6,060Spotlight: 406Oral: 168
- Towards Diverse Scientific Hypothesis Search with Large Language ModelsPoster
- Towards Docking-oriented De Novo Ligand Design via Gradient InversionPoster
- Towards Effective Waste Segmentation for Automated Waste Recycling in Cluttered BackgroundPoster
- Towards Efficient LLMs Annealing with Principled Sample SelectionSpotlight
- Towards Efficient Large Language Reasoning Models via Extreme-Ratio Chain-of-Thought CompressionPoster
- Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-LearningPoster
- Towards Execution-Grounded Automated AI ResearchPoster
- Towards Fair Sequential Decision-Making: A Causal Decomposition ApproachOral
- Towards Feedback-to-Plan Decisions for Self-Evolving LLM Agents in CUDA Kernel GenerationPoster
- Towards Fine-grained Robustness: Attention-guided Test-time Prompt Tuning for Vision-Language ModelsPoster
- Towards Foundation Models for Zero-Shot Time Series Anomaly Detection: Leveraging Synthetic Data and Relative Context DiscrepancyPoster
- Towards Fully Parameter-Free Stochastic Optimization: Grid Search with Self-Bounding AnalysisPoster
- Towards Functional Correctness of Large Code Models with Selective GenerationPoster
- Towards Generalizable EEG-to-fMRI Synthesis via a Unified, Context-Aware Prompting FrameworkPoster
- Towards Generative Graph Matching for Graph Edit Distance ComputationPoster
- Towards Hierarchy–Uniformity Equilibrium: Recovering Semantic Depth in Hypergraph Contrastive LearningOral
- Towards High-Fidelity CAD Generation via LLM-Driven Program Generation and Text-Based B-Rep Primitive GroundingSpotlight
- Towards Long-Horizon Interpretability: Efficient and Faithful Multi-Token Attribution for Reasoning LLMsOral
- Towards Multimodal Large Language Models with Both Training and Inference EfficiencyPoster
- Towards On-Policy SFT: Distribution Discriminant Theory and its Applications in LLM TrainingPoster
- Towards One-for-All Anomaly Detection for Tabular DataPoster
- Towards One-to-Many Temporal GroundingPoster
- Towards Optimal Robustness in Learning-Augmented PagingSpotlight
- Towards Parameter-Free Temporal Difference LearningPoster
- Towards Pareto-Optimal Tool-Integrated Agents with Pareto Ranking Policy OptimizationSpotlight
- Towards Practical World Model-based Reinforcement Learning for Vision-Language-Action ModelsPoster
- Towards Professional-Grade Financial Agents: Benchmarking, Tooling, and Structured ReasoningPoster
- Towards Realistic Lifelong Re-identification: Identity Recurrence with Changing ClothesPoster
- Towards Reliable Marking and Verification of AI-Generated Text via Geometry-aware Sentence-level WatermarkingPoster
- Towards Resource-Efficient LLMs: End-to-End Energy Accounting of Distillation PipelinesPoster
- Towards Robust Human-AI Complementarity under UncertaintyPoster
- Towards Rule-Based Knowledge Sharing in Federated LearningPoster
- Towards Scalable and Consistent 3D EditingPoster
- Towards Seed-Robust Safety Alignment in Text-to-Image ModelsPoster
- Towards Solving the Gilbert-Pollak Conjecture via Large Language ModelsPoster
- Towards Spectroscopy: Susceptibility Clusters in Language ModelsPoster
- Towards Steering without Sacrifice: Principled Training of Steering Vectors for Prompt-only InterventionsPoster
- Towards Sub-second Biological Foundation Model Infrastructure: A Quantized Consistency Diffusion Framework for Molecular DockingOral
- Towards Theoretical Understanding of Transformer Test-Time Computing: Investigation on In-Context Linear RegressionPoster
- Towards Trustworthy Video Anomaly Understanding: A Class-Guided Chain-of-Evaluation Metric and An Anomaly-focused Meta-BenchmarkPoster
- Towards Trustworthy and Identifiable Virtual Face GenerationPoster
- Towards Understanding Adam Convergence on Highly Degenerate PolynomialsSpotlight
- Towards Understanding Continual Factual Knowledge Acquisition of Language Models: From Theory to AlgorithmPoster
- Towards Understanding Generalization of Federated Adversarial Learning: Perspective of Algorithmic StabilityPoster
- Towards Understanding Massive Activations in Attention Sink MechanismPoster
- Towards Understanding Modality Interaction in Multimodal Language Models via Partial Information DecompositionPoster
- Towards Understanding Steering StrengthPoster
- Towards Understanding the Dynamics of Low-Rank AdaptationPoster
- Towards Unified Multimodal PretrainingSpotlight
- Towards Uniformity and Alignment for Multimodal Representation LearningPoster
- Towards Universal Gene Regulatory Network Inference: Unlocking Generalizable Regulatory Knowledge in Single-cell Foundation ModelsPoster
- Towards Whole-corpus Reconstruction of Heterogeneous RAG Knowledge BasesPoster
- Towards a Holistic Understanding of Selection Bias for Causal Effect IdentificationPoster
- Towards a Science of AI Agent ReliabilityPoster
- Towards a Unified Generative Model for Scarce Time Series with Domain ExpertsPoster
- Towards the Explainability of Temporal Graph Networks via Memory Backtracking and Topological AttributionSpotlight
- Towards the Training of Deeper Predictive Coding Neural NetworksPoster
- TraCeS: Learning Per-Timestep Constraint-Violation Credit from Sparse Trajectory-Level LabelsPoster
- TraceRouter: Robust Safety for Large Foundation Models via Path-Level InterventionPoster
- Tracing the Dynamics of Refusal: Exploiting Latent Refusal Trajectories for Robust Jailbreak DetectionPoster
- Tracing the Emergence of Symbol Grounding in Multimodal Language ModelsPoster
- Tracing the Persona Circuit: How Large Language Models Encode and Express Character TraitsPoster
- Tracking Drift: Variation-Aware Entropy Scheduling for Non-Stationary Reinforcement LearningPoster
- Tractable Expected Information Gains for Exponential Family PosteriorsPoster
- Trading Complexity for Expressivity Through Structured Generalized Linear Token MixingPoster
- Train Once, Reuse Everywhere: Generalizable Implicit ICL by Routing AttentionPoster
- Train for Truth, Keep the Skills: Binary Retrieval-Augmented Reward Mitigates HallucinationsSpotlight
- Trainable Nonexpansive Denoisers for Contractive Image ReconstructionPoster
- Training AI Co-Scientists Using Rubric RewardsPoster
- Training Data Efficiency in Multimodal Process Reward ModelsPoster
- Training Deep Spiking Neural Networks without NormalizationPoster
- Training Diffusion Language Models for Black-Box OptimizationSpotlight
- Training LLM Agents to Empower HumansPoster
- Training Language Model Agents to Find Vulnerabilities with CTF-DojoPoster
- Training Prompt Matters: State-Adaptive Optimization for Robust Fine-TuningPoster
- Training with Honeypots: Reshaping How LLMs FailPoster
- Training-Free Adaptation of Diffusion Models via Doob's $h$-TransformPoster
- Training-Free Adversarial Robustness in Deep Learning MRI ReconstructionPoster
- Training-Free Bayesian Filtering with Generative EmulatorsOral
- Training-Free Coverless Multi-Image Steganography with Access ControlPoster
- Training-Free Distribution Adaptation for Diffusion Models via Maximum Mean Discrepancy GuidancePoster
- Training-Free Guided Diffusion for Planning: A Unified Framework via Doob’s h-Transform with Safety GuaranteesPoster
- Training-Free Hashing-Based Attention via Binary Principal ComponentsPoster
- Training-Free Hierarchical Working Memory for Small Language Model AgentsPoster
- Training-Free Multimodal Large Language Model OrchestrationPoster
- Training-Free Rate-Distortion-Perception Traversal With DiffusionPoster
- Training-Free Sparse Attention for Fast Video Generation via Offline Layer-Wise Sparsity Profiling and Online Bidirectional Co-ClusteringPoster
- Training-Trajectory-Aware Token SelectionPoster
- Training-free Composition of Pre-trained GFlowNets for Multi-Objective GenerationPoster
- Training–Inference Consistent Segmented Execution for Long-Context LLMsPoster
- Trajectory Consistency for One-Step Generation on Euler Mean FlowsPoster
- Trajectory Seriation via Spectral Tangent Alignment and Global EmbeddingPoster
- Trajectory Stitching for Solving Inverse Problems with Flow-Based ModelsPoster
- Trajectory-Aware Certified Decentralized Unlearning via SGD StabilityPoster
- Trajectory-Aware Heuristic Learning for Combinatorial SearchPoster
- Trajectory-Aware Spiking DiTs Conversion via Membrane Potential Error-FeedbackPoster
- Trajectory-Level Data Augmentation for Offline Reinforcement LearningPoster
- Trajectory-Level Speculative Decoding for Diffusion Language ModelsPoster
- Trajectory-Stabilized Inference for Diffusion-Based Video InpaintingPoster
- TranX-Adapter: Bridging Artifacts and Semantics within MLLMs for Robust AI-generated Image DetectionPoster
- TransLight: Image-Guided Customized Lighting Control with Generative DecouplingPoster
- TransNormal: Dense Visual Semantics for Diffusion-based Transparent Object Normal EstimationPoster
- Transfer Learning in High-dimensional Ising ModelsPoster
- Transfer Learning in Nonparametric Regression with Deep ReLU NetworksPoster
- Transferable Reinforcement Learning via Probabilistic Latent Embeddings and Dynamic Policy Adaptation for Sim-to-Real DeploymentPoster
- Transform Trained Transformer for Accelerating Native 4K Video GenerationPoster
- Transformed Latent Variable Multi-Output Gaussian ProcessesPoster
- Transformer Circuits Can Realize Clustering AlgorithmsSpotlight
- Transformers Can Learn Posterior Predictive Distributions In-ContextPoster
- Transformers Efficiently Perform In-Context Logistic Regression via Normalized Gradient DescentPoster
- Transformers Learn the Optimal DDPM Denoiser for Multi-Token GMMsPoster
- Transformers Provably Learn Algorithmic Solutions for Graph Connectivity, But Only with the Right DataPoster
- Transformers learn factored representationsPoster
- Transformers with RL or SFT Provably Learn Sparse Boolean Functions, But DifferentlyPoster
- Transforming Weather Data from Pixel to Latent SpaceOral
- Transitive Representation Learning Enhances Histopathology AnnotationPoster
- Transitivity Meets Cyclicity: Explicit Preference Decomposition for Dynamic Large Language Model AlignmentPoster
- Transolver-3: Scaling Up Transformer Solvers to Industrial-Scale GeometriesPoster
- Transport Clustering: Solving Low-Rank Optimal Transport via ClusteringPoster
- Transport and Merge: Cross-Architecture Merging for Large Language ModelsPoster
- Transport or Discard: Robust Unbalanced Optimal Transport for Cross-Domain Policy AdaptationPoster
- Transporting Task Vectors across Different Architectures without TrainingPoster
- Treatment Responder Classification with AbstentionSpotlight
- Tree-Structured Orthonormal Decomposition of the Aitchison SimplexPoster
- TreeCUA: Efficiently Scaling GUI Automation with Tree-Structured Verifiable EvolutionPoster
- TreePO: Enhancing Policy Efficacy and Inference Efficiency with Tree ModelingPoster
- Trees to Flows and Back: Unifying Decision Trees and Diffusion ModelsPoster
- Tri-Scale Neural ODEs for Continuous Multi-Omics Disease ModelingPoster
- TriAttention: Efficient Long Reasoning with Trigonometric KV CompressionPoster
- TriForces: Augmenting Atomistic GNNs for Transferable RepresentationsPoster
- Triadic Dynamics Aware Diffusion Posterior Sampling for Inverse Problems: Optimizing Guidance and Stochasticity SchedulesPoster
- Trifuse: Enhancing Attention-Based GUI Grounding via Multimodal FusionPoster
- TritonGym: A Benchmark for Agentic LLM Workflows in Triton GPU Code GenerationPoster
- Trojan-Speak: Bypassing Constitutional Classifiers with No Jailbreak Tax via Adversarial FinetuningSpotlight
- Trust Functions: Near Lossless Weak-to-Strong Generalization by Learning to Trust the Weak TeacherPoster
- Trust Region Inverse Reinforcement LearningPoster
- Trust Region Masking for Long-Horizon LLM Reinforcement LearningPoster
- Trust-Region Diffusion Policies for Massively Parallel On-Policy RLPoster
- Trust3R: Unifying Feed-Forward Pointmap Prediction and Evidential Learning for Trust-Aware 3D ReconstructionPoster
- Trustworthy Federated Label Distribution Learning under Annotation Quality DisparityPoster
- TrustworthyQENN: A Quantum Evidential Neural Network Based on Complex-Valued Contrastive Learning for Uncertainty Pattern ClassificationPoster
- TruthRL: Incentivizing Truthful LLMs via Reinforcement LearningPoster
- Truthfulness Does Not Scale Like Reasoning: Why Polling Fails as a Proxy VerifierPoster
- TsLLM: Augmenting LLMs for General Time Series Understanding and PredictionPoster
- Tucker Attention: A generalization of approximate attention mechanismsPoster
- TuneAhead: Predicting Fine-tuning Performance Before Training BeginsPoster
- Tuning the Implicit Regularizer of Masked Diffusion Language Models: Enhancing Generalization via Insights from $k$-ParityPoster
- Tuning-Free One-Class Discriminant Learning for Tabular Anomaly DetectionPoster
- Turbo Connection: Reasoning as Information Flow from Higher to Lower LayersPoster
- Turbo4DGen: Ultra-Fast Acceleration for 4D GenerationPoster
- TurboGS: Accelerating 3D Gaussian Splatting via Error-Guided Sparse Pixel Sampling and OptimizationPoster
- Turning Adaptation into Assets: Cross-Domain Bridging for Online Vision-Language NavigationPoster
- Turning Back Without Forgetting: Selective Backward Refinement for Parameter-Efficient Continual LearningPoster
- Turning Bias into Bugs: Bandit-Guided Style Manipulation Attacks on LLM JudgesPoster
- Turning Drift into Constraint: Robust Reasoning Alignment in Non-Stationary Multi-Stream EnvironmentsPoster
- Turning Stale Gradients into Stable Gradients: Coherent Coordinate Descent with Implicit Landscape Smoothing for Lightweight Zeroth-Order OptimizationPoster
- Tvcache: A Tool-Value Cache for Post-Training LLM AgentsPoster
- Twice Sequential Monte Carlo for Tree SearchPoster
- TwinQuant: Learnable Subspace Decomposition for 4-Bit LLM QuantizationPoster
- TwinWeaver: An LLM-Based Foundation Model Framework for Pan-Cancer Digital TwinsPoster
- Twins: Learn to Predict Unified Representations with Focal LossPoster
- Two Calm Ends and the Wild Middle: A Geometric Picture of Memorization in Diffusion ModelsPoster
- Two Modalities Are Better Than One: Efficient Adversarial Purification via Multimodal Diffusion ModelsPoster
- Two-Layer Linear Auto-Regressive Models Estimate Latent StatesPoster
- Two-Parameter Flows for Learning Population Dynamics of Physical SystemsPoster
- Two-Stage Unit Tying for Simplifying Differentiable Logic Gate NetworksPoster
- Two-dimensional quantization for geometry-aware audio codingPoster
- U$^3$CF: Unbiased, Unconfounding, and Unified Causal Framework for Multi-Target Domain AdaptationPoster
- U-Cast: A Surprisingly Simple Frontier Probabilistic AI Weather ForecasterPoster
- UAV$^2$: A Unified and Adaptive Scheduling Framework for UAV Autopilot System with Reinforcement LearningPoster
- UB-SMoE: Universally Balanced Sparse Mixture-of-Experts for Resource-adaptive Federated Fine-tuning of Foundation ModelsPoster
- UCB Exploration for Fixed-Budget Bayesian Best Arm IdentificationPoster
- UCPO: Uncertainty-Aware Policy OptimizationPoster
- UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion ModelsSpotlight
- UFO: Chain-of-Evaluation for Omni-Condition Alignment in Multi-Modal Image GenerationPoster
- UGround: Towards Unified Visual Grounding with Unrolled TransformersPoster
- UHR-BAT: Budget-Aware Token Compression Vision-Language model for Ultra-High-Resolution Remote SensingPoster
- UI2Code^N: UI-to-Code Generation as Interactive Visual OptimizationPoster
- UMEM: Unified Memory Extraction and Management Framework for Generalizable MemoryPoster
- UNIVERSAL REPRESENTATION OF GENERALIZED CONVEX FUNCTIONS AND THEIR GRADIENTSPoster
- UOTIP: Unbalanced Optimal Transport Map for Unpaired Inverse ProblemsPoster
- URS: A Unified Neural Routing Solver for Cross-Problem Zero-Shot GeneralizationPoster
- USE : A Unified Self-Ensembling Framework for Test-Time Prompt TuningPoster
- Ubiquity of Homeostatic Hebbian Dynamics in Regularized LearningPoster
- UltraHorizon: Benchmarking LLM-Agent Capabilities in Ultra Long-Horizon ScenariosPoster
- UltraLIF: Fully Differentiable Spiking Neural Networks via Ultradiscretization and Max-Plus AlgebraPoster
- Ultrafast On-Chip Online Learning via Spline Locality in Kolmogorov–Arnold NetworksPoster
- UnHype: CLIP-Guided Hypernetworks for Dynamic LoRA UnlearningPoster
- UnMaskFork: Test-Time Scaling for Masked Diffusion via Deterministic Action BranchingPoster
- Unbiased Alignment for Large Language Models with Noisy PreferencesPoster
- Unbiased Dynamic Pruning for Efficient Group-Based Policy OptimizationPoster
- Unbiased Principles, Robust RewardsPoster
- Unbiased Reward Modeling from Implicit PreferencePoster
- Unbiased and Second-Order-Free Training for High-Dimensional PDEsPoster
- Uncertainty-Aware Clarification in LLM Agents with Information GainPoster
- Uncertainty-Constrained Trustworthiness for Graph LearningPoster
- Uncertainty-Guided Exploration and Stable Planning for Sparse-Reward Manipulation from Limited DemonstrationsPoster
- Uncovering Bias Mechanisms in Observational StudiesPoster
- Uncovering Competency Gaps in Large Language Models and Their BenchmarksPoster
- Uncovering Grounding IDs: How External Cues Shape Multi-Modal BindingPoster
- Uncovering Hidden Triggers: Backdoor Attribution in Language ModelsPoster
- Uncovering Latent Communication Patterns in Brain Networks via Adaptive Flow RoutingPoster
- Uncovering the Gradient Geometry of Long CoT: A Spectral-guided Approach to Reasoning DistillationPoster
- Uncovering the Latent Potential of Deep Intermediate RepresentationsSpotlight
- Understand and Accelerate Memory Processing Pipeline for Large Language Model InferencePoster
- Understanding Behavior Cloning with Action QuantizationPoster
- Understanding Data Temporality Impact on Large Language Models Pre-trainingPoster
- Understanding Deep Representation Learning via Layerwise Feature Compression and DiscriminationPoster
- Understanding Dynamic Compute Allocation in Recurrent TransformersPoster
- Understanding Dynamics of Adam in Zero-Sum Games: An ODE ApproachPoster
- Understanding Generalization and Forgetting in In-Context Continual LearningPoster
- Understanding Generalization from Embedding Dimension and Distributional ConvergencePoster
- Understanding LoRA as Knowledge Memory: An Empirical AnalysisPoster
- Understanding MARS: When Scaling Momentum Provably HelpsPoster
- Understanding Multimodal Learning: A Loss Landscape Smoothness PerspectivePoster
- Understanding Performance Collapse in Layer-Pruned Large Language Models via Decision Representation TransitionsPoster
- Understanding Private Learning From Feature PerspectivePoster
- Understanding Reasoning Collapse in LLM Agent Reinforcement LearningOral
- Understanding SAM through Minimax PerspectivePoster
- Understanding Self-Supervised Learning via Latent Distribution MatchingSpotlight
- Understanding Transfer Learning of RNA Foundation Models on Downstream TasksPoster
- Understanding Truncated Positional Encodings for Graph Neural NetworksPoster
- Understanding and Mitigating Token-Pruning-Induced Vulnerabilities in VLMsPoster
- Understanding the Ability of LLMs to Handle Character-Level PerturbationPoster
- Understanding the Gaps in Satisficing BanditsPoster
- Understanding the Performance Gap in Preference Learning: A Dichotomy of RLHF and DPOPoster
- Unfolded Laplacian Spectral Embedding: A Theoretically Grounded Approach to Dynamic Network RepresentationPoster
- Unfolding Generative Flows with Koopman Operators: Trajectory-Preserving LinearizationPoster
- Uni-DocRobust: Universal Plug-and-Play Robustness Enhancement for Multi-modal LLMs via Feature RestorationPoster
- UniCoD: Enhancing Robot Policy via Unified Continuous and Discrete Representation LearningPoster
- UniCode: Augmenting Evaluation for Code ReasoningPoster
- UniDrag: Unified Multi-Field Prediction and Robust Shape Optimization for Vehicle AerodynamicsPoster
- UniFLoW: Universal Multi-Modal Federated LoRA Fine-Tuning Framework with Analytical AggregationPoster
- UniFast-HGR: Scalable and Efficient Maximal Correlation for Multimodal ModelsPoster
- UniMapping: Unified SLAM Framework for Map-Centric Embodied PerceptionSpotlight
- UniMedVL: Unifying Medical Multimodal Understanding and Generation through Observation-Knowledge-AnalysisPoster
- UniPercept: Towards Unified Perceptual-Level Image Understanding across Aesthetics, Quality, Structure, and TextureSpotlight
- UniRRM: Unified Reasoning Reward Models Across Languages and Evaluation ParadigmsPoster
- UniRTL: Unifying Code and Graph for Robust RTL Representation LearningPoster
- UniSVQ: 2-bit Unified Scalar-Vector QuantizationPoster
- UniScale: Adaptive Unified Inference Scaling via Online Joint Optimization of Model Routing and Test-Time ScalingPoster
- UniSparse: Combining Weight Pruning and Spike Sparsification in Spiking Neural NetworksPoster
- Unified Episodic and Semantic Memory via Modulating Transformer FeedForward LayersPoster
- Unified Multimodal Autoregressive Modeling with Shared Context—Visual Tokenizer is Key to UnificationPoster
- Unified Multimodal Visual Tracking with Dual Mixture-of-ExpertsPoster
- Unified Safe In-context Image Generation in Multimodal Diffusion TransformersPoster
- Unified Time Series Explanations via Semi-Amortized Optimization and Instance-level Multi-Expert Knowledge DistillationPoster
- Unifying Adversarial Robustness and Training Across Text Scoring ModelsPoster
- Unifying Deep Stochastic Processes for Image EnhancementPoster
- Unifying Heterogeneous Degradations: Uncertainty-Aware Diffusion Bridge Model for All-in-One Image RestorationPoster
- Unifying Heterogeneous Multi-Modal Remote Sensing Detection Via Language-Pivoted PretrainingPoster
- Unifying Low Dimensional Spectra in Deep LearningPoster
- Unifying Masked Diffusion Models with Various Generation Orders and BeyondSpotlight
- Unifying Stacking and Cascading for Efficient Ensemble InferencePoster
- Unifying Value Alignment and Assignment in Cross-Domain Offline Reinforcement Learning with Heterogeneous DatasetsPoster
- Unifying and Optimizing Data Values for Selection via Sequential Decision-MakingSpotlight
- Unison: Benchmarking Unified Multimodal Models via Synergistic Understanding and GenerationPoster
- Unitary Convolutions for Message-passing and Positional Encodings on Directed GraphsPoster
- Universal Algorithm-Implicit LearningPoster
- Universal Approximation with Softmax AttentionPoster
- Universal Learning of Nonlinear DynamicsPoster
- Universal Multiclass Transductive Online LearningPoster
- Universal One-third Time Scaling in Learning Peaked DistributionsPoster
- Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMsPoster
- Universal Redundancies in Time Series Foundation ModelsSpotlight
- Universal Skeleton Understanding via Differentiable Rendering and MLLMsPoster
- Universality, Function Composition, and Algorithm Emulation All In-ContextPoster
- Unlearning Isn't Deletion: Investigating Reversibility of Machine Unlearning in LLMsPoster
- Unlearning Isn’t Forgetting: Revealing Hidden Leakage in Class Unlearning EvaluationsPoster
- Unlearning in Diffusion Models: A Unified Framework with KL Divergence and Likelihood ConstraintsPoster
- Unlearning with Asymmetric Sources: Improved Unlearning-Utility Trade-off with Public DataPoster
- Unlearning’s Blind Spots: Over‑Unlearning and Prototypical Relearning AttackPoster
- Unleashing Implicit Rewards: Prefix-Value Learning for Distribution-Level OptimizationPoster
- Unleashing the Representational Power of Fourier Shapes for Attacking Infrared Object DetectionPoster
- Unlocking Cross-Modal Biosignal Synthesis: A Temporally-Aware VAE-Diffusion ModelPoster
- Unlocking Noise-Resistant Vision: Key Architectural Secrets for Robust Models Against Gaussian NoisePoster
- Unlocking Speech–Text Compositional Powers: Instruction-Following Speech Language Models without Instruction TuningPoster
- Unlocking Zero-Shot Geospatial Reasoning via Indirect RewardsPoster
- Unlocking the Potential of Continual Model Merging: An ODE PerspectivePoster
- Unpaired Visual Editing with Self-Consistent Flow MatchingPoster
- Unraveling Syntax: Language Modeling and the Substructure of GrammarsSpotlight
- Unsafer in Many Turns: Benchmarking and Defending Multi-Turn Safety Risks in Tool-Using AgentsPoster
- Unsat Core Prediction through Polarity-Aware Representation Learning over Clause-Literal HypergraphsPoster
- Unsupervised Camouflaged Object Detection with Dual-Eigenvector Spectral Pseudo-Labeling and Contrastive RefinementPoster
- Unsupervised Diffusion for Combinatorial Optimization via Adjoint MatchingPoster
- Unsupervised Disentanglement Without Compromises : How Functional Orthogonality Enforces IdentifiabilityPoster
- Unsupervised Hierarchical Skill DiscoveryPoster
- Unsupervised Mode Discovery for Fine-tuning Multimodal Generative PoliciesPoster
- Unsupervised Neural Langevin Sampler for Mixed Integer Linear ProgrammingPoster
- Unsupervised Partner Design Enables Robust Ad-hoc TeamworkOral
- Unsupervised Process-Aware Coreset Selection for In-Context LearningPoster
- Untied Ulysses: Memory-Efficient Context Parallelism via Headwise ChunkingPoster
- Unveiling And Addressing Dimensional Collapse In Vector Quantization Models Via Codebook RegularizationPoster
- Unveiling Multi-regime Patterns in SciML: Distinct Failure Modes and Regime-specific OptimizationPoster
- Unveiling Prior-data Fitted Networks on Causal Effect Estimation: Pre-training or Finetuning?Poster
- Unveiling the Entropy Dynamics of Chain-of-Thought ReasoningPoster
- Unveiling the Potential of Quantization with MXFP4: Strategies for Quantization Error ReductionPoster
- Unveiling the Role of Data Uncertainty in Tabular Deep LearningPoster
- Unveiling the Structure of Do-Calculus Reasoning via Derivation GraphsPoster
- Unveiling the Visual Counting Bottleneck in Vision-Language ModelsPoster
- Upper-Linearizability of Online Non-Monotone DR-Submodular Maximization over Down-Closed Convex SetsPoster
- UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial RepresentationsPoster
- UrbanMLLM: Joint Learning of Cross-view Imagery for Urban UnderstandingPoster
- Use What You Know: Causal Foundation Models with Partial GraphsPoster
- User-Aware Active Knowledge Acquisition for Emotional Support DialoguePoster
- Utility Boundary of Dataset Distillation: Scaling and Coverage LawsPoster
- Utility-Diversity Aware Online Batch Selection for LLM Supervised Fine-tuningPoster
- Utonia: Toward One Encoder for All Point CloudsPoster
- V-ABS: Action-Observer Driven Beam Search for Dynamic Visual ReasoningPoster
- V1: Unifying Generation and Self-Verification for Parallel ReasonersPoster
- VALUEFLOW: Toward Pluralistic and Steerable Value-based Alignment in Large Language ModelsOral
- VAnim: Rendering-Aware Sparse State Modeling for Structure-Preserving Vector AnimationPoster
- VBA: Vector Bundle Attention for Intrinsically Geometric Representation LearningPoster
- VCG-Bench: Towards A Unified Visual-Centric Benchmark for Structured Generation and EditingPoster
- VDW-GNNs: Vector diffusion wavelets for geometric graph neural networksPoster
- VELR: Efficient Video Reward Feedback via Ensemble Latent Reward ModelsPoster
- VENOMREC: Cross-Modal Interactive Poisoning for Targeted Promotion in Multimodal LLM Recommender SystemsPoster
- VEQ: Modality-Adaptive Quantization for MoE Vision-Language ModelsPoster
- VERA-V: Variational Inference Framework for Jailbreaking Vision-Language ModelsPoster
- VFMF: Dense Forecasting by Generating Foundation Model FeaturesPoster
- VGGT-Motion: Motion-Aware Calibration-Free Monocular SLAM for Long-Range ConsistencySpotlight
- VIA-SD: Verification via Intra-Model Routing for Speculative DecodingPoster
- VIBE: Disentangling Social Dynamics via Kinematics-Informed Variational Inference for Behavioral EmotionPoster
- VIP: Visual-guided Prompt Evolution for Efficient Dense Vision-Language InferencePoster
- VIPO: Value Function Inconsistency Penalized Offline Reinforcement LearningPoster
- VIRUS: Injecting Persistent Cognitive Pathogens into Stateful Zero-Shot Object Navigation AgentsPoster
- VJEPA: Variational Joint Embedding Predictive Architectures as Probabilistic World ModelsPoster
- VLA-ATTC: Adaptive Test-Time Compute for VLA Models with Relative Action Critic ModelPoster
- VLA-Arena: An Open-Source Framework for Benchmarking Vision-Language-Action ModelsPoster
- VLANeXt: Recipes for Building Strong VLA ModelsPoster
- VLAW: Iterative Co-Improvement of Vision-Language-Action Policy and World ModelPoster
- VLM-RobustBench: A Comprehensive Benchmark for Robustness of Vision-Language ModelsPoster
- VPD-100K: Towards Generalizable and Fine-grained Visual Privacy ProtectionPoster
- VR-Thinker: Boosting Multimodal Reward Models through Think with Image ReasoningPoster
- VSCD: Video-based Scene Change Detection in Unaligned ScenesPoster
- VT-Bench: A Unified Benchmark for Visual-Tabular Multi-Modal LearningPoster
- Value Aggregation with Uncertainty in Online Decentralized MARLPoster
- Value-as-Return: A Two-Stage Framework to Align on the Optimal Score FunctionPoster
- Var-JEPA: Variational Joint-Embedding Predictive Architecture – Bridging Predictive and Generative Self-Supervised LearningPoster
- Variable Clustering via Distributionally Robust Nodewise RegressionPoster
- Variable-Length Tokenization via Learnable Global Merging for Diffusion TransformersPoster
- Variance Driven Exploration: A Provable and Efficient Methodology for Pure Exploration in Highly Stochastic EnvironmentsPoster
- Variance-Reduced $(\varepsilon, \delta)-$Unlearning using Forget Set GradientsPoster
- Variance-Reduced Zeroth-Order Langevin Dynamics for Non-Log-Concave Black-Box Sampling and Inverse ProblemsPoster
- Variational Adapter for Cross-modal Similarity RepresentationPoster
- Variational Bayesian Flow Network for Graph GenerationPoster
- Variational Entropic Optimal TransportPoster
- Variational Flow Maps: Make Some Noise for One-Step Conditional GenerationPoster
- Variational Inference for Uncertain Optimal Transport via Sinkhorn ParametrizationPoster
- Variational Learning for Insertion-based GenerationSpotlight
- Variational Learning of Disentangled RepresentationsPoster
- Variational Routing: A Scalable Bayesian Framework for Calibrated Mixture-of-Experts TransformersPoster
- Variational Speculative Decoding: Rethinking Draft Training from Token Likelihood to Sequence AcceptancePoster
- Variational inference via Gaussian interacting particles in the Bures-Wasserstein geometryPoster
- VeRO: An Evaluation Harness for Agents to Optimize AgentsPoster
- VecDesigner: Exploring Visual Guidance and Structural Consistency for Semantic TypographyPoster
- VecMol: Vector-Field Representations for 3D Molecule GenerationPoster
- Vector Linking via Cross-Model Local Isometric ConsistencyPoster
- Vector Quantization using Gaussian Variational AutoencoderPoster
- VectorWorld: Efficient Streaming World Model via Diffusion Flow on Vector GraphsSpotlight
- Veda: Scalable Video Diffusion via Distilled Sparse AttentionPoster
- Vegas: Self-Speculative Decoding with Verification-Guided Sparse AttentionPoster
- VenusBench-Mobile: A Challenging and User-Centric Benchmark for Mobile GUI Agents with Capability DiagnosticsOral
- Verbalized Bayesian PersuasionPoster
- Verbalized Sampling: How to Mitigate Mode Collapse and Unlock LLM DiversityPoster
- VeriSimpl: Robust Optimization Modeling from Natural Language using Simplification-based VerificationPoster
- Verifiable Multimodal Reasoning: Fact-level Attribution with Multimodal SourcesPoster
- Verifying Meta-Awareness via Predictive Rewards in Reasoning ModelsPoster
- Very Efficient Listwise Multimodal Reranking for Long DocumentsPoster
- ViEEG: Hierarchical Visual Neural Representation for EEG Brain DecodingPoster
- ViSurf: Visual Supervised-and-Reinforcement Fine-Tuning for Large Vision-and-Language ModelsPoster
- ViTok-v2: Scaling Native-Resolution Autoencoders to 5BPoster
- Vibe Checker: Aligning Code Evaluation with Human PreferencePoster
- VidLaDA: Bidirectional Diffusion Large Language Models for Efficient Video UnderstandingPoster
- Video-BCI: Bayesian Cognitive Integration of Self-Prior Hypotheses for Video UnderstandingPoster
- Video-Based Optimal Transport for Feedback-Efficient Offline Preference-Based Reinforcement LearningOral
- Video-MTR: Reinforced Multi-Turn Reasoning for Long Video UnderstandingPoster
- Video-OPD: Efficient Post-Training of Multimodal Large Language Models for Temporal Video Grounding via On-Policy DistillationPoster
- Video-SVD: Efficient Video Diffusion via Orthogonal Basis CompositionPoster
- Video-in-the-Loop: Span-Grounded Long Video QA with Interleaved ReasoningPoster
- Video2GUI: Synthesizing Large-Scale Interaction Trajectories for Generalized GUI Agent PretrainingPoster
- VideoBrain: Learning Adaptive Frame Sampling for Long Video UnderstandingPoster
- VideoFlexTok: Flexible-Length Coarse-to-Fine Video TokenizationSpotlight
- VideoKR: Towards Knowledge- and Reasoning-Intensive Video UnderstandingSpotlight
- VideoLoom: A Video Large Language Model for Joint Spatial-Temporal UnderstandingPoster
- VideoSEAL: Separating Planning from Answer Authority for Agentic Long Video UnderstandingPoster
- VideoSEG-O3: A Multi-turn Reinforcement Learning Framework for Reasoning Video Object SegmentationPoster
- VideoSeeker: Native Interleaved Clue Seeking for Long Video Multi-Hop ReasoningPoster
- VideoTemp-o3: Harmonizing Temporal Grounding and Video Understanding in Agentic Thinking-with-VideosPoster
- VideoTrace-R1: Long Video-based Retrieval-Augmented Generation via Temporal Path Graph UnderstandingPoster
- VideoVeritas: AI-Generated Video Detection via Perception Pretext Reinforcement LearningPoster
- View Space: Learning Representation across Arbitrary GraphsPoster
- ViewMask-1-to-3: Multi-View Consistent Image Generation via Multimodal Diffusion ModelsPoster
- VimRAG: Navigating Massive Visual Context in Retrieval-Augmented Generation via Multimodal Memory GraphPoster
- Vision Language Models Cannot Reason About Physical TransformationPoster
- Vision Transformer Finetuning Benefits from Non-Smooth ComponentsPoster
- Vision in One Vector: Implicit Visual Compression with Diffusion Foundation ModelsPoster
- Vision-DeepResearch: Incentivizing DeepResearch Capability in Multimodal Large Language ModelsPoster
- Vision-Language-Action Pretraining from Large-Scale Human VideosPoster
- Vision-aligned Latent Reasoning for Multi-Modal Large Language ModelPoster
- VisionPulse: Dynamic Visual Sparsity for Efficient Multimodal ReasoningPoster
- VisionWebDev: A Hierarchical Benchmark for Visual Website Development with Agent VerificationSpotlight
- Visual Implicit Autoregressive ModelingPoster
- Visual Para-Thinker: Divide-and-Conquer Reasoning for Visual ComprehensionPoster
- Visual Persuasion: What Influences Decisions of Vision-Language Models?Poster
- VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain KnowledgePoster
- VisualScore: Learning Holistic Visual Quality Scores via Multi-Task ReasoningPoster
- VividCam: Learning Unconventional Camera Motions from Virtual Synthetic VideosPoster
- VlogReward: Learning Multi-Dimensional Evaluation for Vlog EditingPoster
- VocSim A Training-free Benchmark for Zero-shot Content Identity in Single-source AudioPoster
- Von Mises-Fisher Mixture Model with Dynamic Shrinkage for Realistic Test-Time TransductionPoster
- Vulnerable Agent Identification in Large-Scale Multi-Agent Reinforcement LearningPoster
- WAVE: Window-Aware Vocabulary-Efficient Early-Exit for Training-Free LLM AccelerationPoster
- WBMM: Windowed Batch Matrix Multiplication for Efficient Large Receptive Field ConvolutionSpotlight
- WET: Mitigating World-Conditioned Knowledge Conflicts via World Entropy TetheringPoster
- WEVSR: Adapting Video Diffusion Generators to Real-World Video Super‑Resolution with Wavelet-Enhanced VAE EncoderPoster
- WF-Bench: A Benchmark for Neural-Network WaveFunction Expressivity and Scaling LawsPoster
- WFR-MFM: One-Step Inference for Dynamic Unbalanced OTPoster
- WIND: Weather Inverse Diffusion for Zero-Shot Atmospheric ModelingPoster
- WISE: World Knowledge-Informed Semantic Evaluation for Text-to-Image GenerationPoster
- WMVLM: Evaluating Diffusion Model Image Watermarking via Vision-Language ModelsPoster
- WS-GRPO: Weakly-Supervised Group-Relative Policy Optimization for Rollout-Efficient ReasoningPoster
- WUSH: Near-Optimal Adaptive Transforms for LLM QuantizationPoster
- Wait, Wait, Wait... Why Do Reasoning Models Loop?Spotlight
- Walrus: A Cross-domain Foundation Model for Continuum DynamicsSpotlight
- WarmServe: Enabling One-for-Many GPU Prewarming for Multi-LLM ServingPoster
- Wasserstein Geometry-Aware Adaptive Control via Meta-LearningPoster
- Watch Your Step: Information Injection in Diffusion Models via Shadow Timestep EmbeddingPoster
- WatchLog: Efficient and Interpretable Event Reasoning for Endpoint Detection and Response Logs with Multimodal LLMsPoster
- WaterSIC: information-theoretically (near) optimal linear layer quantizationSpotlight
- Watermarking Graph Neural Networks via Explanations for Ownership ProtectionPoster
- Watermarking LLM Agent TrajectoriesPoster
- WaveSSM: Multiscale State-Space Models for Non-stationary Signal AttentionPoster
- WeDLM: Reconciling Diffusion Language Models with Standard Causal Attention for Fast InferenceOral
- Weak Diffusion Priors Can Still Achieve Strong Inverse-Problem PerformanceSpotlight
- Weak-to-Strong Generalization via Bregman Bias–Variance DecompositionPoster
- Weakly Supervised Cross-Modal Learning for 4D Radar Scene Flow EstimationPoster
- Weasel: Out-of-Domain Generalization for Web Agents via Importance-Diversity Data SelectionPoster
- WeatherSyn: An Instruction Tuning MLLM For Weather Forecasting Report GenerationPoster
- Weaving Graph over Tokens: Contextualizing Structured Sequences for LLMsPoster
- Weaving in the Clouds: Achieving Synergistic Collaboration among LLM Agents via Federated LearningPoster
- WebWorld: A Large-Scale World Model for Web Agent TrainingPoster
- Weight Decay Improves Language Model PlasticityPoster
- Weight Updates as Activation Shifts: A Principled Framework for SteeringPoster
- Weight-Space Learning for Certifiable Few-shot Transfer LearningPoster
- Weight-sparse transformers have interpretable circuitsPoster
- Weights to Code: Extracting Interpretable Algorithms from the Discrete TransformerPoster
- Welfare-Optimal Classification with Accuracy AuctionsSpotlight
- Well-Posed KL-Regularized Control via Wasserstein and Kalman–Wasserstein KL DivergencesPoster
- WestWorld: A Knowledge-Encoded Scalable Trajectory World Model for Diverse Robotic SystemsSpotlight
- What Characterizes Effective Reasoning? Revisiting Length, Review, and Structure of CoTPoster
- What Do Agents Learn from Trajectory-SFT: Semantics or Interfaces?Spotlight
- What Does Flow-Matching Bring to TD-Learning?Poster
- What Does Preference Learning Recover from Pairwise Comparison Data?Poster
- What Does Thompson Sampling Optimize?Poster
- What Does Vision Tool-Use Reinforcement Learning Really Learn? Disentangling Tool-Induced and Intrinsic Effects for Crop-and-ZoomPoster
- What If We Allocate Test-Time Compute Adaptively?Poster
- What If We Let Forecasting Forget? A Sparse Bottleneck for Cross-Variable DependenciesPoster
- What Information Matters? Graph Out-of-Distribution Detection via Tri-Component Information DecompositionPoster
- What Language is This? Ask Your Tokenizer.Poster
- What Linear Probes Miss: Multi-View Probing for Weight-Space LearningPoster
- What Makes Effective Supervision in Latent Chain-of-Thought: An Information-Theoretic AnalysisPoster
- What Makes Synthetic Data Effective in Image SegmentationPoster
- What Makes Value Learning Efficient in Residual Reinforcement Learning?Spotlight
- What Makes a Desired Graph for Relational Deep Learning?Poster
- What Makes a Good Representation for Single-Cell Perturbation Prediction?Poster
- What Makes a Strong Model? A Unified Spectral Analysis of Knowledge Transfer over High-dimensional Linear RegressionPoster
- What Preferences Can—and Cannot—Predict in Multi-Agent Online LearningOral
- What Really Improves Mathematical Reasoning: Structured Reasoning Signals Beyond Pure CodePoster
- What Reward Structure Enables Efficient Sparse-Reward RL? A Proof-of-Concept with Policy-Aware Matrix CompletionPoster
- What You Think is What You See: Driving Exploration in VLM Agents via Visual-Linguistic CuriositySpotlight
- What if Tomorrow is the World Cup Final? Counterfactual Time Series Forecasting with Textual ConditionsPoster
- What is Missing? Explaining Neurons Activated by Absent ConceptsPoster
- When AI Agents Compete for Jobs: Strategic Capabilities and Economic Dynamics of AI Labour MarketsPoster
- When AI Benchmarks Plateau: A Systematic Study of Benchmark SaturationPoster
- When Actions Go Off-Task: Detecting and Correcting Misaligned Actions in Computer-Use AgentsPoster
- When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent SystemsPoster
- When Attributes Disagree: Gradient Conflict in Image Aesthetic AssessmentSpotlight
- When Benign Inputs Lead to Severe Harms: Eliciting Unsafe Unintended Behaviors of Computer-Use AgentsPoster
- When Can We Trust Survival Model Evaluation ?Poster
- When Can You Poison Rewards? A Tight Characterization of Reward Poisoning in Linear MDPsPoster
- When Data Is Scarce: Scaling Sparse Language Models with Repeated TrainingPoster
- When Diffusion Language Models Hesitate: Detecting and Correcting Visual Hallucinations via Confidence FluctuationPoster
- When Distance Distracts: Representation Distance Bias in BT-Loss for Reward ModelsPoster
- When Do Diffusion Models learn to Generate Multiple Objects?Poster
- When Do Graph Foundation Models Transfer? A Data-Centric TheoryPoster
- When Do Hallucinations Arise? A Graph Perspective on the Evolution of Path Reuse and Path CompressionPoster
- When Does Adaptation Win? Scaling Laws for Meta-Learning in Quantum ControlPoster
- When Does Sparsity Mitigate the Curse of Depth in LLMsPoster
- When Drafts Evolve: Speculative Decoding Meets Online LearningPoster
- When Embedding-Based Defenses Fail: Rethinking Safety in LLM-Based Multi-Agent SystemsPoster
- When Generalized Zero-Shot Learning Meets PU Learning: A Plug-and-Play Framework for Seen-Class Bias MitigationPoster
- When Is Rank-1 Enough? Geometry-Guided Initialization for Parameter-Efficient Fine-TuningPoster
- When Is Symbolic Regression Tractable?Poster
- When Iteration Helps and Hurts in Self-Training: Denoising vs. Signal ForgettingPoster
- When LLMs Develop Languages: Symbolic Communication for Efficient Multi-Agent ReasoningPoster
- When LLMs Encounter Open-world Graph Learning: A Fresh View on Unlabeled Data UncertaintyPoster
- When Labelers Stay Silent: The Power of Ties in Cost-Effective Preference LearningPoster
- When Model Merging Breaks Routing: Training-Free Calibration for MoEPoster
- When More Data Doesn't Help: Limits of Adaptation in Multitask LearningPoster
- When More Experts Hurt: Underfitting in Multi-Expert Learning to DeferPoster
- When Planning Fails Despite Correct Execution: On Epistemic Calibration for LLM-Based Multi-Agent SystemsPoster
- When Preference Labels Fall Short: Aligning Diffusion Models from Real DataPoster
- When RAG Hurts: Diagnosing and Mitigating Attention Distraction in Retrieval-Augmented LVLMsPoster
- When RL Meets Adaptive Speculative Training: A Unified Training-Serving SystemPoster
- When Random Saliency Looks Trained: Architectural Center Bias in CNN InterpretabilityPoster
- When Replanning Becomes the Bottleneck: Budgeted Replanning for Embodied AgentsPoster
- When Sample Selection Bias Precipitates Model CollapsePoster
- When Search Goes Wrong: Red-Teaming Web-Augmented Large Language ModelsPoster
- When Shared Knowledge Hurts: Spectral Over-Accumulation in Model MergingPoster
- When Simple Problems Wear Complex Costumes: Improving Efficiency in LRM’s Adaptive ReasoningPoster
- When Single Answer Is Not Enough: Rethinking Single-Step Retrosynthesis Benchmarks for LLMsPoster
- When Softmax Fails at the Top: Extreme‑Value Corrections for InfoNCEPoster
- When Tabular Foundation Models Meet Strategic Tabular Data: A Prior Alignment ApproachPoster
- When and How Human Curation Backfires: Preference Alignment under Multi-Model Self-Consuming LoopPoster
- When does predictive inverse dynamics outperform behavior cloning?Poster
- When less gives more: bias from small dataset can speed up trainingPoster
- When the Prompt Becomes Visual: Vision-Centric Jailbreak Attacks for Large Image Editing ModelsOral
- When to Memorize and When to Stop: Gated Recurrent Memory for Long-Context ReasoningPoster
- When to Think, When to Speak: Learning Disclosure Policies for Large Language Model ReasoningPoster
- When to Trust the Cheap Check: Weak and Strong Verification for ReasoningSpotlight
- Where Concept Erasure Should Occur: Concept–Layer Alignment in Text-to-Video Diffusion ModelsPoster
- Where Detectors Fail: Probing Generative Space for Generalizable AI-Generated Image DetectionPoster
- Where Rectified Flows Leak: Characterizing Membership Signals Along the Interpolation PathPoster
- Where Signals Are Sparse, We Synthesize: Reinforcing Self-Corrective Reasoning in Vision–Language Models via Rollout AugmentationPoster
- Which Algorithms Can Graph Neural Networks Learn?Oral
- Which Heads Matter for Reasoning? RL-Guided KV Cache CompressionPoster
- Which LLM Multi-Agent Protocol to Choose?Poster
- Which Reasoning Traces Are Worth Generating Further? Data Curation for Training Reasoning ModelsPoster
- WhisperSplat: Lossless Steganography in 3D Gaussian SplattingPoster
- Who Evaluates AI's Social Impacts? Mapping Coverage and Gaps in First and Third Party EvaluationsPoster
- Who Gets Credit or Blame? Attributing Accountability in Modern AI SystemsPoster
- Who Said Neural Networks Aren't Linear?Poster
- Who Transfers Safety? Identifying and Targeting Cross-Lingual Shared Safety NeuronsPoster
- Who can we trust? LLM-as-a-jury for Comparative AssessmentPoster
- Who’s in Charge? Disempowerment Patterns in Real-World LLM UsagePoster
- Why Agentic Theorem Prover Works: A Statistical Provability Theory of Mathematical Reasoning ModelsPoster
- Why Are Linear RNNs More Parallelizable?Poster
- Why DDIM Hallucinates More than DDPM: A Theoretical Analysis of Reverse DynamicsPoster
- Why Dedicated Critics: Eliminating Target Drift in Multi-Constraint RLPoster
- Why Deep Jacobian Spectra Separate: Depth-Induced Scaling and Singular-Vector AlignmentSpotlight
- Why Do We Need Warm-up? A Theoretical PerspectivePoster
- Why Linear Recurrent Memory Works in Partially Observable Reinforcement LearningSpotlight
- Why ReLU? A Bit-Model Dichotomy for Deep Network TrainingPoster
- Why Specialist Models Still Matter: A Heterogeneous Multi-Agent Paradigm for Medical Artificial IntelligencePoster
- Why Tree-Style Branching Matters for Thought Advantage Estimation in GRPOPoster
- Width Independent Bounds for the Local Lipschitz Constant of Deep Neural Networks at Random Initialization and after Lazy TrainingPoster
- Wikipedia in the Era of LLMs: Evolution and RisksPoster
- WildActor: Unconstrained Identity-Preserving Video GenerationPoster
- WildCat: Near-Linear Attention in Theory and PracticePoster
- WinDeskGround: A Benchmark for Robust GUI Grounding in Complex Multi-Window Desktop EnvironmentsPoster
- WinQ: Accelerating Quantization-Aware Training of Large Language Models around Saddle PointsPoster
- Winformer: Transcending Pairwise Similarity for Time-series GenerationPoster
- With Argus Eyes: Assessing Retrieval Gaps via Uncertainty Scoring to Detect and Remedy Retrieval Blind SpotsPoster
- Words & Weights: Streamlining Multi-Turn Interactions via Co-AdaptationPoster
- Words Towards Explainability: Caption Label-Free Learning via Dual Loop Agentic Time Series CaptioningPoster
- World Guidance: World Modeling in Condition Space for Action GenerationPoster
- World-Model Inspired Emotion-aware Token Refinement for Training-Free Multimodal Emotion RecognitionSpotlight
- World-R1: Reinforcing 3D Constraints for Text-to-Video GenerationPoster
- World-Shaper: A Unified Framework for 360° Panoramic EditingPoster
- WorldCache: Accelerating World Models for Free via Heterogeneous Token CachingPoster
- WorldComp2D: Spatio-semantic Representations of Object Identity and Location from Local ViewsPoster
- WorldCompass: Reinforcement Learning for Long-Horizon World ModelsPoster
- WorldMirror: Universal 3D World Reconstruction with Any-Prior PromptingPoster
- WorldPlay: Towards Long-Term Geometric Consistency for Real-Time Interactive World ModelingPoster
- WorldTravel: A Realistic Multimodal Travel-Planning Benchmark with Tightly Coupled ConstraintsPoster
- X-EviProbe: Post-hoc Parameter-free Evidential Uncertainty Quantification for Frozen Graph Neural NetworksPoster
- X-MoGe: A Cross-Modal Adaptation Framework with Mixture-of-Experts and Geometry Guidance for Heterogeneous Collaborative PerceptionPoster
- XDomainBench: Diagnosing Reasoning Collapse in High-Dimensional Scientific Knowledge CompositionPoster
- XPERT: Expert Knowledge Transfer for Effective Training of Language ModelsPoster
- XR-1: Towards Versatile Vision-Language-Action Models via Learning Unified Vision-Motion RepresentationsOral
- XRPO: Pushing the Limits of GRPO with Targeted Exploration and ExploitationPoster
- XSpecMesh: Quality-Preserving Auto-Regressive Mesh Generation Acceleration via Multi-Head Speculative DecodingPoster
- XTransfer: Modality-Agnostic Few-Shot Model Transfer for Human Sensing at the EdgePoster
- XYZFlow: Scaling Multidimensional Shortcut Flows for Efficient Generative ModelingPoster
- You Can Learn Tokenization End-to-End with Reinforcement LearningPoster
- You Don't Protect if You Don't Expect: Breaking the Key Assumption behind CLIP's Test-Time DefensesPoster
- You Don’t Need All That Attention: Surgical Memorization Mitigation in Text-to-Image Diffusion ModelsPoster
- You Need Better Attention PriorsPoster
- Your Latent Reasoning is Secretly Policy Improvement OperatorPoster
- Z-Erase: Enabling Concept Erasure in Single Stream Diffusion TransformersPoster
- Zero Sum SVD: Balancing Loss Sensitivity for Low Rank LLM CompressionPoster
- Zero-Flow EncodersPoster
- Zero-Shot 3D Question Answering via Hierarchical View-to-Token TransportationPoster
- Zero-Shot Off-Policy LearningPoster
- Zero-Shot Rankability: Revealing Latent Ordinal Structure in Multimodal Large Language Models via LanguagePoster
- Zero-Shot Text-to-Motion Evaluation using Video Language ModelsPoster
- Zero-shot Active Mapping via Fused 360-BEV Representations and Vision–Language ModelsPoster
- Zero-source LLM Hallucination Detection with Human-like Criteria ProbingPoster
- ZeroBench: An Impossible Visual Benchmark for Contemporary Large Multimodal ModelsPoster
- ZeroDiff: Zero-Shot Time Series Reconstruction via Informed-Prior DiffusionPoster
- ZeroUnlearn: Few-Shot Knowledge Unlearning in Large Language ModelsPoster
- Zeroth-Order Forward-Only SNN Training Inspiring Neuromorphic On-Chip LearningPoster
- Zeroth-Order Optimization at the Edge of StabilityPoster
- Zeus: Towards Tuning-Free Foundation Model for Time Series AnalysisPoster
- ZipMoE: Efficient On-Device MoE Serving via Lossless Compression and Cache-Affinity SchedulingPoster
- Zono-Conformal Prediction: Zonotope-Based Uncertainty Quantification for Regression and Classification TasksPoster
- Zooming without Zooming: Region-to-Image Distillation for Fine-Grained Multimodal PerceptionPoster
- [CLS] is Not Enough: Multi-Label Recognition via Patch-Level Inference and Adaptive AggregationPoster
- ``Someone Hid It!'': Query-Agnostic Black-Box Attacks on LLM-Based RetrievalPoster
- cMoLLM at Scale: Horizontal Scaling Laws for Convolutionally-Gated Mixture-of-LLMsPoster
- cuRegOT: A GPU-Accelerated Solver for Entropic-Regularized Optimal TransportPoster
- d2: Improved Techniques for Training Reasoning Diffusion Language ModelsPoster
- d2p: Fast and Scalable Structured Attention with Differentiable Dynamic ProgrammingPoster
- d3LLM: Ultra-Fast Diffusion LLM using Pseudo-Trajectory DistillationPoster
- dLLM-Cache: Accelerating Diffusion Large Language Models with Adaptive CachingPoster
- dTRPO : Trajectory Reduction in Policy Optimization of Diffusion Large Language ModelsPoster
- daVinci-Dev: Agent-native Mid-training for Software EngineeringOral
- dgMARK: Decoding-Guided Watermarking for Diffusion Language ModelsPoster
- dnaHNet: A Scalable and Hierarchical Foundation Model for Genomic Sequence LearningOral
- ePC: Fast and Deep Predictive Coding for Digital HardwarePoster
- effGen: Enabling Small Language Models as Capable Autonomous AgentsPoster
- gp2Scale: A Class of Compactly Supported Non-Stationary Kernels and Distributed Computing for Exact Gaussian Processes on 10 Million Data PointsPoster
- h1: Bootstrapping LLMs to Reason over Longer Horizons via Reinforcement LearningSpotlight
- iGRPO: Fast Online RL for Flow Matching Model with Dense RewardPoster
- iLoRA: Bayesian Low-Rank Adaptation with Latent Interaction Graphs for Microbiome DiagnosisPoster
- iTryOn: Mastering Interactive Video Virtual Try-On with Spatial-Semantic GuidancePoster
- iVGR: Internalizing Visually Grounded Reasoning for MLLMs with Reinforcement LearningPoster
- iWorld-Bench: A Benchmark for Interactive World Models with a Unified Action Generation FrameworkPoster
- mHC: Manifold-Constrained Hyper-ConnectionsSpotlight
- mSOP-765k: A Benchmark For Multi-Modal Structured Output PredictionsPoster
- mmBERT: A Modern Multilingual Encoder with Annealed Language LearningPoster
- nD-RoPE: A Generalized RoPE for n-Dimensional Position EmbeddingPoster
- pTNAS: Progressive Neural Architecture Search for Tabular DataPoster
- rePIRL: Learn PRM with Inverse RL for LLM ReasoningPoster
- scCBGM: Single-Cell Editing via Concept BottlenecksPoster
- scChord: A Probabilistic Manifold Rectification Framework for RNA-to-Protein TranslationPoster
- scDEBART: Predicting in silico Single-Cell Perturbation Responses via Large-Scale Differential Expression LearningPoster
- scDataset: Scalable Data Loading for Deep Learning on Large-Scale Single-Cell OmicsPoster
- video-SALMONN S: Memory-Enhanced Streaming Audio-Visual LLMPoster
- xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector ExtractionPoster
- xLSTM Distillation: Achieving Teacher-Student Parity Through Efficient Hybrid ArchitecturesPoster
- “Do Diffusion Models Dream of Electric Planes?” Discrete and Continuous Simulation-Based Inference for Aircraft DesignPoster
- “very likely” Means “uncertain”? How LLMs Diverge from Humans in Linguistic Uncertainty QuantificationPoster
ICML accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.