ICML 2025 Accepted Papers
The full list of 3,333 papers accepted at ICML 2025 (International Conference on Machine Learning). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 2,988Spotlight: 225Oral: 120
- Learning to (Learn at Test Time): RNNs with Expressive Hidden StatesSpotlight90 citations
- AdvPrompter: Fast Adaptive Adversarial Prompting for LLMsPoster88 citations
- rStar-Math: Small LLMs Can Master Math Reasoning with Self-Evolved Deep ThinkingOral78 citations
- SFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-trainingPoster72 citations
- MimicMotion: High-Quality Human Motion Video Generation with Confidence-aware Pose GuidancePoster65 citations
- LongVU: Spatiotemporal Adaptive Compression for Long Video-Language UnderstandingPoster59 citations
- DPO Meets PPO: Reinforced Token Optimization for RLHFSpotlight58 citations
- Demystifying Long Chain-of-Thought ReasoningPoster51 citations
- OR-Bench: An Over-Refusal Benchmark for Large Language ModelsPoster47 citations
- Agent Workflow MemoryPoster42 citations
- What If We Recaption Billions of Web Images with LLaMA-3?Poster38 citations
- Free Process Rewards without Process LabelsPoster36 citations
- How Far Is Video Generation from World Model: A Physical Law PerspectivePoster35 citations
- Agent-as-a-Judge: Evaluate Agents with AgentsPoster34 citations
- LMRL Gym: Benchmarks for Multi-Turn Reinforcement Learning with Language ModelsPoster34 citations
- Windows Agent Arena: Evaluating Multi-Modal OS Agents at ScalePoster33 citations
- Forest-of-Thought: Scaling Test-Time Compute for Enhancing LLM ReasoningPoster32 citations
- Freeze-Omni: A Smart and Low Latency Speech-to-speech Dialogue Model with Frozen LLMPoster32 citations
- Theoretical guarantees on the best-of-n alignment policyPoster31 citations
- Nonparametric Modern Hopfield ModelsPoster30 citations
- Discrepancy Minimization in Input-Sparsity TimeSpotlight29 citations
- Aguvis: Unified Pure Vision Agents for Autonomous GUI InteractionPoster27 citations
- High-Dimensional Prediction for Sequential Decision MakingOral26 citations
- RLEF: Grounding Code LLMs in Execution Feedback with Reinforcement LearningSpotlight25 citations
- Cradle: Empowering Foundation Agents towards General Computer ControlPoster22 citations
- Imagine While Reasoning in Space: Multimodal Visualization-of-ThoughtPoster22 citations
- Towards World Simulator: Crafting Physical Commonsense-Based Benchmark for Video GenerationPoster22 citations
- Training Software Engineering Agents and Verifiers with SWE-GymPoster22 citations
- Mind Your Step (by Step): Chain-of-Thought can Reduce Performance on Tasks where Thinking Makes Humans WorsePoster21 citations
- Optimizing Test-Time Compute via Meta Reinforcement FinetuningPoster21 citations
- AutoML-Agent: A Multi-Agent LLM Framework for Full-Pipeline AutoMLPoster20 citations
- Taming Rectified Flow for Inversion and EditingPoster19 citations
- VisionTS: Visual Masked Autoencoders Are Free-Lunch Zero-Shot Time Series ForecastersPoster19 citations
- WorldSimBench: Towards Video Generation Models as World SimulatorsPoster18 citations
- AutoEval Done Right: Using Synthetic Data for Model EvaluationPoster17 citations
- Automatically Interpreting Millions of Features in Large Language ModelsPoster17 citations
- DINO-WM: World Models on Pre-trained Visual Features enable Zero-shot PlanningPoster17 citations
- FourierMamba: Fourier Learning Integration with State Space Models for Image DerainingPoster17 citations
- G-Designer: Architecting Multi-agent Communication Topologies via Graph Neural NetworksSpotlight17 citations
- The Surprising Effectiveness of Test-Time Training for Few-Shot LearningPoster17 citations
- Emergent Misalignment: Narrow finetuning can produce broadly misaligned LLMsOral16 citations
- FlipAttack: Jailbreak LLMs via FlippingPoster16 citations
- Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion ModelPoster16 citations
- MedXpertQA: Benchmarking Expert-Level Medical Reasoning and UnderstandingPoster16 citations
- Putnam-AXIOM: A Functional & Static Benchmark for Measuring Higher Level Mathematical Reasoning in LLMsPoster16 citations
- RE-Bench: Evaluating Frontier AI R&D Capabilities of Language Model Agents against Human ExpertsSpotlight16 citations
- SliM-LLM: Salience-Driven Mixed-Precision Quantization for Large Language ModelsPoster16 citations
- Thinking LLMs: General Instruction Following with Thought GenerationPoster16 citations
- A General Framework for Inference-time Scaling and Steering of Diffusion ModelsPoster15 citations
- AI for Global Climate Cooperation: Modeling Global Climate Negotiations, Agreements, and Long-Term Cooperation in RICE-NPoster14 citations
- Critical Tokens Matter: Token-Level Contrastive Estimation Enhances LLM’s Reasoning CapabilityPoster14 citations
- Graph-constrained Reasoning: Faithful Reasoning on Knowledge Graphs with Large Language ModelsPoster14 citations
- MoH: Multi-Head Attention as Mixture-of-Head AttentionPoster14 citations
- Reward-Guided Speculative Decoding for Efficient LLM ReasoningPoster14 citations
- WMAdapter: Adding WaterMark Control to Latent Diffusion ModelsPoster14 citations
- Why Has Predicting Downstream Capabilities of Frontier AI Models with Scale Remained Elusive?Poster14 citations
- FlowAR: Scale-wise Autoregressive Image Generation Meets Flow MatchingPoster13 citations
- Learning to Plan & Reason for Evaluation with Thinking-LLM-as-a-JudgePoster13 citations
- Look Twice Before You Answer: Memory-Space Visual Retracing for Hallucination Mitigation in Multimodal Large Language ModelsPoster13 citations
- MATH-Perturb: Benchmarking LLMs' Math Reasoning Abilities against Hard PerturbationsPoster13 citations
- MM-RLHF: The Next Step Forward in Multimodal LLM AlignmentPoster13 citations
- NETS: A Non-equilibrium Transport SamplerPoster13 citations
- SWE-Lancer: Can Frontier LLMs Earn $1 Million from Real-World Freelance Software Engineering?Oral13 citations
- Shortcut-connected Expert Parallelism for Accelerating Mixture of ExpertsPoster13 citations
- Addressing Misspecification in Simulation-based Inference through Data-driven CalibrationOral12 citations
- AxBench: Steering LLMs? Even Simple Baselines Outperform Sparse AutoencodersSpotlight12 citations
- Parrot: Multilingual Visual Instruction TuningPoster12 citations
- SANA 1.5: Efficient Scaling of Training-Time and Inference-Time Compute in Linear Diffusion TransformerPoster12 citations
- Aligning with Logic: Measuring, Evaluating and Improving Logical Preference Consistency in Large Language ModelsSpotlight11 citations
- Context is Key: A Benchmark for Forecasting with Essential Textual InformationPoster11 citations
- Hi Robot: Open-Ended Instruction Following with Hierarchical Vision-Language-Action ModelsPoster11 citations
- Learning Adversarial MDPs with Stochastic Hard ConstraintsPoster11 citations
- One-Step Diffusion Policy: Fast Visuomotor Policies via Diffusion DistillationPoster11 citations
- Proposer-Agent-Evaluator (PAE): Autonomous Skill Discovery For Foundation Model Internet AgentsPoster11 citations
- Sparse Video-Gen: Accelerating Video Diffusion Transformers with Spatial-Temporal SparsityPoster11 citations
- Star Attention: Efficient LLM Inference over Long SequencesPoster11 citations
- Contrastive Localized Language-Image Pre-TrainingPoster10 citations
- Diffusion Adversarial Post-Training for One-Step Video GenerationPoster10 citations
- Editable Concept Bottleneck ModelsPoster10 citations
- EmbodiedBench: Comprehensive Benchmarking Multi-modal Large Language Models for Vision-Driven Embodied AgentsOral10 citations
- Mechanistic Unlearning: Robust Knowledge Unlearning and Editing via Mechanistic LocalizationSpotlight10 citations
- Subobject-level Image TokenizationPoster10 citations
- Token Assorted: Mixing Latent and Text Tokens for Improved Language Model ReasoningPoster10 citations
- A Manifold Perspective on the Statistical Generalization of Graph Neural NetworksPoster9 citations
- A Trichotomy for List Transductive Online LearningPoster9 citations
- An analytic theory of creativity in convolutional diffusion modelsOral9 citations
- Audio Flamingo 2: An Audio-Language Model with Long-Audio Understanding and Expert Reasoning AbilitiesPoster9 citations
- EARTH: Epidemiology-Aware Neural ODE with Continuous Disease Transmission GraphPoster9 citations
- Learn from Downstream and Be Yourself in Multimodal Large Language Models Fine-TuningPoster9 citations
- Normalizing Flows are Capable Generative ModelsOral9 citations
- Programming Every Example: Lifting Pre-training Data Quality Like Experts at ScalePoster9 citations
- Self-Consistency Preference OptimizationPoster9 citations
- The dark side of the forces: assessing non-conservative force models for atomistic machine learningOral9 citations
- Video Prediction Policy: A Generalist Robot Policy with Predictive Visual RepresentationsSpotlight9 citations
- AnyEdit: Edit Any Knowledge Encoded in Language ModelsPoster8 citations
- Automated Red Teaming with GOAT: the Generative Offensive Agent TesterPoster8 citations
- Cavia: Camera-controllable Multi-view Video Diffusion with View-Integrated AttentionPoster8 citations
- CodeIO: Condensing Reasoning Patterns via Code Input-Output PredictionOral8 citations
- Collapse or Thrive: Perils and Promises of Synthetic Data in a Self-Generating WorldPoster8 citations
- Compute or Load KV Cache? Why Not Both?Poster8 citations
- Distillation Scaling LawsPoster8 citations
- Diverging Preferences: When do Annotators Disagree and do Models Know?Poster8 citations
- Flow-field inference from neural data using deep recurrent networksPoster8 citations
- How to set AdamW's weight decay as you scale model and dataset sizePoster8 citations
- KAN-AD: Time Series Anomaly Detection with Kolmogorov–Arnold NetworksPoster8 citations
- Limitations of measure-first protocols in quantum machine learningPoster8 citations
- Masked Autoencoders Are Effective Tokenizers for Diffusion ModelsSpotlight8 citations
- Modular Duality in Deep LearningPoster8 citations
- Optimizing Large Language Model Training Using FP4 QuantizationPoster8 citations
- Orthus: Autoregressive Interleaved Image-Text Generation with Modality-Specific HeadsPoster8 citations
- Scaling Test-Time Compute Without Verification or RL is SuboptimalSpotlight8 citations
- Selective Prompt Anchoring for Code GenerationPoster8 citations
- Understanding Mode Connectivity via Parameter Space SymmetryPoster8 citations
- VideoJAM: Joint Appearance-Motion Representations for Enhanced Motion Generation in Video ModelsOral8 citations
- Wyckoff Transformer: Generation of Symmetric CrystalsPoster8 citations
- Adaptive Message Passing: A General Framework to Mitigate Oversmoothing, Oversquashing, and UnderreachingPoster7 citations
- Adversaries Can Misuse Combinations of Safe ModelsPoster7 citations
- AlphaVerus: Bootstrapping Formally Verified Code Generation through Self-Improving Translation and TreefinementPoster7 citations
- Autoformulation of Mathematical Optimization Models Using LLMsPoster7 citations
- DreamDPO: Aligning Text-to-3D Generation with Human Preferences via Direct Preference OptimizationPoster7 citations
- Geometry-Informed Neural NetworksPoster7 citations
- No-Regret is not enough! Bandits with General Constraints through Adaptive Regret MinimizationPoster7 citations
- NoLiMa: Long-Context Evaluation Beyond Literal MatchingPoster7 citations
- Synthetic Face Datasets Generation via Latent Space Exploration from Brownian Identity DiffusionPoster7 citations
- TabPFN Unleashed: A Scalable and Effective Solution to Tabular Classification ProblemsPoster7 citations
- Think Smarter not Harder: Adaptive Reasoning with Inference Aware OptimizationPoster7 citations
- ZebraLogic: On the Scaling Limits of LLMs for Logical ReasoningPoster7 citations
- A Physics-Informed Machine Learning Framework for Safe and Optimal Control of Autonomous SystemsPoster6 citations
- AdaptiveStep: Automatically Dividing Reasoning Step through Model ConfidencePoster6 citations
- Alpha-SQL: Zero-Shot Text-to-SQL using Monte Carlo Tree SearchPoster6 citations
- CTBench: A Library and Benchmark for Certified TrainingPoster6 citations
- Clients Collaborate: Flexible Differentially Private Federated Learning with Guaranteed Improvement of Utility-Privacy Trade-offPoster6 citations
- Discrete Neural Algorithmic ReasoningPoster6 citations
- EasyRef: Omni-Generalized Group Image Reference for Diffusion Models via Multimodal LLMPoster6 citations
- Emergence in non-neural models: grokking modular arithmetic via average gradient outer productOral6 citations
- FACTER: Fairness-Aware Conformal Thresholding and Prompt Engineering for Enabling Fair LLM-Based Recommender SystemsPoster6 citations
- History-Guided Video DiffusionPoster6 citations
- Learning Smooth and Expressive Interatomic Potentials for Physical Property PredictionOral6 citations
- Learnings from Scaling Visual Tokenizers for Reconstruction and GenerationPoster6 citations
- Leveraging Online Olympiad-Level Math Problems for LLMs Training and Contamination-Resistant EvaluationPoster6 citations
- Mastering Board Games by External and Internal Planning with Language ModelsSpotlight6 citations
- Memory Layers at ScalePoster6 citations
- Model Swarms: Collaborative Search to Adapt LLM Experts via Swarm IntelligencePoster6 citations
- Multi-Session Budget Optimization for Forward Auction-based Federated LearningPoster6 citations
- Multi-agent Architecture Search via Agentic SupernetOral6 citations
- Parameters vs FLOPs: Scaling Laws for Optimal Sparsity for Mixture-of-Experts Language ModelsPoster6 citations
- Position: Language model developers should report train-test overlapSpotlight6 citations
- QLASS: Boosting Language Agent Inference via Q-Guided Stepwise SearchPoster6 citations
- QMamba: On First Exploration of Vision Mamba for Image Quality AssessmentPoster6 citations
- Reducing Tool Hallucination via Reliability AlignmentPoster6 citations
- Self-Discriminative Modeling for Anomalous Graph DetectionPoster6 citations
- SepLLM: Accelerate Large Language Models by Compressing One Segment into One SeparatorPoster6 citations
- ShadowKV: KV Cache in Shadows for High-Throughput Long-Context LLM InferenceSpotlight6 citations
- Step-DAD: Semi-Amortized Policy-Based Bayesian Experimental DesignPoster6 citations
- Subspace Optimization for Large Language Models with Convergence GuaranteesPoster6 citations
- TabICL: A Tabular Foundation Model for In-Context Learning on Large DataPoster6 citations
- Understanding Chain-of-Thought in LLMs through Information TheoryPoster6 citations
- Universal Length Generalization with Turing ProgramsPoster6 citations
- ViTally Consistent: Scaling Biological Representation Learning for Cell MicroscopyPoster6 citations
- Where is the Truth? The Risk of Getting Confounded in a Continual WorldSpotlight6 citations
- Which Attention Heads Matter for In-Context Learning?Poster6 citations
- Zero-Shot Generalization of GNNs over Distinct Attribute DomainsPoster6 citations
- Beyond Log-Concavity and Score Regularity: Improved Convergence Bounds for Score-Based Generative Models in W2-distancePoster5 citations
- Causal Discovery from Conditionally Stationary Time SeriesPoster5 citations
- Compress then Serve: Serving Thousands of LoRA Adapters with Little OverheadPoster5 citations
- Dissecting Submission Limit in Desk-Rejections: A Mathematical Analysis of Fairness in AI Conference PoliciesPoster5 citations
- Distilling the Knowledge in Data PruningPoster5 citations
- Dueling Convex Optimization with General PreferencesPoster5 citations
- EQ-VAE: Equivariance Regularized Latent Space for Improved Generative Image ModelingPoster5 citations
- EVOLvE: Evaluating and Optimizing LLMs For In-Context ExplorationPoster5 citations
- Efficient Time Series Processing for Transformers and State-Space Models through Token MergingPoster5 citations
- Fast Video Generation with Sliding Tile AttentionPoster5 citations
- Ferret: Federated Full-Parameter Tuning at Scale for Large Language ModelsPoster5 citations
- Fixing the Double Penalty in Data-Driven Weather Forecasting Through a Modified Spherical Harmonic Loss FunctionPoster5 citations
- FlatQuant: Flatness Matters for LLM QuantizationPoster5 citations
- From Language Models over Tokens to Language Models over CharactersSpotlight5 citations
- From Mechanistic Interpretability to Mechanistic Biology: Training, Evaluating, and Interpreting Sparse Autoencoders on Protein Language ModelsSpotlight5 citations
- From RAG to Memory: Non-Parametric Continual Learning for Large Language ModelsPoster5 citations
- FunBO: Discovering Acquisition Functions for Bayesian Optimization with FunSearchPoster5 citations
- HealthGPT: A Medical Large Vision-Language Model for Unifying Comprehension and Generation via Heterogeneous Knowledge AdaptationSpotlight5 citations
- Improving LLMs for Recommendation with Out-Of-Vocabulary TokensPoster5 citations
- LMAct: A Benchmark for In-Context Imitation Learning with Long Multimodal DemonstrationsPoster5 citations
- Layer by Layer: Uncovering Hidden Representations in Language ModelsOral5 citations
- MARS: Unleashing the Power of Variance Reduction for Training Large ModelsPoster5 citations
- MAS-GPT: Training LLMs to Build LLM-based Multi-Agent SystemsPoster5 citations
- MedRAX: Medical Reasoning Agent for Chest X-rayPoster5 citations
- Metadata Conditioning Accelerates Language Model Pre-trainingPoster5 citations
- Monte Carlo Tree Search for Comprehensive Exploration in LLM-Based Automatic Heuristic DesignPoster5 citations
- OTTER: A Vision-Language-Action Model with Text-Aware Visual Feature ExtractionPoster5 citations
- On Temperature Scaling and Conformal Prediction of Deep ClassifiersPoster5 citations
- On the Vulnerability of Applying Retrieval-Augmented Generation within Knowledge-Intensive Application DomainsPoster5 citations
- P(all-atom) Is Unlocking New Path For Protein DesignSpotlight5 citations
- PaperBench: Evaluating AI’s Ability to Replicate AI ResearchPoster5 citations
- PertEval-scFM: Benchmarking Single-Cell Foundation Models for Perturbation Effect PredictionPoster5 citations
- Raising the Bar: Investigating the Values of Large Language Models via Generative Evolving TestingPoster5 citations
- SAM2Act: Integrating Visual Foundation Model with A Memory Architecture for Robotic ManipulationPoster5 citations
- SAeUron: Interpretable Concept Unlearning in Diffusion Models with Sparse AutoencodersPoster5 citations
- SK-VQA: Synthetic Knowledge Generation at Scale for Training Context-Augmented Multimodal LLMsOral5 citations
- Sample, Scrutinize and Scale: Effective Inference-Time Search by Scaling VerificationPoster5 citations
- Scaling Laws for Pre-training Agents and World ModelsPoster5 citations
- Stochastic Deep Restoration Priors for Imaging Inverse ProblemsPoster5 citations
- Textual Unlearning Gives a False Sense of UnlearningPoster5 citations
- The Best of Both Worlds: Bridging Quality and Diversity in Data Selection with Bipartite GraphPoster5 citations
- The Brain's Bitter Lesson: Scaling Speech Decoding With Self-Supervised LearningPoster5 citations
- Annealing Flow Generative Models Towards Sampling High-Dimensional and Multi-Modal DistributionsPoster4 citations
- Are Sparse Autoencoders Useful? A Case Study in Sparse ProbingPoster4 citations
- Auditing $f$-differential privacy in one runOral4 citations
- Beyond Matryoshka: Revisiting Sparse Coding for Adaptive RepresentationOral4 citations
- Bring Reason to Vision: Understanding Perception and Reasoning through Model MergingPoster4 citations
- Can MLLMs Reason in Multimodality? EMMA: An Enhanced MultiModal ReAsoning BenchmarkOral4 citations
- DEFAME: Dynamic Evidence-based FAct-checking with Multimodal ExpertsPoster4 citations
- Demystifying Cost-Efficiency in LLM Serving over Heterogeneous GPUsPoster4 citations
- EpiCoder: Encompassing Diversity and Complexity in Code GenerationPoster4 citations
- EraseAnything: Enabling Concept Erasure in Rectified Flow TransformersPoster4 citations
- Evaluating Judges as Evaluators: The JETTS Benchmark of LLM-as-Judges as Test-Time Scaling EvaluatorsPoster4 citations
- Exploring and Mitigating Adversarial Manipulation of Voting-Based LeaderboardsOral4 citations
- FireFlow: Fast Inversion of Rectified Flow for Image Semantic EditingPoster4 citations
- Fourier Position Embedding: Enhancing Attention’s Periodic Extension for Length GeneralizationPoster4 citations
- Generalizing from SIMPLE to HARD Visual Reasoning: Can We Mitigate Modality Imbalance in VLMs?Poster4 citations
- GeoPixel: Pixel Grounding Large Multimodal Model in Remote SensingPoster4 citations
- Gradient Boosting Reinforcement LearningPoster4 citations
- How to Synthesize Text Data without Model Collapse?Poster4 citations
- Importance Corrected Neural JKO SamplingPoster4 citations
- Is Noise Conditioning Necessary for Denoising Generative Models?Poster4 citations
- Large Language-Geometry Model: When LLM meets EquivariancePoster4 citations
- Locate-then-edit for Multi-hop Factual Recall under Knowledge EditingPoster4 citations
- Multimodal Medical Code TokenizerPoster4 citations
- Optimizing Adaptive Attacks against Watermarks for Language ModelsSpotlight4 citations
- Orient Anything: Learning Robust Object Orientation Estimation from Rendering 3D ModelsPoster4 citations
- PENCIL: Long Thoughts with Short MemoryPoster4 citations
- Position: LLM Social Simulations Are a Promising Research MethodPoster4 citations
- ReFocus: Visual Editing as a Chain of Thought for Structured Image UnderstandingPoster4 citations
- RealRAG: Retrieval-augmented Realistic Image Generation via Self-reflective Contrastive LearningPoster4 citations
- Rethinking External Slow-Thinking: From Snowball Errors to Probability of Correct ReasoningPoster4 citations
- Ringmaster ASGD: The First Asynchronous SGD with Optimal Time ComplexityPoster4 citations
- Risk and cross validation in ridge regression with correlated samplesPoster4 citations
- Robust Autonomy Emerges from Self-PlayPoster4 citations
- SITCOM: Step-wise Triple-Consistent Diffusion Sampling For Inverse ProblemsPoster4 citations
- SafeArena: Evaluating the Safety of Autonomous Web AgentsPoster4 citations
- Teaching Transformers Causal Reasoning through Axiomatic TrainingPoster4 citations
- TimeBridge: Non-Stationarity Matters for Long-term Time Series ForecastingPoster4 citations
- TopoTune: A Framework for Generalized Combinatorial Complex Neural NetworksPoster4 citations
- Towards Black-Box Membership Inference Attack for Diffusion ModelsPoster4 citations
- Train for the Worst, Plan for the Best: Understanding Token Ordering in Masked DiffusionsOral4 citations
- Training Deep Learning Models with Norm-Constrained LMOsSpotlight4 citations
- Universal Sparse Autoencoders: Interpretable Cross-Model Concept AlignmentPoster4 citations
- VersaPRM: Multi-Domain Process Reward Model via Synthetic Reasoning DataOral4 citations
- A Hitchhiker's Guide to Scaling Law EstimationPoster3 citations
- A Large Recurrent Action Model: xLSTM enables Fast Inference for Robotics TasksPoster3 citations
- A Simple Model of Inference Scaling LawsPoster3 citations
- AdaWorld: Learning Adaptable World Models with Latent ActionsPoster3 citations
- Adaptive Learn-then-Test: Statistically Valid and Efficient Hyperparameter SelectionSpotlight3 citations
- AffectGPT: A New Dataset, Model, and Benchmark for Emotion Understanding with Multimodal Large Language ModelsOral3 citations
- Bongard in Wonderland: Visual Puzzles that Still Make AI Go Mad?Poster3 citations
- CaDA: Cross-Problem Routing Solver with Constraint-Aware Dual-AttentionPoster3 citations
- Commute Graph Neural NetworksPoster3 citations
- Complex Wavelet Mutual Information Loss: A Multi-Scale Loss Function for Semantic SegmentationPoster3 citations
- Compositional Risk MinimizationPoster3 citations
- Contextual Bandits for Unbounded Context DistributionsPoster3 citations
- DSP: Dynamic Sequence Parallelism for Multi-Dimensional TransformersPoster3 citations
- DeFoG: Discrete Flow Matching for Graph GenerationOral3 citations
- Decision Making under the Exponential Family: Distributionally Robust Optimisation with Bayesian Ambiguity SetsSpotlight3 citations
- Decision Theoretic Foundations for Conformal Prediction: Optimal Uncertainty Quantification for Risk-Averse AgentsSpotlight3 citations
- Deliberation in Latent Space via Differentiable Cache AugmentationPoster3 citations
- Diffusion models for Gaussian distributions: Exact solutions and Wasserstein errorsPoster3 citations
- Disentangling and Integrating Relational and Sensory Information in Transformer ArchitecturesPoster3 citations
- Distributed Event-Based Learning via ADMMPoster3 citations
- Distributional Diffusion Models with Scoring RulesPoster3 citations
- Does Graph Prompt Work? A Data Operation Perspective with Theoretical AnalysisPoster3 citations
- Doubly Robust Conformalized Survival Analysis with Right-Censored DataSpotlight3 citations
- EasyInv: Toward Fast and Better DDIM InversionPoster3 citations
- Eliciting Language Model Behaviors with Investigator AgentsPoster3 citations
- Elucidating the design space of language models for image generationPoster3 citations
- Emergent Symbolic Mechanisms Support Abstract Reasoning in Large Language ModelsPoster3 citations
- Everything Everywhere All at Once: LLMs can In-Context Learn Multiple Tasks in SuperpositionSpotlight3 citations
- ExPLoRA: Parameter-Efficient Extended Pre-Training to Adapt Vision Transformers under Domain ShiftsPoster3 citations
- GenMol: A Drug Discovery Generalist with Discrete DiffusionPoster3 citations
- Guardians of Image Quality: Benchmarking Defenses Against Adversarial Attacks on Image Quality MetricsPoster3 citations
- HashAttention: Semantic Sparsity for Faster InferencePoster3 citations
- Hyperband-based Bayesian Optimization for Black-box Prompt SelectionPoster3 citations
- Improving LLM Safety Alignment with Dual-Objective OptimizationPoster3 citations
- Improving Your Model Ranking on Chatbot Arena by Vote RiggingPoster3 citations
- In-Context Learning and Occam's RazorPoster3 citations
- InfAlign: Inference-aware language model alignmentPoster3 citations
- KBQA-o1: Agentic Knowledge Base Question Answering with Monte Carlo Tree SearchPoster3 citations
- Lexico: Extreme KV Cache Compression via Sparse Coding over Universal DictionariesPoster3 citations
- LightningDrag: Lightning Fast and Accurate Drag-based Image Editing Emerging from VideosPoster3 citations
- MENTOR: Mixture-of-Experts Network with Task-Oriented Perturbation for Visual Reinforcement LearningPoster3 citations
- MMedPO: Aligning Medical Vision-Language Models with Clinical-Aware Multimodal Preference OptimizationPoster3 citations
- Machines and Mathematical Mutations: Using GNNs to Characterize Quiver Mutation ClassesPoster3 citations
- Mechanisms of Projective Composition of Diffusion ModelsPoster3 citations
- MetaOptimize: A Framework for Optimizing Step Sizes and Other Meta-parametersPoster3 citations
- Metastable Dynamics of Chain-of-Thought Reasoning: Provable Benefits of Search, RL and DistillationPoster3 citations
- MiraGe: Editable 2D Images using Gaussian SplattingPoster3 citations
- Mitigating Heterogeneous Token Overfitting in LLM Knowledge EditingPoster3 citations
- Modeling Multi-Task Model Merging as Adaptive Projective Gradient DescentPoster3 citations
- Monte Carlo Tree Diffusion for System 2 PlanningSpotlight3 citations
- Monte-Carlo Tree Search with Uncertainty Propagation via Optimal TransportSpotlight3 citations
- Objective drives the consistency of representational similarity across datasetsPoster3 citations
- One Example Shown, Many Concepts Known! Counterexample-Driven Conceptual Reasoning in Mathematical LLMsPoster3 citations
- Optimizing Temperature for Language Models with Multi-Sample InferencePoster3 citations
- OrcaLoca: An LLM Agent Framework for Software Issue LocalizationPoster3 citations
- Parameter-Efficient Fine-Tuning of State Space ModelsPoster3 citations
- Point-Level Topological Representation Learning on Point CloudsPoster3 citations
- Position: Deep Learning is Not So Mysterious or DifferentSpotlight3 citations
- Position: Editing Large Language Models Poses Serious Safety RisksPoster3 citations
- ReQFlow: Rectified Quaternion Flow for Efficient and High-Quality Protein Backbone GenerationPoster3 citations
- ReVISE: Learning to Refine at Test-Time via Intrinsic Self-VerificationPoster3 citations
- Reasoning Limitations of Multimodal Large Language Models. A case study of Bongard ProblemsPoster3 citations
- Reasoning-as-Logic-Units: Scaling Test-Time Reasoning in Large Language Models Through Logic Unit AlignmentPoster3 citations
- Scaling Laws for Task-Optimized Models of the Primate Visual Ventral StreamSpotlight3 citations
- Scaling Laws in Patchification: An Image Is Worth 50,176 Tokens And MorePoster3 citations
- Sundial: A Family of Highly Capable Time Series Foundation ModelsOral3 citations
- Test-Time Preference Optimization: On-the-Fly Alignment via Iterative Textual FeedbackPoster3 citations
- Time-VLM: Exploring Multimodal Vision-Language Models for Augmented Time Series ForecastingPoster3 citations
- Toward a Unified Theory of Gradient Descent under Generalized SmoothnessPoster3 citations
- Towards flexible perception with visual memoryPoster3 citations
- Understanding Model Ensemble in Transferable Adversarial AttackPoster3 citations
- Understanding the Emergence of Multimodal Representation AlignmentPoster3 citations
- video-SALMONN-o1: Reasoning-enhanced Audio-visual Large Language ModelPoster3 citations
- A Theoretical Framework For Overfitting In Energy-based ModelingPoster2 citations
- A Unified Approach to Routing and Cascading for LLMsPoster2 citations
- AGAV-Rater: Adapting Large Multimodal Model for AI-Generated Audio-Visual Quality AssessmentPoster2 citations
- Adaptive kernel predictors from feature-learning infinite limits of neural networksPoster2 citations
- AdvI2I: Adversarial Image Attack on Image-to-Image Diffusion ModelsPoster2 citations
- Archetypal SAE: Adaptive and Stable Dictionary Learning for Concept Extraction in Large Vision ModelsPoster2 citations
- AutoAdvExBench: Benchmarking Autonomous Exploitation of Adversarial Example DefensesOral2 citations
- AutoElicit: Using Large Language Models for Expert Prior Elicitation in Predictive ModellingPoster2 citations
- AutoStep: Locally adaptive involutive MCMCPoster2 citations
- BaxBench: Can LLMs Generate Correct and Secure Backends?Spotlight2 citations
- Benchmarking Quantum Reinforcement LearningPoster2 citations
- Best of Both Worlds: Advantages of Hybrid Graph Sequence ModelsPoster2 citations
- CVE-Bench: A Benchmark for AI Agents’ Ability to Exploit Real-World Web Application VulnerabilitiesSpotlight2 citations
- Clone-Robust AI AlignmentPoster2 citations
- CoSER: Coordinating LLM-Based Persona Simulation of Established RolesPoster2 citations
- CodeSteer: Symbolic-Augmented Language Models via Code/Text GuidancePoster2 citations
- Compression via Pre-trained Transformers: A Study on Byte-Level Multimodal DataPoster2 citations
- CtrlSynth: Controllable Image Text Synthesis for Data-Efficient Multimodal LearningPoster2 citations
- De-mark: Watermark Removal in Large Language ModelsPoster2 citations
- Dimension-Independent Rates for Structured Neural Density EstimationPoster2 citations
- Do Vision-Language Models Really Understand Visual Language?Poster2 citations
- Do We Need to Verify Step by Step? Rethinking Process Supervision from a Theoretical PerspectivePoster2 citations
- Does learning the right latent variables necessarily improve in-context learning?Poster2 citations
- Doubly Protected Estimation for Survival Outcomes Utilizing External Controls for Randomized Clinical TrialsPoster2 citations
- ESPFormer: Doubly-Stochastic Attention with Expected Sliced Transport PlansPoster2 citations
- Enhancing Foundation Models for Time Series Forecasting via Wavelet-based TokenizationPoster2 citations
- Enhancing Performance of Explainable AI Models with Constrained Concept RefinementPoster2 citations
- Enhancing Statistical Validity and Power in Hybrid Controlled Trials: A Randomization Inference Approach with Conformal Selective BorrowingPoster2 citations
- Event-Customized Image GenerationPoster2 citations
- Expressive Power of Graph Neural Networks for (Mixed-Integer) Quadratic ProgramsPoster2 citations
- Feynman-Kac Correctors in Diffusion: Annealing, Guidance, and Product of ExpertsSpotlight2 citations
- From Individual Experience to Collective Evidence: A Reporting-Based Framework for Identifying Systemic HarmsPoster2 citations
- G-Adaptivity: optimised graph-based mesh relocation for finite element methodsSpotlight2 citations
- Graph Generative Pre-trained TransformerPoster2 citations
- Guarantees of a Preconditioned Subgradient Algorithm for Overparameterized Asymmetric Low-rank Matrix RecoveryPoster2 citations
- Haste Makes Waste: A Simple Approach for Scaling Graph Neural NetworksPoster2 citations
- Hierarchical Equivariant Policy via Frame TransferPoster2 citations
- Idiosyncrasies in Large Language ModelsPoster2 citations
- Implicit degree bias in the link prediction taskPoster2 citations
- Improved Off-policy Reinforcement Learning in Biological Sequence DesignPoster2 citations
- Interpolating Neural Network-Tensor Decomposition (INN-TD): a scalable and interpretable approach for large-scale physics-based problemsPoster2 citations
- Is Best-of-N the Best of Them? Coverage, Scaling, and Optimality in Inference-Time AlignmentPoster2 citations
- Joint Learning of Energy-based Models and their Partition FunctionPoster2 citations
- KV Shifting Attention Enhances Language ModelingPoster2 citations
- LASER: Attention with Exponential TransformationPoster2 citations
- LLM-SRBench: A New Benchmark for Scientific Equation Discovery with Large Language ModelsOral2 citations
- LOGO --- Long cOntext aliGnment via efficient preference OptimizationPoster2 citations
- Latent Preference Coding: Aligning Large Language Models via Discrete Latent CodesPoster2 citations
- Learning Distances from Data with Normalizing Flows and Score MatchingPoster2 citations
- Learning Multi-Level Features with Matryoshka Sparse AutoencodersPoster2 citations
- Learning With Multi-Group Guarantees For Clusterable SubpopulationsPoster2 citations
- Learning multivariate Gaussians with imperfect advicePoster2 citations
- Linear Contextual Bandits With InterferencePoster2 citations
- Linearization Turns Neural Operators into Function-Valued Gaussian ProcessesSpotlight2 citations
- Long-Form Speech Generation with Spoken Language ModelsOral2 citations
- Lower Bounds for Chain-of-Thought Reasoning in Hard-Attention TransformersPoster2 citations
- MERGE$^3$: Efficient Evolutionary Merging on Consumer-grade GPUsPoster2 citations
- Measuring Diversity: Axioms and ChallengesPoster2 citations
- MoHAVE: Mixture of Hierarchical Audio-Visual Experts for Robust Speech RecognitionPoster2 citations
- MuLan: Adapting Multilingual Diffusion Models for Hundreds of Languages with Negligible CostPoster2 citations
- Multi-Domain Graph Foundation Models: Robust Knowledge Transfer via Topology AlignmentPoster2 citations
- Nearly Optimal Algorithms for Contextual Dueling Bandits from Adversarial FeedbackPoster2 citations
- Neural Genetic Search in Discrete SpacesPoster2 citations
- Observation Interference in Partially Observable Assistance GamesPoster2 citations
- On Expressive Power of Looped Transformers: Theoretical Analysis and Enhancement via Timestep EncodingPoster2 citations
- On-Device Collaborative Language Modeling via a Mixture of Generalists and SpecialistsPoster2 citations
- Online Learning with Unknown ConstraintsPoster2 citations
- Optimal transport-based conformal predictionPoster2 citations
- Over-Tokenized Transformer: Vocabulary is Generally Worth ScalingPoster2 citations
- Parametric Scaling Law of Tuning Bias in Conformal PredictionPoster2 citations
- PepTune: De Novo Generation of Therapeutic Peptides with Multi-Objective-Guided Discrete DiffusionPoster2 citations
- Persistent Topological Features in Large Language ModelsPoster2 citations
- Polynomial Time Learning Augmented Algorithms for NP-hard Permutation ProblemsPoster2 citations
- Position: Scaling LLM Agents Requires Asymptotic Analysis with LLM PrimitivesPoster2 citations
- Principled Data Selection for Alignment: The Hidden Risks of Difficult ExamplesPoster2 citations
- Probing Visual Language Priors in VLMsPoster2 citations
- Provably Efficient Exploration in Inverse Constrained Reinforcement LearningPoster2 citations
- Puzzle: Distillation-Based NAS for Inference-Optimized LLMsPoster2 citations
- QT-DoG: Quantization-Aware Training for Domain GeneralizationPoster2 citations
- ROPO: Robust Preference Optimization for Large Language ModelsPoster2 citations
- Reflection-Window Decoding: Text Generation with Selective RefinementPoster2 citations
- Regularized Langevin Dynamics for Combinatorial OptimizationPoster2 citations
- Reinforced Lifelong Editing for Language ModelsPoster2 citations
- Reliable and Efficient Amortized Model-based EvaluationPoster2 citations
- RepoAudit: An Autonomous LLM-Agent for Repository-Level Code AuditingPoster2 citations
- ResearchTown: Simulator of Human Research CommunityPoster2 citations
- Rethinking Aleatoric and Epistemic UncertaintyPoster2 citations
- Retraining with Predicted Hard Labels Provably Increases Model AccuracyPoster2 citations
- Revolve: Optimizing AI Systems by Tracking Response Evolution in Textual OptimizationPoster2 citations
- Reward Modeling with Ordinal Feedback: Wisdom of the CrowdPoster2 citations
- Reward-Augmented Data Enhances Direct Preference Alignment of LLMsPoster2 citations
- Robust Conformal Outlier Detection under Contaminated Reference DataPoster2 citations
- SENSEI: Semantic Exploration Guided by Foundation Models to Learn Versatile World ModelsPoster2 citations
- SPHINX: Structural Prediction using Hypergraph Inference NetworkPoster2 citations
- STAIR: Improving Safety Alignment with Introspective ReasoningOral2 citations
- Satori: Reinforcement Learning with Chain-of-Action-Thought Enhances LLM Reasoning via Autoregressive SearchPoster2 citations
- Scalable Equilibrium Sampling with Sequential Boltzmann GeneratorsPoster2 citations
- Scaling Laws for Differentially Private Language ModelsPoster2 citations
- Self-Improving Transformers Overcome Easy-to-Hard and Length Generalization ChallengesPoster2 citations
- Sliding Puzzles Gym: A Scalable Benchmark for State Representation in Visual Reinforcement LearningPoster2 citations
- SongGen: A Single Stage Auto-regressive Transformer for Text-to-Song GenerationPoster2 citations
- Stochastic Online Conformal Prediction with Semi-Bandit FeedbackPoster2 citations
- Structured Preconditioners in Adaptive Optimization: A Unified AnalysisPoster2 citations
- TabFlex: Scaling Tabular Learning to Millions with Linear AttentionSpotlight2 citations
- Teaching Language Models to Critique via Reinforcement LearningPoster2 citations
- The Double-Ellipsoid Geometry of CLIPPoster2 citations
- Thermalizer: Stable autoregressive neural emulation of spatiotemporal chaosPoster2 citations
- Tool Unlearning for Tool-Augmented LLMsPoster2 citations
- UGPhysics: A Comprehensive Benchmark for Undergraduate Physics Reasoning with Large Language ModelsPoster2 citations
- UP-VLA: A Unified Understanding and Prediction Model for Embodied AgentPoster2 citations
- Understanding Multimodal LLMs Under Distribution Shifts: An Information-Theoretic ApproachPoster2 citations
- VideoRoPE: What Makes for Good Video Rotary Position Embedding?Oral2 citations
- Wasserstein Flow Matching: Generative Modeling Over Families of DistributionsPoster2 citations
- Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent SystemsSpotlight2 citations
- X-Hacking: The Threat of Misguided AutoMLPoster2 citations
- Zebra: In-Context Generative Pretraining for Solving Parametric PDEsPoster2 citations
- Zero-Inflated BanditsPoster2 citations
- (How) Do Language Models Track State?Poster1 citations
- A Dynamical Systems-Inspired Pruning Strategy for Addressing Oversmoothing in Graph Attention NetworksPoster1 citations
- A Market for Accuracy: Classification Under CompetitionPoster1 citations
- A Memory Efficient Randomized Subspace Optimization Method for Training Large Language ModelsPoster1 citations
- A Meta-learner for Heterogeneous Effects in Difference-in-DifferencesPoster1 citations
- A Model of Place Field Reorganization During Reward MaximizationPoster1 citations
- A Theoretical Justification for Asymmetric Actor-Critic AlgorithmsPoster1 citations
- A Two-Stage Learning-to-Defer Approach for Multi-Task LearningPoster1 citations
- A Unified Comparative Study with Generalized Conformity Scores for Multi-Output Conformal RegressionPoster1 citations
- A Unified Framework for Entropy Search and Expected Improvement in Bayesian OptimizationOral1 citations
- A Unified View on Learning Unnormalized Distributions via Noise-Contrastive EstimationPoster1 citations
- Accelerated Diffusion Models via Speculative SamplingPoster1 citations
- Activation by Interval-wise Dropout: A Simple Way to Prevent Neural Networks from Plasticity LossPoster1 citations
- Active Evaluation Acquisition for Efficient LLM BenchmarkingPoster1 citations
- Active Learning of Deep Neural Networks via Gradient-Free Cutting PlanesPoster1 citations
- Adapting While Learning: Grounding LLMs for Scientific Problems with Tool Usage AdaptationPoster1 citations
- Adaptive Exploration for Multi-Reward Multi-Policy EvaluationPoster1 citations
- Adjustment for Confounding using Pre-Trained RepresentationsPoster1 citations
- Adversarial Reasoning at Jailbreaking TimePoster1 citations
- Adversarial Robustness in Two-Stage Learning-to-Defer: Algorithms and GuaranteesPoster1 citations
- Aligned Multi Objective OptimizationPoster1 citations
- An Analysis for Reasoning Bias of Language Models with Small InitializationSpotlight1 citations
- Arbitrarily-Conditioned Multi-Functional Diffusion for Multi-Physics EmulationPoster1 citations
- AsymRnR: Video Diffusion Transformers Acceleration with Asymmetric Reduction and RestorationPoster1 citations
- Automated Benchmark Generation for Repository-Level Coding TasksPoster1 citations
- Automated Hypothesis Validation with Agentic Sequential FalsificationsPoster1 citations
- Automatic Differentiation of Optimization Algorithms with Time-Varying UpdatesPoster1 citations
- Average Certified Radius is a Poor Metric for Randomized SmoothingPoster1 citations
- Avoiding spurious sharpness minimization broadens applicability of SAMPoster1 citations
- BARNN: A Bayesian Autoregressive and Recurrent Neural NetworkPoster1 citations
- BRiTE: Bootstrapping Reinforced Thinking Process to Enhance Language Model ReasoningPoster1 citations
- Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement LearningPoster1 citations
- Beyond Atoms: Enhancing Molecular Pretrained Representations with 3D Space ModelingPoster1 citations
- Beyond CVaR: Leveraging Static Spectral Risk Measures for Enhanced Decision-Making in Distributional Reinforcement LearningPoster1 citations
- Bipartite Ranking From Multiple Labels: On Loss Versus Label AggregationPoster1 citations
- Black-Box Adversarial Attacks on LLM-Based Code CompletionPoster1 citations
- Breaking the Quadratic Barrier: Robust Cardinality Sketches for Adaptive QueriesPoster1 citations
- C-3PO: Compact Plug-and-Play Proxy Optimization to Achieve Human-like Retrieval-Augmented GenerationPoster1 citations
- CROW: Eliminating Backdoors from Large Language Models via Internal Consistency RegularizationPoster1 citations
- Can Diffusion Models Learn Hidden Inter-Feature Rules Behind Images?Poster1 citations
- Can RLHF be More Efficient with Imperfect Reward Models? A Policy Coverage PerspectivePoster1 citations
- Can Transformers Reason Logically? A Study in SAT SolvingPoster1 citations
- Certification for Differentially Private Prediction in Gradient-Based TrainingPoster1 citations
- Chaos Meets Attention: Transformers for Large-Scale Dynamical PredictionPoster1 citations
- Closed-Loop Long-Horizon Robotic Planning via Equilibrium Sequence ModelingPoster1 citations
- CoDy: Counterfactual Explainers for Dynamic GraphsPoster1 citations
- CollabLLM: From Passive Responders to Active CollaboratorsOral1 citations
- Comparing Comparisons: Informative and Easy Human Feedback with Distinguishability QueriesPoster1 citations
- Compositional Causal Reasoning Evaluation in Language ModelsPoster1 citations
- Compressed Image Generation with Denoising Diffusion Codebook ModelsPoster1 citations
- ConceptAttention: Diffusion Transformers Learn Highly Interpretable FeaturesOral1 citations
- Conformal Prediction as Bayesian QuadratureOral1 citations
- Context Matters: Query-aware Dynamic Long Sequence Modeling of Gigapixel ImagesPoster1 citations
- Contextual Online Decision Making with Infinite-Dimensional Functional RegressionPoster1 citations
- Continuous Bayesian Model Selection for Multivariate Causal DiscoveryPoster1 citations
- Contrastive Private Data Synthesis via Weighted Multi-PLM FusionPoster1 citations
- Controlling Neural Collapse Enhances Out-of-Distribution Detection and Transfer LearningPoster1 citations
- Counterfactual Graphical Models: Constraints and InferenceSpotlight1 citations
- CursorCore: Assist Programming through Aligning AnythingPoster1 citations
- DCTdiff: Intriguing Properties of Image Generative Modeling in the DCT SpacePoster1 citations
- DOLPHIN: A Programmable Framework for Scalable Neurosymbolic LearningPoster1 citations
- Deep Bayesian Filter for Bayes-Faithful Data AssimilationPoster1 citations
- Deep Linear Network Training Dynamics from Random Initialization: Data, Width, Depth, and Hyperparameter TransferPoster1 citations
- Demonstration Selection for In-Context Learning via Reinforcement LearningPoster1 citations
- Density Ratio Estimation-based Bayesian Optimization with Semi-Supervised LearningPoster1 citations
- Detecting Strategic Deception with Linear ProbesPoster1 citations
- DiTAR: Diffusion Transformer Autoregressive Modeling for Speech GenerationPoster1 citations
- Dialogue Without Limits: Constant-Sized KV Caches for Extended Response in LLMsPoster1 citations
- Differential Coding for Training-Free ANN-to-SNN ConversionPoster1 citations
- Differential Privacy Under Class Imbalance: Methods and Empirical InsightsPoster1 citations
- Differentially Private BoxplotsPoster1 citations
- Discovering Symbolic Cognitive Models from Human and Animal BehaviorSpotlight1 citations
- Distillation of Discrete Diffusion through Dimensional CorrelationsPoster1 citations
- Distributionally Robust Policy Learning under Concept DriftsPoster1 citations
- Diversity By Design: Leveraging Distribution Matching for Offline Model-Based OptimizationPoster1 citations
- DriveGPT: Scaling Autoregressive Behavior Models for DrivingPoster1 citations
- Edge-Colored Clustering in Hypergraphs: Beyond Minimizing Unsatisfied EdgesPoster1 citations
- Effective and Efficient Masked Image Generation ModelsPoster1 citations
- Efficient Distributed Optimization under Heavy-Tailed NoisePoster1 citations
- Efficient and Scalable Density Functional Theory Hamiltonian Prediction through Adaptive SparsityPoster1 citations
- Efficiently Serving Large Multimodal Models Using EPD DisaggregationPoster1 citations
- Emotional Face-to-SpeechPoster1 citations
- Energy-Based Preference Model Offers Better Offline Alignment than the Bradley-Terry Preference ModelPoster1 citations
- Exact risk curves of signSGD in High-Dimensions: quantifying preconditioning and noise-compression effectsPoster1 citations
- Expected Variational InequalitiesOral1 citations
- Explanatory Instructions: Towards Unified Vision Tasks Understanding and Zero-shot GeneralizationPoster1 citations
- Exploring Representations and Interventions in Time Series Foundation ModelsPoster1 citations
- Extractive Structures Learned in Pretraining Enable Generalization on Finetuned FactsPoster1 citations
- Falsification of Unconfoundedness by Testing Independence of Causal MechanismsPoster1 citations
- Faster Global Minimum Cut with PredictionsPoster1 citations
- Features are fate: a theory of transfer learning in high-dimensional regressionPoster1 citations
- FlexTok: Resampling Images into 1D Token Sequences of Flexible LengthPoster1 citations
- Flexible Tails for Normalizing FlowsPoster1 citations
- Flexible and Efficient Grammar-Constrained DecodingPoster1 citations
- Flow Q-LearningPoster1 citations
- Flow of Reasoning: Training LLMs for Divergent Reasoning with Minimal ExamplesPoster1 citations
- Flow-of-Options: Diversified and Improved LLM Reasoning by Thinking Through OptionsPoster1 citations
- FrameBridge: Improving Image-to-Video Generation with Bridge ModelsPoster1 citations
- From Kernels to Features: A Multi-Scale Adaptive Theory of Feature LearningPoster1 citations
- From Logits to Hierarchies: Hierarchical Clustering made SimplePoster1 citations
- Fully Heteroscedastic Count Regression with Deep Double Poisson NetworksPoster1 citations
- Function-Space Learning RatesPoster1 citations
- Gap-Dependent Bounds for Federated $Q$-LearningPoster1 citations
- General framework for online-to-nonconvex conversion: Schedule-free SGD is also effective for nonconvex optimizationOral1 citations
- Generative Intervention Models for Causal Perturbation ModelingPoster1 citations
- Geometric Representation Condition Improves Equivariant Molecule GenerationSpotlight1 citations
- Gravity-Bench-v1: A Benchmark on Gravitational Physics Discovery for AgentsPoster1 citations
- High-Fidelity Simultaneous Speech-To-Speech TranslationPoster1 citations
- How Much Can We Forget about Data Contamination?Poster1 citations
- Hyper: Hyperparameter Robust Efficient Exploration in Reinforcement LearningPoster1 citations
- Implicit Language Models are RNNs: Balancing Parallelization and ExpressivitySpotlight1 citations
- Impossible VideosPoster1 citations
- Improved Online Confidence Bounds for Multinomial Logistic BanditsPoster1 citations
- Improved Regret Analysis in Gaussian Process Bandits: Optimality for Noiseless Reward, RKHS norm, and Non-Stationary VarianceOral1 citations
- Improved Sample Complexity for Private Nonsmooth Nonconvex OptimizationPoster1 citations
- Improving LLM Video Understanding with 16 Frames Per SecondPoster1 citations
- IntLoRA: Integral Low-rank Adaptation of Quantized Diffusion ModelsPoster1 citations
- Inverse Problem Sampling in Latent Space Using Sequential Monte CarloPoster1 citations
- Is Complex Query Answering Really Complex?Spotlight1 citations
- Isolated Causal Effects of Natural LanguagePoster1 citations
- Joint Metric Space Embedding by Unbalanced Optimal Transport with Gromov–Wasserstein Marginal PenalizationPoster1 citations
- KernelBench: Can LLMs Write Efficient GPU Kernels?Poster1 citations
- Kinetic Langevin Diffusion for Crystalline Materials GenerationPoster1 citations
- LARM: Large Auto-Regressive Model for Long-Horizon Embodied IntelligencePoster1 citations
- LAuReL: Learned Augmented Residual LayerPoster1 citations
- LEAPS: A discrete neural sampler via locally equivariant networksPoster1 citations
- LIVS: A Pluralistic Alignment Dataset for Inclusive Public SpacesPoster1 citations
- LLM Alignment as Retriever Optimization: An Information Retrieval PerspectivePoster1 citations
- LLMs can see and hear without any trainingPoster1 citations
- LOB-Bench: Benchmarking Generative AI for Finance - an Application to Limit Order Book DataPoster1 citations
- LaRA: Benchmarking Retrieval-Augmented Generation and Long-Context LLMs – No Silver Bullet for LC or RAG RoutingPoster1 citations
- Large Language Model-driven Large Neighborhood Search for Large-Scale MILP ProblemsSpotlight1 citations
- Latent Diffusion Planning for Imitation LearningSpotlight1 citations
- Learning Latent Graph Structures and their UncertaintyPoster1 citations
- Learning Representations of Instruments for Partial Identification of Treatment EffectsPoster1 citations
- Learning Strategic Language Agents in the Werewolf Game with Iterative Latent Space Policy OptimizationPoster1 citations
- Learning Utilities from Demonstrations in Markov Decision ProcessesPoster1 citations
- Learning curves theory for hierarchically compositional data with power-law distributed featuresPoster1 citations
- Learning dynamics in linear recurrent neural networksOral1 citations
- Learning from others' mistakes: Finetuning machine translation models with span-level error annotationsPoster1 citations
- Learning the RoPEs: Better 2D and 3D Position Encodings with STRINGSpotlight1 citations
- Lightspeed Geometric Dataset Distance via Sliced Optimal TransportPoster1 citations
- Lightweight Dataset Pruning without Full Training via Example Difficulty and Prediction UncertaintyPoster1 citations
- Lightweight Online Adaption for Time Series Foundation Model ForecastsPoster1 citations
- LoRA Training Provably Converges to a Low-Rank Global Minimum Or It Fails Loudly (But it Probably Won't Fail)Oral1 citations
- Logarithmic Regret for Online KL-Regularized Reinforcement LearningPoster1 citations
- Looking Beyond the Top-1: Transformers Determine Top Tokens in OrderPoster1 citations
- Low-Dimension-to-High-Dimension Generalization and Its Implications for Length GeneralizationPoster1 citations
- MONA: Myopic Optimization with Non-myopic Approval Can Mitigate Multi-step Reward HackingPoster1 citations
- Massive Values in Self-Attention Modules are the Key to Contextual Knowledge UnderstandingPoster1 citations
- MathConstruct: Challenging LLM Reasoning with Constructive ProofsPoster1 citations
- Matryoshka QuantizationPoster1 citations
- Mechanistic PDE Networks for Discovery of Governing EquationsPoster1 citations
- Meta-Black-Box-Optimization through Offline Q-function LearningPoster1 citations
- Mixed-curvature decision trees and random forestsPoster1 citations
- MoE-SVD: Structured Mixture-of-Experts LLMs Compression via Singular Value DecompositionPoster1 citations
- Model-Based Exploration in Monitored Markov Decision ProcessesPoster1 citations
- Multi-Objective Causal Bayesian OptimizationPoster1 citations
- Multiple-policy Evaluation via Density EstimationPoster1 citations
- NBDI: A Simple and Effective Termination Condition for Skill Extraction from Task-Agnostic DemonstrationsPoster1 citations
- NExtLong: Toward Effective Long-Context Training without Long DocumentsPoster1 citations
- Near-Optimal Sample Complexity for MDPs via AnchoringPoster1 citations
- Near-optimal Regret Using Policy Optimization in Online MDPs with Aggregate Bandit FeedbackPoster1 citations
- Nested Expectations with Kernel QuadraturePoster1 citations
- Neural Discovery in Mathematics: Do Machines Dream of Colored Planes?Oral1 citations
- Neural Encoding and Decoding at ScaleSpotlight1 citations
- No Task Left Behind: Isotropic Model Merging with Common and Task-Specific SubspacesPoster1 citations
- Nonlinearly Preconditioned Gradient Methods under Generalized SmoothnessOral1 citations
- Nonparametric Teaching for Graph Property LearnersSpotlight1 citations
- OOD-Chameleon: Is Algorithm Selection for OOD Generalization Learnable?Poster1 citations
- OWLS: Scaling Laws for Multilingual Speech Recognition and Translation ModelsPoster1 citations
- Offline Learning for Combinatorial Multi-armed BanditsPoster1 citations
- On Linear Convergence in Smooth Convex-Concave Bilinearly-Coupled Saddle-Point Optimization: Lower Bounds and Optimal AlgorithmsPoster1 citations
- On Volume Minimization in Conformal RegressionPoster1 citations
- On Zero-Initialized Attention: Optimal Prompt and Gating Factor EstimationPoster1 citations
- On the Benefits of Active Data Collection in Operator LearningSpotlight1 citations
- On the Importance of Embedding Norms in Self-Supervised LearningPoster1 citations
- On the Local Complexity of Linear Regions in Deep ReLU NetworksPoster1 citations
- On the Power of Context-Enhanced Learning in LLMsSpotlight1 citations
- On the Query Complexity of Verifier-Assisted Language GenerationPoster1 citations
- OneForecast: A Universal Framework for Global and Regional Weather ForecastingPoster1 citations
- OptMATH: A Scalable Bidirectional Data Synthesis Framework for Optimization ModelingPoster1 citations
- Optimal Task Order for Continual Learning of Multiple TasksPoster1 citations
- Optimal Transport Barycenter via Nonconvex-Concave Minimax OptimizationPoster1 citations
- Oscillation-Reduced MXFP4 Training for Vision TransformersPoster1 citations
- Outlier Gradient Analysis: Efficiently Identifying Detrimental Training Samples for Deep Learning ModelsOral1 citations
- Overcoming the Curse of Dimensionality in Reinforcement Learning Through Approximate FactorizationPoster1 citations
- Overtrained Language Models Are Harder to Fine-TunePoster1 citations
- PDE-Controller: LLMs for Autoformalization and Reasoning of PDEsPoster1 citations
- PILAF: Optimal Human Preference Sampling for Reward ModelingPoster1 citations
- POROver: Improving Safety and Reducing Overrefusal in Large Language Models with Overgeneration and Preference OptimizationPoster1 citations
- Perception in ReflectionPoster1 citations
- Permutation Equivariant Neural Networks for Symmetric TensorsPoster1 citations
- PhantomWiki: On-Demand Datasets for Reasoning and Retrieval EvaluationPoster1 citations
- Physics-Informed Generative Modeling of Wireless ChannelsPoster1 citations
- PlaySlot: Learning Inverse Latent Dynamics for Controllable Object-Centric Video Prediction and PlanningPoster1 citations
- Policy Design for Two-sided Platforms with Participation DynamicsPoster1 citations
- Policy Guided Tree Search for Enhanced LLM ReasoningPoster1 citations
- PolyConf: Unlocking Polymer Conformation Generation through Hierarchical Generative ModelsPoster1 citations
- Portable Reward Tuning: Towards Reusable Fine-Tuning across Different Pretrained ModelsPoster1 citations
- Position: AI Should Not Be An Imitation Game: Centaur EvaluationsPoster1 citations
- Position: Graph Learning Will Lose Relevance Due To Poor BenchmarksPoster1 citations
- Position: Medical Large Language Model Benchmarks Should Prioritize Construct ValidityOral1 citations
- Posterior Inference with Diffusion Models for High-dimensional Black-box OptimizationPoster1 citations
- Prediction-Powered Adaptive Shrinkage EstimationPoster1 citations
- Predictive Data Selection: The Data That Predicts Is the Data That TeachesPoster1 citations
- Premise-Augmented Reasoning Chains Improve Error Identification in Math reasoning with LLMsPoster1 citations
- Pretraining Generative Flow Networks with Inexpensive Rewards for Molecular Graph GenerationPoster1 citations
- Proactive Agents for Multi-Turn Text-to-Image Generation Under UncertaintyPoster1 citations
- R.I.P.: Better Models by Survival of the Fittest PromptsPoster1 citations
- RUN: Reversible Unfolding Network for Concealed Object SegmentationPoster1 citations
- Rectifying Conformity Scores for Better Conditional CoveragePoster1 citations
- Reinforcement Learning for Quantum Control under Physical ConstraintsPoster1 citations
- RelGNN: Composite Message Passing for Relational Deep LearningPoster1 citations
- Relating Misfit to Gain in Weak-to-Strong Generalization Beyond the Squared LossPoster1 citations
- RepLoRA: Reparameterizing Low-rank Adaptation via the Perspective of Mixture of ExpertsPoster1 citations
- ResQ: Mixed-Precision Quantization of Large Language Models with Low-Rank ResidualsSpotlight1 citations
- Rethinking Addressing in Language Models via Contextualized Equivariant Positional EncodingPoster1 citations
- Rethinking Benign Overfitting in Two-Layer Neural NetworksPoster1 citations
- Rethinking Chain-of-Thought from the Perspective of Self-TrainingPoster1 citations
- Retrieval Augmented Time Series ForecastingPoster1 citations
- Revisiting Instance-Optimal Cluster Recovery in the Labeled Stochastic Block ModelPoster1 citations
- Revisiting Non-Acyclic GFlowNets in Discrete EnvironmentsPoster1 citations
- Robust Multi-bit Text Watermark with LLM-based ParaphrasersPoster1 citations
- Robust and Conjugate Spatio-Temporal Gaussian ProcessesPoster1 citations
- SAE-V: Interpreting Multimodal Models for Enhanced AlignmentPoster1 citations
- SKIM: Any-bit Quantization Pushing The Limits of Post-Training QuantizationPoster1 citations
- SUICA: Learning Super-high Dimensional Sparse Implicit Neural Representations for Spatial TranscriptomicsPoster1 citations
- Scaling Laws for Floating–Point Quantization TrainingPoster1 citations
- Scaling Laws for Forgetting during Finetuning with Pretraining Data InjectionPoster1 citations
- Scaling Value Iteration Networks to 5000 Layers for Extreme Long-Term PlanningPoster1 citations
- Score as Action: Fine Tuning Diffusion Generative Models by Continuous-time Reinforcement LearningPoster1 citations
- Selective Response Strategies for GenAIPoster1 citations
- Simple Policy OptimizationPoster1 citations
- Sparse Autoencoders for Hypothesis GenerationPoster1 citations
- Sparse Spectral Training and Inference on Euclidean and Hyperbolic Neural NetworksPoster1 citations
- Spatial Reasoning with Denoising ModelsPoster1 citations
- Speculate, then Collaborate: Fusing Knowledge of Language Models during DecodingPoster1 citations
- Speeding up Policy Simulation in Supply Chain RLPoster1 citations
- Statistical Test for Feature Selection Pipelines by Selective InferenceOral1 citations
- Statistical and Computational Guarantees of Kernel Max-Sliced Wasserstein DistancesPoster1 citations
- Stealing That Free Lunch: Exposing the Limits of Dyna-Style Reinforcement LearningPoster1 citations
- Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and ConvergencePoster1 citations
- Sub-Sequential Physics-Informed Learning with State Space ModelPoster1 citations
- Symmetric Reinforcement Learning Loss for Robust Learning on Diverse Tasks and Model ScalesPoster1 citations
- SyncMind: Measuring Agent Out-of-Sync Recovery in Collaborative Software EngineeringPoster1 citations
- TAROT: Targeted Data Selection via Optimal TransportPoster1 citations
- TCP-Diffusion: A Multi-modal Diffusion Model for Global Tropical Cyclone Precipitation Forecasting with Change AwarenessPoster1 citations
- Target Concrete Score Matching: A Holistic Framework for Discrete DiffusionPoster1 citations
- Temperature-Annealed Boltzmann GeneratorsPoster1 citations
- Test-Time Training Provably Improves Transformers as In-context LearnersPoster1 citations
- Text-to-CAD Generation Through Infusing Visual Feedback in Large Language ModelsPoster1 citations
- The Devil Is in the Details: Tackling Unimodal Spurious Correlations for Generalizable Multimodal Reward ModelsPoster1 citations
- The Disparate Benefits of Deep EnsemblesPoster1 citations
- The Perils of Optimizing Learned Reward Functions: Low Training Error Does Not Guarantee Low RegretPoster1 citations
- The Role of Randomness in StabilitySpotlight1 citations
- The Sharpness Disparity Principle in Transformers for Accelerating Language Model Pre-TrainingPoster1 citations
- TimeFilter: Patch-Specific Spatial-Temporal Graph Filtration for Time Series ForecastingPoster1 citations
- Toward Efficient Kernel-Based Solvers for Nonlinear PDEsPoster1 citations
- Toward Robust Hyper-Detailed Image Captioning: A Multiagent Approach and Dual Evaluation Metrics for Factuality and CoveragePoster1 citations
- Towards Attributions of Input Variables in a CoalitionPoster1 citations
- Towards Cost-Effective Reward Guided Text GenerationPoster1 citations
- Towards LLM Unlearning Resilient to Relearning Attacks: A Sharpness-Aware Minimization Perspective and BeyondPoster1 citations
- Towards characterizing the value of edge embeddings in Graph Neural NetworksPoster1 citations
- Towards scientific discovery with dictionary learning: Extracting biological concepts from microscopy foundation modelsPoster1 citations
- Training Dynamics of In-Context Learning in Linear AttentionSpotlight1 citations
- Trajectory Inference with Smooth Schrödinger BridgesPoster1 citations
- Transolver++: An Accurate Neural Solver for PDEs on Million-Scale GeometriesPoster1 citations
- Tuning LLM Judge Design Decisions for 1/1000 of the CostPoster1 citations
- Ultra-Resolution Adaptation with EasePoster1 citations
- Uncertainty Quantification for LLM-Based Survey SimulationsPoster1 citations
- Understanding Generalization in Quantum Machine Learning with MarginsPoster1 citations
- Understanding High-Dimensional Bayesian OptimizationPoster1 citations
- Understanding and Mitigating Miscalibration in Prompt Tuning for Vision-Language ModelsPoster1 citations
- Understanding the Limits of Deep Tabular Methods with Temporal ShiftPoster1 citations
- Understanding the Skill Gap in Recurrent Language Models: The Role of the Gather-and-Aggregate MechanismPoster1 citations
- Unified Breakdown Analysis for Byzantine Robust GossipPoster1 citations
- Unifying 2D and 3D Vision-Language UnderstandingPoster1 citations
- Unifying Specialized Visual Encoders for Video Language ModelsPoster1 citations
- Universal Approximation Theorem of Deep Q-NetworksPoster1 citations
- Unveiling AI's Blind Spots: An Oracle for In-Domain, Out-of-Domain, and Adversarial ErrorsPoster1 citations
- Upweighting Easy Samples in Fine-Tuning Mitigates ForgettingSpotlight1 citations
- Variational Rectified Flow MatchingPoster1 citations
- Vintix: Action Model via In-Context Reinforcement LearningPoster1 citations
- Visual Autoregressive Modeling for Image Super-ResolutionPoster1 citations
- Why Is Spatial Reasoning Hard for VLMs? An Attention Mechanism Perspective on Focus AreasPoster1 citations
- XAttnMark: Learning Robust Audio Watermarking with Cross-AttentionPoster1 citations
- You Get What You Give: Reciprocally Fair Federated LearningPoster1 citations
- Zero-shot Meta-learning for Tabular Prediction Tasks with Adversarially Pre-trained TransformerPoster1 citations
- ZeroFlow: Overcoming Catastrophic Forgetting is Easier than You ThinkPoster1 citations
- xLSTM 7B: A Recurrent LLM for Fast and Efficient InferencePoster1 citations
- µnit Scaling: Simple and Scalable FP8 LLM TrainingPoster1 citations
- "Who experiences large model decay and why?" A Hierarchical Framework for Diagnosing Heterogeneous Performance DriftPoster
- "Why Is There a Tumor?": Tell Me the Reason, Show Me the EvidencePoster
- $K^2$VAE: A Koopman-Kalman Enhanced Variational AutoEncoder for Probabilistic Time Series ForecastingSpotlight
- $S^2$FGL: Spatial Spectral Federated Graph LearningPoster
- $\infty$-Video: A Training-Free Approach to Long Video Understanding via Continuous-Time Memory ConsolidationPoster
- $\mathcal{V}ista\mathcal{DPO}$: Video Hierarchical Spatial-Temporal Direct Preference Optimization for Large Video ModelsPoster
- $\texttt{I$^2$MoE}$: Interpretable Multimodal Interaction-aware Mixture-of-ExpertsPoster
- (How) Can Transformers Predict Pseudo-Random Numbers?Poster
- 3D Question Answering via only 2D Vision-Language ModelsPoster
- 3D-LMVIC: Learning-based Multi-View Image Compression with 3D Gaussian Geometric PriorsPoster
- A Bayesian Model Selection Criterion for Selecting Pretraining CheckpointsPoster
- A Bregman Proximal Viewpoint on Neural OperatorsPoster
- A Causal World Model Underlying Next Token Prediction: Exploring GPT in a Controlled EnvironmentPoster
- A Certified Unlearning Approach without Access to Source DataPoster
- A Chaotic Dynamics Framework Inspired by Dorsal Stream for Event Signal ProcessingPoster
- A Checks-and-Balances Framework for Context-Aware Ethical AI AlignmentPoster
- A Classification View on Meta Learning BanditsPoster
- A Closer Look at Backdoor Attacks on CLIPPoster
- A Closer Look at Generalized BH Algorithm for Out-of-Distribution DetectionPoster
- A Closer Look at Multimodal Representation CollapseSpotlight
- A Closer Look at Transformers for Time Series Forecasting: Understanding Why They Work and Where They StrugglePoster
- A Cognac Shot To Forget Bad Memories: Corrective Unlearning for Graph Neural NetworksPoster
- A Comprehensive Framework for Analyzing the Convergence of Adam: Bridging the Gap with SGDPoster
- A Computationally Efficient Algorithm for Infinite-Horizon Average-Reward Linear MDPsPoster
- A Cross Modal Knowledge Distillation & Data Augmentation Recipe for Improving Transcriptomics Representations through Morphological FeaturesPoster
- A First-order Generative Bilevel Optimization Framework for Diffusion ModelsPoster
- A Forget-and-Grow Strategy for Deep Reinforcement Learning Scaling in Continuous ControlPoster
- A General Graph Spectral Wavelet Convolution via Chebyshev Order DecompositionPoster
- A General Representation-Based Approach to Multi-Source Domain AdaptationPoster
- A Generalizable Physics-Enhanced State Space Model for Long-Term Dynamics Forecasting in Complex EnvironmentsPoster
- A Generalization Result for Convergence in Learning-to-OptimizeOral
- A Generalization Theory for Zero-Shot PredictionOral
- A Generic Family of Graphical Models: Diversity, Efficiency, and HeterogeneityPoster
- A Geometric Approach to Personalized Recommendation with Set-Theoretic Constraints Using Box EmbeddingsPoster
- A Lens into Interpretable Transformer Mistakes via Semantic DependencyPoster
- A Likelihood Based Approach to Distribution Regression Using Conditional Deep Generative ModelsPoster
- A Machine Learning Approach to Duality in Statistical PhysicsPoster
- A Mathematical Framework for AI-Human Integration in WorkPoster
- A Mixed-Curvature based Pre-training Paradigm for Multi-Task Vehicle Routing SolverPoster
- A Mixture-Based Framework for Guiding Diffusion ModelsPoster
- A Multi-Region Brain Model to Elucidate the Role of Hippocampus in Spatially Embedded Decision-MakingPoster
- A Near Linear Query Lower Bound for Submodular MaximizationPoster
- A Near-Optimal Single-Loop Stochastic Algorithm for Convex Finite-Sum Coupled Compositional OptimizationPoster
- A New Approach to Backtracking Counterfactual Explanations: A Unified Causal Framework for Efficient Model InterpretabilityPoster
- A New Concentration Inequality for Sampling Without Replacement and Its Application for Transductive LearningPoster
- A Non-Asymptotic Convergent Analysis for Scored-Based Graph Generative Model via a System of Stochastic Differential EquationsPoster
- A Non-isotropic Time Series Diffusion Model with Moving Average TransitionsPoster
- A Novel Characterization of the Population Area Under the Risk Coverage Curve (AURC) and Rates of Finite Sample EstimatorsPoster
- A Online Statistical Framework for Out-of-Distribution DetectionPoster
- A Parameter-Free and Near-Optimal Zeroth-Order Algorithm for Stochastic Convex OptimizationPoster
- A Parametric Contextual Online Learning Theory of BrokeragePoster
- A Peer-review Look on Multi-modal Clustering: An Information Bottleneck Realization MethodPoster
- A Physics-Augmented Deep Learning Framework for Classifying Single Molecule Force Spectroscopy DataPoster
- A Reasoning-Based Approach to Cryptic Crossword Clue SolvingPoster
- A Recipe for Causal Graph Regression: Confounding Effects RevisitedPoster
- A Reduction Framework for Distributionally Robust Reinforcement Learning under Average RewardPoster
- A Reductions Approach to Risk-Sensitive Reinforcement Learning with Optimized Certainty EquivalentsPoster
- A Rescaling-Invariant Lipschitz Bound Based on Path-Metrics for Modern ReLU Network ParameterizationsPoster
- A Sample Efficient Conditional Independence Test in the Presence of DiscretizationPoster
- A Selective Learning Method for Temporal Graph Continual LearningPoster
- A Sharper Global Convergence Analysis for Average Reward Reinforcement Learning via an Actor-Critic ApproachPoster
- A Square Peg in a Square Hole: Meta-Expert for Long-Tailed Semi-Supervised LearningPoster
- A Stronger Mixture of Low-Rank Experts for Fine-Tuning Foundation ModelsPoster
- A Sub-Problem Quantum Alternating Operator Ansatz for Correlation ClusteringPoster
- A Tale of Two Structures: Do LLMs Capture the Fractal Complexity of Language?Poster
- A Theoretical Study of (Hyper) Self-Attention through the Lens of Interactions: Representation, Training, GeneralizationPoster
- A Theory for Conditional Generative Modeling on Multiple Data SourcesPoster
- A Unified Framework for Generalization Error Analysis of Learning with Arbitrary Discrete Weak FeaturesPoster
- A Unified Theoretical Analysis of Private and Robust Offline Alignment: from RLHF to DPOSpotlight
- A Variational Framework for Improving Naturalness in Generative Spoken Language ModelsPoster
- A Variational Information Theoretic Approach to Out-of-Distribution DetectionPoster
- A Variational Perspective on Generative Protein Fitness OptimizationPoster
- A Versatile Influence Function for Data Attribution with Non-Decomposable LossPoster
- A-PSRO: A Unified Strategy Learning Method with Advantage Metric for Normal-form GamesPoster
- AAAR-1.0: Assessing AI’s Potential to Assist ResearchPoster
- ABKD: Pursuing a Proper Allocation of the Probability Mass in Knowledge Distillation via $\alpha$-$\beta$-DivergenceOral
- ABNet: Adaptive explicit-Barrier Net for Safe and Scalable Robot LearningPoster
- ADDQ: Adaptive distributional double Q-learningPoster
- ADHMR: Aligning Diffusion-based Human Mesh Recovery via Direct Preference OptimizationPoster
- ADIOS: Antibody Development via Opponent ShapingPoster
- AEQA-NAT : Adaptive End-to-end Quantization Alignment Training Framework for Non-autoregressive Machine TranslationPoster
- AKORN: Adaptive Knots generated Online for RegressioN splinesPoster
- AKRMap: Adaptive Kernel Regression for Trustworthy Visualization of Cross-Modal EmbeddingsPoster
- ALMTokenizer: A Low-bitrate and Semantic-rich Audio Codec Tokenizer for Audio Language ModelingPoster
- AMPO: Active Multi Preference Optimization for Self-play Preference SelectionPoster
- ARS: Adaptive Reward Scaling for Multi-Task Reinforcement LearningPoster
- ATA: Adaptive Task Allocation for Efficient Resource Management in Distributed Machine LearningPoster
- AUTOCIRCUIT-RL: Reinforcement Learning-Driven LLM for Automated Circuit Topology GenerationPoster
- Ab Initio Nonparametric Variable Selection for Scalable Symbolic Regression with Large $p$Poster
- Accelerating LLM Inference with Lossless Speculative Decoding Algorithms for Heterogeneous VocabulariesOral
- Accelerating Large Language Model Reasoning via Speculative SearchPoster
- Accelerating Linear Recurrent Neural Networks for the Edge with Unstructured SparsityPoster
- Accelerating PDE-Constrained Optimization by the Derivative of Neural OperatorsPoster
- Accelerating Quantum Reinforcement Learning with a Quantum Natural Policy Gradient Based ApproachPoster
- Accelerating Spectral Clustering under Fairness ConstraintsPoster
- Accelerating Unbiased LLM Evaluation via Synthetic FeedbackPoster
- Accurate Identification of Communication Between Multiple Interacting Neural PopulationsPoster
- Accurate and Efficient World Modeling with Masked Latent TransformersPoster
- Achieving Linear Speedup and Near-Optimal Complexity for Decentralized Optimization over Row-stochastic NetworksSpotlight
- Action Dubber: Timing Audible Actions via Inflectional FlowPoster
- Action-Constrained Imitation LearningPoster
- Action-Dependent Optimality-Preserving Reward ShapingPoster
- Action-Minimization Meets Generative Modeling: Efficient Transition Path Sampling with the Onsager-Machlup FunctionalPoster
- ActionPiece: Contextually Tokenizing Action Sequences for Generative RecommendationSpotlight
- Activation Space Interventions Can Be Transferred Between Large Language ModelsPoster
- Active Fine-Tuning of Multi-Task PoliciesPoster
- Active Learning for Efficient Discovery of Optimal Combinatorial PerturbationsPoster
- Active Learning with Selective Time-Step Acquisition for PDEsPoster
- Active Reward Modeling: Adaptive Preference Labeling for Large Language Model AlignmentPoster
- Active Treatment Effect Estimation via Limited SamplesPoster
- Active feature acquisition via explainability-driven rankingPoster
- Actor-Critics Can Achieve Optimal Sample EfficiencyPoster
- Ad Hoc Teamwork via Offline Goal-Based Decision TransformersPoster
- Ad-Hoc Human-AI Coordination ChallengeSpotlight
- AdaDecode: Accelerating LLM Decoding with Adaptive Layer ParallelismPoster
- AdaPTS: Adapting Univariate Foundation Models to Probabilistic Multivariate Time Series ForecastingPoster
- AdaSplash: Adaptive Sparse Flash AttentionOral
- Adapter Naturally Serves as Decoupler for Cross-Domain Few-Shot Semantic SegmentationSpotlight
- Adapting Precomputed Features for Efficient Graph CondensationPoster
- Adapting to Evolving Adversaries with Regularized Continual Robust TrainingPoster
- Adapting to Linear Separable Subsets with Large-Margin in Differentially Private LearningPoster
- Adaptive Data Collection for Robust Learning Across Multiple DistributionsPoster
- Adaptive Elicitation of Latent Information Using Natural LanguagePoster
- Adaptive Estimation and Learning under Temporal Distribution ShiftPoster
- Adaptive Flow Matching for Resolving Small-Scale PhysicsPoster
- Adaptive Localization of Knowledge Negation for Continual LLM UnlearningPoster
- Adaptive Median Smoothing: Adversarial Defense for Unlearned Text-to-Image Diffusion Models at Inference TimePoster
- Adaptive Multi-prompt Contrastive Network for Few-shot Out-of-distribution DetectionSpotlight
- Adaptive Partitioning Schemes for Optimistic OptimizationPoster
- Adaptive Sample Sharing for Multi Agent Linear BanditsPoster
- Adaptive Self-improvement LLM Agentic System for ML Library DevelopmentPoster
- Adaptive Sensitivity Analysis for Robust Augmentation against Natural Corruptions in Image SegmentationPoster
- Addressing Concept Mislabeling in Concept Bottleneck Models Through Preference OptimizationPoster
- Addressing Imbalanced Domain-Incremental Learning through Dual-Balance Collaborative ExpertsPoster
- Adjoint Sampling: Highly Scalable Diffusion Samplers via Adjoint MatchingPoster
- Adjusting Model Size in Continual Gaussian Processes: How Big is Big Enough?Spotlight
- AdvAgent: Controllable Blackbox Red-teaming on Web AgentsPoster
- Advancing Constrained Monotonic Neural Networks: Achieving Universal Approximation Beyond Bounded ActivationsPoster
- Advancing Personalized Learning with Neural Collapse for Long-Tail ChallengePoster
- Adversarial Combinatorial Semi-bandits with Graph FeedbackPoster
- Adversarial Cooperative Rationalization: The Risk of Spurious Correlations in Even Clean DatasetsPoster
- Adversarial Inception Backdoor Attacks against Reinforcement LearningPoster
- Adversarial Inputs for Linear Algebra BackendsPoster
- Adversarial Perturbations Are Formed by Iteratively Learning Linear Combinations of the Right Singular Vectors of the Adversarial JacobianPoster
- Adversarial Robust Generalization of Graph Neural NetworksPoster
- Adversarial Robustness via Deformable Convolution with StochasticityPoster
- Aequa: Fair Model Rewards in Collaborative Learning via Slimmable NetworksPoster
- AffinityFlow: Guided Flows for Antibody Affinity MaturationPoster
- Agent Reviewers: Domain-specific Multimodal Agents with Shared Memory for Paper ReviewPoster
- Agent-Centric Actor-Critic for Asynchronous Multi-Agent Reinforcement LearningPoster
- Aggregation Buffer: Revisiting DropEdge with a New Parameter BlockPoster
- Aggregation of Dependent Expert Distributions in Multimodal Variational AutoencodersPoster
- Alberta Wells Dataset: Pinpointing Oil and Gas Wells from Satellite ImageryPoster
- Algorithm Development in Neural Networks: Insights from the Streaming Parity TaskOral
- Algorithmic Recourse for Long-Term ImprovementPoster
- Algorithms and Hardness for Active Learning on GraphsPoster
- Algorithms with Calibrated Machine Learning PredictionsSpotlight
- Aligning LLMs by Predicting Preferences from User Writing SamplesPoster
- Aligning Multimodal Representations through an Information BottleneckPoster
- Aligning Protein Conformation Ensemble Generation with Physical FeedbackPoster
- Aligning Spoken Dialogue Models from User InteractionsPoster
- All-Purpose Mean Estimation over R: Optimal Sub-Gaussianity with Outlier Robustness and Low Moments PerformanceOral
- All-atom Diffusion Transformers: Unified generative modelling of molecules and materialsPoster
- All-atom inverse protein folding through discrete flow matchingPoster
- Almost Optimal Fully Dynamic $k$-Center Clustering with RecoursePoster
- AlphaDPO: Adaptive Reward Margin for Direct Preference OptimizationPoster
- AlphaPO: Reward Shape Matters for LLM AlignmentPoster
- AlphaQCM: Alpha Discovery in Finance with Distributional Reinforcement LearningPoster
- An Adaptive Orthogonal Convolution Scheme for Efficient and Flexible CNN ArchitecturesPoster
- An All-Atom Generative Model for Designing Protein ComplexesPoster
- An Architecture Search Framework for Inference-Time TechniquesPoster
- An Asymptotically Optimal Approximation Algorithm for Multiobjective Submodular Maximization at ScalePoster
- An Augmentation-Aware Theory for Self-Supervised Contrastive LearningPoster
- An Effective and Secure Federated Multi-View Clustering Method with Information-Theoretic PerspectivePoster
- An Efficient Matrix Multiplication Algorithm for Accelerating Inference in Binary and Ternary Neural NetworksPoster
- An Efficient Private GPT Never Autoregressively DecodesPoster
- An Efficient Pruner for Large Language Model with Theoretical GuaranteePoster
- An Efficient Search-and-Score Algorithm for Ancestral Graphs using Multivariate Information Scores for Complex Non-linear and Categorical DataPoster
- An Empirical Study on Configuring In-Context Learning Demonstrations for Unleashing MLLMs' Sentimental Perception CapabilityPoster
- An End-to-End Model for Logits-Based Large Language Models WatermarkingPoster
- An Error Analysis of Flow Matching for Deep Generative ModelingSpotlight
- An Expressive and Self-Adaptive Dynamical System for Efficient Function LearningPoster
- An Improved Clique-Picking Algorithm for Counting Markov Equivalent DAGs via Super Cliques TransferOral
- An Instrumental Value for Data Production and its Application to Data PricingPoster
- An Interpretable N-gram Perplexity Threat Model for Large Language Model JailbreaksPoster
- An Online Adaptive Sampling Algorithm for Stochastic Difference-of-convex Optimization with Time-varying DistributionsOral
- An Online Learning Approach to Prompt-based Selection of Generative Models and LLMsPoster
- An Optimistic Algorithm for online CMDPS with Anytime Adversarial ConstraintsPoster
- An in depth look at the Procrustes-Wasserstein distance: properties and barycentersPoster
- AnalogGenie-Lite: Enhancing Scalability and Precision in Circuit Topology Discovery through Lightweight Graph ModelingPoster
- Analytical Construction on Geometric Architectures: Transitioning from Static to Temporal Link PredictionPoster
- Analytical Lyapunov Function Discovery: An RL-based Generative ApproachPoster
- Analyze Feature Flow to Enhance Interpretation and Steering in Language ModelsPoster
- Angle Domain Guidance: Latent Diffusion Requires Rotation Rather Than ExtrapolationPoster
- Antidote: Post-fine-tuning Safety Alignment for Large Language Models against Harmful Fine-tuning AttackPoster
- Anytime-Constrained Equilibria in Polynomial TimePoster
- Approximate Differential Privacy of the $\ell_2$ MechanismPoster
- Approximate Forest Completion and Learning-Augmented Algorithms for Metric Minimum Spanning TreesPoster
- Approximately Correct Label Distribution LearningPoster
- Approximating Latent Manifolds in Neural Networks via Vanishing IdealsPoster
- Approximation to Smooth Functions by Low-Rank Swish NetworksPoster
- Are High-Quality AI-Generated Images More Difficult for Models to Detect?Poster
- Are LLMs Prescient? A Continuous Evaluation using Daily News as the OraclePoster
- Are Large Brainwave Foundation Models Capable Yet ? Insights from Fine-TuningPoster
- Are Large Language Models Ready for Multi-Turn Tabular Data Analysis?Poster
- Armijo Line-search Can Make (Stochastic) Gradient Descent Provably FasterPoster
- ArrayDPS: Unsupervised Blind Speech Separation with a Diffusion PriorPoster
- Arrow: Accelerator for Time Series Causal Discovery with Time WeavingPoster
- Assessing Safety Risks and Quantization-aware Safety Patching for Quantized Large Language ModelsPoster
- AssistanceZero: Scalably Solving Assistance GamesPoster
- Asymmetric Decision-Making in Online Knowledge Distillation: Unifying Consensus and DivergencePoster
- AtlasD: Automatic Local Symmetry DiscoveryPoster
- Attention Mechanisms Perspective: Exploring LLM Processing of Graph-Structured DataPoster
- Attention-Level SpeculationPoster
- Attention-Only Transformers via Unrolled Subspace DenoisingPoster
- Attributes Shape the Embedding Space of Face Recognition ModelsPoster
- AuPair: Golden Example Pairs for Code RepairPoster
- Auditing Prompt Caching in Language Model APIsPoster
- Auto-reconfiguration for Latency Minimization in CPU-based DNN ServingPoster
- AutoAL: Automated Active Learning with Differentiable Query Strategy SearchPoster
- AutoCATE: End-to-End, Automated Treatment Effect EstimationPoster
- AutoGFM: Automated Graph Foundation Model with Adaptive Architecture CustomizationOral
- Autoencoder-Based Hybrid Replay for Class-Incremental LearningPoster
- Automatic Reward Shaping from Confounded Offline DataPoster
- Automatically Identify and Rectify: Robust Deep Contrastive Multi-view Clustering in Noisy ScenariosSpotlight
- Autonomy-of-Experts ModelsPoster
- Average Sensitivity of Hierarchical $k$-Median ClusteringPoster
- Avoiding Catastrophe in Online Learning by Asking for HelpPoster
- Avoiding Leakage Poisoning: Concept Interventions Under Distribution ShiftsPoster
- B-score: Detecting biases in large language models using response historyPoster
- BAME: Block-Aware Mask Evolution for Efficient N:M Sparse TrainingPoster
- BARK: A Fully Bayesian Tree Kernel for Black-box OptimizationPoster
- BAnG: Bidirectional Anchored Generation for Conditional RNA DesignPoster
- BCE vs. CE in Deep Feature LearningPoster
- BDC-CLIP: Brownian Distance Covariance for Adapting CLIP to Action RecognitionPoster
- BECAME: Bayesian Continual Learning with Adaptive Model MergingPoster
- BEST-Route: Adaptive LLM Routing with Test-Time Optimal ComputePoster
- BILBO: BILevel Bayesian OptimizationPoster
- BOOD: Boundary-based Out-Of-Distribution Data GenerationPoster
- BOPO: Neural Combinatorial Optimization via Best-anchored and Objective-guided Preference OptimizationPoster
- BRIDGE: Bootstrapping Text to Control Time-Series Generation via Multi-Agent Iterative Optimization and Diffusion ModelingPoster
- BSLoRA: Enhancing the Parameter Efficiency of LoRA with Intra-Layer and Inter-Layer SharingPoster
- BSO: Binary Spiking Online Optimization AlgorithmPoster
- BSemiFL: Semi-supervised Federated Learning via a Bayesian ApproachPoster
- BaWA: Automatic Optimizing Pruning Metric for Large Language Models with Balanced Weight and ActivationPoster
- BackSlash: Rate Constrained Optimized Training of Large Language ModelsPoster
- Backdoor Attacks in Token Selection of Attention MechanismPoster
- BalancEdit: Dynamically Balancing the Generality-Locality Trade-off in Multi-modal Model EditingPoster
- Balanced Learning for Domain Adaptive Semantic SegmentationPoster
- Balancing Efficiency and Expressiveness: Subgraph GNNs with Walk-Based CentralityPoster
- Balancing Interference and Correlation in Spatial Experimental Designs: A Causal Graph Cut ApproachPoster
- Balancing Model Efficiency and Performance: Adaptive Pruner for Long-tailed DataPoster
- Balancing Preservation and Modification: A Region and Semantic Aware Metric for Instruction-Based Image EditingPoster
- Balancing the Scales: A Theoretical and Algorithmic Framework for Learning from Imbalanced DataPoster
- BanditSpec: Adaptive Speculative Decoding via Bandit AlgorithmsPoster
- Banyan: Improved Representation Learning with Explicit StructurePoster
- Batch List-Decodable Linear Regression via Higher MomentsPoster
- Bayesian Active Learning for Bivariate Causal DiscoveryPoster
- Bayesian Basis Function Approximation for Scalable Gaussian Process Priors in Deep Generative ModelsPoster
- Bayesian Inference for Correlated Human Experts and ClassifiersPoster
- Bayesian Neural Scaling Law Extrapolation with Prior-Data Fitted NetworksPoster
- Bayesian Optimization from Human Feedback: Near-Optimal Regret BoundsPoster
- Bayesian Weight Enhancement with Steady-State Adaptation for Test-time Adaptation in Dynamic EnvironmentsPoster
- Be Confident: Uncovering Overfitting in MLLM Multi-Task TuningPoster
- Be a Goldfish: Forgetting Bad Conditioning in Sparse Linear Regression via Variational AutoencodersPoster
- Behavior-agnostic Task Inference for Robust Offline In-context Reinforcement LearningPoster
- Behavioral Exploration: Learning to Explore via In-Context AdaptationPoster
- Bellman Unbiasedness: Toward Provably Efficient Distributional Reinforcement Learning with General Value Function ApproximationPoster
- Benchmarking Abstract and Reasoning Abilities Through A Theoretical PerspectivePoster
- Benefits of Early Stopping in Gradient Descent for Overparameterized Logistic RegressionPoster
- Benign Overfitting in Token Selection of Attention MechanismPoster
ICML accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.