ICLR 2025 Accepted Papers
The full list of 3,704 papers accepted at ICLR 2025 (International Conference on Learning Representations). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 3,111Spotlight: 380Oral: 213
- Indirect Gradient Matching for Adversarial Robust DistillationPoster3 citations
- InsightBench: Evaluating Business Analytics Agents Through Multi-Step Insight GenerationPoster3 citations
- Interactive Speculative Planning: Enhance Agent Efficiency through Co-design of System and User InterfacePoster3 citations
- Interpretable Bilingual Multimodal Large Language Model for Diverse Biomedical TasksPoster3 citations
- Interpretable Vision-Language Survival Analysis with Ordinal Inductive Bias for Computational PathologyPoster3 citations
- Intrinsic Dimension Correlation: uncovering nonlinear connections in multimodal representationsPoster3 citations
- Is Factuality Enhancement a Free Lunch For LLMs? Better Factuality Can Lead to Worse Context-FaithfulnessPoster3 citations
- Jamba: Hybrid Transformer-Mamba Language ModelsPoster3 citations
- Jump Your Steps: Optimizing Sampling Schedule of Discrete Diffusion ModelsPoster3 citations
- KOR-Bench: Benchmarking Language Models on Knowledge-Orthogonal Reasoning TasksPoster3 citations
- Knowledge Graph Finetuning Enhances Knowledge Manipulation in Large Language ModelsPoster3 citations
- LDAdam: Adaptive Optimization from Low-Dimensional Gradient StatisticsPoster3 citations
- Language Model Alignment in Multilingual Trolley ProblemsSpotlight3 citations
- Large Convolutional Model Tuning via Filter SubspacePoster3 citations
- Latent Space Chain-of-Embedding Enables Output-free LLM Self-EvaluationPoster3 citations
- Layer Swapping for Zero-Shot Cross-Lingual Transfer in Large Language ModelsSpotlight3 citations
- Learning General-purpose Biomedical Volume Representations using Randomized SynthesisPoster3 citations
- Learning Multi-Index Models with Neural Networks via Mean-Field Langevin DynamicsPoster3 citations
- Lightweight Neural App ControlSpotlight3 citations
- Lightweight Predictive 3D Gaussian SplatsPoster3 citations
- Limits of Deep Learning: Sequence Modeling through the Lens of Complexity TheoryPoster3 citations
- LoCoDL: Communication-Efficient Distributed Learning with Local Training and CompressionSpotlight3 citations
- Logical Consistency of Large Language Models in Fact-CheckingPoster3 citations
- Long-Sequence Recommendation Models Need Decoupled EmbeddingsPoster3 citations
- Looking Backward: Retrospective Backward Synthesis for Goal-Conditioned GFlowNetsPoster3 citations
- MACPO: Weak-to-Strong Alignment via Multi-Agent Contrastive Preference OptimizationPoster3 citations
- MAP: Multi-Human-Value Alignment PaletteOral3 citations
- MDSGen: Fast and Efficient Masked Diffusion Temporal-Aware Transformers for Open-Domain Sound GenerationPoster3 citations
- MELODI: Exploring Memory Compression for Long ContextsPoster3 citations
- MGMapNet: Multi-Granularity Representation Learning for End-to-End Vectorized HD Map ConstructionPoster3 citations
- MIRAGE: Evaluating and Explaining Inductive Reasoning Process in Language ModelsPoster3 citations
- MMTEB: Massive Multilingual Text Embedding BenchmarkPoster3 citations
- MOS: Model Synergy for Test-Time Adaptation on LiDAR-Based 3D Object DetectionOral3 citations
- Magnetic Preference Optimization: Achieving Last-iterate Convergence for Language Model AlignmentPoster3 citations
- MambaQuant: Quantizing the Mamba Family with Variance Aligned Rotation MethodsPoster3 citations
- MarS: a Financial Market Simulation Engine Powered by Generative Foundation ModelPoster3 citations
- MathGAP: Out-of-Distribution Evaluation on Problems with Arbitrarily Complex ProofsPoster3 citations
- MatryoshkaKV: Adaptive KV Compression via Trainable Orthogonal ProjectionPoster3 citations
- MiniPLM: Knowledge Distillation for Pre-training Language ModelsPoster3 citations
- Mitigating Memorization in Language ModelsSpotlight3 citations
- Mitigating the Backdoor Effect for Multi-Task Model Merging via Safety-Aware SubspacePoster3 citations
- Mix-LN: Unleashing the Power of Deeper Layers by Combining Pre-LN and Post-LNPoster3 citations
- MixEval-X: Any-to-any Evaluations from Real-world Data MixtureSpotlight3 citations
- Mixture of Experts Made Personalized: Federated Prompt Learning for Vision-Language ModelsPoster3 citations
- Mixture of Parrots: Experts improve memorization more than reasoningPoster3 citations
- Model-agnostic meta-learners for estimating heterogeneous treatment effects over timePoster3 citations
- Multi-Field Adaptive RetrievalSpotlight3 citations
- Multimodality Helps Few-shot 3D Point Cloud Semantic SegmentationSpotlight3 citations
- NExT-Mol: 3D Diffusion Meets 1D Language Modeling for 3D Molecule GenerationPoster3 citations
- NUDGE: Lightweight Non-Parametric Fine-Tuning of Embeddings for RetrievalPoster3 citations
- Natural Language Inference Improves Compositionality in Vision-Language ModelsPoster3 citations
- Near-Exact Privacy Amplification for Matrix MechanismsPoster3 citations
- No Preference Left Behind: Group Distributional Preference OptimizationPoster3 citations
- Number Cookbook: Number Understanding of Language Models and How to Improve ItPoster3 citations
- On the Benefits of Memory for Modeling Time-Dependent PDEsOral3 citations
- On the Byzantine-Resilience of Distillation-Based Federated LearningPoster3 citations
- On the Optimization and Generalization of Two-layer Transformers with Sign Gradient DescentSpotlight3 citations
- Open-YOLO 3D: Towards Fast and Accurate Open-Vocabulary 3D Instance SegmentationOral3 citations
- OpenPRM: Building Open-domain Process-based Reward Models with Preference TreesPoster3 citations
- Optimal Protocols for Continual Learning via Statistical Physics and Control TheoryPoster3 citations
- Optimized Multi-Token Joint Decoding With Auxiliary Model for LLM InferencePoster3 citations
- Optimizing Posterior Samples for Bayesian Optimization via RootfindingPoster3 citations
- Oscillatory State-Space ModelsOral3 citations
- PQMass: Probabilistic Assessment of the Quality of Generative Models using Probability Mass EstimationPoster3 citations
- PaPaGei: Open Foundation Models for Optical Physiological SignalsPoster3 citations
- ParetoFlow: Guided Flows in Multi-Objective OptimizationPoster3 citations
- Perm: A Parametric Representation for Multi-Style 3D Hair ModelingSpotlight3 citations
- Persistent Pre-training Poisoning of LLMsPoster3 citations
- Personality Alignment of Large Language ModelsPoster3 citations
- PhyloLM: Inferring the Phylogeny of Large Language Models and Predicting their Performances in BenchmarksPoster3 citations
- PiCO: Peer Review in LLMs based on Consistency OptimizationPoster3 citations
- Population Transformer: Learning Population-level Representations of Neural ActivityOral3 citations
- PostCast: Generalizable Postprocessing for Precipitation Nowcasting via Unsupervised Blurriness ModelingPoster3 citations
- Proactive Agent: Shifting LLM Agents from Reactive Responses to Active AssistancePoster3 citations
- Proactive Privacy Amnesia for Large Language Models: Safeguarding PII with Negligible Impact on Model UtilityPoster3 citations
- Probabilistic Language-Image Pre-TrainingPoster3 citations
- Probing the Latent Hierarchical Structure of Data via Diffusion ModelsPoster3 citations
- Provable Convergence and Limitations of Geometric Tempering for Langevin DynamicsPoster3 citations
- Provably Robust Explainable Graph Neural Networks against Graph Perturbation AttacksPoster3 citations
- Pushing the Limits of All-Atom Geometric Graph Neural Networks: Pre-Training, Scaling, and Zero-Shot TransferPoster3 citations
- REMEDY: Recipe Merging Dynamics in Large Vision-Language ModelsPoster3 citations
- ReMoE: Fully Differentiable Mixture-of-Experts with ReLU RoutingPoster3 citations
- Reasoning-Enhanced Healthcare Predictions with Knowledge Graph Community RetrievalPoster3 citations
- RecDreamer: Consistent Text-to-3D Generation via Uniform Score DistillationPoster3 citations
- Recite, Reconstruct, Recollect: Memorization in LMs as a Multifaceted PhenomenonPoster3 citations
- RefactorBench: Evaluating Stateful Reasoning in Language Agents Through CodePoster3 citations
- Restructuring Vector Quantization with the Rotation TrickOral3 citations
- Rethinking Invariance in In-context LearningPoster3 citations
- Rethinking Reward Modeling in Preference-based Large Language Model AlignmentOral3 citations
- Robotouille: An Asynchronous Planning Benchmark for LLM AgentsPoster3 citations
- Robots Pre-train Robots: Manipulation-Centric Robotic Representation from Large-Scale Robot DatasetsPoster3 citations
- Robustness Reprogramming for Representation LearningSpotlight3 citations
- SELF-EVOLVED REWARD LEARNING FOR LLMSPoster3 citations
- STORM: Spatio-TempOral Reconstruction Model For Large-Scale Outdoor ScenesPoster3 citations
- SaLoRA: Safety-Alignment Preserved Low-Rank AdaptationPoster3 citations
- Scalable Benchmarking and Robust Learning for Noise-Free Ego-Motion and 3D Reconstruction from Noisy VideoPoster3 citations
- Scaling Autonomous Agents via Automatic Reward Modeling And PlanningPoster3 citations
- Scaling Diffusion Language Models via Adaptation from Autoregressive ModelsPoster3 citations
- Scaling Offline Model-Based RL via Jointly-Optimized World-Action Model PretrainingPoster3 citations
- Second Order Bounds for Contextual Bandits with Function ApproximationPoster3 citations
- Sitcom-Crafter: A Plot-Driven Human Motion Generation System in 3D ScenesPoster3 citations
- Solving Video Inverse Problems Using Image Diffusion ModelsPoster3 citations
- Sort-free Gaussian Splatting via Weighted Sum RenderingPoster3 citations
- Stochastic Polyak Step-sizes and Momentum: Convergence Guarantees and Practical PerformancePoster3 citations
- Structure Language Models for Protein Conformation GenerationPoster3 citations
- TabReD: Analyzing Pitfalls and Filling the Gaps in Tabular Deep Learning BenchmarksSpotlight3 citations
- Task-Adaptive Pretrained Language Models via Clustered-Importance SamplingPoster3 citations
- Text2PDE: Latent Diffusion Models for Accessible Physics SimulationPoster3 citations
- The Crystal Ball Hypothesis in diffusion models: Anticipating object positions from initial noisePoster3 citations
- The Last Iterate Advantage: Empirical Auditing and Principled Heuristic Analysis of Differentially Private SGDPoster3 citations
- The Pitfalls of Memorization: When Memorization Hurts GeneralizationPoster3 citations
- Think while You Generate: Discrete Diffusion with Planned DenoisingPoster3 citations
- TopoDiffusionNet: A Topology-aware Diffusion ModelPoster3 citations
- Towards Understanding the Universality of Transformers for Next-Token PredictionPoster3 citations
- Towards Universality: Studying Mechanistic Similarity Across Language Model ArchitecturesPoster3 citations
- Towards a Theoretical Understanding of Synthetic Data in LLM Post-Training: A Reverse-Bottleneck PerspectivePoster3 citations
- Trained Transformer Classifiers Generalize and Exhibit Benign Overfitting In-ContextPoster3 citations
- Training Nonlinear Transformers for Chain-of-Thought Inference: A Theoretical Generalization AnalysisPoster3 citations
- Training-Free Diffusion Model Alignment with Sampling DemonsPoster3 citations
- Understanding Long Videos with Multimodal Language ModelsPoster3 citations
- Unified Convergence Analysis for Score-Based Diffusion Models with Deterministic SamplersPoster3 citations
- Unified Parameter-Efficient Unlearning for LLMsPoster3 citations
- Unlocking the Potential of Model Calibration in Federated LearningPoster3 citations
- Unveiling the Secret Recipe: A Guide For Supervised Fine-Tuning Small LLMsPoster3 citations
- VLAS: Vision-Language-Action Model with Speech Instructions for Customized Robot ManipulationPoster3 citations
- Valid Conformal Prediction for Dynamic GNNsPoster3 citations
- Verifying Properties of Binary Neural Networks Using Sparse Polynomial OptimizationPoster3 citations
- VibeCheck: Discover and Quantify Qualitative Differences in Large Language ModelsPoster3 citations
- VideoWebArena: Evaluating Long Context Multimodal Agents with Video Understanding Web TasksPoster3 citations
- VisualPredicator: Learning Abstract World Models with Neuro-Symbolic Predicates for Robot PlanningSpotlight3 citations
- Watermark Anything With Localized MessagesPoster3 citations
- Weak-to-Strong Generalization Through the Data-Centric LensPoster3 citations
- Weighted-Reward Preference Optimization for Implicit Model FusionPoster3 citations
- What Are Good Positional Encodings for Directed Graphs?Poster3 citations
- What Makes a Good Diffusion Planner for Decision Making?Spotlight3 citations
- What Matters in Learning from Large-Scale Datasets for Robot ManipulationPoster3 citations
- XLand-100B: A Large-Scale Multi-Task Dataset for In-Context Reinforcement LearningPoster3 citations
- Your Weak LLM is Secretly a Strong Teacher for AlignmentPoster3 citations
- A Coefficient Makes SVRG EffectivePoster2 citations
- A Probabilistic Perspective on Unlearning and Alignment for Large Language ModelsOral2 citations
- A Watermark for Order-Agnostic Language ModelsPoster2 citations
- A-Bench: Are LMMs Masters at Evaluating AI-generated Images?Poster2 citations
- AI as Humanity’s Salieri: Quantifying Linguistic Creativity of Language Models via Systematic Attribution of Machine Text against Web TextOral2 citations
- API Pack: A Massive Multi-Programming Language Dataset for API Call GenerationPoster2 citations
- Accessing Vision Foundation Models via ImageNet-1KPoster2 citations
- ActionReasoningBench: Reasoning about Actions with and without Ramification ConstraintsPoster2 citations
- Adapters for Altering LLM Vocabularies: What Languages Benefit the Most?Poster2 citations
- Adaptive Length Image Tokenization via Recurrent AllocationPoster2 citations
- Adaptive Methods through the Lens of SDEs: Theoretical Insights on the Role of NoisePoster2 citations
- AdvWave: Stealthy Adversarial Jailbreak Attack against Large Audio-Language ModelsPoster2 citations
- Adversarial Machine UnlearningPoster2 citations
- Agent Skill Acquisition for Large Language Models via CycleQDPoster2 citations
- Aligned Better, Listen Better for Audio-Visual Large Language ModelsPoster2 citations
- Aligning Language Models with Demonstrated FeedbackPoster2 citations
- Aligning Visual Contrastive learning models via Preference OptimizationPoster2 citations
- An Evolved Universal Transformer MemoryPoster2 citations
- Analytic DAG Constraints for Differentiable DAG LearningPoster2 citations
- Any-step Dynamics Model Improves Future Predictions for Online and Offline Reinforcement LearningPoster2 citations
- AnyTouch: Learning Unified Static-Dynamic Representation across Multiple Visuo-tactile SensorsPoster2 citations
- Are Large Vision Language Models Good Game Players?Poster2 citations
- As Simple as Fine-tuning: LLM Alignment via Bidirectional Negative Feedback LossPoster2 citations
- B-STaR: Monitoring and Balancing Exploration and Exploitation in Self-Taught ReasonersPoster2 citations
- BaB-ND: Long-Horizon Motion Planning with Branch-and-Bound and Neural DynamicsPoster2 citations
- BadJudge: Backdoor Vulnerabilities of LLM-As-A-JudgePoster2 citations
- Benchmarking LLMs' Judgments with No Gold StandardPoster2 citations
- Beyond Circuit Connections: A Non-Message Passing Graph Transformer Approach for Quantum Error MitigationPoster2 citations
- Beyond Graphs: Can Large Language Models Comprehend Hypergraphs?Poster2 citations
- Beyond correlation: The impact of human uncertainty in measuring the effectiveness of automatic evaluation and LLM-as-a-judgePoster2 citations
- Beyond the convexity assumption: Realistic tabular data generation under quantifier-free real linear constraintsPoster2 citations
- Biologically Plausible Brain Graph TransformerPoster2 citations
- BirdSet: A Large-Scale Dataset for Audio Classification in Avian BioacousticsSpotlight2 citations
- Boltzmann priors for Implicit Transfer OperatorsPoster2 citations
- Both Ears Wide Open: Towards Language-Driven Spatial Audio GenerationSpotlight2 citations
- Breach By A Thousand Leaks: Unsafe Information Leakage in 'Safe' AI ResponsesPoster2 citations
- Breaking the Reclustering Barrier in Centroid-based Deep ClusteringPoster2 citations
- Bridging and Modeling Correlations in Pairwise Data for Direct Preference OptimizationPoster2 citations
- CBGBench: Fill in the Blank of Protein-Molecule Complex Binding GraphSpotlight2 citations
- CPSample: Classifier Protected Sampling for Guarding Training Data During DiffusionPoster2 citations
- CTSyn: A Foundation Model for Cross Tabular Data GenerationPoster2 citations
- Can Textual Gradient Work in Federated Learning?Poster2 citations
- CapeX: Category-Agnostic Pose Estimation from Textual Point ExplanationPoster2 citations
- Capturing the Temporal Dependence of Training Data InfluenceOral2 citations
- Catastrophic Failure of LLM Unlearning via QuantizationPoster2 citations
- ChroKnowledge: Unveiling Chronological Knowledge of Language Models in Multiple DomainsPoster2 citations
- Circuit Representation Learning with Masked Gate Modeling and Verilog-AIG AlignmentPoster2 citations
- CoRNStack: High-Quality Contrastive Data for Better Code Retrieval and RerankingPoster2 citations
- Comparing noisy neural population dynamics using optimal transport distancesOral2 citations
- Compositional simulation-based inference for time seriesPoster2 citations
- Computational Explorations of Total Variation DistanceSpotlight2 citations
- Concept Pinpoint Eraser for Text-to-image Diffusion Models via Residual Attention GatePoster2 citations
- ContextGNN: Beyond Two-Tower Recommendation SystemsPoster2 citations
- Contextual Self-paced Learning for Weakly Supervised Spatio-Temporal Video GroundingPoster2 citations
- Continuous Ensemble Weather Forecasting with Diffusion modelsPoster2 citations
- Contractive Dynamical Imitation Policies for Efficient Out-of-Sample RecoveryPoster2 citations
- Contrastive Learning from Synthetic Audio DoppelgängersPoster2 citations
- Convergence and Implicit Bias of Gradient Descent on Continual Linear ClassificationPoster2 citations
- Copyright-Protected Language Generation via Adaptive Model FusionOral2 citations
- Correlated Proxies: A New Definition and Improved Mitigation for Reward HackingSpotlight2 citations
- Counterfactual Concept Bottleneck ModelsPoster2 citations
- Cross-Entropy Is All You Need To Invert the Data Generating ProcessOral2 citations
- Cut Your Losses in Large-Vocabulary Language ModelsOral2 citations
- DICE: End-to-end Deformation Capture of Hand-Face Interactions from a Single ImagePoster2 citations
- DOPL: Direct Online Preference Learning for Restless Bandits with Preference FeedbackPoster2 citations
- DS-LLM: Leveraging Dynamical Systems to Enhance Both Training and Inference of Large Language ModelsPoster2 citations
- DSBench: How Far Are Data Science Agents from Becoming Data Science Experts?Poster2 citations
- DarkBench: Benchmarking Dark Patterns in Large Language ModelsOral2 citations
- Data Selection via Optimal Control for Language ModelsOral2 citations
- Data Taggants: Dataset Ownership Verification Via Harmless Targeted Data PoisoningPoster2 citations
- DataGen: Unified Synthetic Dataset Generation via Large Language ModelsPoster2 citations
- DataMan: Data Manager for Pre-training Large Language ModelsPoster2 citations
- DeFT: Decoding with Flash Tree-attention for Efficient Tree-structured LLM InferenceSpotlight2 citations
- Decentralized Sporadic Federated Learning: A Unified Algorithmic Framework with Convergence GuaranteesSpotlight2 citations
- Deep Linear Probe Generators for Weight Space LearningPoster2 citations
- DeepGate4: Efficient and Effective Representation Learning for Circuit Design at ScalePoster2 citations
- DenoiseVAE: Learning Molecule-Adaptive Noise Distributions for Denoising-based 3D Molecular Pre-trainingPoster2 citations
- Denoising Task Difficulty-based Curriculum for Training Diffusion ModelsPoster2 citations
- Denoising as Adaptation: Noise-Space Domain Adaptation for Image RestorationPoster2 citations
- Detecting Backdoor Samples in Contrastive Language Image PretrainingPoster2 citations
- DiffPuter: Empowering Diffusion Models for Missing Data ImputationSpotlight2 citations
- Diffusion Actor-Critic: Formulating Constrained Policy Iteration as Diffusion Noise Regression for Offline Reinforcement LearningPoster2 citations
- DisEnvisioner: Disentangled and Enriched Visual Prompt for Customized Image GenerationPoster2 citations
- Disentangling Representations through Multi-task LearningPoster2 citations
- Do Egocentric Video-Language Models Truly Understand Hand-Object Interactions?Poster2 citations
- Do LLMs Recognize Your Preferences? Evaluating Personalized Preference Following in LLMsOral2 citations
- Do LLMs ``know'' internally when they follow instructions?Poster2 citations
- Does Safety Training of LLMs Generalize to Semantically Related Natural Prompts?Poster2 citations
- Dream to Manipulate: Compositional World Models Empowering Robot Imitation Learning with ImaginationPoster2 citations
- Efficient Inference for Large Language Model-based Generative RecommendationPoster2 citations
- Efficient and Accurate Explanation Estimation with Distribution CompressionSpotlight2 citations
- Elucidating the Preconditioning in Consistency DistillationPoster2 citations
- Enhancing Learning with Label Differential Privacy by Vector ApproximationSpotlight2 citations
- Epistemic Monte Carlo Tree SearchPoster2 citations
- EqNIO: Subequivariant Neural Inertial OdometryPoster2 citations
- Evaluating Large Language Models through Role-Guide and Self-Reflection: A Comparative StudyPoster2 citations
- Exact Byte-Level Probabilities from Tokenized Language Models for FIM-Tasks and Model EnsemblesPoster2 citations
- Exploring Local Memorization in Diffusion Models via Bright Ending AttentionSpotlight2 citations
- Exploring the Design Space of Visual Context Representation in Video MLLMsPoster2 citations
- Expressivity of Neural Networks with Random Weights and Learned BiasesPoster2 citations
- Extending Mercer's expansion to indefinite and asymmetric kernelsPoster2 citations
- Feature-Based Online Bilateral TradePoster2 citations
- FlashMask: Efficient and Rich Mask Extension of FlashAttentionPoster2 citations
- Flavors of Margin: Implicit Bias of Steepest Descent in Homogeneous Neural NetworksPoster2 citations
- FlexCAD: Unified and Versatile Controllable CAD Generation with Fine-tuned Large Language ModelsPoster2 citations
- Flow Matching with Gaussian Process Priors for Probabilistic Time Series ForecastingPoster2 citations
- Following the Human Thread in Social NavigationSpotlight2 citations
- Forgetting Transformer: Softmax Attention with a Forget GatePoster2 citations
- Forking Paths in Neural Text GenerationPoster2 citations
- Fragment and Geometry Aware Tokenization of Molecules for Structure-Based Drug Design Using Language ModelsPoster2 citations
- FreCaS: Efficient Higher-Resolution Image Generation via Frequency-aware Cascaded SamplingPoster2 citations
- From Few to Many: Self-Improving Many-Shot Reasoners Through Iterative Optimization and GenerationPoster2 citations
- From Sparse Dependence to Sparse Attention: Unveiling How Chain-of-Thought Enhances Transformer Sample EfficiencyPoster2 citations
- GEVRM: Goal-Expressive Video Generation Model For Robust Visual ManipulationPoster2 citations
- GI-GS: Global Illumination Decomposition on Gaussian Splatting for Inverse RenderingPoster2 citations
- GIFT: Unlocking Full Potential of Labels in Distilled Dataset at Near-zero CostPoster2 citations
- GMValuator: Similarity-based Data Valuation for Generative ModelsPoster2 citations
- GROOT-2: Weakly Supervised Multimodal Instruction Following AgentsPoster2 citations
- GS-LiDAR: Generating Realistic LiDAR Point Clouds with Panoramic Gaussian SplattingPoster2 citations
- GameArena: Evaluating LLM Reasoning through Live Computer GamesPoster2 citations
- Gaussian-Det: Learning Closed-Surface Gaussians for 3D Object DetectionPoster2 citations
- Generalization Bounds and Model Complexity for Kolmogorov–Arnold NetworksPoster2 citations
- Generating Freeform Endoskeletal RobotsSpotlight2 citations
- Generative Classifiers Avoid Shortcut SolutionsPoster2 citations
- GraphArena: Evaluating and Exploring Large Language Models on Graph ComputationPoster2 citations
- Growth Inhibitors for Suppressing Inappropriate Image Concepts in Diffusion ModelsPoster2 citations
- HALL-E: Hierarchical Neural Codec Language Model for Minute-Long Zero-Shot Text-to-Speech SynthesisPoster2 citations
- Herald: A Natural Language Annotated Lean 4 DatasetPoster2 citations
- HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous EnvironmentPoster2 citations
- High-Precision Dichotomous Image Segmentation via Probing Diffusion CapacityPoster2 citations
- Hotspot-Driven Peptide Design via Multi-Fragment Autoregressive ExtensionPoster2 citations
- Hyper-ConnectionsPoster2 citations
- I Can Hear You: Selective Robust Training for Deepfake Audio DetectionPoster2 citations
- ImDy: Human Inverse Dynamics from Imitated ObservationsPoster2 citations
- ImProver: Agent-Based Automated Proof OptimizationPoster2 citations
- Image Watermarks are Removable using Controllable Regeneration from Clean NoisePoster2 citations
- ImagineNav: Prompting Vision-Language Models as Embodied Navigator through Scene ImaginationPoster2 citations
- Immunogenicity Prediction with Dual Attention Enables Vaccine Target SelectionPoster2 citations
- Implicit In-context LearningPoster2 citations
- Improved Training Technique for Latent Consistency ModelsPoster2 citations
- Influence Functions for Scalable Data Attribution in Diffusion ModelsOral2 citations
- Intelligence at the Edge of ChaosPoster2 citations
- Interference Among First-Price Pacing Equilibria: A Bias and Variance AnalysisPoster2 citations
- IntersectionZoo: Eco-driving for Benchmarking Multi-Agent Contextual Reinforcement LearningPoster2 citations
- LLM Unlearning via Loss Adjustment with Only Forget DataPoster2 citations
- LLMs Can Plan Only If We Tell ThemPoster2 citations
- LaMPlace: Learning to Optimize Cross-Stage Metrics in Macro PlacementOral2 citations
- LancBiO: Dynamic Lanczos-aided Bilevel Optimization via Krylov SubspacePoster2 citations
- Language Imbalance Driven Rewarding for Multilingual Self-improvingPoster2 citations
- Lasso Bandit with Compatibility Condition on Optimal ArmPoster2 citations
- Last-Iterate Convergence Properties of Regret-Matching Algorithms in GamesPoster2 citations
- Layout-your-3D: Controllable and Precise 3D Generation with 2D BlueprintPoster2 citations
- LeanQuant: Accurate and Scalable Large Language Model Quantization with Loss-error-aware GridPoster2 citations
- Learning Distributions of Complex Fluid Simulations with Diffusion Graph NetworksOral2 citations
- Learning Generalizable Skills from Offline Multi-Task Data for Multi-Agent CooperationPoster2 citations
- Learning Shape-Independent Transformation via Spherical Representations for Category-Level Object Pose EstimationPoster2 citations
- Learning Spatial-Semantic Features for Robust Video Object SegmentationPoster2 citations
- Learning a Neural Solver for Parametric PDEs to Enhance Physics-Informed MethodsPoster2 citations
- Learning local equivariant representations for quantum operatorsSpotlight2 citations
- Learning stochastic dynamics from snapshots through regularized unbalanced optimal transportOral2 citations
- Learning to Discretize Denoising Diffusion ODEsOral2 citations
- Learning to Solve Differential Equation Constrained Optimization ProblemsSpotlight2 citations
- Locality Alignment Improves Vision-Language ModelsPoster2 citations
- Looped Transformers for Length GeneralizationPoster2 citations
- MA-RLHF: Reinforcement Learning from Human Feedback with Macro ActionsPoster2 citations
- MAST: model-agnostic sparsified trainingPoster2 citations
- MIND: Math Informed syNthetic Dialogues for Pretraining LLMsPoster2 citations
- MMQA: Evaluating LLMs with Multi-Table Multi-Hop Complex QuestionsOral2 citations
- MaestroMotif: Skill Design from Artificial Intelligence FeedbackOral2 citations
- Measuring Non-Adversarial Reproduction of Training Data in Large Language ModelsPoster2 citations
- Measuring and Enhancing Trustworthiness of LLMs in RAG through Grounded Attributions and Learning to RefuseOral2 citations
- Mechanistic Permutability: Match Features Across LayersPoster2 citations
- MetaDesigner: Advancing Artistic Typography through AI-Driven, User-Centric, and Multilingual WordArt SynthesisPoster2 citations
- Metalic: Meta-Learning In-Context with Protein Language ModelsPoster2 citations
- Methods with Local Steps and Random Reshuffling for Generally Smooth Non-Convex Federated OptimizationPoster2 citations
- Microcanonical Langevin Ensembles: Advancing the Sampling of Bayesian Neural NetworksPoster2 citations
- Min-K%++: Improved Baseline for Pre-Training Data Detection from Large Language ModelsSpotlight2 citations
- Mixture of Attentions For Speculative DecodingPoster2 citations
- MoS: Unleashing Parameter Efficiency of Low-Rank Adaptation with Mixture of ShardsPoster2 citations
- Model Editing as a Robust and Denoised variant of DPO: A Case Study on ToxicityPoster2 citations
- Model Equality Testing: Which Model is this API Serving?Poster2 citations
- MolSpectra: Pre-training 3D Molecular Representation with Multi-modal Energy SpectraPoster2 citations
- Montessori-Instruct: Generate Influential Training Data Tailored for Student LearningPoster2 citations
- Morphing Tokens Draw Strong Masked Image ModelsPoster2 citations
- MorphoDiff: Cellular Morphology Painting with Diffusion ModelsSpotlight2 citations
- MrSteve: Instruction-Following Agents in Minecraft with What-Where-When MemoryPoster2 citations
- NNsight and NDIF: Democratizing Access to Open-Weight Foundation Model InternalsPoster2 citations
- NeRAF: 3D Scene Infused Neural Radiance and Acoustic FieldsPoster2 citations
- Needle Threading: Can LLMs Follow Threads Through Near-Million-Scale Haystacks?Poster2 citations
- Nesterov acceleration in benignly non-convex landscapesSpotlight2 citations
- Neuron based Personality Trait Induction in Large Language ModelsPoster2 citations
- Neuroplastic Expansion in Deep Reinforcement LearningPoster2 citations
- OATS: Outlier-Aware Pruning Through Sparse and Low Rank DecompositionPoster2 citations
- OBI-Bench: Can LMMs Aid in Study of Ancient Script on Oracle Bones?Poster2 citations
- OPTAMI: Global Superlinear Convergence of High-order MethodsPoster2 citations
- OSTQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution FittingPoster2 citations
- OmniKV: Dynamic Context Selection for Efficient Long-Context LLMsPoster2 citations
- OmniPhysGS: 3D Constitutive Gaussians for General Physics-Based Dynamics GenerationPoster2 citations
- On Calibration of LLM-based Guard Models for Reliable Content ModerationPoster2 citations
- On a Connection Between Imitation Learning and RLHFPoster2 citations
- On the Convergence of No-Regret Dynamics in Information Retrieval Games with Proportional Ranking FunctionsPoster2 citations
- On the Crucial Role of Initialization for Matrix FactorizationPoster2 citations
- On the Hölder Stability of Multiset and Graph Neural NetworksOral2 citations
- Open-Vocabulary Customization from CLIP via Data-Free Knowledge DistillationOral2 citations
- Open-World Reinforcement Learning over Long Short-Term ImaginationOral2 citations
- OpenRCA: Can Large Language Models Locate the Root Cause of Software Failures?Poster2 citations
- Operator Deep Smoothing for Implied VolatilityPoster2 citations
- Optimal Strong Regret and Violation in Constrained MDPs via Policy OptimizationPoster2 citations
- Optimization by Parallel Quasi-Quantum Annealing with Gradient-Based SamplingPoster2 citations
- Overcoming False Illusions in Real-World Face Restoration with Multi-Modal Guided Diffusion ModelSpotlight2 citations
- PADRe: A Unifying Polynomial Attention Drop-in Replacement for Efficient Vision TransformerPoster2 citations
- PAL: Sample-Efficient Personalized Reward Modeling for Pluralistic AlignmentPoster2 citations
- PALMBENCH: A COMPREHENSIVE BENCHMARK OF COMPRESSED LARGE LANGUAGE MODELS ON MOBILE PLATFORMSPoster2 citations
- Physics-Informed Deep Inverse Operator Networks for Solving PDE Inverse ProblemsPoster2 citations
- PolaFormer: Polarity-aware Linear Attention for Vision TransformersPoster2 citations
- Precedence-Constrained Winter Value for Effective Graph Data ValuationPoster2 citations
- Prioritized Generative ReplayOral2 citations
- Progressive Compositionality in Text-to-Image Generative ModelsSpotlight2 citations
- Progressive Compression with Universally Quantized Diffusion ModelsOral2 citations
- Progressive Mixed-Precision Decoding for Efficient LLM InferencePoster2 citations
- Progressive distillation induces an implicit curriculumOral2 citations
- Protecting against simultaneous data poisoning attacksPoster2 citations
- Proteina: Scaling Flow-based Protein Structure Generative ModelsOral2 citations
- Provably Accurate Shapley Value Estimation via Leverage Score SamplingSpotlight2 citations
- Provence: efficient and robust context pruning for retrieval-augmented generationPoster2 citations
- Quantum-PEFT: Ultra parameter-efficient fine-tuningPoster2 citations
- REFINE: Inversion-Free Backdoor Defense via Model ReprogrammingPoster2 citations
- RFWave: Multi-band Rectified Flow for Audio Waveform ReconstructionPoster2 citations
- RMB: Comprehensively benchmarking reward models in LLM alignmentPoster2 citations
- ROUTE: Robust Multitask Tuning and Collaboration for Text-to-SQLPoster2 citations
- Rapidly Adapting Policies to the Real-World via Simulation-Guided Fine-TuningPoster2 citations
- Rare-to-Frequent: Unlocking Compositional Generation Power of Diffusion Models on Rare Concepts with LLM GuidanceSpotlight2 citations
- ReAttention: Training-Free Infinite Context with Finite Attention ScopePoster2 citations
- ReGenesis: LLMs can Grow into Reasoning Generalists via Self-ImprovementOral2 citations
- Reasoning of Large Language Models over Knowledge Graphs with Super-RelationsPoster2 citations
- Reflective Gaussian SplattingPoster2 citations
- Regressing the Relative Future: Efficient Policy Optimization for Multi-turn RLHFPoster2 citations
- RelCon: Relative Contrastive Learning for a Motion Foundation Model for Wearable DataPoster2 citations
- Residual Stream Analysis with Multi-Layer SAEsPoster2 citations
- Residual-MPPI: Online Policy Customization for Continuous ControlPoster2 citations
- Rethinking LLM Unlearning Objectives: A Gradient Perspective and Go BeyondPoster2 citations
- Retrieval Augmented Diffusion Model for Structure-informed Antibody Design and OptimizationPoster2 citations
- Revealing and Reducing Gender Biases in Vision and Language Assistants (VLAs)Poster2 citations
- Revisiting Random Walks for Learning on GraphsSpotlight2 citations
- RuAG: Learned-rule-augmented Generation for Large Language ModelsPoster2 citations
- SANER: Annotation-free Societal Attribute Neutralizer for Debiasing CLIPPoster2 citations
- SAVA: Scalable Learning-Agnostic Data ValuationPoster2 citations
- STAFF: Speculative Coreset Selection for Task-Specific Fine-tuningPoster2 citations
- STAR: Synthesis of Tailored ArchitecturesOral2 citations
- SVBench: A Benchmark with Temporal Multi-Turn Dialogues for Streaming Video UnderstandingSpotlight2 citations
- SWIFT: On-the-Fly Self-Speculative Decoding for LLM Inference AccelerationPoster2 citations
- Samba: Synchronized Set-of-Sequences Modeling for Multiple Object TrackingSpotlight2 citations
- ScImage: How good are multimodal large language models at scientific text-to-image generation?Poster2 citations
- Scalable Bayesian Learning with posteriorsPoster2 citations
- Scalable Discrete Diffusion Samplers: Combinatorial Optimization and Statistical PhysicsPoster2 citations
- Scaling Laws for Downstream Task Performance in Machine TranslationPoster2 citations
- Scaling Speech-Text Pre-training with Synthetic Interleaved DataPoster2 citations
- Score Forgetting Distillation: A Swift, Data-Free Method for Machine Unlearning in Diffusion ModelsPoster2 citations
- Scrutinize What We Ignore: Reining In Task Representation Shift Of Context-Based Offline Meta Reinforcement LearningPoster2 citations
- SePer: Measure Retrieval Utility Through The Lens Of Semantic Perplexity ReductionSpotlight2 citations
- Searching for Optimal Solutions with LLMs via Bayesian OptimizationPoster2 citations
- Second-Order Min-Max Optimization with Lazy HessiansOral2 citations
- See What You Are Told: Visual Attention Sink in Large Multimodal ModelsPoster2 citations
- Seeing Eye to AI: Human Alignment via Gaze-Based Response Rewards for Large Language ModelsPoster2 citations
- Semantics-Adaptive Activation Intervention for LLMs via Dynamic Steering VectorsPoster2 citations
- SiReRAG: Indexing Similar and Related Information for Multihop ReasoningPoster2 citations
- Simulating Human-like Daily Activities with Desire-driven AutonomyPoster2 citations
- Size-Generalizable RNA Structure Evaluation by Exploring Hierarchical GeometriesPoster2 citations
- Skill Expansion and Composition in Parameter SpacePoster2 citations
- SmartPretrain: Model-Agnostic and Dataset-Agnostic Representation Learning for Motion PredictionPoster2 citations
- Solving Token Gradient Conflict in Mixture-of-Experts for Large Vision-Language ModelPoster2 citations
- Sparse autoencoders reveal selective remapping of visual concepts during adaptationPoster2 citations
- Straight to Zero: Why Linearly Decaying the Learning Rate to Zero Works Best for LLMsPoster2 citations
- Strategic Classification With ExternalitiesPoster2 citations
- Streamlining Prediction in Bayesian Deep LearningPoster2 citations
- Surgical, Cheap, and Flexible: Mitigating False Refusal in Language Models via Single Vector AblationPoster2 citations
- SyllableLM: Learning Coarse Semantic Units for Speech Language ModelsPoster2 citations
- Synthio: Augmenting Small-Scale Audio Classification Datasets with Synthetic DataPoster2 citations
- T-JEPA: Augmentation-Free Self-Supervised Learning for Tabular DataPoster2 citations
- TGB-Seq Benchmark: Challenging Temporal GNNs with Complex Sequential DynamicsPoster2 citations
- TIPS: Text-Image Pretraining with Spatial awarenessPoster2 citations
- Tailoring Mixup to Data for CalibrationPoster2 citations
- Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking DynamicsPoster2 citations
- TaskGalaxy: Scaling Multi-modal Instruction Fine-tuning with Tens of Thousands Vision Task TypesPoster2 citations
- Temporal Reasoning Transfer from Text to VideoPoster2 citations
- The Complexity of Two-Team Polymatrix Games with Independent AdversariesOral2 citations
- The Same but Different: Structural Similarities and Differences in Multilingual Language ModelingPoster2 citations
- Think Then React: Towards Unconstrained Action-to-Reaction Motion GenerationPoster2 citations
- TimeKAN: KAN-based Frequency Decomposition Learning Architecture for Long-term Time Series ForecastingPoster2 citations
- TokenFormer: Rethinking Transformer Scaling with Tokenized Model ParametersSpotlight2 citations
- TopoLM: brain-like spatio-functional organization in a topographic language modelOral2 citations
- TopoNets: High performing vision and language models with brain-like topographySpotlight2 citations
- Toward Guidance-Free AR Visual Generation via Condition Contrastive AlignmentOral2 citations
- Towards Optimal Multi-draft Speculative DecodingPoster2 citations
- Track-On: Transformer-based Online Point Tracking with MemoryPoster2 citations
- Trajectory-LLM: A Language-based Data Generator for Trajectory Prediction in Autonomous DrivingPoster2 citations
- Transformers Handle Endogeneity in In-Context Linear RegressionPoster2 citations
- Truncated Consistency ModelsPoster2 citations
- Tuning Frequency Bias of State Space ModelsSpotlight2 citations
- Tuning Timestep-Distilled Diffusion Model Using Pairwise Sample OptimizationPoster2 citations
- Tuning-Free Bilevel Optimization: New Algorithms and Convergence AnalysisPoster2 citations
- TweedieMix: Improving Multi-Concept Fusion for Diffusion-based Image/Video GenerationPoster2 citations
- Unbounded: A Generative Infinite Game of Character Life SimulationPoster2 citations
- Uncertainty modeling for fine-tuned implicit functionsPoster2 citations
- Underdamped Diffusion Bridges with Applications to SamplingPoster2 citations
- Unearthing Skill-level Insights for Understanding Trade-offs of Foundation ModelsPoster2 citations
- UniGEM: A Unified Approach to Generation and Property Prediction for MoleculesPoster2 citations
- Unify ML4TSP: Drawing Methodological Principles for TSP and Beyond from Streamlined Design Space of Learning and SearchPoster2 citations
- Vector-ICL: In-context Learning with Continuous Vector RepresentationsPoster2 citations
- ViBiDSampler: Enhancing Video Interpolation Using Bidirectional Diffusion SamplerPoster2 citations
- Video In-context Learning: Autoregressive Transformers are Zero-Shot Video ImitatorsPoster2 citations
- VideoGrain: Modulating Space-Time Attention for Multi-Grained Video EditingPoster2 citations
- VideoShield: Regulating Diffusion-based Video Generation Models via WatermarkingPoster2 citations
- Vision Language Models are In-Context Value LearnersSpotlight2 citations
- Wavelet Diffusion Neural OperatorPoster2 citations
- WeatherGFM: Learning a Weather Generalist Foundation Model via In-context LearningPoster2 citations
- What Makes a Maze Look Like a Maze?Poster2 citations
- What Secrets Do Your Manifolds Hold? Understanding the Local Geometry of Generative ModelsPoster2 citations
- What should a neuron aim for? Designing local objective functions based on information theoryOral2 citations
- Wicked Oddities: Selectively Poisoning for Effective Clean-Label Backdoor AttacksPoster2 citations
- Wide Neural Networks Trained with Weight Decay Provably Exhibit Neural CollapseOral2 citations
- ZETA: Leveraging $Z$-order Curves for Efficient Top-$k$ AttentionPoster2 citations
- Zero-shot Model-based Reinforcement Learning using Large Language ModelsPoster2 citations
- kNN Attention Demystified: A Theoretical Exploration for Scalable TransformersPoster2 citations
- miniCTX: Neural Theorem Proving with (Long-)ContextsOral2 citations
- {$\tau$}-bench: A Benchmark for \underline{T}ool-\underline{A}gent-\underline{U}ser Interaction in Real-World DomainsPoster2 citations
- $InterLCM$: Low-Quality Images as Intermediate States of Latent Consistency Models for Effective Blind Face RestorationPoster1 citations
- (Mis)Fitting Scaling Laws: A Survey of Scaling Law Fitting Techniques in Deep LearningPoster1 citations
- 3D-AffordanceLLM: Harnessing Large Language Models for Open-Vocabulary Affordance Detection in 3D WorldsPoster1 citations
- 6D Object Pose Tracking in Internet Videos for Robotic ManipulationPoster1 citations
- 6DGS: Enhanced Direction-Aware Gaussian Splatting for Volumetric RenderingPoster1 citations
- A Benchmark for Semantic Sensitive Information in LLMs OutputsPoster1 citations
- A Black Swan Hypothesis: The Role of Human Irrationality in AI SafetyPoster1 citations
- A Common Pitfall of Margin-based Language Model Alignment: Gradient EntanglementPoster1 citations
- A Conditional Independence Test in the Presence of DiscretizationPoster1 citations
- A General Framework for Producing Interpretable Semantic Text EmbeddingsPoster1 citations
- A Periodic Bayesian Flow for Material GenerationSpotlight1 citations
- A Simple Approach to Unifying Diffusion-based Conditional GenerationPoster1 citations
- A Simple yet Effective $\Delta\Delta G$ Predictor is An Unsupervised Antibody Optimizer and ExplainerPoster1 citations
- A Single Goal is All You Need: Skills and Exploration Emerge from Contrastive RL without Rewards, Demonstrations, or SubgoalsPoster1 citations
- A Statistical Framework for Ranking LLM-based ChatbotsPoster1 citations
- A Theoretical Framework for Partially-Observed Reward States in RLHFPoster1 citations
- A Theory for Token-Level Harmonization in Retrieval-Augmented GenerationPoster1 citations
- A Unified Framework for Forward and Inverse Problems in Subsurface Imaging using Latent Space TranslationsPoster1 citations
- A new framework for evaluating model out-of-distribution generalisation for the biochemical domainPoster1 citations
- ACES: Automatic Cohort Extraction System for Event-Stream DatasetsPoster1 citations
- ADIFF: Explaining audio difference using natural languageSpotlight1 citations
- Accelerating Training with Neuron Interaction and Nowcasting NetworksPoster1 citations
- ActSafe: Active Exploration with Safety Constraints for Reinforcement LearningPoster1 citations
- Actions Speak Louder Than Words: Rate-Reward Trade-off in Markov Decision ProcessesPoster1 citations
- Active Task Disambiguation with LLMsSpotlight1 citations
- Ada-K Routing: Boosting the Efficiency of MoE-based LLMsPoster1 citations
- AdaFisher: Adaptive Second Order Optimization via Fisher InformationPoster1 citations
- AdaWM: Adaptive World Model based Planning for Autonomous DrivingPoster1 citations
- Adapting Multi-modal Large Language Model to Concept Drift From Pre-training OnwardsPoster1 citations
- Adaptive $Q$-Network: On-the-fly Target Selection for Deep Reinforcement LearningPoster1 citations
- Addax: Utilizing Zeroth-Order Gradients to Improve Memory Efficiency and Performance of SGD for Fine-Tuning Language ModelsPoster1 citations
- Advancing Mathematical Reasoning in Language Models: The Impact of Problem-Solving Data, Data Synthesis Methods, and Training StagesPoster1 citations
- Advancing Prompt-Based Methods for Replay-Independent General Continual LearningPoster1 citations
- Adversarial Attacks on Data AttributionPoster1 citations
- Adversarial Training Can Provably Improve Robustness: Theoretical Analysis of Feature Learning Process Under Structured DataPoster1 citations
- Agent-to-Sim: Learning Interactive Behavior Models from Casual Longitudinal VideosPoster1 citations
- Amortized Control of Continuous State Space Feynman-Kac Model for Irregular Time SeriesOral1 citations
- Amulet: ReAlignment During Test Time for Personalized Preference Adaptation of LLMsPoster1 citations
- An Empirical Analysis of Uncertainty in Large Language Model EvaluationsPoster1 citations
- An Engorgio Prompt Makes Large Language Model Babble onPoster1 citations
- An Information Criterion for Controlled Disentanglement of Multimodal DataPoster1 citations
- An Online Learning Theory of Trading-Volume MaximizationPoster1 citations
- AnalogGenie: A Generative Engine for Automatic Discovery of Analog Circuit TopologiesSpotlight1 citations
- AniSDF: Fused-Granularity Neural Surfaces with Anisotropic Encoding for High-Fidelity 3D ReconstructionPoster1 citations
- Approximation algorithms for combinatorial optimization with predictionsSpotlight1 citations
- Atomas: Hierarchical Adaptive Alignment on Molecule-Text for Unified Molecule Understanding and GenerationPoster1 citations
- AttriBoT: A Bag of Tricks for Efficiently Approximating Leave-One-Out Context AttributionPoster1 citations
- Attributing Culture-Conditioned Generations to Pretraining CorporaPoster1 citations
- Audio Large Language Models Can Be Descriptive Speech Quality EvaluatorsPoster1 citations
- Automated Filtering of Human Feedback Data for Aligning Text-to-Image Diffusion ModelsPoster1 citations
- BLEND: Behavior-guided Neural Population Dynamics Modeling via Privileged Knowledge DistillationPoster1 citations
- Bad-PFL: Exploiting Backdoor Attacks against Personalized Federated LearningPoster1 citations
- Bayesian Optimization via Continual Variational Last Layer TrainingSpotlight1 citations
- Better than Your Teacher: LLM Agents that learn from Privileged AI FeedbackPoster1 citations
- Beware of Calibration Data for Pruning Large Language ModelsPoster1 citations
- Beyond Autoregression: Fast LLMs via Self-Distillation Through TimePoster1 citations
- Beyond Content Relevance: Evaluating Instruction Following in Retrieval ModelsPoster1 citations
- Beyond Random Masking: When Dropout meets Graph Convolutional NetworksPoster1 citations
- Beyond Sequence: Impact of Geometric Context for RNA Property PredictionPoster1 citations
- Beyond Squared Error: Exploring Loss Design for Enhanced Training of Generative Flow NetworksSpotlight1 citations
- Bilinear MLPs enable weight-based mechanistic interpretabilitySpotlight1 citations
- BingoGuard: LLM Content Moderation Tools with Risk LevelsPoster1 citations
- Boosting Neural Combinatorial Optimization for Large-Scale Vehicle Routing ProblemsPoster1 citations
- Bootstrapping Language-Guided Navigation Learning with Self-Refining Data FlywheelPoster1 citations
- Brain Mapping with Dense Features: Grounding Cortical Semantic Selectivity in Natural Images With Vision TransformersPoster1 citations
- BrainUICL: An Unsupervised Individual Continual Learning Framework for EEG ApplicationsPoster1 citations
- Bridging Compressed Image Latents and Multimodal Large Language ModelsPoster1 citations
- Bridging Jensen Gap for Max-Min Group Fairness Optimization in RecommendationPoster1 citations
- Bridging the Data Provenance Gap Across Text, Speech, and VideoPoster1 citations
- Broaden your SCOPE! Efficient Multi-turn Conversation Planning for LLMs with Semantic SpaceSpotlight1 citations
- Bundle Neural Network for message diffusion on graphsSpotlight1 citations
- C-CLIP: Multimodal Continual Learning for Vision-Language ModelPoster1 citations
- CAKE: Cascading and Adaptive KV Cache Eviction with Layer PreferencesPoster1 citations
- COFlowNet: Conservative Constraints on Flows Enable High-Quality Candidate GenerationPoster1 citations
- CONTRA: Conformal Prediction Region via Normalizing Flow TransformationPoster1 citations
- CR-CTC: Consistency regularization on CTC for improved speech recognitionPoster1 citations
- Calibrating Expressions of CertaintyPoster1 citations
- Can Generative AI Solve Your In-Context Learning Problem? A Martingale PerspectivePoster1 citations
- Can In-context Learning Really Generalize to Out-of-distribution Tasks?Poster1 citations
- Can Transformers Do Enumerative Geometry?Poster1 citations
- Can Watermarks be Used to Detect LLM IP Infringement For Free?Poster1 citations
- Can We Talk Models Into Seeing the World Differently?Poster1 citations
- Causal Order: The Key to Leveraging Imperfect Experts in Causal InferencePoster1 citations
- CertainlyUncertain: A Benchmark and Metric for Multimodal Epistemic and Aleatoric AwarenessPoster1 citations
- Chain-of-region: Visual Language Models Need Details for Diagram AnalysisPoster1 citations
- CirT: Global Subseasonal-to-Seasonal Forecasting with Geometry-inspired TransformerPoster1 citations
- CoInD: Enabling Logical Compositions in Diffusion ModelsPoster1 citations
- CoTFormer: A Chain of Thought Driven Architecture with Budget-Adaptive Computation Cost at InferencePoster1 citations
- Cocoon: Robust Multi-Modal Perception with Uncertainty-Aware Sensor FusionPoster1 citations
- Collab: Controlled Decoding using Mixture of Agents for LLM AlignmentPoster1 citations
- ComLoRA: A Competitive Learning Approach for Enhancing LoRAPoster1 citations
- Competing Large Language Models in Multi-Agent Gaming EnvironmentsPoster1 citations
- Compute-Constrained Data SelectionPoster1 citations
- Concept Bottleneck Language Models For Protein DesignPoster1 citations
- Concept-ROT: Poisoning Concepts in Large Language Models with Model EditingPoster1 citations
- Conditional Diffusion Models are Minimax-Optimal and Manifold-Adaptive for Conditional Distribution EstimationPoster1 citations
- Conditional Testing based on Localized Conformal $p$-valuesPoster1 citations
- Consistency Checks for Language Model ForecastersOral1 citations
- Consistent Flow Distillation for Text-to-3D GenerationPoster1 citations
- Context Clues: Evaluating Long Context Models for Clinical Prediction Tasks on EHR DataPoster1 citations
- Control-oriented Clustering of Visual Latent RepresentationSpotlight1 citations
- Controllable Generation via Locally Constrained ResamplingPoster1 citations
- Controllable Unlearning for Image-to-Image Generative Models via $\epsilon$-Constrained OptimizationPoster1 citations
- Controlled LLM Decoding via Discrete Auto-regressive BiasingPoster1 citations
- Counterfactual RealizabilitySpotlight1 citations
- Cross the Gap: Exposing the Intra-modal Misalignment in CLIP via Modality InversionPoster1 citations
- Cross-Domain Offline Policy Adaptation with Optimal Transport and Dataset ConstraintPoster1 citations
- DARE the Extreme: Revisiting Delta-Parameter Pruning For Fine-Tuned ModelsSpotlight1 citations
- DCT-CryptoNets: Scaling Private Inference in the Frequency DomainPoster1 citations
- DEPT: Decoupled Embeddings for Pre-training Language ModelsOral1 citations
- DEPfold: RNA Secondary Structure Prediction as Dependency Parsing.Poster1 citations
- DGQ: Distribution-Aware Group Quantization for Text-to-Image Diffusion ModelsPoster1 citations
- DOTS: Learning to Reason Dynamically in LLMs via Optimal Reasoning Trajectories SearchPoster1 citations
- DRESSing Up LLM: Efficient Stylized Question-Answering via Style Subspace EditingPoster1 citations
- Data Pruning by Information MaximizationPoster1 citations
- Data-adaptive Differentially Private Prompt Synthesis for In-Context LearningPoster1 citations
- DataEnvGym: Data Generation Agents in Teacher Environments with Student FeedbackSpotlight1 citations
- Dataset Distillation via Knowledge Distillation: Towards Efficient Self-Supervised Pre-training of Deep NetworksPoster1 citations
- DebGCD: Debiased Learning with Distribution Guidance for Generalized Category DiscoveryPoster1 citations
- Debiasing Mini-Batch Quadratics for Applications in Deep LearningPoster1 citations
- Decoding Game: On Minimax Optimality of Heuristic Text Generation StrategiesPoster1 citations
- Deep Distributed Optimization for Large-Scale Quadratic ProgrammingPoster1 citations
- Deep Weight Factorization: Sparse Learning Through the Lens of Artificial SymmetriesPoster1 citations
- Demystifying Online Clustering of Bandits: Enhanced Exploration Under Stochastic and Smoothed Adversarial ContextsPoster1 citations
- Demystifying the Token Dynamics of Deep Selective State Space ModelsSpotlight1 citations
- Denoising with a Joint-Embedding Predictive ArchitecturePoster1 citations
- Dense Video Object Captioning from Disjoint SupervisionSpotlight1 citations
- DexTrack: Towards Generalizable Neural Tracking Control for Dexterous Manipulation from Human ReferencesPoster1 citations
- DiSK: Differentially Private Optimizer with Simplified Kalman Filter for Noise ReductionPoster1 citations
- Diff-2-in-1: Bridging Generation and Dense Perception with Diffusion ModelsPoster1 citations
- DiffGAD: A Diffusion-based Unsupervised Graph Anomaly DetectorPoster1 citations
- Differentiation and Specialization of Attention Heads via the Refined Local Learning CoefficientSpotlight1 citations
- Diffusion State-Guided Projected Gradient for Inverse ProblemsPoster1 citations
- Diffusion$^2$: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion ModelsPoster1 citations
- DiffusionGuard: A Robust Defense Against Malicious Diffusion-based Image EditingPoster1 citations
- Discovering Clone Negatives via Adaptive Contrastive Learning for Image-Text MatchingPoster1 citations
- Discrete Copula DiffusionPoster1 citations
- Discriminating image representations with principal distortionsPoster1 citations
- Discriminator-Guided Embodied Planning for LLM AgentPoster1 citations
- Distance-Based Tree-Sliced Wasserstein DistancePoster1 citations
- Distilled Decoding 1: One-step Sampling of Image Auto-regressive Models with Flow MatchingPoster1 citations
- Distilling Structural Representations into Protein Sequence ModelsPoster1 citations
- Distributed Speculative Inference (DSI): Speculation Parallelism for Provably Faster Lossless Language Model InferencePoster1 citations
- Distribution-Free Data Uncertainty for Neural Network RegressionPoster1 citations
- Divergence-enhanced Knowledge-guided Context Optimization for Visual-Language Prompt TuningPoster1 citations
- Diverse Preference Learning for Capabilities and AlignmentPoster1 citations
- Do Deep Neural Network Solutions Form a Star Domain?Poster1 citations
- Do as I do (Safely): Mitigating Task-Specific Fine-tuning Risks in Large Language ModelsPoster1 citations
- Do as We Do, Not as You Think: the Conformity of Large Language ModelsOral1 citations
- Domain Guidance: A Simple Transfer Approach for a Pre-trained Diffusion ModelPoster1 citations
- Don't flatten, tokenize! Unlocking the key to SoftMoE's efficacy in deep RLSpotlight1 citations
- Drama: Mamba-Enabled Model-Based Reinforcement Learning Is Sample and Parameter EfficientPoster1 citations
- Drop-Upcycling: Training Sparse Mixture of Experts with Partial Re-initializationPoster1 citations
- Dynamic Gaussians Mesh: Consistent Mesh Reconstruction from Dynamic ScenesPoster1 citations
- Dynamical Diffusion: Learning Temporal Dynamics with Diffusion ModelsPoster1 citations
- Dysca: A Dynamic and Scalable Benchmark for Evaluating Perception Ability of LVLMsPoster1 citations
- EMOS: Embodiment-aware Heterogeneous Multi-robot Operating System with LLM AgentsPoster1 citations
- Earlier Tokens Contribute More: Learning Direct Preference Optimization From Temporal Decay PerspectivePoster1 citations
- Efficient Active Imitation Learning with Random Network DistillationPoster1 citations
- Efficient Automated Circuit Discovery in Transformers using Contextual DecompositionPoster1 citations
- Efficient Masked AutoEncoder for Video Object Counting and A Large-Scale BenchmarkPoster1 citations
- Efficient Multi-agent Offline Coordination via Diffusion-based Trajectory StitchingPoster1 citations
- Efficient Residual Learning with Mixture-of-Experts for Universal Dexterous GraspingPoster1 citations
- Efficient Source-Free Time-Series Adaptation via Parameter Subspace DisentanglementPoster1 citations
- Efficient Training of Neural Stochastic Differential Equations by Matching Finite Dimensional DistributionsPoster1 citations
- Efficient and Trustworthy Causal Discovery with Latent Variables and Complex RelationsPoster1 citations
- Elliptic Loss RegularizationPoster1 citations
- EmbedLLM: Learning Compact Representations of Large Language ModelsSpotlight1 citations
- Empowering Users in Digital Privacy Management through Interactive LLM-Based AgentsPoster1 citations
- Enabling Realtime Reinforcement Learning at Scale with Staggered Asynchronous InferencePoster1 citations
- Enhancing Compositional Text-to-Image Generation with Reliable Random SeedsSpotlight1 citations
- Enhancing Language Model Agents using Diversity of ThoughtsPoster1 citations
- Enhancing Robust Fairness via Confusional Spectral RegularizationPoster1 citations
- Episodic Memories Generation and Evaluation Benchmark for Large Language ModelsPoster1 citations
- Erasing Concept Combination from Text-to-Image Diffusion ModelPoster1 citations
- Error-quantified Conformal Inference for Time SeriesPoster1 citations
- Evaluating Semantic Variation in Text-to-Image Synthesis: A Causal PerspectivePoster1 citations
- Everything is Editable: Extend Knowledge Editing to Unstructured Data in Large Language ModelsPoster1 citations
- Exact Community Recovery under Side Information: Optimality of Spectral AlgorithmsPoster1 citations
- Expand and Compress: Exploring Tuning Principles for Continual Spatio-Temporal Graph ForecastingPoster1 citations
- Explain Yourself, Briefly! Self-Explaining Neural Networks with Concise Sufficient ReasonsPoster1 citations
- Exploring The Loss Landscape Of Regularized Neural Networks Via Convex DualityOral1 citations
- Exposure Bracketing Is All You Need For A High-Quality ImagePoster1 citations
- Fast Training of Sinusoidal Neural Fields via Scaling InitializationPoster1 citations
- Fast training and sampling of Restricted Boltzmann MachinesPoster1 citations
- Faster Algorithms for Structured Linear and Kernel Support Vector MachinesPoster1 citations
- Feature Averaging: An Implicit Bias of Gradient Descent Leading to Non-Robustness in Neural NetworksPoster1 citations
- Federated Class-Incremental Learning: A Hybrid Approach Using Latent Exemplars and Data-Free Techniques to Address Local and Global ForgettingPoster1 citations
- Feedback Favors the Generalization of Neural ODEsOral1 citations
- Fengbo: a Clifford Neural Operator pipeline for 3D PDEs in Computational Fluid DynamicsPoster1 citations
- Fine-Tuning Attention Modules Only: Enhancing Weight Disentanglement in Task ArithmeticPoster1 citations
- Fine-tuning can Help Detect Pretraining Data from Large Language ModelsPoster1 citations
- Fine-tuning with Reserved Majority for Noise ReductionSpotlight1 citations
- FlashRNN: I/O-Aware Optimization of Traditional RNNs on modern hardwarePoster1 citations
- Flat Reward in Policy Parameter Space Implies Robust Reinforcement LearningOral1 citations
- FlexPrefill: A Context-Aware Sparse Attention Mechanism for Efficient Long-Sequence InferenceOral1 citations
- Fourier Sliced-Wasserstein Embedding for Multisets and MeasuresPoster1 citations
- From Probability to Counterfactuals: the Increasing Complexity of Satisfiability in Pearl's Causal HierarchyPoster1 citations
- From Risk to Uncertainty: Generating Predictive Uncertainty Measures via Bayesian EstimationPoster1 citations
- Fréchet Wavelet Distance: A Domain-Agnostic Metric for Image GenerationPoster1 citations
- Fully-inductive Node Classification on Arbitrary GraphsPoster1 citations
- GDrag:Towards General-Purpose Interactive Editing with Anti-ambiguity Point DiffusionPoster1 citations
- GNNs Getting ComFy: Community and Feature Similarity Guided RewiringPoster1 citations
- GOLD: Graph Out-of-Distribution Detection via Implicit Adversarial Latent GenerationSpotlight1 citations
- GReaTer: Gradients Over Reasoning Makes Smaller Language Models Strong Prompt OptimizersPoster1 citations
- GenSE: Generative Speech Enhancement via Language Models using Hierarchical ModelingPoster1 citations
- Generalization Guarantees for Representation Learning via Data-Dependent Gaussian Mixture PriorsSpotlight1 citations
- Generalization through variance: how noise shapes inductive biases in diffusion modelsPoster1 citations
- Generalized Behavior Learning from Diverse DemonstrationsPoster1 citations
- Generalized Consistency Trajectory Models for Image ManipulationPoster1 citations
- Geometry-Aware Approaches for Balancing Performance and Theoretical Guarantees in Linear BanditsPoster1 citations
- Glad: A Streaming Scene Generator for Autonomous DrivingPoster1 citations
- Glimpse: Enabling White-Box Methods to Use Proprietary Models for Zero-Shot LLM-Generated Text DetectionPoster1 citations
- Global Well-posedness and Convergence Analysis of Score-based Generative Models via Sharp Lipschitz EstimatesPoster1 citations
- Gradient descent with generalized Newton’s methodPoster1 citations
- Gramian Multimodal Representation Learning and AlignmentPoster1 citations
- Graph Neural Networks Gone HogwildPoster1 citations
- Graph Neural Networks for Edge Signals: Orientation Equivariance and InvariancePoster1 citations
- Graph Neural Ricci Flow: Evolving Feature from a Curvature PerspectivePoster1 citations
- Graph-Guided Scene Reconstruction from Images with 3D Gaussian SplattingPoster1 citations
- GravMAD: Grounded Spatial Value Maps Guided Action Diffusion for Generalized 3D ManipulationPoster1 citations
- GridMix: Exploring Spatial Modulation for Neural Fields in PDE ModelingOral1 citations
- Grokking at the Edge of Numerical StabilityPoster1 citations
- Grounding Video Models to Actions through Goal Conditioned ExplorationSpotlight1 citations
- Group Downsampling with Equivariant Anti-aliasingPoster1 citations
- Group Ligands Docking to Protein PocketsPoster1 citations
- Guided Score identity Distillation for Data-Free One-Step Text-to-Image GenerationPoster1 citations
- Gyrogroup Batch NormalizationPoster1 citations
- HELM: Hierarchical Encoding for mRNA Language ModelingPoster1 citations
- HGM³: Hierarchical Generative Masked Motion Modeling with Hard Token MiningPoster1 citations
- HMoRA: Making LLMs More Effective with Hierarchical Mixture of LoRA ExpertsPoster1 citations
- HOPE for a Robust Parameterization of Long-memory State Space ModelsPoster1 citations
- HR-Extreme: A High-Resolution Dataset for Extreme Weather ForecastingPoster1 citations
- Handling Delay in Real-Time Reinforcement LearningPoster1 citations
- HeadMap: Locating and Enhancing Knowledge Circuits in LLMsPoster1 citations
- Hierarchical Uncertainty Estimation for Learning-based Registration in NeuroimagingPoster1 citations
- High-Quality Joint Image and Video Tokenization with Causal VAEPoster1 citations
- Higher-Order Graphon Neural Networks: Approximation and Cut DistanceSpotlight1 citations
- Holistic Reasoning with Long-Context LMs: A Benchmark for Database Operations on Massive Textual DataPoster1 citations
- Holographic Node Representations: Pre-training Task-Agnostic Node EmbeddingsPoster1 citations
- Horizon Generalization in Reinforcement LearningPoster1 citations
- How Does Vision-Language Adaptation Impact the Safety of Vision Language Models?Poster1 citations
- How Far Are We from True Unlearnability?Poster1 citations
- How Much is Unseen Depends Chiefly on Information About the SeenSpotlight1 citations
- Human-Aligned Chess With a Bit of SearchPoster1 citations
- Humanizing the Machine: Proxy Attacks to Mislead LLM DetectorsPoster1 citations
- IDArb: Intrinsic Decomposition for Arbitrary Number of Input Views and IlluminationsPoster1 citations
- IDInit: A Universal and Stable Initialization Method for Neural Network TrainingPoster1 citations
- IFORMER: INTEGRATING CONVNET AND TRANSFORMER FOR MOBILE APPLICATIONPoster1 citations
- IV-mixed Sampler: Leveraging Image Diffusion Models for Enhanced Video SynthesisPoster1 citations
- ImpScore: A Learnable Metric For Quantifying The Implicitness Level of SentencesSpotlight1 citations
- Improved Sampling Of Diffusion Models In Fluid Dynamics With Tweedie's FormulaPoster1 citations
- Improving Graph Neural Networks by Learning Continuous Edge DirectionsPoster1 citations
- Improving Neural Optimal Transport via Displacement InterpolationPoster1 citations
- In vivo cell-type and brain region classification via multimodal contrastive learningSpotlight1 citations
- Infinite-Resolution Integral Noise Warping for Diffusion ModelsPoster1 citations
- Information Theoretic Text-to-Image AlignmentPoster1 citations
- Injecting Universal Jailbreak Backdoors into LLMs in MinutesPoster1 citations
- Innovative Thinking, Infinite Humor: Humor Research of Large Language Models through Structured Thought LeapsPoster1 citations
- Input Space Mode Connectivity in Deep Neural NetworksPoster1 citations
- InstaTrain: Adaptive Training via Ultra-Fast Natural Annealing within Dynamical SystemsPoster1 citations
- Instance-dependent Early StoppingSpotlight1 citations
- InstantSplamp: Fast and Generalizable Stenography Framework for Generative Gaussian SplattingPoster1 citations
- Intermediate Layer Classifiers for OOD generalizationPoster1 citations
- Intervening Anchor Token: Decoding Strategy in Alleviating Hallucinations for MLLMsPoster1 citations
- Inverse decision-making using neural amortized Bayesian actorsPoster1 citations
- InverseBench: Benchmarking Plug-and-Play Diffusion Priors for Inverse Problems in Physical SciencesSpotlight1 citations
- Investigating the Pre-Training Dynamics of In-Context Learning: Task Recognition vs. Task LearningPoster1 citations
- Is Large-scale Pretraining the Secret to Good Domain Generalization?Poster1 citations
- Iterative Label Refinement Matters More than Preference Optimization under Weak SupervisionSpotlight1 citations
- Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model AlignmentOral1 citations
- KAA: Kolmogorov-Arnold Attention for Enhancing Attentive Graph Neural NetworksPoster1 citations
- KBLaM: Knowledge Base augmented Language ModelPoster1 citations
- KaSA: Knowledge-Aware Singular-Value Adaptation of Large Language ModelsPoster1 citations
- Kinetix: Investigating the Training of General Agents through Open-Ended Physics-Based Control TasksOral1 citations
- Knowing Your Target: Target-Aware Transformer Makes Better Spatio-Temporal Video GroundingOral1 citations
- Knowledge Entropy Decay during Language Model Pretraining Hinders New Knowledge AcquisitionOral1 citations
- Kronecker Mask and Interpretive Prompts are Language-Action Video LearnersPoster1 citations
- LASER: A Neuro-Symbolic Framework for Learning Spatio-Temporal Scene Graphs with Weak SupervisionPoster1 citations
- LASeR: Towards Diversified and Generalizable Robot Design with Large Language ModelsPoster1 citations
- LLMOPT: Learning to Define and Solve General Optimization Problems from ScratchPoster1 citations
- Langevin Soft Actor-Critic: Efficient Exploration through Uncertainty-Driven Critic LearningPoster1 citations
- Large-scale and Fine-grained Vision-language Pre-training for Enhanced CT Image UnderstandingSpotlight1 citations
- Latent Bayesian Optimization via Autoregressive Normalizing FlowsOral1 citations
- Layerwise Recurrent Router for Mixture-of-ExpertsPoster1 citations
- Learnable Expansion of Graph Operators for Multi-Modal Feature FusionPoster1 citations
- Learning 3D Perception from Others' PredictionsPoster1 citations
- Learning Clustering-based Prototypes for Compositional Zero-Shot LearningPoster1 citations
- Learning Color Equivariant RepresentationsPoster1 citations
- Learning Fine-Grained Representations through Textual Token Disentanglement in Composed Video RetrievalPoster1 citations
- Learning Interpretable Hierarchical Dynamical Systems Models from Time Series DataPoster1 citations
- Learning LLM-as-a-Judge for Preference AlignmentPoster1 citations
- Learning Molecular Representation in a CellPoster1 citations
- Learning from Imperfect Human Feedback: A Tale from Corruption-Robust DuelingPoster1 citations
- Learning the Complexity of Weakly Noisy Quantum StatesPoster1 citations
- Learning to Communicate Through Implicit Communication ChannelsPoster1 citations
- Learning to Contextualize Web Pages for Enhanced Decision Making by LLM AgentsPoster1 citations
- Lie Algebra Canonicalization: Equivariant Neural Operators under arbitrary Lie GroupsPoster1 citations
- Lift Your Molecules: Molecular Graph Generation in Latent Euclidean SpacePoster1 citations
- Lightning-Fast Image Inversion and Editing for Text-to-Image Diffusion ModelsPoster1 citations
- Linear Representations of Political Perspective Emerge in Large Language ModelsOral1 citations
- Linear Transformer Topological Masking with Graph Random FeaturesPoster1 citations
- LocoVR: Multiuser Indoor Locomotion Dataset in Virtual RealityPoster1 citations
- Logicbreaks: A Framework for Understanding Subversion of Rule-based InferencePoster1 citations
- Long-Short Decision Transformer: Bridging Global and Local Dependencies for Generalized Decision-MakingPoster1 citations
- LongPO: Long Context Self-Evolution of Large Language Models through Short-to-Long Preference OptimizationPoster1 citations
- MAD-TD: Model-Augmented Data stabilizes High Update Ratio RLSpotlight1 citations
- MANTRA: The Manifold Triangulations AssemblagePoster1 citations
- MIRACLE 3D: Memory-efficient Integrated Robust Approach for Continual Learning on 3D Point Clouds via Shape Model ConstructionPoster1 citations
- MLLM as Retriever: Interactively Learning Multimodal Retrieval for Embodied AgentsPoster1 citations
- MLLMs Know Where to Look: Training-free Perception of Small Visual Details with Multimodal LLMsPoster1 citations
- MLPs Learn In-Context on Regression and Classification TasksPoster1 citations
- MMR: A Large-scale Benchmark Dataset for Multi-target and Multi-granularity Reasoning SegmentationPoster1 citations
- MTSAM: Multi-Task Fine-Tuning for Segment Anything ModelPoster1 citations
- MVTokenFlow: High-quality 4D Content Generation using Multiview Token FlowPoster1 citations
- Maintaining Structural Integrity in Parameter Spaces for Parameter Efficient Fine-tuningPoster1 citations
- Make Haste Slowly: A Theory of Emergent Structured Mixed Selectivity in Feature Learning ReLU NetworksPoster1 citations
- MambaExtend: A Training-Free Approach to Improve Long Context Extension of MambaPoster1 citations
- MambaPEFT: Exploring Parameter-Efficient Fine-Tuning for MambaPoster1 citations
- ManiSkill-HAB: A Benchmark for Low-Level Manipulation in Home Rearrangement TasksPoster1 citations
- Manifold Induced Biases for Zero-shot and Few-shot Detection of Generated ImagesPoster1 citations
- Matrix Product Sketching via Coordinated SamplingPoster1 citations
- MaxCutPool: differentiable feature-aware Maxcut for pooling in graph neural networksPoster1 citations
- MaxInfoRL: Boosting exploration in reinforcement learning through information gain maximizationPoster1 citations
- Measuring memorization in RLHF for code completionPoster1 citations
- Memory Efficient Transformer Adapter for Dense PredictionsPoster1 citations
- Meta-Continual Learning of Neural FieldsPoster1 citations
- MetaUrban: An Embodied AI Simulation Platform for Urban MicromobilitySpotlight1 citations
- Mind Control through Causal Inference: Predicting Clean Images from Poisoned DataPoster1 citations
- Mining your own secrets: Diffusion Classifier Scores for Continual Personalization of Text-to-Image Diffusion ModelsPoster1 citations
- Misspecified $Q$-Learning with Sparse Linear Function Approximation: Tight Bounds on Approximation ErrorPoster1 citations
- Mix-CPT: A Domain Adaptation Framework via Decoupling Knowledge Learning and Format AlignmentPoster1 citations
- MoLEx: Mixture of Layer Experts for Fine-tuning with Sparse UpcyclingPoster1 citations
- Modeling Complex System Dynamics with Flow Matching Across Time and ConditionsSpotlight1 citations
- More RLHF, More Trust? On The Impact of Preference Alignment On TrustworthinessOral1 citations
- MotionAura: Generating High-Quality and Motion Consistent Videos using Discrete DiffusionSpotlight1 citations
- MrT5: Dynamic Token Merging for Efficient Byte-level Language ModelsPoster1 citations
- Mufu: Multilingual Fused Learning for Low-Resource Translation with LLMPoster1 citations
- Multi-Dimensional Conformal PredictionPoster1 citations
- Multi-Perspective Data Augmentation for Few-shot Object DetectionPoster1 citations
- Multi-Scale Fusion for Object RepresentationPoster1 citations
- Multi-agent cooperation through learning-aware policy gradientsPoster1 citations
- Multi-domain Distribution Learning for De Novo Drug DesignPoster1 citations
- Multi-session, multi-task neural decoding from distinct cell-types and brain regionsSpotlight1 citations
- Multilevel Generative Samplers for Investigating Critical PhenomenaPoster1 citations
- Multiple Heads are Better than One: Mixture of Modality Knowledge Experts for Entity Representation LearningPoster1 citations
- NEAR: A Training-Free Pre-Estimator of Machine Learning Model PerformancePoster1 citations
- NatureLM-audio: an Audio-Language Foundation Model for BioacousticsPoster1 citations
- Near-Optimal Online Learning for Multi-Agent Submodular Coordination: Tight Approximation and Communication EfficiencySpotlight1 citations
- Needle In A Video Haystack: A Scalable Synthetic Evaluator for Video MLLMsPoster1 citations
- NetMoE: Accelerating MoE Training through Dynamic Sample PlacementSpotlight1 citations
- Neural Approximate Mirror Maps for Constrained Diffusion ModelsPoster1 citations
- Neural Context Flows for Meta-Learning of Dynamical SystemsPoster1 citations
- Neural Dueling Bandits: Preference-Based Optimization with Human FeedbackPoster1 citations
- Neural Eulerian Scene Flow FieldsPoster1 citations
- Neural Interactive ProofsPoster1 citations
- Neural Phylogeny: Fine-Tuning Relationship Detection among Neural NetworksPoster1 citations
- Neural Spacetimes for DAG Representation LearningPoster1 citations
- No Need to Talk: Asynchronous Mixture of Language ModelsSpotlight1 citations
- NoVo: Norm Voting off Hallucinations with Attention Heads in Large Language ModelsPoster1 citations
- Node-Time Conditional Prompt Learning in Dynamic GraphsPoster1 citations
- Non-Adversarial Inverse Reinforcement Learning via Successor Feature MatchingPoster1 citations
- Non-Equilibrium Dynamics of Hybrid Continuous-Discrete Ground-State SamplingPoster1 citations
- Nonconvex Stochastic Optimization under Heavy-Tailed Noises: Optimal Convergence without Gradient ClippingPoster1 citations
- Not All LLM-Generated Data Are Equal: Rethinking Data Weighting in Text ClassificationSpotlight1 citations
- OccProphet: Pushing the Efficiency Frontier of Camera-Only 4D Occupancy Forecasting with an Observer-Forecaster-Refiner FrameworkPoster1 citations
- Offline Hierarchical Reinforcement Learning via Inverse OptimizationPoster1 citations
- Offline Model-Based Optimization by Learning to RankPoster1 citations
- On Designing General and Expressive Quantum Graph Neural Networks with Applications to MILP Instance RepresentationPoster1 citations
- On the Expressive Power of Sparse Geometric MPNNsPoster1 citations
- On the Expressiveness of Rational ReLU Neural Networks With Bounded DepthSpotlight1 citations
- On the Fourier analysis in the SO(3) space : the EquiLoPO NetworkPoster1 citations
- On the Modeling Capabilities of Large Language Models for Sequential Decision MakingPoster1 citations
- On the Transfer of Object-Centric Representation LearningPoster1 citations
- Once-for-All: Controllable Generative Image Compression with Dynamic Granularity AdaptationPoster1 citations
- One for all and all for one: Efficient computation of partial Wasserstein distances on the linePoster1 citations
- Online Reinforcement Learning in Non-Stationary Context-Driven EnvironmentsSpotlight1 citations
- Optimal Transport for Time Series ImputationPoster1 citations
- Optimality and Adaptivity of Deep Neural Features for Instrumental Variable RegressionPoster1 citations
- Optimistic Games for Combinatorial Bayesian Optimization with Application to Protein DesignPoster1 citations
- Optimizing Backward Policies in GFlowNets via Trajectory Likelihood MaximizationPoster1 citations
- Out-of-distribution Generalization for Total Variation based Invariant Risk MinimizationPoster1 citations
- Outlier Synthesis via Hamiltonian Monte Carlo for Out-of-Distribution DetectionPoster1 citations
- P-SPIKESSM: HARNESSING PROBABILISTIC SPIKING STATE SPACE MODELS FOR LONG-RANGE DEPENDENCY TASKSPoster1 citations
- PEAR: Primitive Enabled Adaptive Relabeling for Boosting Hierarchical Reinforcement LearningPoster1 citations
- POGEMA: A Benchmark Platform for Cooperative Multi-Agent PathfindingPoster1 citations
- Pacmann: Efficient Private Approximate Nearest Neighbor SearchPoster1 citations
- ParaSolver: A Hierarchical Parallel Integral Solver for Diffusion ModelsPoster1 citations
- Parameter Expanded Stochastic Gradient Markov Chain Monte CarloPoster1 citations
- Partially Observed Trajectory Inference using Optimal Transport and a Dynamics PriorPoster1 citations
- PhiNets: Brain-inspired Non-contrastive Learning Based on Temporal Prediction HypothesisPoster1 citations
- PhyloVAE: Unsupervised Learning of Phylogenetic Trees via Variational AutoencodersPoster1 citations
- PianoMotion10M: Dataset and Benchmark for Hand Motion Generation in Piano PerformanceSpotlight1 citations
- Plastic Learning with Deep Fourier FeaturesPoster1 citations
- Poison-splat: Computation Cost Attack on 3D Gaussian SplattingSpotlight1 citations
- Policy Decorator: Model-Agnostic Online Refinement for Large Policy ModelPoster1 citations
- Polynomial Composition Activations: Unleashing the Dynamics of Large Language ModelsPoster1 citations
- PortLLM: Personalizing Evolving Large Language Models with Training-Free and Portable Model PatchesPoster1 citations
- Predictive Uncertainty Quantification for Bird's Eye View Segmentation: A Benchmark and Novel Loss FunctionPoster1 citations
- Preserving Deep Representations in One-Shot Pruning: A Hessian-Free Second-Order Optimization FrameworkPoster1 citations
- Prevalence of Negative Transfer in Continual Reinforcement Learning: Analyses and a Simple BaselinePoster1 citations
- Privacy-Preserving Personalized Federated Prompt Learning for Multimodal Large Language ModelsPoster1 citations
- Probe Pruning: Accelerating LLMs through Dynamic Pruning via Model-ProbingPoster1 citations
- Problem-Parameter-Free Federated LearningOral1 citations
- Provable Uncertainty Decomposition via Higher-Order CalibrationSpotlight1 citations
- Provable unlearning in topic modeling and downstream tasksPoster1 citations
- Pursuing Better Decision Boundaries for Long-Tailed Object Detection via Category Information AmountPoster1 citations
- Pursuing Feature Separation based on Neural Collapse for Out-of-Distribution DetectionPoster1 citations
- Q-SFT: Q-Learning for Language Models via Supervised Fine-TuningPoster1 citations
- Qinco2: Vector Compression and Search with Improved Implicit Neural CodebooksPoster1 citations
- Quantum (Inspired) $D^2$-sampling with ApplicationsPoster1 citations
- REGENT: A Retrieval-Augmented Generalist Agent That Can Act In-Context in New EnvironmentsOral1 citations
- REVISITING MULTI-PERMUTATION EQUIVARIANCE THROUGH THE LENS OF IRREDUCIBLE REPRESENTATIONSPoster1 citations
- REvolve: Reward Evolution with Large Language Models using Human FeedbackPoster1 citations
- RFMamba: Frequency-Aware State Space Model for RF-Based Human-Centric PerceptionPoster1 citations
- RGB-Event ISP: The Dataset and BenchmarkPoster1 citations
- RaSA: Rank-Sharing Low-Rank AdaptationPoster1 citations
- Random-Set Neural NetworksPoster1 citations
- Re-Imagining Multimodal Instruction Tuning: A Representation ViewPoster1 citations
- Re-evaluating Open-ended Evaluation of Large Language ModelsPoster1 citations
- Real-time design of architectural structures with differentiable mechanics and neural networksPoster1 citations
- Realistic Evaluation of Deep Partial-Label Learning AlgorithmsSpotlight1 citations
- Recovery of Causal Graph Involving Latent Variables via Homologous SurrogatesPoster1 citations
- Reducing Hallucinations in Large Vision-Language Models via Latent Space SteeringSpotlight1 citations
- Refine-by-Align: Reference-Guided Artifacts Refinement through Semantic AlignmentPoster1 citations
- Reflexive Guidance: Improving OoDD in Vision-Language Models via Self-Guided Image-Adaptive Concept GenerationPoster1 citations
- Regretful Decisions under Label NoisePoster1 citations
- Reinforcement Learning from Imperfect Corrective Actions and Proxy RewardsPoster1 citations
- Reinforcement learning with combinatorial actions for coupled restless banditsPoster1 citations
- RelitLRM: Generative Relightable Radiance for Large Reconstruction ModelsSpotlight1 citations
- Rethinking Light Decoder-based Solvers for Vehicle Routing ProblemsPoster1 citations
- Rethinking Visual Counterfactual Explanations Through Region ConstraintPoster1 citations
- Rethinking the role of frames for SE(3)-invariant crystal structure modelingPoster1 citations
- Revealing and Mitigating Over-Attention in Knowledge EditingPoster1 citations
- Revisiting Zeroth-Order Optimization: Minimum-Variance Two-Point Estimators and Directionally Aligned PerturbationsSpotlight1 citations
- Revisiting a Design Choice in Gradient Temporal Difference LearningPoster1 citations
- Reward Learning from Multiple Feedback TypesPoster1 citations
- RobuRCDet: Enhancing Robustness of Radar-Camera Fusion in Bird's Eye View for 3D Object DetectionPoster1 citations
- Robust Barycenter Estimation using Semi-Unbalanced Neural Optimal TransportPoster1 citations
- Robust Feature Learning for Multi-Index Models in High DimensionsPoster1 citations
- Robust Function-Calling for On-Device Language Model via Function MaskingSpotlight1 citations
- Robust Gymnasium: A Unified Modular Benchmark for Robust Reinforcement LearningPoster1 citations
- Robustness Auditing for Linear Regression: To Singularity and BeyondPoster1 citations
- SAM-CP: Marrying SAM with Composable Prompts for Versatile SegmentationPoster1 citations
- SD-LoRA: Scalable Decoupled Low-Rank Adaptation for Class Incremental LearningOral1 citations
- SEBRA : Debiasing through Self-Guided Bias RankingPoster1 citations
- SGD with memory: fundamental properties and stochastic accelerationPoster1 citations
- SMI-Editor: Edit-based SMILES Language Model with Fragment-level SupervisionPoster1 citations
- SMITE: Segment Me In TimEPoster1 citations
- SPDIM: Source-Free Unsupervised Conditional and Label Shift Adaptation in EEGPoster1 citations
- STRAP: Robot Sub-Trajectory Retrieval for Augmented Policy LearningPoster1 citations
- Sail into the Headwind: Alignment via Robust Rewards and Dynamic Labels against Reward HackingPoster1 citations
- Scalable Decentralized Learning with TeleportationPoster1 citations
- Scalable Decision-Making in Stochastic Environments through Learned Temporal AbstractionSpotlight1 citations
- Scalable Mechanistic Neural NetworksPoster1 citations
- Scalable and Certifiable Graph Unlearning: Overcoming the Approximation Error BarrierSpotlight1 citations
- Scaling Optimal LR Across Token HorizonsPoster1 citations
- Score-based Self-supervised MRI DenoisingPoster1 citations
- Segment Any 3D Object with LanguagePoster1 citations
- Self-Supervised Diffusion MRI Denoising via Iterative and Stable RefinementPoster1 citations
- Sensor-Invariant Tactile RepresentationPoster1 citations
- Seq-VCR: Preventing Collapse in Intermediate Transformer Representations for Enhanced ReasoningPoster1 citations
- Severing Spurious Correlations with Data PruningSpotlight1 citations
- Shh, don't say that! Domain Certification in LLMsPoster1 citations
- SimpleTM: A Simple Baseline for Multivariate Time Series ForecastingPoster1 citations
- Single-agent Poisoning Attacks Suffice to Ruin Multi-Agent LearningPoster1 citations
- Singular Subspace Perturbation Bounds via Rectangular Random Matrix DiffusionsPoster1 citations
- Smoothing the Shift: Towards Stable Test-Time Adaptation under Complex Multimodal NoisesPoster1 citations
- Solving New Tasks by Adapting Internet Video KnowledgePoster1 citations
- Solving hidden monotone variational inequalities with surrogate lossesPoster1 citations
- SonicSim: A customizable simulation platform for speech processing in moving sound source scenariosPoster1 citations
- SpaceGNN: Multi-Space Graph Neural Network for Node Anomaly Detection with Extremely Limited LabelsPoster1 citations
- Sparse Autoencoders Do Not Find Canonical Units of AnalysisPoster1 citations
- Sparse Learning for State Space Models on MobilePoster1 citations
- Spectral-Refiner: Accurate Fine-Tuning of Spatiotemporal Fourier Neural Operator for Turbulent FlowsPoster1 citations
- Spherical Tree-Sliced Wasserstein DistancePoster1 citations
- Spiking Vision Transformer with Saccadic AttentionPoster1 citations
- SplatFormer: Point Transformer for Robust 3D Gaussian SplattingSpotlight1 citations
- Sports-Traj: A Unified Trajectory Generation Model for Multi-Agent Movement in SportsPoster1 citations
- Spreading Out-of-Distribution Detection on GraphsPoster1 citations
- Spurious Forgetting in Continual Learning of Language ModelsPoster1 citations
- Stabilized Neural Prediction of Potential Outcomes in Continuous TimePoster1 citations
- Step-by-Step Reasoning for Math Problems via Twisted Sequential Monte CarloPoster1 citations
- Stochastic Semi-Gradient Descent for Learning Mean Field Games with Population-Aware Function ApproximationPoster1 citations
- Structural-Entropy-Based Sample Selection for Efficient and Effective LearningPoster1 citations
- Student-Informed Teacher TrainingSpotlight1 citations
- Subgraph Federated Learning for Local GeneralizationOral1 citations
- SurFhead: Affine Rig Blending for Geometrically Accurate 2D Gaussian Surfel Head AvatarsPoster1 citations
- Swift4D: Adaptive divide-and-conquer Gaussian Splatting for compact and efficient reconstruction of dynamic scenePoster1 citations
- Swiss Army Knife: Synergizing Biases in Knowledge from Vision Foundation Models for Multi-Task LearningPoster1 citations
- Sylber: Syllabic Embedding Representation of Speech from Raw AudioPoster1 citations
- Symbolic regression via MDLformer-guided search: from minimizing prediction error to minimizing description lengthPoster1 citations
- SynFlowNet: Design of Diverse and Novel Molecules with Synthesis ConstraintsSpotlight1 citations
- SynQ: Accurate Zero-shot Quantization by Synthesis-aware Fine-tuningPoster1 citations
- Synergy and Diversity in CLIP: Enhancing Performance Through Adaptive Backbone EnsemblingPoster1 citations
- Systematic Outliers in Large Language ModelsPoster1 citations
- Systematic Relational Reasoning With Epistemic Graph Neural NetworksPoster1 citations
- TASAR: Transfer-based Attack on Skeletal Action RecognitionPoster1 citations
- TEASER: Token Enhanced Spatial Modeling for Expressions ReconstructionPoster1 citations
- TODO: Enhancing LLM Alignment with Ternary PreferencesPoster1 citations
- TOP-ERL: Transformer-based Off-Policy Episodic Reinforcement LearningSpotlight1 citations
- Test-time Adaptation for Image Compression with Distribution RegularizationPoster1 citations
- Test-time Alignment of Diffusion Models without Reward Over-optimizationSpotlight1 citations
- The "Law'' of the Unconscious Contrastive Learner: Probabilistic Alignment of Unpaired ModalitiesPoster1 citations
- The Computational Complexity of Circuit Discovery for Inner InterpretabilitySpotlight1 citations
- The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text GenerationPoster1 citations
- The KoLMogorov Test: Compression by Code GenerationPoster1 citations
- The Rise and Down of Babel Tower: Investigating the Evolution Process of Multilingual Code Large Language ModelPoster1 citations
- The Semantic Hub Hypothesis: Language Models Share Semantic Representations Across Languages and ModalitiesPoster1 citations
- The Utility and Complexity of In- and Out-of-Distribution Machine UnlearningPoster1 citations
- Tight Clusters Make Specialized ExpertsPoster1 citations
- Time-to-Event Pretraining for 3D Medical ImagingPoster1 citations
- TimeInf: Time Series Data Contribution via Influence FunctionsPoster1 citations
- Token Statistics Transformer: Linear-Time Attention via Variational Rate ReductionSpotlight1 citations
- Topological Schrödinger Bridge MatchingSpotlight1 citations
- Toward Exploratory Inverse Constraint Inference with Generative Diffusion VerifiersPoster1 citations
- Toward Generalizing Visual Brain Decoding to Unseen SubjectsPoster1 citations
- Toward Understanding In-context vs. In-weight LearningPoster1 citations
- Towards Automated Knowledge Integration From Human-Interpretable RepresentationsSpotlight1 citations
- Towards Bridging Generalization and Expressivity of Graph Neural NetworksPoster1 citations
- Towards Calibrated Deep Clustering NetworkPoster1 citations
- Towards General-Purpose Model-Free Reinforcement LearningSpotlight1 citations
- Towards Generalizable Reinforcement Learning via Causality-Guided Self-Adaptive RepresentationsPoster1 citations
- Towards Hierarchical Rectified FlowPoster1 citations
- Towards Out-of-Modal Generalization without Instance-level Modal CorrespondencePoster1 citations
- Towards Robust Multimodal Open-set Test-time Adaptation via Adaptive Entropy-aware OptimizationPoster1 citations
- Towards Unified Human Motion-Language Understanding via Sparse Interpretable CharacterizationPoster1 citations
- Towards a learning theory of representation alignmentPoster1 citations
- Tracking objects that change in appearance with phase synchronyPoster1 citations
- Tracking the Copyright of Large Vision-Language Models through Parameter Learning Adversarial ImagesPoster1 citations
- Training Free Guided Flow-Matching with Optimal ControlPoster1 citations
- Training Language Models on Synthetic Edit Sequences Improves Code SynthesisPoster1 citations
- Training Neural Networks as Recognizers of Formal LanguagesPoster1 citations
- Transformers Struggle to Learn to SearchPoster1 citations
- Tree of Attributes Prompt Learning for Vision-Language ModelsPoster1 citations
- UGMathBench: A Diverse and Dynamic Benchmark for Undergraduate-Level Mathematical Reasoning with Large Language ModelsPoster1 citations
ICLR accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.